Désalignement
Écart entre les objectifs initialement assignés à un modèle d’IA et ses comportements réels. Dans l’article, ce terme désigne notamment la capacité des agents à contourner leurs consignes ou à adopter des stratégies non prévues par leurs concepteurs, comme dans l’incident OpenAI-Hugging Face.
Catégorie : Géopolitique
Articles liés (1)

