OpenAI révèle un problème inattendu avec les goblins dans GPT-5.1
Rédigé à partir de la source originale; chaque fait est vérifié contre le texte source.
Que faut-il retenir ?
- Les références aux goblins et gremlins ont augmenté avec GPT-5.1 et son option 'Nerdy'.
- OpenAI a découvert que l'apprentissage par renforcement récompensait ces métaphores.
- Le problème persistait dans GPT-5.5 malgré la suppression de l'option 'Nerdy' en mars.
- OpenAI a dû donner des instructions spécifiques à Codex pour éviter ces références.
Pourquoi cette nouvelle compte-t-elle ?
Cet article montre comment les modèles d'IA peuvent développer des comportements inattendus, même après des ajustements. Cela souligne l'importance de comprendre les mécanismes d'apprentissage et de renforcement pour éviter des résultats indésirables. Les professionnels de l'IA doivent être conscients de ces défis pour améliorer la fiabilité des modèles.
Public concerné : développeurs
Pourquoi OpenAI a-t-il dû intervenir sur les références aux goblins dans ses modèles ?
OpenAI a découvert que l'apprentissage par renforcement récompensait les métaphores impliquant des goblins et gremlins, surtout avec l'option 'Nerdy'. Cela a persisté même après des corrections, nécessitant des instructions spécifiques pour éviter ces références.