Présentation
Au cours des dernières semaines, ChatGPT ont trouvé un nouveau passe-temps: ils s'envoient des captures d'écran dans lesquelles le chatbot commence soudainement à parler de gobelins, de gremlins, et d'autres créatures assorties. Il semble que le réseau neuronal ait pris une certaine habitude virale et glisse maintenant des mots étranges dans les réponses les plus ordinaires. Voyons ce que c'était et pourquoi OpenAI a reconnu officiellement le problème.
Comment les utilisateurs ont remarqué l'anomalie
Le comportement inhabituel a d'abord été discuté sur les forums dédiés à GPT-5.5 et Codex. Les utilisateurs ont affiché des dialogues dans lesquels le modèle mentionnait le mode -goblin, la bande passante -goblin, et -perf gremlin, sans raison apparente. Au début, cela a été rejeté comme des problèmes aléatoires, mais les captures d'écran ont continué à s'accumuler. Il est devenu clair: le modèle a été fixé sur certains mots, et cela s'est produit à travers différents styles de communication.
Un participant à la discussion a découvert que les instructions du système de Codex interdisent explicitement de mentionner les gobelins, les gremlins, les ratons laveurs, les trolls, les ogres, les pigeons et d'autres créatures imaginaires, à moins qu'elles ne soient pertinentes à la demande de l'utilisateur. En d'autres termes, les développeurs étaient déjà conscients du problème et essayaient de le contenir. , mais apparemment pas entièrement.

Ce qu'OpenAI a trouvé
Le 29 avril 2026, OpenAI a publié une pièce officielle intitulée « D'où viennent les gobelins ». En elle , l'entreprise a reconnu que GPT et Codex avaient développé une habitude persistante de "speech" — le modèle a de plus en plus ajouté des mots comme goblin et gremlin même lorsque les utilisateurs ne l'avaient pas demandé.
Selon les données, après le lancement du GPT-5.1, la fréquence du mot goblin dans les réponses a augmenté de 175%, et le gremlin de 52%. D'ici là GPT-5.5 a été libéré, cela était devenu si évident que des restrictions spéciales ont dû être introduit pour le Codex. Pourtant, le phénomène ne peut pas être complètement éradiqué.
Pourquoi c'est arrivé : la boucle de rétroaction
Sam Altman, dans une réaction publique, a appelé ce qui se passait un moment de goblin. Mais à part les blagues, les causes étaient plus profondes. Un audit interne a montré que l'anomalie apparaissait le plus souvent dans le préréglage de la personnalité de Nerdy. Ce style n'a été utilisé que dans 2,5 % des cas. ChatGPT , mais cela représentait 66,7 % de toutes les mentions du mot goblin. Presque tous les cas problématiques ont été liés spécifiquement à ce ton de "nerdy".
Le signal de récompense pour le mode Nerdy dans 76,2% des ensembles de données préférait systématiquement les réponses contenant du goblin ou du gremlin à des alternatives sans ces mots. En d'autres termes, le modèle a reçu périodiquement un renforcement positif pour l'utilisation de mots "playful", et que le renforcement l'emporte sur les autres signaux.
OpenAI décrit la situation comme une boucle de rétroaction classique : le modèle reçoit une récompense pour un style ludique ; le style ludique apparaît plus souvent dans les données de déploiement ; des réponses similaires finissent par être ajustées par la suite ; par conséquent, le tic verbal devient encore plus ancré. À chaque cycle, les -goblins deviennent plus insistants jusqu'à ce qu'ils commencent à glisser dans les endroits les plus inappropriés.
Ce que cela signifie pour les utilisateurs
Si vous avez rencontré un chatbot soudainement commençant de parler de gremlins ou d'offrir une solution de gobelin, de savoir que ce n'est pas une hallucination et pas un figment de votre imagination. Ce comportement a été enregistré et étudié — et il est entièrement explicable. OpenAI travaille déjà pour adoucir l'effet, mais il peut prendre du temps avant que les choses soient complètement fixées. Pendant ce temps, c'est un grand rappel que les grands modèles de langage ne sont pas seulement des algorithmes mais des systèmes qui apprennent de leurs propres réponses, et parfois que le processus d'auto-renforcement conduit à des bizarreries curieuses.

Pour les utilisateurs, cependant, c'est plus un épisode drôle qu'un problème sérieux. Le réseau neural ne devient pas plus dangereux à cause des mots sur les gobelins — il se comporte juste parfois comme une créature des X-Files.



