CHATGPT Goblin Glitch: Mengapa Model Berbicara Tentang Goblin dan Gremlins

18 Agustus 202621 tampilan

OpenAI menjelaskan bahwa karena loop umpan balik selama pelatihan, model GPT dan Codex mulai terobsesi memasukkan menyebutkan goblin dan gremlins. Hal ini sering muncul di preset Nerdy, dan perusahaan harus menambahkan pembatasan khusus untuk memperbaiki masalah.

CHATGPT Goblin Glitch: Mengapa Model Berbicara Tentang Goblin dan Gremlins

Perkenalan

Dalam beberapa minggu terakhir, pengguna ChatGPT telah menemukan hobi baru: mereka saling mengirim cuplikan layar lain di mana chatbot tiba-tiba mulai berbicara tentang goblin, gremlins, dan berbagai macam makhluk lainnya. Tampaknya seolah-olah jaringan saraf telah mengambil beberapa kebiasaan virus dan sekarang menyelipkan kata-kata aneh ke dalam balasan yang paling biasa. Mari kita cari tahu apa ini dan mengapa OpenAI secara resmi mengakui masalahnya.

Bagaimana pengguna memperhatikan anomali

Perilaku yang tidak biasa pertama kali dibahas di forum didedikasikan untuk GPT-5.5 dan Codex. Pengguna memasang dialog di mana model tersebut menyebutkan "mode goblin", "bandwidth goblin", dan "perf gremlin" tanpa alasan yang jelas. Awalnya, ini dianggap sebagai gangguan acak, tapi gambar terus menumpuk. Ini menjadi jelas: model itu terpaku pada kata-kata tertentu, dan ini terjadi dengan berbagai gaya komunikasi.

Satu peserta diskusi menemukan bahwa instruksi sistem Codex secara eksplisit melarang menyebutkan goblin, gremlins, rakun, troll, ogre, merpati, dan makhluk fantasi lainnya - kecuali mereka relevan dengan permintaan pengguna. Dengan kata lain, pengembang sudah menyadari masalah dan mencoba untuk berisi itu, tapi tampaknya tidak sepenuhnya.

Apa yang ditemukan OpenAI

Pada 29 April 2026, OpenAI menerbitkan artikel resmi berjudul "Dari mana Iblis berasal". Di dalamnya, perusahaan ini mengakui bahwa GPT dan Codex telah mengembangkan "kebiasaan berbicara" - model yang semakin menambahkan kata-kata seperti goblin dan gremlin bahkan ketika pengguna tidak memintanya.

Menurut data, setelah peluncuran GPT-5.1, frekuensi kata goblin di respon meningkat 175%, dan gremlin sebesar 52%. Demi masa. GPT-5.5 dibebaskan, ini telah menjadi begitu terlihat bahwa pembatasan khusus harus diperkenalkan untuk Codex. Namun, fenomena tidak bisa sepenuhnya diberantas.

Mengapa hal itu terjadi: loop umpan balik

Sam Altman, dalam reaksi publik, menyebut apa yang terjadi saat "goblin". Tapi lelucon samping, penyebab berlari lebih dalam. Audit internal menunjukkan bahwa anomali yang paling sering muncul dalam kepribadian Nerdy. Gaya ini hanya digunakan dalam 2,5% dari semua ChatGPT Respon, namun dihitung untuk 66.7% dari semua menyebutkan kata goblin. Hampir semua kasus yang bermasalah terkait khusus dengan nada "kutu buku".

Sinyal imbalan untuk mode Nerdy dalam 76.2% dari dataset secara sistematis lebih suka respon yang mengandung goblin atau gremlin daripada alternatif tanpa kata-kata itu. Dengan kata lain, model secara berkala menerima penguatan positif untuk menggunakan kata "bermain", dan bahwa penguatan melebihi sinyal lainnya.

OpenAI mendeskripsikan situasi sebagai loop umpan balik klasik: model menerima hadiah untuk sebuah gaya bermain; gaya bermain lebih sering muncul dalam menggulung data; respon serupa berakhir dalam finetuning selanjutnya; sebagai hasilnya, vertikal menjadi lebih entrenched. Dengan setiap siklus, "goblin" menjadi lebih ngotot sampai mereka mulai tergelincir ke tempat yang paling tidak pantas.

Apa artinya ini bagi pengguna

Jika Anda telah menghadapi chatbot tiba-tiba mulai untuk berbicara tentang gremlins atau menawarkan "solusi goblin", tahu bahwa itu bukan halusinasi dan bukan bagian dari imajinasimu. Perilaku ini telah direkam dan dipelajari - dan itu sepenuhnya dapat dijelaskan. OpenAI sudah bekerja untuk melunakkan efeknya, tapi mungkin butuh waktu sebelum semuanya sepenuhnya diperbaiki. Sementara itu, ini adalah pengingat besar bahwa model bahasa yang besar bukan hanya algoritma tapi sistem yang belajar dari tanggapan mereka sendiri, dan kadang-kadang proses penguatan diri itu mengarah pada keanehan penasaran.

Bagi pengguna, meskipun, ini lebih dari sebuah episode lucu daripada masalah serius. Jaringan saraf tidak menjadi lebih berbahaya karena kata-kata tentang goblin - itu hanya kadang-kadang berperilaku seperti makhluk dari The X-Files.

Pertanyaan yang sering ditanyakan

Bahan terkait

Semua bahan
ChatGPT: mengapa jaringan saraf berbicara tentang goblin dan gremlins