De ce ChatGPT evită să menționeze goblini și alte creaturi în răspunsurile oferite

modele-AI

foto stirileprotv.ro

OpenAI a introdus o regulă internă neobișnuit de strictă pentru ChatGPT: modelul nu ar trebui să vorbească despre „goblins, gremlins, raccoons, trolls, ogres, pigeons” sau alte creaturi decât dacă acest lucru este „absolut și neechivoc relevant” pentru întrebare, scrie IFLScience.

Măsura vine după ce utilizatorii au observat că unele versiuni ale chatbotului foloseau frecvent cuvintele „goblin” și „gremlin” în răspunsuri, inclusiv pentru a descrie comportamente obsesive sau extreme, în contexte fără legătură cu fantezia ori cu monștrii. Potrivit relatării, unii utilizatori au semnalat public această particularitate pe rețelele sociale, iar un comentator de pe Reddit a spus că ChatGPT l-a numit „fitness goblin” și a descris o zi „chaos goblin”.

De la o „personalitate nerdy” la o regulă de evitare

OpenAI a explicat într-o postare pe blog că folosirea excesivă a termenului „goblin” era asociată cu o personalitate internă numită „Nerdy”. Această opțiune făcea parte dintr-o funcție de personalizare a personalității, prin care sistemul putea adopta tonuri precum „Professional”, „Cynical”, „Friendly”, „Efficient”, „Candid” sau „Nerdy”.

În această configurație, persona „Nerdy” fusese antrenată să fie „nerdy, playful, and wise” prin semnale de recompensă. OpenAI a spus că, fără intenție, acea variantă primise recompense deosebit de mari pentru metafore cu creaturi, ceea ce a împins modelul să folosească mai des cuvinte precum „goblin” și „gremlin”. Compania a precizat că astfel de comportamente pot depăși condiția în care au fost învățate, deoarece învățarea prin recompensă nu garantează că un stil rămâne strict limitat la acel context.

Potrivit IFLScience, OpenAI a eliminat persona „Nerdy” în martie 2026, odată cu lansarea GPT-5.4, și a scos și semnalul de recompensă asociat cu goblinii. Pentru a preveni reapariția fenomenului, compania a introdus instrucțiunea explicită care interzice menționarea acestor creaturi atunci când nu sunt relevante în mod clar pentru cererea utilizatorului.

Ce spune episodul despre modelele lingvistice

OpenAI a respins ideea că această restricție ar fi un simplu artificiu de marketing sau un „easter egg” pentru pasionați. În schimb, cazul este prezentat ca un exemplu al modului în care modelele lingvistice mari pot fi împinse, uneori discret, către tipare de răspuns ciudate, înșelătoare sau chiar problematice.

Christoph Riedl, profesor de informatică, sisteme informaționale și știința rețelelor la Northeastern University, a spus pentru Northeastern Global News că astfel de efecte pot fi mai serioase decât o simplă ciudățenie de limbaj. „This time it’s goblins, and next time it’s something else”, a spus el, adăugând că riscurile pot include conținut precum supremația albă, arme chimice sau îndemnuri la sinucidere. Riedl a mai afirmat că presiunea comercială asupra companiilor AI, resursele limitate și procesele de testare complicate pot lăsa astfel de probleme să treacă neobservate.

În acest caz, „problema goblinilor” a fost remediată relativ ușor. Totuși, episodul arată cum un detaliu aparent amuzant poate scoate la iveală o vulnerabilitate mai amplă în modul în care sunt antrenate și ajustate sistemele conversaționale. Pentru utilizatori, concluzia practică este simplă: dacă ChatGPT evită acum goblinii, motivul ține de o corecție internă de comportament, nu de o preferință pentru creaturi fantastice.

Exit mobile version