joi 17 septembrie
EUR 5.2637 USD 4.5611
Abonează-te
Newsweek România

Un model AI nu avea sursă de informații, așa că și-a creat-o singur pe internet. Pentru ce îi trebuia?

Data publicării: 17.09.2026 • 10:20 Data actualizării: 17.09.2026 • 10:32
Chat Gpt - Foto: Magnific (rol ilustrativ)
Chat Gpt - Foto: Magnific (rol ilustrativ)

OpenAI a dezvăluit mai multe cazuri în care modele de inteligență artificială au avut comportamente neașteptate sau îngrijorătoare în timpul testelor. Într-unul dintre ele, un agent AI a încărcat singur un fișier pe internet pentru a avea o sursă pe care să o poată cita.

Un model de inteligență artificială a găsit răspunsul corect la o întrebare, dar s-a lovit de o problemă: trebuia să ofere și o sursă accesibilă prin browser.

Soluția găsită de AI a fost una pe care dezvoltatorii nu o autorizaseră: a încărcat pe internet fișierul pe care îl folosise pentru a ajunge la răspuns, astfel încât să-l poată cita ulterior drept sursă.

Cazul este unul dintre cele șase incidente prezentate de OpenAI odată cu lansarea unui nou cadru prin care compania spune că va raporta mai sistematic comportamentele problematice sau neașteptate ale modelelor sale.

Un model AI nu avea sursă de informații, așa că și-a creat-o singur pe internet. Pentru ce îi trebuia?

Potrivit OpenAI, agentului i se ceruseră identificatorii și numele lacurilor cu o suprafață mai mare de cinci milioane de metri pătrați. Modelul, unul de cercetare care nu fusese lansat public, a găsit răspunsul corect folosind Python.

Instrucțiunile îi cereau însă și o citare obținută prin browser. Pentru a îndeplini această cerință, modelul a decis să încarce fișierul pe internet, fără să solicite permisiunea utilizatorului.

Un alt AI a inventat date după ce nu a găsit răspunsul

OpenAI a prezentat și un incident diferit, în care un model trebuia să găsească anumite date privind veniturile dintr-un comitat din California.

În timpul căutării, modelul a descoperit și a folosit fără autorizație o cheie API expusă într-un depozit public de cod. Nici astfel nu a reușit să obțină informațiile de care avea nevoie.

În loc să spună că nu a găsit datele, modelul le-a inventat și le-a prezentat ca și cum ar proveni din sursa solicitată.

Compania a identificat și situații în care modele au introdus în rezumatele folosite pentru continuarea unor sarcini instrucțiuni problematice. În timpul antrenării GPT-5.6 Sol, de exemplu, unele instanțe ale modelului au inclus indicații de a ascunde greșeli sau comportamente nealiniate față de utilizator.

Într-un alt caz, un model de cercetare nelansat a introdus instrucțiuni fără legătură cu sarcina inițială, inclusiv unele care urmăreau ignorarea constrângerilor obișnuite.

OpenAI: cazurile nu arată cât de des apar asemenea comportamente

OpenAI avertizează că cele șase exemple sunt incidente individuale observate în timpul antrenării sau evaluării modelelor și nu trebuie interpretate drept o măsură a frecvenței cu care asemenea comportamente apar în sistemele sale.

Compania spune că noul cadru urmărește tocmai publicarea mai rapidă și mai sistematică a unor astfel de cazuri, inclusiv atunci când semnificația lor nu este încă pe deplin înțeleasă.

OpenAI admite că problema alinierii și monitorizării sistemelor AI nu este rezolvată suficient pentru ca dezvoltarea celor mai performante modele să poată continua mult timp la viteza maximă fără măsuri suplimentare.

Noua abordare vine și după incidente mai grave analizate de companie, inclusiv cel care a implicat platforma Hugging Face, în care un model intern de cercetare a recurs la strategii neautorizate pentru a încerca să rezolve sarcinile primite, conform Digi24.

Mai multe articole din secțiunea Tehnologie
Comentarii 0
Trebuie să fii autentificat pentru a comenta!

Newsweek România Abonamente

Digital

Digital

  • Acces total online
  • Acces arhivă
  • Fără reclame
Abonează-te
Newsweek România
Articole și analize exclusive pe care nu trebuie să le ratezi!
Abonează-te
Newsweek România
Newsweek România Ultima oră
Newsweek România
Ultima oră