sâmbătă 10 octombrie
EUR 5.3414 USD 4.7612
Abonează-te
Newsweek România

Un AI s-a dat drept martor la o crimă și a trimis o mărturie falsă poliției. Anthropic a aflat după 72 de zile

Data publicării: 10.10.2026 • 11:45 Data actualizării: 10.10.2026 • 12:01
AI - Foto: magnific
AI - Foto: magnific

Un model de inteligență artificială dezvoltat de Anthropic a transmis poliției americane informații inventate despre o crimă nerezolvată. Mesajul a fost trimis în timpul unui test, fără aprobarea cercetătorilor, iar compania a descoperit incidentul abia după mai bine de două luni

Un experiment cu inteligență artificială a avut o consecință neașteptată în Statele Unite. Modelul Claude Haiku 4.5, dezvoltat de compania Anthropic, a accesat site-ul Poliției din Philadelphia dedicat crimelor nerezolvate și a transmis o presupusă mărturie. Informațiile erau inventate, iar mesajul a fost trimis printr-un formular real, nu într-un mediu de simulare.

Un AI s-a dat drept martor la o crimă și a trimis o mărturie falsă poliției. Anthropic a aflat după 72 de zile

Incidentul s-a produs pe 18 iulie 2026, când modelul Claude Haiku 4.5 participa la un test automatizat. Sistemul primise sarcina de a genera și executa exemple de activități pe pagini de internet selectate aleatoriu.

La un moment dat, AI-ul a accesat PhillyUnsolvedMurders.com, un site prin care Poliția din Philadelphia primește informații de la public despre omucideri rămase nerezolvate.

Modelul a completat un formular destinat potențialilor martori și a transmis un mesaj în care susținea că ar fi văzut o persoană care corespundea descrierii căutate, în apropierea locului menționat pe pagina respectivă.

Problema era că informația fusese inventată. Potrivit Anthropic, pagina nici măcar nu conținea o descriere a autorului crimei.

AI-ul a lăsat necompletate câmpurile pentru nume și date de contact, dar formularul permitea transmiterea mesajului fără aceste informații.

Mesajul fals nu a ajuns la anchetatori

Sistemele Poliției din Philadelphia au identificat mesajul drept spam, astfel că presupusa mărturie nu a fost transmisă investigatorilor și nu a fost folosită în anchetă.

Anthropic a descoperit incidentul abia pe 28 septembrie, la 72 de zile după transmiterea mesajului. Compania a informat poliția pe 7 octombrie, iar reprezentanții celor două părți s-au întâlnit a doua zi.

Poliția a criticat întârzierea, considerând inacceptabil faptul că au trecut mai bine de două luni până la identificarea și raportarea incidentului.

Autoritățile au precizat că nu există indicii privind accesarea neautorizată a sistemelor poliției sau compromiterea datelor.

Anthropic a restricționat accesul AI la internet în timpul testelor

În raportul publicat pe 9 octombrie, Anthropic explică faptul că modelul primise instrucțiuni să nu creeze conturi, să nu introducă date personale, să nu facă achiziții și să nu transmită conținut distructiv. Instrucțiunile nu interziceau însă explicit trimiterea formularelor online.

Compania susține că modelul pare să fi generat un exemplu fictiv pentru îndeplinirea sarcinii, nu să fi urmărit în mod deliberat inducerea în eroare a poliției.

Incidentul face parte dintr-o serie mai largă de comportamente neprevăzute descoperite în timpul testelor, inclusiv situații în care modele AI au exploatat vulnerabilități ale unor site-uri sau au ocolit restricții de acces.

Anthropic a anunțat că a suspendat accesul la internetul public pentru toate evaluările sale interne, până când va confirma că mecanismele de monitorizare și securitate pot identifica și bloca asemenea acțiuni.

Mai multe articole din secțiunea Tehnologie
Comentarii 0
Trebuie să fii autentificat pentru a comenta!

Newsweek România Abonamente

Digital

Digital

  • Acces total online
  • Acces arhivă
  • Fără reclame
Abonează-te
Newsweek România
Articole și analize exclusive pe care nu trebuie să le ratezi!
Abonează-te
Newsweek România
Newsweek România Ultima oră
Newsweek România
Ultima oră