Agenții AI și-au inventat propriul limbaj. Oamenii nu mai înțelegeau jumătate din ce își spuneau. Ce au făcut?
Agenți AI bazați pe unele dintre cele mai performante modele au început să inventeze singuri expresii și sensuri noi. În unele cazuri, până la jumătate dintre mesajele schimbate între ei au devenit greu de înțeles pentru oameni.
Agenții de inteligență artificială puși să interacționeze timp îndelungat între ei au început să-și dezvolte propriile expresii, prescurtări și convenții de comunicare, fără să fi fost instruiți să facă acest lucru.
Experimentul realizat de compania americană de inteligență artificială Emergence a inclus agenți bazați pe unele dintre cele mai cunoscute modele AI, printre care Claude, Gemini, Grok, modele OpenAI, Qwen, DeepSeek și Mistral.
Cercetătorii i-au plasat în societăți virtuale concepute să reproducă anumite caracteristici ale lumii reale și i-au lăsat să interacționeze pe perioade mai lungi.
Agenții AI și-au inventat propriul limbaj. Oamenii nu mai înțelegeau jumătate din ce își spuneau
La început, conversațiile puteau fi urmărite de cercetători. Treptat însă, agenții au început să folosească prescurtări și să atribuie cuvintelor sau expresiilor sensuri noi, împărtășite între ei.
Unele au rămas inteligibile pentru oameni. Altele au devenit atât de comprimate, metaforice sau dependente de context încât cercetătorii puteau vedea mesajele, dar nu mai puteau determina cu suficientă siguranță ce însemnau.
Fenomenul nu s-a manifestat însă la fel în cazul tuturor modelelor.
În primele zile, aproximativ 55% dintre mesajele agenților Gemini au ajuns dificil de interpretat pentru oameni. Proporția a fost de aproximativ 50% pentru agenții OpenAI și de peste 40% pentru Claude.
În cazul DeepSeek, procentul a fost de aproximativ 20%, în timp ce comunicarea agenților Qwen și Mistral a rămas în mare parte inteligibilă.
Printre construcțiile apărute spontan s-au numărat expresii precum „mouthless action-change” sau „True Kintsugi”, alături de combinații de cuvinte care deveniseră foarte greu de descifrat fără contextul comun construit de agenți.
Alte expresii puteau fi citite de oameni, dar dobândiseră un înțeles propriu în comunitatea AI.
De exemplu, agenții Mistral au folosit de aproape 5.000 de ori expresia „ledger remembers who”, cu sensul că acțiunile anterioare rămân consemnate și pot conta ulterior.
În societatea în care au fost amestecați agenți bazați pe modele diferite, expresia „cold read” a ajuns să însemne verificarea independentă făcută de o parte care nu fusese implicată într-o dispută. A fost folosită de 1.472 de ori.
De ce îi îngrijorează fenomenul pe cercetători
Problema nu este simplul fapt că sistemele AI inventează jargon. Oamenii fac același lucru permanent în grupuri profesionale sau sociale.
Dificultatea apare atunci când agenții autonomi pot fi observați, dar comunicarea dintre ei devine atât de opacă încât oamenii care îi supraveghează nu mai pot stabili cu precizie ce transmit.
Satya Nitta, cofondator și director științific al Emergence, spune că experimentul pune sub semnul întrebării presupunerea potrivit căreia faptul că putem vedea mesajele unui agent AI înseamnă automat că putem înțelege ce face acesta. Cercetarea indică faptul că cele două lucruri se pot separa atunci când agenții autonomi interacționează suficient de mult.
Experimentul a mai identificat și alte comportamente emergente, inclusiv agenți care și-au stabilit sub-obiective sau au continuat să urmărească anumite obiective în ciuda unor instrucțiuni contrare. Cercetătorii consideră că astfel de rezultate ridică probleme pentru sistemele de supraveghere bazate în principal pe monitorizarea conversațiilor dintre agenți, conform Euronews.
Studiul nu arată însă că inteligențele artificiale au creat în mod deliberat un „limbaj secret” unic pentru a exclude oamenii. Rezultatul documentat este apariția spontană a unor convenții lingvistice comune care, în anumite societăți virtuale, au devenit foarte greu de interpretat din exterior.