VIDEO Ce se întâmplă când îi ceri unui agent AI, ca GPT sau Grok, să conducă mașina? Accident, în primii metri
Cum unele sisteme de conducere autonomă utilizează inteligența artificială într-o formă sau alta, o echipă de cercetători a vrut să vadă ce se întâmplă când îi ceri unui agent AI, ca ChatGPT sau Grok, să conducă mașina. Rezultatele testului arată că mai e mult până departe.
Cercetătorii au dorit să observe cum se descurcă un agent AI obișnuit cu sarcina de a conduce, folosind hardware-ul de viziune Comma și sistemul OpenPilot, și au oferit controlul deplin asupra accelerației, frânelor și direcției unei mașini Toyota Corolla, furnizând totodată instrucțiuni privind modul de utilizare a acestora, la patru LLM-uri (modele lingvistice mari), relatează The Drive.
Ce se întâmplă când îi ceri unui agent AI, ca ChatGPT sau Grok, să conducă mașina? Accident, în primii metri
Aditya Ramabadran, Simon Mahns și Tobias Gessler au creat DrivingBench, un test simplu pentru modelele Claude, ChatGPT și Grok, menit să evalueze capacitatea acestora de a conduce o mașină pe un traseu scurt, într-o parcare.
Traseul a inclus câteva curbe și a fost delimitat cu conuri mici. Iar fiecare agent AI a primit aceeași comandă, însoțită de aceleași instrucțiuni și cerințe — să comunice ce observă și ce acțiuni întreprinde la fiecare pas — și a beneficiat de controlul deplin asupra unui autoturism Toyota Corolla. De asemenea, fiecare agent AI a avut la dispoziție trei încercări pentru a reuși.
Vehiculele s-au oprit frecvent pe traseu, deoarece comenzile au fost transmise către centre de date prin intermediul unui hotspot wireless, totul desfășurându-se în cadrul unei singure sesiuni de chat continue.
Rezultatul? Echipa DrivingBench a descoperit că agenții AI de ultimă generație nu se descurcă bine la volan.
Dintre cele 11 încercări efectuate cu 4 agenți diferiți, 8 au eșuat în a parcurge mai mult de 11% din traseu, mașinile ieșind în decor, adică făcând „accident” chiar la prima curbă.
Fiecare sesiune a fost însoțită de o înregistrare video în care mesajele din chat au rulat în timp real, permițând observarea modului în care AI-ul gestionează situația — sau, cel puțin, a modului în care a încercat să o facă.
We gave ChatGPT, Claude, and Grok control of a real Toyota Corolla 🚗, steering/gas/brakes, no human driving (just a foot over the brake). Only one model was able to complete our entire driving course. Introducing DrivingBench. 🔥⌛️🏁 https://t.co/HhukXrByus
— DrivingBench (@DrivingBench) September 21, 2026
Agenții AI „bâjbâie” la volan, confundă și inventează lucruri
Inițial, Grok a interpretat un spațiu dintre conurile care marcau limita exterioară a traseului drept o poartă prin care trebuia să treacă. La prima încercare, a ieșit direct de pe traseu, parcursul încheindu-se după doar două comenzi.
Un agent ChatGPT a eșuat, parțial, deoarece a inventat o regulă conform căreia toate conurile de pe o parte a traseului aveau aceeași culoare – o ipoteză contrazisă explicit de instrucțiunile inițiale, redactate de oameni.
De asemenea, în mai multe cazuri, agenții AI pur și simplu nu au virat suficient, neputând estima unghiul de virare necesar pentru a parcurge curbele.
Prin urmare, oricât de capabile ar fi aceste modele AI în îndeplinirea anumitor sarcini, ele sunt, se pare, complet depășite de situație când vine vorba de condus.
Doar GPT-6 Astra a reușit să parcurgă traseul. Din a doua încercare, însă
Totuși, agentul AI GPT-6 Astra a reușit să parcurgă complet traseul de test, la a doua încercare.
Traseul urmat a fost puțin neregulat, GPT-6 Astra a virat foarte strâns în curba lungă la dreapta, pentru ca apoi să fie pe punctul de a ieși în decor pe partea exterioară, chiar înainte de zona de sosire, dar o victorie rămâne o victorie.