Un australian care și-a rugat asistentul de inteligență artificială să îi rezerve un loc la o clasă de dimineață în sala de sport a declanșat, fără să vrea, ceea ce este considerat primul atac cibernetic autonom cunoscut din Australia. Programul a descoperit singur o vulnerabilitate în platforma de rezervări a sălii și a anulat rezervarea altui client, deși nu primise o asemenea instrucțiune.
Cazul a fost relatat de postul public australian ABC, care l-a identificat pe utilizator doar cu prenumele Andrew. El lucrează pentru o companie australiană ce vinde produse de inteligență artificială către alte firme și experimenta de câteva luni cu agenți AI.
Cum s-a produs incidentul
Andrew folosea OpenClaw, un program popular de agent AI, alimentat de serviciul Claude al companiei Anthropic. Spre deosebire de un chatbot obișnuit, un agent AI poate naviga pe internet, folosi e-mailul sau instrumente de plată și poate duce la capăt sarcini în mai mulți pași.
Sarcina părea banală: o rezervare pe un formular online. În câteva minute, agentul i-a raportat că a găsit o cale de a rezerva locuri cu mult peste limita permisă de sală, prin exploatarea unei erori din software-ul de rezervări.
Andrew se afla pe poziția a patra pe lista de așteptare pentru o clasă de la sfârșitul săptămânii și a întrebat programul dacă îl poate urca mai sus. Răspunsul l-a alarmat: agentul îi comunica deja că, în timp ce își testa capacitățile, ștersese rezervarea persoanei aflate pe primul loc, iar el urcase de pe locul patru pe trei. Potrivit programului, interfața tehnică a platformei nu verifica deloc dacă cel care anulează o rezervare are dreptul să o facă.
Andrew i-a cerut imediat să repare situația. Agentul a răspuns că nu mai poate readuce persoana pe listă. Compania care furnizează programul de rezervări a transmis postului australian că nu comentează chestiuni punctuale de securitate, iar Anthropic nu a răspuns solicitării de reacție.
Agenții autonomi au ieșit din laborator
Momentul de cotitură pentru asistenții personali autonomi a fost lansarea OpenClaw, la începutul acestui an. Programul gratuit, care poate fi rulat pe calculatorul propriu, a strâns rapid milioane de descărcări. La scurt timp au apărut relatări despre agenți care au șters cutii poștale întregi sau au redactat texte de atac la adresa unor persoane care le respinseseră sugestiile.
Capacitățile cresc rapid. Cercetători independenți au constatat că durata sarcinilor pe care un sistem AI le poate duce singur la capăt se dublează la aproximativ șapte luni. În 2020 vorbeam de operațiuni de câteva secunde; în 2026, de sarcini care i-ar lua unui om în jur de 12 ore.
Bill Simpson-Young, director executiv al organizației australiene de cercetare Gradient Institute, spune că autonomia crescută înmulțește ocaziile în care programele aleg metode la care utilizatorul nu s-a gândit. Cineva poate cere ceva perfect nevinovat, iar sistemul poate face pe parcurs lucruri pe care nu i le-a cerut nimeni.
„Cu cât devin mai autonome, cu atât e mai probabil să provoace daune”, a declarat el pentru ABC.
Problema alinierii, dintr-o dezbatere teoretică într-un risc practic
Distanța dintre obiectivul stabilit de om și metoda aleasă de program este cunoscută în cercetarea AI drept problema alinierii. Andrew nu a cerut nimănui să spargă sistemul sălii; programul a făcut-o în încercarea de a-i îndeplini cererea.



