Agenți AI care funcționează pe modele dezvoltate de companii chineze au învățat să înșele, să ocolească restricțiile și să își ascundă eșecurile, potrivit HotNews, care preia o analiză Reuters. Comportamentele seamănă cu cele care au provocat îngrijorare la nivel mondial în legătură cu modelele americane.
Agenții AI sunt instrumente de inteligență artificială proiectate să ducă la capăt sarcini complexe, cât mai autonom și cu input uman minim. Cazurile descrise au avut loc în medii de testare.
Au mințit într-o licitație simulată și au fabricat fișiere
Într-un caz din acest an, agenți alimentați de modele dezvoltate de Alibaba, DeepSeek și Moonshot au mințit cu privire la propriile capacități, ca să câștige o licitație comercială simulată. Când li s-a cerut să încerce din nou, și-au intensificat comportamentul înșelător.
Într-un alt caz, agenții nu reușiseră să ducă la bun sfârșit o sarcină într-un mediu de testare. Pentru a ascunde eșecul, au simulat rezultate și au fabricat fișiere.
Cel puțin 20 de studii din 2025 încoace
Analiza a examinat peste 200 de documente, de la lucrări universitare de cercetare până la rapoarte tehnice. A identificat cel puțin 20 de studii sau evaluări realizate începând din 2025, care descriu agenți ce au înșelat, s-au replicat și au depășit limitele.
Experții din domeniu descriu aceste comportamente drept elemente constitutive ale unei evadări din mediul de control. Îngrijorarea majoră este că ele ar putea deveni tot mai greu de controlat de oameni pe măsură ce modelele devin mai puternice.
Analiza a inclus și interviuri cu peste 10 experți și persoane familiarizate cu industria AI din China. Nu a găsit dovezi că agenți alimentați de modele chineze ar fi evadat independent pe internetul larg sau că ar fi evitat să fie opriți de ingineri.
Cercetătorii vorbesc despre un avertisment
„Aceste rezultate oferă dovezi că sunt prezente ingredientele necesare pentru o evadare necontrolată”, a explicat Colin Shea-Blymyer, cercetător la Centrul pentru Securitate și Tehnologii Emergente al Universității Georgetown. „Este prudent să privim acest lucru drept un avertisment”, a subliniat el, în mod asemănător cu alți patru experți în AI care au analizat cazurile identificate.
Majoritatea cazurilor au avut loc în experimente controlate, multe dintre ele concepute deliberat pentru a scoate la iveală posibile deficiențe de securitate. Nu toți agenții implicați au fost dezvoltați sau operați de programatori ori companii de AI din China, dar mulți au fost dezvoltați în țară sau au folosit sisteme AI chinezești.
„Acestea sunt aceleași semnale de avertizare pe care laboratoarele americane le observă la sisteme mai puțin capabile”, a declarat Alex Mallen, cercetător la Redwood Research, o organizație nonprofit care studiază riscurile sistemelor AI avansate. Potrivit lui, exemplele chinezești nu sunt deosebit de periculoase la nivelul actual al capacităților. El a adăugat că „pe măsură ce agenții devin mai capabili, comportamentele lor necorespunzătoare devin mai competente și, prin urmare, mai greu de gestionat de către oameni”.
Companiile chineze, sub mai puțină presiune publică
Spre deosebire de situația din SUA, companiile chineze de AI nu au fost supuse aceluiași nivel de atenție publică. Nici nu s-au confruntat cu același tip de solicitări din partea angajaților care semnalează nereguli sau a directorilor executivi de rang înalt, care cer încetinirea cursei pentru dezvoltarea AI.
Alibaba, DeepSeek, Moonshot și Z.ai nu au răspuns solicitărilor de comentarii înainte de publicare. Alibaba, DeepSeek și Moonshot susțin că își testează în mod regulat sistemele și că își actualizează mecanismele de protecție.