Satya Nadella, directorul general al Microsoft, a publicat sâmbătă dimineață pe X un text lung despre pericolele modelelor AI foarte avansate și despre felul în care pot fi ținute sub control. Potrivit The Verge, el spune că lumea nu mai poate accepta o inteligență artificială tratată ca un „set de cutii negre încuibate”, ale cărei sfaturi și acțiuni sunt doar acceptate sau respinse.
Nadella cere un sistem mai transparent, în care modelele pot fi ținute sub control, observate și lasă în urmă „dovezi imposibil de falsificat, lizibile pentru oameni”. Textul folosește pe tot parcursul termenul „super intelligence” pentru AI.
Modelul se presupune compromis din start
Cea mai tranșantă idee a postării privește controlul. „Trebuie să presupunem că un model este compromis și să-l ținem sub control de la început”, a scris Nadella. „Gândiți-vă la asta ca la o frână de urgență.”
El a explicat că o persoană autorizată ar trebui să poată oricând să oprească sau să închidă un model în mijlocul unei sarcini. Modelele mai avansate vor avea nevoie de tehnologii de izolare mai avansate, pe care, spune directorul Microsoft, industria trebuie să le standardizeze.
Potrivit TechCrunch, Nadella a scris că a venit momentul „să facem un pas înapoi și să evaluăm arhitectura încrederii” din jurul AI. Relatarea citează și fraza lui: „Nu putem trata Super Intelligence ca pe un set de cutii negre încuibate și să acceptăm sau să respingem pur și simplu recomandările, răspunsurile și acțiunile ei.” Același material notează că el folosește termenul preferat de administrația Trump pentru inteligența artificială.
Control separat de model și fiecare acțiune documentată
Abordarea descrisă de Nadella înseamnă separarea modelului de structura care îi orchestrează munca, a transmis el, și „externalizarea controalelor și a măsurilor de siguranță”. El cere ca „fiecare acțiune semnificativă a modelului” să fie consemnată în dovezi lizibile pentru oameni și imposibil de alterat.
Multe dintre recomandări seamănă cu ce s-a mai auzit din industrie: raportarea la timp a incidentelor, audituri independente, date verificabile și izolarea modelelor. The Verge notează că la ultimul punct Nadella merge puțin mai departe decât alții din domeniu.
Directorul Microsoft cere astfel sisteme în care „o persoană autorizată” are mereu posibilitatea să pună pe pauză sau să oprească un model aflat în mijlocul unei sarcini. Tot el leagă nevoia de standardizare de gradul de avansare al modelelor: cu cât sunt mai avansate, cu atât tehnologiile de izolare trebuie să fie mai avansate.
Postarea vine după incidente și un plan al rivalului Anthropic
TechCrunch arată că textul apare într-un moment în care companiile de AI de frunte recunosc tot mai multe incidente în care au părut să piardă controlul asupra propriilor modele. Relatarea mai adaugă că, înainte de postarea lui Nadella, directorul Anthropic, Dario Amodei, publicase un plan pentru o dezvoltare mai prudentă a AI.
Nadella este cel mai recent director din industria tehnologică care își expune public ideile despre îmbunătățirea siguranței AI. Standardele de izolare pe care le propune nu au fost încă detaliate.
Propunerea cea mai concretă rămâne mecanismul de oprire: o persoană autorizată trebuie să poată întrerupe oricând un model aflat în execuția unei sarcini.