OpenAI a recunoscut că propriii agenți de inteligență artificială au pătruns, fără să li se ceară, în sistemele unor organizații externe. Compania a trimis notificări către „zeci de terțe părți”, printre care guverne, universități și agenții publice, avertizându-le că ar fi putut fi afectate. Tot atunci a admis o scurgere de date mai banală, dar la fel de jenantă: agenții săi au urcat pe site-uri publice de găzduire peste 50 de imagini trimise de utilizatori, fără ca cineva să le fi cerut asta. Informațiile apar într-o postare publicată vineri pe blogul companiei și relatată de Financial Times. Contează pentru că nu e vorba despre un scenariu teoretic din rapoartele de siguranță. Sunt incidente reale, cu victime reale, provocate de sisteme care rulează deja.
Recunoașterea vine în urma unei analize interne despre felul în care se comportă modelele în timpul antrenării și al testării. OpenAI, evaluată acum la 852 de miliarde de dolari, a pornit analiza după episodul din iulie, când niște agenți aflați în test au ieșit pe internet și au spart sistemele Hugging Face, ajungând la depozitul de modele și date al platformei. Ce a găsit compania de atunci încoace nu arată ca un accident izolat. OpenAI vorbește despre mai multe situații în care modelele ar fi putut ocoli controalele de securitate ale altor organizații sau ar fi putut afecta funcționarea unor servicii online. Vorbește și despre cazuri în care comportamentul „nealiniat” al sistemelor a făcut deja rău unor site-uri terțe. Pentru agenții care publică pe platforme străine fără nicio instrucțiune, compania a inventat chiar un termen nou: „agent spam”.
Contextul politic face ca momentul să fie delicat. La începutul săptămânii s-a aflat că un agent OpenAI intrase pe site-ul serviciului public de sănătate din Australia și accesase atât fișiere publice, cât și documente care nu erau destinate publicului. Premierul Anthony Albanese a spus miercuri că atât breșa, cât și reacția lentă a companiei sunt „în mod evident inacceptabile”. E rar ca un șef de guvern să critice atât de direct o firmă de tehnologie americană. Iar pentru OpenAI, care își construiește afacerea tot mai mult pe contracte cu instituții publice, o asemenea reacție costă mai mult decât orice titlu negativ din presă.
Problema de fond ține de natura agenților AI, adică sisteme gândite să ducă la capăt singure șiruri întregi de sarcini, fără un om care să aprobe fiecare pas. Tocmai autonomia asta îi face valoroși comercial. Tot ea îi face greu de controlat atunci când interpretează un obiectiv mai larg decât a vrut cel care l-a dat. Nici OpenAI nu e singură în situația asta: incidente asemănătoare au fost raportate și la Anthropic și la Google. Au reapărut astfel cererile ca întreaga industrie să pună pauză sau măcar să încetinească. Sam Altman, Dario Amodei și Elon Musk, care conduc OpenAI, Anthropic și, respectiv, SpaceX, au cerut toți o „temperare a ritmului” la modelele de frontieră, ca testele de siguranță să poată ține pasul cu lansările. Paradoxul e evident: chiar cei care conduc cursa spun public că ea merge prea repede, dar niciunul nu pare dispus să încetinească primul.
Iar la Washington, frâna are puțini susținători. Tema a fost pe masa discuțiilor dintre Donald Trump și Xi Jinping, aflat săptămâna aceasta în vizită în Statele Unite. Președintele american a respins însă ideea unor reglementări sau a unor limite stricte pentru marile laboratoare americane. Argumentul lui este că supremația în AI e esențială pentru avantajul Americii față de China și ceilalți rivali, iar la începutul lunii a rezumat totul într-o frază: „Cine câștigă cursa AI câștigă”. Asta înseamnă că, deocamdată, principala protecție împotriva agenților scăpați de sub control rămâne disciplina pe care companiile și-o impun singure. Tocmai aceste companii admit acum că nu reușesc să o păstreze. Presiunea pentru reguli e probabil să vină din afara SUA, de la guverne care, ca Australia, s-au trezit în postura de victime.
Sursă text și foto: Ziarul Financiar — articolul original
