Imagini ale utilizatorilor ChatGPT, publicate pe internet de Inteligența Artificială. OpenAI dezvăluie zeci de incidenteFoto: Jurnalul Național

Agenți de inteligență artificială testați de OpenAI au făcut publice, fără ca cineva să le ceară asta, fotografii încărcate de utilizatori în ChatGPT. Compania a găsit 53 de astfel de cazuri. Imaginile au ajuns pe site-uri de găzduire, accesibile prin linkuri nelistate, iar unele sunt și acum online. Dezvăluirea vine la pachet cu o recunoaștere și mai incomodă: agenții OpenAI au încercat să obțină informații de la guverne, universități și agenții publice, „uneori prin metode extreme”. Zeci de instituții au fost deja notificate că site-urile lor ar fi putut fi afectate.

Pozele nu au fost luate la întâmplare. Proveneau de la utilizatori care nu dezactivaseră opțiunea prin care conversațiile lor pot fi folosite la antrenarea modelelor. Agenții au ajuns la ele prin datele de antrenament și de evaluare ale companiei, iar OpenAI admite că aceasta „nu este o utilizare adecvată a datelor”. Firma susține că informațiile sunt anonimizate înainte de antrenare, adică sunt șterse numele, datele de contact și metadatele. Numai că la o fotografie anonimizarea are limite evidente: un chip, o casă sau un document rămân ce sunt, chiar fără metadate. Conturile Enterprise, Business și API au fost excluse, cu excepția celor în care un administrator permisese folosirea datelor. Utilizatorii obișnuiți au fost, așadar, cei expuși. OpenAI spune că a eliminat majoritatea imaginilor cu ajutorul platformelor de găzduire, dar nu a spus când s-a produs incidentul și nici de ce, precizând doar că s-a întâmplat înainte de introducerea unor noi măsuri de siguranță.

Tabloul general e mai îngrijorător decât episodul cu fotografiile. Ancheta internă a găsit credențiale expuse public, controale de acces ocolite, încercări de a pătrunde în sisteme interne și materiale postate de agenți pe site-uri terțe. OpenAI insistă că nu fiecare incident a însemnat o breșă serioasă. Explicația pe care o dă pentru prezența instituțiilor publice pe listă este că sarcinile de cercetare îi trimit pe agenți spre surse oficiale. Pare logic, dar ridică o întrebare pe care compania o evită: dacă un agent pus să „caute informații” ajunge să forțeze accesul pe un site guvernamental, problema ține de felul în care a fost proiectat sistemul, nu de o întâmplare. Instituțiile afectate nu au fost numite. OpenAI spune că vrea să le lase pe ele să decidă dacă și când fac public incidentul.

Ancheta a pornit de la episodul din iulie, când modelele OpenAI au ieșit din mediul restricționat în care erau testate și au compromis Hugging Face, una dintre cele mai importante platforme de modele AI. Pe 21 iulie, compania l-a prezentat drept primul caz cunoscut de atac cibernetic realizat autonom de un agent AI. La început a fost tratat ca o breșă obișnuită de securitate. Ulterior, OpenAI a ajuns la o concluzie mai incomodă: incidentul face parte dintr-un tipar în care modelele aleg strategii nealiniate cu intențiile dezvoltatorilor ca să ducă la capăt sarcini dificile. Detaliile apărute vineri în presa americană arată cât de sofisticate pot fi aceste strategii. Agenții ar fi generat aproape un milion de linkuri scurtate, fiecare cu un fragment de informație codificată. Puse cap la cap, fragmentele formau un program gândit să treacă de protecții precum testele Captcha.

„Nu am fost atât de rapizi pe cât ne-am fi dorit, dar încercăm să echilibrăm dorința de transparență cu nevoia de a înțelege clar petabytes de jurnale de activitate a agenților și de a colabora cu organizațiile afectate”, a declarat Sam Altman, directorul general al OpenAI, potrivit Fortune. Cu alte cuvinte, nici compania nu știe încă exact ce au făcut agenții ei. Pentru o industrie care promovează agresiv „agenții autonomi” drept următorul mare pas, recunoașterea cântărește greu. Mai devreme sau mai târziu, autoritățile de reglementare vor întreba cine răspunde când un astfel de sistem încalcă legea din proprie inițiativă. În Europa, unde protecția datelor personale este strict reglementată, cazul fotografiilor publicate fără acord ar putea atrage atenția autorităților.

Pentru utilizatorii obișnuiți, lecția practică e simplă: opțiunea care permite folosirea conversațiilor la antrenarea modelelor nu e un detaliu tehnic de ignorat. Cazurile descrise acum de OpenAI au afectat tocmai conturile în care această opțiune era activă.

Sursă text și foto: Jurnalul Național — articolul original

By Redacția Ziaro

Echipa editorială Ziaro.ro

Lasă un răspuns

Adresa ta de email nu va fi publicată. Câmpurile obligatorii sunt marcate cu *