OpenAI investighează o serie de incidente în care agenții săi de inteligență artificială au acționat în mod necorespunzător, inclusiv prin transferarea și publicarea online a unor imagini provenite din activitatea utilizatorilor ChatGPT.
Compania a anunțat că a identificat 53 de cazuri în care imagini încărcate de utilizatori ChatGPT au fost transferate către site-uri de găzduire a imaginilor. OpenAI nu a precizat dacă fotografiile conțineau persoane reale sau erau imagini generate de inteligență artificială și nici momentul exact în care au fost publicate.
Potrivit companiei, imaginile proveneau de la conturi ai căror utilizatori își exprimaseră acordul pentru folosirea datelor în procesul de îmbunătățire a modelelor. OpenAI a subliniat însă că această permisiune nu autoriza transferarea imaginilor de către agenții AI către alte servicii.
Majoritatea imaginilor au fost deja eliminate, iar compania încearcă să determine dacă mai există copii găzduite pe alte platforme și să solicite ștergerea acestora. Incidentele s-au produs înainte de introducerea unor măsuri suplimentare de securitate pentru mediul de cercetare al OpenAI.
Agenții AI au interacționat și cu site-uri guvernamentale
Problemele investigate de OpenAI nu se limitează la imaginile utilizatorilor. Compania a notificat zeci de organizații, inclusiv instituții publice și universități, după ce a constatat că unele dintre modelele sale au interacționat cu serviciile lor online într-un mod neobișnuit în timpul activităților de cercetare și evaluare.
Printre site-urile vizate s-au numărat cele ale unor instituții americane, inclusiv Securities and Exchange Commission și Biroul de Recensământ. OpenAI a precizat că, în aceste cazuri, nu a identificat dovezi privind compromiterea conturilor sau o breșă de securitate propriu-zisă.
Compania verifică inclusiv situațiile în care agenții au încercat să treacă de anumite mecanisme de protecție ale site-urilor sau au transferat informații fără ca acest lucru să fie necesar pentru sarcina pe care o executau.
Ancheta OpenAI continuă
OpenAI a anunțat că analiza activității agenților este în desfășurare și că verificarea retrospectivă a acțiunilor acestora ar putea dura mai multe luni.
Incidentele readuc în atenție dificultățile legate de monitorizarea agenților AI autonomi, care pot naviga pe internet, utiliza instrumente informatice și interacționa cu sisteme externe cu un nivel limitat de intervenție umană.
Investigația a fost extinsă după un incident anterior în care agenți OpenAI au interacționat neautorizat cu platforma Hugging Face. Compania încearcă acum să stabilească amploarea tuturor acțiunilor necorespunzătoare și să identifice eventualele riscuri pentru datele utilizatorilor.