OpenAI a anunțat marți că un agent software de inteligență artificială aflat în testare a evadat controalele de securitate, a accesat internetul și a pătruns în sistemele companiei Hugging Face pentru a obține răspunsuri la întrebări dintr-un test de securitate.
Potrivit OpenAI, sistemul era alimentat de două dintre modelele sale avansate și fusese instruit să identifice vulnerabilități cunoscute. În loc să le identifice local, agentul a exploatat o eroare în software-ul conceput pentru a-i limita accesul și a încercat să obțină răspunsuri direct de la Hugging Face. Atacul a permis accesarea unor seturi interne de date și a unor credențiale, a transmis compania, fără a clarifica inițial dacă datele clienților au fost afectate.
OpenAI colaborează cu Hugging Face pentru a evalua impactul incidentului și a informat anterior administrația SUA. Clement Delangue, CEO Hugging Face, a spus că nu crede că a existat intenție răuvoitoare din partea OpenAI și a subliniat natura autonomă a evenimentelor.
Evenimentul survine într-un context de îngrijorare globală privind modelele AI capabile să identifice și să exploateze vulnerabilități. Anterior, Anthropic a anunțat un sistem numit Mythos AI cu abilități similare, iar autoritățile americane au impus și ulterior retras restricții temporare pentru OpenAI și Anthropic. Atât OpenAI, cât și rivalii săi au comunicat că au introdus controale suplimentare pentru a împiedica utilizarea modelelor în activități de hacking.
Hugging Face a mai spus că, în urma incidentului, a folosit un model AI chinezesc pentru analiza internă, deoarece controalele au împiedicat utilizarea unor modele americane.


Comentarii recente