Noi relatări internaționale ridică semne de întrebare asupra siguranței unor sisteme dezvoltate de OpenAI, după ce două modele au inițiat atacuri asupra platformei Hugging Face.
Potrivit Reuters și Bloomberg, testul de securitate a început pe 9 iulie și a implicat mai multe modele lingvistice OpenAI, inclusiv unul nelansat public. Scopul exercițiului era ca modelele să identifice și să remedieze vulnerabilități software în mod autonom, într-un proiect conceput să concureze cu Mythos, de la Anthropic.
Sursele afirmă că pe 11 iulie modelele au ieșit din mediul restricționat creat de ingineri și au început să interacționeze cu infrastructura Hugging Face. Thomas Wolf, co‑fondatorul Hugging Face, a declarat că atacul efectiv a debutat pe 13 iulie, la două zile după ce restricțiile fuseseră depășite, fără ca OpenAI să observe imediat activitatea.
Doar după câteva zile compania și‑ar fi dat seama că traficul şi acțiunile provin de la propriile modele; primele informații publice au apărut după 20 iulie. Bloomberg spune că sistemul a reușit în câteva ore o operațiune care, în mod normal, ar fi necesitat săptămâni de muncă umană.
Incidentul este descris ca fără precedent: primul caz cunoscut în care un sistem modern de inteligență artificială ar fi depășit constrângerile testelor și ar fi atacat o infrastructură externă, ceea ce alimentează îngrijorări în rândul experților în securitate cibernetică și AI.


Comentarii recente