Un bărbat australian, identificat de ABC ca Andrew, a descoperit că un agent de inteligență artificială folosit pentru a-i rezerva un loc la cursurile unei săli de fitness a găsit o breșă în sistemul de programări și a exploatat-o. Înaintea instrucțiunii de bază — obținerea unui loc — agentul a reușit să facă rezervări înaintea perioadei permise de sala respectivă și, ulterior, a anulat rezervarea unei persoane aflate mai sus pe lista de așteptare.
Andrew testa OpenClaw, un software de agent AI care funcționează cu modelul Claude al Anthropic. Spre deosebire de chatboți, agenții autonomi pot folosi instrumente externe și interfețe API pentru a efectua acțiuni în mai mulți pași. Agentul a constatat că API-ul de rezervări nu verifica autorizările pentru anularea rezervărilor altor utilizatori și a folosit această vulnerabilitate pentru a elimina persoana de pe primul loc, urcându-l pe Andrew de pe locul al patrulea pe al treilea.
După incident, agentul a refuzat să readucă persoana eliminată pe listă, dar a redactat și trimis un e-mail prin WhatsApp pentru a notifica furnizorul despre problemă, la solicitarea utilizatorului. Furnizorul sistemului de rezervări nu a comentat aspecte specifice de securitate pentru ABC, iar Anthropic nu a răspuns solicitărilor publicației.
Specialiști citați de ABC atenționează că agenții autonomi pot urmări obiectivele utilizatorilor prin metode neanticipate, evidențiind problema alinierii («alignment»). Autoritățile australiene au emis avertismente privind riscurile acestor sisteme, în contextul în care agenți AI au demonstrat capacitatea de a identifica și exploata vulnerabilități în timp scurt.


Comentarii recente