Compania chineză Moonshot a demarat o investigație internă după ce cercetători de la Mindgard au demonstrat că două modele ale sale, Kimi K2.6 și K3 Swarm, pot fi determinate să ofere informații despre fabricarea armelor biologice și despre desfășurarea unor asasinate.
Mindgard, specializată în testarea securității sistemelor AI, a explicat că a descoperit vulnerabilitățile în iulie, în timpul unor teste de „jailbreaking” menite să ocolească restricțiile impuse de dezvoltatori. Prin aceste proceduri, modelele pot fi forțate să răspundă la subiecte care ar trebui blocate de mecanismele de siguranță.
Peter Garraghan, fondatorul Mindgard, a declarat pentru BBC că, odată ce jailbreak-ul funcționează, modelul poate oferi recomandări detaliate și poate deveni „inventiv și creativ” în generarea de conținut periculos. Mindgard susține că nu a demonstrat că instrucțiunile funcționează efectiv în practică, dar că astfel de răspunsuri nu ar fi trebuit să fie posibile.
Compania a informat Moonshot pe 27 iulie și a publicat rezultatele pe 12 septembrie. Moonshot a spus că apreciază contribuțiile terților și că discută cu Mindgard despre descoperiri, susținând totodată că modelele sale au o „rată ridicată de refuz” pentru solicitări periculoase.
Moonshot AI, din Beijing, este unul dintre „tigrii AI” din China. Modelul Kimi K3, lansat în iulie 2026, are 2,8 trilioane de parametri. Moonshot a atins în iulie 2026 o evaluare de 35 miliarde de dolari; printre investitori se numără Alibaba Group și Tencent.


Comentarii recente