Inteligența artificială avansată este considerată de tot mai mulți experți drept un risc existențial. Nu e vorba neapărat de roboți violenți, ci de sisteme extrem de puternice care pot urmări obiective incompatibile cu supraviețuirea oamenilor sau pot fi folosite în scopuri catastrofale.
Discuția a reintrat în prim-plan după demisia lui Jacob Coxon de la Anthropic și declarațiile sale că firme precum Anthropic și OpenAI se grăbesc în dezvoltarea tehnologiilor care „ne-ar putea ucide pe toți până la sfârșitul deceniului”, nota The Wall Street Journal. Colegul său, Evan Hubinger, a confirmat că îngrijorările legate de acest risc sunt reale în interiorul companiei, oferind o estimare de peste 10% pentru probabilitatea unei dispariții umane în următorul deceniu.
Principalele temeri se reunesc în două direcții: pierderea controlului (misalignment) şi utilizarea AI în scopuri distructive. În primul caz, agenți AI capabili să se autoîmbunătățească pot dezvolta scopuri proprii nealiniate cu valorile umane, astfel încât să ia decizii care pun în pericol oamenii. Experimentul mental al „fabricii de agrafe” ilustrează riscul: un sistem care ar interpreta literal un obiectiv ar putea redirecționa resursele în mod catastrofal.
Alte scenarii includ folosirea AI pentru a proiecta şi răspândi arme biologice, manipularea rivalităților între puteri nucleare sau declanșarea unor atacuri cibernetice masive care să paralizeze rețele electrice, finanțe sau infrastructura esențială. De asemenea, există pericolul unei pierderi treptate a controlului uman, pe măsură ce decizii esențiale sunt delegate sistemelor automate.
Companii precum Anthropic şi OpenAI lucrează la măsuri de siguranță şi la antrenarea modelelor pentru a respecta reguli, dar recunosc că nu există garanții absolute. Termenul „recursive self-improvement” descrie capacitatea unor modele de a se îmbunătăți singure, ceea ce intensifică îngrijorările legate de transparență și control.
Au fost propuse măsuri legislative în SUA—mecanisme de oprire de urgență, raportarea incidentelor şi testarea modelelor de către autoritățile de securitate—dar inițiativele nu au avansat decisiv. Critici din industrie contestă uneori amploarea avertismentelor, unii susţinând că ele pot servi unor interese politice sau comerciale; David Sacks a acuzat Anthropic de încercarea de a influența reglementarea în avantaj propriu.
Anthropic şi OpenAI resping aceste acuzaţii şi afirmă că vor continua să dezvolte măsuri de protecţie, subliniind în același timp potenţialul enorm al inteligenţei artificiale şi riscurile fără precedent pe care le implică.


Comentarii recente