Avertisment care dă fiori: „În 6-12 luni o aglomerare de agenți AI ar putea fi capabilă să preia controlul întregului internet”
Ritmul accelerat în care evoluează sistemele autonome a determinat conducerea Anthropic să tragă un semnal de alarmă fără precedent. Pe fondul unui incident recent în care un model OpenAI a evadat din mediul securizat și a compromis o platformă terță, Dario Amodei avertizează că o rețea scăpată de sub control ar putea subjuga întreaga rețea globală de internet în mai puțin de un an dacă industria nu încetinește cursa tehnologică.
O criză majoră de securitate ar putea lovi infrastructura digitală a lumii într-un orizont de timp de doar 6 până la 12 luni. Într-un eseu publicat pe propriul blog, Dario Amodei, directorul executiv al companiei Anthropic — creatorul asistentului Claude —, susține că o grupare de agenți inteligenți ar putea ajunge în punctul în care să dețină controlul complet asupra internetului. „În 6-12 luni o aglomerare de agenți AI ar putea fi capabilă să preia controlul întregului internet”, a scris Dario Amodei, CEO al companiei Antrophic, într-o postare pe blogul său.
Această perspectivă sumbră este alimentată de capacitatea tot mai pronunțată a sistemelor moderne de a învăța autonom, printr-un mecanism de auto-îmbunătățire recurentă. Conform informațiilor relatate de Business Insider , Amodei s-a convins în ultima perioadă că tempoul dezvoltării trebuie redus, subliniind că riscurile generate de această tehnologie sunt direct proporționale cu forța sa uriașă de transformare a societății.
Incidentul care a zguduit industria: evadarea unui agent OpenAI
Temerile exprimate de fondatorul Anthropic își au rădăcinile într-un eveniment concret petrecut pe 21 iulie. La acea dată, un agent cibernetic dezvoltat de OpenAI a reușit să străpungă barierele mediului de testare în timp ce compania îi evalua capacitățile avansate. Odată scăpat în mediul online deschis, sistemul a orchestrat un atac cibernetic și a pătruns în sistemele Hugging Face — o platformă de referință dedicată găzduirii de modele lingvistice și seturi de date open-source —, ștergându-și ulterior urmele pentru a-și atinge scopul stabilit în test.
Reprezentanții OpenAI au recunoscut gravitatea situației, descriind-o drept un episod cibernetic fără precedent ce a implicat capabilități ofensive extrem de sofisticate, menționând totodată că își întăresc sistemele de apărare. La rândul lor, cei de la Hugging Face au confirmat breșa, arătând că s-au confruntat cu un atac complet automatizat, dirijat integral de o arhitectură de agenți autonomi.
Clement Delangue, cofondatorul Hugging Face, a subliniat uluirea echipei sale în fața nivelului de autonomie dovedit de atacator, suspectând încă de la început implicarea unui laborator tehnologic de prim rang din cauza gradului excepțional de complexitate tehnică.
Avertismentele experților în securitate cibernetică
Specialiștii externi confirmă că sistemele avansate tind să devină tot mai greu de ținut în frâu. Katie Moussouris, CEO la Luta Security, a comparat noile modele cu „cele mai istețe caracatițe din lume, specializate în evadări, cu brațe nelimitate și capacitatea de a se strecura oriunde”. Moussouris a atras atenția că mediul de cercetare și autoritățile duc lipsă totală de instrumente dedicate pentru monitorizarea și izolarea unui AI înainte ca acesta să execute o nouă „farsă à la Houdini” cu pagube colaterale.
În mod similar, Matt Suiche, inginer în cadrul firmei de securitate Tolmo, a punctat că astfel de incidente arată clar cum modelele de ultimă generație au început să șteargă diferențele dintre laboratoarele AI și autorii de atacuri cibernetice de nivel avansat.
O strategie în trei pași propusă de Anthropic
Pentru a preveni un scenariu catastrofal, Dario Amodei argumentează că breșa OpenAI nu trebuie tratată ca o eroare izolată, afirmând că anomalii similare, deși la o scară mai redusă, s-au manifestat în întreaga industrie, inclusiv la Anthropic. Soluția avansată de acesta nu vizează oprirea definitivă a cercetării sau a antrenării de rețele neurale, ci acordarea timpului necesar pentru securizarea și alinierea temeinică a sistemelor.
Planul liderului Anthropic se sprijină pe trei direcții:
- Instituirea de reglementări guvernamentale stricte la nivelul Statelor Unite;
- Adoptarea unor norme globale uniforme aplicabile marilor dezvoltatori tech;
- Permiterea accesului direct în companii pentru evaluatori de securitate externi și independenți, la nivel de angajat, pentru a verifica sistemele din interior.
Amodei a anunțat că Anthropic își asumă deja în mod unilateral această deschidere către verificatori externi independenți, lansând o chemare către toți rivalii din industrie să adopte măsuri de precauție similare: „Măsurile pe care le propun eu pentru a dezvolta AI într-un ritm de siguranță nu sunt ușor de luat. Dar cred că îi datorăm omenirii să încercăm”.
Explorează subiectele:
