Inginerii OpenAI au descoperit cu întârziere atacul unui AI scăpat de sub control

O serie de dezvăluiri recente din presa internațională readuc în discuție siguranța sistemelor de inteligență artificială, după ce două modele AI dezvoltate de OpenAI au acționat autonom și au lansat un atac asupra platformei Hugging Face. Incidentul, fără precedent în istoria inteligenței artificiale moderne, este cu atât mai îngrijorător cu cât inginerii companiei nu au reușit să detecteze această acțiune neautorizată decât la câteva zile după ce AI-ul a depășit limitele impuse.

Apar tot mai multe întrebări legate de siguranța AI FOTO Shutterstock

Apar tot mai multe întrebări legate de siguranța AI. FOTO: Shutterstock

Potrivit unor rapoarte publicate de Reuters și Bloomberg, preluate și de News.ro , echipa OpenAI a avut nevoie de mai multe zile pentru a realiza că un sistem de inteligență artificială, aflat în faza de testare într-un mediu controlat, a depășit barierele de securitate și a inițiat atacuri împotriva platformei Hugging Face. Experimentul, demarat pe 9 iulie, implica o combinație de modele lingvistice avansate ale OpenAI, inclusiv unul care nu fusese încă disponibil public. Obiectivul declarat al acestor sisteme era să identifice și să remedieze în mod autonom vulnerabilitățile software, ca parte a unui proiect menit să concureze cu Mythos, un sistem de securitate cibernetică dezvoltat de Anthropic. Punctul de cotitură s-a produs pe 11 iulie, când, conform Reuters, modelele AI au reușit să iasă din mediul restricționat creat de inginerii OpenAI. La două zile distanță, pe 13 iulie, atacul propriu-zis asupra infrastructurii online a Hugging Face a început, o informație confirmată de Thomas Wolf, co-fondatorul platformei. Ceea ce este alarmant este că, în tot acest timp, echipa OpenAI nu a observat imediat activitatea neobișnuită. Abia după alte câteva zile, inginerii companiei au realizat că activitatea malicioasă provenea chiar de la propriile lor modele de inteligență artificială. Primele detalii despre acest incident au fost făcute publice după data de 20 iulie, ceea ce indică o întârziere semnificativă în identificarea și comunicarea problemei. Sistemul AI a demonstrat o eficiență remarcabilă, necesitând doar câteva ore pentru a desfășura un atac de amploare, o sarcină care, în mod obișnuit, ar solicita săptămâni de muncă din partea unor specialiști umani, conform informațiilor citate de Bloomberg. Acest eveniment este considerat a fi primul caz cunoscut în care un sistem modern de inteligență artificială a depășit constrângerile impuse în timpul testelor și a lansat un atac asupra unei infrastructuri cibernetice externe. Situația a generat îngrijorări profunde în rândul experților din domeniul securității informatice și al inteligenței artificiale, subliniind provocările tot mai mari legate de controlul și siguranța acestor tehnologii.

Explorează subiectele:

OpenAIInteligență artificialăHugging Face


Citește și:

populare
astăzi

1 Ce urmează săptămâna viitoare? / România, victima unui război gri despre care nimeni nu spune adevărul?

2 Un document care dă fiori despre atacul de la Cadastru

3 Rețea de milioane la Muntele Athos: Pelerinii români, ținta unei afaceri ilicite

4 Procurorii DNA au găsit 500.000 de euro acasă la unul dintre directorii uzinelor de armament reținuți. O directoare a cerut mită dublă, deoarece „dola…

5 Drona doborâtă de Forțele Aeriene române la Buzău: un zbor sinuos, plin de enigme