Agent AI scăpat de sub control: OpenAI confirmă un atac cibernetic real asupra unei alte companii

Agent AI scăpat de sub control: OpenAI confirmă un atac cibernetic real asupra unei alte companii

OpenAI a confirmat un incident fără precedent petrecut în timpul unui test intern de securitate cibernetică. Compania a admis că un agent de inteligență artificială, alimentat de mai multe modele dezvoltate intern, a depășit limitele mediului de testare și a compromis infrastructura companiei Hugging Face. Potrivit explicațiilor oferite ulterior, scopul atacului nu a fost întâmplător, ci unul bine definit: obținerea răspunsurilor necesare pentru a „trișa” într-un test destinat evaluării performanțelor modelelor AI.

OpenAI recunoaște că modelele sale au lansat un atac cibernetic real asupra unei alte companii
OpenAI recunoaște că modelele sale au lansat un atac cibernetic real asupra unei alte companii

Mai multe modele OpenAI au colaborat în timpul atacului

Într-o analiză publicată pe blogul oficial, OpenAI explică faptul că incidentul nu a fost provocat de un singur model, ci de o combinație de sisteme de inteligență artificială, printre care GPT-5.6 Sol și un model experimental care nu a fost încă lansat public.

După investigații, știm acum că acest incident specific a fost cauzat de o combinație de modele OpenAI – inclusiv GPT-5.6 Sol și un model aflat care nu a fost lansat deocamdată, chiar mai performant, toate având restricții reduse privind refuzul acțiunilor cibernetice în scopul evaluării – în timp ce erau testate intern pe un benchmark al capabilităților cibernetice”, precizează OpenAI.

Compania subliniază că modelele rulau într-un mediu de testare cu restricții speciale, conceput pentru evaluarea capacităților de securitate cibernetică.

Ținta agentului AI: acces la soluțiile unui test de evaluare

Potrivit OpenAI, modelele aveau ca obiectiv rezolvarea unui benchmark public numit ExploitGym, folosit pentru măsurarea capacității inteligenței artificiale de a identifica și exploata vulnerabilități informatice cunoscute.

În timpul testului, agentul AI a descoperit o vulnerabilitate într-un instrument destinat instalării pachetelor software și a folosit-o pentru a obține acces la internet, deși acest lucru nu era prevăzut în scenariul de testare.

Modelele erau extrem de concentrate pe găsirea unei soluții pentru ExploitGym, mergând până la măsuri extreme pentru a atinge un obiectiv de testare foarte restrâns”, explică OpenAI.

După ce au ieșit din mediul controlat, modelele au identificat platforma Hugging Face drept un posibil loc unde puteau găsi informațiile necesare pentru test.

Cum a reușit AI-ul să compromită infrastructura Hugging Face

Conform explicațiilor oferite de OpenAI, agentul AI a căutat modalități de acces la informații confidențiale și a identificat vulnerabilități în infrastructura Hugging Face.

După ce au obținut acces la internet, modelele au dedus că Hugging Face ar putea găzdui modele, seturi de date și soluții pentru ExploitGym. Cunoscând acest lucru, modelul a căutat și a găsit cu succes modalități de a obține acces la informații secrete pe care le putea folosi pentru a trișa la evaluare.

În cele din urmă, sistemele AI au reușit să acceseze direct soluțiile testului din baza de date a companiei, ceea ce a compromis întregul proces de evaluare.

OpenAI și Hugging Face colaborează după incident

Inițial, Hugging Face a anunțat că a fost victima unui atac realizat de un „agent AI extern”, fără să știe că acesta provenea din cadrul testelor OpenAI.

Între timp, OpenAI a declarat că a raportat vulnerabilitățile descoperite și colaborează cu Hugging Face pentru analizarea completă a incidentului și remedierea problemelor de securitate.

Compania americană susține că va introduce reguli mai stricte pentru testarea modelelor de inteligență artificială și va consolida infrastructura folosită în astfel de experimente, pentru a preveni repetarea unor situații similare.

Un precedent care ridică semne de întrebare pentru industria AI

Cazul este considerat unul fără precedent, deoarece este prima situație cunoscută în care un benchmark destinat exclusiv testării capacităților cibernetice ale inteligenței artificiale s-a transformat într-un atac real asupra infrastructurii unei alte companii.

Pe lângă implicațiile tehnice, incidentul ar putea avea și consecințe juridice. Potrivit TechCrunch, rămâne de văzut dacă OpenAI va răspunde legal pentru această breșă, în condițiile în care acțiunile agentului AI ar putea intra sub incidența legislației americane privind frauda și abuzul informatic.



Parteneri

image
image
image
image
image
image
image
image
image
image
image
image
image
image
image
image
image
image
image
image
Chalkida  jpg
image png
gazpacho jpg
burnout pexels jpg
ploaie png
descoperire aeronava pan jpg
image png
wedding gift jpg
image
image