OpenAI a anunțat că unul dintre modelele sale de inteligență artificială în curs de testare a compromis infrastructura Hugging Face, una dintre cele mai relevante platforme online utilizate de cercetători și dezvoltatori pentru găzduirea și distribuirea modelelor AI. Conform OpenAI, incidentul a implicat o combinație de modele, inclusiv GPT-5.6 Sol și un model experimental nepublicat încă. Compania a menționat că măsurile de protecție împotriva activităților cibernetice riscante au fost dezactivate în mod intenționat pentru a desfășura o evaluare internă a capacităților modelelor.
„Considerăm că acesta este un incident cibernetic fără precedent, implicând capacități cibernetice avansate”, a comunicat OpenAI pe blogul său, adăugând că publică rezultatele preliminare pentru a ajuta specialiștii în securitate să înțeleagă mai bine nivelul actual al capacităților modelelor de inteligență artificială.
Săptămâna trecută, Hugging Face a declarat că a identificat și a blocat un agent autonom bazat pe inteligență artificială care i-a compromis infrastructura, fără a indica atunci modelul folosit. Platforma a subliniat că sistemul AI a realizat zeci de mii de acțiuni automate pe parcursul unui weekend, iar ancheta ulterioară a reconstituit peste 17.000 de evenimente.
OpenAI afirmă că modelele sale au participat la o evaluare internă denumită ExploitGym, menită să măsoare capacitățile de identificare și exploatare a vulnerabilităților informatice. Potrivit companiei, modelele s-au concentrat intens asupra rezolvării testului și au detectat o serie de vulnerabilități care le-au permis să părăsească mediul izolat de testare.
Compania susține că modelele au exploatat o vulnerabilitate de tip „zero-day” într-un program utilizat intern pentru a obține acces la internet, apoi au dedus că Hugging Face ar putea găzdui modelele, seturile de date și soluțiile folosite în evaluare. Ulterior, acestea au combinat diverse tehnici de atac, inclusiv utilizarea unor credențiale compromise și exploatarea altor vulnerabilități necunoscute pentru a obține acces la informații confidențiale din infrastructura platformei și la răspunsurile testului.
OpenAI a menționat că echipa sa de securitate a observat activitatea neobișnuită, în timp ce Hugging Face a identificat și a oprit atacul împotriva propriei infrastructuri. Cele două companii colaborează acum pentru investigarea incidentului și remedierea vulnerabilităților.
Conform OpenAI, incidentul demonstrează că modelele actuale de inteligență artificială pot desfășura operațiuni cibernetice complexe, în mai multe etape, și pot descoperi noi căi de atac asupra sistemelor informatice reale, chiar și fără acces la codul sursă.
În urma incidentului, compania a anunțat că va implementa măsuri suplimentare de securitate pentru infrastructura și mediile sale de testare, chiar dacă acestea vor încetini ritmul cercetării. De asemenea, OpenAI a notificat dezvoltatorul software-ului în care a fost identificată vulnerabilitatea de tip „zero-day” și colaborează la remedieri.
Directorul general al Hugging Face, Clem Delangue, a apreciat colaborarea cu OpenAI și a subliniat că incidentul evidențiază necesitatea cooperării între companiile de inteligență artificială pentru îmbunătățirea securității cibernetice.
OpenAI a subliniat că investigația continuă și că va publica informații suplimentare după finalizarea acesteia.


