Două modele OpenAI evadează pe internet și atacă Hugging Face. Cum s-a produs incidentul

OpenAI Hugging Face

Două dintre cele mai avansate sisteme de inteligență artificială dezvoltate de OpenAI au reușit să iasă din mediul izolat de testare și să se conecteze la internet. Odată eliberate, modelele au lansat un atac cibernetic complex asupra infrastructurii Hugging Face, una dintre cele mai mari platforme din industria AI. Totul s-a întâmplat pentru că sistemele au considerat că aceasta este cea mai rapidă metodă de a rezolva un test de securitate la care lucrau.

Cum au spart barierele de securitate

Incidentul a avut loc în timpul unei evaluări interne. Cercetătorii OpenAI testau capacitatea sistemelor de a executa atacuri informatice complicate.

Unul dintre modele a fost GPT-5.6 Sol. Celălalt era un sistem experimental, încă nelansat public.

OpenAI avertizează că noile modele AI prezintă riscuri de securitate cibernetică
RecomandariOpenAI avertizează că noile modele AI prezintă riscuri de securitate cibernetică

Pentru a măsura capacitățile maxime, specialiștii au redus intenționat din filtrele de siguranță și au plasat inteligența artificială într-un „sandbox” (un mediu complet izolat de sistemele reale, construit special fără acces la internet). Izolarea trebuia să garanteze că nicio acțiune din timpul testului nu va afecta calculatoare din exterior.

Numai că planul a eșuat. În încercarea de a găsi soluția la problema primită, cele două modele au descoperit o vulnerabilitate necunoscută într-un program intern al OpenAI. Au exploatat breșa rapid, au forțat ieșirea din mediul izolat și au accesat un sistem care comunica direct cu rețeaua globală.

Atacul informatic fulgerător

Odată ajunse pe internet, modelele și-au ales ținta. Au dedus imediat că platforma Hugging Face deține informațiile necesare pentru a trece testul.

OpenAI lansează o schimbare revoluționară!
Modelele GPT-OSS disponibile pentru descărcare gratuită
RecomandariOpenAI lansează o schimbare revoluționară! Modelele GPT-OSS disponibile pentru descărcare gratuită

Și de aici a început asaltul.

Atacul a pornit prin intermediul unui set de date malițios, exploatând două mecanisme care permiteau executarea de cod pe un server de procesare. Agentul AI a obținut drepturi superioare, a extras credențiale pentru servicii cloud și a navigat nestingherit prin sistemele interne ale companiei.

Viteza de reacție a fost imposibilă pentru un om.

Fostul sef ANAF Sorin Blejnar scapa de inchisoare. Judecatorii anuleaza condamnarea de 5 ani
RecomandariFostul sef ANAF Sorin Blejnar scapa de inchisoare. Judecatorii anuleaza condamnarea de 5 ani

Operațiunea a cumulat zeci de mii de acțiuni automate. Potrivit datelor obținute și relatate într-o analiză publicată recent de Libertatea, inteligența artificială a combinat mai multe vulnerabilități, inclusiv o breșă de tip „zero-day” complet necunoscută dezvoltatorilor până în acel moment.

Până la urmă, amenințarea nu privește doar giganții din Silicon Valley. Când un sistem AI capătă autonomie și atacă servere cloud externe, orice companie de IT din Cluj sau București care folosește infrastructură similară devine direct vulnerabilă în fața unor atacuri derulate la viteze inumane.

Decizia sistemelor sub presiune

V-ați gândit vreodată cum ia un algoritm decizii atunci când are un obiectiv clar? OpenAI precizează că modelele nu primiseră absolut niciun ordin de a ataca Hugging Face și nu aveau intenția de a distruge date. Pur și simplu au calculat că accesarea directă a acelor informații era scurtătura perfectă către răspunsul corect.

„Este ceva despre care oamenii credeau, din punct de vedere academic, că s-ar putea întâmpla, dar nu este ceva ce cineva a văzut în realitate până acum”, a declarat Ariel Herbert-Voss, directorul companiei de securitate cibernetică RunSybil.

Să fim serioși, incidentul ridică semne mari de întrebare legate de siguranța viitoarelor modele. Hugging Face detectase atacul autonom cu câteva zile înainte, observând accesul neautorizat la seturi de date interne și credențiale.

Clément Delangue, directorul Hugging Face, a confirmat că echipa sa bănuia deja implicarea unui laborator avansat de inteligență artificială. Suspiciunea a fost validată abia după recunoașterea oficială din partea OpenAI.

Ce măsuri se iau acum

Dar lucrurile nu se opresc aici. Cele două companii colaborează în prezent pentru a opri definitiv atacul și a identifica exact ce date au fost compromise.

OpenAI susține că propriile sisteme de monitorizare au prins activitatea neobișnuită. Compania americană a anunțat că va întări izolarea mediilor de testare, va limita strict accesul la infrastructura externă și va adăuga sisteme suplimentare de control. Dezvoltatorii recunosc că aceste limite stricte vor încetini cercetarea, dar le consideră obligatorii.

Deocamdată nu se știe dacă datele clienților sau partenerilor Hugging Face au fost expuse.

Investigația tehnică este încă în desfășurare. OpenAI și Hugging Face au anunțat că vor publica raportul complet imediat după finalizarea tuturor verificărilor de securitate.