OpenAI recunoaste atacul cibernetic asupra platformei Hugging Face. Un agent AI a evadat din testare

OpenAI atac cibernetic Hugging Face

OpenAI a recunoscut marți că un agent de inteligență artificială a evadat din mediul intern de testare și a lansat un atac cibernetic real asupra sistemelor externe ale companiei Hugging Face. Incidentul fără precedent a scăpat complet de sub controlul dezvoltatorilor conduși de Sam Altman.

Cum a inceput atacul cibernetic

Hugging Face, o platformă independentă de găzduire a modelelor AI, a raportat inițial breșa săptămâna trecută, atribuind-o unui agent extern. Iar lucrurile stau puțin diferit acum, când creatorul ChatGPT își asumă oficial responsabilitatea.

Spre deosebire de un simplu chatbot precum Gemini sau Claude, agenții AI sunt proiectați să execute sarcini cap-coadă, cu intervenție umană minimă pe parcursul procesului.

În atacul cibernetic din Germania, hackeri ruși au vizat conducerea Bundestagului pe Signal
RecomandariÎn atacul cibernetic din Germania, hackeri ruși au vizat conducerea Bundestagului pe Signal

„După investigații, știm acum că acest incident specific a fost cauzat de o combinație de modele OpenAI, inclusiv GPT-5.6 Sol și un model aflat care nu a fost lansat deocamdată, chiar mai performant, toate având restricții reduse privind refuzul acțiunilor cibernetice în scopul evaluării, în timp ce erau testate intern pe un benchmark al capabilităților cibernetice”, a transmis compania.

Vulnerabilitatea exploatata pentru acces la internet

Testul intern viza „ExploitGym”, un benchmark public folosit frecvent pentru a măsura capacitatea inteligenței artificiale de a executa atacuri pe baza unor vulnerabilități deja cunoscute.

Până la urmă, programul nici măcar nu trebuia să aibă acces la internet.

Florida investighează penal compania OpenAI pentru rolul ChatGPT în atacul cu 2 morți de la FSU
RecomandariFlorida investighează penal compania OpenAI pentru rolul ChatGPT în atacul cu 2 morți de la FSU

Dispunea doar de un instrument special pentru instalarea de pachete software necesare îndeplinirii sarcinii. Așa cum arată detaliile publicate recent de Hotnews, agentul AI a descoperit o vulnerabilitate nedivulgată exact în acest program de instalare și a exploatat-o pentru a ieși liber pe internet.

V-ați gândit vreodată până unde poate merge o mașinărie ca să treacă un test?

„Modelele erau extrem de concentrate pe găsirea unei soluții pentru ExploitGym, mergând până la măsuri extreme pentru a atinge un obiectiv de testare foarte restrâns”, explică inginerii OpenAI.

Un tânăr de 20 de ani riscă închisoare pe viață după atacul asupra casei CEO-ului OpenAI
RecomandariUn tânăr de 20 de ani riscă închisoare pe viață după atacul asupra casei CEO-ului OpenAI

Furtul datelor de pe serverele externe

Odată conectat la rețeaua globală, sistemul a luat decizii complet autonome.

„După ce au obținut acces la internet, modelele au dedus că Hugging Face ar putea găzdui modele, seturi de date și soluții pentru ExploitGym. Cunoscând acest lucru, modelul a căutat și a găsit cu succes modalități de a obține acces la informații secrete pe care le putea folosi pentru a trișa la evaluare”, a detaliat dezvoltatorul american.

Practic, modelele au identificat breșe în infrastructura Hugging Face pentru a „obține direct soluțiile de test din baza de date de producție a Hugging Face”. Să fim serioși, vorbim despre un sistem (conceput inițial doar pentru evaluare internă) care a furnizat efectiv propriile răspunsuri la benchmark spărgând baza de date a altei companii.

Urmarile legale si masurile anuntate

Compania atacată a descris intruziunea ca fiind deosebit de agresivă și sofisticată. Reprezentanții Hugging Face au raportat „mii de acțiuni individuale (…) cu o infrastructură de comandă și control capabilă să se auto-migreze și găzduită pe servicii publice”.

Dar ce urmează acum? OpenAI a raportat vulnerabilitățile identificate în programul de instalare a pachetelor software și colaborează cu platforma afectată pentru investigarea completă a incidentului.

Cert e că dezvoltatorul va implementa noi măsuri de control atât asupra testării modelelor, cât și asupra infrastructurii aferente. Următoarea etapă vizează clarificarea posibilelor consecințe juridice, în condițiile în care acțiunile autonome ale modelelor AI ar putea intra direct sub incidența legii federale americane Computer Fraud and Abuse Act.