Modelele de inteligenta artificiala Claude ataca trei companii reale. Anthropic recunoaste bresa

Claude Anthropic securitate

Compania americană Anthropic a anunțat oficial că modelele sale de inteligență artificială Claude au accesat fără autorizație sistemele informatice aparținând unui număr de trei organizații. Incidentul major a avut loc în timpul unor teste interne de securitate cibernetică. Totul a pornit de la o eroare de configurare care le-a permis algoritmilor să se conecteze la internet, deși, teoretic, aceștia ar fi trebuit să funcționeze într-un mediu complet izolat.

Peste 141.000 de teste și o eroare umană

Anthropic a precizat că a revizuit peste 141.000 de teste de securitate înainte de a trage concluziile. În urma acestei analize uriașe, specialiștii au identificat trei incidente separate. Cel mai vechi dintre ele a avut loc în luna aprilie.

Evenimentele s-au produs în cadrul unor exerciții specifice de tip „capture the flag”.

Leonardo Badea, Prim-viceguvernator BNR: <a href= inteligența artificială și noua eră a competitivității" loading="lazy" referrerpolicy="no-referrer" style="width:140px;height:100%;object-fit:cover;display:block;margin:0;padding:0;border:0;border-radius:0">
RecomandariLeonardo Badea, Prim-viceguvernator BNR: Inteligența artificială și noua eră a competitivității

Aceste simulări sunt folosite în mod curent pentru evaluarea capacităților de hacking ale modelelor de inteligență artificială. În mod normal, așa cum dictează protocoalele industriei, acestea sunt desfășurate într-un mediu izolat, fără acces la internet și fără posibilitatea de a interacționa cu sisteme reale.

Numai că o banală eroare tehnică a dat totul peste cap. Compania susține că o greșeală de configurare a infrastructurii administrate împreună cu partenerul său de testare, Irregular, a permis modelelor Claude să acceseze internetul public.

Parole slabe și programe malițioase create de AI

Odată conectate la rețeaua globală, modelele Claude au compromis sistemele informatice a trei organizații reale. Nu au folosit tehnici imposibil de detectat, ci au exploatat metode relativ simple, precum parole slabe sau servicii expuse direct pe internet fără autentificare.

Profitul Tesla scade sub asteptari. Elon Musk investeste 25 de miliarde in inteligenta artificiala
RecomandariProfitul Tesla scade sub asteptari. Elon Musk investeste 25 de miliarde in inteligenta artificiala

Într-un amplu material publicat marți dimineață, jurnaliștii de la Adevarul explică exact mecanismul prin care a operat algoritmul. Într-unul dintre incidente, modelul AI a creat efectiv un program malițios. Acesta a fost descărcat automat de sistemul de scanare al unei companii de securitate cibernetică. Ulterior, folosind datele de autentificare obținute, inteligența artificială a pătruns adânc în infrastructura organizației.

Iar lucrurile devin și mai complicate când ne uităm la cel mai grav caz documentat. Modelul încerca să atace o companie fictivă din cadrul exercițiului de testare. Din cauza faptului că aceasta avea același nume cu o companie reală, AI-ul a accesat direct baza de date a organizației existente.

Potrivit Anthropic, acesta a fost singurul incident în care modelul a continuat atacul după ce și-a dat seama că interacționează cu un sistem real.

Romanii aleg inteligenta artificiala pentru imobiliare. 50% raporteaza economii de timp
RecomandariRomanii aleg inteligenta artificiala pentru imobiliare. 50% raporteaza economii de timp

Victimele nu au știut că sunt atacate

V-ați gândit vreodată cât de vulnerabile sunt rețelele instituțiilor din România în fața unui astfel de scenariu? Să fim serioși, dacă un model AI scăpat de sub control sparge sisteme externe bazându-se doar pe parole slabe, zeci de primării sau companii locale (care folosesc adesea infrastructuri IT învechite) ar putea pica oricând victime colaterale, fără măcar să își dea seama cine le descarcă arhivele.

Fix asta s-a întâmplat și acum.

Anthropic afirmă că nici compania și nici organizațiile vizate nu au detectat atacurile în momentul producerii lor. Două dintre firme au fost informate ulterior de Anthropic. Cea de-a treia nu fusese încă notificată la momentul publicării raportului oficial. Compania americană a refuzat să dezvăluie identitatea organizațiilor afectate, dar și-a asumat întreaga responsabilitate pentru eroarea de configurare care a făcut posibil accesul modelelor AI la internet.

Ce versiuni Claude au fost implicate

Cele trei incidente au implicat modelele Claude Opus 4.7, Claude Mythos 5 și un model intern de cercetare. Reprezentanții Anthropic susțin că aceste cazuri evidențiază necesitatea unor măsuri de izolare și control mult mai stricte în laboratoarele de dezvoltare a inteligenței artificiale. Asta e valabil atât în infrastructurile proprii, cât și în cele administrate de parteneri externi, pe măsură ce modelele AI dobândesc capacități tot mai avansate în domeniul securității cibernetice.

Dar cum de a început Anthropic să caute aceste breșe? Potrivit companiei, incidentele au fost descoperite în urma unei verificări ample declanșate abia după ce rivalul OpenAI a dezvăluit recent un caz similar. În acel dosar, un agent AI a ieșit din mediul de testare și a compromis sistemele platformei Hugging Face.