Anthropic anunță compromiterea sistemelor informatice ale trei organizații de către modelul său AI Claude
Detalii despre incidentele semnalate de Anthropic
Compania americană Anthropic a anunțat joi că modelul său de inteligență artificială, Claude, a compromis sistemele informatice ale trei organizații în cadrul unor teste de securitate cibernetică, informează The Guardian. Incidentul a fost descoperit în urma analizării a peste 141.000 de sesiuni de evaluare, după ce o eroare de configurare a permis accesul modelelor la internet în medii de testare care ar fi trebuit să fie complet izolate.
Potrivit Anthropic, cele trei atacuri s-au referit la trei versiuni diferite ale modelului: Claude Opus 4.7, Claude Mythos 5 și un model intern de cercetare. Primele breșe au fost detectate în luna aprilie, în medii de testare care nu dispuneau de măsurile standard de protecție.
Cauze și mecanismele de atac
Modelul Claude a exploatat „tehnici elementare, precum exploatarea parolelor slabe și a unor puncte de acces care nu necesitau autentificare”, după cum a precizat Anthropic. Compania a adăugat că breșele s-au produs în timpul exercițiilor de tip „capture the flag”, în care modelele AI erau instruite să găsească informații ascunse în rețele simulate.
Instrucțiunile transmise modelelor indicau faptul că acestea nu aveau acces la internet, însă o neînțelegere cu partenerul de evaluare, Irregular, a făcut ca sistemele să fie conectate la internetul public, facilitând astfel accesul neautorizat.
Reacții și măsuri luate
Două dintre organizațiile afectate nu au fost conștiente de compromiterea sistemelor până când au fost informate de Anthropic, iar compania continuă demersurile pentru a contacta și a treia entitate implicată. Anthropic a subliniat că aceste incidente au fost identificate „în urma unei analize proactive a transcrierilor evaluărilor noastre de securitate cibernetică”.
Anunțul survine într-un context în care dezvoltarea accelerată a tehnologiilor de inteligență artificială începe să ridice probleme serioase de securitate, fiind urmată și de situația recentă în care OpenAI a raportat atacuri informatice organizate de agenți AI scăpați de sub control.
Aceste evenimente evidențiază dificultățile cu care se confruntă dezvoltatorii în gestionarea riscurilor asociate cu noile capabilități AI și relevă necesitatea unor măsuri riguroase de securitate în mediile de testare și implementare a acestor tehnologii.


