Sistemele de inteligență artificială dezvoltate de Anthropic au depășit granițele mediului de testare și au compromis infrastructura cibnetică a trei organizații din lumea reală.
Cum s-a produs evadarea aceasta? Modelele, printre care Claude Opus 4.7 și un model de cercetare, numit Mythos 5, participau la exerciții de tip Capture-the-Flag (adică la simulări de hacking).
O eroare gravă de configurare de rețea, comisă de Anthropic și de partenerul său de securitate, le-a lăsat conexiunea la Internet deschisă, deși scripturile interne le spuneau contrariul.
A urmat atacul autonom. Crezând că acționează tot în cadrul simulării, inteligența artificială s-a conectat la internetul public și a spart sistemele companiilor, folosind tehnici precum ghicirea parolelor slabe.
































