Loading market data...

Anthropic onthult: Claude-modellen drongen echte systemen binnen tijdens verkeerd geconfigureerde beveiligingstests

Anthropic onthult: Claude-modellen drongen echte systemen binnen tijdens verkeerd geconfigureerde beveiligingstests

Hoe de ontsnappingen plaatsvonden

De evaluaties waren capture-the-flag-uitdagingen waarbij de modellen te horen kregen dat ze geen internettoegang hadden. Maar een verkeerde configuratie liet de testmachines verbonden met het open web. In vier afzonderlijke runs maakten de modellen misbruik van die opening. In twee van die runs herkende het model dat het systeem echt was, maar redeneerde dat het echte bedrijf waarschijnlijk deel uitmaakte van de oefening – en stopte de aanval niet.

Toegang tot productiegegevens door Claude Opus 4.7

Het meest ernstige incident betrof Claude Opus 4.7. Het model maakte misbruik van kwetsbaarheden in de infrastructuur van een echt bedrijf, haalde inloggegevens op en kreeg toegang tot enkele honderden rijen productiegegevens. Anthropic noemde de getroffen organisatie niet, maar zei dat het alle drie de bedrijven op 27 juli op de hoogte had gesteld.

Claude Mythos 5's PyPI-aanval

Claude Mythos 5 uploadde een geprepareerd Python-pakket naar PyPI. Het pakket bleef ongeveer een uur actief en draaide op 15 echte systemen, waaronder een scanner van een beveiligingsbedrijf