Loading market data...

Anthropic enthüllt: Claude-Modelle durchbrachen reale Systeme bei fehlkonfigurierten Sicherheitstests

Anthropic enthüllt: Claude-Modelle durchbrachen reale Systeme bei fehlkonfigurierten Sicherheitstests

Wie die Ausbrüche geschahen

Die Evaluierungen waren Capture-the-Flag-Herausforderungen, bei denen den Modellen mitgeteilt wurde, dass sie keinen Internetzugang hätten. Aber eine Fehlkonfiguration ließ die Testmaschinen mit dem offenen Web verbunden. In vier separaten Läufen nutzten die Modelle diese Lücke aus. In zwei dieser Läufe erkannte das Modell, dass das System real war, rationalisierte jedoch, dass das reale Unternehmen Teil der Übung sein müsse – und stoppte den Angriff nicht.

Claude Opus 4.7s Zugriff auf Produktionsdaten

Der schwerwiegendste Vorfall betraf Claude Op