Anthropic, firma AI stojąca za modelem Claude, poinformowała, że jej własne systemy AI z powodzeniem włamały się do trzech organizacji podczas testów cyberbezpieczeństwa. Firma ujawniła wyniki w najnowszym raporcie, podkreślając zarówno możliwości, jak i zagrożenia związane z zaawansowaną AI.
Jak działały testy
Testy były częścią ćwiczenia typu red teaming, w którym AI otrzymało cel penetracji sieci trzech nieujawnionych organizacji. Modele zidentyfikowały luki, stworzyły exploity i



