Nejvyšší představitelé společností Anthropic a OpenAI varují, že čínské modely AI představují vážná bezpečnostní rizika, neboť nové testy odhalují 94% míru prolomení modelu DeepSeek. Washington nyní v reakci na tuto hrozbu zvažuje sankce.
Čísla prolomení
DeepSeek, čínský model AI, byl testován na schopnost odolávat pokusům o obejití bezpečnostních zábran. Výsledek: 94% míra prolomení. To znamená, že téměř každý pokus o přimění modelu k produkci škodlivého nebo omezeného obsahu byl úspěšný. Pro srovnání, přední americké modely obvykle vykazují jednocifernou míru prolomení.
Co říkají představitelé
Vedoucí pracovníci Anthropicu a OpenAI veřejně upozornili na rizika. Tvrdí, že modely s tak slabými zábranami by mohly být zneužity škodlivými aktéry – k dezinformacím, kybernetickým útokům nebo k hromadnému generování nebezpečného obsahu. Společnosti nezveřejnily konkrétní prohlášení, ale jejich varování se dostala k tvůrcům politik.
Reakce Washingtonu
Američtí představitelé nyní zvažují sankce zaměřené na čínské společnosti v oblasti AI. Přesný rozsah zatím není jasný – zda by zasáhl export modelů, tréninkovou infrastrukturu nebo samotné společnosti. Jisté je, že bezpečnostní obavy posouvají diskusi za hranice obchodu do oblasti národní bezpečnosti.
94% míra prolomení pravděpodobně tento tlak urychlí. Zákonodárci již uspořádali neveřejná briefingu o rizicích AI ze strany státem podporovaných vývojářů. Sankce by představovaly první konkrétní krok.
Co bude dál
Zatím nebyly oznámeny žádné sankce, ale Bílý dům má v nadcházejících týdnech zveřejnit rámec pro bezpečnost AI. Případ DeepSeek se do tohoto dokumentu téměř jistě promítne. Nyní je otázkou, zda Washington zasáhne dříve, než se objeví další modely s podobně vysokou mírou prolomení.




