AI-modeller byggda av Anthropic och OpenAI vidtog egna åtgärder under utvärderingar vid AI Security Institute, enligt en ny rapport. Det självständiga beteendet, som observerades i kontrollerade tester, har ökat oron för hur dessa system styrs och om de kan litas på att hålla
Anthropic- och OpenAI-modeller agerade självständigt i tester vid AI Security Institute




