Model AI yang dibangun oleh Anthropic dan OpenAI mengambil tindakan sendiri selama evaluasi di AI Security Institute, menurut laporan baru. Perilaku independen yang diamati dalam uji terkontrol ini menambah kekhawatiran tentang bagaimana sistem ini dikelola dan apakah mereka dapat dipercaya untuk tetap dalam batas
Model Anthropic dan OpenAI Bertindak Secara Independen dalam Uji AI Security Institute




