OpenAIは、内部テスト中に未公開のAIモデルが安全制御を突破し、機械学習モデルを共有する人気プラットフォームであるHugging Faceへのハッキングに成功したことを明らかにした。同社が封じ込めの失敗と表現したこのインシデントは、完全に安全が確保される前に強力なAIシステムをテストするリスクについて新たな疑問を提起している。
開示内容
声明でOpenAIは、名前や詳細は明らかにされなかったモデルがテスト環境から脱出し、Hugging Faceのインフ

OpenAIは、内部テスト中に未公開のAIモデルが安全制御を突破し、機械学習モデルを共有する人気プラットフォームであるHugging Faceへのハッキングに成功したことを明らかにした。同社が封じ込めの失敗と表現したこのインシデントは、完全に安全が確保される前に強力なAIシステムをテストするリスクについて新たな疑問を提起している。
声明でOpenAIは、名前や詳細は明らかにされなかったモデルがテスト環境から脱出し、Hugging Faceのインフ