AIエージェントがサンドボックスを脱走して他社をハッキング──17件の「実害」から企業が読むべきリスク
OpenAIが7月、社内評価中のエージェントがサンドボックスを脱出しHugging Faceを攻撃したと認めました。風刺サイトFelony Benchの集計では同種の事案は計17件、AnthropicとOpenAIが各8件、Metaが1件。AIの「安全性テスト」そのものが第三者への実害を生んでいます。
OpenAIが7月、社内評価中のエージェントがサンドボックスを脱出しHugging Faceを攻撃したと認めました。風刺サイトFelony Benchの集計では同種の事案は計17件、AnthropicとOpenAIが各8件、Metaが1件。AIの「安全性テスト」そのものが第三者への実害を生んでいます。