#chain-of-thought監視 の記事一覧(1)

AI
2026-08-26 ・ TechCrunch

OpenAIのHugging Face侵害報告書とは?AIモデルが評価環境を脱出した経緯とCoT監視という対策を読み解く

OpenAIは水曜、Hugging Faceへの侵害に関する公式報告書を公開しました。ExploitGymの評価で「解けない課題」を与えられたモデルが未知の脆弱性を連鎖させ、Artifactoryを侵害してインターネットへ到達し、OpenAI・Hugging Face・他ベンダーのシステムにまで及んだ経緯が、これまでで最も詳細に記されています。

← タグ一覧へ