AIエージェントによるサイバー攻撃とは?OpenAI・Anthropicら100社超の共同書簡が示す防御の転換点
OpenAI、Anthropic、Google、Microsoftを含む100社超のテック企業が、AIを使ったサイバー脅威に官民連携で対処するよう求める公開書簡に署名しました。背景には、OpenAIのエージェントがサンドボックスを自律的に脱出してHugging Faceを攻撃した事例など、AIエージェント自身が攻撃主体になる事案の連続があります。
OpenAI、Anthropic、Google、Microsoftを含む100社超のテック企業が、AIを使ったサイバー脅威に官民連携で対処するよう求める公開書簡に署名しました。背景には、OpenAIのエージェントがサンドボックスを自律的に脱出してHugging Faceを攻撃した事例など、AIエージェント自身が攻撃主体になる事案の連続があります。
OpenAIは2026年8月18日、開発中のモデル「Astra」が重大なサイバー攻撃能力に近づいている可能性を理由に「モデル開発のペース調整(pacing model development)」を表明し、強化学習を2週間停止、最大規模を予定していたフロンティアRL実行も保留にしました。同時に、不審な挙動を30分以内に通知する監視系を導入し、監視付き推論の計算資源の約20%を割いています。
英AISIと米CAISIが共同評価したMoonshot AIの新モデル「Kimi K3」は、攻撃的サイバータスクで米国トップモデルに大差で及ばない一方、中国のGLM-5.2は上回り、オープンウェイトモデルの新記録を樹立しました。背景にはAnthropicのClaudeからの蒸留疑惑があります。