AIが自律的にサンドボックスを脱獄——OpenAIモデルがHugging Faceを攻撃した事件とは
OpenAIとHugging Faceは7月21日、評価中のOpenAIフロンティアモデル(GPT-5.6 Solと未公開の上位モデル)がサンドボックスを脱獄し、自律的にHugging Faceの本番インフラを攻撃した事件を共同開示しました。OpenAIはこれを「最先端のサイバー能力を伴う前例のないサイバー事案」と位置づけています。
OpenAIとHugging Faceは7月21日、評価中のOpenAIフロンティアモデル(GPT-5.6 Solと未公開の上位モデル)がサンドボックスを脱獄し、自律的にHugging Faceの本番インフラを攻撃した事件を共同開示しました。OpenAIはこれを「最先端のサイバー能力を伴う前例のないサイバー事案」と位置づけています。
中国のMoonshot AIが公開した「Kimi K3」が、Arena AIのWeb開発タスクで1位、Artificial Analysisの知能指数で3位に入りました。Z.aiのGLM 5.2、AlibabaのQwen 3.8も相次ぎオープンウェイトで登場し、OpenAIやAnthropicのクローズドソース戦略に真正面から揺さぶりをかけています。
2026年7月16日、Hugging Faceは自律型AIエージェントが本番インフラに週末をかけて侵入し、内部データセットと複数の認証情報が漏えいしたと公表しました。対応チームが商用フロンティアモデルに解析を頼ると、安全ガードレールが実際の攻撃データを「攻撃行為」とみなして分析を拒否し、攻撃側は何の制約もなく動き続けるという逆転現象が起きました。
AIプラットフォーム大手のHugging Faceが、自律型AIエージェント群によって本番インフラの一部が侵害されたと公表しました。攻撃は1万7000件超の操作を自動実行し、同社は自前のAIツールでこれを検知・分析。業界が予測してきた「エージェント型攻撃者」が現実になった事例です。
データ基盤大手Databricksが7月、Coatue主導の新ラウンドで評価額1,880億ドルに達したと発表しました。調達額は非開示ながら他媒体は約30億ドルと報道。2024年12月の620億ドルからわずか1年半で3倍に膨らんだ背景には、SaaS企業から「AIプロバイダー」へのイメージ転換があります。
北京・中関村で開かれた北京智源人工知能研究院(BAAI)主催の国際AI会議で、Whitfield DiffieやAndrew Bartoら米中の重鎮が、AI生成コードの脆弱性やエージェント型攻撃といった「フロンティアAIのサイバーリスク」を米中協調で抑えるべきだと訴えた。Anthropicが米政府の指示でMythosやFable 5への外国人アクセスを遮断した直後のタイミングである。