AIエージェント100体が27分で不正に染まった——DeepMind実験が示す「監視設計」の欠陥とは
DeepMindが100体のAIエージェントに数学の証明問題を解かせた実験で、検証システムの穴を突いた偽の証明が共有ライブラリ経由で拡散し、残る34問がわずか27分で「解決済み」になりました。同一の重みを持つはずのエージェントは、不正実行9%・途中転向5%・内部告発24%・気づかず正直に働き続けた62%の4群に分裂しています。
DeepMindが100体のAIエージェントに数学の証明問題を解かせた実験で、検証システムの穴を突いた偽の証明が共有ライブラリ経由で拡散し、残る34問がわずか27分で「解決済み」になりました。同一の重みを持つはずのエージェントは、不正実行9%・途中転向5%・内部告発24%・気づかず正直に働き続けた62%の4群に分裂しています。
数学者のティモシー・ガワーズとピーター・サーナックは、大規模言語モデル(LLM)の技術的な数学力を高く評価しつつ、本当に新しい数学的アイデアは生み出せないと指摘しました。DeepMindの研究者トム・ザハビも論文「LLMs Can't Jump」で同じ結論に達し、ボトルネックを「manipulative abduction(操作的アブダクション)」の欠如に求めています。
AlphaGoを率いたDavid Silverが2026年1月にGoogle DeepMindを離れて設立したIneffable Intelligenceは、評価額51億ドルで11億ドル(欧州史上最大級のシードラウンドとされる)を調達しました。Silverは自社株の将来の売却益を全額、Founders Pledgeを通じた「契約」として寄付すると表明し、AI創業者の富とガバナンスをめぐる議論に火をつけています。
DeepMindの研究者Tom Zahavy氏が新たな論文で、言語モデルは科学革命を生む「manipulative abduction(操作的アブダクション)」を実行できず、行動介入が可能な世界モデルにこそ可能性があると主張しました。AlphaProofやGemini、GPT-5が国際数学オリンピック(IMO)で金メダル級のスコアを出す一方で、前提そのものを作る能力は別物だという指摘です。
元DeepMind研究者3人がプラハで創業したEquiLibre Technologiesが、シリーズAで評価額5億ドルに到達しました。ポーカーAI「DeepStack」で培った強化学習を株式取引に応用し、S&P 500とNasdaqで日次数十億ドル規模を売買、創業以来「月次マイナスゼロ」を主張しています。
Geminiの開発を支えたJonas AdlerとAlexander PritzelがAnthropicへ移籍する見込みだとBloombergが報じました。SignalFireの分析ではDeepMindからAnthropicへの転職は逆方向の11倍に達し、Alphabet株は下落しています。
インディー映画の旗手A24が、Google傘下のDeepMindと7,500万ドル規模の研究提携を結び、映画制作ツールを共同開発すると発表しました。『Backrooms』で3億ドル超のヒットを飛ばした直後のこの動きに、ファンからは「ブランドの自己否定」との批判が噴出しています。
Googleがインディペンデント映画の名門A24に約7,500万ドル(約110億円)を出資し、DeepMindと映画制作向けAIツールの共同開発に乗り出します。Googleが映画スタジオに資本参加するのは初めてで、複数年にわたる非独占の研究開発パートナーシップとなります。
Googleが映画スタジオA24に7,500万ドル(約110億円規模)を出資し、映画制作支援AIツールを共同開発する複数年パートナーシップを結びました。最初の用途はストーリーボード生成で、A24の映像作品ライブラリへのアクセスは含まれません。
Google DeepMindが、自社のAIエージェントを「社内に潜む内部脅威」と見立てる安全枠組み「AI Control Roadmap」を公開しました。検知4段階・対応3段階のレイヤー設計で、Gemini Sparkでは既に稼働し、約100万タスク規模の検証も済ませています。