マルチターン攻撃とは?AIエージェントを最大88.3%突破する脅威をCiscoの検証から読み解く
Ciscoが15の主力モデルに6,986回の「マルチターン攻撃」を仕掛けたところ、会話を重ねて適応する攻撃は最大88.3%の確率で突破に成功しました。VB Transform 2026でCiscoのAmy Chang氏らが示したのは、単発プロンプトの赤チーム演習ではこの脅威を見逃すという事実です。
Ciscoが15の主力モデルに6,986回の「マルチターン攻撃」を仕掛けたところ、会話を重ねて適応する攻撃は最大88.3%の確率で突破に成功しました。VB Transform 2026でCiscoのAmy Chang氏らが示したのは、単発プロンプトの赤チーム演習ではこの脅威を見逃すという事実です。
ExpediaのAI・データ責任者Xavi Amatriain氏がVB Transform 2026で、AI時代の製品要件はコードでなく「評価(evals)」に集約され、ガードレールは最小化すべきだと主張しました。調査では157社の66%が人間のレビューなしの本番運用を許可または1年以内に目指す一方、自動評価を完全に信頼するのはわずか5%にとどまります。
VB Transform 2026で、LangChain・Conviva・CoreWeaveの登壇者は「1件の会話ログが満点でも製品は壊れている」ことがあると指摘。個別トレースの採点から、利用者集団をベースラインと比べるコホート対比評価へ、そして安価で用途を絞った小型ジャッジモデルへと評価手法が移りつつあります。
会計ソフト大手Intuitは、専門エージェントを束ねる中央オーケストレーター方式を約3カ月で放棄し、60日で「スキルとツール」型へ再構築した。原因はエージェント同士が自然言語で結果を受け渡すたびにコンテキストが失われ、誤りが増幅したことにある。VB Transform 2026でAI担当VPのNhung Ho氏が明かした。
VB Transform 2026で、LinkedIn・Walmart・Zendeskのインフラ責任者3人が「AIエージェントの本番化を阻むのはモデルではなく、人間の働き方に合わせて作られた既存インフラだ」と結論づけ、Kubernetes刷新やハーネスの自前化など具体的な解決策を共有しました。