Deepseek V4-Flash-Vision-Expとは?画像1枚384トークンで動くエージェント向け視覚モデルを解説
中国のDeepseekが、V4-Flashに画像理解を足した実験的マルチモーダルモデル「V4-Flash-Vision-Exp」を公開しました。社内のマルチモーダルエージェントベンチマークではOpus 4.8に迫り、項目によっては上回るとされ、画像1枚あたりのコストは最大384トークン、1リクエストに最大600枚を投入できます。
中国のDeepseekが、V4-Flashに画像理解を足した実験的マルチモーダルモデル「V4-Flash-Vision-Exp」を公開しました。社内のマルチモーダルエージェントベンチマークではOpus 4.8に迫り、項目によっては上回るとされ、画像1枚あたりのコストは最大384トークン、1リクエストに最大600枚を投入できます。
Microsoftはオープンウェイトモデルを推す公開書簡にMeta・Nvidia・Hugging Faceら20社超と署名し、GitHub CopilotやExcel、Outlookで使うAIをOpenAI・Anthropic製から自社の「MAI」に置き換え始めました。ベンチマークでMAIはDeepseek V3.2並みで両社の主力に及びませんが、狙いは性能競争ではなくAzureの収益とマージンにあります。
中国Moonshot AIの新モデル「Kimi K3」が、西側AI業界の前提だった「計算力が能力を決める」という考えを揺さぶっています。1タスク平均0.94ドルとGPT 5.6 Solの1.04ドルに肉薄し、MITとGoogle Deepmindの研究者は「蒸留だけでは説明不可能」「異常なほど良い」と評価しました。
開発者Steven Chong氏が公開したオープンソースツール「pxpipe」は、Claude Codeへのリクエストのうちシステムプロンプトや長い履歴をPNG画像として送ることで、トークンコストを平均59〜70%削減します。Fable 5のデモでは1セッションのコストが42.21ドルから6.06ドルへと約85%縮小しました。
米Coinbaseが社内のAI開発基盤をGLM 5.2やKimi 2.7など中国製モデルへ切り替え、トークン消費量を増やしながらAI支出を半減させました。OpenAIやAnthropicへの依存度を下げる動きは、Snowflakeやスタートアップにも波及しています。
AIスタートアップ Lindy が Anthropic の Claude を完全に捨て、Deepseek に全面移行し数百万ドルを節約しました。CEOのFlo Crivello氏は「コストカーブが地に落ちた」と語り、エージェント時代のAIコストが事業存続に直結する局面に入ったことを示しています。