DeepSeek V4 Flash「0731」とは?GPT-5.6 Lunaに1点差で6割安いコスト構造を解説
DeepSeekが2026年7月31日に公開した廉価モデル「V4 Flash 0731」は、Artificial Analysis Intelligence Indexで50点を記録し、OpenAIの廉価モデルGPT-5.6 Lunaにわずか1点差まで迫りました。OpenAIが80%の値下げを実施した後でも、タスクあたりのコストは約60%安く、価格性能比で首位に立っています。
DeepSeekが2026年7月31日に公開した廉価モデル「V4 Flash 0731」は、Artificial Analysis Intelligence Indexで50点を記録し、OpenAIの廉価モデルGPT-5.6 Lunaにわずか1点差まで迫りました。OpenAIが80%の値下げを実施した後でも、タスクあたりのコストは約60%安く、価格性能比で首位に立っています。
Moonshot AIが2026年7月16日にオープンウェイトのMoEモデル「Kimi K3」を発表しました。2.8兆パラメータ、重みは7月27日公開予定で、Artificial Analysisの知能指数で総合3位、Frontend Code Arenaで1位。オープンと最先端の差は「6〜9カ月」から「3〜5カ月」へ縮んだと筆者は論じます。
中国のMoonshot AIが、同社最強を謳う2.8兆パラメータのAIモデル「Kimi K3」を発表しました。7月27日にオープンウェイト公開を予定し、価格は入力$3/出力$15(100万トークンあたり)と、中国製モデルとして過去最高値を付けました。
中国のKimiが総パラメータ2.8兆・コンテキスト100万トークンのマルチモーダルモデル「K3」を発表し、7月27日までに全重みを公開します。性能はFable 5とGPT-5.6 Solに次ぐ水準に迫る一方、価格は前世代K2.6から大幅に引き上げられ、中国勢による「フロンティアモデルの激安提供」が転換点を迎えたことを示しています。
OpenAIの新フラッグシップGPT-5.6 SolがArtificial AnalysisのIntelligence Indexで59点を記録し、首位のClaude Fable 5(60点)に1点差まで迫りました。しかもタスク単価は1.04ドルとFable 5の2.75ドルの約3分の1で、コーディングエージェント指標では80点で全モデル中トップです。
Anthropicの新モデルClaude Sonnet 5は入力$3・出力$15/百万トークンと価格を据え置いた一方、Artificial Analysisの計測では平均タスクコストが前世代Sonnet 4.6の約$1.20から$2.29へとほぼ倍増した。単価は変えず、トークン消費量で実質値上げする構造が続いている。
Artificial Analysisの新ベンチマーク「AA-Briefcase」で、最上位のClaude Fable 5でも全基準を満たして完遂できたのは全タスクのわずか3%。SlackやメールなどバラバラのファイルからAIが多週間の業務を遂行できるかを測ると、現行モデルの限界が一気に露呈しました。