Gemini 3.8 Flashはなぜ「値上げ」に見えるのか?単価据え置きでもタスク単価が約40%上がる理由
Googleが前世代Gemini 3.7 Flashからわずか数週間でGemini 3.8 Flashを投入しました。入力100万トークン0.75ドル・出力3.75ドルという単価は据え置きですが、Artificial Analysisの計測ではタスクあたりコストは約40%上昇。原因は出力トークンが30%増え、エージェント評価での往復回数が増えたことにあります。
Googleが前世代Gemini 3.7 Flashからわずか数週間でGemini 3.8 Flashを投入しました。入力100万トークン0.75ドル・出力3.75ドルという単価は据え置きですが、Artificial Analysisの計測ではタスクあたりコストは約40%上昇。原因は出力トークンが30%増え、エージェント評価での往復回数が増えたことにあります。
OpenRouterで6日間正体不明のまま1日数兆トークンを処理していた「Ox Alpha」は、中国Z.aiのGLM-5.3-Flashでした。8月26日の公表と同時に、MITライセンスの公開重み、中国製チップのみでの推論提供、100万トークンあたり15セント/50セントという価格が明らかになり、上位モデルとの「知能2ポイント差に7倍の価格差」という構図が可視化されています。
OpenRouterに匿名で投入され各種ベンチマークの首位を取っていたオープンウェイトモデル「Ox Alpha」の開発元が、GLMシリーズを手がけるZ.aiだったとBloombergが報じました。Z.aiはOx AlphaをGLMシリーズの最新版だと認め、重み(ウェイト)を水曜日に公開すると表明しています。
Alibabaの Qwen チームが、総パラメータ1250億・トークンあたり活性60億のマルチモーダルMoE「Qwen3.8-Flash-Next」を公開しました。同社説明では Qwen3.7-Plus を約9分の1の学習コストで上回り、価格は入力100万トークン0.16ドル/出力0.47ドル。次世代 Qwen4 のアーキテクチャ先行公開という位置づけです。
SpaceXAIのGrok 4.6がArtificial Analysis Intelligence Indexで61点を獲得し、OpenAIのGPT-5.6 Solと同点に並びました。価格は100万トークンあたり$2/$6と据え置きで、$5/$30のGPT-5.6 Solより6割以上安く、上位モデルとの「性能差」より「価格差」が事業判断の主変数になりつつあります。
AnthropicがコーディングAI「Opus 5」を公開しました。Opus 4.5のような性能の大飛躍ではなく、上位モデルFableに迫る品質を約半分のコストで出す「費用対効果」路線が今回の主眼です。
Anthropicが新モデル「Opus 5」を公開しました。最上位モデルFable 5に近い性能を半額(入力100万トークン5ドル、出力25ドル)で提供し、Fable 5で不満の多かった過剰なセーフガードも緩和しています。
米陸軍は生成AIプラットフォーム「Ask Sage」の年間契約枠1億トークンを、無制限提供を打ち出した2026年5月からわずか1カ月半で使い切り、6月中旬に利用制限を再導入しました。国防総省が全職員350万人の半数近くがAIを業務利用していると公表した直後の出来事です。
Googleがコスト効率重視の「Gemini 3.6 Flash」、低遅延の「3.5 Flash-Lite」、セキュリティ特化の「3.5 Flash Cyber」の3機種を公開しました。一方で本命フラッグシップ「Gemini 3.5 Pro」はパートナー限定テストのまま未公開で、Bloombergは同モデルがコーディング性能改善のため数カ月遅延と報じています。
中国のKimiが総パラメータ2.8兆・コンテキスト100万トークンのマルチモーダルモデル「K3」を発表し、7月27日までに全重みを公開します。性能はFable 5とGPT-5.6 Solに次ぐ水準に迫る一方、価格は前世代K2.6から大幅に引き上げられ、中国勢による「フロンティアモデルの激安提供」が転換点を迎えたことを示しています。
Anthropicは2026年7月12日、有料プラン上でのClaude Fable 5の提供終了時期を再び先送りし、7月19日まで延長すると発表しました。Claude Codeの週次レート上限を50%高い水準に維持する措置も継続され、その背景にはFable/Mythosクラスと目されるOpenAIのGPT-5.6 Solの存在があります。
Hugging FaceのCEOクレム・デランジュ氏が、企業は当初フロンティアのAPIから始めても、規模拡大に伴うコストでオープンソースモデルへ移行していくと指摘しました。同社のプラットフォームは今やFortune 500のおよそ半数に使われており、その視点からの発言です。
OpenAIのVaibhav Srivastav氏が、GPT-5.6 Solに用意された5段階の推論レベル(Light/Low/Medium/High/xhigh、加えてMax・Ultra)の使い分けを解説しました。前世代GPT-5.5のティアとは対応せず、乗り換える人は「今までより1段階低いレベル」から始めるべきだといいます。
OpenAIの新フラッグシップGPT-5.6 SolがArtificial AnalysisのIntelligence Indexで59点を記録し、首位のClaude Fable 5(60点)に1点差まで迫りました。しかもタスク単価は1.04ドルとFable 5の2.75ドルの約3分の1で、コーディングエージェント指標では80点で全モデル中トップです。
AIスタートアップ Lindy が Anthropic の Claude を完全に捨て、Deepseek に全面移行し数百万ドルを節約しました。CEOのFlo Crivello氏は「コストカーブが地に落ちた」と語り、エージェント時代のAIコストが事業存続に直結する局面に入ったことを示しています。
AnthropicがMythos級の公開モデル「Claude Fable 5」を投入。SWE-bench Verifiedで95%、Vibe Code Benchで90.35%とコーディング系で首位に立つ一方、月2万ドル級のコスト、約8〜9%のタスクで発生する拒否・フォールバック、30日間のデータ保持ポリシーが事業利用の論点となっています。
AppleはWWDCで、App Storeの初回ダウンロードが200万未満の開発者に対し、Private Cloud Compute上で動くFoundation Modelsをクラウド利用料ゼロで開放すると発表しました。AI実験コストの高騰が常態化する中、推論コスト負担を肩代わりする異例の措置です。
Anthropicが650億ドル規模のシリーズH調達を発表し、同時に売上ランレート(年換算)が470億ドルを突破したと公表しました。2026年2月時点の140億ドルから、わずか4ヶ月足らずで3倍以上に膨らんだ計算になります。