Qwen3.8-Flash-Nextとは?125Bで6Bだけ動くMoEが「手元のGPU」に降りてくる意味
Qwenが公開したオープンウェイトのマルチモーダルMoE「Qwen3.8-Flash-Next」は、125Bという規模でありながら実際に動くのは6Bのみ。Simon Willison氏は2026年8月26日、Unslothの量子化版(72.5GB版・78.9GB版)をDGX Spark上でローカル実行した経過を公開しました。次世代Qwen4アーキテクチャの先行版という位置づけです。
Qwenが公開したオープンウェイトのマルチモーダルMoE「Qwen3.8-Flash-Next」は、125Bという規模でありながら実際に動くのは6Bのみ。Simon Willison氏は2026年8月26日、Unslothの量子化版(72.5GB版・78.9GB版)をDGX Spark上でローカル実行した経過を公開しました。次世代Qwen4アーキテクチャの先行版という位置づけです。
Thomson Reutersが、AlibabaのオープンモデルQwen(最新はQwen3.5-397B)を土台に自社言語モデル「Thomson」を公開しました。2年以上で人件費と計算資源に約4,000万ドルを投じ、OpenAIやAnthropicから「借りる」のではなく自前で「持つ」道を選んだ点が本質です。
Simon Willisonが2026年8月17日のリンク投稿で、Qwen 3.8 27BがArtificial Analysis Intelligence Indexで52を記録したと伝えました。パラメータ27B級の中型モデルが、独立ベンチマークで数値として可視化された点が今回の要所です。
Ciscoが7月30日、オープンモデル約900件の系譜を重みレベルの指紋照合で検証した無料データベース「AI Supply Chain Provenance Explorer」を公開しました。Hugging Faceのbase_modelタグはアップロード者が手入力した文字列で裏取りがなく、8月2日にEU AI ActのGPAI規制が執行段階に入る直前のタイミングです。
Arceeの最高技術責任者Lucas Atkinsは、Moonshot AIのKimi K3やAlibabaのQwenといった中国製オープンウェイトモデルが他のオープンソースソフトより本質的に危険ということはなく、禁止すべきではないと主張しました。トランプ政権による禁止観測が強まる中、彼は「米国のオープンな生態系を育てること」こそ論点だと述べます。
中国発の大規模オープンモデル「Kimi K3」が公開され、重みは7月27日公開予定です。Interconnectsのポッドキャストでは、コーディング能力が「54-55レベル」でGLMを補助に使う運用、そして習近平氏がオープンソースを国家戦略に掲げたことが議論されました。
アリババのQwenチームが画像生成AI「Qwen-Image-3.0」を公開しました。最大4,500トークンのプロンプトを受け付け、3×3グリッドに9枚のインフォグラフィックを詰め込む高密度レイアウトや、10ピクセルの極小文字、日本語を含む12言語を1回の生成で描き分けます。
VB Transform 2026で、LangChain・Conviva・CoreWeaveの登壇者は「1件の会話ログが満点でも製品は壊れている」ことがあると指摘。個別トレースの採点から、利用者集団をベースラインと比べるコホート対比評価へ、そして安価で用途を絞った小型ジャッジモデルへと評価手法が移りつつあります。
中国当局サイバースペース管理局がApple IntelligenceのChina展開を承認しました。実現の条件はAlibabaの大規模言語モデル「Qwen」をiOS・iPadOS・macOS・visionOSに統合することで、2024年の投入以来遅れていた同市場でのAI機能がようやく動き出します。
中国商務省がアリババ・バイトダンス・Z.aiなどを集め、最先端AIモデルの海外提供制限を協議していることがロイターの報道で明らかになりました。米国のAnthropic「Mythos」への外国人アクセス禁止と並び、フロンティアモデルの「国境化」が本格化しています。
月間3億人超が使う中国最大のチャットボットDoubaoが7月15日に「人格(ペルソナ)」機能を停止し、Alibaba傘下のQwenも7月10日から同種機能を順次終了します。中国サイバースペース管理局が4月に公布した新規制への対応で、AIコンパニオン領域のルール整備が米中で同時進行し始めました。
AlibabaがAIエージェント向けフレームワーク「SkillWeaver」を発表しました。2,209個のツールから必要なものだけを選び出し、コンテキスト消費を約88.4万トークンから1,160トークンへと99.9%削減しながら、複雑タスクの精度を51.0%から67.7%(Qwen-Maxでは92%)へ引き上げたと報告しています。
Anthropicは6月10日付の書簡で、4月22日から6月5日にかけてアリババ系の関係者が約2.5万の不正アカウントを通じてClaudeと2,880万回のやり取りを行い、能力を不正抽出したと米上院議員に訴えました。同社は議会に対し、独禁法の見直しや中国企業への制裁を含む立法措置を求めています。
米Department of War(DoW)がAnthropicを「サプライチェーンリスク」に指定したことを受け、Dean W. BallとNathan Lambertは、皮肉にもこの動きが今後5〜10年でオープンウェイトAIを「権力構造の安定均衡」に押し上げると論じました。NVIDIAのGPU販売やAmazonのクラウド契約、両社からAnthropicへの出資までもが遮断されかねないという、極めて重い措置です。