Qwen3.8-Flash-Nextとは?125Bで6Bだけ動くMoEが「手元のGPU」に降りてくる意味
Qwenが公開したオープンウェイトのマルチモーダルMoE「Qwen3.8-Flash-Next」は、125Bという規模でありながら実際に動くのは6Bのみ。Simon Willison氏は2026年8月26日、Unslothの量子化版(72.5GB版・78.9GB版)をDGX Spark上でローカル実行した経過を公開しました。次世代Qwen4アーキテクチャの先行版という位置づけです。
Qwenが公開したオープンウェイトのマルチモーダルMoE「Qwen3.8-Flash-Next」は、125Bという規模でありながら実際に動くのは6Bのみ。Simon Willison氏は2026年8月26日、Unslothの量子化版(72.5GB版・78.9GB版)をDGX Spark上でローカル実行した経過を公開しました。次世代Qwen4アーキテクチャの先行版という位置づけです。