Qwen 3.8 27Bとは?スコア52が示す「中型オープンモデル」の実力と選定基準
Simon Willisonが2026年8月17日のリンク投稿で、Qwen 3.8 27BがArtificial Analysis Intelligence Indexで52を記録したと伝えました。パラメータ27B級の中型モデルが、独立ベンチマークで数値として可視化された点が今回の要所です。
Simon Willisonが2026年8月17日のリンク投稿で、Qwen 3.8 27BがArtificial Analysis Intelligence Indexで52を記録したと伝えました。パラメータ27B級の中型モデルが、独立ベンチマークで数値として可視化された点が今回の要所です。
Googleが自ら運営するAndroidアプリ開発向けLLM評価ベンチマーク「Android Bench」の最新版で、Gemini 3.1 Proは5位。首位はClaude Fable 5の84.5%で、GPT 5.4やClaude Sonnet 5にも及ばず、モバイル開発領域でのGeminiの遅れが自社ベンチで可視化された格好です。
Moonshot AIはコーディング特化モデル「Kimi K2.7-Code」をオープンソースで公開し、前世代K2.6比で思考トークンを30%削減したと発表したが、独自ベンチマークでの好成績に対し研究者からは「自社テストでの改善は誰でも示せる」との批判が上がっている。