#Qwen3 の記事一覧(5)

AI
2026-08-21 ・ VentureBeat

KVキャッシュ転送とは?Nvidiaが示した「モデル乗り換え時の再計算ゼロ化」を解説

Nvidiaの研究チームが、あるLLMで作ったKVキャッシュを別サイズのモデルへ線形代数で写し替える手法を公開しました。32,768トークンのキャッシュをQwen3 14Bから32Bへ278ミリ秒で転送し、通常の再プリフィル(約7秒)比で2.7〜25倍高速、精度は対象モデル単独実行の最大98%を維持しています。

AI
2026-07-03 ・ The Decoder

Qwen3をファインチューニングした金融特化AIが、GPTやClaudeを超えた——BridgewaterとMira Murati新会社の共同実験

世界最大級のヘッジファンドBridgewaterとMira Murati率いるThinking Machines Labが、オープンウェイトモデルQwen3-235Bをファインチューニングし、金融文書の評価タスクでフロンティアモデルを上回る精度84.7%と、約14分の1のコストを実現したと発表しました。

AI
2025-09-06 ・ Ahead of AI

Qwen3とは何か?PyTorchでゼロから実装する記事から読み解くオープンウェイトLLMの実力

Apache 2.0ライセンスで公開されているQwen3は、235B-Instruct版がLMArenaで8位、Claude Opus 4と同順位に並ぶ実力派です。PyTorchによるフルスクラッチ実装を解説した「Ahead of AI」の記事を起点に、その存在感と事業活用の現実を整理します。

AI
2025-07-01 ・ Ahead of AI

2025年上半期のLLM推論モデル論文マップ──DeepSeek-R1からMagistralまで何を読むべきか

Ahead of AIが2025年1〜6月のLLM研究論文をトピック別に整理した読書リストを公開しました。Kimi k1.5、DeepSeek-R1、Qwen3、Magistralなど主要モデルから、検証可能な報酬による強化学習(RLVR)、推論時スケーリングまで、3カテゴリで全体像を俯瞰できます。

← タグ一覧へ