記事一覧

AI
2025-11-04 ・ Ahead of AI

線形アテンションとは?Qwen3-NextやKimi LinearがLLMの常識を変える理由

Qwen3-Next、Kimi Linear、MiniMax-M1など、計算量をO(n²)からO(n)に下げる「線形アテンション」を採用したLLMが2025年6月以降相次いで登場。Qwen3-Nextは262kトークンのネイティブ文脈長を実現し、長文処理のコスト構造を塗り替えつつあります。

AI
2025-11-01 ・ BAIR (Berkeley)

Transitive RL(TRL)とは?BAIRが示した長期タスクに効く分割統治型・オフポリシー強化学習を解説

カリフォルニア大バークレー校のBAIRが、時間差分(TD)学習ではなく分割統治パラダイムで価値関数を学ぶオフポリシー強化学習「Transitive RL(TRL)」を公開しました。最大3,000ステップ規模の長期タスクを含むOGBenchで、TD・モンテカルロ・準距離学習の各ベースラインを上回る性能を示しています。

AI
2025-09-16 ・ SemiAnalysis

xAIの「Colossus 2」とは?ギガワット級AIデータセンターと200億ドル調達の全貌

xAIはメンフィスで世界初のギガワット級AIデータセンター「Colossus 2」を建設中で、評価額約2000億ドル、最大400億ドル規模の資金調達を準備しています。電力確保のために隣接するミシシッピ州サウスヘイブンに独自のガスタービン電源を構築し、Oracle連合の3分の1以下の期間で立ち上げました。

AI
2025-09-06 ・ Ahead of AI

Qwen3とは何か?PyTorchでゼロから実装する記事から読み解くオープンウェイトLLMの実力

Apache 2.0ライセンスで公開されているQwen3は、235B-Instruct版がLMArenaで8位、Claude Opus 4と同順位に並ぶ実力派です。PyTorchによるフルスクラッチ実装を解説した「Ahead of AI」の記事を起点に、その存在感と事業活用の現実を整理します。

AI
2025-08-20 ・ SemiAnalysis

GB200 NVL72はH100の何倍速いと元が取れるか?SemiAnalysisが示すTCO1.6倍の壁

SemiAnalysisがH100とGB200 NVL72の学習性能を比較し、GB200の全体TCOがH100比1.6倍に達するため、最低でも1.6倍の性能向上がなければ採算が合わないと指摘しました。同時に、H100のBF16 MFUがソフトウェア改善だけで1年間に34%から54%へ向上した事実も明らかにしています。

AI
2025-08-14 ・ Synced

マルチエージェントAIが失敗したとき、誰の責任か?Penn Stateらが示す「自動原因特定」の現在地

Penn State大学とDuke大学らの研究チームは、LLMマルチエージェントシステムの失敗原因を自動で特定する新タスクと、127システム分の失敗ログを集めたベンチマーク「Who&When」を公開しました。最良の手法でも責任エージェント特定の精度は53.5%、決定的な誤り箇所の特定は14.2%にとどまります。

AI
2025-08-09 ・ Ahead of AI

gpt-oss-120b/20bとは?OpenAIが6年ぶりに公開したオープンウェイトLLMの中身を解説

OpenAIが2019年のGPT-2以来となるオープンウェイトモデル「gpt-oss-120b」「gpt-oss-20b」を公開しました。20bは16GBのコンシューマGPUで、120bは80GBのH100単体で動かせる設計で、Mixture-of-ExpertsやGrouped Query Attentionなど現代的なアーキテクチャを採用しています。