記事一覧

AI
2024-09-09 ・ The Gradient

目的駆動型対話とは?LLMチャットボットが多ターン会話で「迷子」になる構造的限界

MMLUやHumanEvalなどのベンチマークが飽和する一方、ChatGPTやClaudeは数ターンの会話で指示を忘れ始める。The Gradientは、長文脈100kトークン対応モデルでも約1.6kトークン(8ターン程度)で注意が散漫になることを示し、現行のRLHFが「目的を持った対話」を学習できていないと指摘しました。

AI
2024-08-19 ・ AI Snake Oil

AIバブルは本当か?1兆ドル投資を正当化する5つの壁とOpenAI・Anthropic・Appleの戦略転換

OpenAIやAnthropic、Google、Microsoftが総額1兆ドル規模をハードウェアとデータセンターに投じる一方、AI Snake Oilは「AGI追求から実用プロダクトへ」の転換と、コスト・信頼性・プライバシー・安全性・UIという5つの障壁を指摘しています。AI統合は1〜2年ではなく10年以上かかる見立てです。

AI
2024-07-26 ・ AI Snake Oil

AI絶滅リスクの確率予測は政策判断に使えるか?XPTが示した「100倍の開き」の意味

AI Snake Oilは、AIによる人類絶滅リスク(x-risk)の確率予測は信頼性が低く、公共政策の根拠としては誤解を招くと主張しました。Forecasting Research Instituteが2022年末に実施したXPTでは、AI専門家と予測専門家の見積もりが少なくとも100倍乖離したことが示されています。

AI
2024-07-03 ・ AI Snake Oil

AIエージェントのベンチマークはなぜ実用と乖離するのか?プリンストン大学の論文が指摘する5つの落とし穴

プリンストン大学のSayash KapoorやArvind Narayananらの研究チームが、AIエージェント評価の現状に潜む欠陥を指摘し、コスト制御や再現性確保など5つの改善策を提示する論文を公表しました。ベンチマーク上は優秀でも実用に耐えないエージェントが量産されている構造を、HumanEvalやWebArenaの事例で実証しています。

AI
2024-04-20 ・ The Gradient

LLMは金融市場を予測できるか?クオンツ運用への応用可能性と「データ量の壁」を読み解く

The Gradientが2024年に公開した論考は、GPT-3の学習に使われた5,000億トークンに対し、株式市場で年間利用可能なデータは1,770億トークンに留まるというHudson River Tradingの試算を引きつつ、LLMを定量取引に応用する際の本質的な制約と可能性を整理しています。

AI
2024-03-28 ・ The Gradient

Mambaとは?Transformerを超える状態空間モデルが100万トークン処理と5倍速を実現する仕組み

State Space Model(SSM)の系譜に連なる「Mamba」が、Transformerと同等の性能を保ちながら推論を最大5倍高速化し、100万トークン級の長文処理を現実的な計算量で可能にしました。GuとDaoによる本アーキテクチャは、3Bパラメータで同サイズのTransformerを上回り、2倍規模のモデルに匹敵する評価を示しています。

AI
2024-01-13 ・ The Gradient

シングルセルシーケンシングとは?深層学習が解読する細胞個別データの最前線

The Gradientが、シングルセルシーケンシング(sc-seq)解析における深層学習の役割を解説しました。3万近い遺伝子と細胞単位の高次元データを扱う領域で、オートエンコーダ等が次元削減と非線形構造の抽出に不可欠な存在となっています。