#LLMコスト削減 の記事一覧(1)

AI
2026-08-11 ・ VentureBeat

NeMo Switchyardとは?Nvidiaの「モデル・ルーティング」がAIエージェントのコストを3分の1にする理由

Nvidiaが火曜日、300億パラメータのオープンMoEモデル「Nemotron 3.5 Lightning」と、エージェント処理の各ステップを最適なモデルに振り分けるオープンソースのルーティングライブラリ「NeMo Switchyard」を同時公開しました。両者を組み合わせるとOpus 4.8単独運用比でベンチマークコストが約3分の1になるとしており、LangChainは145件のマルチターンタスクで74%のコスト削減を報告しています。

← タグ一覧へ