NeMo Switchyardとは?Nvidiaの「モデル・ルーティング」がAIエージェントのコストを3分の1にする理由
Nvidiaが火曜日、300億パラメータのオープンMoEモデル「Nemotron 3.5 Lightning」と、エージェント処理の各ステップを最適なモデルに振り分けるオープンソースのルーティングライブラリ「NeMo Switchyard」を同時公開しました。両者を組み合わせるとOpus 4.8単独運用比でベンチマークコストが約3分の1になるとしており、LangChainは145件のマルチターンタスクで74%のコスト削減を報告しています。