AIエージェントの「検索コスト」が経営課題に——Nimble Web Search Agentsが示すトークン51%削減の意味
ニューヨークのNimbleが11月、企業向け検索基盤「Web Search Agents」を公開しました。同社は主要なAI検索と比べて精度21%向上・トークン消費51%削減を主張し、AI-native CRMのRoxはトークンコストが20分の1になったと報告しています。価格はリクエストあたり0.025ドルから、マネージド契約は月2,500ドルからです。
ニューヨークのNimbleが11月、企業向け検索基盤「Web Search Agents」を公開しました。同社は主要なAI検索と比べて精度21%向上・トークン消費51%削減を主張し、AI-native CRMのRoxはトークンコストが20分の1になったと報告しています。価格はリクエストあたり0.025ドルから、マネージド契約は月2,500ドルからです。
AI企業Writerの研究論文が、基盤モデルをそのままに、モデルを包む「ハーネス(オーケストレーション層)」を最適化するだけでタスクあたりのトークンを38%(14.2k→8.8k)、コストを41%(21セント→12セント)削減し、成功率は78%→81%に維持したと報告しました。エンタープライズAIのROIを左右する「見落とされてきたレバー」を検証した内容です。
Microsoft CEOのサティア・ナデラ氏が、あらゆるタスクに最強AIモデルを使う「トークンマックス」を戒め、自身も中毒的にやっていると認めました。同氏は開発者がコードを書く時代から、数百〜数千のAIエージェントを統括する時代への移行を示唆しています。