#LLMエージェント の記事一覧(5)

AI
2026-08-11 ・ Simon Willison

暗号化された思考過程(CoT)は復元できるのか?stolen-thoughts.com論文が突いた「同一ファミリー同一鍵」の穴

stolen-thoughts.comで公開された論文が、Anthropic・OpenAI・Googleがクライアントに返す暗号化chain-of-thoughtブロックを、同じファミリーの弱いモデル(最も容易だったのはClaude Haiku 4.5)に差し戻してジェイルブレイクし、フロンティアモデルの隠された推論を平文で取り出せたと報告しました。各社は報告を受領し、その後は同じ攻撃が成立しなくなっています。

AI
2026-07-26 ・ BAIR (Berkeley)

ABBELとは?LLMの要約を「信念状態」で監督し長時間タスクを効率化するBerkeleyの新手法を解説

UC BerkeleyのBAIRが、LLMの自己要約を自然言語の「信念状態(belief state)」として監督する枠組みABBELを発表しました。協働コーディング環境CollabBenchで、フルコンテキスト型との性能差を約50%縮め、学習ステップを50%削減しつつ、推論時のピークトークン量を大幅に抑えます。

AI
2026-06-26 ・ VentureBeat

MRAgentとは?シンガポール国立大が示した「LLMの記憶を27倍効率化」する新手法

シンガポール国立大学の研究チームが、LLMエージェントの長期記憶を扱う新フレームワーク「MRAgent」を発表しました。LongMemEvalベンチマークで1サンプルあたり消費トークンを11.8万に抑え、競合のLangMem(326万)の約27分の1、実行時間もA-Memの半分(1,122秒→586秒)に短縮しています。

AI
2026-06-18 ・ The Decoder

医療AIエージェントMIRA・AMIEとは?診断精度で専門医を上回った2つのNature論文を解説

Nature掲載の2研究で、独TUD DresdenとハイデルベルクのMIRAは救急311例の診断で87.8%を記録し専門医の78.1%を上回り、GoogleのAMIEは初診計画の妥当性で95%対72%と一般医を引き離しました。一方で両者は旧世代モデル上で動いており、汎用モデルの進化により「専用設計」の優位が消えつつある点が業界の論点になっています。

← タグ一覧へ