記事一覧

AI
2026-08-28 ・ VentureBeat

EvoHarness-RLとは?8BモデルがClaude Opus 4.5と並んだ「ハーネス学習」の中身と事業インパクト

Meta AIとイリノイ大学アーバナ・シャンペーン校(UIUC)の研究チームが、エージェントの「ハーネス(実行支援層)」自体を学習対象にする枠組みEvoHarness-RLを公開しました。8BパラメータのQwen3-8Bがベンチマーク ALFWorld で平均成功率96.9%に到達し、Claude Opus 4.5の96.4%と実質的に肩を並べています。

AI
2026-08-28 ・ Wired

JAMA論文「自律AIは医師を超えるか」とは?2030年予測とAMAの反論から読む、専門職AI化の本命論点

米医学誌JAMAに、Ezekiel Emanuel(ペンシルベニア大医療倫理・健康政策学科長)とベンチャー投資家Vinod Khosla、Curai Healthを率いるNeal Khoslaらが「自律型AI単独が、医師および医師+AIのハイブリッドを2030年までに上回る」とする論文を発表しました。問診・診断・検査選定・処方・慢性疾患管理という5つの基幹業務が対象で、米国医師会(AMA)CEOのJohn Whyteが真っ向から反論しています。

AI
2026-08-28 ・ Wired

Caraスクレイピング事件とは?1200万枚流出から生まれた検出ツール「Lantern」の意味

アーティスト向けSNS「Cara」が2026年8月13日から3度の大規模スクレイピングを受け、初回は約1200万点・12テラバイトが10ドル未満のコストで丸ごと持ち去られました。犯人の「Heft」はデータを削除し、現在は創業者Jingna Zhang氏とともに、AI学習データセット内に自作品が含まれていないかを検出するオープンソースツール「Lantern」を開発しています。

AI
2026-08-28 ・ Wired

Anthropicの国防総省ブラックリストが無効に──「AIの使い道に条件をつける」ベンダーは排除できるのか

米カリフォルニア州連邦地裁のRita Lin判事は木曜、国防長官Pete Hegsethが2月27日にAnthropicへ下した「サプライチェーンリスク」指定を、憲法違反の報復にあたるとして取り消しました。59ページの判決は、国防総省・財務省・国務省・国土安全保障省を含む9機関の制裁を一括で撤回させ、2億ドルのClaude導入交渉決裂に端を発した政府とAIラボの対立に、司法が初めて線を引いた形です。

AI
2026-08-28 ・ The Decoder

Co-Scientistとは?Google DeepMindの「実験まで回すAI科学者」が示した4%の捏造率と、ベンチマークの限界

Google DeepMindが、仮説生成AI「Co-Scientist」を実験計画・装置制御・論文執筆まで担う研究パートナーへ拡張し、材料科学・生物学・計算機科学の3分野で実験検証済みの結果を出したと発表しました。信頼性モジュール有効時の重要結果の捏造率は4%(無効時46%、比較システム90%)で、一方で医療AIの性能はベンチマークと医師評価が食い違いました。

AI
2026-08-28 ・ The Decoder

二重盲検AI評価とは?GoogleとシンガポールAI安全研究所が始めた「重みも問題も見せない」検証の仕組み

Google DeepMindが2026年8月28日、シンガポールAI安全研究所らとともに、商用フロンティアモデルとしては初となる二重盲検評価を開始しました。Google CloudのConfidential Spaceを使い、Gemini Flash Lite系モデルの重みを外部評価者に渡さず、評価者のテスト問題もGoogle側に見せないまま検証する方式です。

AI
2026-08-28 ・ The Decoder

Anthropicが国防総省の「サプライチェーンリスク」指定で勝訴——AI調達に政治リスクが持ち込まれた意味

サンフランシスコの連邦裁判所は2026年8月28日、国防総省(Department of War)がAnthropicを「サプライチェーンリスク」に指定した措置を違法と判断しました。CNBCによれば、裁判所は同社が政府のAI政策を公に批判したことへの報復であり、憲法修正第1条に違反すると認定しています。秋に予定されるIPOを前に、AIベンダー選定の前提が変わる判断です。

AI
2026-08-28 ・ The Decoder

BeatportがAI楽曲を出品禁止に──「人間が作った音楽」を有料化する審査インフラの始まり

DJ向け音楽マーケットプレイスのBeatportが、全面的またはほぼAI生成の楽曲の販売を禁止しました。人間主導の制作にAIを補助的に使った楽曲は許可されますが「AI使用」のフラグが付き、判定はストリーミング不正検知で提携済みのBeatdappの検出ツールがアップロード時に行います。