記事一覧

AI
2026-08-09 ・ The Decoder

WeatherNext Cyclones(WN-C)とは?Googleの台風AIが進路と強度を同時予測、5日先誤差230kmで「警報1日分」を稼ぐ

Google DeepMindが、熱帯低気圧の進路と強度を単一モデルで予測するAI「WeatherNext Cyclones(WN-C)」をコードと重みごとオープンソース公開しました。5日先の中心位置誤差は平均230kmで、ECMWFのアンサンブル(ENS)の370km、前世代GenCastの335kmを上回り、実務上は約1日分の警報リードタイムに相当します。

AI
2026-08-09 ・ The Decoder

AI生成の訴状が裁判所を詰まらせる──英国労働審判で仮救済申立てが100倍、未処理6.4万件が示す「紛争コストの反転」

英国の労働審判所で、ChatGPTやGrokで作成された申立てが急増し、仮救済(interim relief)の申立件数が100倍に膨らみました。2026年3月までの1年で申立ては39%増、未処理案件は55%増の6万4000件に達し、審判所長のBarry Clarke氏とSusan Walker氏は内部メモで事態を「厳しい(grim)」と表現しています。

AI
2026-08-09 ・ The Decoder

DiffusionGemmaとは?Googleが既存モデルを「拡散化」して毎秒1,500トークンを実現した仕組みと限界

Google DeepMindが実験的なテキスト拡散モデル「DiffusionGemma」を公開しました。ゼロから学習せず既存のGemma-4-26B-A4Bを元の学習トークン予算の1割未満で変換し、精度を同等に保ったまま出力速度を数倍(毎秒約1,500トークン)に引き上げた点が新しさです。

AI
2026-08-09 ・ The Decoder

AIデータセンターの電力争奪とは?NvidiaのLancium出資とAmazonのガス火力から読む「電力がAIの上限になる」構図

NvidiaがテキサスでOpenAI・Oracle向けデータセンターの電力基盤を手がけるLanciumに最大30億ドルを投じ、Amazonはテキサス州ペコス郡で35基のガスタービン・最大7.65ギガワットの火力発電所を後押しします。AI競争の主戦場が、半導体から「発電所と送電枠」へ移り始めたことを示す動きです。

AI
2026-08-09 ・ Simon Willison

Claude Fable 5・Mythos 5の提供停止とは?輸出規制による19日間の空白と、システムプロンプトに残された記録

2026年6月9日に公開されたClaude Fable 5とClaude Mythos 5は、6月12日に米商務省の輸出規制対応でAnthropicが提供を停止し、規制解除を受けて7月1日に復旧しました。この経緯が、Claude Opus 5のシステムプロンプトに「事実として正確に答えよ」という指示付きで書き込まれていることを、Simon Willison氏が8月9日に引用・紹介しています。

AI
2026-08-08 ・ TechCrunch

NextSlideとは?OpenAIが買収した資料生成AIから読む、ChatGPTの「成果物づくり」シフト

プレゼン資料生成スタートアップNextSlideがOpenAIに買収され、チームはすでにChatGPTの開発に加わっています。TechCrunchが2026年8月8日に報じたもので、買収自体は今年前半に完了済み、金額は非開示。創業者Ahmed Beshry氏は、2021年にInstacartが買収したレジレス決済のCaper AI共同創業者でもあります。

AI
2026-08-08 ・ Engadget

ClaudeとChatGPTの違いを2026年版で比較——幻覚率55%対89%、無料枠の広告、Cowork/skillsまで

AA-Omniscienceの精度スコアはClaude Fable 5(Max)61%対GPT 5.6 Sol(Max)59%とほぼ互角ですが、ハルシネーション率はClaude 55%対ChatGPT 89%と大差がつきました。Engadgetの比較記事は、性能差より「間違えなさ」「無料枠の広告」「2026年2月の米政府契約」という三点が両者の選択を分けていると指摘しています。

AI
2026-08-08 ・ The Decoder

Claude Code「Auto Mode」デフォルト化とは?8月14日から何が変わり、開発現場のレビュー体制はどう組み直すべきか

Anthropicは8月14日から、Claude CodeのAuto ModeをPro・Max・Teamプランでデフォルト有効にします。1,053人の有料テスターを使った検証では、危険なコマンドの検知率が人間のレビュアー13.6%に対しAuto Modeは89%、チームのプルリクエスト数は約25%増えたとしています。

AI
2026-08-08 ・ The Decoder

ChatGPTの短編小説はなぜ人間より高評価なのか──1,682人実験が示した「読みやすさ」と表示バイアス

学術誌Judgment and Decision Makingに掲載されたSydney SearsとDeena Skolnick Weisbergの研究で、ChatGPT 4.0が生成した約1,000語の短編は、文芸誌掲載の人間作品より品質(1.54対0.97)でも没入感(1.42対1.00)でも高く評価されました。一方で「AIが書いた」と伝えられた作品は実際の著者に関係なく点が下がり、905人が直接読み比べた追試でも判別精度は偶然の域を出ませんでした。