AI検出ツールPangramの「28%」は何を測っているのか — スコアで人を裁く危うさ
AI検出サービスPangramが、ジャーナリストのRod Breslau氏を「攻撃犬」として雇い、SNSでAI利用者を名指しする戦術をとっていたとWIREDが報じました。The Decoderの論考は、検出スコアが測れるのは「AIを使ったか」だけで「どう使ったか」ではない点を突き、実際に同誌の記事は28%のAI判定を受けています。
AI検出サービスPangramが、ジャーナリストのRod Breslau氏を「攻撃犬」として雇い、SNSでAI利用者を名指しする戦術をとっていたとWIREDが報じました。The Decoderの論考は、検出スコアが測れるのは「AIを使ったか」だけで「どう使ったか」ではない点を突き、実際に同誌の記事は28%のAI判定を受けています。
AI生成コンテンツ検知のPangramが900万ドルを調達し、ニュースレター配信基盤Substackと提携しました。Substackは同社技術を使い、どの書き手がAIで執筆しているかを読者に表示します。AI画像の検知ツールも新たに投入され、「AI利用の可視化」がプラットフォーム側の標準機能になり始めています。
従業員24人・累計調達1300万ドル(OpenAIの約0.0072%)のブルックリン発スタートアップPangramが、小説『Shy Girl』を「78%がAI生成」と判定してHachetteの刊行中止を招き、7月末にはSubstackへの統合も決まりました。スコアが事実上の処分根拠として機能する一方、誤検知・偏り・利益相反という三つの穴が同時に露呈しています。
LinkedInは7月30日に導入した「Seems like AI slop(AIスロップのようだ)」報告ボタンが100万人以上にクリックされ、AIスロップと分類された投稿の表示回数が40%減ったと明かしました。AI検出企業Pangramが同社の長文投稿の41%を「完全なAI生成」と判定した直後の施策で、プラットフォーム側が「AIっぽさ」を可視化し始めたことを意味します。
LinkedInが導入した「seems like AI slop(AIの粗製乱造っぽい)」報告ボタンが、公開から数週間で100万回以上使われ、同社がAIスロップと分類したコンテンツの閲覧数は40%減少しました。さらに自分の投稿が通報された事実を本人に知らせる通知機能も追加されます。
AI文章検出ツールPangramのCTOブラッドリー・エミ氏は、LLMの文章が検出できるのは能力の限界ではなく、事後学習(ポストトレーニング)と安全ガードレールが表現の幅を狭める「モードコラプス」のせいだとブログで論じました。事後学習前のベースモデルはPangramの検出に引っかからない、というのが主張の核心です。
LinkedInが、投稿を「seems like AI slop(AIの粗製濫造に見える)」として通報できる機能のテストを開始し、同時に自ら推していた「rewrite with AI」ボタンを削除します。AI検出企業Pangramの調査では、LinkedInは最もAI飽和度の高いSNSで、長文投稿の40%超が「完全にAI生成」と判定されていました。
ニューヨークのAI検出スタートアップPangramが、Menlo Venturesをリードに900万ドルを調達し、次世代テキスト検出モデル「Pangram 4」と画像検出「Pangram Image」を同時に公開しました。テキストはAI補助や人間とAIの混在文まで99%超の精度で見分けるとされ、すでにSubstackがAPI連携で「AIを使って書いている著者」を読者に開示し始めています。
AI文章検出を手がけるPangramが新モデル「Pangram 4」を公開しました。自社ベンチマークでAI生成文の99.66%を検出し、人間の文章を誤ってAIと判定する確率は0.0041%(約2万4000件に1件)。旧モデル比で誤検知は14分の1、見逃しは6分の1としています。
Substackが今週、AI文章検出ソフトのPangramと連携。アプリ上で100文字以上の投稿・コメント・返信をスキャンし、人間とAIの執筆割合の推定値を表示できるようになりました。禁止ではなく「開示を促す」設計が特徴です。
Substackは、投稿・ノート・返信・コメントの文章がどの程度AI生成・AI補助で書かれたかを推定する検出機能を追加しました。AI検出企業Pangramを採用し、Web版とiOSアプリで提供開始、Android版も近く追加されます。
Substackが検出企業Pangramと組み、投稿のうちどれだけがAIで書かれたかを読者が判定できるツールを本日開始しました。100語超のテキストが対象で、Web版とiOSから利用でき、Androidは後日対応。同時に、創作者がAI利用の有無や方法を自己申告する記述欄も新設されます。
Epoch AIの検証で、Pangram・GPTZero・Originality.aiの主要AI文章検出ツールは、単純生成のAI文はほぼ完璧に見抜く一方、特定著者の文体を模倣させたAI文は平均約13%を見逃し、科学論文では24〜29%を取りこぼすことが分かりました。
検出企業Pangramが2026年4月〜6月に5プラットフォームの100万件超の投稿を調べたところ、250語を超える長文投稿の4件に1件がAI生成で、LinkedInは41%と最も高い比率でした。全スキャン投稿のうちLinkedInは約3分の1に過ぎないのに、検出されたAIコンテンツの実に3分の2近くを占めています。
作家団体Authors Guildが2020〜2022年の人間執筆10記事でAI検出ツールを検証したところ、PangramとGrammarlyは全件を正しく人間と判定した一方、Sidekickerは全記事をAI生成と誤判定し、うち2本は100%スコアを付けました。検出ツールの精度が事業判断の根拠になり得るかを問い直す結果です。
AI検出ツールPangramのMax Spero CEOがAI Policy Perspectivesのインタビューで、言語モデルが残す痕跡は誤字や不自然な表現ではなく「論点の均質さ」と文書構造のパターンだと明かしました。同じテーマで100の論点を生成させると、人間の発想空間に比べ極めて狭いクラスタに収束するといいます。