何が起きたか

Redditはブログで、旧デザインのOld Redditに変更を加えると告知しました。理由は「プラットフォーム、ビジネス、ユーザーを悪質なスクレイピングやスパムから守るため」。ただし具体的に何を変えるのかは明かしていません。同時に、重要なボットやモデレーター向けのワークフローを「モダンなスタックへ移行する作業を進める」としています。

伏線は6月末にありました。Redditは未ログインユーザーからのOld Redditへのアクセスを遮断すると発表し、管理者のboat-botany氏は「Old Redditのログアウト状態は、悪質なスクレイピングと自動トラフィックの大きな発生源だ」と説明しています。この遮断は「段階的に」進行中で、Engadgetの記者は未ログインでも閲覧できたものの、後に「ネットワークセキュリティによりブロックされた」という表示に切り替わったといいます。

完全終了かどうかについて、広報は明言を避け「さまざまな選択肢を検討中」「明確なスケジュールはない」と回答。CEOのSteve Huffman氏は「アクセスを制限する、重要な用途を移行する、モダンな技術スタックで作り直す──選択肢はあり、おそらくその全部をやることになる」と述べ、「中身はともかくUIを、HTMLとCSSごと新しい基盤の上で再現するのが夢だ」とも書いています。

公開APIの終わりが本題

より影響が大きいのはAPIです。Redditは公開APIを全面的に段階廃止すると表明しました。「限定的な公開APIアクセス」は続けるものの、新規リクエストは徐々に制限し、サードパーティアプリはRedditのDeveloper Platform(通称Devit)上への移行を求められます。Devitはボットなどを開発できる仕組みですが、旧APIよりはるかに統制が強い環境です。移行を促すため100万ドル規模の「アプリ移行プログラム」も用意されました。研究者向けのアクセスが今後も残るかは不明です。

2023年、Redditは自社データが大規模言語モデルの学習に使われていることを理由にAPIを有料化し、結果としてサードパーティクライアントは事実上壊滅、サイト全体を巻き込む抗議に発展しました。今回はその続編であり、到達点です。有料化は「値付け」でしたが、今回は「経路そのものの閉鎖」。データの出口を、契約と審査を通した一本道に絞り込む動きです。

モデレーションもLLMへ

Redditはモデレーション基盤の刷新も進めており、LLMベースの「Rules Hub」のテストを拡大しています。キーワード一致に頼るAutoModと違い、ルールの意図を解釈することで「ニュアンス、自然言語、エッジケースにうまく対応できる」というのが同社の説明です。広報は、最終的にAutoModの「執行機能を置き換える」ことが目標で、「それ以外の部分は残る」としています。

スクレイピング遮断とLLMモデレーションは別の話に見えて、根は同じです。どちらも「機械が読み書きする流量を、自社の制御下に置き直す」という一貫した方針の表れといえます。

💼 事業会社視点:これは自社にどう効くか

事業視点での要点は3つです。

第一に、無償・準無償の外部APIの上に機能を載せている事業は、時限爆弾を抱えているという再確認です。ソーシャルリスニングやUGC収集を売るSaaS、口コミデータを分析に組み込むECのマーケ部門、そして「SNS連携」を要件に受託開発を請けている会社は、2023年のサードパーティクライアント全滅という前例を思い出すべきです。契約もSLAもないAPIは、事業の前提条件ではなく調達リスクとして棚卸しし、データ供給元が単一なら代替経路か契約データへの切り替えを今期中に検討すべきです。

第二に、自社が「データを持つ側」なら、Redditは先行事例になります。求人、不動産、EC、レビュー、Q&Aなど日本語UGCを抱える事業者は、AIクローラーに無償で在庫を渡し続けるのか、ログイン必須化や有料APIで囲うのかという判断を迫られます。Redditが未ログイン導線を絞ったのは示唆的で、SEO流入と学習データ流出のトレードオフをどこで切るかが経営判断になります。

第三に、Rules Hubの方向性はモデレーションに限りません。NGワード表で回している審査、コンプラチェック、CS対応のルール運用は、いずれも「キーワード一致からルール意図の解釈へ」という同じ移行曲線に乗ります。既存のルール資産をそのままLLMに読ませられる形で持っているかが、移行コストを左右します。

関連リンク