OpenAI訴訟でシアトル・タイムズが求めた「AIモデルの破棄」とは? 約400紙の集団提訴が示す学習データの法的リスク
米シアトル・タイムズとニューズデイが2026年9月、OpenAIとMicrosoftを著作権侵害で提訴し、自社記事を含む学習データセットとAIモデル自体の破棄を求めました。両紙は、直近で提訴した約400の地方紙に続く原告となります。
米シアトル・タイムズとニューズデイが2026年9月、OpenAIとMicrosoftを著作権侵害で提訴し、自社記事を含む学習データセットとAIモデル自体の破棄を求めました。両紙は、直近で提訴した約400の地方紙に続く原告となります。
米地方紙のThe Seattle TimesとNewsdayが金曜、OpenAIとMicrosoftを共同提訴しました。ペイウォールを回避する「組織的なスクレイピング」で記事を学習に使われ、トラフィックと広告収入を奪われたという主張で、2023年のNew York Timesが開いた道に地方紙が続いた形です。
Metaが新モデルMuse Sparkで、プロンプトと出力を将来のモデル学習に提供するユーザーに平均約95%の割引を提示しました。標準価格は入力100万トークンあたり1.25ドル、出力4.25ドルですが、コントリビューター層ではそれぞれ10セント・20セントになります。
Twitchが、配信やビデオを親会社AmazonのAI学習に使わせないためのオプトアウト設定「Generative AI Training」をアカウント設定に追加しました。この追加によって「デフォルトで学習に使われていた」事実が初めて明るみに出て、フォーラムでは16,000人超のクリエイターが反対を表明しています。
OpenAIを8カ月で退社した研究者Andrew Ho氏が、LLMの汎化性能の低さは計算資源ではなく学習データの欠落に起因すると主張し、今後AI各社が1000億ドル超を「狙い撃ちのデータ収集」に投じると予測しました。バイオインフォマティクスではGPT-5.6 Solでも成功率は約30%にとどまるといいます。
AI学習データ企業Encordが、カリフォルニア州San Leandroの倉庫で人間の「パイロット」約12名にロボットの訓練データを生成させています。ドイツのZander Labsの脳波ヘッドセットを使い、Jenga崩しの最中の脳活動まで記録する試みは、ヒューマノイド・倉庫ロボットの次のボトルネックが「現実世界の物理データの枯渇」だという賭けを象徴しています。
アーティストRefik Anadolが2026年6月20日、ロサンゼルス中心部に「世界初のAIアート美術館」Datalandを開館し、最初の2週間で1万人超が来場しました。目玉は来場者の動きと生体データに反応する没入型作品「Machine Dreams: Rainforest」で、Smithsonianなどの自然科学アーカイブから自前で構築したAI「Large Nature Model」を基盤にしています。
米The Atlanticが、AIモデルの学習に使われた音楽データセット4種類(最大1,200万曲・900万曲規模)を検索可能な形で公開しました。GoogleとStabilityも論文内で利用を認めており、YouTubeやSpotifyの利用規約違反となる取得手段が常態化している実態が浮き彫りになっています。
ロボット学習用データのパイプラインを構築する米XDOFがステルスを脱し、Thrive CapitalやSpark Capital、a16zなどから7,000万ドルを調達しました。OpenAIが2021年に閉じたロボティクス部門を2週間前に再始動させた直後のタイミングで、「フィジカルAI」の競争はモデルからデータ基盤へと舞台を移しつつあります。