#AI学習データ の記事一覧(23)

AI
2026-09-08 ・ The Verge

ナビエ・ストークス問題をAIが解いた?OpenAIの主張と「Codexの履歴が使われた」疑義を整理

OpenAIは火曜、GPT-6 Astraを上回る社内モデルと1万体の並列エージェントで、約90年未解決だったナビエ・ストークス問題の解を得たとブログで公表しました。一方、前日に関連する成果を発表したニューヨーク大学のTristan Buckmaster氏は、自分たちがCodexに入れ続けていた草稿が結果に影響した可能性を指摘しています。

AI
2026-09-06 ・ The Decoder

Lyria 3.5とは?Geminiアプリで使えるGoogleの音楽生成AIと「ライセンス済み学習データ」の意味を解説

Googleは2026年9月6日、音楽生成モデル「Lyria 3.5」をGeminiアプリとAPIで提供開始しました。Flow Music、AI Studio、Vidsでも使え、Googleは前世代より歌唱表現とアレンジが豊かになったとし、学習データはライセンス済みコンテンツのみだと主張しています。

AI
2026-09-02 ・ Wired

AI学習は「フェアユース」か?米政府がOpenAI支持の意見書、NYT訴訟の論点を整理

米トランプ政権が火曜日、ニューヨーク・タイムズがOpenAIとMicrosoftを訴えた2023年提訴の著作権訴訟で、AI学習はフェアユースにあたるとする意見書を連邦地裁に提出しました。司法省名義の文書は、著作物によるLLMの学習を「極めて変容的(extraordinarily transformative)」と位置づけ、フェアユースの解釈を米国のAI競争力と直結させています。

AI
2026-08-31 ・ Ars Technica

音楽出版社がAnthropicを提訴——歌詞・楽譜の海賊版学習疑惑と、日本企業のAI利用に及ぶ影響

ソニー、EMI、Warner Chappellら音楽出版社が金曜、Anthropicを提訴しました。同社が海賊版図書館LibGen/PiLiMiから大量にトレントした書籍のなかに「何千、何万もの」楽曲著作物が含まれ、Claudeが歌詞を再生産していると主張。著者側との15億ドル和解は「2兆ドル評価の企業を抑止するには小さすぎる」と述べています。

AI
2026-08-30 ・ The Decoder

ソニー・ワーナーがAnthropicを提訴 — 「学習」ではなく「入手経路」が争点になるAI著作権訴訟の本質

ソニー・ミュージックやワーナー・ミュージックなど大手音楽出版社が、カリフォルニア州北部連邦地裁でAnthropicを提訴しました。48ページの訴状は、数万曲分の楽曲(主に歌詞)を違法にトレントで入手しClaudeの学習に使ったと主張し、CEOのダリオ・アモデイ氏と共同創業者のベンジャミン・マン氏を個人としても被告に加えています。

AI
2026-08-29 ・ TechCrunch

Anthropic音楽出版社訴訟とは?ソニー・ワーナーが問う「学習データの入手経路」リスクを解説

Sony Music PublishingとWarner Chappellを含む複数の音楽出版社が2026年8月28日(金)夜、AnthropicとDario Amodei氏、Benjamin Mann氏を米カリフォルニア州北部地区連邦地裁に提訴しました。Claudeの学習のために数千点の著作物を「あからさまな窃盗」で取得したとし、torrentによる書籍数百万部の入手を「露骨な海賊行為」と主張しています。

AI
2026-08-29 ・ The Verge

AI学習データの著作権リスクとは?ソニー・ミュージックがAnthropicを提訴した件から読む調達実務

Sony MusicとWarner Chappellが2026年8月29日、カリフォルニア州北部連邦地裁でAnthropicと共同創業者のDario Amodei氏・Benjamin Mann氏を提訴しました。数万曲の楽曲について1作品あたり最大15万ドル、著作権情報の削除1件につき最大2万5000ドルを請求しており、認容されれば総額は数十億ドル規模に達し得ます。

AI
2026-08-29 ・ Engadget

AI学習データの著作権訴訟はどこまで来たか——ソニー・ワーナーがAnthropicを提訴、1曲あたり15万ドル請求の意味

Sony Music PublishingとWarner Chappell Musicが金曜、Anthropicを著作権侵害で提訴しました。Claudeの学習に楽曲を大規模にトレント・スクレイピングしたとし、侵害1作品あたり最大15万ドル、著作権管理情報の削除1件あたり2万5000ドルを求めています。Anthropicは今年、著者らとの訴訟を過去最大の15億ドルで和解したばかりです。

AI
2026-08-28 ・ Wired

Caraスクレイピング事件とは?1200万枚流出から生まれた検出ツール「Lantern」の意味

アーティスト向けSNS「Cara」が2026年8月13日から3度の大規模スクレイピングを受け、初回は約1200万点・12テラバイトが10ドル未満のコストで丸ごと持ち去られました。犯人の「Heft」はデータを削除し、現在は創業者Jingna Zhang氏とともに、AI学習データセット内に自作品が含まれていないかを検出するオープンソースツール「Lantern」を開発しています。

AI
2026-08-27 ・ Ars Technica

Grokの学習データにCSAM混入か——xAI集団訴訟が突きつける「生成物を再学習する設計」のリスク

被害者女性が水曜、xAIを相手取り、GrokがCSAM(児童性的虐待物)を学習データに使ったとする集団訴訟を提起しました。争点は画像生成の是非よりも、公開投稿とGrok自身の出力を既定で学習に回すというxAIの規約設計と、いったん学習したデータの影響を後から除去できるのかという技術的な問いです。

AI
2026-08-21 ・ TechCrunch

AI学習データ市場とは?Micro1が8カ月で年換算売上5倍、データ調達が「第二の計算資源」になる理由

AIデータラベリングのMicro1が、直近8カ月でグロス年換算売上(ARR)を1億ドルから5億ドルへと5倍に伸ばしたとTechCrunchが報じました。Mercorの20億ドル、Handshakeの10億ドルに次ぐ規模で、AI学習データの調達競争が複数社を同時に成立させるほど過熱していることを示しています。

AI
2026-08-17 ・ TechCrunch

AI学習データ枯渇とは?Amazonが希少本を裁断・スキャンする理由と「モデル崩壊」の関係を解説

404 Mediaの調査により、Amazonが希少本を大量に買い集め、背を裁断してスキャンし、AIの学習データ化していることが明らかになりました。404 Mediaが本に追跡装置を仕込んだところ、ラスベガスにあるAmazonの施設「VGT3」に到着したといいます(TechCrunch、2026年8月17日)。

AI
2026-08-17 ・ Ars Technica

AmazonのAI学習用「本の解体スキャン」とは?Airtagが暴いたVGT3拠点と、ISBN網羅という戦略

希少本に仕込まれたApple製Airtagが、大量注文の行き先をラスベガスにあるAmazonのAI学習用施設「VGT3」まで追跡した——404 Mediaが月曜に報じました。この拠点では本が背表紙から引き剥がされ、ページがスキャンされており、扉のロゴには本を食べようとするティラノサウルスが描かれていたといいます。

AI
2026-08-17 ・ The Decoder

Amazonが本を裁断してAI学習データ化とは?404 MediaがAirTagで追跡した「VGT3」倉庫の実態

404 MediaがレアブックにApple AirTagを仕込んで追跡したところ、荷物はラスベガスのAmazon倉庫に到達し、そこでは「VGT3」というチームが本の背を裁断してスキャンし、原本を破棄していました。スキャンされたデータはAmazonの自社モデル「Nova」の学習に使われています。

AI
2026-08-12 ・ Ars Technica

AI学習のための「本の裁断」はどこまで進んでいるのか——希少書店が5,000冊の一括注文を拒み始めた理由

2025年夏の訴訟でAnthropicが「Project Panama」のコードネームのもと数百万冊の紙の本を裁断・スキャンしていた事実が明るみに出て以降、アイルランドのKennysなど希少書店が「値切らない5,000冊の一括注文」をAI企業由来と疑って拒否し始めています。著作権法上は購入した本の破壊は合法ですが、供給側が取引を選び始めたことで、学習データ調達の前提が変わりつつあります。

AI
2026-08-02 ・ The Verge

Pippaとは?アーティストに0.005ドル/枚を払うAI動画スタートアップの「倫理」はどこまで本物か

生成AI動画スタートアップのPippaは、アーティストの作風を使った画像1枚につき0.005ドル、動画1秒につき0.003ドルを本人に支払う仕組みを2026年5月に立ち上げ、現在は有料会員約800人、契約アーティスト4人。ただし基盤は無断収集データを含むオープンモデルで、「倫理的AI」の看板と実態のギャップがそのまま残っています。

AI
2026-07-22 ・ The Decoder

Anthropicの15億ドル和解とは?書籍海賊版とAI学習「フェアユース」の境界を解説

サンフランシスコ連邦地裁は2026年7月22日、AnthropicがLibGenなどから書籍を違法ダウンロードした問題で、著者への15億ドル支払いを命じる和解を承認しました。集団訴訟史上最大規模ですが、支払い対象は「海賊版行為」であり、正規入手した書籍でのAI学習は別途フェアユースと判断されています。

AI
2026-07-21 ・ The Verge

Anthropicの15億ドル著作権和解が正式承認へ——AI学習データ訴訟が示す「無断データの後払いコスト」

連邦地裁のAraceli Martínez-Olguín判事が、Anthropicが著作権のある書籍でAIを学習させたとして作家らが起こした集団訴訟の15億ドル和解を承認しました。1冊あたり約3,000ドルが支払われ、原告側は「史上最大級の著作権回収」と位置づけています。

AI
2026-07-18 ・ Wired

Suno情報流出と生理管理アプリ監査から見える「データ収集の死角」――AI学習・SDK・侵入検知の三つの穴

AI音楽生成のSunoがYouTube MusicなどからYouTube Music音声だけで11万3879時間分を無断収集していたことが侵入者経由で判明。同じ週、Mozilla財団は生理管理アプリ6本を監査し、Stardustが10点満点中2点で最下位に。DHSは実際の侵入を2度「誤検知」と誤判定しました。データ収集と防御の死角が同時に露呈しています。

AI
2026-07-14 ・ Engadget

Gemini学習データ訴訟とは?Hachette・Elsevierら出版社がGoogleを集団訴訟、争点はCMI削除

Hachette Book Group、Cengage Learning、Elsevierの出版3社と作家Scott Turow氏が、GoogleがGeminiの学習に無断で著作物を使ったとして集団訴訟を申し立てました。数百万点の複製に加え、学習元を隠すために著作権管理情報(CMI)を除去したという主張が含まれる点が、これまでのAI著作権訴訟と質的に異なります。

AI
2026-06-24 ・ Wired

GoogleのSearch Services Historyとは?AI学習へのアップロード保存がデフォルトONになる新設定を解説

Googleが今後数カ月かけて、検索にアップロードした画像・音声・動画をAI学習用に既定で保存する「Search Services History」を全世界で展開します。オプトアウト方式で、学習に使われたデータは元の履歴を削除しても最長4年保持されます。

AI
2026-06-22 ・ Wired

MetaのAI学習用「社員ノートPC監視」が情報漏洩、4.5万テーブルが社内に露出した意味

MetaがAI学習データ収集のため4月から始めた米国社員ノートPCの監視プログラム「Model Capability Initiative」で、キーストロークや画面内容を含む4万5000のhiveテーブルが社内の誰でも閲覧可能な状態に置かれていたことが判明しました。同社CTOのAndrew Bosworthはプライバシーレビューの基準に達していなかったと内部で認めています。

← タグ一覧へ