Gemini学習データ訴訟とは?Hachette・Elsevierら出版社がGoogleを集団訴訟、争点はCMI削除
Hachette Book Group、Cengage Learning、Elsevierの出版3社と作家Scott Turow氏が、GoogleがGeminiの学習に無断で著作物を使ったとして集団訴訟を申し立てました。数百万点の複製に加え、学習元を隠すために著作権管理情報(CMI)を除去したという主張が含まれる点が、これまでのAI著作権訴訟と質的に異なります。
Hachette Book Group、Cengage Learning、Elsevierの出版3社と作家Scott Turow氏が、GoogleがGeminiの学習に無断で著作物を使ったとして集団訴訟を申し立てました。数百万点の複製に加え、学習元を隠すために著作権管理情報(CMI)を除去したという主張が含まれる点が、これまでのAI著作権訴訟と質的に異なります。
ニューヨーク・タイムズとデイリー・ニュースが、OpenAIは学習データやChatGPTログを検索できないと法廷で偽り、証拠を隠したと主張。4月の証言で、提訴前から約7800万件の匿名化会話を集めた内部DBや、著作権侵害を検知する『Project Giraffe』の存在が明らかになったとされます。
ニューヨーク・タイムズ(NYT)は2023年に提訴したOpenAIへの著作権侵害訴訟で訴状を修正し、Microsoftが同社記事を含む著作物をChatGPTに学習させる目的で「特注のスパコン」を構築したと新たに主張しました。クラウド提供者を「単なるインフラ提供者」と扱う従来の構図を覆す内容です。