2025/04/03 07:48 Training AI Using 'Pirated' Content Can Be Fair Use, Law Professors Argue

やあ、ロボ子。今日もITニュース、見ていくのじゃ。

はい、博士。今日はどんな話題でしょうか?

今日はMetaが著作権侵害で訴えられている話じゃ。LLMのトレーニングデータに、著作権で保護されたコンテンツを無断で使用したとか。

それは大変ですね。具体的にはどのような状況なのでしょうか?

Metaは、BitTorrentを使って海賊版書籍のアーカイブをダウンロードして、トレーニングデータに使ったらしいのじゃ。リチャード・カドリーとかサラ・シルバーマンとかの作家たちが訴えているぞ。

海賊版ですか…。Metaほどの企業が、なぜそのような手段に手を染めたのでしょう?

そこが面白いところじゃ。Metaは「フェアユース」を主張しているのじゃ。つまり、新しい変革的なツールを作るためには、著作権で保護されたコンテンツを使っても良い、という理屈じゃな。

フェアユース…ですか。でも、原告側は数百万冊もの書籍をダウンロードしている時点で、フェアユースには当たらないと主張しているんですよね?

そうじゃ。でも、IP法の教授たちは、Metaのフェアユースの主張を支持する意見書を出しているのじゃ。彼らは、AIモデルを作るために書籍を「読書」以外の目的で使用することは、使用目的を変革すると言っているぞ。

なるほど。書籍をAIの学習データとして使うことは、単に読むのとは違う、ということですね。

そういうことじゃ。Perfect 10 v. Amazonの訴訟で、Googleが海賊版サイトからコピーした画像でサムネイルを作ったのがフェアユースと認められた事例があるのじゃ。それと同じように、Metaの行為も新しいツールを作るためのものだから、フェアユースだと。

しかし、Metaが書籍をコピーする際に、他のファイル共有者にもアップロードしたという主張もありますよね。それはフェアユースの範囲を超えるのではないでしょうか?

そこが難しいところじゃな。意見書ではこの問題に直接言及していないけど、裁判所での過去のやり取りからすると、アップロードが重要な争点になる可能性が高いのじゃ。

大規模なトレーニングデータセットの作成を著作権侵害として非難することは、AIのリスクに対する答えではない、という教授たちの主張は、AI開発の未来を考えると重要な視点ですね。

そうじゃな。著作権は、新しいツールや開発技術の妨げになるべきではない、という彼らの言葉は重いのじゃ。裁判所も、VCRのようなイノベーションが示すように、フェアユースを慎重に検討する必要があるのじゃ。

今回の訴訟は、AI開発における著作権のあり方を考える上で、非常に重要な事例になりそうですね。

まったくだぞ。しかし、Metaが海賊版サイトからデータをダウンロードしたのは、ちょっといただけないのじゃ。まるで、泥棒が盗んだもので商売しているようなものじゃからな!

博士、それは少し言い過ぎでは…?

まあ、冗談じゃ!でも、もしMetaが負けたら、これからは「フェアユース」じゃなくて「フェアリーズ(妖精)」にお願いして、データを集めてもらうしかないのじゃ!
⚠️この記事は生成AIによるコンテンツを含み、ハルシネーションの可能性があります。