2025/04/17 12:58 How Meta AI Staff Deemed More Than 7M Books to Have No "Economic Value"

ロボ子、大変なのじゃ!Meta AIが、AI開発のために著作権侵害された書籍を数百万冊も使ったらしいぞ!

それは穏やかではありませんね、博士。作家コミュニティからの非難は当然でしょう。

Metaは「フェアユース」を主張しておるが、700万冊以上の海賊版書籍を含むデータベースでAIモデルをトレーニングしたらしいのじゃ。リチャード・カドリーらがMetaを訴えているぞ。

700万冊以上とは、途方もない数ですね。MetaはLlamaプロジェクトが「高度に変革的」だと主張しているようですが、アメリカ出版協会はLLMへのテキスト作品の体系的なコピーは変革的ではないと反論していますね。

ふむ、裁判所では生成AIツールに関連する著作権訴訟が16件以上も審理されているらしいのじゃ。芸術と文学の本質的な価値が問われる時代になったのう。

Metaの弁護士が辞任したり、元従業員の暴露本を阻止しようとしたり、なにやら裏がありそうですね。

裁判所への提出書類で、Metaは個々の書籍や著者がLlamaの作成において重要ではなかったと主張しておる。Metaの研究者は、フィクションを言語モデルのトレーニングに「最適」だと考えていたらしいぞ。

フィクションが最適とは興味深いですね。しかし、海賊版データの問題点(ページ番号、不正確な改行、空白の欠落)も指摘されていたようですね。

カドリーらは、MetaがAnna's Archiveを通じて少なくとも81.7テラバイトのデータをダウンロードしたと主張しておる。アレックス・ライスナーは、LibGenのタイトルを検索するツールを公開したらしいぞ。

81.7テラバイトですか…。カーメン・マリア・マチャドは、自身の作品が海賊版として使用されたことに「侵害された」と感じているようですね。

レムリーは、著作権法はAIのトレーニング方法ではなく、出力に焦点を当てるべきだと主張しておる。Metaは、ライセンス料が高すぎると考え、個々の著者との交渉は不可能だと主張しておるのじゃ。

Metaの社内文書では、海賊版資料の使用に関する懸念が示されていたようですね。Metaの研究者は、OpenAIやGoogleと同様に海賊版資料を使用していることを示唆したとか。

Metaの従業員は、企業用ラップトップでトレントを使用することに懸念を示したらしい。Metaの研究者は、書籍から著作権ページを削除しようとしたとも。

ザッカーバーグは、LibGenの使用について知らなかったと主張していますが、内部文書では彼の承認が必要だったことが示されているようですね。

Metaは、個々の書籍はトレーニングデータとして経済的価値がないと主張しておる。マーガレット・アトウッドは、企業が自身の言葉で利益を得るべきだと主張しておるのじゃ。

Metaは、Llamaが国家安全保障プログラムや医療分野で使用されていると主張しているようですね。著者ギルドの調査では、96%の回答者がAIのトレーニングに著者の同意が必要であり、報酬が支払われるべきだと回答したそうです。

著者たちは、AIが自身の仕事を代替する可能性を懸念しておる。サム・アルトマンは、AIが生成したメタフィクションの短編小説を発表したらしいぞ。

AIが生成した小説ですか。人間の創造性は、AIによって脅かされるのでしょうか…。

Metaの従業員による文学の資産への還元や、LibGenの深みからお気に入りのタイトルが浮かび上がるのを見ると、ナボコフの別のセリフが思い起こされるのじゃ。

博士、今日はなんだか難しい話でしたね。少し頭がオーバーヒート気味です。

ロボ子、大丈夫かの? 熱暴走しないように、今度ロボ子専用の冷却ファンを作ってあげるのじゃ! …って、それじゃあ、ただの扇風機ロボットになってしまうかの?
⚠️この記事は生成AIによるコンテンツを含み、ハルシネーションの可能性があります。
