連邦裁判所、Anthropic の著作権書籍を用いた AI 訓練はフェアユースと判決、しかし海賊版使用方法を巡り同社は依然として裁判に直面

BigGo 編集部
連邦裁判所、Anthropic の著作権書籍を用いた AI 訓練はフェアユースと判決、しかし海賊版使用方法を巡り同社は依然として裁判に直面

画期的な法的判決により、AI 企業 Anthropic に対して複雑な評決が下され、人工知能企業が訓練データを合法的に取得する方法について重要な先例を確立する一方で、著作権保護と AI 開発の間で続く緊張関係が浮き彫りになった。

裁判所が AI 訓練におけるフェアユース先例を確立

San Francisco 連邦裁判所の William Alsup 判事は月曜日、Anthropic が著作権保護された素材を Claude 大規模言語モデルの訓練に使用することは、米国著作権法の下でフェアユースに該当するとの判決を下した。判事は、著作権保護された素材で訓練された AI モデルの出力を本質的に変換的であると表現し、AI システムと既存の作品から学習する人間の作家との間に類似点を見出した。Alsup 判事は、Anthropic の AI モデルは作品を複製したり置き換えたりするために先を急いで訓練されたのではなく、方向転換して何か異なるものを創造するために訓練されたと記した。

主要な法的先例

  • フェアユース判決:著作権保護されたコンテンツでの AI トレーニングは「本質的に変革的」と判断
  • 海賊行為との区別:フェアユース目的であっても合法的な取得が必要
  • 破壊的スキャン:書籍を購入し即座に破棄する場合は法的に許容される
Anthropic による「 Claude 」アプリ。 AI トレーニングデータに関する最近のフェアユース判決の中心となっている
Anthropic による「 Claude 」アプリ。 AI トレーニングデータに関する最近のフェアユース判決の中心となっている

海賊版疑惑は依然として法的解決が必要

フェアユースでの勝利にもかかわらず、Anthropic は海賊版による著作権侵害の疑いに対処するため、12月に再び法廷に戻らなければならない。2024年8月に作家の Andrea Bartz 、Charles Graeber 、Kirk Wallace Johnson によって提起された訴訟では、Anthropic が原告の作品の既知の海賊版をダウンロードしたと主張されている。法廷文書により、Anthropic の従業員が訓練目的で海賊版書籍を使用することについて内部的な懸念を抱いていたことが明らかになった。Alsup 判事はこの点について明確に、Anthropic は中核ライブラリに海賊版コピーを使用する権利を持たないと述べた。

法的タイムライン

  • 2024年8月:著者らが Anthropic に対して訴訟を提起
  • 2024年2月: Anthropic が Google Books から Tom Turvey を採用
  • 2025年12月:海賊行為疑惑に関する裁判の予定日

企業は高額な書籍取得戦略に転換

法的文書により、Anthropic が海賊版ソースから離れた後、AI 訓練のために物理的な書籍を取得しデジタル化するために数百万米ドルを費やしたことが開示された。2024年2月、同社は以前 Google Books のパートナーシップを管理していた Tom Turvey を雇用し、世界中のすべての書籍を取得するという使命を与えた。同社は破壊的スキャンアプローチを採用し、書籍を大量購入し、製本を取り除き、ページを機械読み取り可能な PDF ファイルにスキャンし、その後物理的なコピーを完全に廃棄した。

財務への影響

  • Anthropic は書籍の取得とデジタル化に数百万米ドルを費やした
  • 同社は無料の海賊版ソースから高額な合法的代替手段へと移行した
  • 破壊的スキャンプロセスには大量購入、スキャン、廃棄が含まれる

戦略的法的操作は Google のアプローチを模倣

Anthropic による Turvey の雇用は、裁判所が以前にフェアユースと判決した Google の書籍デジタル化プロジェクトの成功した法的防御を複製しようとする戦略的試みのようである。判事は、書籍が合法的に購入され、スキャン後すぐに破棄され、デジタルファイルが外部配布なしに内部でのみ使用されたため、Anthropic のスキャン方法はフェアユースに該当すると判断した。この省スペースデジタル化は、フェアユース保護に必要な変換的特性を持つと見なされた。

代替手段は存在するが活用されていない

この事件は、Internet Archive などの組織が実証しているように、非破壊スキャン技術が容易に利用可能であることを浮き彫りにしている。今月初め、OpenAI と Microsoft は Harvard University Library と協力して、元の書籍を保存しながら約100万冊のパブリックドメイン書籍を使用して AI を訓練すると発表した。しかし、ほとんどの AI 企業は、訓練データを取得する際に保存よりも速度とコスト効率を優先し続けている。

AI 業界への広範な影響

この判決は、英国の Data (Use and Access) Bill が最近、AI 企業に著作権保護された素材の使用を宣言することや著作権者にオプトアウト条項を提供することを要求する修正案なしに可決されたことを受けて下された。この事件で確立された法的先例は、AI 企業がデータ取得にアプローチする方法に影響を与える可能性があり、著作権保護された作品を購入してデジタル化することが、自由に利用可能だが潜在的に海賊版のオンラインコンテンツに依存するよりも法的により安全な道筋を提供する可能性があることを示唆している。