Claude AIモデルを開発するAnthropicは、自社の主力製品の学習に海賊版の本を使用していたことが判明し、15億ドルの集団訴訟和解に合意しました。この訴訟はBartz v. Anthropicとして知られ、約50万点の著作権保護された作品を対象とし、資格のある米国登録権利者にはタイトルあたり約3,000ドルが支払われます。
アイルランド作家組合は現在、Anthropicと独自の合意に達し、アイルランドの作家たちに請求手続きの方法について積極的に助言しています。この組合は、この事例をAI企業に対する欧州の著作権執行における先例の可能性と見なしています。
実際に何が起こったのか
訴訟では、Anthropicが言語モデルのトレーニング中に、有名な海賊版プラットフォームであるLibrary Genesis(LibGen)とPirate Library Mirror(PiLiMi)から本をダウンロードしたと主張された。
米国連邦地裁は、意外に明確な線を引く混合判決を下した。法的に取得した資料を用いてAIを訓練することは、公正使用に該当する可能性がある。海賊サイトから著作権のある作品をダウンロードしてデータセットを構築することは、明確な著作権侵害である。
和解の一環として、Anthropicは訓練に使用された海賊版データセットを破壊する必要があります。最終的な裁判所の承認は2026年半ば頃を見込んでいます。支払いは必要な控除後、分割で分配されます。
なぜアイルランド作家組合がここでの意義があるのか
IWUの関与は、これがアメリカの物語にとどまらないことを示している。この組合は、権利を主張する可能性のある欧州の著者たちのガイドとして立場を固めており、合意枠組みへの公的な支持は、クリエイティブ産業における組織労働がこれをモデルとして捉えていることを示唆している。
ヨーロッパは既に米国よりも厳しいデータ保護および著作権規制を有しています。EUのAI法は2024年から段階的に導入され、トレーニングデータに関する透明性を要求しています。
AI業界の拡大する著作権問題
Anthropicは、これらの質問に直面している唯一のAI企業ではありません。OpenAIはニューヨーク・タイムズや複数の著者から訴えられています。Stability AIはGetty Imagesから訴訟を受けています。
15億ドルの和解金は巨額に聞こえるが、Anthropicは最近、数十億ドルの評価額を獲得している。すべてのAI企業が訓練データのライセンスを取得しないと、数十億ドル規模の和解金を支払うリスクを負うなら、大規模言語モデルの構築における経済モデルは根本的に変化する。
