背後開發 Claude AI 模型的公司 Anthropic,在被發現使用盜版書籍訓練其旗艦產品後,已同意達成 1.5 億美元的集體訴訟和解。此案稱為 Bartz v. Anthropic,涵蓋約 500,000 部受版權保護的作品,將向符合資格的美國註冊版權持有人支付每部作品約 3,000 美元。
愛爾蘭作家協會已介入此事,與Anthropic達成自身協議,並積極為愛爾蘭作家提供申索指引。該協會將此案視為歐洲針對AI公司版權執法的潛在先例。
實際發生了什麼
該訴訟指控 Anthropic 從兩個著名的盜版平台 Library Genesis(LibGen)和 Pirate Library Mirror(PiLiMi)下載書籍,以在訓練期間為其語言模型提供數據。
美國地方法院作出了一項混合裁決,劃出了一條出人意料的明確界線。使用合法取得的資料訓練人工智慧?這可能構成合理使用。從盜版網站下載受版權保護的作品以建立您的資料集?這屬於明顯的侵權行為。
作為和解的一部分,Anthropic 必須摧毀用於訓練的盜版數據集。最終法院批准預計將於 2026 年年中左右完成。付款將在扣除必要費用後分期支付。
為何愛爾蘭作家聯盟在這裡至關重要
IWU 的參與表明,這不會僅僅停留在美國的範疇內。該工會正定位自身為可能有索賠的歐洲作者的指導者,其對和解框架的公開支持表明,創意產業的有組織勞動力將此視為一個範本。
歐洲已擁有比美國更嚴格的數據保護和版權制度。歐盟的《人工智能法案》自2024年起逐步實施,要求對訓練數據進行透明化披露。
AI 行業日漸嚴重的版權問題
Anthropic 遠非唯一面臨這些問題的 AI 公司。OpenAI 已被《紐約時報》和多位作者起訴。Stability AI 則應對了 Getty Images 的訴訟。
15 億美元的和解金數額聽起來龐大,但 Anthropic 近期的估值達數百億美元。如果每家 AI 公司都必須取得其訓練資料的授權,否則面臨十億美元級別的和解,那麼建構大型語言模型的經濟模式將發生根本性變化。
