Anthropic, công ty đứng sau mô hình AI Claude, đã đồng ý bồi thường 1,5 tỷ USD theo kiện tập thể sau khi bị phát hiện sử dụng sách lậu để huấn luyện sản phẩm chủ lực. Vụ việc, được biết đến với tên Bartz v. Anthropic, bao gồm khoảng 500.000 tác phẩm có bản quyền và sẽ trả khoảng 3.000 USD cho mỗi đầu sách cho các chủ sở hữu quyền hợp lệ đã đăng ký tại Mỹ.
Liên đoàn Nhà văn Ireland hiện đã tham gia vào vụ việc, đạt được thỏa thuận riêng với Anthropic và tích cực tư vấn cho các nhà văn Ireland về cách nộp đơn khiếu nại. Liên đoàn xem vụ việc này như một tiền lệ tiềm năng cho việc thực thi bản quyền châu Âu chống lại các công ty AI.
Điều gì đã thực sự xảy ra
Đơn kiện cáo buộc rằng Anthropic đã tải xuống các cuốn sách từ Library Genesis (LibGen) và Pirate Library Mirror (PiLiMi), hai nền tảng vi phạm bản quyền nổi tiếng, để huấn luyện các mô hình ngôn ngữ của mình.
Một tòa án liên bang Hoa Kỳ đã đưa ra phán quyết hỗn hợp, vạch ra một ranh giới rõ ràng một cách bất ngờ. Việc đào tạo AI trên các tài liệu được thu thập hợp pháp? Điều đó có thể được coi là sử dụng hợp lý. Tải về các tác phẩm có bản quyền từ các trang web pirate để xây dựng bộ dữ liệu của bạn? Đó là hành vi xâm phạm rõ ràng.
Là một phần của thỏa thuận, Anthropic phải tiêu hủy các bộ dữ liệu bị đánh cắp đã được sử dụng trong quá trình huấn luyện. Sự phê duyệt cuối cùng của tòa án dự kiến vào khoảng giữa năm 2026. Các khoản thanh toán sẽ được phân phối theo từng đợt sau khi đã trừ các khoản cần thiết.
Tại sao Liên đoàn Nhà văn Ireland lại quan trọng ở đây
Sự tham gia của IWU cho thấy đây sẽ không còn là câu chuyện chỉ của Mỹ. Công đoàn đang tự định vị mình như một người hướng dẫn cho các tác giả châu Âu có thể có yêu cầu, và sự ủng hộ công khai của họ đối với khung thỏa thuận cho thấy lực lượng lao động tổ chức trong các ngành sáng tạo coi đây là mô hình mẫu.
Châu Âu đã có các chế độ bảo vệ dữ liệu và bản quyền nghiêm ngặt hơn Hoa Kỳ. Đạo luật AI của EU, bắt đầu được triển khai từng giai đoạn vào năm 2024, yêu cầu minh bạch về dữ liệu huấn luyện.
Vấn đề bản quyền ngày càng gia tăng trong ngành AI
Anthropic không phải là công ty AI duy nhất đang đối mặt với những câu hỏi này. OpenAI đã bị New York Times và nhiều tác giả kiện tụng. Stability AI đã phải đối phó với các vụ kiện từ Getty Images.
Con số bồi thường 1,5 tỷ đô la nghe có vẻ khổng lồ, nhưng Anthropic gần đây đã được định giá ở mức hàng chục tỷ đô la. Nếu mọi công ty AI đều cần cấp phép dữ liệu huấn luyện của mình hoặc đối mặt với nguy cơ bồi thường hàng tỷ đô la, kinh tế học trong việc xây dựng các mô hình ngôn ngữ lớn sẽ thay đổi căn bản.
