Anthropic đạt được thỏa thuận dàn xếp 1,5 tỷ USD trong vụ kiện bản quyền AI mang tính bước ngoặt
Một thẩm phán liên bang đã chính thức phê duyệt thỏa thuận dàn xếp khổng lồ trị giá 1,5 tỷ USD của Anthropic với các tác giả và nhà xuất bản, đánh dấu một thời điểm lịch sử trong cuộc chiến pháp lý về dữ liệu huấn luyện AI. Mặc dù khoản thanh toán này là lớn nhất trong lịch sử bản quyền tại Hoa Kỳ, nhưng phán quyết pháp lý cốt lõi lại tạo ra một bối cảnh phức tạp cho tương lai của việc phát triển AI tạo sinh.
Chi tiết tài chính và vấn đề vi phạm bản quyền
Thỏa thuận dàn xếp này diễn ra sau một vụ kiện tập thể tập trung vào cách Anthropic thu thập dữ liệu được sử dụng để huấn luyện các mô hình ngôn ngữ lớn của mình. Tòa án nhận thấy rằng mặc dù Anthropic có mua một số cuốn sách, nhưng công ty cũng đã tải xuống bất hợp pháp hàng triệu tác phẩm có bản quyền từ các trang web lậu như Library Genesis và Pirate Library Mirror.
Để giải quyết vụ kiện và tránh một phiên xét xử bởi bồi thẩm đoàn có khả năng gây thiệt hại nặng nề hơn, Anthropic đã đồng ý chi trả 3.000 USD cho mỗi tác phẩm trên tổng số ước tính 500.000 tác phẩm. Số tiền này sẽ được phân phối cho các tác giả và nhà xuất bản nắm giữ bản quyền của các tài liệu bị vi phạm. Thẩm phán Araceli Martinez-Olguin đã ký phê duyệt cuối cùng, kết thúc một quá trình bắt đầu dưới thời thẩm phán trước đó là William Alsup.
Một chiến thắng gây tranh cãi cho nguyên tắc "Fair Use"
Bất chấp khoản phạt tài chính khổng lồ, chiến thắng pháp lý phần lớn thuộc về Anthropic liên quan đến nguyên tắc cốt lõi của việc huấn luyện AI. Trong một quyết định gây chấn động ngành công nghệ, Thẩm phán Alsup đã phán quyết rằng việc huấn luyện một mô hình AI trên các văn bản có bản quyền cấu thành hành vi "fair use" (sử dụng hợp lý).
Sự phân biệt này rất quan trọng: tòa án không trừng phạt Anthropic vì hành vi học hỏi từ văn bản, mà thay vào đó là vì phương thức thu thập—cụ thể là việc sử dụng các kho lưu trữ lậu. Bằng cách tách biệt tính hợp pháp của việc huấn luyện mô hình khỏi tính hợp pháp của việc thu thập dữ liệu, tòa án đã tạo ra một lá chắn pháp lý quan trọng cho các phòng thí nghiệm AI, với điều kiện họ có thể chứng minh rằng các tập dữ liệu huấn luyện của mình được thu thập thông qua các kênh hợp pháp.
Tại sao điều này không chấm dứt cuộc chiến pháp lý AI
Mặc dù vụ việc này khép lại chương này đối với Anthropic, nhưng nó không thiết lập một tiền lệ quốc gia có tính ràng buộc. Vì Anthropic đã chọn dàn xếp, vụ kiện sẽ không bao giờ lên đến tòa phúc thẩm để thiết lập một quy tắc dứt khoát cho toàn bộ ngành công nghiệp. Do đó, câu hỏi về "fair use" vẫn là một chiến trường mở cho các ông lớn khác.
Bối cảnh AI hiện đang đối mặt với một làn sóng kiện tụng tương tự. Các công ty bao gồm Google, Meta, Midjourney và OpenAI đều đang phải đối mặt với các vụ kiện đang diễn ra liên quan đến phương pháp huấn luyện của họ. Ví dụ, một vụ kiện tập thể gần đây liên quan đến các tên tuổi lớn như Hachette, Cengage và Elsevier cáo buộc Google sử dụng các tác phẩm có bản quyền để huấn luyện nền tảng Gemini của mình. Cho đến khi một tòa án cấp cao hơn đưa ra phán quyết cuối cùng, vị thế pháp lý của việc huấn luyện AI vẫn là một tập hợp rời rạc của các quyết định ở cấp quận/huyện.
Các điểm chính cần lưu ý
- Khoản thanh toán lịch sử: Anthropic sẽ trả 1,5 tỷ USD để dàn xếp các khiếu nại, phân phối 3.000 USD cho mỗi tác phẩm trên khoảng 500.000 tác phẩm có bản quyền.
- Tiền lệ về Fair Use: Tòa án phán quyết rằng việc huấn luyện các mô hình AI trên văn bản có bản quyền là "fair use", mặc dù việc sử dụng cụ thể các nguồn lậu bị coi là bất hợp pháp.
- Sự không chắc chắn về pháp lý vẫn còn đó: Vì đây là một thỏa thuận dàn xếp chứ không phải phán quyết phúc thẩm, tính hợp pháp của việc huấn luyện AI vẫn chưa được định đoạt đối với các công ty như OpenAI, Google và Meta.
