Ngày 20/7/2026, một thẩm phán Liên bang Mỹ đã phê chuẩn thỏa thuận dàn xếp trị giá 1,5 tỉ USD giữa Anthropic và nhóm tác giả, nhà xuất bản trong vụ kiện liên quan đến việc sử dụng hàng triệu bản sao sách có bản quyền để huấn luyện các mô hình AI đứng sau chatbot Claude.
Đây được xem là một trong những vụ dàn xếp bản quyền lớn nhất tại Mỹ, với số tiền bồi thường dự kiến được phân bổ cho hơn 482.000 tác phẩm. Các tác giả và chủ sở hữu quyền đủ điều kiện có thể nhận khoảng 3.000 USD cho mỗi tác phẩm. Khoảng 91% số tác phẩm thuộc diện dàn xếp đã có yêu cầu nhận bồi thường.
Vụ kiện bắt nguồn từ cáo buộc Anthropic đã thu thập hàng triệu bản sao sách có bản quyền từ các nguồn trực tuyến không hợp pháp để xây dựng thư viện dữ liệu phục vụ huấn luyện AI. Các nguyên đơn cho rằng việc sử dụng những tác phẩm này mà không được phép đã xâm phạm quyền của tác giả và chủ sở hữu bản quyền.
Điểm đáng chú ý là tranh chấp không chỉ xoay quanh việc AI có được sử dụng sách có bản quyền để huấn luyện hay không, mà còn liên quan đến cách thức Anthropic có được những tác phẩm đó. Tòa án Mỹ từng nhận định việc sử dụng sách để huấn luyện AI có thể thuộc phạm vi “sử dụng hợp lý” (fair use) trong một số trường hợp. Tuy nhiên, việc thu thập từ nguồn lậu lại bị xác định là vi phạm.
Thẩm phán liên bang Mỹ đã phê chuẩn thỏa thuận dàn xếp trị giá 1,5 tỉ USD giữa Anthropic và một nhóm tác giả sách trong vụ kiện bản quyền - Ảnh minh họa: AI
Anthropic đã phủ nhận trách nhiệm pháp lý nhưng đồng ý dàn xếp để giải quyết tranh chấp. Khoản tiền 1,5 tỉ USD là khoản dàn xếp, không phải tiền phạt do tòa án áp đặt.
Ý nghĩa lớn đối với ngành AI và bản quyền
Vụ việc được đánh giá là dấu mốc quan trọng trong cuộc tranh luận toàn cầu về bản quyền trong kỷ nguyên AI. Các mô hình AI lớn cần lượng dữ liệu khổng lồ để huấn luyện, trong đó có sách, báo, hình ảnh, âm nhạc và nhiều sản phẩm sáng tạo khác.
Từ vụ Anthropic, một vấn đề lớn được đặt ra là liệu các công ty AI có thể coi những nội dung được công bố trên môi trường số như nguồn dữ liệu tự do khai thác hay không. Nếu tác phẩm có bản quyền trở thành “nguyên liệu” cho AI, cơ chế cấp phép, minh bạch nguồn dữ liệu và phân chia lợi ích giữa doanh nghiệp công nghệ với người sáng tạo sẽ là những vấn đề khó có thể né tránh.
Vụ dàn xếp cũng tạo thêm sức ép đối với các công ty AI trong việc xây dựng cơ chế thu thập dữ liệu minh bạch, hợp pháp và có trách nhiệm. Đồng thời, nó được kỳ vọng sẽ tác động đến cách các tòa án, nhà lập pháp và ngành công nghiệp sáng tạo tiếp cận vấn đề bản quyền trong quá trình phát triển AI.
Tại Việt Nam, câu chuyện này có giá trị tham khảo quan trọng trong bối cảnh hành lang pháp lý về AI và sở hữu trí tuệ đang tiếp tục được hoàn thiện. Khi các mô hình AI tiếng Việt phát triển và nhu cầu về dữ liệu chất lượng cao ngày càng tăng, việc sử dụng sách, báo, tác phẩm văn học, âm nhạc và các nội dung tiếng Việt có bản quyền để huấn luyện AI cũng cần được quan tâm.
Nguồn tham khảo: Báo Văn Hóa, Reuters, PNAS Nexus (cập nhật 22/7/2026).
