Phán quyết 1,5 tỷ USD đối với Anthropic: Khi AI “đọc” sách bản quyền gây tranh cãi pháp lý
Tòa án Mỹ quyết định Anthropic phải trả 1,5 tỷ USD vì vi phạm bản quyền khi đào tạo mô hình AI từ các cuốn sách trong thư viện bóng tối, đồng thời khẳng định việc đào tạo này không vi phạm pháp luật.
Sự kiện pháp lý mới: Anthropic bị phạt 1,5 tỷ USD vì vi phạm bản quyền sách
Vào năm 2025, Thẩm phán William Alsup của Tòa án Liên bang Hoa Kỳ đã ra phán quyết khiến công ty AI Anthropic phải trả khoản bồi thường kỷ lục 1,5 tỷ USD cho một nhóm các tác giả. Các tác phẩm của họ đã được sử dụng để “đào tạo” các mô hình ngôn ngữ lớn (LLM) của Anthropic – những công cụ mà người dùng ngày nay thường gặp trong ChatGPT, Gemini, Claude và các chatbot khác. Mặc dù phán quyết này ban đầu được nhìn nhận như một chiến thắng đạo đức cho các nhà văn, Thẩm phán Alsup lại khẳng định rằng việc “đào tạo” AI trên các cuốn sách này là hợp pháp; hình phạt chỉ nhằm vào hành vi sao chép trái phép các sách từ các thư viện bóng tối trên mạng.
Chi tiết vụ án và quan điểm chuyên gia
Các mô hình AI hiện nay được “đào tạo” trên những kho dữ liệu khổng lồ, bao gồm hàng trăm triệu cuốn sách, bài báo, bài nghiên cứu và vô vàn nội dung trực tuyến. Như Cathy Gellis – luật sư chuyên về sở hữu trí tuệ, bản quyền và công nghệ – cho biết: “Tôi nghĩ một trong những vấn đề trong lĩnh vực pháp luật và công nghệ này là có quá nhiều yếu tố đang diễn ra đồng thời. Nó vô cùng phức tạp và có rất nhiều cảm xúc thô sơ về những gì đang xảy ra, cả ủng hộ và phản đối.”
Trong phán quyết, Thẩm phán Alsup viết: “Giống như bất kỳ độc giả nào mong muốn trở thành nhà văn, các LLM của Anthropic được huấn luyện trên các tác phẩm không phải để sao chép hay thay thế chúng, mà để đi một hướng mới và tạo ra điều gì đó khác biệt.” Ông so sánh quá trình “tiêu thụ” hàng nghìn tỷ từ ngữ của một LLM với việc một nhà văn nghiên cứu văn học.
Cathy Gellis cho rằng mức phạt 1,5 tỷ USD không thực sự là gánh nặng đối với các công ty AI: “Đối với một công ty dự báo doanh thu khoảng 200 tỷ USD mỗi năm vào năm 2028, 1,5 tỷ USD chỉ là một phần nhỏ.” Bà nhấn mạnh rằng, theo cô, phán quyết đã “đánh giá việc đọc một tác phẩm có bản quyền như là việc tiêu thụ, chứ không phải sao chép”.
Jason Henderson, luật sư cấp cao và người sáng lập Phòng thực hành IP & Media tại JWL International, chia sẻ: “Mọi người hiện đang rất lo lắng vì luật pháp đang rải rác, và điều đó bắt nguồn từ câu hỏi này. Họ biết mô hình AI đã được đào tạo trên một lượng khổng lồ dữ liệu, nhưng luật pháp chưa kịp bắt kịp.”
Vấn đề cốt lõi thường xoay quanh nguyên tắc “fair use” (sử dụng hợp lý). Để xác định một việc sử dụng có hợp pháp hay không, tòa án xem xét các yếu tố: mục đích và tính chất của việc sử dụng, lượng nội dung được dùng, và ảnh hưởng tới thị trường của tác phẩm gốc. Henderson giải thích: “Nếu mục đích của bạn là cạnh tranh trực tiếp với tài sản của người khác, tòa án sẽ không đồng ý. Ngược lại, nếu không có mục đích cạnh tranh, tòa án có xu hướng chấp nhận.”
Một ví dụ điển hình là vụ kiện giữa Thomson Reuters và công ty nghiên cứu Ross Intelligence. Ross đã sao chép nội dung của Reuters để xây dựng một nền tảng pháp lý dựa trên AI. Thẩm phán Stephanos Bibas năm ngoái đã phán quyết: “Việc sử dụng của Ross không mang tính chuyển đổi vì nó không có ‘mục đích hay tính chất khác biệt’ so với nội dung của Thomson Reuters.” Do đó, việc đào tạo AI trên dữ liệu Reuters để tạo ra một sản phẩm cạnh tranh trực tiếp không được coi là fair use.
Bên cạnh đó, vụ án Thaler v. Perlmutter đã đưa ra một kết luận mới: nếu một tác phẩm được tạo ra 100 % bởi AI, nó không được bảo hộ bản quyền. Điều này mở ra câu hỏi mới: “Làm sao chúng ta chứng minh một tác phẩm có được tạo ra bằng AI hay không, và nếu có, tỷ lệ AI đóng góp bao nhiêu?” Gellis so sánh: “Nếu bạn viết tiểu thuyết trong Microsoft Word và dùng tính năng kiểm tra chính tả, chúng ta không cho Word sở hữu tác phẩm của bạn. AI đang buộc chúng ta phải xem xét lại rất nhiều quyết định mà trước đây chúng ta đã bỏ qua.”
Bối cảnh ngành và triển vọng pháp lý
Hiện tại, hầu hết các công ty AI đang phải đối mặt với các vụ kiện liên quan đến bản quyền, và không có giải pháp cuối cùng nào xuất hiện trong thời gian ngắn. Như Gellis nhận định, “Các quyết định ban đầu đang tạo ra ảnh hưởng lớn, nhưng ảnh hưởng đó có thể bị đảo ngược nếu các tòa án khác ra phán quyết khác.” Các vụ tranh chấp sẽ tiếp tục diễn ra, và kết quả cuối cùng sẽ quyết định cách các mô hình AI được đào tạo và thương mại hoá trong tương lai.
Trong khi luật bản quyền chưa được cập nhật kể từ năm 1976, các thẩm phán buộc phải “diễn giải” các quy định 50 năm tuổi để giải quyết các câu hỏi pháp lý mới. Điều này tạo ra một môi trường pháp lý chưa ổn định, khiến các nhà phát triển AI phải cân nhắc kỹ lưỡng về nguồn dữ liệu và cách thu thập chúng. Việc hiểu rõ các nguyên tắc fair use và tránh sử dụng các thư viện bóng tối sẽ trở thành yếu tố quyết định để các công ty AI duy trì sự phát triển bền vững mà không bị rơi vào rủi ro pháp lý.