Các nhà xuất bản kiện Google vì sử dụng tác phẩm có bản quyền để huấn luyện Gemini
Một nhóm các nhà xuất bản và tác giả lớn nộp đơn kiện Google, cáo buộc công ty sử dụng sách có bản quyền mà không xin phép để huấn luyện mô hình AI Gemini và cố ý xóa thông tin bản quyền để che giấu điều này.
Google lại phải đối mặt với vụ kiện bản quyền AI
Google lại phải đối mặt với một vụ kiện tập thể mới liên quan đến việc sử dụng tác phẩm có bản quyền để huấn luyện mô hình AI Gemini mà không xin phép tác giả. Những nhà xuất bản lớn bao gồm Hachette, Cengage, Elsevier cùng với tác giả Scott Turow và tổ chức S.C.R.I.B.E. đã nộp đơn kiện tập thể tại Tòa án Quận Phía Nam New York. Cáo buộc chính là Google sử dụng những công trình có bản quyền mà không được phép, và còn bị cáo buộc "cố ý xóa hoặc thay đổi thông tin bản quyền" để che giấu bản chất của hành động này.
Nguồn dữ liệu huấn luyện và bằng chứng nội bộ
Theo đơn kiện, Google đã lợi dụng hai nguồn chính để thu thập dữ liệu: các sách được số hóa thông qua chương trình Google Books (nơi người dùng chỉ có thể xem các đoạn trích ngắn, không phải toàn bộ nội dung) và các sách được tải lên Google Play Store. Điều đáng chú ý là các nhà xuất bản từng cung cấp sách cho Google Books tự nguyện, nhưng với mục đích cụ thể là giúp những công trình này trở nên dễ tìm kiếm – không phải để huấn luyện AI. Giống như các vụ kiện khác, nhóm nguyên đơn cũng cầu cứu vào một tài liệu nội bộ của Google mà họ cho rằng điều này cho thấy công ty biết rõ ràng nguy hiểm của hành động này. Tài liệu đó nói rằng việc sử dụng sách có bản quyền để huấn luyện AI "có thể gây ra vấn đề cực kỳ nghiêm trọng" và có thể dẫn tới các khoản phạt lên tới 10–100 tỷ USD. Điều này cho thấy Google hoàn toàn nhận thức được rủi ro pháp lý nhưng vẫn tiếp tục hành động.
Bối cảnh vụ kiện bản quyền AI rộng lớn
Vụ kiện này không phải lần đầu Google phải đối mặt với hành động pháp lý vì vấn đề tương tự – rất nhiều nhà xuất bản, tác giả và những người sở hữu bản quyền khác đã kiện Google cùng với Meta, OpenAI, và Anthropic. Tuy nhiên, trong bối cảnh chung của những vụ tranh chấp bản quyền AI, những quyết định từ các tòa án ở California đã gây bất ngờ. Hai phán quyết ban đầu ủng hộ các công ty AI, khẳng định rằng việc sử dụng tác phẩm có bản quyền để huấn luyện mô hình được coi là "sử dụng công bằng" (fair use) theo luật bản quyền Mỹ – một luật được ban hành trước cả kỷ nguyên internet. Tuy vậy, Anthropic đã được phán có tội và bị phạt 1,5 tỷ USD, mức phạt cao nhất trong lịch sử pháp luật bản quyền Mỹ. Khoảng nửa triệu nhà văn đủ điều kiện nhận khoản thanh toán từ 3.000 USD trở lên, nhưng nhiều tác giả đã từ chối nhận tiền để có thể tiếp tục hành động pháp lý riêng chống lại việc sử dụng tác phẩm cho AI.
Tại sao phán quyết New York có thể khác
Việc Google bị kiện ở Tòa án New York thay vì California là điều quan trọng vì nó mở ra cơ hội cho một thẩm phán khác đánh giá lại vấn đề này với góc nhìn khác. Mối quan hệ lâu dài giữa Google và các nhà xuất bản – những người từng tự nguyện cung cấp tác phẩm cho mục đích tìm kiếm sách, không phải huấn luyện AI – có thể trở thành yếu tố then chốt giúp lật ngược các phán quyết trước đây ủng hộ "fair use". Nếu tòa án ủng hộ phía nguyên đơn, đây sẽ là một tiền lệ quan trọng ảnh hưởng tới cách các công ty AI có thể sử dụng dữ liệu và tác phẩm có bản quyền trong tương lai. Với độc giả Việt Nam, đây là tín hiệu rằng vấn đề bản quyền trong AI không phải chỉ là tranh luận pháp lý xa xôi mà có thể ảnh hưởng tới cách các nền tảng công nghệ và AI hoạt động ở Việt Nam nếu các công ty này được phép sử dụng tác phẩm của nhà văn, nhà báo và nhà sáng tạo Việt theo cách tương tự.

