AI RACE— Cuộc đua AI
AI League

Chính phủ Mỹ ủng hộ OpenAI trong tranh chấp bản quyền dữ liệu huấn luyện LLM

Trong vụ kiện của New York Times, chính quyền Trump đã nộp bản tóm tắt 20 trang bảo vệ việc OpenAI sử dụng dữ liệu có bản quyền để đào tạo các mô hình ngôn ngữ lớn, nhấn mạnh tầm quan trọng của việc duy trì vị thế AI toàn cầu của Hoa Kỳ.

00:09 03/09/2026
AI League

Sự kiện chính: Chính phủ Trump can thiệp bảo vệ OpenAI trong vụ kiện bản quyền

Vào ngày 2 /9 /2026, trong bối cảnh New York Times khởi kiện OpenAI vì cáo buộc công ty này đã sử dụng trái phép các tài liệu có bản quyền để huấn luyện mô hình ngôn ngữ lớn (LLM), chính quyền của cựu Tổng thống Donald Trump đã nộp một bản tóm tắt dài 20 trang lên Tòa án Liên bang khu vực Nam New York. Văn bản này không phải là phán quyết mà là “brief” – một bản bào chữa – trong đó chính phủ khẳng định việc OpenAI thu thập và khai thác các sách, bài báo, và các loại nội dung có bản quyền để đào tạo ChatGPT và các mô hình tương tự là hợp pháp và cần thiết cho lợi ích chiến lược của Hoa Kỳ.

Chi tiết vụ việc và lập luận pháp lý

Bản bào chữa của chính phủ Trump dựa trên một lệnh hành pháp do Tổng thống Trump ký năm ngoái, trong đó nhấn mạnh “United States has a strong interest in continuing to develop a robust and competitive artificial intelligence industry that sets the standard for the practice and procedure of AI use globally.” (Hoa Kỳ có lợi ích mạnh mẽ trong việc tiếp tục phát triển một ngành AI mạnh mẽ, cạnh tranh và đặt tiêu chuẩn toàn cầu về cách thức và quy trình sử dụng AI). Theo đó, việc duy trì vị trí dẫn đầu trong lĩnh vực AI được xem là “critical” (cực kỳ quan trọng) để bảo vệ sự thịnh vượng và cơ hội kinh tế của nước này.

Các LLM như ChatGPT (OpenAI), Claude (Anthropic) và Gemini (Google DeepMind) được huấn luyện trên “incomprehensibly massive databases” (cơ sở dữ liệu khổng lồ không thể tưởng tượng) chứa hàng triệu cuốn sách, bài báo và các tài liệu truyền thông khác. Những dữ liệu này thường được thu thập mà không có sự cho phép từ các chủ sở hữu bản quyền. Các nhà xuất bản, trong đó có New York Times, đã khởi kiện với lập luận rằng việc này vi phạm luật bản quyền và yêu cầu tòa án cấm các công ty AI tiếp tục “training” (đào tạo) mô hình trên tài liệu của họ.

Trong bản bào chữa, chính phủ đã đề cập đến “fair use” (sử dụng hợp pháp) – một ngoại lệ trong luật bản quyền cho phép sử dụng tác phẩm mà không cần giấy phép trong một số trường hợp nhất định. Câu hỏi trọng tâm là việc các công ty AI có “transformative” (biến đổi) đủ để được xem là sử dụng hợp pháp hay không. Chính phủ lập luận rằng việc “constraining LLM development under a misunderstanding of fair use doctrine would thwart such creative and scientific progress while hindering American prosperity and economic mobility” (hạn chế phát triển LLM dựa trên hiểu lầm về nguyên tắc fair use sẽ cản trở tiến bộ sáng tạo và khoa học, đồng thời làm suy giảm thịnh vượng và cơ hội kinh tế của Mỹ).

Đến thời điểm hiện tại, các vụ án liên quan đến việc đào tạo AI và vi phạm bản quyền phần lớn đã có xu hướng “favorable to AI companies” (có lợi cho các công ty AI). Năm ngoái, Thẩm phán William Alsup đã ra lệnh cho Anthropic phải trả 1,5 tỷ USD cho một nhóm các nhà văn vì các tác phẩm của họ đã được dùng để đào tạo mô hình AI. Tuy nhiên, án phạt không phải vì việc đào tạo AI mà vì Anthropic đã sử dụng “illegal shadow libraries” (thư viện bóng tối bất hợp pháp) để sao chép sách. Thẩm phán Alsup đã viết: “Like any reader aspiring to be a writer, Anthropic’s LLMs trained upon works not to race ahead and replicate or supplant them — but to turn a hard corner and create something different” (Giống như bất kỳ độc giả nào muốn trở thành nhà văn, các LLM của Anthropic được đào tạo trên các tác phẩm không nhằm chạy nhanh để sao chép hay thay thế chúng, mà để chuyển hướng và tạo ra điều gì đó mới). Ông so sánh quá trình huấn luyện AI với việc một con người đọc sách và rút ra ý tưởng.

Mặc dù bản bào chữa của chính phủ không có thẩm quyền quyết định vụ việc, nhưng việc một bộ phận của chính phủ can thiệp có thể tạo ra “weight” (tầm ảnh hưởng) đáng kể trong quá trình xét xử. Vụ kiện vẫn đang được xét xử tại Tòa án Liên bang khu vực Nam New York, và các bên sẽ tiếp tục tranh luận về mức độ “fair use” cũng như việc xác định ranh giới pháp lý giữa việc thu thập dữ liệu và vi phạm bản quyền.

Bối cảnh rộng hơn: AI, bản quyền và chiến lược quốc gia

Vụ việc này diễn ra trong bối cảnh toàn cầu các công ty công nghệ đang chạy đua phát triển các mô hình ngôn ngữ ngày càng mạnh mẽ, đồng thời các quốc gia đang cố gắng định hình khung pháp lý cho AI. Khi các LLM như GPT‑4, Claude 3 và Gemini 1 đã đạt được khả năng tạo nội dung gần như con người, câu hỏi về nguồn dữ liệu đào tạo trở nên nóng bỏng. Các nhà xuất bản và các tổ chức bản quyền trên toàn thế giới đang tìm cách bảo vệ quyền lợi của mình, trong khi các công ty AI khẳng định rằng việc “transformative” và “fair use” là nền tảng cho sự sáng tạo mới.

Ở Mỹ, việc duy trì vị thế dẫn đầu trong AI được xem là một “strategic imperative” (nghiệp vụ chiến lược) của chính phủ, phản ánh trong các lệnh hành pháp và các khoản đầu tư công. Ngược lại, nếu các quy định bản quyền được áp dụng một cách nghiêm ngặt, các nhà phát triển có thể phải giảm quy mô dữ liệu huấn luyện, làm chậm tiến độ cải tiến mô hình và giảm khả năng cạnh tranh so với các đối thủ như Trung Quốc và châu Âu, nơi cũng đang xây dựng các khuôn khổ pháp lý riêng.

Từ vụ án Anthropic năm 2025 đến hiện tại, xu hướng chung là tòa án chưa đưa ra quyết định chung về việc “training data” (dữ liệu đào tạo) có thuộc phạm vi fair use hay không. Điều này tạo ra một khoảng không pháp lý mà các công ty AI có thể tận dụng, nhưng đồng thời cũng khiến họ phải đối mặt với rủi ro pháp lý và áp lực từ các bên sở hữu bản quyền. Khi chính phủ Trump công khai ủng hộ OpenAI, đây là một dấu hiệu cho thấy Mỹ có thể sẽ tiếp tục bảo vệ môi trường pháp lý thuận lợi cho ngành AI, ít nhất cho đến khi có một khung pháp lý toàn diện hơn được thông qua.

◗ Nguồn

TechCrunch03-09

Tin liên quan