AI RACE— Cuộc đua AI
Doanh nghiệp

Làn sóng quay lưng với các lab AI: Nỗi sợ rò rỉ dữ liệu khiến các "ông lớn" công nghệ bất an

Hàng loạt tập đoàn lớn như Nvidia, Booz Allen Hamilton và Palantir đang siết chặt hoặc cấm sử dụng các mô hình AI tiên tiến do lo ngại chính sách lưu trữ và nguy cơ đánh cắp tài sản trí tuệ.

00:52 16/09/2026
Làn sóng quay lưng với các lab AI: Nỗi sợ rò rỉ dữ liệu khiến các "ông lớn" công nghệ bất an

Khủng hoảng niềm tin dữ liệu lan rộng trong khối doanh nghiệp

Mối quan hệ giữa các phòng thí nghiệm AI hàng đầu và khách hàng doanh nghiệp đang rơi vào giai đoạn căng thẳng chưa từng có. Bất chấp những cam kết bảo mật từ OpenAI hay Anthropic, nhiều tập đoàn lớn bắt đầu hạn chế triển khai các mô hình AI tân tiến nhất cho những tác vụ nhạy cảm, thậm chí yêu cầu những cam kết tuyệt đối về việc không lưu trữ dữ liệu (Zero Data Retention - ZDR).

Theo báo cáo từ The Information, phản ứng dữ dội này bùng nổ sau khi Anthropic điều chỉnh chính sách, thông báo sẽ lưu giữ nhật ký sử dụng (logs) của mô hình Fable trong vòng 30 ngày với lý do phòng chống các "cuộc tấn công phức tạp và mới lạ". Động thái này ngay lập tức trở thành rào cản lớn đối với các công ty coi trọng việc bảo vệ tài sản trí tuệ độc quyền.

Các ông lớn công nghệ và quốc phòng đồng loạt "đóng cửa"

Đáng chú ý nhất trong làn sóng phản đối là Nvidia – đối tác cung cấp hạ tầng phần cứng chủ lực kiêm nhà đầu tư của Anthropic. Bất chấp mối quan hệ tài chính mật thiết, Nvidia hiện chỉ cho phép sử dụng mô hình Fable của Anthropic trong các tác vụ ít rủi ro như dự án mã nguồn mở. Đối với các công việc nội bộ mang tính cốt lõi như giám sát chuỗi cung ứng bằng AI, hãng chuyển sang vận hành mô hình Nemotron "cây nhà lá vườn". Justin Boitano, Phó chủ tịch phụ trách mảng AI doanh nghiệp tại Nvidia, khẳng định quan điểm: chính sách không lưu dữ liệu (ZDR) phải là mặc định chứ không phải tùy chọn.

Tình trạng tương tự cũng diễn ra tại tập đoàn thầu quốc phòng Booz Allen Hamilton. Từng là một trong những bên đầu tiên ứng dụng mô hình Mythos của Anthropic, công ty này hiện đã cấm nhân viên đưa Fable vào quy trình phát triển phần mềm an ninh mạng độc quyền. Giám đốc Công nghệ (CTO) Bill Vass bày tỏ sự dè chừng: "Chúng tôi có phần lo ngại rằng mô hình có thể đang tự học từ chính các đoạn mã của chúng tôi."

Trong khi đó, công ty phân tích dữ liệu Palantir thậm chí chặn phân phối Fable đến khách hàng qua nền tảng phần mềm của mình cho đến khi Anthropic đưa ra cam kết ZDR không thể hủy ngang. CEO Palantir Alex Karp thẳng thắn tuyên bố tại một sự kiện rằng các doanh nghiệp đã quá mệt mỏi với việc bị các phòng thí nghiệm AI "bóc lột". Trước áp lực ngày càng lớn và sau khi OpenAI cho phép người dùng dịch vụ GPT-5.6 Cyber tự lưu nhật ký trên máy chủ riêng, Anthropic cũng buộc phải triển khai chương trình tương tự cho một số khách hàng chọn lọc.

"Không lưu trữ" vẫn chưa đủ: Những kẽ hở vô hình đe dọa tài sản trí tuệ

Dù các lab AI đưa ra cam kết xóa dữ liệu, nguy cơ thất thoát tài sản trí tuệ vẫn hiện hữu. Cả OpenAI và Anthropic đều thu thập siêu dữ liệu (metadata) và dữ liệu kỹ thuật từ khách hàng doanh nghiệp. OpenAI khẳng định dữ liệu này đã được "khử danh tính" và chạy qua các bộ phân loại tự động để phân tích hành vi sử dụng mà không chứa nội dung gốc. Tuy nhiên, ranh giới của loại siêu dữ liệu này vẫn rất mơ hồ trong mắt người dùng doanh nghiệp.

John Schulman, nhà đồng sáng lập OpenAI (từng làm việc tại Anthropic và hiện chuyển sang Thinking Machines), đã vạch ra nhiều phương thức các công ty AI có thể khai thác thông tin người dùng: từ việc chưng cất mô hình (distillation) đến xây dựng tác vụ học tăng cường (reinforcement learning) từ "dấu vết người dùng" (user traces). Ông cảnh báo việc khử danh tính rất mong manh khi danh tính người dùng có thể bị truy ngược chỉ qua một lượng bit thông tin nhỏ, đồng thời phương pháp này không ngăn được nguy cơ rò rỉ tài sản trí tuệ khi các công cụ AI lập trình thu thập toàn bộ môi trường mã nguồn và lịch sử commit của lập trình viên.

Nhà nghiên cứu AI Sarah Hooker (cựu nhân viên Google DeepMind và Cohere) cũng đưa ra cảnh báo: các kỹ thuật dữ liệu tổng hợp (synthetic data) có thể trích xuất các phân phối thống kê tương đương mà không cần giữ lại dữ liệu gốc. "Nếu bạn là một công ty nắm giữ tài sản trí tuệ, bạn chỉ có một khung cửa hẹp để tự xây dựng AI riêng dựa trên tài sản đó. Nếu không, bạn đang tiếp tay nuôi lớn các lab tiên phong – những kẻ sớm muộn gì cũng lấn sân sang lĩnh vực của bạn," Hooker nhấn mạnh.

Nỗi lo sợ này không chỉ mang tính lý thuyết. Vụ ồn ào giữa nhà toán học Tristan Buckmaster và OpenAI là một minh chứng rõ ràng: sau khi Buckmaster và cộng sự tải các bản nháp nghiên cứu về phương trình Navier-Stokes lên công cụ Codex của OpenAI, không lâu sau đó chính OpenAI đã công bố đột phá toán học đi theo đúng hướng giải bất thường này. Dù OpenAI sau đó điều tra nội bộ và khẳng định các câu lệnh của Buckmaster không hề can thiệp hay huấn luyện hệ thống, vụ việc đã phơi bày vết rạn nứt niềm tin sâu sắc giữa giới học thuật, doanh nghiệp với những đơn vị phát triển AI hàng đầu hiện nay.

◗ Nguồn

The Decoder16-09

Tin liên quan

Doanh nghiệp

Các "ông lớn" AI đồng loạt cảnh báo rủi ro từ LLM thế hệ mới

Giới lãnh đạo OpenAI, Anthropic, Google DeepMind và xAI bất ngờ tìm được tiếng nói chung khi cảnh báo thế hệ mô hình ngôn ngữ lớn mới nhất chưa đủ an toàn, làm dấy lên cuộc tranh luận về ranh giới giữa kiểm soát rủi ro và toan tính thương mại.

7 giờ trước