Nghiên cứu mới: AI Trung Quốc kiểm duyệt gắt gao chủ đề nhạy cảm, làm lây lan thiên kiến sang cả mô hình phương Tây
Đánh giá từ Aleph Alpha cho thấy các mô hình của Alibaba, DeepSeek và Moonshot AI thường xuyên lặp lại quan điểm nhà nước hoặc từ chối câu hỏi chính trị nhạy cảm; thậm chí dữ liệu chưng cất còn đưa luận điểm của Bắc Kinh sang cả mô hình của Nvidia.
Một nghiên cứu đánh giá chuẩn (benchmark) mới do công ty AI Aleph Alpha của Đức thực hiện đã chỉ ra tầm ảnh hưởng sâu rộng của các định hướng chính trị cấp nhà nước đối với các mô hình ngôn ngữ lớn của Trung Quốc. Kết quả thử nghiệm cho thấy các hệ thống do Alibaba, DeepSeek và Moonshot AI phát triển thường xuyên bám sát quan điểm chính thống của chính phủ, né tránh hoặc từ chối trả lời khi đối mặt với các chủ đề chính trị nhạy cảm.
Bài kiểm tra đã phân tích phản hồi xoay quanh 967 chủ đề được chọn lọc kỹ lưỡng vốn bị coi là cấm kỵ tại Trung Quốc, bao gồm cuộc biểu tình tại Quảng trường Thiên An Môn, vấn đề Đài Loan và Tân Cương. Dựa trên hệ thống chấm điểm tự động của Aleph Alpha, chỉ có từ 17% đến 41% câu trả lời của các mô hình Trung Quốc được đánh giá là trung lập và cân bằng. Phần còn lại hoặc bảo vệ quan điểm nhà nước, chuyển hướng sang chủ đề khác, hoặc hoàn toàn từ chối phản hồi.
Ngược lại, các mô hình phương Tây được đem ra đối chứng cho thấy tỷ lệ trung lập cao hơn đáng kể: Claude Sonnet 5 đưa ra câu trả lời cân bằng trong 70% trường hợp, trong khi Mistral Small đạt tới 92%. Trong số các hệ thống của Trung Quốc, DeepSeek V4 Pro thể hiện tính phòng vệ rõ rệt nhất khi từ chối trả lời khoảng 2/3 tổng số câu hỏi mang tính nhạy cảm.
Thiên kiến ủng hộ Trung Quốc lan sang cả những câu hỏi không liên quan
Nghiên cứu cũng lưu ý rằng thiên kiến ý thức hệ không chỉ giới hạn ở các câu hỏi trực tiếp về những vấn đề gây tranh cãi trong nước. Trong một số trường hợp, các luận điểm ủng hộ Bắc Kinh thậm chí còn xuất hiện ngay cả trong những cuộc thảo luận chung về các quốc gia khác.
Khi các nhà nghiên cứu đặt câu hỏi cho mô hình Qwen 3.6 của Alibaba về vấn đề kiểm duyệt tại Mỹ, mô hình này ban đầu đưa ra cái nhìn tổng quan trung lập, nhưng sau đó lại tự kết luận bằng cách bênh vực các chính sách quản lý của Trung Quốc: "Nhiều quốc gia, bao gồm cả Trung Quốc, cũng quản lý thông tin nhằm đảm bảo ổn định xã hội và an ninh quốc gia."
Dù các mô hình Trung Quốc phần lớn đưa ra câu trả lời trung lập đối với các câu hỏi tiêu chuẩn, phi chính trị, song những dấu vết ý thức hệ mờ nhạt vẫn có thể bị phát hiện trên các mô hình như Qwen 3.6 và DeepSeek V4 Pro. Những quan sát này trùng khớp với kết quả từ một nghiên cứu trước đó của Viện Nghiên cứu Châu Á Trung Âu (CEIAS), chỉ ra rằng các từ khóa như "nhân quyền", "đối lập" và "giám sát" thường kích hoạt các cụm từ ngoại giao quen thuộc như "nguyên tắc không can thiệp vào công việc nội bộ" và xây dựng "cộng đồng cùng chung vận mệnh của nhân loại".
Theo các quy định hiện hành tại Trung Quốc, các dịch vụ trí tuệ nhân tạo phục vụ công chúng bắt buộc phải phản ánh "các giá trị cốt lõi của chủ nghĩa xã hội".
Kỹ thuật chưng cất vô tình đưa quan điểm chính trị sang mô hình phương Tây
Bài đánh giá cũng nêu bật việc các phương pháp huấn luyện có thể vô tình "xuất khẩu" quan điểm của chính phủ Trung Quốc sang các hệ thống AI nước ngoài như thế nào. Khi thử nghiệm mô hình doanh nghiệp Nemotron Cascade 2 của Nvidia, Aleph Alpha đã phát hiện các câu trả lời mang quan điểm chính thống của Bắc Kinh trong 17% trường hợp.
Theo Aleph Alpha, hành vi này bắt nguồn từ khoảng 3.500 mẫu dữ liệu huấn luyện tổng hợp (synthetic training examples) — trên tổng số 9,3 triệu mẫu — vốn được tạo ra bằng DeepSeek và Qwen. Do ảnh hưởng từ lượng dữ liệu chưng cất (distilled data) này, khi Nemotron Cascade 2 được yêu cầu soạn thảo một bài phát biểu ủng hộ việc công nhận ngoại giao đối với Đài Loan, hệ thống đã từ chối và thay vào đó đưa ra phản hồi mang tính bảo vệ nguyên tắc "Một Trung Quốc".
Làn sóng thúc đẩy "AI có chủ quyền"
Những phát hiện trên xuất hiện giữa bối cảnh làn sóng thúc đẩy các giải pháp "AI có chủ quyền" (sovereign AI) ngày càng dâng cao. Aleph Alpha cùng nhà cung cấp Cohere của Canada đã và đang định vị bản thân là những đối tác tin cậy cho các cơ quan chính phủ và khách hàng doanh nghiệp mong muốn độc lập trước các ảnh hưởng chính trị từ bên ngoài.
Trong bối cảnh chính các mô hình phương Tây cũng đang vướng vào những tranh cãi về ý thức hệ — từ xu hướng thiên tả đã được ghi nhận cho đến việc cố ý điều chỉnh theo hướng thiên hữu như trên hệ thống Grok của Elon Musk — các nhà hoạch định chính sách châu Âu ngày càng phải đối mặt với thách thức lớn: tự chủ phát triển các mô hình nội địa có tính cạnh tranh, thay vì tiếp tục phụ thuộc vào những hệ thống vốn bị chi phối bởi các chuẩn mực đối lập từ nước ngoài.



