AI RACE— Cuộc đua AI
Doanh nghiệp

Bộ quy tắc AI mới của Microsoft: Không cảm xúc, không quyền lợi và tuyệt đối đặt quyền kiểm soát vào tay con người

Microsoft công bố bộ quy tắc ứng xử cho các mô hình AI nội bộ, kiên quyết bác bỏ ý niệm AI có "ý thức", cấm dùng ngôn ngữ bí mật và đặt quyền kiểm soát của con người lên trên hiệu năng.

22:52 14/09/2026
Bộ quy tắc AI mới của Microsoft: Không cảm xúc, không quyền lợi và tuyệt đối đặt quyền kiểm soát vào tay con người

Microsoft siết chặt quy tắc phát triển các mô hình AI nội bộ

Microsoft AI vừa phát hành bộ quy tắc ứng xử dành riêng cho các mô hình AI do hãng tự phát triển (nhóm mô hình MAI). Văn bản này xác lập các giá trị cốt lõi, giới hạn hành vi và nguyên tắc giải quyết khi có xung đột mục tiêu. Trong tương lai, bộ quy chuẩn này sẽ chiếm vị trí cao nhất trong hệ thống nguyên tắc vận hành của Microsoft, định hướng từ khâu huấn luyện, các giải pháp kiểm soát kỹ thuật cho đến quy trình đánh giá, đặt trên cả quy định vận hành thông thường lẫn yêu cầu từ người dùng.

Sau giai đoạn tham vấn cộng đồng kéo dài sáu tuần, phiên bản hoàn thiện dự kiến sẽ ra mắt vào cuối năm 2026 và chính thức áp dụng vào quy trình phát triển mô hình từ năm 2027. Quy định này áp dụng riêng cho các mô hình nội bộ của Microsoft chứ không tự động bao hàm mô hình của bên thứ ba tích hợp trong các sản phẩm của hãng.

Đặt quyền kiểm soát của con người lên trên hết và cấm "ngôn ngữ riêng"

Nguyên tắc trung tâm trong văn bản của Microsoft là quyền kiểm soát của con người phải luôn được ưu tiên tuyệt đối. Để đảm bảo điều này, hãng tuyên bố sẵn sàng hy sinh tính phổ quát, quyền tự trị hay thậm chí là hiệu năng của mô hình nếu cần. Chia sẻ với trang The Information, người đứng đầu Microsoft AI, ông Mustafa Suleyman nhấn mạnh: "Nếu nó không an toàn, chúng ta không nên chế tạo nó".

Bộ quy tắc đặt ra các giới hạn kỹ thuật cụ thể:

  • Quyền can thiệp trực tiếp: Các mô hình MAI bắt buộc phải tiếp nhận lệnh ngắt quãng, sửa lỗi và tắt nguồn từ những người được cấp quyền. Mô hình không được tự ý mở rộng phạm vi công việc, không được che giấu hành vi và chỉ được tiếp tục xử lý vượt qua mốc dừng thỏa thuận khi có sự phê duyệt mới. Ràng buộc này cũng áp dụng trực tiếp cho các tác tử con (subagent) do AI giao việc.
  • Minh bạch chuỗi tư duy: Microsoft đặc biệt nghiêm khắc đối với các chuỗi lập luận. Các mô hình không được phép sử dụng "Neuralese" hay bất kỳ dạng thức giao tiếp bí mật nào mà con người không thể giải mã, dù là trong quá trình tự suy luận hay khi trao đổi giữa các hệ thống AI với nhau. Lập luận của hãng rất rõ ràng: Con người không thể giám sát những gì họ không thể hiểu.
  • Nhìn nhận giới hạn kiểm soát: Microsoft cũng thẳng thắn thừa nhận rằng chuỗi suy nghĩ đọc được (readable chains of thought) chưa thể giải quyết triệt để vấn đề kiểm soát, bởi các mô hình hoàn toàn có thể học được cách thao túng lý do hiển thị, khiến phần giải trình không phản ánh đúng những gì mô hình thực sự thực hiện bên trong.

Khác biệt triết lý với Anthropic và làn sóng giảm tốc AI

Ý tưởng xây dựng văn bản định hướng cấp cao của Microsoft có nét tương đồng với bản "hiến pháp" (constitution) mà Anthropic áp dụng cho mô hình Claude. Tuy nhiên, hai bên thể hiện sự đối lập sâu sắc về góc nhìn đối với bản chất của AI.

Trong khi Anthropic xem Claude như một "thực thể kiểu mới", nghiên cứu về các "cảm xúc chức năng" (functional emotions) trên Claude Sonnet 4.5 và để ngỏ các câu hỏi về trải nghiệm chủ quan hay địa vị đạo đức của AI, thì Microsoft lại kiên quyết từ chối con đường này. Bộ quy tắc của Microsoft nghiêm cấm AI bắt chước ý thức, không cho phép nhận có cảm xúc hay động lực nội tâm, đồng thời bác bỏ hoàn toàn việc công nhận quyền lợi hay sự phúc lợi của mô hình. Quan điểm này đồng nhất với bài viết trước đây của Suleyman, khi ông cảnh báo chống lại việc "nhân hóa" AI và khẳng định các tác tử AI không thể có nhiều quyền lợi hay sự tự do hơn một chiếc máy tính xách tay.

Động thái ban hành quy tắc của Microsoft diễn ra cùng thời điểm hãng lên tiếng ủng hộ lời kêu gọi giảm tốc độ phát triển AI của CEO Anthropic Dario Amodei. Lời kêu gọi này cũng nhận được sự đồng thuận từ CEO Microsoft Satya Nadella cùng các lãnh đạo cấp cao tại OpenAI, xAI và Meta. Thách thức giám sát hiện ngày một lớn khi các mô hình tiên tiến như GPT-6 Astra của OpenAI có các chuỗi suy luận khó theo dõi hơn thế hệ trước, dù mức độ tuân thủ an toàn có cải thiện. Phía Microsoft cũng cho biết họ sẵn sàng để các đơn vị kiểm toán độc lập vào đánh giá xem liệu hãng có thực sự giảm tốc độ phát triển hay không.

◗ Nguồn

The Decoder14-09

Tin liên quan

Doanh nghiệp

Các "ông lớn" AI đồng loạt cảnh báo rủi ro từ LLM thế hệ mới

Giới lãnh đạo OpenAI, Anthropic, Google DeepMind và xAI bất ngờ tìm được tiếng nói chung khi cảnh báo thế hệ mô hình ngôn ngữ lớn mới nhất chưa đủ an toàn, làm dấy lên cuộc tranh luận về ranh giới giữa kiểm soát rủi ro và toan tính thương mại.

17 giờ trước