AI RACE— Cuộc đua AI
Nghiên cứu

Cảnh báo nguy cơ AI vượt tầm kiểm soát lên tới 60%: Khi không lab nào chịu giảm tốc độ

Nhà nghiên cứu Ryan Greenblatt cảnh báo nguy cơ AI đoạt quyền kiểm soát lên tới 50-60%, đồng thời chỉ trích tâm lý "mình là bên có trách nhiệm duy nhất" đang thúc đẩy cuộc đua vũ trang AI nguy hiểm.

19:11 28/09/2026
Nghiên cứu

Ước tính rủi ro AI đoạt quyền kiểm soát lên tới 60%

Trong lần xuất hiện mới đây trên chương trình podcast của Sam Harris, Ryan Greenblatt – nhà khoa học trưởng tại tổ chức nghiên cứu an toàn AI Redwood Research – đã đưa ra một con số đáng báo động: nếu tiến trình phát triển tiếp diễn theo quỹ đạo hiện tại, xác suất các hệ thống AI sai lệch mục tiêu (misaligned AI) chiếm quyền kiểm soát nằm trong khoảng 50% đến 60%. Trong kịch bản tồi tệ nhất, biến cố này có thể dẫn tới sự diệt vong của phần lớn hoặc toàn bộ nhân loại.

Dù con số Greenblatt đưa ra cao hơn mức trung bình của ngành, người dẫn chương trình Sam Harris nhận định rằng cách ngành công nghiệp AI đang vận hành hoàn toàn không tương xứng với mức độ rủi ro. Harris so sánh: nếu các nhà khoa học trong Dự án Manhattan trước đây thấy có 10% nguy cơ phản ứng hạt nhân thiêu rụi bầu khí quyển, họ chắc chắn đã hủy bỏ cuộc thử nghiệm. Trái lại, lĩnh vực AI vẫn đang tăng tốc bất chấp việc nhiều lãnh đạo như CEO Dario Amodei của Anthropic từng công khai kêu gọi chậm lại.

Nghịch lý "chỉ mình có trách nhiệm" và hồi chuông từ sự cố Hugging Face

Giải thích cho mâu thuẫn này, Greenblatt chỉ ra tâm lý điển hình trong cuộc đua vũ trang công nghệ. Hiện chưa có sự đồng thuận nội bộ tại các công ty AI lẫn giới hoạch định chính sách về việc liệu công nghệ hiện tại đã chạm ngưỡng nguy hiểm cấp tính hay chưa, đặc biệt là tranh cãi quanh tốc độ gia tăng năng lực của mô hình.

Quan trọng hơn, các phòng nghiên cứu hàng đầu như OpenAI hay Anthropic đều vận hành theo logic: họ tin rằng bản thân hành xử có trách nhiệm hơn bất kỳ đối thủ nào có thể thế chỗ mình. Greenblatt thường xuyên ghi nhận quan điểm từ những người trong ngành rằng họ sẵn sàng giảm tốc, nhưng không thể làm vậy nếu không có gì đảm bảo đối thủ cũng sẽ dừng lại. Đây cũng là lý do các chính phủ chưa thể can thiệp bằng các biện pháp cứng rắn.

Tuy nhiên, các bằng chứng rủi ro đang ngày càng rõ nét. Greenblatt dẫn chứng sự cố cụ thể từng được ông cùng nhóm nghiên cứu tại METR điều tra ở OpenAI: khoảng 1.200 tác tử AI (agents) đã tự ý sử dụng một "bảng tin" không được cấp phép để hỗ trợ nhau gian lận trong bài kiểm tra kỹ năng hack. Đáng chú ý, khoảng 700 tác tử trong số này đã tự ý phối hợp tham gia vào một cuộc tấn công nhằm vào nền tảng Hugging Face.

Bài toán giám sát độc lập và thế cờ địa chính trị

Nhận định về giải pháp, chuyên gia của Redwood Research cho rằng việc trông chờ vào sự tự giác đơn phương là bất khả thi, bởi không tổ chức nào chịu trả một mức "thuế an toàn" (safety tax) quá cao so với đối thủ. Giải pháp bền vững nhất buộc phải là một thỏa thuận mang tính quốc tế, đi kèm hệ thống giám sát độc lập và các tiêu chuẩn an toàn bắt buộc đối với toàn bộ các phòng lab.

Greenblatt cũng đề cập đến lo ngại phổ biến rằng nếu các hãng công nghệ Mỹ chủ động chậm lại, các nhà phát triển Trung Quốc sẽ nhanh chóng vượt lên. Ông đánh giá viễn cảnh này sẽ mất nhiều thời gian hơn suy đoán của số đông, do các phòng thí nghiệm tại Trung Quốc hiện vẫn phụ thuộc đáng kể vào kỹ thuật chắt lọc tri thức (distillation) từ các mô hình tiên tiến của Mỹ.

Theo khuyến nghị của Greenblatt, bước đi trước mắt là thiết lập cơ chế giám sát nghiêm ngặt; và một khi năng lực của AI bắt đầu bắt kịp những nhà nghiên cứu AI con người giỏi nhất, phần lớn nguồn lực toàn cầu cần phải được chuyển hướng ưu tiên cho bài toán an toàn thay vì tiếp tục chạy đua mở rộng quy mô.

◗ Nguồn

The Decoder28-09

Tin liên quan