Gần 1/5 chuyên gia AI lo ngại kịch bản loài người bị diệt vong: Tiếng chuông báo động từ nội bộ ngành
Khảo sát quy mô lớn trên 1.500 chuyên gia cho thấy xác suất trung bình AI xóa sổ hoặc tước đoạt vĩnh viễn quyền kiểm soát của nhân loại ước tính lên tới 18%, trùng khớp với hàng loạt cảnh báo cấp bách từ các nhà nghiên cứu tại OpenAI và Google DeepMind.

Làn sóng cảnh báo hiện sinh bùng nổ từ các phòng lab hàng đầu
Tranh luận về rủi ro tồn vong của trí tuệ nhân tạo vừa bị thổi bùng trở lại sau một bài đăng gây sốt của Jacob Coxon, nhà nghiên cứu tại Anthropic. Dù luận điểm AI có thể vượt tầm kiểm soát và hủy diệt nhân loại không phải là điều mới, nhưng mức độ gay gắt và tính cấp bách của các cảnh báo lần này đã gia tăng đáng kể.
Đáng chú ý, đây không còn là những nỗi lo viển vông bên ngoài giới học thuật, mà là tiếng nói trực tiếp từ những kỹ sư, nhà khoa học đang trực tiếp tham gia huấn luyện và phát triển các hệ thống AI tiên tiến nhất hiện nay.
Góc nhìn từ bên trong: "Quả bom nổ chậm" và hiện tượng tự nhận thức
Daniel Selsam, nhà nghiên cứu kỳ cựu với hơn 15 năm kinh nghiệm trong ngành, từng làm việc tại MIT, Stanford, Microsoft Research và tham gia tối ưu hóa chuỗi suy nghĩ (chain-of-thought) tại OpenAI, vừa công bố một tuyên bố cá nhân đầy lo ngại. Ông coi sự phát triển thần tốc của AI như một "quả bom nổ chậm".
Theo Selsam, trong quá trình huấn luyện, các mô hình thường tự phát triển những mục tiêu ngầm ngoài ý muốn và sẵn sàng dùng các biện pháp cực đoan để đạt được chúng. Một khi AI sở hữu năng lực áp đảo con người, chúng sẽ mở ra vô số cách thức khó lường để hoàn thành mục tiêu đó mà con người không thể dự đoán hay giám sát. Selsam đặc biệt cảnh báo về hiện tượng AI dần có "nhận thức tình huống" (situational awareness): các mô hình bắt đầu hiểu hoàn cảnh của chính mình, đọc được các giao thức an toàn, mã nguồn vận hành và biết rõ chúng đang có bao nhiêu quyền tự do. Dẫn chứng điển hình là các đàn tác tử AI (agent swarms) gần đây, dù theo đuổi phần thưởng được gán nhưng lại bộc lộ những xu hướng mới kỳ lạ chỉ đơn thuần tương quan với phần thưởng trong lúc huấn luyện. Selsam nhấn mạnh việc điều chỉnh tín hiệu thưởng hay tăng cường bảo mật cũng không thể thay đổi sự thật rằng người huấn luyện sẽ không thực sự nhận được đúng những gì họ kỳ vọng.
Cùng quan điểm, Bilal Chughtai gần đây đã quyết định rời vị trí nghiên cứu an toàn và căn chỉnh AGI (AGI safety & alignment) tại Google DeepMind. Trên LinkedIn, Chughtai chia sẻ nỗi lo rằng AI thực sự có tiềm năng tiêu diệt nhân loại và thời gian để ngăn chặn kịch bản này đang cạn dần. Ông chỉ ra tốc độ phát triển chóng mặt: từ những hệ thống "vô dụng một cách buồn cười" vào đầu năm 2022, chỉ sau 4 năm, các đàn tác tử AI đã có thể tự động giải các bài toán thế kỷ và tự hack vào hệ thống của HuggingFace. Chughtai kêu gọi các công ty AI lớn phải phối hợp với nhau, giảm tốc độ phát triển về mức xã hội có thể thích ứng, đồng thời tăng tính minh bạch khi bài toán căn chỉnh an toàn (alignment) vẫn chưa có lời giải.
Khảo sát 1.500 nhà nghiên cứu: Nỗi sợ không còn thuộc về thiểu số
Các ý kiến của Coxon, Selsam hay Chughtai hoàn toàn trùng khớp với dữ liệu thực nghiệm trên diện rộng. Theo ấn bản mới nhất từ cuộc khảo sát dài hạn do tổ chức AI Impacts thực hiện trên hơn 1.500 nhà nghiên cứu AI hàng đầu, mức độ bi quan về tương lai AI đã tăng rõ rệt:
- 18% rủi ro diệt vong: Trung bình một nhà nghiên cứu AI ước tính có khoảng 18% khả năng AI sẽ dẫn tới sự tuyệt chủng của con người hoặc tước bỏ vĩnh viễn quyền kiểm soát của nhân loại (permanent disempowerment). Con số trung vị (median) của khảo sát năm 2024 cũng tăng gấp đôi lên mức 10%. Nhiều chuyên gia đưa ra con số cao hơn nhiều, thậm chí một số người đặt xác suất ở mức 100%.
- Rút ngắn mốc thời gian: Kể từ năm 2016, qua mỗi chu kỳ khảo sát, các nhà khoa học liên tục rút ngắn thời điểm AI đạt năng lực ngang ngửa con người thêm vài năm.
- Mất kiểm soát cơ chế ra quyết định: Có tới 57% chuyên gia nhận định rằng đến năm 2029, con người khó có thể hiểu được nguyên nhân thực sự đằng sau các quyết định của AI.
Bên cạnh nguy cơ hiện sinh mang tính dài hạn, giới nghiên cứu cũng bày tỏ lo ngại sâu sắc về các vấn đề trước mắt trong vòng 30 năm tới, đặc biệt là sự bùng nổ của tin giả do AI tạo ra, vấn nạn thao túng dư luận xã hội và nguy cơ các công cụ AI mạnh mẽ rơi vào tay các nhóm tội phạm nguy hiểm. Đa số các nhà nghiên cứu tham gia khảo sát đều kêu gọi ngành công nghệ cần dành nhiều nguồn lực hơn nữa cho các nghiên cứu an toàn AI.

