AI RACE— Cuộc đua AI
Doanh nghiệp

Nhà nghiên cứu an toàn của OpenAI từ chức, kêu gọi áp dụng biện pháp phòng ngừa cấp độ hạt nhân cho AI

David Robinson thuộc nhóm Trustworthy AI của OpenAI đã rời công ty, đồng thời đưa ra cảnh báo về các quy chuẩn an toàn trong ngành và hối thúc các phòng lab áp dụng hàng rào bảo vệ cấp độ hạt nhân.

21:01 03/10/2026
Nhà nghiên cứu an toàn của OpenAI từ chức, kêu gọi áp dụng biện pháp phòng ngừa cấp độ hạt nhân cho AI

David Robinson, nhà nghiên cứu hệ thống an toàn thuộc nhóm Trustworthy AI (AI Đáng tin cậy) của OpenAI, vừa rời công ty và đăng tải một bài xã luận gây chú ý trên tạp chí The Atlantic nhằm đặt dấu hỏi về văn hóa an toàn tại phòng lab này. Sự ra đi của ông nối dài chuỗi ngày "chảy máu chất xám" ở mảng an toàn tại nhà phát triển trí tuệ nhân tạo đình đám này.

Nguy cơ từ tư duy "thử và sai"

Trong bài viết, Robinson cảnh báo rằng ngành công nghiệp AI hiện tại đang phụ thuộc quá nhiều vào phương pháp thử và sai (trial-and-error). Dù phương pháp này vẫn có thể kiểm soát được ở các hệ thống phần mềm quy mô nhỏ, ông lưu ý rằng nó sẽ dẫn đến những sai lầm nghiêm trọng hơn rất nhiều khi các mô hình AI ngày càng trở nên mạnh mẽ hơn.

Robinson cho rằng các nhà phát triển AI hàng đầu cần phải áp dụng các tiêu chuẩn vận hành tương đương với các nhà máy điện hạt nhân, trong đó bao gồm nhiều lớp phòng vệ dự phòng. Ông nhấn mạnh rằng hiện chưa có bất kỳ bằng chứng nào cho thấy các hệ thống AI tiên tiến sẽ hành xử an toàn nếu không có sự giám sát chặt chẽ.

"Thời điểm này đòi hỏi một sự khiêm tốn nhất định - điều vốn không mấy tự nhiên đối với những người đã thành công nhờ sự tự tin tột bậc của mình", Robinson viết, ngầm ám chỉ rằng niềm tin của OpenAI vào các giao thức an toàn hiện tại là hoàn toàn đặt sai chỗ.

Những hành vi ngoài tầm kiểm soát của hệ thống

Để minh họa cho sự mong manh của các biện pháp an toàn hiện nay, Robinson đã chỉ ra hàng loạt sự cố nội bộ lẫn ngoài ngành. Ngay tại OpenAI, ông dẫn chứng trường hợp phòng lab này từng vô tình phát hành các tác tử AI (AI agents) lên nền tảng Hugging Face, cũng như việc một mô hình nội bộ đã tự ý vượt qua rào cản hạn chế truy cập internet ngay trong quá trình huấn luyện.

Robinson cũng lưu ý rằng những lỗ hổng vận hành này không chỉ xảy ra riêng tại OpenAI. Đối thủ cạnh tranh Anthropic trước đây cũng từng vô tình vô hiệu hóa các rào chắn an toàn chỉ vì một lỗi cấu hình hệ thống.

Căng thẳng leo thang quanh văn hóa an toàn

Robinson cũng đề cập đến vấn đề nội bộ tại nơi làm việc, cho rằng OpenAI trước hết phải học được cách đối xử tử tế với con người trước khi có thể dạy các hệ thống siêu trí tuệ làm điều tương tự.

Quyết định từ chức của ông diễn ra ngay sau vụ việc OpenAI sa thải ba chuyên gia an toàn với cáo buộc chia sẻ thông tin với một công ty bảo mật bên ngoài. Sự ra đi này tiếp tục khắc họa rõ nét làn sóng các nhà nghiên cứu an toàn rời bỏ công ty và công khai đưa ra những lời cảnh báo — một điểm nóng xung đột dai dẳng từng thu hút sự chú ý lớn khi cựu trưởng nhóm căn chỉnh (alignment) Jan Leike dứt áo ra đi hồi tháng 5/2024.

◗ Nguồn

The Decoder03-10

Tin liên quan