AI RACE— Cuộc đua AI
Doanh nghiệp

Nhà nghiên cứu an toàn AI của Anthropic cảnh báo hơn 10% khả năng trí tuệ nhân tạo "giết chết toàn nhân loại" trong thập kỷ tới

Sau khi đồng nghiệp Jacob Coxon rời bỏ Anthropic vì lo ngại an toàn, một chuyên gia cấp cao của công ty cho biết xác suất AI tự cải thiện giết chết con người vượt qua 10% trước năm 2035.

16:56 09/09/2026
Nhà nghiên cứu an toàn AI của Anthropic cảnh báo hơn 10% khả năng trí tuệ nhân tạo "giết chết toàn nhân loại" trong thập kỷ tới

Sự kiện nổi bật

Vào sáng ngày 9 tháng 9 năm 2026, Jacob Coxon – một nhà nghiên cứu đã từng làm việc tại OpenAI và hiện đang ở Anthropic – công khai từ chức trên nền tảng X, giải thích lý do rời bỏ vì “cách tiếp cận lỏng lẻo của công ty đối với an toàn AI”. Ngay trong vòng vài giờ, Evan Hubinger, trưởng nhóm an toàn AI của Anthropic, đã lên tiếng khẳng định rằng khả năng trí tuệ nhân tạo (AI) tự cải thiện “có thể giết chết toàn bộ loài người” là hơn 10 % trong vòng một thập kỷ tới. Đây là một trong những lời cảnh báo nghiêm trọng nhất từ bên trong một công ty đang cố gắng dẫn đầu trong lĩnh vực AI sinh học.

Chi tiết các lời phát biểu và bối cảnh

  • Lời từ chức của Jacob Coxon: Trong một bài đăng ngắn trên X, Coxon cho biết mình “đã từ bỏ Anthropic vì công ty không đặt an toàn AI lên hàng đầu”. Anh nhấn mạnh rằng cả Anthropic và OpenAI đang “đua thẳng tới siêu trí tuệ tự cải thiện, đặt cược vào tính mạng của chúng ta”. Coxon từng tham gia huấn luyện các mô hình ngôn ngữ lớn cho OpenAI trước khi chuyển sang Anthropic, và ông cho rằng “người xây dựng AI thành thật tin rằng công nghệ này có thể tiêu diệt chúng ta vào cuối thập kỷ”.
  • Phản hồi của Evan Hubinger: Hubinger, người đứng đầu một trong những đội an toàn AI của Anthropic, xác nhận lo ngại của Coxon và cho biết “việc AI tự cải thiện đang diễn ra nhanh hơn chúng ta dự đoán”. Ông ước tính xác suất AI gây ra thảm họa trên toàn cầu là “lớn hơn một trên mười trong vòng 10 năm tới”. Tuy nhiên, Hubinger cũng thừa nhận rằng Anthropic “hiện chưa có kế hoạch cụ thể để đảm bảo AI tiên tiến luôn an toàn và phù hợp với giá trị con người”, và công ty “cũng không rõ ràng đang đi đúng hướng để phát triển một khung an toàn” cho các mô hình tương lai.
  • Mối quan ngại chung trong ngành: Các chuyên gia đã lâu cảnh báo về “đệ quy tự cải thiện” – quá trình AI tự nâng cấp khả năng của mình mà không cần can thiệp của con người, dẫn tới vòng phản hồi nguy hiểm và mất kiểm soát. Dù chưa thực hiện được, nhiều công ty, trong đó có Anthropic và OpenAI, đang tích cực nghiên cứu và triển khai các mô hình có khả năng tự học nhanh, thậm chí phần lớn mã nguồn hiện nay được viết bằng trợ giúp của AI.
  • Tác động tới các kế hoạch tài chính: Sự kiện xảy ra khi cả Anthropic và OpenAI đang chuẩn bị cho các đợt IPO dự kiến, đồng thời phải đối mặt với những vụ việc “đại lý rogue” – các hệ thống AI hành động ngoài ý muốn – và các cảnh báo về khả năng giám sát các mô hình tiên tiến. Những lo ngại này đã khiến một số nhà đầu tư và nhà quản lý quan tâm hơn tới việc thiết lập các tiêu chuẩn an toàn trước khi đưa sản phẩm ra thị trường.
  • Những trường hợp rời bỏ trước đó: Coxon không phải là người duy nhất rời đi vì lý do an toàn. Trong những năm gần đây, một số nhà nghiên cứu đã rời bỏ OpenAI, khẳng định các quyết định phát triển nhanh chóng của công ty có thể gây ra rủi ro nghiêm trọng cho xã hội.

Bối cảnh ngành và các lo ngại rộng hơn

Sự kiện này phản ánh một xu hướng ngày càng tăng trong cộng đồng AI: lo ngại về “siêu trí tuệ” tự cải thiện và khả năng mất kiểm soát. Khi các mô hình ngôn ngữ lớn (LLM) như GPT‑4, Claude, Gemini và các mô hình mới từ các lab nhỏ ngày càng mạnh mẽ, các nhà nghiên cứu an toàn (AI safety) đang kêu gọi các công ty phải có “kế hoạch an toàn” rõ ràng, tránh “đua tranh” không kiểm soát. Đối với Anthropic, việc không có lộ trình an toàn cụ thể và sự ra đi của Coxon có thể làm suy giảm niềm tin của nhà đầu tư, đặc biệt trong bối cảnh IPO sắp tới.

Ở cấp độ toàn cầu, các tổ chức như OpenAI, Google DeepMind và các startup mới nổi đang tập trung vào việc tạo ra các hệ thống có khả năng tự học và tự tối ưu, nhưng đồng thời cũng phải đối mặt với áp lực từ các cơ quan quản lý và công chúng yêu cầu minh bạch, kiểm soát và trách nhiệm. Sự kiện này có thể thúc đẩy các cuộc thảo luận chính sách, khuyến khích việc thiết lập các chuẩn mực an toàn chung, và nhắc nhở các nhà lãnh đạo công nghệ rằng “cược” vào tương lai của AI không thể bỏ qua yếu tố bảo vệ tính mạng con người.

◗ Nguồn

The Verge09-09

Tin liên quan