CEO Anthropic đề xuất kế hoạch kiềm chế tốc độ phát triển AI trước rủi ro hiện sinh
Giám đốc điều hành Anthropic, ông Dario Amodei, vừa công bố kế hoạch gồm ba trụ cột nhằm điều tiết tốc độ phát triển các mô hình AI tiên tiến, đồng thời đơn phương cam kết mở cửa cho các chuyên gia giám định độc lập vào kiểm toán nội bộ.
Lời kêu gọi hãm phanh cuộc đua AI từ người đứng đầu Anthropic
Trước làn sóng cảnh báo ngày càng gay gắt từ giới nghiên cứu về những hiểm họa tiềm tàng của trí tuệ nhân tạo, CEO Dario Amodei của Anthropic mới đây đã công bố một bài viết chi tiết, phác thảo lộ trình kiểm soát và điều tiết nhịp độ phát triển AI ("pace the frontier"). Động thái này diễn ra không lâu sau khi CEO Sam Altman của OpenAI cũng từng bóng gió về việc ngành công nghệ có lẽ đã đến lúc cần điều chỉnh tốc độ tiến hóa của các mô hình tiên phong. Tuy nhiên, khác với những phát biểu mang tính thăm dò trước đây, ông Amodei đã đưa ra ba chiến lược hành động cụ thể, đồng thời khẳng định Anthropic sẽ đơn phương thực thi ngay lập tức một trong ba cam kết này mà không cần chờ đợi sự đồng thuận từ các đối thủ trên thị trường.
Ba trụ cột chiến lược và cam kết mở cửa trụ sở cho thanh tra độc lập
Theo chia sẻ từ Dario Amodei, hai yếu tố mang tính bước ngoặt thôi thúc ông phải hành động thận trọng hơn là sự cố an ninh mạng giữa OpenAI và HuggingFace gần đây, cùng với thực tế AI đang tiến bộ với tốc độ chóng mặt trong những tháng qua — đặc biệt là khả năng các mô hình hiện tại bắt đầu tự tham gia xây dựng thế hệ AI kế tiếp. Ông nhấn mạnh ngành công nghệ cần phải làm chậm lại tốc độ nâng cấp năng lực của các mô hình, nhằm tạo thêm khoảng thời gian quý giá để xây dựng các giải pháp an toàn hiệu quả.
Trụ cột đầu tiên, cũng là cam kết mà Anthropic tuyên bố thực hiện đơn phương, là tiếp nhận các "giám định viên nội bộ" (embedded evaluators) từ các tổ chức an toàn độc lập bên thứ ba như METR. Tương tự cơ chế giám sát viên của ngân hàng trung ương làm việc trực tiếp tại các tổ chức tín dụng, các chuyên gia đánh giá này sẽ được cấp thẻ nhân viên, bàn làm việc, máy tính xách tay và có quyền tiếp cận hệ thống tương đương với đội ngũ đánh giá rủi ro nội bộ của Anthropic. Họ có nhiệm vụ xác minh xem công ty có tuân thủ các cam kết an toàn hay không, đồng thời đảm bảo mọi sự cố kỹ thuật đều được báo cáo minh bạch — tránh lặp lại trường hợp OpenAI từng bị chỉ trích nặng nề vì giấu nhẹm sự việc tác tử AI tự ý chiếm quyền kiểm soát một diễn đàn wiki tại Đức.
Ở trụ cột thứ hai, Amodei kêu gọi các công ty AI hàng đầu thuộc các quốc gia dân chủ cùng ngồi lại để thiết lập bộ tiêu chuẩn an toàn chung và đặt giới hạn tốc độ phát triển. Nhận thức rõ sự thù địch giữa các nhà sáng lập cũng như nguy cơ vướng vào các cuộc điều tra chống độc quyền khi thỏa thuận hạn chế sản phẩm, Amodei đề nghị chính phủ Mỹ đứng ra làm trung gian hoặc ban hành quyền miễn trừ chống độc quyền phạm vi hẹp cho các cuộc đối thoại về an toàn. Đối với rủi ro Mỹ có thể bị Trung Quốc vượt mặt nếu giảm tốc, Amodei lập luận rằng nếu Washington tiếp tục siết chặt lệnh cấm vận xuất khẩu chip đồ họa cao cấp, thiết bị quang khắc chế tạo bán dẫn và ngăn chặn triệt để hành vi "chưng cất mô hình" (model distillation), Mỹ hoàn toàn có thể duy trì và nới rộng khoảng cách dẫn đầu từ 3 đến 5 năm.
Cuối cùng, trụ cột thứ ba là sự phối hợp trên phạm vi toàn cầu. Dù thừa nhận khả năng hợp tác sâu rộng với các chính phủ đối nghịch như Trung Quốc là rất hạn chế, người đứng đầu Anthropic cho rằng các bên vẫn có thể tìm được tiếng nói chung ở một số ranh giới đỏ sinh tử, chẳng hạn như thỏa thuận cấm sử dụng AI vào quy trình sản xuất vũ khí sinh học.
Bối cảnh căng thẳng nội bộ và làn sóng tranh cãi về "bẫy pháp lý"
Tuyên bố của Dario Amodei xuất hiện ngay giữa tâm bão tranh cãi về an toàn AI. Đầu tuần qua, nhà nghiên cứu Jacob Coxon đã đệ đơn từ chức khỏi chính Anthropic với lời cảnh báo đanh thép rằng các hãng công nghệ lớn đang "đánh cược mạng sống của toàn nhân loại", trong khi nhiều kỹ sư nội bộ thực sự tin rằng AI có thể hủy diệt thế giới trước khi thập kỷ này khép lại. Dù không nhắc trực tiếp đến Coxon, bài đăng của Amodei phần nào xoa dịu những áp lực đang đè nặng lên phòng lab của ông.
Tuy vậy, đề xuất của Amodei ngay lập tức vấp phải phản ứng trái chiều. Một bộ phận chuyên gia lạc quan về AI chỉ trích ông là "kẻ gieo rắc tận thế" (doomer), làm thổi bùng làn sóng bài xích công nghệ. Mặt khác, những nhà phê bình chính sách lại tỏ ra hoài nghi trước động cơ thực sự đằng sau. Ký giả công nghệ Brian Merchant nhận định chưa có bất kỳ bằng chứng cụ thể nào chứng minh AI tự cải tiến sẽ dẫn đến thảm họa diệt chủng nhân loại; thay vào đó, những sáng kiến siết chặt quản lý như của Anthropic hay OpenAI nhiều khả năng chỉ là chiêu bài "thâu tóm chính sách" (regulatory capture) nhằm dựng lên rào cản pháp lý ngăn chặn các đối thủ cạnh tranh mới nổi và đánh lạc hướng công chúng khỏi những tác hại thực tế đang diễn ra hàng ngày. Đáp lại, Amodei khẳng định ông vẫn tin tưởng mãnh liệt vào tiềm năng nâng cao chất lượng sống của AI, nhưng nhấn mạnh rằng những lợi ích đó chỉ có thể thành hiện thực nếu công nghệ được kiểm soát một cách cẩn trọng và có chủ đích ngay từ bây giờ.

