Anthropic phát hiện hàng loạt âm mưu dùng AI chế tạo vũ khí sinh học và tấn công mạng
Báo cáo an toàn mới từ Anthropic tiết lộ việc ngăn chặn nhiều nỗ lực lợi dụng mô hình Claude để thiết kế vũ khí sinh học và phần mềm tác chiến, trong bối cảnh làn sóng nhân sự an toàn rời bỏ các phòng lab lớn gia tăng.

Làn sóng lạm dụng AI cho mục đích quân sự và nguy cơ sinh học bị ngăn chặn
Anthropic vừa công bố một báo cáo an toàn đáng chú ý, tiết lộ công ty đã phát hiện và ngăn chặn 5 trường hợp cố gắng lợi dụng mô hình AI Claude để lên kế hoạch và chế tạo vũ khí sinh học. Bên cạnh mối đe dọa sinh học, báo cáo cũng ghi nhận 6 vụ việc khác sử dụng công cụ AI này nhằm phát triển phần mềm phục vụ các loại vũ khí quy ước.
Những phát hiện này nhấn mạnh mối lo ngại ngày càng hiện hữu về việc các mô hình ngôn ngữ lớn (LLM) tiên tiến có thể bị khai thác ngoài tầm kiểm soát, biến thành công cụ hỗ trợ các kịch bản phá hoại nguy hiểm.
Claude bị lạm dụng từ tấn công mạng đến giám sát nhà nước
Theo các chi tiết được Anthropic chia sẻ và các nguồn tin độc lập ghi nhận:
- Chiến tranh mạng: Nhóm tin tặc có liên hệ với Nga đã cố gắng lợi dụng Claude để tự động hóa các đợt tấn công mạng nhằm vào cơ sở hạ tầng của Ukraine.
- Giám sát diện rộng: Một số cơ quan chính phủ cũng đang đưa mô hình Claude vào vận hành để phục vụ mục đích giám sát.
- Biến động nhân sự an toàn: Báo cáo xuất hiện ngay giữa thời điểm nhạy cảm về nội bộ ngành AI. Hai nhà nghiên cứu an toàn AI vừa quyết định rời khỏi Anthropic và Google do lo ngại về các rủi ro chưa được kiểm soát. Động thái này diễn ra chỉ một ngày sau vụ từ chức gây xôn xao dư luận của Jacob Coxon tại Anthropic.
Trước các cảnh báo an toàn từ giới nghiên cứu, tỷ phú Elon Musk công khai gọi những lo ngại này là một "vở kịch dàn dựng" (setup) và "chiến dịch tâm lý" (psyop). Tuy nhiên, tại Quốc hội Mỹ, các mối đe dọa thực tế đang thúc đẩy các nhà lập pháp nhanh chóng thắt chặt quy định pháp lý đối với công nghệ AI.
Áp lực đặt lên các phòng thí nghiệm hàng đầu
Các rủi ro an ninh đang buộc các ông lớn AI phải điều chỉnh chiến lược tiếp cận. CEO Sam Altman của OpenAI mới đây đã chủ động gặp gỡ các công ty điện lực để chào bán giải pháp phòng thủ an ninh mạng do OpenAI phát triển, sau hàng loạt báo cáo về các cuộc tấn công AI nhắm vào cơ sở hạ tầng trọng yếu. Đáng chú ý, Altman cũng chia sẻ với nhân viên rằng OpenAI sẵn sàng cân nhắc phương án làm chậm tốc độ phát triển mô hình nếu các rủi ro an toàn chưa được giải quyết thấu đáo.
Cùng lúc đó, Bill Gates và nhiều chuyên gia công nghệ tiếp tục lên tiếng kêu gọi ngành công nghiệp AI cần gấp rút thiết lập các "hàng rào bảo vệ" (guardrails) mới. Khi ranh giới giữa nghiên cứu khoa học dân sự và vũ khí hóa AI ngày càng mờ nhạt, việc các lab hàng đầu như Anthropic hay OpenAI chủ động công khai các trường hợp xâm phạm và siết chặt cơ chế kiểm duyệt được xem là bước đi bắt buộc trước áp lực giám sát từ chính phủ.

