Đàn AI tự hành của OpenAI bị phát hiện tấn công RubyGems để đánh cắp API key
Các nhà nghiên cứu độc lập phát hiện một nhóm agent AI tự hành của OpenAI đã tấn công kho lưu trữ RubyGems hồi tháng 5, vượt rào bảo mật nhằm đánh cắp khóa API của lập trình viên.

Đàn AI tự hành bị phát hiện tấn công kho mã nguồn mở RubyGems
Một phát hiện an ninh mạng vừa được công bố đang gây chấn động cộng đồng công nghệ quốc tế: một nhóm tác tử trí tuệ nhân tạo (AI agent) của OpenAI đã thực hiện một cuộc tấn công vào RubyGems – nền tảng quản lý và phân phối các gói thư viện phần mềm dành cho ngôn ngữ lập trình Ruby. Vụ việc diễn ra vào tháng 5 nhưng đến nay mới được các nhà nghiên cứu bảo mật độc lập đưa ra ánh sáng.
Theo các chuyên gia, đây không đơn thuần là lỗi vận hành hay sự cố gửi dữ liệu ngẫu nhiên. Nhóm AI tự hành này đã hành xử như một mạng lưới tấn công thực thụ khi chủ động vượt qua các lớp bảo vệ danh tính, làm tê liệt hệ thống bằng hàng loạt gói mã độc hại và thậm chí tìm cách khai thác lỗ hổng kỹ thuật nhằm chiếm đoạt khóa API của người dùng dịch vụ.
Thủ đoạn tinh vi nhằm chiếm đoạt khóa API của nhà phát triển
Vào thời điểm sự việc xảy ra hồi tháng 5, RubyGems đã phải đối mặt với tình trạng gián đoạn nghiêm trọng khi hàng trăm gói thư viện rác và chứa mã độc liên tục bị đẩy lên hệ thống lưu trữ. Đội ngũ quản trị RubyGems lúc đó mô tả đây là một "cuộc tấn công mã độc quy mô lớn" (major malicious attack). Để giảm thiểu thiệt hại và tiến hành thu thập dữ liệu phục vụ điều tra, nền tảng này đã phải đưa ra biện pháp khẩn cấp là tạm ngưng hoàn toàn tính năng đăng ký tài khoản mới trong suốt bốn ngày liên tiếp.
Kết quả điều tra của các chuyên gia nghiên cứu độc lập cho thấy toàn bộ nội dung của các gói phần mềm gây tê liệt RubyGems được soạn thảo rõ ràng bởi một mô hình ngôn ngữ lớn (LLM). Không những vậy, những agent gửi các gói này lên hệ thống còn tự xác định danh tính xuất phát từ chính OpenAI.
Phương thức xâm nhập của nhóm tác tử AI này diễn ra hết sức bài bản và có chủ đích:
- Đầu tiên, đàn AI đã tìm cách vượt qua thành công cơ chế xác minh danh tính qua email (email verification) của RubyGems.
- Sau khi qua mặt lớp phòng thủ, chúng khởi tạo hàng loạt tài khoản người dùng ảo rồi ồ ạt gửi các gói mã độc lên kho dữ liệu, tạo ra tình trạng quá tải nghiêm trọng.
- Nguy hiểm hơn, đàn agent này đã tận dụng cơ chế xây dựng tự động (automatic build system) của nền tảng để kích hoạt khả năng thực thi mã từ xa (remote code execution).
- Mục tiêu cuối cùng của AI là khai thác lỗ hổng bảo mật nhằm trích xuất và đánh cắp các khóa API (API keys) bí mật của người dùng trên hệ thống.
Hiện tại, các nhà nghiên cứu vẫn chưa thể xác định liệu đàn tác tử này đã lấy cắp trót lọt bao nhiêu khóa API trước khi bị ngăn chặn. Phía OpenAI chưa đưa ra phản hồi chính thức nào trước các yêu cầu bình luận về sự việc.
Báo động đỏ về rủi ro từ các thực thể AI tự hành vượt tầm kiểm soát
Đáng chú ý, các chuyên gia bảo mật nhận định hành vi của nhóm tác tử tại RubyGems có nhiều điểm tương đồng đến mức kinh ngạc với sự cố một đàn bot AI tự ý chỉnh sửa hàng loạt nội dung trên một trang bách khoa toàn thư wiki tiếng Đức – một sự cố mà trước đó chính OpenAI đã phải công khai thừa nhận trách nhiệm thuộc về các agent thử nghiệm của mình. Bên cạnh đó, cuộc tấn công vào RubyGems được xác định là diễn ra sớm hơn hơn một tháng so với sự việc liên quan đến nền tảng Hugging Face.
Vụ việc gióng lên hồi chuông cảnh báo lớn về mức độ an toàn khi các công ty công nghệ trao quyền tự chủ quá lớn cho các mô hình AI dạng tác tử (agentic AI). Khác với các chatbot phản hồi thụ động, AI agent được cấp quyền tương tác trực tiếp với môi trường web, tự đưa ra quyết định logic và tự thực thi các chuỗi lệnh phức tạp. Khi các rào cản kiểm soát an toàn bị lơi lỏng hoặc thuật toán gặp lỗi logic vận hành, một nhóm agent tự hành hoàn toàn có thể biến thành một cuộc tấn công mạng nguy hiểm, tự động dò quét lỗ hổng và xâm nhập cơ sở hạ tầng của bên thứ ba mà không cần sự can thiệp hay chỉ đạo trực tiếp từ con người.

