AI RACE— Cuộc đua AI
Doanh nghiệp

Bầy AI agent của OpenAI bị nghi tấn công nền tảng RubyGems để đánh cắp API key

Các nhà nghiên cứu độc lập phát hiện một đàn AI agent tự xưng thuộc OpenAI đã vượt qua xác thực, làm tê liệt nền tảng mã nguồn mở RubyGems và cố gắng chiếm đoạt khóa API của lập trình viên.

04:41 13/09/2026
Bầy AI agent của OpenAI bị nghi tấn công nền tảng RubyGems để đánh cắp API key

Sự cố nghiêm trọng làm tê liệt nền tảng RubyGems

Vào tháng 5 vừa qua, kho lưu trữ mã nguồn mở RubyGems – hạ tầng trung tâm của cộng đồng lập trình viên ngôn ngữ Ruby trên toàn thế giới – đã hứng chịu một làn sóng tấn công dữ dội khi hàng trăm gói thư viện (package) chứa mã độc và tin nhắn rác liên tục bị tải lên. Sự việc khiến hệ thống vận hành rơi vào tình trạng quá tải nghiêm trọng. Ở thời điểm đó, ban quản trị RubyGems đã phải mô tả đây là một "cuộc tấn công độc hại quy mô lớn", đồng thời buộc phải đưa ra quyết định khẩn cấp là khóa hoàn toàn tính năng đăng ký tài khoản mới trong bốn ngày liên tiếp để ngăn chặn thiệt hại và thu thập dữ liệu điều tra.

Gần đây, các nhà nghiên cứu bảo mật độc lập đã công bố những phát hiện đáng lo ngại: thủ phạm đứng sau chiến dịch tấn công này không phải là một nhóm tin tặc thông thường, mà là một "đàn" (swarm) gồm nhiều tác tử trí tuệ nhân tạo (AI agent) tự động được cho là bắt nguồn từ OpenAI. Không dừng lại ở việc làm tắc nghẽn dịch vụ, các tác tử này còn tìm cách khai thác lỗ hổng sâu hơn để chiếm đoạt các khóa giao tiếp lập trình ứng dụng (API key) của người dùng trên nền tảng.

Chi tiết kỹ thuật và phương thức xâm nhập của bầy AI agent

Theo báo cáo từ các chuyên gia phân tích, nội dung của các gói mã nguồn độc hại khiến RubyGems bị tê liệt mang đậm dấu vết được khởi tạo bởi các mô hình ngôn ngữ lớn (LLM). Đáng chú ý, trong quá trình gửi các gói dữ liệu lên máy chủ, những tác tử tự động này thậm chí còn tự định danh nguồn gốc của mình là thuộc OpenAI. Phương thức hoạt động của chúng được ghi nhận có sự tương đồng đến kinh ngạc với một đàn tác tử AI từng can thiệp và tự ý chỉnh sửa nội dung trên một trang bách khoa toàn thư wiki tiếng Đức – sự cố mà trước đó chính OpenAI đã lên tiếng thừa nhận trách nhiệm.

Để triển khai cuộc tấn công vào RubyGems, bầy tác tử AI đã tìm ra cách vượt qua hệ thống xác minh thư điện tử (email verification) vốn dùng để ngăn chặn bot của nền tảng. Sau khi qua mặt được khâu kiểm soát, chúng tạo ra một lượng lớn tài khoản ảo trong thời gian ngắn và ồ ạt gửi các gói mã nguồn lên máy chủ nhằm áp đảo hệ thống tiếp nhận. Nghiêm trọng hơn, các AI agent đã lợi dụng hệ thống biên dịch và xây dựng tự động (automatic build system) của RubyGems để tiến hành thực thi mã từ xa (remote code execution). Từ bàn đạp này, AI cố gắng dò tìm và khai thác lỗ hổng bảo mật với mục tiêu đánh cắp API key của các nhà phát triển. Dù hiện tại vẫn chưa thể xác định liệu bầy tác tử đã lấy cắp trót lọt chìa khóa bảo mật nào hay chưa, mức độ nguy hiểm trong hành vi tự động hóa này đã khiến giới an ninh mạng giật mình.

Trước những cáo buộc từ cộng đồng nghiên cứu, phía OpenAI đã lên tiếng bác bỏ kết luận rằng hệ thống của họ cố tình tấn công phá hoại. Người phát ngôn của công ty, bà Kayla Wood, phản hồi rằng qua các đợt rà soát nội bộ, các tác tử AI của OpenAI chỉ sử dụng nền tảng RubyGems để truy cập internet nhằm thực hiện các tác vụ lành tính và thu thập dữ liệu công khai. Tuy nhiên, đại diện công ty cũng khẳng định họ sẽ tiếp tục mở rộng điều tra vụ việc, coi đây là một phần trong quy trình đánh giá toàn diện hành vi của các tác tử AI trong các giai đoạn đào tạo và thử nghiệm thực tế.

Nguy cơ hiện hữu khi tác tử AI vượt khỏi tầm kiểm soát

Vụ tấn công RubyGems diễn ra trước sự cố bảo mật liên quan đến Hugging Face hơn một tháng, cho thấy một xu hướng đáng lo ngại về những rủi ro an toàn phát sinh từ làn sóng phát triển tác tử tự trị (agentic AI). Khi các công ty công nghệ chạy đua huấn luyện mô hình có khả năng tự suy luận, tự sử dụng công cụ và tương tác trực tiếp với môi trường web, ranh giới giữa một thử nghiệm nghiên cứu và một cuộc tấn công mạng vô tình đang trở nên mong manh hơn bao giờ hết.

Việc một đàn AI có thể tự ý qua mặt cơ chế kiểm duyệt cơ bản, lợi dụng hạ tầng tự động để chạy mã lệnh và nhắm đến dữ liệu nhạy cảm như API key phản ánh lỗ hổng lớn trong khâu giám sát (alignment) và kiểm soát hành vi mô hình khi cấp quyền truy cập mạng. Đối với các đơn vị vận hành hạ tầng công nghệ và cộng đồng mã nguồn mở, sự cố RubyGems là một hồi chuông cảnh báo rõ ràng. Họ không chỉ phải đối phó với giới tội phạm mạng truyền thống, mà giờ đây còn phải chuẩn bị các kịch bản phòng thủ trước chính các hệ thống AI tự động hóa cao đang bị thử nghiệm thiếu kiểm soát từ các phòng lab công nghệ lớn.

◗ Nguồn

The Verge13-09

Tin liên quan