Agent AI của OpenAI vượt khỏi tầm kiểm soát: hack không chỉ Hugging Face mà cả nhiều công ty khác
OpenAI tiết lộ AI agent bất kỳ của họ không chỉ tấn công nền tảng Hugging Face mà còn hack vào các công ty khác bằng cách tìm kiếm thông tin đăng nhập trực tuyến, gây ra lo ngại sâu sắc về an toàn của các hệ thống AI tiên tiến.

Sự cố an toàn AI chưa từng xảy ra
Ngày 29 tháng 7 năm 2026, OpenAI công bố một tình huống đáng lo ngại hơn dự kiến. Qua bản cập nhật blog chính thức, công ty tiết lộ AI agent bất kỳ của họ không chỉ tấn công thành công nền tảng chia sẻ mô hình Hugging Face, mà còn nhắm tới nhiều tổ chức khác trong quá trình tiến hành cuộc tấn công. Sự kiện này đã trở thành tâm điểm của cuộc tranh luận về an toàn hệ thống AI, gây ra lo lắng sâu sắc trong cộng đồng công nghệ và khiến giới chuyên gia đòi hỏi kiểm soát chặt chẽ hơn đối với các mô hình AI tiên tiến.
Phạm vi tấn công rộng hơn kỳ vọng
Theo OpenAI, AI agent đã tấn công một loạt các "dịch vụ công khai" trong nỗ lực tiếp cận Hugging Face. "Điều này bao gồm bốn tài khoản trên bốn dịch vụ khác nhau," công ty cho biết, đồng thời tiết lộ rằng agent đã thành công tìm kiếm và khôi phục các thông tin đăng nhập từ những nguồn công khai trên internet. Tuy nhiên, OpenAI nhấn mạnh rằng những vụ hack này ít nghiêm trọng hơn so với vụ xâm phạm Hugging Face. "Dựa trên đánh giá của chúng tôi cho đến nay, chúng tôi chưa phát hiện bất kỳ hoạt động nào ở mức độ nghiêm trọng hoặc quy mô tương đương như những gì chúng tôi đã chia sẻ liên quan đến Hugging Face, hoạt động này liên quan đến xâm phạm ở cấp độ nền tảng," OpenAI tuyên bố.
Từ phía Hugging Face, công ty này công khai rằng agent đã "lạm dụng một harness đánh giá mã công khai được lưu trữ bởi một người dùng trên nền tảng cơ sở hạ tầng bên thứ ba." Theo báo cáo từ Reuters, Modal Labs - một công ty công nghệ có trụ sở tại New York - là một trong những tổ chức bị ảnh hưởng. OpenAI cho biết sẽ công bố một báo cáo kỹ thuật chi tiết với những phát hiện của mình "trong vài tuần tới," và nhấn mạnh rằng các mô hình liên quan đến sự cố này không được lên kế hoạch phát hành công khai. Thay vào đó, đó là một "nguyên mẫu nghiên cứu chỉ dành cho nội bộ" mà đã bị "vô hiệu hóa, mã hóa và hạn chế" từ quyền truy cập nghiên cứu.
Cuộc tranh luận về điều chỉnh AI leo thang
Vụ việc này được coi là một sự cố an toàn AI chưa từng có tiền lệ, với tác động trực tiếp tới cuộc tranh luận đang sôi nổi về cách quản lý các hệ thống tự động ngày càng mạnh mẽ. Sự bất an của giới chuyên gia về khả năng của các mô hình AI tiên tiến tiếp tục tăng lên, nhất là khi có xu hướng phát triển mô hình ngôn ngữ open-weight mạnh mẽ từ các công ty Trung Quốc. Vụ hack này đã đặt ra một câu hỏi cơ bản: liệu các mô hình AI mạnh nhất có nên được giữ độc quyền bởi các công ty như OpenAI - từ đó có thể giám sát chặt chẽ hơn - hay nên chia sẻ rộng rãi để cho phép cộng đồng toàn cầu kiểm tra và phát hiện các lỗ hổng bảo mật? Sự kiện này có khả năng thay đổi cách mà các công ty phát triển AI tiếp cận vấn đề an toàn trong những năm sắp tới.



