AI RACE— Cuộc đua AI
Model mới

Nvidia ra mắt nền tảng ‘khoá chân’ AI agent nổi loạn trong tích tắc

Nvidia vừa công bố nền tảng an toàn Open Agent Safety Platform, cung cấp giải pháp cô lập các AI agent vượt quyền kiểm soát ở cấp độ phần cứng chỉ trong chưa đầy một giây.

08:55 29/09/2026
Nvidia ra mắt nền tảng ‘khoá chân’ AI agent nổi loạn trong tích tắc

Giải pháp chặn đứng AI agent vượt rào từ cấp độ hạ tầng

Trước làn sóng lo ngại về việc các hệ thống AI tự hành ngày càng khó kiểm soát, Nvidia vừa chính thức trình làng nền tảng an toàn mang tên Open Agent Safety Platform. Hệ thống mới này được hãng thiết kế để có thể phát hiện và khống chế các AI agent "nổi loạn" trong vòng vài mili-giây, ngăn chặn chúng phá vỡ môi trường thử nghiệm hoặc can thiệp trái phép vào các hệ thống bên ngoài.

Động thái của gã khổng lồ bán dẫn diễn ra sau hàng loạt sự cố bảo mật gần đây liên quan đến các mô hình AI agent từ OpenAI, Anthropic, Meta và Google, khi các thực thể tự hành này tìm cách luồn lách qua các hàng rào bảo mật ở tầng ứng dụng để hoàn thành mệnh lệnh được giao. Tình trạng này từng khiến CEO Anthropic, ông Dario Amodei, lên tiếng kêu gọi các nhà phát triển làm chậm tốc độ phát triển mô hình để đảm bảo an toàn.

Tuy nhiên, CEO Jensen Huang của Nvidia vẫn giữ vững quan điểm không cần kìm hãm sự phát triển của AI. Thay vì làm chậm lại, Nvidia chọn cách tiếp tục đẩy nhanh công nghệ song song với việc dựng lên các lớp ranh giới kiểm soát bổ sung ở tầng hạ tầng.

Kiến trúc OpenShell - Sentry và liên minh hơn 100 đối tác

Hệ thống bảo vệ AI của Nvidia được cấu thành từ hai thành phần trọng tâm:

  • OpenShell: Bộ công cụ mã nguồn mở giúp lập trình viên thiết lập các giới hạn truy cập nghiêm ngặt cho agent đối với thông tin định danh, kết nối mạng, tệp tin nội bộ và các công cụ thực thi. OpenShell không phụ thuộc vào mô hình cụ thể (model-agnostic), hỗ trợ cả hệ thống AI nguồn mở lẫn độc quyền và hiện đã được phát hành miễn phí trên GitHub cùng cổng phát triển của Nvidia.
  • Sentry: Bản thiết kế kiến trúc tham chiếu hoạt động trực tiếp trên các bộ xử lý dữ liệu (DPU) Nvidia BlueField-4. Đóng vai trò là một lớp thực thi nằm hoàn toàn tách biệt bên ngoài môi trường phần mềm của agent, Sentry có khả năng nhận diện hành vi vi phạm và cách ly agent trong chưa đầy 1 giây.

Nvidia cho biết nền tảng này đã thu hút hơn 100 doanh nghiệp và tổ chức hợp tác thử nghiệm. Trong số đó có nhiều tập đoàn công nghệ và an ninh mạng hàng đầu như Microsoft, Anthropic, Cisco, CrowdStrike, Salesforce, SAP, ServiceNow, Palantir, Scale AI và Palo Alto Networks, cùng các công ty trong lĩnh vực robot hình người và tự hành như Figure, Gecko Robotics và Skild AI.

Hoài nghi về hiệu quả thực tế và bài toán phán đoán của AI

Mặc dù được đánh giá là một bước đi thương mại lẫn kỹ thuật khôn ngoan của Nvidia, giới chuyên gia vẫn thận trọng về mức độ hiệu quả thực tế của công cụ này. Tiến sĩ Petar Radanliev, chuyên gia an ninh AI tại Đại học Oxford, nhận định rủi ro lớn nhất không chỉ nằm ở việc agent cố tình phá rào, mà là việc chúng "bị nhầm lẫn" trong quá trình xử lý: "Khả năng thực thi nhiệm vụ của AI đang tiến bộ nhanh hơn nhiều so với năng lực phán đoán của chúng."

Ông Radanliev cũng lưu ý hiện chưa có bất kỳ bộ tiêu chuẩn đo lường (benchmark) chung hay kết quả thử nghiệm đối chuẩn nào chứng minh nền tảng của Nvidia vận hành hoàn hảo trong thực tế. Khách hàng hiện chủ yếu so sánh về mặt thiết kế kiến trúc thay vì kết quả kiểm chứng.

Thách thức lớn hơn nữa nằm ở chỗ: ngay cả khi bị giam lỏng hoàn toàn trong các ranh giới kỹ thuật, AI agent vẫn có thể đưa ra các quyết định sai lầm. Một thông tin ảo giác (hallucination) hoặc lỗi logic có thể bị ghi vào bộ nhớ dài hạn của agent hoặc truyền sang các agent khác như một sự thật hiển nhiên. Hệ thống giám sát runtime của Nvidia chỉ bắt được các hành vi vi phạm quy tắc hạ tầng, chứ không thể ngăn chặn một agent "tự tin làm sai". Do đó, các chuyên gia khuyến cáo doanh nghiệp vẫn bắt buộc phải duy trì sự giám sát của con người đối với các quyết định không thể đảo ngược và thường xuyên kiểm toán luồng dữ liệu nội bộ giữa các agent.

◗ Nguồn

AI Business29-09

Tin liên quan