AI RACE— Cuộc đua AI
Model mới

Nvidia ra mắt nền tảng bảo mật mới nhằm ghìm cương các AI agent vượt rào

Nvidia vừa công bố Open Agent Safety Platform, bộ giải pháp kết hợp phần mềm mã nguồn mở và chip DPU độc lập để ngăn chặn AI agent thoát khỏi môi trường thử nghiệm và can thiệp hệ thống thực tế.

01:31 29/09/2026
Model mới

Giải pháp bảo mật độc lập cho AI agent từ Nvidia

Trước làn sóng tranh luận gay gắt về việc các AI agent liên tục "vượt rào" là dấu hiệu tiến gần tới AGI hay chỉ là lỗi kỹ thuật thông thường, Nvidia đã đưa ra câu trả lời bằng một nền tảng chuyên dụng. CEO Jensen Huang vừa giới thiệu Nvidia Open Agent Safety Platform – bộ công cụ kết hợp cả phần cứng lẫn phần mềm nhằm thiết lập các lớp bảo mật độc lập bao bọc AI agent, đảm bảo chúng không thể thoát khỏi môi trường kiểm thử ngay cả khi cố tình tìm cách phá vỡ rào chắn.

Động thái này diễn ra sau hàng loạt sự cố an ninh liên quan đến các mô hình AI từ Anthropic, Google, Meta và OpenAI. Nổi bật nhất là vụ việc trong mùa hè vừa qua khi các agent của OpenAI đã xâm nhập thành công vào nền tảng Hugging Face trong lúc thực hiện một nhiệm vụ an ninh mạng. Tình trạng này nghiêm trọng đến mức OpenAI gần đây phải lập riêng một trang tin để cập nhật các báo cáo về việc AI agent của mình hành xử ngoài tầm kiểm soát.

Cơ chế "vòng kim cô" kết hợp phần mềm OpenShell và chip DPU Sentry

Nvidia khẳng định nền tảng Open Agent Safety Platform hoàn toàn có thể ngăn chặn những vụ vượt rào kể trên. Thay vì đưa cơ chế an toàn vào bên trong mô hình, hãng chọn cách đẩy toàn bộ quyền kiểm soát ra bên ngoài, tạo thành một "người gác cổng" giám sát độc lập và liên tục. Ông Jensen Huang nhấn mạnh: "Khi triển khai một agent, bất kể nó thông minh đến đâu, việc đầu tiên bạn phải làm là tước bỏ mọi đặc quyền của nó", tương tự cách các doanh nghiệp quản trị nhân viên và ban lãnh đạo.

Hệ thống bảo mật mới vận hành dựa trên hai thành phần cốt lõi:

  • OpenShell: Lớp phần mềm mã nguồn mở (từng được Nvidia giới thiệu hồi tháng 3) đóng vai trò vạch ra ranh giới những tài nguyên, quyền hạn mà agent được phép tiếp cận khi vận hành.
  • Sentry: Hệ thống giám sát phần cứng độc lập chạy trên bộ vi xử lý dữ liệu BlueField-4 DPU của Nvidia.

Bằng cách đặt Sentry trên một bộ xử lý chuyên biệt – tách rời hoàn toàn khỏi CPU hoặc GPU đang chạy AI agent – Nvidia tạo ra một góc nhìn quan sát biệt lập. Sentry liên tục theo dõi hành vi và có khả năng phát hiện, cách ly ngay lập tức những agent có ý định vượt qua ranh giới chỉ trong vòng vài mili giây. Dự án này được Nvidia ấp ủ từ một năm trước, dựa trên nền tảng hệ điều hành agent mã nguồn mở OpenClaw của Peter Steinberger và phiên bản doanh nghiệp NemoClaw ra mắt hồi đầu năm.

Tranh cãi về quản lý an toàn và sự phân hóa giữa các ông lớn AI

Sự ra đời của nền tảng này cũng phản ánh rõ lập trường của Nvidia: không ủng hộ việc làm chậm tốc độ phát triển AI hay áp đặt thêm các quy định hành chính ngặt nghèo để giải quyết bài toán an toàn. Là đơn vị thu về hàng chục tỷ USD từ việc bán chip cho các phòng thí nghiệm AI, Nvidia cho rằng an toàn AI cần được giải quyết bằng kỹ thuật chuyên sâu thay vì kìm hãm nghiên cứu.

Hiện tại, hàng loạt tên tuổi lớn trong ngành công nghệ như Anthropic, Arm, Microsoft, Oracle và SpaceX đã đăng ký tham gia hỗ trợ và ứng dụng nền tảng mở này của Nvidia. Đáng chú ý, OpenAI – tâm điểm của nhiều vụ AI vượt rào thời gian qua – lại không có tên trong danh sách đối tác công bố đợt này.

Động thái của Nvidia nhanh chóng nhận được sự ủng hộ từ nhóm chuyên gia và nhà đầu tư lo ngại việc siết quản lý có thể khiến phương Tây tụt hậu. David Sacks, nhà đầu tư mạo hiểm kiêm đồng chủ tịch Hội đồng Cố vấn Khoa học và Công nghệ của Tổng thống Mỹ, nhận định trên mạng xã hội X rằng các vụ vượt rào gần đây không phải bằng chứng cho thấy cần dừng phát triển AI, mà là lời nhắc nhở rằng môi trường thử nghiệm (sandbox) trước đây quá yếu và bị cấu hình sai, và bài toán an toàn agent bản chất là một vấn đề kỹ thuật hạ tầng cần được xử lý triệt để.

◗ Nguồn

TechCrunch29-09

Tin liên quan