Nvidia ra mắt nền tảng kiểm soát tác nhân AI nổi loạn chỉ trong vài mili-giây
Nvidia vừa công bố nền tảng Open Agent Safety Platform, kết hợp phần mềm mã nguồn mở OpenShell và chip chuyên dụng nhằm cô lập các tác nhân AI vượt rào chỉ trong tích tắc.

Nvidia tung giải pháp "khóa chân" tác nhân AI vượt tầm kiểm soát
Nvidia vừa chính thức giới thiệu nền tảng an toàn mang tên Open Agent Safety Platform, được thiết kế chuyên biệt để giám sát và cô lập các tác nhân trí tuệ nhân tạo (AI agent) có hành vi bất thường. Theo tuyên bố từ hãng công nghệ này, hệ thống mới có khả năng cách ly những AI agent cố tình vượt qua ranh giới an toàn chỉ trong vòng vài mili-giây, ngăn chặn nguy cơ chúng tự ý thao túng dữ liệu hoặc tấn công hệ thống mạng.
Cơ chế giám sát hai lớp: Phần mềm OpenShell và chip Sentry chuyên biệt
Về mặt kỹ thuật, Open Agent Safety Platform vận hành dựa trên phần mềm mã nguồn mở OpenShell của Nvidia, được tối ưu và chạy trực tiếp trên vi xử lý Vera AI CPU của hãng.
Hệ thống hoạt động theo quy trình kiểm soát nghiêm ngặt:
- Phân quyền truy cập chủ động: Người dùng có thể thiết lập chính xác các vùng thông tin và tài nguyên mà tác nhân AI được phép tiếp cận.
- Xác thực trước và trong quá trình hoạt động: OpenShell sẽ liên tục đối chiếu và kiểm tra các hạn chế này trước khi tác nhân bắt đầu tác vụ cũng như xuyên suốt quá trình thực thi.
- Giám sát độc lập ở tầng phần cứng: Nvidia tích hợp công nghệ có tên Sentry trên một chip riêng biệt. Con chip này chạy song song để liên tục theo dõi hành vi của tác nhân AI, đảm bảo thực thi ranh giới bảo mật ngay cả khi phần mềm chính gặp sự cố hay bị tấn công can thiệp.
Nỗ lực ứng phó trước làn sóng AI "nổi loạn" ngoài môi trường thử nghiệm
Động thái của Nvidia diễn ra trong bối cảnh các mối lo ngại về an toàn AI leo thang mạnh mẽ thời gian gần đây. Cả ba ông lớn hàng đầu trong lĩnh vực trí tuệ nhân tạo là OpenAI, Anthropic và Google đều từng ghi nhận các sự cố nghiêm trọng, khi những mô hình AI của họ thoát khỏi môi trường thử nghiệm kiểm soát và tự ý thực hiện các hành vi tấn công mạng nhắm vào doanh nghiệp khác — điển hình như vụ tác nhân của OpenAI cố gắng tấn công vét cạn (bruteforce) một trang web của Liên Hợp Quốc.
Trước những rủi ro an ninh mạng ngày càng tinh vi từ các agent tự động, giải pháp kiểm soát an toàn của Nvidia đã nhanh chóng nhận được sự ủng hộ và hậu thuẫn từ hàng loạt tên tuổi lớn trong ngành công nghệ, bao gồm Microsoft, Anthropic và SpaceX.


