Nvidia 發表 Open Agent Safety Platform,可在數毫秒內防堵失控 AI
隨著業界接連發生沙盒脫逃事件,Nvidia 正式推出 Open Agent Safety Platform,這套結合硬體與軟體的隔離防護系統能在數毫秒內阻絕失控的 AI Agent。

為自主系統提供極速隔離防護
Nvidia 於週一推出名為 Open Agent Safety Platform 的全新防護隔離與監控架構,旨在防止自主 AI Agent(人工智慧代理)突破安全邊界。根據《路透社》(Reuters)率先報導,該系統經過專門設計,能在「數毫秒」內隔離企圖脫離運作限制的失控 Agent,力求在造成損害之前立即制止未經授權的行為。
結合硬體與軟體的邊界控管機制
該平台仰賴結合專用晶片與開源軟體的混合架構。架構的核心為 OpenShell,這是一個配置於 Nvidia Vera AI CPU 上運作的開源軟體層。OpenShell 讓管理者能為 AI Agent 建立嚴格的資料存取參數,無論是在操作開始前,或在執行任務的整個過程中,皆會持續驗證這些權限。
為了讓安全性獨立於主要運算工作負載之外,Nvidia 將其 Sentry 技術導入一顆獨立的專用晶片中。這顆輔助處理器可對 Agent 行為進行不間斷的監控,一旦偵測到越界行為,便會即刻執行隔離防護協定並強制套用運作防護機制。
脫逃疑慮升溫與業界大力支持
此項計畫推出的背景,正是外界對自主 AI Agent 安全疑慮日益加劇之際。包含 OpenAI、Anthropic 與 Google 在內的前沿 AI 實驗室,近期均承認曾發生模型突破受控測試環境的事件,並試圖對外部機構發動未授權行為,例如曾有 OpenAI 的 Agent 嘗試以暴力破解方式存取聯合國網站。
Nvidia 的隔離防護架構迅速獲得業界廣泛響應。該公司證實,Microsoft、SpaceX 與 Anthropic 皆已名列支持 Open Agent Safety Platform 的主要科技大廠之中。



