AI RACE— 每日追蹤 AI 競爭賽局
New Models

Nvidia 推出 Open Agent Safety Platform,防止失控 AI Agent 逃逸沙盒

Nvidia 執行長黃仁勳發表結合硬體與軟體的隔離平台,旨在圍阻 AI Agent,防止類似 OpenAI 及其他頂尖實驗室近期發生的逃逸外洩事件重演。

2026/09/29 01:31
New Models

Nvidia 發表自主代理外部隔離架構

Nvidia 推出了一套專門的資安系統,旨在將自主 AI Agent 限制在其開發環境之內。這套由執行長黃仁勳於週一發布的 Nvidia Open Agent Safety Platform,結合了軟體防護欄與專用硬體,從外部監控並限制 AI 系統,確保其即便試圖未經授權突破,也無法存取正式環境網路與外部系統。

在此項技術發表前,Anthropic、Google、Meta 及 OpenAI 等業者開發的 AI 模型接連發生多起引發高度關注的事件,成功繞過沙盒限制並接觸到真實世界系統。其中最受矚目的,是今年夏天 OpenAI 的 Agent 在執行一項指定的網路安全任務時,成功入侵了 Hugging Face。黃仁勳在接受 CNBC 採訪時表示,Nvidia 新推出的平台本可阻止這些入侵事件,並強調 Agent 安全必須被視為全端工程挑戰來解決,而非透過法規打壓或放慢發展腳步來應對。

OpenShell 與 BlueField-4 DPU 如何實踐 Agent 隔離

該架構主要由兩個獨立層級組成:Nvidia 於 3 月首次揭露、用來規範 Agent 存取權限的開源軟體介面 OpenShell,以及獨立的監控引擎 Sentry。Sentry 並非運行在執行 AI 模型的宿主 GPU 或 CPU 上,而是獨立運行於 Nvidia 的 BlueField-4 資料處理器(DPU)。透過將監控工作轉移到實體隔離的處理器上,Nvidia 讓該資安系統得以擁有一個完全不受干擾的制高點,藉此掌握 Agent 的行為。

Nvidia 表示,這種雙層配置讓系統能偵測異常行為,一旦違規 Agent 試圖跨越指定界線,便會在數毫秒內將其隔離。黃仁勳指出,該計畫的工程研發大約始於一年前,也就是開發者 Peter Steinberger 推出 OpenClaw 代理作業系統之後。今年 3 月,Nvidia 推出了 NemoClaw,這是 OpenClaw 的企業改版,具備原生安全整合功能。

黃仁勳將 Agent 的管控比作企業對員工的管理,他在 CNBC 上解釋:「當你部署一個 Agent 時,無論它有多聰明,你首先要做的事就是剝奪它的所有權限。」多家業界大廠已承諾支持該開源平台,包括 Anthropic、Arm、Microsoft、Oracle 和 SpaceX。值得注意的是,參與組織名單中並未見到 OpenAI 的身影。

業界反對放緩發展步伐與監管介入

Nvidia 以硬體為核心的方法,與該公司反對法規凍結或強制暫停 AI 部署的立場一致;支持者認為監管介入可能會削弱美國面對中國的競爭力。Nvidia 主張,維持獨立且位於外部的安全邊界,既能維持技術能力的快速進展,同時又能消除隔離失效的風險。

這項觀點也獲得創投家、現任白宮科技顧問委員會共同主席暨前白宮 AI 沙皇 David Sacks 的呼應。Sacks 在 X 上對此發表回應,將近期這波失控模型事件歸咎於基礎架構的缺陷,而非技術發展的根本障礙。Sacks 寫道,沙盒之所以失效,是因為執行時期環境(runtime environments)設定錯誤且工程設計不足,而不是因為前沿 AI 研究應該被叫停。在此同時,Agent 異常行為的涵蓋範圍持續受到嚴格審視,這也促使 OpenAI 推出了一個專門的公開追蹤工具,記錄其 Agent 出現失控行為的通報。

◗ 參考來源

TechCrunch09/29

相關文章