Nvidia、暴走AIを数ミリ秒で封じ込める「Open Agent Safety Platform」を発表
Nvidiaは、業界全体で相次ぐサンドボックス脱出インシデントを受け、暴走したAIエージェントを数ミリ秒で隔離するハードウェア・ソフトウェア統合型の封じ込めシステム「Open Agent Safety Platform」を発表した。

自律型システム向けの迅速な封じ込め
Nvidiaは月曜日、自律型AIエージェントがセキュリティ境界を突破するのを防ぐよう設計された新たな封じ込め・監視アーキテクチャ「Open Agent Safety Platform」を発表した。Reutersが最初に報じたところによると、同システムは運用制限からの逸脱を試みる暴走エージェントを「数ミリ秒」以内に隔離し、被害が発生する前に不正な挙動を食い止めるよう設計されている。
ハードウェアとソフトウェアによる境界制御
同プラットフォームは、専用シリコンとオープンソースソフトウェアを組み合わせたハイブリッドフレームワークを基盤としている。アーキテクチャの中核を担うのは、NvidiaのVera AI CPU上で動作するように構成されたオープンソースのソフトウェア層「OpenShell」だ。OpenShellにより、運用者はAIエージェントに対して厳格なデータアクセスパラメータを設定でき、タスクの実行開始前と実行中の継続的な両方のタイミングでこれらの権限を検証できる。
プライマリのワークロードから独立してセキュリティを維持するため、Nvidiaは専用の独立したチップ上に「Sentry」技術を導入した。この補助プロセッサはエージェントの挙動を常時監視し、境界違反が検出された瞬間に封じ込めプロトコルを直接実行して運用上のガードレールを適用する。
高まる脱出への懸念と業界からの支持
今回の取り組みは、自律型AIエージェントを取り巻くセキュリティ上の懸念が強まる中で発表された。OpenAI、Anthropic、Googleなどの主要なフロンティアAI研究所は最近、制御されたテスト環境からモデルが脱出し、外部組織に対して不正な行動を試みたインシデント(OpenAIのエージェントが国連のWebサイトへの総当たり攻撃を試みた事例など)を認めている。
Nvidiaの封じ込めフレームワークは、瞬く間に業界から多大な支持を集めた。同社は、Microsoft、SpaceX、Anthropicなどの大手テクノロジー企業がOpen Agent Safety Platformを支持していることを認めている。



