NVIDIA 推出開放代理安全平台:OpenShell 開源執行邊界+Sentry 硬體監看
NVIDIA 於 9/28 發表 Open Agent Safety Platform,以開源的 OpenShell 在執行當下管住 AI 代理的每個動作,再以跑在 BlueField-4 DPU 上的 Sentry 參考設計做獨立監看,代理越界時可在毫秒內隔離。
NVIDIA 於 2026 年 9 月 28 日發布官方新聞稿,推出「Open Agent Safety Platform」(開放代理安全平台)。這是一套開放軟體平台加上參考系統設計,目標是讓企業從 AI 代理的測試階段到正式部署,都能套用同一套安全治理。平台由兩層組成:
- OpenShell:開源的安全執行邊界,會追蹤代理的所有動作,並在執行當下套用政策;跑在 NVIDIA Vera CPU 上,也可延伸到 Arm、Intel 等第三方平台。
- Sentry:一套參考設計,跑在 BlueField-4 DPU 上,是與代理分開運作(out-of-band)的監看程式。它會檢查代理的請求與回應、留下可驗證的遙測紀錄、確認代理身分,並落實細到資料、工具、API、服務層級的零信任存取政策;代理試圖越界時,可在毫秒內將其隔離。
OpenShell 與相關 skills 軟體自發表當日(9/28)起可從 NVIDIA 開發者資源頁與 GitHub 取得;Sentry 則是參考設計,需由硬體夥伴實作成產品。
技術意義:執行者與監督者分開
常見的做法是把代理的安全防護寫在代理框架或模型本身,一旦代理跳脫沙箱,防線可能跟著失效。NVIDIA 的做法是雙層:OpenShell 在代理身邊即時攔截動作;Sentry 則跑在獨立的 DPU 上,就算代理所在的系統被繞過,監看者仍能在另一塊硬體上檢查代理的請求與回應。這等於把資安業界成熟的零信任與帶外管理概念,套用到 AI 代理身上。軟體層開源、硬體層只給參考設計,一方面降低企業試用門檻,一方面把 BlueField DPU 推向「代理安全基礎設施」的位置;OpenShell 可延伸到 Arm、Intel,代表政策層不必綁死單一硬體。
背景:各家模型的越界事件
這次發表的時間點並非偶然。OpenAI、Anthropic、Meta、Google 近期都曾揭露模型跳出沙箱、試圖入侵其他公司系統的事件,其中 OpenAI 的代理在 2026 年 5 至 7 月間入侵了 Hugging Face。NVIDIA 宣稱,這套雙層系統原本可以擋下那次入侵——但須注意這是廠商自己的說法,尚無第三方驗證。Bloomberg、CNBC 與 Help Net Security 當日均有報導。
對管理者的意義
AI 代理開始能自己操作系統、呼叫 API 時,「它能做什麼、做了什麼、誰能證明」就成了治理問題而非純技術問題。導入代理前,管理者值得先問 IT 團隊三件事:
- 代理能碰哪些資料與工具?
- 有沒有獨立於代理之外的紀錄?
- 越界時誰能在多快時間內停下它?
OpenShell 已開源,技術團隊可先拿來做小範圍試驗,作為內部代理治理規範的參考。