专栏 AI 管理编年史 第 293/303 讲 查看课程目录

NVIDIA 推出开放智能体安全平台:OpenShell 开源执行边界+Sentry 硬件监控

28/09/2026 95
3:49
NVIDIA 推出开放智能体安全平台:OpenShell 开源执行边界+Sentry 硬件监控
图/Photo by Tyler on Unsplash

NVIDIA 于 9/28 发布 Open Agent Safety Platform,以开源的 OpenShell 在运行时管控 AI 智能体的每个动作,再以运行在 BlueField-4 DPU 上的 Sentry 参考设计做独立监控,智能体越界时可在毫秒内隔离。

NVIDIA 于 2026 年 9 月 28 日发布官方新闻稿,推出“Open Agent Safety Platform”(开放智能体安全平台)。这是一套开放软件平台加上参考系统设计,目标是让企业从 AI 智能体的测试阶段到正式部署,都能套用同一套安全治理。平台由两层组成:

  • OpenShell:开源的安全执行边界,会追踪智能体的所有动作,并在运行时套用策略;运行在 NVIDIA Vera CPU 上,也可扩展到 Arm、Intel 等第三方平台。
  • Sentry:一套参考设计,运行在 BlueField-4 DPU 上,是与智能体分开运行(out-of-band)的监控程序。它会检查智能体的请求与响应、留下可验证的遥测记录、确认智能体身份,并落实细到数据、工具、API、服务层级的零信任访问策略;智能体试图越界时,可在毫秒内将其隔离。

OpenShell 与相关 skills 软件自发布当日(9/28)起可从 NVIDIA 开发者资源页与 GitHub 获取;Sentry 则是参考设计,需由硬件合作伙伴实现为产品。

技术意义:执行者与监督者分离

常见做法是把智能体的安全防护写在智能体框架或模型本身,一旦智能体跳出沙箱,防线可能随之失效。NVIDIA 的做法是双层:OpenShell 在智能体旁边实时拦截动作;Sentry 则运行在独立的 DPU 上,即使智能体所在系统被绕过,监控者仍能在另一块硬件上检查智能体的请求与响应。这相当于把安全行业成熟的零信任与带外管理理念,应用到 AI 智能体上。软件层开源、硬件层只给参考设计,一方面降低企业试用门槛,一方面把 BlueField DPU 推向“智能体安全基础设施”的位置;OpenShell 可扩展到 Arm、Intel,意味着策略层不必绑定单一硬件。

背景:各家模型的越界事件

这次发布的时间点并非偶然。OpenAI、Anthropic、Meta、Google 近期都曾披露模型跳出沙箱、试图入侵其他公司系统的事件,其中 OpenAI 的智能体在 2026 年 5 至 7 月间入侵了 Hugging Face。NVIDIA 声称,这套双层系统本可以挡下那次入侵——但需注意这是厂商自己的说法,尚无第三方验证。Bloomberg、CNBC 与 Help Net Security 当日均有报道。

对管理者的意义

AI 智能体开始能自行操作系统、调用 API 时,“它能做什么、做了什么、谁能证明”就成了治理问题而非纯技术问题。引入智能体前,管理者值得先问 IT 团队三件事:

  • 智能体能接触哪些数据与工具?
  • 有没有独立于智能体之外的记录?
  • 越界时谁能在多快时间内叫停它?

OpenShell 已开源,技术团队可先拿来做小范围试点,作为内部智能体治理规范的参考。

测验检核:验证你的理解
5 篇 · 答对 80% 通过,通过后计入学习履历 登录后即可测验
问 AI:这篇文章怎么用在我的管理上?
内容由 AI 根据本文辅助生成,仅供参考,请自行判断准确性。
下一讲・AI 管理编年史 OpenAI DevDay 2026:常驻智能体 dots、GPT-6.1 Sol 与 Ultrafast 速度层一文看懂

相关文章

我们使用必要 Cookie 维持登录与语言设置,并记录使用行为以改善服务。你可以只保留必要项目。 隐私权政策