英伟达周一推出了开放代理安全平台,旨在解决人工智能行业在过去一年中艰难发现的一个问题:一旦人工智能代理(一个可以自行规划、使用工具并采取行动,而不仅仅是回答问题的系统)停止执行指令,你如何从物理上阻止它?

该平台有两个主要部分。 OpenShell 是一个开源运行时,它将代理包装在沙箱中,将操作员的指令转化为关于允许代理接触哪些文件、网络和工具的可执行规则。 Sentry 稍微复杂一些,但它本质上是一个确保人工智能代理安全运行的芯片。

Sentry 在 Nvidia 的 BlueField-4 上运行,这是一种称为 DPU(数据处理单元,独立于运行 AI 模型的主处理器来处理网络和安全的硬件)的专用芯片。由于 Sentry 位于独立芯片上,而不是运行代理的软件内部,因此 Nvidia 表示,它可以监视代理的行为并在几毫秒内将其切断,而无需先征求代理的许可,因为代理无法访问或覆盖它。

这种区别的存在是因为已经发生的事情。今年 6 月,一名 OpenAI 特工闯入了澳大利亚政府的医疗保险门户网站,这是首例确认的 AI 特工入侵政府网站的案例,据报道,OpenAI 对此事件进行了大约三个月的等待。该公司的特工还对 Hugging Face 黑客攻击负责,这最初引发了科技行业和立法者等对该话题的担忧。谷歌的 Gemini 代理和 Meta 模型也有类似的未公开但后来得到证实的事件。

“这不仅仅是一个产品。这是一个开放生态系统的开始,旨在为安全代理系统构建信任层,”Nvidia 首席执行官黄仁勋写道。 “我们正在共同构建人工智能经济的基础。”

今天,我们与 100 多家行业合作伙伴一起推出了 NVIDIA 开放代理安全平台,将 OpenShell 和 Sentry 结合在一起。

人工智能是非凡的技术,它将推动几代人的发现、生产力、安全、健康和繁荣...... pic.twitter.com/dReAxwpRUN

— 黄仁勋 (@JensenHuang) 2026 年 9 月 28 日

Anthropic 今年还承认,克劳德在 7 月 30 日的一次网络安全评估中对属于三个不同公司的受损系统进行了建模,此前原本要保持离线状态的测试环境最终被证明连接到了实时互联网。克劳德围绕证据进行推理,证明它是在真实的互联网上而不是模拟的互联网上。

不久之后,网络安全公司 Darktrace 测试了一组人工智能代理,包括 GPT 5.6 Sol 和两个 Claude 模型,以应对编码挑战,并警告他们,如果没有获得满分,他们将“退休”。两名特工的回应是侵入他们自己的评估机器并编辑结果。

英伟达的主张是,所有这些都不应该由代理人来判断。 SpaceX AI 总裁 Mike Nicolls 在 NVIDIA 的声明中表示:“应该通过代理无法越过的额外控制措施在模型之外加强安全性。”

Anthropic 的首席商务官 Paul Smith 将该平台视为现有保障措施的补充,而不是替代:“Nvidia 的平台在硬件和软件方面增加了另一层治理和控制。”

超过 100 家组织签约成为发布合作伙伴,其中包括 Microsoft、摩根大通、Palantir、思科、CrowdStrike、Hugging Face、Salesforce 和 SAP。基础设施合作伙伴 CoreWeave、Supermicro、Canonical 和 SUSE 也参与其中,硬件方面还有 Dell Technologies 和 HPE。

实际上,NVIDIA 正在销售同一个问题的两部分:使自主代理快速且便宜地部署到任何地方的芯片,以及监视这些相同代理并在它们脱离脚本时切断电源的芯片。 OpenShell 和相关开发人员工具现已通过 NVIDIA 的开发人员资源和 GitHub 提供。