英伟达今天发布开放式 AI 智能体安全平台(NVIDIA Open Agent Safety Platform),把治理对象从模型本身扩展到了 AI 智能体、智能体硬件和机器人系统。这是一套全栈治理和控制方案,官方新闻稿给出的定位是"开放"。

平台的核心组件之一是英伟达 OpenShell 安全软件。它要做的事很具体:对运行在 CPU 上的 AI 智能体设定边界。开源模型和闭源模型都在支持范围内,OpenShell 本身也是开源软件,可支持第三方平台,包括 Arm 和英特尔产品。

打开网易新闻 查看精彩图片

毫秒级隔离是怎么做到的

英伟达同时推出了看门狗系统 NVIDIA Sentry,持续监控 AI 智能体的行为。如果智能体试图突破软件枷锁,Sentry 可在毫秒时间内将其隔离、停止运行。

这套监控跑在 BlueField-4 DPU 上,在芯片层面独立执行安全策略。它把威胁检测、基于硬件的智能体治理与执行、数据访问保护结合在一起,通过一个独立于智能体和攻击者的带外信任域实现实时响应。

性能与生态

OpenShell 在 Vera 平台上的性能占用非常低。OpenShell 与 Vera 结合后,可让 AI 智能体在尽快完成工作的同时保证安全——这是官方给出的组合逻辑。

生态侧已有动作。Anthropic、SpaceX 和 Scale AI 等公司已经与英伟达合作,将 OpenShell 用于其 AI 模型和智能体。