Perplexity 的 CEO Aravind Srinivas 在 X 上发了一条推文,把安全这件事重新定义了一遍。他说,安全是一个工程问题。这句话背后,是 Perplexity 与 NVIDIA 的一项新合作——双方将共同构建安全、可靠的智能体沙箱,并配上恰当的护栏机制。
更关键的是后半句:他们打算把这一切全部开源。Srinivas 的原话是,他们有意将所有这些开源,更多细节很快就会公布。没有藏着掖着,也没有先商业化再考虑开放,而是从一开始就把开源写进了计划里。
安全为什么被叫做工程问题
把安全称作工程问题,意味着它不是一个靠喊口号或者事后补救就能解决的议题。工程问题有明确的输入、输出、边界条件和可验证的标准。智能体沙箱要做的,就是给 AI 智能体划出一个可控的运行范围,让它在里面执行任务,同时用护栏限制它不能越界。
这个思路和传统的安全策略不太一样。传统做法往往是先让系统跑起来,出了问题再打补丁。而沙箱加护栏的组合,是在智能体行动之前就把规则定好,把风险关在笼子里。Srinivas 没有展开沙箱的具体技术细节,但他把这件事定性为工程问题,说明 Perplexity 和 NVIDIA 打算用可落地、可复现的方式来做,而不是停留在原则层面。
英伟达这边的动作
NVIDIA 在同一天宣布,联合超过 100 家行业合作伙伴,推出了 NVIDIA Open Agent Safety Platform,这个平台把 OpenShell 和 Sentry 整合在一起。Srinivas 的推文与这一发布形成了呼应——Perplexity 是这个生态里的参与者之一,而双方合作的具体产出就是智能体沙箱和护栏。
超过 100 家合作伙伴的规模,说明智能体安全已经不是一个公司单独能解决的问题。NVIDIA 搭平台,Perplexity 贡献沙箱和护栏的构建经验,双方各自拿出擅长的部分。Srinivas 强调的开源,则让这套方案有可能被更多开发者和公司直接使用,而不是锁在某一家公司的产品里。
开源意味着什么
如果 Perplexity 和 NVIDIA 真的把智能体沙箱和护栏全部开源,那么任何构建智能体应用的团队都可以基于这套方案来搭建自己的安全边界。这降低的不只是技术门槛,还有信任门槛——代码公开可查,护栏怎么设计的、沙箱怎么隔离的,都能被审视。
Srinivas 说“更多细节很快就会公布”,目前能确定的是合作方向、开源意图,以及 NVIDIA 那边超过 100 家合作伙伴的平台发布。至于沙箱具体怎么实现、护栏包含哪些规则、开源采用什么协议,这些还没有公开。但方向已经清楚:安全不是事后补丁,而是从沙箱和护栏开始的基础设施,并且这套基础设施准备对外开放。
热门跟贴