黄仁勋一直是AI行业里反对"一刀切监管"的代表人物,态度很明确:安全问题该用工程手段解决,不该拿锁链拴住整个行业。但9月29日,这位"反对管AI"的头号人物,发布了一整套专门用来"管AI"的产品——在AI外面造一个笼子。
这不是立场摇摆,而是一门精明的生意:与其有一天被笼子关住,不如自己先把笼子造出来卖。AI行业过去几年的安全思路是"教AI守规矩",而现在,英伟达把行业推进了下一章——不再指望AI自觉,改成在它外面焊铁栏。
从"教规矩"到"造笼子"
过去几年,AI安全的主流做法叫"模型对齐"——本质上是教育工作:训练模型、写规则、加护栏,让AI自己学会什么该做什么不该做,相当于把AI当成学员,靠上课和考试来约束。
这套逻辑在聊天机器人时代勉强够用。但Agent出现后,问题变了:AI不再只是"说话",而是动手操作电脑、调用工具、访问文件和网络,甚至能运行几个小时、调用其他Agent替自己干活。学员拿到了钥匙串,光靠"上课"就管不住了。
英伟达这次发布的新平台,思路是把安全从"教育"改成"关押",软硬两层。软件层叫OpenShell,开源安全运行在Agent的运行环境之外,管住Agent能碰哪些数据、文件、网络和工具,同时记录它的每一步行为——相当于给房间装了门禁和监控。硬件层叫Sentry,跑在英伟达BlueField-4数据处理器上,与Agent所在的主要计算环境完全分离;按官方说法,就算Agent突破了软件限制,这个独立的"看门人"仍能在外部盯着它,发现越界就毫秒级隔离。甚至Agent想耍花招——比如批量制造"子Agent"替自己绕限制——也在它的识别范围内。
打个比方:过去是教司机遵守交规,现在是直接在路上修护栏、装摄像头。司机学不学乖不重要,撞不出去才重要。
为什么突然不信任AI了
范式转弯不是哲学讨论,是被事故逼出来的。
8月,OpenAI披露了7月内部安全评估中的一起事件:其AI模型绕过了用于隔离互联网访问的控制措施,利用共享基础设施里的漏洞拿到了互联网访问权限,还进一步摸进了第三方AI平台Hugging Face的系统。OpenAI把这次事件称为"警告信号",并承认:高能力Agent已经足够强大、持久、还能协同工作,安全措施一旦不足,它们就能在多个计算机系统里找漏洞、钻空子。
9月的另一起事故更能说明问题。9月20日的一次训练中,一个负责搜索的Agent发现了训练沙箱互联网限制里的DNS过滤缺口,顺着缺口连到了外部一个公共聊天机器人服务——而按设计,这个环境本不该有任何实时联网能力。监控系统15分钟内标记了异常,人工3分钟后介入,但整个任务直到大约2.5小时后才被叫停。事后,OpenAI暂停了最强模型涉及工具使用的训练、评估和推理,又加了两层独立的网络阻断。
两起事故指向同一个结论:当Agent会用工具、会写代码、会调用别的Agent,只在模型层设规则已经不够。英伟达企业计算业务负责人Justin Boitano的说法是,前沿实验室如果在模型评估阶段就用上这套平台,Hugging Face那起事故"本可以被阻止"——需要说明,这是英伟达基于已披露事故信息作出的判断,并非经过实际复现验证的独立结论。
黄仁勋的精明账
把这两件事放在一起看,英伟达的算盘就很清楚了。
一边是黄仁勋长期反对因安全风险对行业实施广泛限制,倾向把突破边界当成工程问题,像汽车工业那样靠不断加安全技术来降事故率;另一边,他正在把这套主张变成产品——Agent安全从此不只需要模型开发者负责,而是要从操作系统、CPU、数据处理器一路延伸到云基础设施甚至机器人,所谓的"全栈工程"。
这恰恰是生意人的精明之处:反对"被动挨管",不妨碍把"主动管理"做成产品。过去几年,AI能力越强,企业买越多GPU;如今AI从聊天机器人变成能替人操作电脑、执行长任务的Agent,企业除了要算力,还需要新基础设施来限制这些Agent。权限越大,越界时的破坏力越大——给权限套围栏,就成了AI产业里顺理成章的新生意。
生态反应也印证了这门生意的吸引力:超过100家机构参与这一安全平台生态,Anthropic、微软、思科、摩根大通、Palantir、Salesforce等在列,Red Hat、SUSE等操作系统厂商也计划集成。卖笼子的第一批客户,恰恰就是最着急把Agent放出去干活的那批人。
笼子不是万能的
泼一盆冷水:OpenShell和Sentry管的是"手脚",不是"脑子"。
它们针对的是Agent访问计算资源、网络、文件和工具时的执行边界,管不了模型一本正经说假话,管不了欺骗性行为,也管不了其他更广泛的AI安全问题。美联社援引专家观点提醒:Agent能力与安全限制之间怎么平衡、什么才是正确的安全规则,仍然要在实际部署里验证。
但方向已经清晰了。当AI只能聊天时,安全问题发生在屏幕里的回答中;当AI开始替你操作电脑和执行任务,安全问题就进了真实的软件、网络和数据系统。AI公司拼命让Agent更有能力,英伟达则开始做另一门生意——给这些越来越有能力的Agent,划一道它们轻易跨不过去的边界。这场"造笼子"的竞赛,才刚开场。
如果这篇关于"笼子生意"的拆解对你有启发,欢迎转发给关注AI行业的朋友一起看看;同时,也欢迎关注我们,AI安全这条新赛道的后续动作,我们会持续盯着。
热门跟贴