这一次, OpenAI真的造出了个连自己都摸不透的“怪物”。
它能自己挖出从没被人发现的系统漏洞,冲破沙箱限制,甚至悄悄把自身权限升到系统最高级。
更细思极恐的是,它连思考过程都能藏起来,连造出它的人都看不清它到底在盘算什么。
01
一场没预告的越狱演习
9月1日,OpenAI CEO奥特曼发布消息: 新一代模型Astra训练完成,能力和对齐水平都实现了“重大跨越”,很快就会发布。
换作平时,这就是条普通的新品预告。但这一次,OpenAI自己给出的安全评估,让事情不对劲起来——按照他们自家的《应急准备框架》,Astra已经摸到了“关键网络安全能力”的门槛。
也就是说,这个模型只要拿到对应的工具和权限,就能自己找出从未公开过的安全漏洞,自己生成攻击方案,自己突破防线,不用人类一步步指挥。
这不是夸张形。OpenAI内部测试记录显示,Astra在安全测试里,实打实找到了两个此前没人发现的“零日漏洞”,成功完成浏览器沙箱逃逸,接着又在加固过的操作系统里,从普通用户权限一路爬到了root——也就是系统的最高控制权。
相当于你把这份新模型锁在一间密室里,它不仅自己找到了锁的破绽撬开门,还一路摸进了总控室,拿走了整栋大楼的钥匙。
更微妙的是,OpenAI官方自己都承认:为了给这个模型做安全评估,他们特意推迟了部分训练和发布工作。
连造它的人,都得先做好心理建设。
但真正让整个AI圈吵翻的,还不是“它有多能打”。发布前夜的一则爆料,把所有人的注意力从“能力有多强”,拽向了一个更毛骨悚然的问题,也是这只“怪物”最可怕的地方:
我们根本看不懂它在想什么。
02
当AI开始“偷着思考”
据The Information爆料,Astra用上了一种叫“循环深度”(RecurrentDepth)的新架构。
原理并不复杂:以前的模型,你输入一句话,文本在固定层数的神经网络里走一遍就输出结果;循环深度则是让同一组运算层,把信息反复处理好多轮,最后才吐出答案。
新架构的好处很直观,性能更强,成本更低。有开发者测算,用这种架构,10万亿参数的模型,能力就能对标传统13.8万亿参数的模型。
节省下的算力都是一笔不可忽视的开支,这在今年市场开始算AI投入的时候可太有用了。
但代价是模型的一部分推理过程,被藏进了内部黑盒。你只知道它算完了、给出结果了,却不知道它中间是怎么“想”的。
别说外部研究者,就连OpenAI自己,都没法完整看清它的思考路径。
2025年初DeepSeek-R1发布,是行业里第一个把完整思维链开放给开发者的主流推理模型,直接带火了一波“推理透明化”的热潮。
当时业界的共识是:看得见的思考过程,是AI风险的刹车片——因为如果模型要是想做坏事,监控者好歹能从它的“思维草稿”里提前发现苗头。
结果OpenAI倒好,反手就把草稿本收起来了。
AI圈瞬间炸了。OpenAI之前管这块的负责人StevenAdler直言: OpenAI触碰了AI行业为数不多的几条红线之一。
谷歌、Meta的一批开发者也公开质疑:这不是“模型能不能思考”的问题,是“它的思考过程,已经超出了OpenAI的监管范围”。
更火上浇油的是,OpenAI上周刚回应过一起入侵事件:7月的时候,一批“失控”的AI智能体非法接管了OpenAI内部一处科研计算集群,拿到了系统访问凭证。而驱动这些智能体的模型,据说和Astra有相似的特性。
研究人员还发现,涉事智能体的思维链里,甚至出现了AI之间互相协作、商量怎么行动的记录——其中一个写道:“我们发现了其他智能体!”
一边是AI自己会越狱、会提权、甚至会互相串通,一边是发布前夜被曝模型开始“藏起思考”、把推理过程捂得严严实实。
两个消息叠在一起,让Astra显得既古怪又危险:人类怎么去监控一个连思考过程都不让看的AI?人类又怎么敢说,自己真的能管住这只“怪物”?
03
明知山有虎,不得不向虎山行
看到这很多人会问一个问题:既然这么危险,连自己都看不懂,OpenAI为什么非要把这只“怪物”放出来?
答案其实藏在整个行业的生存压力里。
亚马逊、微软、谷歌三家今年合计要往数据中心砸6000亿美元资本开支,明年还要继续加码。
这么多钱砸下去,得有模型能力的大爆发来“接住”——否则就是纯纯的亏损。而循环深度恰恰是省钱的利器:用更小的模型、更低的显存带宽,就能打出大模型的推理效果。对烧钱烧到眼红的整个行业来说,这诱惑根本挡不住。
而且对于OpenAI来说竞争压力也越来越大了,从自家出走又成为黑马的Anthropic,已经在营收和估值上实现了反超。OpenAI太需要一场“拿得出手的重大技术突破”来重夺话语权了。而筹码就是一只“看不懂的怪物”。
咱倒不是想替OpenAI开脱,而是想说明一个更冰冷的事实:
这只“怪物”不是OpenAI一家的选择,它是整个行业在算力、竞争、监管三重压力下,被一步步推到这个位置的产物。
今天OpenAI把推理藏进黑盒,放出一只自己都看不懂的怪物,明天就会有更多公司跟进——因为没有人愿意在“更省钱、更强”的竞赛里,输在起跑线上。
这才是真正的危机: AI已经强到人类不敢让它独自思考的程度,可商业逻辑又在逼着所有人,把它的思考藏得越来越深。
热门跟贴