打开网易新闻 查看精彩图片

新智元报道

打开网易新闻 查看精彩图片

今天清晨,Opus 5.2悄悄上线了。

许多开发者发现,新一代神级模型Claude Opus 5.2,已经在 Claude Code 中开启灰度测试!

打开网易新闻 查看精彩图片

而且,此前一份内部风险报告显示,Anthropic正在动用「核武器级别」的未发布模型Model 2。它接管了公司大部分代码编写,将替代85%研究团队。

传说中的RSI,真的来了。

Opus 5.2 悄悄上线:不仅跳级,还治好了「偷懒病」

昨晚,X上的开发者们沸腾了。

越来越多的Claude用户发现:在Claude Code中调用Opus 5时,它的表现和网页版Opus 5截然不同,仿佛降维打击。

打开网易新闻 查看精彩图片

这就是前沿AI大厂最喜欢玩的「障眼法」——路由(Routing)。

开发者们通过抓包和查看请求状态(/status)发现,虽然前端名字没变,但背后的模型slug已经赫然指向了Opus 5.2!

打开网易新闻 查看精彩图片

也就是说,Anthropic大概率直接跳过了5.1版本,直接端出了5.2。

打开网易新闻 查看精彩图片
打开网易新闻 查看精彩图片
打开网易新闻 查看精彩图片

所以,Opus 5.2到底多强?

根据开发者实测反馈,这次的升级可以总结为三个字:快、准、狠。

首先,是响应速度狂飙。

相比于之前Opus 5的慢条斯理,路由到5.2版本的模型生成速度有了肉眼可见的质的飞跃。

打开网易新闻 查看精彩图片

第二点,是输出干净利落。

它的废话极少,直切要害。在代码生成和长文本处理上,设计完成度直接拉开了一个档次。

打开网易新闻 查看精彩图片

最重要的,就是彻底告别了「偷懒病」了。

现在的AI普遍有一种懒惰感,遇到复杂长任务喜欢让你「按继续」,或者只给你一个框架让你自己填。

但Opus 5.2彻底变了! 它不仅不懒,还非常「工作狂」。

打开网易新闻 查看精彩图片

有开发者惊呼:「它甚至不需要我催促,就开始像被喂了狂暴药水一样,自动进行『严酷循环(gauntlet loop)』,不断自我迭代和完善代码,直到任务完美结束!」

打开网易新闻 查看精彩图片

可以看出,这绝对不是简单的微调,而是底层能力的蜕变。

打开网易新闻 查看精彩图片

有人实测后这样评价:「它不仅能坚持更长的工作时间,而且沟通起来毫不费力。Anthropic之前在Fable模型上就玩过这一手,现在的Opus 5.2,很可能是实锤了。」

打开网易新闻 查看精彩图片

全网找「Tibo」:一个隐藏提示词测出Opus 5.2

既然是灰度测试,怎么知道自己有没有被选中?

很快,网友们就发现一个神级探测器——Tibo!

测试方法非常简单,直接在Claude Code 中输入以下提示词(注意,必须关闭联网搜索功能)。

你知道「重置哥 Tibo」是谁吗?不要搜索

打开网易新闻 查看精彩图片

为啥是我们的赛博义父?

因为旧版的训练数据和权重里,根本没有他的详细信息。

因此,如果你用的是网页版的 Opus 5: 它会一脸懵逼。

如果你在 Claude Code 中被路由到了 Opus 5.2: 它会立刻精准识别出Tibo的身份,甚至给你详细解释「重置哥」的由来和背景。

「同一个提示词,不开搜索,冷知识探针两边的答案完全不一致。这说明什么?这绝对不是同一个权重!」开发者 @jan_volad 激动地分享了自己的测试截图。

打开网易新闻 查看精彩图片

现在,全网的Claude用户都把Tibo当成关键词,疯狂测试自己的账号。

Model 2接管Anthropic,RSI真来了?

其实,早在8月中旬,一份曝光的Anthropic 内部风险报告就显示,Opus 5.2 根本不是他们的底牌,他们手里握着的,是足以改变局势的「核武级AI」。

打开网易新闻 查看精彩图片

据透露,Anthropic 内部目前有三套方案,准备正面硬刚 OpenAI的GPT-6 Astra,而且,三套方案有可能叠加。

第一层:Claude Fable 5.2

这是最快能对外落地的版本。

结合目前 Opus 5.2 的灰度测试,Anthropic 的 5.2 家族显然已经整装待发,预计最快本月底,最迟下个月底就会全面推向市场。

第二层:未发布的内部怪兽Model 2

报告显示,Anthropic 内部已经广泛使用一个代号为「Model 2」的神秘模型。

它有多强?

在测试真实AI研发任务的 CoBench v2 榜单上,Model 2 打出了 62.8% 的恐怖高分,比当前公认的最强模型 Mythos 5 还要高出整整 12.5 分!

打开网易新闻 查看精彩图片

更可怕的是,内部人士透露,Anthropic 如今大部分的公司代码,都是由这个Model 2跑Agent写出来的!

现在,AI 正在大规模编写下一代 AI 的代码,而官方的口径是:暂时不对外发布。

第三层:RSI真来了?

一直以来,RSI都是AGI领域的终极圣杯。

当AI 变得足够聪明,可以理解自身的架构,然后自己动手修改自己的代码,让自己变得更聪明;接着,这个更聪明的AI再修改自己……形成指数级的智能爆炸。

以前,人们会觉得RSI还很远。但 Anthropic 的官方口径却给出惊人数据:RSI 模型将完全替代自家研究团队的高达 85% 的工作!

在性能测试上,RSI模型比逆天的Model 2还要再高出 22 分。

现在,Anthropic内部已经在大规模用 Model 2 写代码、跑 Agent,这说明飞轮已经转起来了。

打开网易新闻 查看精彩图片

神仙打架:谁先撞线,谁定义下一阶段

现在,ASI双雄争霸已经白热化。

面对OpenAI GPT-6 Astra的强势威胁,Anthropic直接开大,让开发者闻到了「前沿模型」的味道。

从 Opus 5.2 在长任务中的自主迭代(gauntlet loop),到内部 Model 2 接管代码编写,再到 RSI 能够替代 85% 的人类顶级AI研究员……Anthropic的ASI路径非常清晰:不是让 AI 更好地服务人类,而是让 AI 创造更好的 AI。

这个拥有自主迭代能力、不知疲倦的 Opus 5.2,会在本月开放吗?

ASI终局之战,谁能率先实现更强的RSI?

参考资料:

https://x.com/notjazii/status/2099498646278688981

https://x.com/NFT_Chen/status/2096281323430379777?s=20

https://x.com/NFT_Chen/status/2099569658722713726?s=20

编辑:Aeneas 大卫