Anthropic把自家研发流水线的底牌掀开了。3万个AI智能体,24小时不睡觉,正在参与研发下一代自己。这是这家公司第一次公开内部最核心的三大AI研发指标。

报告里有一句话被反复引用:为了打破前沿实验室与公众之间的黑箱,Anthropic向全行业喊话——我们的底牌亮出来了,把你们的数据也交出来。

打开网易新闻 查看精彩图片

Claude已主导26%核心研发

AGI何时到来,业界一直争论不休。Anthropic给出的第一项指标,是AI能否自主研发出比自己更聪明的下一代AI。

他们参照Epoch AI的六级自动化标准,从完全人工的AL0到AI完全自主闭环的AL5,给内部研发流水线做了一次基因测序。为了拿到真实数据,Anthropic在2026年7月随机抽取模型研发部门20%的员工,让一个Claude研究智能体去翻阅这些员工的Slack聊天记录和内部文档。

Claude最终梳理出多达15000项模型研发任务,归纳为542个任务节点。截至2026年8月,Claude还没有在任何单一研发子任务上实现完全脱离人类的L5级全自动闭环,但渗透率已经很高:

  • Claude已能自主主导高达26%的Anthropic核心研发工作,人类工程师只需给出一个宏观的Prompt,剩下的端到端工作由AI完成。
  • 达到或超过人机深度协同的研发工作占比,突破了90%

也就是说,Anthropic内部超过九成的核心模型研发流程,已经离不开AI。人类工程师正在变成产品经理,真正干活的超级打工人是Claude自己。当26%变成50%,再变成100%,机器迭代机器的速度将呈指数级爆发。

3万个智能体,双层监控防越界

第二个数据更惊人。随着研发自动化程度激增,Anthropic内部的Agent规模正在指数级膨胀。报告披露,目前在Anthropic最常用的内部平台上,日常并发运行着约30000个研发智能体。它们不睡觉,不拿工资,全天候写代码,相互派任务。

3万个高智商AI从事半自主长周期工作,怎么保证它们不造反?Anthropic祭出了双层监控系统。

第一层是实时在线拦截。这3万个Agent敲下的每一行代码,在执行前几秒都会经过实时监控扫描。8月,Anthropic追踪了超过10亿次智能体决策数据,监控系统发出了0.002%的阻断警报,大约每4.7万次操作中就有1次被强制叫停。一个月里,有高达2万次的越界操作被强行暂停。

第二层是离线监控与人类专家终审。系统每周纳入100%的智能体行为记录,通过多层分类和筛查,挑出约10万份可疑的对话日志,最终把最高优先级的50起异常事件交给人类专家审核。

此外,Anthropic在系统底层做了两个架构设计。一是独立身份:打破所有AI都叫Claude的设定,每个Agent被赋予独立的身份标签和记忆记录,这个身份不绑定底层模型版本,方便事后追责,也让AI把其他Agent给出的数据视为需要验证的声明。二是透明广播机制,取消私聊:所有Agent都在一个公共的、可追溯的消息总线上沟通,Agent之间甚至能纠错。

算力账本:安全研究只占6%

第三项指标是算力分配。Anthropic调取了2026年7月13日至7月20日这一周的算力快照,用Claude对近1万次运行记录进行抽样分类,对核心大额算力任务加权计算。

结果很直接:在整体的AI核心研发算力中,只有约6%被严格划拨给安全研究领域,比如对齐研究、可解释性研究、安全红蓝对抗。在由AI主导的研发算力中,这个比例稍高,也只有约12%

Anthropic解释,安全研究和能力训练的底层逻辑完全不同。训练一个前沿大模型动辄需要成千上万张H100/B200,是吞噬算力的无底洞;而安全研究本质上是人类研究员精心设计实验,去解剖模型大脑里的回路,耗费的是高端人类脑力,而不是算力。

Anthropic还表示这是一个极度保守的估计。为了挤出水分,只要某个算力任务既有助于安全又有助于能力提升,就一律不算作安全算力。这6%也不包括用于日常审查过滤有害信息的分类器算力。

公开这个看似难看的数据,Anthropic有自己的盘算。他们认为算力是AI研发过程中最容易被量化和核实的数据。只要建立起这个标准,未来全行业甚至国家层面的监管机构,就可以要求所有大厂公开安全算力占比。现在基线已经摆在这里,如果有些公司安全算力连2%都不到,那就是在拿人类的未来飙车。

一份报告,也是一封挑战书

表面上这是一份内部审计报告,实际上是对整个前沿AI实验室发出的公开挑战书。Anthropic在结论中写道:当世界正在考虑如何控制前沿AI的发展速度时,我们必须尽一切可能,缩小前沿实验室所知与公众所知之间的信息差。任何前沿开发者都可以发布同样的衡量标准,并由第三方进行验证。

过去大家都在黑箱里搞研发,你发一个GPT-5,我发一个Claude-4,公众只能看到跑分,不知道模型内部到底如何。现在Anthropic主动把黑箱炸开了一个洞,不仅引入第三方评估机构如METR,还把是否公开三大指标变成了一块试金石。

如果OpenAI、Google DeepMind等其他AI巨头跟进,整个AI行业的透明度都将提升。如果不跟进,那可能意味着在隐瞒什么。正如Anthropic所言,他们公开这些,是为了给全社会一个决定如何使用这些信息的机会。

RSI已来,AI自我进化的飞轮在转动,3万个昼夜不息的AI打工人,正在进化成一个新物种。