当地时间9月17日,Anthropic对外披露一组内部数据,首次量化呈现AI参与自身研发的程度。截至今年8月,Claude在公司AI研发活动中占据主导地位的比例达26%,而今年2月这一数值尚不足1%。

这里的“主导”指的是Claude能够在人类监督之下,独立完成一项任务绝大部分环节。这种能力成为Anthropic衡量研发自动化水平的核心尺度。

Anthropic为量度这一进程构建了名为“研发自动化指数”的原型指标,并将衡量体系与AI系统自主构建继任者(RSI)联系在一起,其技术标准采用独立AI研究机构Epoch AI提出的六级自动化框架。

在这一框架中,AL0对应完全无AI参与,AL3为AI协作,AL4为AI主导,AL5代表完全自主。截至8月,26%的研发工作达到AL4,超过90%至少处于AL3,没有任何被测量的研发工作达到AL5完全自主水平。

Anthropic同时公布了衡量前沿AI实验室研发速度的三项指标:AI自身承担研发任务的比例、AI智能体行动受监督的程度,以及算力在AI研发中的分配方式。

截至8月,约3万个AI智能体在内部主要研发平台上同时运行,具备独立身份标识,可相互委派任务并交叉纠错。这些智能体当月产生超10亿次决策,全部动作执行前须经在线检查,约0.002%被阻止;离线监控每周标记约10万条对话,约50条升级人工审查。

市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。

本文源自:市场资讯

作者:闻野