刚刚,Anthropic发布了Fable 5.1。

打开网易新闻 查看精彩图片

值得注意的一个细节是,随着新版本上线,Anthropic也对Claude API的一个关键机制进行了调整。

在最新文档描述中,Fable 5.1改变了Messages API处理思考块的方式。

对于新API账户,开发者不能再在多轮对话中随意编辑思考块周围的上下文,包括消息、工具和系统提示。

所谓“思考块”,是Claude在生成最终答案之前产生的推理步骤。

在API中,这些内容会以“思考块”的形式返回给用户。在多轮对话中,API用户通常会在下一轮请求中,将这些思考块与系统提示、工具以及此前的消息一起发送回来,让Claude获得完整的对话上下文

现在,Anthropic开始对这些内容进行一致性验证。

对于受到影响的Fable 5.1账户,如果此前思考块之前的系统提示、工具或者消息被修改,API将返回错误。API会验证思考块是否与产生它时所使用的相同系统提示、工具和消息一起被发送回来。

如果开发者确实需要修改此前的上下文,可以选择使用“非严格”模式。此时请求仍然可以继续,但受到影响的思考块会从模型看到的内容中删除。模型将在看不到这些此前思考内容的情况下继续响应,API返回结果也会告知开发者哪些思考块被删除。

Anthropic解释,这一改变主要针对AI蒸馏。

改变对话早期轮次,是非法蒸馏活动中常见的技术。其目的之一,是提取高级模型的能力,尤其是模型的思考过程,并将这些能力用于训练另一个未经授权的模型。

Anthropic称,这类蒸馏通常可以工业规模进行,使用数千个虚假账户。

打开网易新闻 查看精彩图片

此前,Anthropic已经对Claude的思考块进行加密,以防止这类行为。

但又发现,如果攻击者先修改思考块之前的对话内容,就可能让Claude重新解密并输出此前的推理

这样训练出来的系统,可以继承原本不具备的能力,同时却不一定继承原模型针对网络攻击、武器开发等广泛滥用风险建立的安全保障措施。

因此,这次API调整的目标,就是让这种蒸馏活动更加困难。

Anthropic表示,这项措施建立在现有反蒸馏措施之上,包括增强的蒸馏分类器,以及限制从更高级模型向具有较弱安全保障的低能力模型转移会话或推理。

不过,这一变化也可能影响正常的API集成。

Anthropic特别提到,一些会在对话进行到一半时重写早期轮次的集成可能需要调整,例如上下文压缩和注入系统提醒等场景。

Anthropic同时指出,保持思考块与原始上下文一致也有额外好处:API可以更频繁地重复利用缓存提示,从而降低成本和响应时间。

这项更新目前并不是对所有账户立即生效。

在Fable 5.1上,更新适用于2026年8月31日12:00:00 UTC之后创建的新API账户。

具体包括这一日期之后创建的新Claude Platform组织、Amazon Bedrock账户、Google Cloud Vertex AI项目以及Microsoft Azure Foundry项目。

Anthropic采取的是分阶段执行方式,从新账户开始,因为这些账户中观察到的蒸馏相关滥用浓度最高。

现有账户目前不会受到影响,这也给开发者留下时间,让测试框架和API集成适应新的处理方式。

但Anthropic已经明确表示,未来模型也将采用这一机制,并最终适用于所有用户。

需要注意的是,Claude Code、Claude Cowork、Claude.ai以及通过第三方产品使用Claude的用户不受此次变化影响;Fable 5.1之外的模型也不受影响。

从API层面看,这次变化并不是简单地禁止用户获取思考内容,而是改变了一个关键规则。

如果你想让模型继续看到此前的思考块,那么此前产生这些思考的系统提示、工具和消息上下文就必须保持一致。

Anthropic希望通过这一机制,堵住利用修改历史对话来获取和批量提取模型推理能力的路径。