Anthropic刚刚发布了Claude Fable 5.1与Mythos 5.1。这两个版本共用同一个模型底座,区别只在安全限制的层级。相比上一代Fable 5,新模型在多个Benchmark上都有提升,但最值得关注的不是跑分,而是它在长程Agent任务里的表现——以及那个直接砍掉75%的Cache Read价格。

长程Agent是这次更新的核心方向

打开网易新闻 查看精彩图片

Fable 5上线后,企业端使用量只占6%,这个数字不算好看。5.1的改进重点很明确:让模型能持续运行更长时间而不掉线。实测案例包括Millennium用它定位罕见程序崩溃、Ramp连续自主运行38小时执行ML任务、MongoDB工程师数小时完成复杂原型设计。这些场景的共同点是:上下文保持和任务连续性,比单次回答质量更重要。

传统对话模型一次请求就结束,但Agent会持续读取历史上下文和工具结果,运行越久,重复读取产生的成本越显著。Cache Read降价75%,整体成本预期下降约25%,重度Agent场景最高可降45%。这个价格调整直接改变了企业选型时的计算方式。

科研版本走分层授权路线

Mythos 5.1面向科研和高权限场景,在网络安全和生命科学领域的权限更宽松,但Anthropic没有直接开放,而是通过可信访问计划提供给审核机构。它在蛋白质设计、计算生物学等方向表现更强,Cyphral Distich密码问题在不到一天内被解出。

安全机制的误判率也在下降:网络安全干预减少约60%,生命科学误触发减少约85%。同时仍保留对渗透测试、Exploit生成等高风险操作的限制。这个调整的方向是让专业开发者更顺畅地做防御性分析和生物研究,同时守住前沿安全底线。

反蒸馏限制加码

Anthropic这次强化了反蒸馏机制,并新增不可见数字水印。9月2日之后注册的新API账户,无法在多轮对话中修改历史上下文,这直接切断了工业级蒸馏攻击的路径。数据安全方面新增Enterprise Frontier Safeguards(EFS)计划,允许企业零数据留存使用。

这些动作背后有一个结构性压力,文章里叫「领先者的诅咒」:领先者为了守住第一,要投入更多算力、承担更高训练成本;后来者不需要真正超过你,只要足够接近,再把价格压到你的十分之一,就能构成实质性威胁。GPT-5.6 Sol就是例子,用六分之一的价格完成了相近任务,虽然细节更少。

价格与能力的平衡点

Fable 5.1在Low或Medium Effort模式下,已经能以更低成本达到接近甚至超过Fable 5的效果。基础输入输出定价不变,但Cache Read降价后,重度Agent场景的总成本下降最高可达45%。这不是简单的促销,而是针对Agent工作负载的本质成本结构做的调整。

Anthropic在性能之外同步优化价格和数据留存策略,试图构建系统级护城河。从这次更新的组合拳来看,旗舰模型的竞争已经从单点跑分转向了「能力+成本+安全」的综合较量。