Anthropic这次出手,直接冲着Agent(智能体)的命门去的——成本。
新发布的Fable 5.1和Mythos 5.1,把缓存读取价格从每百万Token 1美元降到了0.25美元,降幅75%。这个数字背后是一个明确信号:想让Agent真正跑起来,先得把重复读上下文的账单打下来。
长任务稳定性,才是这次的主角
Fable 5.1和Mythos 5.1基于同一个底层模型,区别在于安全限制策略。Fable面向大众,Mythos面向专业审核人士。但两者都重点解决了一个问题:长任务链条中的稳定性。
过去模型处理的是"一个问题对应一个答案",现在Fable 5.1面对的任务要复杂得多——从读取资料开始,经过代码分析、工具调用、实验验证,再回到前面的结果重新判断,最后形成可交付的成果。这种需要不断检查结果并调整路径的工作流,正是Agent类应用的核心场景。
在Terminal-Bench-Science等测试中,Fable 5.1得分大幅领先,能执行包含反汇编分析、长时间机器学习任务在内的复杂工作流。
科研场景的硬核成绩单
Mythos 5.1在专业科研领域的表现更值得关注。在蛋白质设计中,其生成的设计在12个目标上,接近50%最终被验证为有效结合剂——行业平均水平只有10%-15%。
在计算生物学方向,Mythos 5.1通过编写定制GPU内核,将部分模型推理速度提升了最高2.5倍。这些数字意味着,模型不再只是聊天工具,而是能直接参与高精尖科研的实用工具。
降价75%背后的商业逻辑
缓存读取价格从1美元降到0.25美元,表面看是让利,实际是在为Agent化任务的普及铺路。Agent运行时的典型特征是频繁读取上下文,这部分成本在总账单里占比极高。虽然输出Token增加可能抵消部分降幅,但对于高频读取场景,节省效果依然显著。
Anthropic还同步推出了Enterprise Frontier Safeguards(EFS),允许企业将数据保存在自有云基础设施中,增强数据主权。分级安全机制加上成本下调,这套组合拳的目标很明确:让企业敢用Agent,也用得起Agent。
两个版本,两种定位
Fable 5.1和Mythos 5.1的区分策略也值得玩味。同一个底层模型,通过不同的安全限制策略切分成两个产品线:一个面向大众市场,一个面向专业审核场景。这种"一鱼两吃"的做法,既覆盖了通用需求,又满足了高要求专业用户,还规避了安全合规风险。
从这次更新的节奏看,Anthropic对Agent赛道的押注相当坚决。模型能力提升是一方面,更关键的是把运行成本打下来——毕竟再强的模型,如果跑不起,也只能是实验室里的展品。
热门跟贴