9月29日消息,Anthropic发布Claude Sonnet 5.5。新模型的API价格与上一版相同,每百万输入token收费2美元、输出10美元;公司称它生成答案的速度提高30%以上,完成同类任务所需token更少,在内部测试中单项任务成本最多降低30%。

打开网易新闻 查看精彩图片

据Anthropic介绍,新模型更常把多次工具调用合并到同一步,减少执行步骤。完成同类任务时,它通常也消耗更少的token,实际费用因而有望降低。

Sonnet 5.5主要面向日常编程和知识工作,可以改代码、修Bug,也能做文档、幻灯片和表格。按照Anthropic的产品定位,开发者可以把要求明确的任务交给Sonnet;需要持续判断的复杂、开放式任务,则更适合一周前发布的Opus 5.5。

在取材于Cursor真实会话、要求跨文件修改代码的CursorBench 4.0中,Sonnet 5.5在最高推理强度(Max)下得分55.5%,上一版为34.1%,Opus 5.5为57.8%。Sonnet在这项测试中的最好成绩,已接近Opus。

打开网易新闻 查看精彩图片

Anthropic公布的客户反馈中,Slack称,在没有修改提示词的离线测试中,新模型完成任务所用步骤更少,输出token约减少14%。Zendesk则用数百个真实客服案例测试,称处理工单的速度比它现用的Claude模型快了20%。

Sonnet 5.5现已进入Claude应用、Claude Code及API,也通过主要云平台提供。Anthropic还计划在未来几周推出面向高调用量任务的Haiku 5.5。Claude Code和应用默认使用中等推理强度(Medium),开发平台默认为高档(High)。提高推理强度后,模型会花更多时间思考和检查结果,token用量也会增加。