同一个Claude,有人问一句秒回,有人等半天还烧掉一堆token。差别不在模型,在一个大多数人从没动过的旋钮:effort。
它决定模型在开口前"想"多久。选低了,难题得到浅答案;选高了,琐碎任务白白烧钱。这篇文章把各个档位拆开讲清楚。
打开网易新闻 查看精彩图片
effort到底是什么
effort控制Claude在解决问题时愿意花多少token。说白了,就是它开口前推理得多深。
低effort是快速省钱的回答。高effort会生成内部推理链,从多个角度分析问题,验证自己的结论,发现思路里出现矛盾就退回去换个方向重来。
最关键的一点:它和选模型不是一回事。你用的还是同一个模型,不是为了便宜降级到"更笨"的版本。你拿的是同样的智力,只是决定这次提问让它投入多少力气。
它管的不只是"思考"
有个细节值得注意:effort影响的不只是隐藏的思考过程。
原文列出的档位包括low、medium、high、xhigh、max,以及ultracode。每一档都有它赢的场景,也有更高effort反而帮倒忙的时候。
怎么设
effort可以在API里设置,也可以在Claude Code里设置,原文给出了现成的代码示例。
另外还有一个常见混淆点:effort和那句"魔法咒语"ultrathink不是一回事。原文专门把这两者的区别拎出来讲。
大多数人从不碰这个旋钮,结果就是在简单任务上烧token,在困难任务上拿到浅回答——因为他们不知道自己可以调它。
热门跟贴