同一个Claude,有人问一句秒回,有人等半天还烧掉一堆token。差别不在模型,在一个大多数人从没动过的旋钮:effort

它决定模型在开口前"想"多久。选低了,难题得到浅答案;选高了,琐碎任务白白烧钱。这篇文章把各个档位拆开讲清楚。

打开网易新闻 查看精彩图片

effort到底是什么

effort控制Claude在解决问题时愿意花多少token。说白了,就是它开口前推理得多深。

低effort是快速省钱的回答。高effort会生成内部推理链,从多个角度分析问题,验证自己的结论,发现思路里出现矛盾就退回去换个方向重来。

最关键的一点:它和选模型不是一回事。你用的还是同一个模型,不是为了便宜降级到"更笨"的版本。你拿的是同样的智力,只是决定这次提问让它投入多少力气。

它管的不只是"思考"

有个细节值得注意:effort影响的不只是隐藏的思考过程。

原文列出的档位包括low、medium、high、xhigh、max,以及ultracode。每一档都有它赢的场景,也有更高effort反而帮倒忙的时候。

怎么设

effort可以在API里设置,也可以在Claude Code里设置,原文给出了现成的代码示例

另外还有一个常见混淆点:effort和那句"魔法咒语"ultrathink不是一回事。原文专门把这两者的区别拎出来讲。

大多数人从不碰这个旋钮,结果就是在简单任务上烧token,在困难任务上拿到浅回答——因为他们不知道自己可以调它。