这两天高强度使用 GPT-6 Astra,好用是真的好用,问题也很明显。我让它做复杂任务和项目时,200 美元订阅套餐的额度肉眼可见地往下掉。虽然送了几张重置卡,还是感觉越来越不够用。

于是我最近最急的事,就是重构任务编排和模型调度,降低额度消耗。

最重要的思路,就是复杂任务交给 GPT-6 Astra,简单任务自动用 GPT-5.6 执行。在验收标准不变的前提下,把昂贵模型的消耗降下来。

但是很多人分不清简单任务和复杂任务,所以一股脑就用最强的 GPT-6 Astra。你要是额度无限,那当我没说,但大部分人用的都是 Codex 订阅套餐,所以我索性就写篇文章提供一些思路。

1.我在做这件事的时候,突然发现 GitHub 发布了 HydraFusion。

HydraFusion 是一个运行时多模型编排系统。它会根据任务选择单模型直出,轻量模型起草后按质量门升级,或者让不同模型起草,审查和修改。目前只能在 GitHub Copilot CLI 的实验模式里使用。

它优化的是达到质量门槛所需的综合成本,不保证每次都使用更少的 token,因为多模型协作也有消耗。我把它的基础思路拆开了。

2.先说推理模式。GPT-6 Astra 整体能力比 GPT-5.6 强,但是同一个模型也能选择不同的推理档位。你可以类比成下棋时想一步还是十步,推理级别越高,速度越慢,通常消耗的 token 也越多。很多小活不需要想那么全面,直接干就好了。

而且推理模式过高,很容易过度设计,明明你就是要的一个马桶,结果最后给你搞个厕所出来。

绝大部分需求先用 medium,复杂任务再升到 high。xhigh 和 max 留给前期架构设计,任务编排,疑难功能和 bug,代码审查以及跨模块重构。

3.什么是简单任务和复杂任务?

你可以理解为盖楼之前,需要顶尖工程师先做整体设计,搭好骨架,这属于复杂任务。上水泥,垒砖头,打孔,上脚手架,就是执行层任务,用 GPT-5.6 就可以搞定。

比如搜索文件,提取资料,整理日志,改格式,局部换变量名,执行测试,这些确定性任务都可以交给轻量模型。边界清楚,结果容易检查,做错了也容易恢复,用 Astra 模型纯属浪费。

4.修普通 bug,实现边界清楚的功能,做局部重构,这些任务可以交给主力模型的 medium 档位。但是这个 bug 如果关联到复杂的业务逻辑,或者两轮都没搞定,这时候再升级模型和推理档位。

5.架构设计,跨模块重构,安全,权限,支付和数据问题,就该让最强旗舰模型配高推理档位上场。这相当于盖大楼时总工程师干的活,前面判断错了,后面返工可能要全部推翻,所以前期设计和搭骨架,我都必须用最强模型。

6.轻量模型先修改,机器自动跑测试,lint,类型检查和构建。通过预先写好的验收项再交付,失败就把任务升级给强推理模型。强模型从全程打工,变成专门处理异常。

7.跨会话的时候别把几十轮聊天记录全塞过去。下一个模型真正需要的只有原始目标,改动文件,当前 diff,失败日志和未解决问题。可以让强模型写一份交接文档,材料越清楚,花在重新加载上的 token 越少。

8.测试全绿也不放心的任务,可以让模型 A 写,模型 B 只读审查,再让模型 A 定向修改。审查模型只说问题位置,依据和验证方法,别让它重新写一遍,也别让两个模型互审到天荒地老。

9.这套方法能不能守住质量,关键不在于你有多信任小模型,在于有没有验收门槛。测试,构建,类型检查,截图对比都可以自动跑。模型说「已经修复」不算,验证结果才算。

10.如果你暂时分不清任务边界,可以直接把 GPT-5.6 Sol 设置为常规模型。GPT-6 Astra 是新的大哥,GPT-5.6 Sol 退居二哥,复杂任务交给大哥,其他任务交给二哥。二哥本身也够强了。

11.多个 Session 不天然省钱。如果每个任务固定叫三个模型,几个模型重复读取整个项目,审查一次又重写一次,token 只会烧得更快。简单任务不编排,失败升级有条件,高风险任务保留独立验收,这三条够用了。

12.用 Goal 模式之前,让 GPT-6 Astra 写一份施工清单,把技术栈,实现方向和注意事项交代清楚,再让 GPT-5.6 逐步执行。长任务用这套方法更自动,也能减少反复理解需求的消耗。我已经把规则加到了 AGENTS.md,只要说一句「用 Goal 模式去做」,它就会先设计施工清单并存档,再让 GPT-5.6 子 Agent 执行,实测干得很好。

13.别凭感觉判断这套方法有没有省钱。至少记录每次使用的模型,推理档位,重试次数,验收结果和总消耗。否则你只知道额度少了,不知道钱到底烧在哪里。

以上就是我最近实测的一些使用心得,说实话,随着最强模型 token 用量越来越大,逼得大家不得不重视 token 消耗,但是我们肯定都不想让质量下降,所以以上思路给大家一些参考,希望对诸位有点价值。

另,之前很多球友刚开始学 AI,就把我的 AGENTS.md 拿去用了,普遍反馈贼好用,AI 做项目时编排更合理,也很少跑偏。这次 GPT-6 Astra 还要做不少调整,我会把优化后的最新版共享到星球。不过还要拿实际项目验证,所以大家再等一等。

想加入星球跟我们一群技术人学 AI 的,之前优惠没了,需要优惠券的,私信回复「星球」即可,不感兴趣忽略就好。

来源 | stormzhang(ID:googdev)

作者 | stormzhang; 编辑 | 虾饺

内容仅代表作者独立观点,不代表早读课立场