在Claude Code中启动一个子代理看似不花成本,实则不然。我们在一个真实审查流水线上进行了测量,发现一个几乎无人提及的关键数字:每个子代理在开始任何有效工作之前,大约要消耗43.6万令牌的固定开销。

本文会解释这个数字从何而来、如何在你自己的环境中复现测量,以及它如何改变你对代理间任务拆分的思路。

我们的实验:每周对一个数字产品目录(以Markdown为主的仓库:规则文件、技能、模板)运行审查流水线。流水线将每个产品的完整内容嵌入审查提示,并请求结构化发现。我们用同一产品、同一完整内容,运行两种方式:A组使用三个子代理,每个负责一个审查视角(买家价值、利基准确性、合规性),提示总大小约31.4万字符;B组使用一个子代理按顺序覆盖全部三个视角,提示总大小约10.5万字符。

从会话记录中统计的实际计费令牌数:B组成本仅为A组的37.6%。朴素的预期——“三个代理读取相同内容,所以成本约3倍”——大致成立,但原因不在内容本身。

逐轮分解会话记录后,每个代理携带约43.6万令牌与审查本身无关的开销:启动时的初始上下文加载,加上最后一轮的缓存写入。而我们原本以为占成本主导的嵌入产品内容,每个代理仅约4.6万令牌。这样固定开销与有效载荷的比例为9.5:1。

这直接引出两个结论:第一,嵌入完整内容其实很便宜。我们过去为省令牌而截断嵌入文件,结果反而悄悄把承载产品实际价值的文件排除在审查之外。全量嵌入的成本相对于每个代理已有的开销几乎可以忽略。第二,代理数量才是成本杠杆,而非你交给它多少内容。三个代理只读取了之前三分之一的文本,却仍然花费了将近2.7倍的总成本。