8月22日,AI模型聚合与调用路由平台Vercel AI Gateway上开放权重模型的token份额升至 62%。两个月前,这一数字只有28.4%。同期,闭源模型的份额由71.6%降至38%。在这个覆盖数百种模型的生产平台上,开发者正在快速调整模型选择。虽然这组数字只代表Vercel AI Gateway,不能直接等同于整个AI市场。它仍然揭示了一个重要变化:企业不再把所有任务都交给最强、最贵的模型。 调用量和支出已经出现明显分化。2026年6月,开放权重模型承担了Vercel AI Gateway 29%的token,却只占不到4%的支出,平均token价格约为整个平台的十分之一。与此同时,Anthropic等前沿模型厂商仍掌握大部分收入。 智能体进一步放大了企业对低价token的需求。2026年4月,只有22.2%的请求包含工具调用,却消耗了58.9%的token。一次数据库查询、代码运行或工具调用,都会让模型多经历一轮输入和输出。模型之间看似不大的价格差,经过几十轮调用后,会直接变成一张明显不同的账单。 DeepSeek的增长为我们提供了一个具体样本。它在Vercel上的token份额从4月的不足1%,升至5月的17%,6月进一步达到22.6%。开发者愿意把高频任务交给它,说明低价模型已经越过了进入生产环境的质量门槛。 最贵的模型则开始遇到企业预算的上限。Ramp的数据显示,Fable 5只占Anthropic企业token使用量的6%,支出占比为11.4%。它的价格约为每百万token 10美元,但7月产生的模型归因支出只有GPT-5.6 Sol的75%。性能领先没有自动转化成调用量。 企业最终选择的通常也不是某一个模型。月请求量超过1000万的Vercel团队,平均同时使用35个模型:便宜模型处理分类、摘要和批量任务,前沿模型负责复杂推理与高风险决策。 开源模型正在获得token的多数,而闭源模型仍守着价值更高的部分。AI市场竞争的重点,正从“谁是最强模型”,转向“什么任务值得用什么价格的模型”。
8月22日,AI模型聚合与调用路由平台Vercel AI Gateway上开放权重模型的token份额升至 62%。两个月前,这一数字只有28.4%。同期,闭源模型的份额由71.6%降至38%。在这个覆盖数百种模型的生产平台上,开发者正在快速调整模型选择。虽然这组数字只代表Vercel AI Gateway,不能直接等同于整个AI市场。它仍然揭示了一个重要变化:企业不再把所有任务都交给最强、最贵的模型。 调用量和支出已经出现明显分化。2026年6月,开放权重模型承担了Vercel AI Gateway 29%的token,却只占不到4%的支出,平均token价格约为整个平台的十分之一。与此同时,Anthropic等前沿模型厂商仍掌握大部分收入。 智能体进一步放大了企业对低价token的需求。2026年4月,只有22.2%的请求包含工具调用,却消耗了58.9%的token。一次数据库查询、代码运行或工具调用,都会让模型多经历一轮输入和输出。模型之间看似不大的价格差,经过几十轮调用后,会直接变成一张明显不同的账单。 DeepSeek的增长为我们提供了一个具体样本。它在Vercel上的token份额从4月的不足1%,升至5月的17%,6月进一步达到22.6%。开发者愿意把高频任务交给它,说明低价模型已经越过了进入生产环境的质量门槛。 最贵的模型则开始遇到企业预算的上限。Ramp的数据显示,Fable 5只占Anthropic企业token使用量的6%,支出占比为11.4%。它的价格约为每百万token 10美元,但7月产生的模型归因支出只有GPT-5.6 Sol的75%。性能领先没有自动转化成调用量。 企业最终选择的通常也不是某一个模型。月请求量超过1000万的Vercel团队,平均同时使用35个模型:便宜模型处理分类、摘要和批量任务,前沿模型负责复杂推理与高风险决策。 开源模型正在获得token的多数,而闭源模型仍守着价值更高的部分。AI市场竞争的重点,正从“谁是最强模型”,转向“什么任务值得用什么价格的模型”。


JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图