DeepSeek 刚刚宣布为其 API 引入峰谷分时定价。消息在 Hacker News 上获得 214 分、113 条评论。这不仅是价格微调,而是主要 AI 供应商中第一个明确将推理算力视为商品,像电价一样按时间段计价。

新定价模型分为两个时段:高峰时段通常是美国工作时间,单价更高,但保证优先接入和更低延迟;低谷时段则是夜间和周末,价格显著下降,有报道称可便宜 50% 到 75%,但延迟为“尽力而为”,高需求时可能需要排队。

这种模式与电力市场类似:夜间用电需求低、可再生能源供给可能更充裕,所以电价更便宜。DeepSeek 是把同样的逻辑搬到 AI 推理上。

为什么值得关注?此前 AI 推理市场是“一口价”:OpenAI、Anthropic、Google 都不论调用时间,按 token 收同样价格。这在 GPU 供给紧张、需求平稳、市场规模小的时候是合理的,因为分时计价只会增加复杂度。

但市场变了:GPU 供给大幅增加,H100、B200 及竞品纷纷涌入;需求明显尖峰化,美国工作日的流量能达到低谷期的 3 到 5 倍;市场规模大到足以消化定价复杂度;而且越来越多的开发者在意成本,并非所有任务都需要实时响应。

Hacker News 社区反应呈现几个阵营。喜欢的开发者说:“反正我凌晨三点跑批量任务,现在等于被奖励了。”“这对后台任务意义重大——摘要、分类、向量化都不需要实时延迟。”怀疑者则问:“到底能省多少?如果只打八折,那这点复杂度不值得。”还有人担心:“如果大家都挪到低谷期,低谷岂不就变成高峰?”战略派则认为,这是 DeepSeek 又一次用价格做差异化,而且这次直接把“算力商品化”摆上台面。

无论怎样,分时定价一旦被验证,可能会迫使其他云厂商跟进。对开发者来说,意味着要重新设计调用策略:把能等的任务放到夜里,把实时请求留给高峰时段——同时为对应的高峰成本买单。