文|大模型之家
8月17日零点,DeepSeek新一版峰谷价格体系正式生效,平均涨幅大约为3.5倍,最高可达12倍。这标志着这家曾以极致性价比席卷国内大模型市场的企业,正式按下了全面涨价的按钮。
然而,就在83天前的5月22日,DeepSeek才刚刚高调宣布将其V4-Pro预览版模型限时折扣转为“永久价格”,降幅高达75%。在这短短不到三个月的时间里,这张曾被全行业奉为价格底线的价目表被彻底改写,“永久”二字在此刻充满了一种反常识的戏剧性反讽。
价格底线崩塌:12倍涨幅背后的算力账
这次涨价的幅度,不仅打破了既有的市场预期,更像是一次对全行业API分发体系的强行重置。
根据8月17日生效的最新规则,在每天的业务高峰时段(北京时间9:00-12:00、14:00-18:00),DeepSeek V4 Pro模型的缓存命中输入价格从0.025元/百万Token飙升至0.3元,涨幅达到原来的12倍。其缓存未命中输入价格也同步上涨200%至9元,而最核心的输出价格则从6元暴涨350%至27元。即便是同步调整的V4 Flash模型,其输出价格同样经历了350%的跃升,达到了9元/百万Token。即使在半价的闲时,其调用成本也远超此前宣称的底价。
价格权力的传导链条展现出了极强的同步性。作为DeepSeek的重要合作方,腾讯云CloudBase几乎在同一时间官宣,完全跟随官方同步调整定价并引入相同的峰谷机制,价格做到分毫不差。与此同时,阿里云百炼以及硅基流动等处于同一价格传导链条上的托管方,也必然面临着成本的重新核算与对冲压力。
Agent时代的“产能反噬”
对于这轮剧烈的价格上涨,DeepSeep官方只是轻描淡写地表示是为了“更合理地分配资源、提升服务稳定性”,试图用峰谷错峰的逻辑来平息开发者的算力焦虑。但撕开这层表象,真正扼住大模型咽喉的,是算力产能面对指数级需求时的断崖式枯竭。
相关数据展现出的消耗速度极为惊人。在8月3日至8月9日当周,V4-Flash的单周调用量已突破8.83万亿Token,环比暴增570%,位居全球第一。在OpenCode平台上,仅8月1日单日就处理了8万亿Token,其中有高达5万亿来自免费额度的消耗。
这种物理极限的背后,是Agent时代的结构性反噬。在单纯的对话交互时代,单次任务的上下文往往不足两千,但在Agent编排与多步推理工作流爆发的当下,单次任务消耗50万甚至100万Token已经成为常态。
可见,DeepSeek此时的调价更像是产能已经根本无法支撑如此庞大的吞吐量,服务频繁出现“繁忙”与“超时”,涨价是硬件物理极限的必然反扑。
在物理极限之外,涨价亦是一场精准的商业收割。创始人梁文锋在流出的投资人闭门交流中曾坦露过其硬核的定价哲学:以购买服务器“10个月收回成本”作为倒推基准,只赚取约6倍的合理利润。在极低的价格区间内,开发者对价格的敏感度极低,属于典型的无弹性需求;此时将价格翻倍,Token的消耗总量并不会发生数量级的衰减,而总营收却能实现近乎翻倍的飙升。
有专业人士测算指出,调价后的V4 Pro真实毛利率可能回升至72%到81%之间。这表明,涨价并非单纯为了覆盖初期的亏损,而是为了匹配未来庞大的资本开支,回应资本市场对商业可持续性的严厉关切,尤其是在公司筹备境内IPO的传闻愈演愈烈的背景下。
开源外衣与昂贵词元:生态构建的内在悖论
在发布涨价公告的8月13日同一晚,DeepSeek打出了一套极具迷惑性的组合拳:它将自家的Agent运行时框架Harness以MIT协议全面开源。
这款被定位为“一切皆插件”的执行层框架,直接对标OpenAI的Codex与Anthropic的Claude Code,支持多Agent编排、上下文管理与沙箱调度,试图用绝对的开放性将开发者锁死在自家的生态中。短短24小时内,该项目在GitHub上狂揽超9.6万颗Star,展现出强大的社区号召力。与此同时,V4-Pro的权重也同步MIT开源,进一步降低了私有化部署的门槛。
然而,DeepSeek一边用免费的顶级框架招徕开发者,另一边却在同一天大幅抬高了喂给这个框架的算力成本,想要培养繁荣的开发者生态,却又亲手推高了开发者的调用门槛。
首当其冲的,恰恰是那些通过API将模型深度接入企业级产品、构建复杂业务流的中小开发者,而这群人,正是Harness最迫切渴望吸引的核心受众。
一边推出Harness,一边token涨价,DeepSeek意欲何为?
在大模型之家看来,从商业自洽的角度来看,开源框架与权重是为了抢占开发者的心智与基础设施话语权,而API涨价则是为了在云端服务上赚取利润,两者逻辑并行不悖。
但从开发者的体感来看,“大门敞开,但电费暴涨”的落差是真实存在的。长期来看,这种策略有可能会将部分轻量级创新者推向价格更低廉的第三方托管平台。那个“便宜到完全没有对手”的价格战,已经彻底终结。
定价全面上移:大模型告别“低价时代”
拉长视线来看,DeepSeek的涨价并非孤例,它实质上引爆了全行业定价中枢上移的强烈外溢效应。
进入2026年以来,行业的涨价潮已经全面铺开:智谱AI年内三次提价,一季度提价约83%后,调用量依然实现了400%的逆势增长,验证了优质模型具备量价齐升的基础。月之暗面Kimi K3将输出价格拔高至百元级别,较前代涨超3.5倍。阿里云、百度智能云等底层云厂商,也悄然将算力产品价格上调了5%到34%。
在大洋彼岸,OpenAI同样在进行精密的分层洗牌,将入门级Luna模型降价80%以疯狂引流,却为旗舰级Sol模型推出定价翻倍的Fast模式,变相推高了高端生产力的门槛。
长期以来,DeepSeek扮演着国内大模型市场的“绝对价格锚”。如今,这个锚点的松动,实质上为整个行业释放了压抑已久的定价空间,全行业走向分层定价、按价值收费的格局已初步确立。
OpenRouter的数据显示,截至6月初,中国模型的Token处理份额已经超越美国,成为全球AI基础设施不可忽视的底座。
然而,开放权重的模型处理了全平台29%的Token,却仅仅分享了不到4%的支出规模。中国模型在国际市场上长期扮演着“廉价”的角色,海量的使用量并未等比例转化为回流原厂的实际收入。
从这个意义上说,DeepSeek的本轮涨价,是中国模型试图将“全球技术影响力”翻译成真实“商业账本”的第一次实质性冲锋。
大模型市场的价格战,正在从“谁的底线更低”的初级战场,升级到了“谁的模型更聪明、服务更稳定、能更深地嵌进企业工作流”的价值深水区。基础的闲聊交互将逐渐失去溢价能力,而真正具备编程与Agent调度能力的生产力工具,必将卖出与其价值相符的昂贵价格。
DeepSeek在83天后的这一脚急刹车,宣告了整个狂热的人工智能行业,开始对残酷的商业规律产生真正的敬畏。
热门跟贴