8月17日凌晨,DeepSeek完成了一次三重变阵。

峰谷定价生效、V4-Pro正式版转正、Harness开源——三件事撞在同一天。

最扎眼的是那个数字:V4-Pro缓存命中输入从0.025元涨到0.30元/百万tokens,涨幅1100%。输出从6元涨到27元,涨幅350%。V4-Flash输出从2元涨到9元。

那个把大模型价格打到"白菜价"的DeepSeek,正式收刀了。

峰谷定价,AI算力也开始"错峰用电"

每天9:00-12:00、14:00-18:00是高峰,其余时间半价。

这逻辑跟电力行业一模一样——白天贵,晚上便宜,把批量任务挪到凌晨跑。

据高盛研报分析,这次调价不是需求走弱,而是算力资源趋紧。调用量暴增是直接推手——8月1日V4-Flash单日处理Token总量达8万亿。中国日均Token调用量已突破140万亿,较2024年初增长超千倍。

V4 Pro正式版,到底强在哪?

版本号0813,1.6万亿参数、每词元激活490亿。

DeepSWE基准从12.8飙到62.7,涨了约4.9倍。九项智能体基准接近Anthropic的Fable 5。官方说,不再强调"更会答题",而是强调"更会把一件事干完"。

Harness开源,才是真正的"杀招"

MIT协议,2天累计约9.5万Star、11.4k Fork。

核心公式:Model + Harness = Agent。一切皆插件,支持40+家模型供应商。

模型可以贵,但框架免费开源——你用Harness搭的系统,底层跑的还是DeepSeek的API。但开发者也完全可以在同一个框架里跑Claude或其他国产模型。

开发者怎么办?

算一笔账:日均调用V4-Pro 100万次,每次输出2000 tokens,高峰期占比70%。

旧价格日均输出费约12000元。新价格峰谷混合约22950元,日均涨幅约91%。

探哥说过: "未来真正能赚钱的人,并不是手头拥有多少钱的人,而是拥有算力的人——又叫Token工厂。"(2026-06-25直播)

许教授也说过: "AI时代就三件事——降本、提效、找机会。没那么多花招。"(2026-06-27实战营1)

实操建议:把批量任务挪到夜间跑、用Flash做80%日常任务、利用缓存优化(实测长会话缓存命中率约80%)。

从通问AI的实践来看,很多团队只关注模型能力,却忽略了调用策略是否合理。一个好的Agent系统,会动态决定什么时候调用什么模型。

行业风向变了

DeepSeek不是唯一涨价的。智谱、月之暗面、MiniMax、阶跃星辰今年都已上调API价格。

算力是真金白银的硬成本。DeepSeek估值约5000亿元,IPO筹备中,商业化变现是绕不开的命题。

靠烧钱换量的阶段正在结束。未来的竞争,不是比谁更便宜,而是比谁能让开发者愿意为能力买单。

本文信息整理于2026年8月17日。数据来源:DeepSeek官方文档、IT之家、第一财经、36氪、高盛研报、国家数据局。