我想世界一直在给我们答案,只是我们还没有找到问题。关注我,听取世界的声音。

文/程不糖

8月13日晚上,深度求索发了一则调价公告,8月17日零时起,API全面涨价,还引入了峰谷定价,每天上午9点到12点、下午2点到6点算高峰,价格最贵,其余时间打五折。

具体数字很壮观,旗舰模型V4-Pro高峰时段每百万tokens的输出价格从6元涨到27元,涨了3.5倍,缓存命中输入从0.025元涨到0.3元,整整12倍,连负责走量的V4-Flash,输出价格也从2元摸到了高峰时段的9元。

峰谷这套玩法,中国人以前只在电费单上见过,没想到大模型也过上了有早晚高峰的日子。

/壹/

公告出来,段子手比开发者先到岗。流传最广的说法是,梁文峰的量化基金今年亏钱了,所以要从大模型这边把钱补回来。

这个段子传得极快,因为它符合群众对一切涨价的朴素理解,老板手头紧了嘛。

同一天还有一件更魔幻的事,A股的DeepSeek概念股集体大涨,十余只涨停,公司宣布多收钱,股民替它欢呼,付费的开发者连夜算账,这个场面充满了我们这个时代特有的荒诞感。

可惜段子的归段子,账本的归账本。

深度求索缺的从来轮不到那几块钱的收入,卡、电、机房、运维,样样都缺。V4-Flash单日token消耗量突破8万亿,全球调用量第一,这个第一是靠低价换来的,原先定价只有海外竞品的十分之一到二十分之一,长期处在补贴状态,卖得越多,亏得越壮观。

更要命的是,agent时代来了,智能体单任务消耗的token是传统对话的百倍以上,调用量越涨,硬件的压力越大,KVCache对显存的占用跟着指数级往上翻,8万亿这个数字每涨一分,亏钱的窟窿就大一分。

同行的情况也好不到哪去,阿里云、腾讯云、智谱AI年内都提过价,大家心照不宣地往回收,只是别人原来卖得贵,亏得有节制,DeepSeek冲得最猛,价格压得最低,最后也扛得最辛苦。

很多人看到涨价的第一反应是,腰杆硬了,敢收钱了!等看清价格表才发现,这哪里是庆功,分明是求救……

/贰/

涨价背后还有一层更难堪的账。过去两年,国产大模型打价格战,token价格一降再降,DeepSeek把价格压到了亏本线以下,赚到了名声,赚到了国货之光的称号,唯独没赚到用户。

原因说起来很残酷,agent和harness大行其道之后,用户和大模型之间隔了一层工具,模型负责想,工具负责做,用户只跟工具打交道,根本不关心壳子里装的是谁家的模型。

Claude Code火了,大家在配置里填Claude的key,DeepSeek便宜了,大家把key换成DeepSeek,明天谁家更便宜,改一行配置就搬家。

换模型这件事,从一项技术决策降格成了下拉菜单里的一次点击,整个过程不超过10秒。用户对工具忠诚,对工具里的模型毫无感情,模型成了随时可以替换的零件。

深度求索自己也看明白了,8月11日悄悄注册了DeepSeekHarness的公众号,准备亲自下场做工具,可惜工具这条赛道上,对手已经跑出去很远了。

过度的低价做不出用户沉淀,只能做出一堆薅羊毛的脚本和一份漂亮到吓人的调用量报表。8万亿的日调用量里,多少是真需求,多少是图便宜,这笔账深度求索自己心里最清楚。

/叁/

价格战打了两年,最后的战利品是一身名声,名声这东西,发新闻稿的时候好用,付电费的时候不好用。

最沉重的成本在训练端,这部分外界很少提。为了配合国产替代的叙事,全面对抗西方的AI资本开支,深度求索买了极贵的国内卡用于训练。

这笔账外人很难算清,国产加速卡的单卡报价只是入门价,采购有溢价,适配要人力,软件栈要重写,集群的良率和稳定性要靠时间和钱一点点堆出来,同样的训练任务,用国内卡跑下来的综合成本,远远超出账面数字。

V4-Pro是个参数1.6T的大家伙,训它一轮烧掉的算力是个天文数字,而对手那边,高端卡的交付周期再长,摊到每一token上的成本仍然更低。

对手用着更便宜、更成熟、供货更稳的卡,你用着更贵、更费劲的卡,训出来的模型还长期卖得比对手便宜,这门生意不管怎么做都是亏。亏到某一个临界点,公告就发出来了,成本已经搂不住了,涨价成了唯一的出口。

尽管如此,还是要承认深度求索的努力。它一心想在中美AI对抗里扮演那个标志性角色,V4-Pro正式版在多项智能体测试里逼近Anthropic的顶级模型,个别榜单还有反超,这很不容易。

/肆/

但评测归评测,实战归实战,真实代码场景里,它的稳定性还差着一截,知识库的广度也无法和顶级模型对抗,开发者嘴上说支持国货,遇到真正难啃的活,还是默默把key换了回去。

往市场下面看,豆包背靠字节的流量和补贴,足够下沉,免费、好用、无处不在,把大众用户圈得干干净净,涨价这种事它根本不着急;往市场上面看,kimi又贵又慢,但效力惊人,掏得起钱的客户愿意为效果买单,贵反而成了它的身份证明。

DeepSeek卡在正中间,下没有豆包的流量,上没有kimi的口碑,价格刚涨上去,能力还没完全跟上去,位置相当尴尬。

梁文峰说过,要搞AGI。这话我信,以深度求索的工程能力,它配得上这个野心。但AGI是一道纯粹的科学题,科学题最怕附加别的任务。

一家公司如果同时要扛着价格战留下的名声、国产替代带来的成本、对抗叙事寄予的期待,那它的每一步都得先满足叙事,再满足科学,买卡要看叙事,定价要看叙事,连发公告的措辞都要看叙事,日子久了,动作难免变形。

OpenAI可以纯粹地烧钱,Anthropic可以纯粹地涨价,轮到DeepSeek,连涨个价都要被解读成亏钱了或者雄起了,横竖都得是个信号,唯独不能是一家公司正常的商业决定。

DeepSeek若想苟到最后的大决战,还是必须得和国运解绑,放开手脚才行啊。

打开网易新闻 查看精彩图片

(完)

打开网易新闻 查看精彩图片