7月31日下午,DeepSeek没开任何发布会,把V4-Flash-0731正式版API悄悄放了出来。当晚 AI圈就炸了——Hacker News热帖标题直白到刺眼:"Intelligence is now so cheap you stop metering it"(智能便宜到你不忍心再按量计费)。先看这版到底改了什么
0731版最反常识的地方,是架构一个参数都没动。还是284B总参数、13B激活的MoE,1M上下文。官方更新日志写得很克制,真正变的只有一件事:重新后训练(post-training),把Agent能力往死里练。
数字比文字更有说服力:
- Terminal-Bench 2.1
(终端操作):61.8 → 82.7,逼近Claude Opus 4.8的85
- DeepSWE
(软件工程):7.3 → 54.4,翻了7.5倍
官方口径:Agent综合成绩 「远超自家V4-Pro-Preview」
一个13B激活参数的"小模型",在Agent基准上干翻了自家1.6T参数的旗舰预览版。这就是圈内说的"以下克上"。
"斩杀线"到底是啥,一张图看懂
这个词其实不是跟着0731版才来的。5月底,DeepSeek把V4-Pro从限时2.5折直接转成永久价——输入输出一口气砍75%,创下当时全球顶级模型的价格新低。中文社区和Hacker News中文区当场刷出一个共识:
" Codex、Claude定上限,DeepSeek定斩杀线——跟它持平没 溢价,落后它就出局。"
那时候更多人把它当段子看。0731这版一出来,"斩杀线"被重新认真对待了,因为它把"能力"和"价格"两张牌同时打满了。
有网友做的图,数据来自Artificial Analysis:横轴是价格,纵轴是性能。V4 Flash-0731又便宜又强,蹲在图的左下角,凡是落在它"右下角"的模型——要么性能不如它,要么价格不如它——都算被斩了。
被斩的是大多数。能躲过这一刀的只剩两种:
幸存的类型
代表模型
代价
更便宜
一些模型(GPT-5.6 Luna、小米MiMo-V2.5 )
价格躲过,但编程能力差一截
更强
一些模型(Kimi K3、Opus 4.8、GPT-5.6 Sol )
必须把思考挡位开到Max/High才能拉开差距
注意右边那一排,连"幸存者"都活得挺累:更强的模型要付出高得多的成本才能拉开差距,更便宜的模型又得拿能力去换。
为什么这次让人慌
过去两年行业默认的玩法是"堆参数换能力":你能力比我强,你就可以卖贵;我不服,就加参数量跟你拼。0731打破的是这套逻辑—— 同一套架构,没加一个参数,光靠后训练就把能力拉高几倍, 价格还是 ¥1/百万token输入、¥2输出,缓存命中低到 ¥0.02。
价格账摆开来更直观:
模型
输入/百万token
输出/百万token
DeepSeek V4-Flash-0731
$0.14
$0.28
Claude Opus 4.8
$5
$25
OpenAI Codex(GPT-5.6)
$5
$30
同样跑一个中等复杂的代码Agent任务,Flash可能几毛钱人民币,Opus 4.8要几美元,效果差不到5个百分点。几十倍的价差,个位数的分差,这套账谁都会算。
这波热度国内外都在刷。有论坛上,"V4F直接干GLM-5.2"刷了一排,回帖里全是"期待斩杀GLM,涨价太恶心人了"。知乎相关话题的讨论量很快破千万。
海外反应集中在Hacker News。除了那条"智能便宜到不忍心按量计费"的热帖,开发者已经用脚投票——OpenRouter上DeepSeek是份额第一的模型作者,占了16.7%的token流量,V4 Flash排进前三。
你可以先记住一句话: 智能的定价锚点,正从"最强的贵"变成"够用的便宜"。
斩杀线会往哪抬
Flash-0731还只是DeepSeek的"轻量牌"。杀手锏V4-Pro正式版就在8月初,参数约是Flash的5倍,还会带上自家Harness(Agent工具)一起发。按网友的说法,搞不好要把斩杀线直接抬到Opus 5、GPT-5.6 Sol那一档。
对友商来说,这题确实难:追不上能力,拼价格是利润自杀;追得上能力,得先把自己成本压下来。对普通用户反而是好事——你手机里、工作流里用的AI,会越来越便宜、越来越够用。
下次再有人喊某个新模型"屠榜",先别急着信,拿它跟DeepSeek摆在一起比价格、比能力,落没落在斩杀线之下,一眼就清楚了。