近日 Deepseek 一次小更新放出两个大招,原本定位轻量应用的 V4 Flash,性能却不输专业版 Pro,价格还低到离谱,直接打乱了大模型市场的定价逻辑。
打开网易新闻 查看精彩图片
性能拉满,价格低到没朋友
基准测试跑分完全不虚 Pro 版本,网友制作的对比图表里,每个点代表一款大模型,位置越靠上性能越好,越靠右价格越贵。
Deepseek V4 Flash 性能虽略逊于 Claude、GPT5.6、Kimi K3 等顶级模型,但价格几乎碾压所有竞品。
打开网易新闻 查看精彩图片
我们实测下来,1 亿多调用量仅花 5 块钱,官方定价每百万调用量仅 2 元,还有缓存命中优惠活动。
不管用哪款竞品,处境都挺尴尬:性能没 Deepseek 好的,价格要贵不少;能力比它强一点的,价格贵得更离谱。
打开网易新闻 查看精彩图片
这还是对数轴的对比,如果换成线性坐标轴,差距更夸张,顶级模型性能只比它强两成,性能差两成,价格贵一两个零,难怪有人说 Deepseek 重新定义了大模型的斩杀线。
打开网易新闻 查看精彩图片
为啥能做到又强又便宜?两大核心逻辑
最关键的一点是后训练优化。
打开网易新闻 查看精彩图片
光靠后训练还不够,这次更新还有另一个关键:未发布的自研 Agent 工具 Deepseek Harness。
这次公开的跑分不是裸跑,而是用上了这个工具。
打开网易新闻 查看精彩图片
多伦多大学的研究显示,同一个模型用不同 Agent 工具,完成任务的概率最高差好几倍。
今年 AI 的核心升级方向就是 Agent,Deepseek 这次提前布局,让轻量版 Flash 直接追平顶级旗舰模型身后。
打开网易新闻 查看精彩图片
原本只是用来打下沉市场的 V4 Flash,靠后训练和自研工具就能和顶级模型掰手腕,要是放到更强的 V4 Pro 上,效果只会更惊艳。
这次更新不止是模型升级,更是 Deepseek 在 Agent 赛道的重要布局,值得所有关注 AI 的人留意。
热门跟贴