今天,DeepSeek-V4-Flash正式版正式发布,迅速引爆了AI圈和算力市场的关注。作为DeepSeek的忠实用户,由衷感到振奋和高兴。
性能表现:直逼GPT-5.6 Luna
根据海外权威机构Artificial Analysis的评测,DeepSeek-V4-Flash正式版在综合智能指数上拿到了50分,比此前预览版高出10分,仅比行业标杆GPT-5.6 Luna低1分。尤其值得一提的是,在DeepSWE (衡量真实复杂编程任务解决能力)测试中,新模型分数从预览版的7.3分飙升至54.4分,涨幅惊人,展现出强大的Agent能力。
价格:低到“白菜价”,仅为Claude的1/90
性能逼近顶尖,价格却低得令人咋舌。模型API的基础定价为每百万token输入约1元、输出约2元,本身就极具性价比。更关键的是,其高达约98%的缓存命中折扣,使得单次任务的实际成本极低——甚至比大幅降价后的GPT-5.6 Luna还要低约60%,价格仅为Claude Opus 4.8的百分之一左右。开发者们戏称其为“白菜价”。
技术路径:不靠规模,靠后训练
值得注意的是,这次性能飞跃并没有通过扩大模型规模实现。DeepSeek-V4-Flash正式版延续了包含2840亿总参数、130亿激活参数的MoE架构,与预览版完全一致。其能力的巨大提升,完全来自重新进行的后训练优化。这验证了一条重要的技术路径:同一个模型骨架,通过更精细的后训练策略,就能释放出巨大潜能。
使用方式:开发者优先,普通用户暂不可用
目前,新版模型仅通过API开放给开发者,网页端和App尚未更新,所以普通用户暂时无法直接体验。不过对开发者非常友好:它原生支持OpenAI的Responses API格式,还针对Codex做了深度适配,几乎可以零改动接入VS Code、Codex CLI等主流开发工具链,使用门槛很低。
DeepSeek-V4-Flash性能逼近GPT-5.6,价格低至Claude的1/90,DeepSeek这次,是真的“卷”到极致了。