DeepSeek V4 Pro 正式版来了。
8 月 12 日晚,DeepSeek 官方 API 文档已经将 deepseek-v4-pro 对应的模型版本更新为 DeepSeek-V4-Pro-0813。目前开发者可以直接通过 API 调用新版本,价格为 3 元/百万 Token 输入、6 元/百万 Token 输出,缓存命中输入仅 0.025 元/百万 Token。
V4 Pro-0813 继续支持 100 万 Token 上下文窗口,最大输出达到 38.4 万 Token,同时支持思考与非思考两种模式。JSON Output、Tool Calls 等能力也已经开放。
截至 8 月 12 日晚,DeepSeek 官方更新日志还没有单独发布 V4 Pro 正式版公告。但在此前 V4 Flash 正式版更新时,DeepSeek 曾明确表示,V4 Pro 正式版将在随后推出;如今 API 后台模型节点已经从此前版本切换至 DeepSeek-V4-Pro-0813。
距离 V4 第一次出现,已经过去接近四个月。
今年 4 月 24 日,DeepSeek 发布 V4 Preview,同时推出 V4 Pro 和 V4 Flash。其中 V4 Pro 是整个系列的旗舰版本,总参数量达到 1.6T,每个 Token 激活约 49B 参数,并支持 100 万 Token 上下文。V4 这一代从一开始就明显加强了 Coding、工具调用和长时间 Agent 任务。
7 月 31 日,DeepSeek 推出 V4-Flash-0731。官方表示,这一版本保持原有模型架构和尺寸,主要重新进行了后训练,Agent 能力得到明显加强,并原生加入 Responses API,同时针对 Codex 进行了适配。当时 DeepSeek还专门强调,此次更新只涉及 Flash,Pro 与网页端模型没有变化,V4 Pro 正式版随后发布。
现在,Pro 这块最后的拼图终于补了上来。
DeepSeek 这一代模型,越来越围着 Agent 转
V4 Pro 正式版发布的时间点,刚好赶上整个大模型行业新一轮产品重心迁移。
今年模型厂商发布新品时,单纯比较知识问答、数学和传统 Benchmark 的篇幅已经越来越少。Coding、Computer Use、Tool Use、长时间任务完成率,以及完成一次任务究竟要花多少钱,正在成为新的核心指标。
7 月发布 GPT-5.6 时,OpenAI 花了大量篇幅介绍 Agent 和 Coding 能力。GPT-5.6 Sol 支持新的 max reasoning effort,进一步推出 ultra 模式,由多个 Agent 并行完成复杂任务;Responses API 也开始允许模型直接编写程序协调工具、处理中间结果,再决定下一步动作。OpenAI甚至直接把“每一美元能完成多少工作”作为这一代产品的主要卖点之一。
Anthropic 的路线也很接近。
6 月底发布的 Claude Sonnet 5,主要提升同样集中在 Coding、Agent、Computer Use 和长时间任务上。Anthropic提供不同 effort level,让开发者根据任务选择推理强度;到了 8 月 10 日,Anthropic 又宣布把 Sonnet 5 原本的促销价格 2 美元/百万输入、10 美元/百万输出永久保留下来。
模型公司现在面对的已经不只是谁更聪明。
一个 Agent 可能连续运行几十分钟甚至数小时,反复读写代码、搜索资料、调用浏览器和外部工具。一旦真正进入生产环境,模型调用次数会迅速增加。能力、速度、Token 消耗和调用价格,开始一起决定一个 Agent 产品能不能跑起来。
DeepSeek V4 的设计基本也沿着这个方向展开。
100 万 Token 上下文可以让模型一次读进更大的代码仓库、企业知识库和任务历史;Tool Calls 负责与外部环境交互;兼容 Anthropic API,以及 Flash 已经率先支持的 Responses API,则是在降低模型进入现有 Agent 工具链的门槛。DeepSeek 在 4 月发布 V4 时,就已经同时开放 OpenAI ChatCompletions 与 Anthropic 格式接口。
这也是 V4 Pro 正式版比单纯又一个更大的 DeepSeek 模型更值得关注的地方。DeepSeek 正在把模型进一步做成 Agent 可以直接调用的基础设施。
V4 Pro 正式版上线后,DeepSeek 这一代产品的分层也更加清楚。
目前 V4 Flash 输入价格为 1 元/百万 Token,Pro 为 3 元;Flash 输出 2 元,Pro 为 6 元。两者价格刚好相差三倍。V4 Pro 与 Flash 都支持 100 万上下文,但 Pro 使用更大的激活参数规模,定位更偏向复杂推理、Coding 和更困难的 Agent 任务。
Flash 承担大量、高频、成本敏感的任务,Pro 留给更重的工作。
2025 年的大模型竞争还经常围绕「旗舰模型谁跑分第一」展开。到了 2026 年,模型正在越来越像真正的软件基础设施,既要聪明,也要有稳定 API、长上下文、工具调用、足够高的并发,以及能让开发者算得过来的价格。
V4 Pro 正式版上线之后,DeepSeek V4 这一代的产品轮廓终于完整了。
热门跟贴