DeepSeek V4 Pro-0813刚转正,直接拆出了两套思考引擎。思考模式默认开启,适合复杂推理、代码生成、深度分析;非思考模式专门处理低延迟调用,实时对话、简单查询秒出。三档推理强度随便切,简单任务用none档能把延迟和成本降50%以上。

打开网易新闻 查看精彩图片

参数拆解一下就明白了:100万令牌上下文加38.4万输出,DeepSWE从预览版12.8飙到62.7,Agent能力翻了5倍。但成本也分化了,Pro版输出6元/百万token,Flash版并发能到2500,Pro仅500。

打开网易新闻 查看精彩图片

这意味着什么?大模型终于从一个模型打天下,变成了按任务调度的成本梯度。你的业务是要精准推理还是要快速响应,现在真的能选了。你会怎么选?

打开网易新闻 查看精彩图片

标签:#DeepSeek #AI大模型 #API开发 #思考模式 #成本优化