继Kimi K3之后,Qwen3.8与DeepSeek V4正式版也将接踵而至。有机构指出,Agent正驱动Token需求非线性增长,模型能力上界依旧是决定定价能力的关键。
国产大模型迎来密集迭代
7月16日(WAIC前夕),月之暗面正式发布新一代开源基础模型KimiK3,参数规模2.8万亿(MoE架构,896专家、每token激活16个),成为目前全球参数最大的开源权重模型。
据悉,K3重点优化了智能体编程(AgenticCoding)能力,基于自研KDA混合线性注意力机制和注意力残差技术构建,原生支持视觉理解,拥有100万token上下文窗口;在官方评测中,Agentic类别平均得分91.2,长程检索BrowseComp斩获单Agent SOTA。

打开网易新闻 查看精彩图片

7月19日,阿里千问官宣Qwen3.8正式版即将发布并开源,新模型参数2.4T,官方称“可能是除Claude Fable 5外最强大的模型”,正以“天”为单位持续迭代。目前Qwen3.8-Max预览版已率先上线阿里云TokenPlan、Qoder及QoderWork,正式版将于近期推出。
与此同时,DeepSeek V4正式版也有望于近期发布。4月24日,V4-Pro预览版发布并同步开源,6月29日,官方宣布计划7月中旬上线正式版。V4-Pro参数1.6T,在Agent能力、世界知识和推理性能上均实现国内与开源领域领先,正式版发布后将引入峰谷定价机制。