国产大模型年中上新季收官,竞争格局出现微妙变化。Kimi K3与GLM-5.3以60分并列T1阵营,与GPT-5.6和Claude Opus 5的差距进一步缩小。

值得注意的是,GLM-5.3的得分提升仅靠后训练迭代完成,并未改动基座架构。这意味着在同等算力条件下,通过优化训练策略仍能挖掘出显著的性能空间。

打开网易新闻 查看精彩图片

T2档位同样看点十足:Qwen3.8 Max拿下58分,DeepSeek-V4-Pro以53分紧随其后。Qwen全系今年在Hugging Face上的下载量已突破20亿次,开源生态的活跃度可见一斑。

从分数分布看,国产模型与海外头部产品的差距正在收窄,但T1与T2之间的分差也提示着技术分层正在形成。下半年各家如何出牌,值得关注。