开源大模型的能力天花板,又被抬高了一截。

MBZUAI基础模型研究院近日发布了开源权重MoE模型K2 Horizon 375B A23B(总参数375B,激活参数23B)。在Artificial Analysis的智能指数评测中,这款新模型拿下了47分的成绩。

打开网易新闻 查看精彩图片

这个分数有多夸张?对比一下前代产品就明白了——上一代K2 Think V2在同一评测中只得了17分。两代之间,直接拉开了30分的差距。

分数翻倍的背后

从17分到47分,不是简单的参数堆砌能解释的。MoE(混合专家)架构的路线选择,加上训练策略的迭代,才是这次跃升的关键。开源社区拿到这个权重后,能直接复现并在此基础上做微调,这比闭源模型的单点突破更有想象空间。

对于开发者来说,一个开源模型在权威评测中逼近闭源第一梯队,意味着部署成本更低、定制自由度更高的替代方案正在变得真正可用。