一个1T参数的模型,每次推理只激活49B。Mistral AI的Mistral Large 4,代号Le Chonk,就这样出现在了Arena的实测里。

据Arena公布的信息,这是一款总参数1T、激活参数49B的模型,开放权重将在本月底放出。Arena把它放进了一系列真实场景测试,用来观察它当前处在什么位置。

打开网易新闻 查看精彩图片

对比名单里都有谁

这次实测的参照对象覆盖了多家专有模型和开源模型。Arena列出的名单包括:

  • GPT-6.1 Sol
  • Astra
  • Claude Fable
  • Claude Opus 5.5
  • Claude Sonnet 5.5
  • Kimi K3
  • GLM 5.3 Flash
  • DeepSeek Flash
  • Muse Spark

把专有阵营和开源阵营放在同一组测试里跑,是Arena这次实测的做法。它想回答的问题很直接:Mistral Large 4今天站在什么位置。

1T与49B这两个数字

1T参数是模型的总规模,49B激活是单次推理实际调用的部分。两个数字放在一起,说明这是一款走稀疏路线的大模型——总盘子铺得很大,每次只动用其中一小块。

开放权重的时间点被定在本月底。对关注开源模型的人来说,这是这条消息里最实在的一项:权重放出来之后,模型能被怎么用、能跑在什么硬件上,才会有更具体的答案。

Arena同时表示,后续还会放出更多分数和关于Mistral Large 4的更新。目前公开的只是第一轮印象,测试本身还在继续。

想自己上手的人,Arena给出了一个入口:arena.ai/agent。第一印象的视频也已经发布。