Mistral Large 4 已经在 OpenRouter 上线公测。参数规模 1T,其中激活参数 49B,原生多模态,上下文窗口 512K,输出上限 256K。

这组数字放在一起,指向的是一件事:长上下文和大参数不再是二选一。512K 的输入窗口意味着可以一次性塞进极长的文档或代码库,而 256K 的输出上限,则让模型有能力连续吐出接近一本书体量的内容。

打开网易新闻 查看精彩图片

价格是这次公测的另一个重点

官方给出的定价是每百万 token 输入 0.68 美元、输出 2.09 美元,缓存命中价格为 0.07 美元。前两周直接打五折。

把 1T 参数、512K 上下文和这个价位放在同一张表里,性价比的锚点被重新拉了一次。对需要处理长文档、长代码或多轮复杂任务的团队来说,缓存价格尤其值得注意——0.07 美元意味着重复上下文几乎可以忽略成本。

公测窗口只有两周

目前 Mistral Large 4 处于 public preview 阶段,通过 OpenRouter 提供访问。五折优惠限定在前两周,之后恢复原价。

对于想验证长上下文实际表现的开发者,这个窗口期是成本最低的测试时机。1T 参数加 49B 激活的稀疏结构,也决定了它在推理开销上不会像参数总量看起来那么重。