谷歌DeepMind的Gemini 3.8 Flash正式上线OpenRouter平台。这条消息的核心不在"新模型发布"本身,而在定价策略——它用3.7 Flash的发布价,在各项基准测试中全面超越了前代。

翻译一下就是:同样的钱,性能全面升级。这种"加量不加价"的打法,在当下大模型厂商普遍提价或收紧免费额度的环境里,显得有些另类。

打开网易新闻 查看精彩图片

价格没变,成绩单变了

根据OpenRouter页面显示的信息,Gemini 3.8 Flash的定价与3.7 Flash发布时保持一致。但在官方展示的基准测试中,它在编程、金融、法律、视频和科学五个维度上均超过了前代。

这五个领域覆盖了目前AI应用最核心的几大场景:写代码、处理财务数据、分析法律文书、理解视频内容,以及科研辅助。每一项都是企业级用户最关心的能力指标,也是开发者选择模型时最看重的参考维度。

这次发布没有走"更大参数、更高价格"的传统路线。Flash系列在Gemini家族中定位轻量高效,主打低延迟和低成本。3.8 Flash在保持价格不变的前提下提升性能,意味着谷歌DeepMind在模型效率上又往前推了一步——用更少的算力成本实现更好的效果,这比单纯堆参数更有商业价值。

对开发者意味着什么

对于在OpenRouter上调用API的开发者来说,这次升级几乎是零成本的。不需要改代码,不需要重新评估预算,只需要切换模型版本,就能获得更好的输出质量。

这种体验在AI行业并不常见。过去两年,模型迭代往往伴随着价格调整,要么是性能提升但价格上浮,要么是价格下降但能力有所取舍。像这样"同价升级"的情况,对开发者生态的友好度明显更高。

从另一个角度看,这也反映出谷歌DeepMind对Flash系列的市场策略:用性价比抢占开发者心智。在高端模型竞争白热化的当下,把轻量模型的性能天花板抬高,或许是在为更广泛的应用场景铺路。

竞争格局的一个信号

OpenRouter作为聚合多家模型的平台,是观察各家模型竞争力的一个窗口。Gemini 3.8 Flash选择在这里首发,并且直接对标自家前代的价格和性能,意图很明确:让开发者用最直观的方式看到升级幅度。

目前OpenRouter上已经可以调用该模型。对于正在做技术选型的团队来说,这或许值得花几分钟跑一下自己的测试集——毕竟价格没变,跑出来的结果如果更好,那就是纯赚。

至于这次升级背后的技术细节,谷歌DeepMind尚未公布更多信息。但从基准测试的结果来看,效率提升的幅度不小。后续如果官方放出技术报告,应该能看到更具体的优化方向。