谷歌在六周内发布了第三款Flash系列模型——Gemini 3.8 Flash。这款新模型在部分智能体编码基准测试中追平了Claude Opus 5,但成本更低。不过,一个细节值得注意:它比前代更“烧钱”。

“更努力”的代价

打开网易新闻 查看精彩图片

据The Decoder报道,Gemini 3.8 Flash的推理机制是“更努力地工作”,这导致它每处理一个任务,输出的token数量比前代多出约30%。尽管官方标称的token费率与前代完全一致,但实际使用中,用户为每个任务支付的费用反而更高了。

换句话说,单看单价没变,但干同样的活,它消耗的“字数”更多,总账单自然就上去了。这种策略在基准测试上好看,但真实项目里的成本控制,可能得重新算一笔账。

平价连发,旗舰缺席

更让市场好奇的是谷歌的节奏:六周内连续推出三款Flash系列平价模型,而真正的旗舰级前沿模型却迟迟没有动静。这种“以量换价”的打法,在当下竞争激烈的AI市场里,显得格外扎眼。

一边是平价模型快速迭代抢占市场,另一边是旗舰产品持续“跳票”。谷歌的算盘到底怎么打的,目前还看不清楚。但至少对开发者来说,多一个低价选项总归是好事——前提是,你得先算清楚那30%的额外token成本。