一场披着马甲的上线,被全网开发者当场抓包。
gemini-3.8-flash。谷歌半个月前刚发布的轻量模型,几斤几两,圈里人心里都有数。可眼前这个挂同样名字的家伙,写代码、画 SVG、跑 Agent,每一样都强得离谱,像是换了个脑子。
同一个小区的保安,穿着同一件制服,身手突然比特种兵还利索。换谁不多看两眼?
一件不合身的制服
9 月 17 日,大模型盲测竞技场 Arena 里,悄悄冒出一个匿名模型,挂名 gemini-3.8-flash。
问题在于,正主 3.8 Flash 九月初才发布,水平大家刚摸清。可这个同名同姓的家伙,一出手就是另一个水准。
有开发者顺手做了次前端探测,好家伙:1000 万 token 的输入上限、25.6 万输出、永久跨会话记忆、原生联网。这些配置,没有一样是 Flash 该有的。
就像你点了碗 12 块的兰州拉面,端上来一掀盖,碗沿镶着金。
全网侦探出动
最先露馅的是实测。
有人拿它画猫咪 SVG,毛茸茸的质感拉满;有人让它做鹈鹕骑自行车的动图,丝滑得不像话;还有开发者 14 分钟做出一个带创意交互的小游戏。这些活儿,是轻量模型的水平?
社区里迅速达成共识:这多半是谷歌藏在标签后面的下一代旗舰,内部代号 Argon。
谷歌怎么回应?一声不吭,转头把名字改成了 gemini-3.7-flash,接着测。
被识破了就换个马甲再上场。这是当全网开发者都不联网吗?
更戏剧的在后面。网上开始疯传一张基准对比图,说这个模型在编码、智能体、推理上全面碾压 GPT-6 Astra 和 Claude Fable 5.1。结果没过两天,有人扒出:那张图本身,疑似 AI 生成的。
八卦里套着八卦。连"偷跑"的证据,都是假的。
他们说减速,它却在踩油门
把时间往前拨五天。
9 月 12 日,Anthropic 的 CEO 阿莫代伊公开发文:全行业该放慢前沿模型的能力提升了,安全优先。OpenAI 的奥特曼点赞,xAI 的马斯克附议,连谷歌 DeepMind 的哈萨比斯都点了头。
四巨头,齐刷刷表态要减速。
五天之后,谷歌披着马甲,把压箱底的旗舰拖出来偷偷实测。
口号和行动之间,隔着的不是时间,是一次偷偷摸摸。
更耐人寻味的是,喊减速最响的那家,也没闲着——Anthropic 转头就被曝正在评估发新模型;四巨头还因为"协同放缓",被一纸诉状告上法庭。会议桌上的共识,会议室外的世界里一条都没兑现。
或许这才是行业真正的运行逻辑:会议上讨论减速,赛道上的车,没有一辆松开过油门。
也许,被识破这件事,本身就是测试的一部分。
当全网都在等着看这个马甲下一场对决时,谷歌的预热,已经悄悄完成了。
热门跟贴