【CNMO科技消息】谷歌近日正式发布Gemini 3.8 Flash,这是该公司在短短六周内推出的第三款Flash系列模型。与此前版本不同,此次发布包含两个变体:面向通用场景的Gemini 3.8 Flash和专攻网络安全的Gemini 3.8 Flash Cyber,分别定位为谷歌"最智能的主力工作模型"和"最强网络安全模型"。
从性能表现来看,Gemini 3.8 Flash在多个基准测试中展现出超越更大规模模型的能力。在衡量自主解决复杂工程问题能力的DeepSWE v1.1测试中,该模型得分73.7%,略低于Claude Opus 5的74%,但明显优于Gemini 3.7 Flash、Claude Sonnet 5、GPT-5.6 Sol和GPT-5.6 Terra等竞品。此外,在Vals Finance Agent v2金融分析、Harvey法律智能体基准、CharXiv Reasoning信息综合、Terminal-bench 2.1终端编码以及LVBench长视频理解等多项测试中,Gemini 3.8 Flash同样领先于上述对手。
谷歌解释称,3.8 Flash之所以表现更优,是因为该模型"工作更努力"。面对复杂任务时,它会主动执行额外的推理步骤以提升输出质量,当然这也意味着在某些情况下会消耗更多token。定价方面,Gemini 3.8 Flash目前处于首发优惠期,输入token价格为每百万0.75美元,输出token为每百万3.75美元,后续将上调至1.50美元和7.50美元。即便如此,其价格仍低于Claude Opus 5和GPT-5.6 Sol等同类产品。
Gemini 3.8 Flash Cyber则是一款更为特殊的模型,目前仅通过谷歌新设立的Fairwind计划向特定用户开放,包括可信政府机构、关键基础设施运营商以及软件维护人员。在C/C++漏洞检测的行业标准测试中,该模型得分86.2%,超过前代Gemini 3.5 Flash Cyber以及Mythos 5、GPT-5.5-Cyber等更大规模的模型。在覆盖20多种编程语言的真实漏洞发现场景中,其成功率达到71%,大幅高于Gemini 3.7 Flash的58.9%和Gemini 3.5 Flash Cyber的46.6%。
该网络安全模型的另一大亮点在于自动化补丁生成能力。据谷歌公布的数据,Gemini 3.8 Flash Cyber为Chrome浏览器漏洞生成的正确补丁数量,是"规模大得多的最佳商用模型"的2.6倍。对于普通用户而言,虽然不会直接与这一模型交互,但其在防御端和开发端的改进将间接提升日常使用的技术产品的安全性。
目前,Gemini 3.8 Flash已向开发者、企业客户以及Google AI Pro和Ultra订阅用户开放。Gemini 3.8 Flash Cyber的访问权限则仅限于Fairwind计划成员。
热门跟贴