9月2日,谷歌发布新一代模型Gemini 3.8 Flash,这是Gemini系列的一次重要更新。新模型最大的变化在于引入了低、中、高三档思考模式,用户可以根据任务复杂度灵活选择,在速度和深度之间找到平衡点。

三档思考模式,按需取用

打开网易新闻 查看精彩图片

这次更新的核心是思考模式的差异化。低档模式适合简单问答,响应速度最快;中档模式兼顾速度与推理质量,适合日常任务处理;高档模式则面向复杂推理场景,模型会投入更多计算资源进行深度思考。这种设计让开发者不必再为所有请求统一配置高算力,成本控制更灵活。

除了新模型,这次更新还修复了一个异步响应的问题——此前部分异步请求未能正确记录最终使用的模型版本,现在已解决。修复由开发者Charlie Tonneslan贡献。

版本记录更可靠

对依赖异步调用的开发者来说,这个修复很关键。之前模型版本记录不准确,可能导致调试和审计时数据错乱。现在版本信息能正确落盘,日志追踪的可靠性明显提升。

从更新日志看,谷歌正在加速Gemini系列的迭代节奏。就在同一天,Anthropic的Claude也更新了系统提示词,明确限制模型复现歌词内容;Claude Fable 5.1则展示了更强的动画生成能力。大模型厂商在推理效率、内容安全和多模态能力上的竞争,正在同步推进。