• 谷歌在2026年I/O大会上宣布了对Gemini的大规模扩展。
  • Gemini正在扩展到搜索、安卓、购物、生产力以及AI智能体等领域。
  • Gemini Spark、Omni和AI驱动搜索等新功能表明,谷歌正全力推进始终在线的AI助手。

谷歌多年来一直坚称,AI会在后台悄然改进其产品。在2026年谷歌I/O大会上,该公司终于不再假装低调仍是其计划。谷歌正试图将Gemini变成人们在网上几乎所做一切事情的连接纽带。

谷歌显然不打算让这一未来发生在自家产品之外的地方。区别在于,谷歌已经拥有人们每天大部分时间所处的数字空间。它不必要求用户切换平台,只需将Gemini直接注入用户经常打开的工具中即可。

更快的“大脑”,更大的野心

更快的“大脑”,更大的野心

打开网易新闻 查看精彩图片

谷歌最重大的技术发布围绕新的Gemini 3.5系列和Gemini Omni展开。谷歌将其描述为迈向AI“世界模型”的重要一步,这类模型能够同时跨多种模态理解和生成信息。

Gemini 3.5 Flash是谷歌的主力模型。谷歌反复强调其速度、更低的成本和效率,声称Flash在大多数基准测试中的表现优于Gemini 3.1 Pro,同时运行速度比竞品模型快四倍。

谷歌还强调,该模型的成本远低于许多竞争对手的高端AI系统。这种定价策略很重要,因为AI在大规模运行时的成本正在悄然变得非常高昂。OpenAI、Anthropic等公司不断提高推理能力的天花板,但也在逐步训练用户接受越来越昂贵的订阅费用。

Gemini Omni是更具未来感的发布。Omni并非让独立的系统分别处理图像、视频、音频和文本,而是将它们整合到一个多模态模型中,旨在同时跨所有模态进行推理。谷歌演示了该系统编辑上传的视频、更改视觉风格、生成AI虚拟形象,并以模糊传统AI助手与创意制作工具之间界限的方式对多媒体内容进行推理。

公司将 Omni 定位为超越 Veo 等独立视频生成器的进化产物,但更广泛的行业背景让这一战略清晰可见。这与 OpenAI 自身日益多模态化的 ChatGPT 方向有着明显的相似之处。整个行业正竞相构建能够在语音、视觉、推理和行动之间流畅切换、无明显边界的 AI 系统。谷歌现在似乎决心构建同样类型的统一 AI 层,只是规模是谷歌级别的。

Gemini 的不间断 Spark

Gemini 的不间断 Spark

打开网易新闻 查看精彩图片

如果说 Gemini 3.5 展示了谷歌的技术实力,那么 Gemini Spark 则揭示了公司真正希望人们用它来做什么。

Spark 本质上是一个基于云的 AI 代理,即使用户合上笔记本电脑或锁定手机后,它仍能继续工作。它可以在后台整理收件箱、起草电子邮件、管理日历,并从 Workspace 应用中提取信息。

谷歌表示,它可以帮助用户整理混乱的日程、根据收到的作业制作学习指南,或留意客户的电子邮件。

这正是更广泛的 AI 行业正在发展的方向。OpenAI、Anthropic 等公司都在竞相构建能够独立完成任务、而不仅仅是回应用户提示的代理系统。不同之处在于,谷歌已经拥有了这些代理有效运作所需的大量周边生态系统。Spark 不需要要求用户连接单独的应用,因为许多服务已经深度集成到人们使用了多年的谷歌账户中。

Android Halo 是一种视觉界面,用来展示 Spark 正在进行的活动,只会更让人觉得,谷歌希望 AI 智能体成为一直在后台默默干活的数字同事。当然,这挺有用。不过也有点瘆人。

话虽如此,Spark 也捕捉到了行业正在走向一个有点让人不安的方向。这类系统只有在用户提供大量背景信息时才能发挥作用。邮件、日历、文档、习惯、联系人、日程安排和浏览行为,都会成为机器了解你生活的一部分。

重新定义 Gemini

重新定义 Gemini

谷歌还重新设计了 Gemini 应用本身。新的“Neural Expressive”界面加入了更丰富的视觉效果、动画、时间线、触觉反馈和对话式布局,旨在让 Gemini 的交互感觉更自然,而不是在冷冰冰的聊天框里打字。Gemini Live 对话现在几乎可以即时开始。

更广泛的目标似乎是减少从“想到”到“用 AI 去做”之间的阻力。例如,Docs Live 让用户用语音聊想法,同时 Gemini 会实时将其整理成结构化文档。谷歌还计划将对话式语音功能扩展到 Gmail 和 Keep,进一步将 AI 嵌入日常办公流程中。

这折射出整个行业的大趋势。OpenAI 让 ChatGPT 能自然语音对话、有长期记忆,因为用户越来越喜欢感觉像对话而非机器应答的 AI。谷歌似乎也得出了同样的结论。

搜索即AI

搜索即AI

打开网易新闻 查看精彩图片

搜索可能是谷歌AI转型影响最大的地方。

新的人工智能搜索框、升级版人工智能模式、信息智能体和生成式界面都说明谷歌想把搜索做得更会聊天、更能互动。搜索不再只是返回链接列表,而是可以在结果页面中直接生成自定义组件、图解说明和迷你应用程序。

这看起来就是在回应ChatGPT这类AI工具把用户胃口养刁了。人们越来越希望获得直接答案和互动体验,而不是一堆链接列表。谷歌明白,要是用户都跑去用独立的AI助手来搜信息、做规划,搜索就可能丢掉自己在互联网经济里的核心位置。

这就产生了一个让人不太舒服的矛盾。谷歌的AI搜索工具可能确实让搜索更好用了,但也从根本上重塑了谷歌当初帮忙搭起来的互联网生态。媒体、创作者和网站越来越担心,AI对话式回答会让用户懒得点进原始链接。谷歌坚称这些系统对全网还是有好处的,但长期能不能平衡,谁也说不准。

AI购物大战

AI购物大战

打开网易新闻 查看精彩图片

购物这块的消息听起来没有Gemini Omni那么炸,但最后可能对谷歌的业务更重要。

通用购物车、通用商务协议和代理支付协议都预示着这样一个未来:Gemini将成为主动的购物中介,而非被动的推荐引擎。谷歌希望AI系统能够跟踪价格、盯着打折信息、发现兼容性问题、同时管理多家零售商的购物车,并最终代表用户完成购买。

该公司演示了一些示例,例如AI在结账前看出PC配件不兼容、留意库存变化、自动盯信用卡的优惠/返现权益,并在后台盯着降价。AP2增加了支出控制、商家审批权限和透明的交易记录,让用户放心AI代理不会一声不吭把他们的钱转走或刷爆银行卡。

同样,这不是单独在搞这件事。亚马逊、OpenAI和其他公司都在探索AI购物助手,因为电商/购物是把AI卖给普通用户、做成持久生意最直接的路子之一。

谷歌的优势显而易见。搜索早就成了大部分人上网找产品的主要方式。Gmail里有收据、有订单记录。YouTube天天在左右大家买什么。Gemini有潜力把这些系统全串起来,变成一个超级大的购物入口。

谷歌在I/O大会上公布的东西,说明他们押注Gemini押得有多深。谷歌想把AI嵌进现代计算里,让人离不开它。搜索、Android、购物、通信等等,现在全都是围着AI来做的。

对谷歌来说,这一策略完全合理。如果AI成为下一个计算平台,谷歌希望Gemini能成为这个平台的核心。用户最终会觉得它方便还是烦人,就不太好说了。