Google I/O 2026 开发者大会终于落下帷幕,说实话,对于非开发者来说,主题演讲有点无聊。头条新闻 Gemini 的消息不过是 Gemini 3.5 Flash 的一次小版本更新,而“智能体”这个词则被反复提及。
正如一位高管在台上所说,Google 正在“构建一个新的智能体时代”。今年的主题是:让 Gemini 承担重活。邮件、晚餐预订、假期规划、购物——Gemini 想成为你万能的解决方案。不同之处在于,Google 现在希望它能在一定范围内 <非常自然地> 自主完成这些事情。
硬件方面也同样平淡。最值得注意的发布是一副智能眼镜,该公司称之为“音频眼镜”——本质上就是 Google 对 Meta Ray-Bans 的回应,但通过与 Warby Parker 和 Gentle Monster 的合作,在风格上更加用力。目标似乎是让摄像头眼镜看起来不像在说“我戴着摄像头眼镜”。
总而言之,这是一场一如既往平淡的发布会——说实话,这基本上就是目前 I/O 主题演讲的传统。但仍有不少值得深挖的发布内容,以下是完整回顾。
Gemini 3.5 Flash 成为新的默认模型
Google 今天发布了新 Gemini 3.5 系列中的首个模型,现在可以在 Gemini 应用和其他 Google AI 产品中使用。Google 高管表示,新的旗舰模型 Gemini 3.5 Pro 将于 6 月推出。
据 Google 称,Gemini 3.5 Flash 在基准测试和 token 效率方面击败了大多数前沿模型。公司还表示,它在大多数方面也超越了 Gemini 3.1 Pro。你可以立即在 gemini.google.com 上开始使用它。
Gemini Spark 想管理你的生活
主题演讲中最引人注目的发布是 Gemini Spark,一个基于云的 AI 智能体,在后台持续运行,在你忙于其他事情时处理任务。正如我在它发布时所写的,这可能是 Google 一段时间以来在台上展示的最雄心勃勃的东西。至少,是今天 I/O 大会上发布的所有内容中最雄心勃勃的。
由 Gemini 3.5 Flash 驱动,并使用 Google 的 Antigravity 编码 IDE 构建,Spark 可连接 Gmail、Docs,并最终接入包括 Uber、OpenTable、Lyft 和 Zillow 在内的 30 多个第三方应用。它将于下周向美国地区的 AI Ultra 订阅用户推出。
为了防止它用你的信用卡做出越界行为,Google 介绍了代理支付协议(AP2),该协议限制了 Spark 的消费额度、购物场所和可购买的商品。目前,你仍需批准每笔交易。该公司将 Spark 描述为拿到第一张借记卡的青少年,并表示随着信任的建立,该代理的监管限制将逐渐放宽。
Google 的 AI 订阅套餐降价了
Google 在 I/O 大会上重新调整了其 AI 订阅产品线,重点是价格更亲民了。正如我之前报道的,AI Ultra 的新入门价格为每月 99.99 美元(原价 250 美元),面向开发者和高级用户,捆绑了 Gemini 3.5 Flash、5 倍于 Pro 的使用限额、Google Antigravity 的优先访问权、20TB 存储空间以及完整的 YouTube Premium 套餐。250 美元的档位仍然存在,但降至 200 美元。目前完整的产品线为 AI Plus(7.99 美元)、AI Pro(19.99 美元)和 AI Ultra(起价 99.99 美元)。
Google 还放弃了按提示词计数的模式,转而采用衡量计算使用量的方式,这意味着简单的文本查询几乎不会消耗你的限额,而复杂的视频任务则消耗更多。限额现在每五小时刷新一次,而不是每天;如果你达到了上限,Google 会自动让你降级到较轻量的模型,而不是完全切断服务。
Gmail 即将推出实时语音模式
Gmail Live,Mashable 的 Haley Henschel 报道的一项新功能,让你可以通过语音向收件箱提问,而不是输入搜索词。其卖点很简单——询问航班的登机口号码,或孩子这周在学校有什么活动,Gmail 会从你的邮件中提取答案。类似的对话功能也将登陆 Google Docs 和 Keep。Gmail Live 将于今年夏天向 AI Pro 和 Ultra 订阅用户推出,同时提供 Workspace 预览版。
AI Inbox 今年早些时候最初是 Ultra 专属功能,现在将新增三项功能,并向 Pro 和 Plus 订阅用户开放更广泛的使用权限。更新包括个性化草稿回复、即时访问相关 Docs 和 Sheets,以及一键式任务管理以清除收件箱杂乱内容。这些功能将于今天开始推出。Gmail 产品副总裁 Blake Barnes 在媒体预沟通会上表示,这两项功能均不会使用用户数据进行训练,并且正在内置来源追溯功能,以便你能清楚看到哪些邮件生成了特定回复。
Google 搜索迎来 25 年来最大规模改版
搜索——成就了 Google 的核心产品——将再次迎来 AI 的强力注入。该公司今年向其旗舰产品投入了大量资源,其中大部分归属于主导主题演讲的同一个理念:“让 Gemini 来处理一切”。
最具象征意义的更新或许就是全新的智能搜索框,谷歌称这是其搜索框 25 多年来首次重新设计。扩展后的搜索框现在支持自然语言查询,并允许你在搜索的同时,附上图片、视频、文件甚至 Chrome 标签页。基本上,谷歌希望你不再“谷歌一下”,而是开始……与谷歌对话。
AI 概览(AI Overviews)也新增了多轮对话模式。用户现在可以直接在概览中提出后续问题,把原本静态的摘要变成更像聊天机器人式的对话。这是顺理成章的演变,尽管它依然不禁让人质疑:那些原本靠这些搜索获取流量的网站该怎么办。
搜索智能体
更大的动作是:谷歌推出了搜索智能体,本质上是在后台全天候运行的 AI 助手,代表你扫描新闻网站、博客和社交媒体。谷歌举出的用例——追踪公寓房源、盯着限量球鞋发售——确实很实用,但有个限制是,这些信息智能体今年夏天上线时,只对 AI Pro 和 Ultra 订阅用户开放。
这股智能体风潮也刮到了购物和预订领域,智能体可以直接给出实时价格、有没有货,以及预订链接。谷歌还允许智能体替你真的给商家打电话——这项功能将于今年夏天向所有用户推出。
谷歌正在让更多人用上搜索里的“个人智能”功能,该功能会关联你的 Gmail、Google Photos,很快就会支持 Google Calendar,让搜索能把你的个人情况考虑进去。这个功能是自愿开启的,谷歌马上补充说,用户可保持对自己数据的控制权——这话也就是因为知道大家肯定会问,所以才说的。
另外,谷歌将基于 Google Antigravity 的 AI 编程工具直接整合到搜索中,明显是冲着非开发者来的。比如定制健身追踪器或婚礼策划面板——就是给没写过一行代码的人用的 Gemini。
谷歌与三星的智能眼镜真实存在,只是尚未命名
本次展会硬件方面的重头戏是Android XR 智能眼镜的首次真机亮相。谷歌和三星揭开了两款产品的面纱——一款与 Gentle Monster 合作,一款与 Warby Parker 合作——均将于今年秋季上市。目前仍没有名称和价格,但设计显然意在避免“一看就是科技眼镜”的外观,这一直困扰着该品类。
谷歌特意将这些产品称为“音频眼镜”,以区别于未来的显示眼镜。功能上,它们与 Meta 的 Ray-Ban 眼镜处于同一领域——语音命令、手机配对、免提辅助——但深度集成了 Gemini。三星负责硬件,谷歌负责 AI 和 Android XR 平台。
Google Shopping 迎来全面改版
购物记者 Samantha Mangino 解析了 I/O 大会上公布的三项 Google Shopping 新功能,其中最引人注目的是 Universal Cart——一个统一购物车,可将你在 Target、亚马逊等不同零售商处添加的所有商品聚合在一个谷歌端视图中,并在后台为你标记降价和补货提醒。该功能将于今年夏天在美国上线谷歌和 Gemini,随后支持 Gmail 和 YouTube。
更具结构性的举措是 Universal Commerce Protocol(UCP,通用商务协议),它允许 AI 代理直接通过合作伙伴(包括亚马逊、沃尔玛、Shopify 和 Meta)完成购物和酒店预订。它还会自动显示相关费用和信用卡奖励,让你在结账前清楚了解实际支付金额。
Docs Live
谷歌发布了 Docs Live,这是一项新功能,你可以将杂乱的文字和想法倾倒给 Gemini,让它实时将这些内容整理成结构化的文档。之后,你可以通过对话方式对其进行完善——只需告诉 Gemini 要修改、添加或删除的内容,它就会立即更新。
SynthID 获得重大提升
主题演讲中一个容易被忽视的重磅消息是:谷歌的 AI 数字水印工具SynthID 正被 OpenAI、Kakao 和 ElevenLabs 采用。该谷歌项目正逐渐成为对抗 AI 生成内容的行业标准,这也是 AI 领域罕见的跨公司协作时刻。
此外,SynthID 还将在 Chrome 和 Google 搜索中轻松使用。正如谷歌 CEO Sundar Pichai 在主题演讲中所说,这意味着用户只需右键点击即可快速查看图片或视频是否包含 SynthID,从而判断其是否可能由 AI 生成。
谷歌发布全新世界模型 Gemini Omni
谷歌在 I/O 大会上发布了 Gemini Omni,这是其全新的多模态世界模型。尽管谷歌将其定位为一个可以“基于任何输出创造任何内容”的模型,但主题演讲中的演示主要侧重于视频生成。该系列的首个版本 Gemini Omni Flash 今天已向 Gemini 应用和 Google Flow 中的 AI Plus、Pro 和 Ultra 付费订阅用户开放,本周晚些时候将免费推广至 YouTube Shorts 和 YouTube Create。
与 Veo 等文本转视频工具不同,Omni 在输入和输出两个方向上都支持多模态——你可以输入文本、音频、图像或视频,它会相应地以对应模态生成内容。谷歌 DeepMind 首席执行官戴密斯·哈萨比斯在主题演讲中称这是向 AGI 迈出的“有意义的一步”。实际演示主要围绕通过对话进行视频编辑,比如替换背景、更改角度以及对片段里的具体细节做调整。还有一个 Avatar 功能,用于创建你的数字分身,不过谷歌说这功能还在测试,之后才会大面积上线。所有 Omni 生成的视频都会嵌入谷歌的 SynthID 水印,用来标明这些视频是 AI 生成的。
YouTube 有两个更新,但都不大
与谷歌其他产品线相比,YouTube 这次在 I/O 大会上存在感不高——但有两件事值得关注。
Gemini Omni 即将登陆 YouTube Shorts Remix,这是该平台基于现有内容生成视频的 AI 创作工具。创作者将能够使用更高级的 AI 提示词来重新混剪自己的 Shorts,系统会自动打上 AI 生成内容标签,并附上原始来源链接。谷歌还将其肖像检测工具(用于标记创作者面部被 AI 修改过的内容)扩展至所有年满 18 岁的创作者。
第二项更新不在 YouTube 本身,而是在 Google 搜索中。Ask YouTube 允许用户在提出复杂问题时,直接在搜索结果中显示相关的 YouTube 视频。可以设想教程类查询——怎么修东西、怎么学东西——这类问题中视频实际上比文字回答更有用。该功能仍在测试中,预计今年夏天在美国全面上线。
热门跟贴