谷歌在周二的I/O开发者大会上秀了一把怎么把AI塞进自家各种产品里——从新模型、改版搜索栏,到马上要出的AI眼镜、YouTube对话搜索。
关键点:谷歌手里的底牌算是AI竞赛里最厚的,但需要防守的地盘也最大,因为满世界都是AI原生应用。
详细看看:谷歌周二公布了这些消息:
YouTube
- 一项新的“询问 YouTube”功能允许用户进行对话式搜索查询,并在短视频和传统视频中获取结果。在大多数情况下,结果既包含文本答案,也包含这些答案所来源的视频。
- 该功能目前正在测试中,将于今年夏天更广泛地推出。
AI 模型
- 谷歌 DeepMind 负责人戴密斯·哈萨比斯宣布推出 Gemini Omni,它旨在不同媒体形式之间进行转换,包括文本、音频、图片和视频。不过,其初始版本仅专注于根据文本、图片、音频和视频的组合来生成视频。
- “一切皆可成为创造全新现实的画布,”哈萨比斯表示,并称该模型是迈向所谓通用人工智能的关键一步。
- Omni 将首先提供给 Google AI Plus、Pro 和 Ultra 订阅用户。
- 谷歌还推出了 Gemini 3.5 Flash,这是其低成本主力模型的更新版本。谷歌称其比去年的 Pro 模型更强大,性能接近当今最好的模型,但速度更快。目前,用户可以通过 Gemini 应用和谷歌搜索中的 AI 模式访问该模型。
- 谷歌表示,更高端的 Pro 版本即将推出。
Gemini 应用
- 除了 Gemini 3.5 Flash 和 Gemini Omni,谷歌还新增了一项名为 Gemini Spark 的智能体能力,可以处理重复性任务和其他自主工作。
- 谷歌还计划尽快让用户能够通过电子邮件或聊天来控制其 Spark 智能体。
- Spark 将于本周向部分测试者推出,下周向 AI Ultra 订阅用户推出。谷歌还将新增一个每月 100 美元的更便宜 Ultra 套餐,并将高端版 Ultra 的价格从每月 250 美元下调至每月 200 美元。
Android
- 谷歌上周发布了大部分 Android 相关公告,但确实预览了一项名为 Android Halo 的新功能。它可以让用户看到智能体在手机上执行哪些任务。
Google Workspace
- 谷歌推出了一款名为 Pics 的新图像编辑应用,并改进了 Gmail、Docs 和 Keep 的语音控制。Pics 将首先向一组测试者开放,Pro 和 Ultra 用户将于今年夏天获得访问权限。
- 谷歌还正在将其AI 收件箱功能的访问权限扩展到 Plus 和 Pro 用户。
搜索
- 谷歌此前已在搜索结果顶部以及独立的 AI 模式中加入 AI,现在正在重新设计搜索框本身。搜索框现在会自动扩展以容纳更长的查询,并在输入过程中提供超越传统自动补全的建议。
- 该公司还开始将智能体能力引入搜索,允许用户在新闻和购物等领域进行 24/7 全天候运行的查询。
硬件
- 谷歌还展示了其与三星及眼镜制造商 Warby Parker 和 Gentle Monster 联合开发的新版智能眼镜原型。仅支持语音的型号将于今年秋季推出,而带有小型显示屏的版本将于今年年底进行扩大测试。
- 该公司还首次展示了与 Xreal 合作开发的可穿戴设备 Project Aura。这款产品有点像介于两者之间,其视野远比配备显示屏的眼镜广阔,但沉浸感不及 Galaxy XR 混合现实头显。
他们的说法:“这是紧张的一年,”首席执行官桑达尔·皮查伊在加利福尼亚州山景城拉开活动序幕时表示。
- 皮查伊提到,Google 现在每个月要处理 3200 万亿个词元(token),这是衡量 AI 使用量的一个关键指标。这比一年前每月 480 万亿个、两年前每月 9.7 万亿个都要高。
- “我们心里一直清楚,AI 将对推进我们的使命、让更多人的生活变得更好产生多么深远的影响。”
不过话说回来:皮查伊坦言,人们想要的不只是炫酷的演示。
- “不过,我们现在正处于这样一个阶段:大家希望日常用的产品能带来实实在在的价值,而这正是我们一直关注的重点,”皮查伊在周一的一次简报会上对记者说。
热门跟贴