把AI搜索塞进手机是什么样的体验?谷歌最近给了答案——不是塞进一个云端App,而是把一个真正能"装在兜里"的开源模型送给了全世界。

一个比安装包还小的AI

10月上旬,谷歌正式开源了新一代多模态嵌入模型 EmbeddingGemma 2。所谓"嵌入模型",通俗讲就是把文字、图片、声音这些不同形式的内容,统一"翻译"成计算机能比对的数学空间,让机器理解它们之间的关联。

打开网易新闻 查看精彩图片

这个模型最大的卖点就俩字:轻。全部参数只有7.4亿(740M),运行时占用内存不足600兆,在部分端侧场景下内存占用甚至能压到191兆左右。600兆是什么概念?远小于很多App更新包的大小。也就是说,这款AI能轻轻松松跑在普通手机、笔记本和浏览器里,而且不需要联网。

断网之后,照片录音照样搜

过去咱们用手机搜东西,几乎都得联网,把内容传到云端服务器去处理。而 EmbeddingGemma 2 主打的是"本地搜索"——所有数据都在设备上处理,不需要上传云端,既快又保护隐私。

打开网易新闻 查看精彩图片

谷歌CEO皮查伊特别强调,这也是他们的首个原生多模态开源嵌入模型。举个例子:你说一句"鸟在唱歌",它能在你的手机里同时找出鸟的照片和鸟叫的录音;拍过的视频片段、录过的会议音频、存下来的文档,都支持用自然语言一句话去搜。

打开网易新闻 查看精彩图片

在浏览器端的实测里,模型响应时间只有大约22毫秒。在图像和视频检索上,它的表现还超过了同量级的 Jina v5 Omni-Nano 等对手。

能力不缩水,还支持上百种语言

别看它身材小,本事却不小。EmbeddingGemma 2 基于谷歌新一代的 Gemma 4 架构打造,采用对商业友好的 Apache 2.0 开源协议发布。它能同时理解文字、图片、视频和音频,支持100多种语言,上下文窗口为8K token。

打开网易新闻 查看精彩图片

在代码检索的测试中,它的成绩比上一代足足提升了近10分。此外,它还支持 Matryoshka 表示学习,可以把输出向量压缩到512、256甚至128维,进一步降低存储和算力需求。

值得一提的是,上一代产品 EmbeddingGemma 上线以来累计下载量已超过2000万次,此次升级把嵌入能力从纯文本扩展到了多模态,有望进一步壮大谷歌的开源生态。

AI搜索正在从云端走向你的口袋

过去两年,AI搜索的舆论焦点大多停留在"冲击新闻流量"这类云端应用层面。而 EmbeddingGemma 2 的出现,标志着AI搜索开始真正下沉到个人设备端。谷歌还专门演示了四个应用场景:图像搜索、视频片段定位、本地文件检索以及实时决策。

打开网易新闻 查看精彩图片

开发者可以将它与 Gemma 4 结合,在手机等设备上搭建离线、隐私优先的本地AI搜索能力。对普通用户来说,最直观的改变或许是:以后在地铁、在飞机、在野外没有信号的地方,你的照片、视频和录音照样能被这个不到600兆的AI快速翻出来。

谷歌CEO皮查伊的那句话或许正在成为现实——把AI搜索"装进口袋",这次是真的装进去了。