打开网易新闻 查看精彩图片
发布时间:2026年9月25日(美国东部时间),来源:Engadget。作者Steve Dent报道,Google在旗下Gemini 3.8 Live对话模型中新增了名为"Live Avatar"的虚拟形象功能,将实时视觉呈现与语音对话相结合。
新功能上线:在推出Gemini 3.8 Live及Live Extended Thinking模型一周后,Google进一步为其引入视频元素,发布"Gemini 3.8 Live with Live Avatar"版本。该功能被Google描述为"拥有动态视觉形象的聆听、观看与对话体验",旨在为开发者及企业提供可用于生产环境的语音智能体构建模块。
技术特性:根据Google发布的演示视频,Live Avatar提供写实与卡通两种风格的虚拟形象,支持精准唇形同步、自然表情呈现以及"流畅的对话轮转"。虚拟形象能够借助Gemini的高级推理能力,在保持对话的同时后台调用工具并获取数据,实现多模态自然交互。
应用场景:Google表示,Live Avatar主要面向销售支持和客户服务等场景,用户未来可能在电脑或手机屏幕上与这些虚拟形象进行交互。企业客户既可选用Google提供的预设形象库,也可基于高质量参考图像定制专属形象,以保留品牌风格或角色特征。
安全措施:相关定制功能仅向通过企业白名单审核的客户开放。所有虚拟形象均内置SynthID水印,并配备严格的身份保护机制,以确保AI生成内容的透明度。
参考链接:
https://www.engadget.com/2268587/google-video-avatars-gemini-3-8-live-agent/
热门跟贴