近日,谷歌推出了全新模型Gemini Omni,号称“从任何输入创造任何内容”。它的首个版本Gemini Omni Flash,将视频生成与编辑变得如同日常对话一样自然。为了深入了解这一模型背后的故事,我们采访了三位来自谷歌DeepMind团队的Omni核心成员:研究科学家Mohammad Babaeizadeh、产品经理Anish Nangia以及研究工程师Sarah Xu。他们分享了对于Omni的愿景,解释了为何首先从视频生成切入,并剖析了Omni究竟能为创作者带来哪些颠覆性的帮助。 三人还畅想了未来的可能性:Omni能否随意换发型?能否把人变成树懒?能否让Sarah的猫直接出现在面前的桌子上?Mohammad说:“这没有上限。”Sarah则表示:“从今以后,它只会越来越好。” 完整访谈视频已上线,欢迎观看,了解更多关于Omni的细节。
打开网易新闻 查看精彩图片
热门跟贴