打开网易新闻 查看精彩图片

国内大模型赛道再掀海外顶尖人才争夺战!一则震动 AI 圈的人事消息正式传开,马斯克旗下 xAI 的多模态理解负责人蔺旭东,已正式入职腾讯混元,出任混元模态内容生成算法负责人电子工程专...。 从谷歌 DeepMind Gemini 到马斯克 xAI,再到腾讯混元,这位手握国际一线多模态项目实战经验的顶尖科学家空降,标志着腾讯混元多模态升级之战,已经按下加速键。

重磅人事落地,海外 AI 骨干奔赴腾讯

据多家科技媒体从知情人士处获悉,蔺旭东已经完成入职流程,正式加入腾讯混元团队,主攻多模态内容生成方向的算法研发工作。 截止目前腾讯官方还未发布正式人事公告。

翻开蔺旭东的履历,可以说是实打实的 “全明星路线”。本科毕业于清华大学数理基础科学专业,之后远赴哥伦比亚大学攻读博士学位,主攻嵌入学习、视频分析、生成模型方向,读书期间就先后进入腾讯、Facebook‑AI、谷歌进行实习深造,早期就产出过 Vx2Text 知名多模态科研成果。

博士毕业之后,蔺旭东 2024 年加入谷歌 DeepMind,深度参与 Gemini 大模型多模态预训练、后训练等核心研发工作,亲身经历了谷歌旗舰多模态大模型的打磨全过程。2025 年 11 月,蔺旭东跳槽加入马斯克创办的 xAI,坐上多模态理解负责人一职,全权负责 xAI 多模态理解、生成模型训练工作,在 xAI 任职时长约十个月,是海外头部 AI 团队多模态板块的核心骨干人员。

混元密集换血,一场大刀阔斧的团队重构早已开启

蔺旭东的到来,并不是一次孤立的人才引进,而是腾讯混元今年一整套组织改革当中的关键一环。回顾近两个月混元的人事变化,动作接连不断: 7 月,原混元多模态理解负责人胡瀚离职创业;OpenAI 研究员田永龙加入腾讯,接手视觉语言模型研发;7 月 24 日腾讯正式宣布,混元大语言模型部门与多模态模型部门合并,成立全新的基础模型部,由腾讯首席 AI 科学家姚顺雨统一掌舵,两条业务线彻底打通,朝着大模型 + 多模态一体化方向发力。

一边是原有团队人员迭代,另一边是田永龙、蔺旭东等一批拥有 OpenAI、DeepMind、xAI 海外大厂背景的顶尖人才陆续入局。一进一出之间,混元全新的多模态研发核心班子,已经悄然成型。业内消息显示,此前负责混元文生视频、文生图片算法的负责人钟钊,近期也传出离职消息,多模态生成板块正迎来新一轮洗牌调整。

蔺旭东加盟,腾讯混元最想补齐哪一块短板?

多模态能力,已经成为当下各大国产大模型比拼的主战场。图片生成、长视频生成、图文视频跨模态理解,都是接下来 AI 落地应用的刚需赛道。 蔺旭东深耕视频生成、多模态融合训练多年,拥有 Gemini、xAI 两大国际项目的一手训练经验。他的到来,最直接的作用,就是补强混元在视频生成、多模态内容生成方向的算法实力,推动混元打通 “理解‑生成” 一体化能力。

过去混元在文字大模型赛道口碑稳健,但是在文生视频、高质量图像生成等可视化多模态产品上,和行业第一梯队相比还有追赶空间。引进海外实战派人才,腾讯的目标已经非常清晰:补齐多模态生成这块短板,加速混元视频大模型的落地,追赶国内多模态赛道第一梯队。

人才回流潮来袭,国产大模型开启抢人大战

蔺旭东从马斯克 xAI 回归国内大厂,也是最近一股海外顶尖 AI 人才回国浪潮的缩影。随着国内大模型赛道竞争白热化,百度文心、阿里通义、字节豆包、腾讯混元,各家巨头都开始疯狂争抢拥有海外一线大模型训练经验的算法人才。 多模态已经成为大模型下半场决胜点,谁能够率先跑出稳定高质量的文生视频产品,谁就能抢占下一轮 AI 商业化的风口。

对于腾讯而言,在微信、QQ、视频号海量流量沃土加持之下,一旦混元多模态视频能力取得突破,后续落地场景空间巨大:短视频 AI 生成、智能剪辑、数字人、企业 AI 创作工具,都有望成为新的增长点。

当然人才引进只是第一步,接下来蔺旭东能否快速适配混元技术路线,团队磨合能否顺利产出突破性的多模态成果,依旧充满悬念。整个 AI 行业都在等待混元交出全新的多模态答卷。