麻省理工学院韩松教授的博士生李沐阳,正式官宣创业。他出任 Nunchux AI 联合创始人兼 CEO,公司聚焦多模态生成式 AI 的推理加速。李沐阳在社交媒体上写道:“今天对我来说是有意义的一天。七年前,我还是一名本科生,就开始研究高效生成式 AI。当时很少有人预见,生成式模型会成为人们日常使用的东西。”

这家公司的联合创始人阵容相当扎实:卡内基梅隆大学机器人研究所副教授朱俊彦,以及长期深耕高效 AI、模型量化和系统优化的 Yujun Lin 和 Zhekai Zhang。导师韩松第一时间连发两条祝贺,对学生赞赏有加:“沐阳在这个领域还没火起来的时候就开始研究了,Zhekai 和 Yujun 一直和他站在一起。还有朱俊彦,他是我认识的这个领域最敏锐的人之一,他们共同成立了 Nunchux AI。”

打开网易新闻 查看精彩图片

韩松在另一条推文中补充:“十年间,同一个问题依旧存在,只是变得更难了。俊彦从大学时代起就是我钦佩的人,他一直站在视觉生成的前沿。”

师门创业,一条延续多年的传统

在韩松的实验室,创业不是新鲜事。韩松本人在博士期间与汪玉、姚颂等人共同创立神经网络压缩算法公司深鉴科技,后被 Xilinx 收购。2021年,他与两位清华校友吴迪、毛慧子在加州创立 OmniML,聚焦边缘设备上的高效人工智能,2023年被英伟达收购。

学生们继承了这一传统。2025年,HAN Lab 的第一位博士生王翰锐和同门联合创立 Eigen AI,专注大语言模型推理和模型优化。同年,另一位 HAN Lab 前成员、现任加州大学圣地亚哥分校助理教授刘至简开始筹备创办高效推理公司 Inco AI。今年8月,Inco AI 发布首个产品,一套名为 DFlash 2 的推测解码草稿模型。

Nunchux AI 是师门创业谱系的最新一环,也是其中首家聚焦多模态生成式 AI 的公司。

七年研究主线,三个关键词

创始人李沐阳2019年本科毕业于上海交通大学,后加入 CMU 机器人研究所的朱俊彦课题组攻读硕士,2023年5月进入韩松团队读博。这七年间,他专注于探索一个问题:模型需要具备哪些条件才能真正被人们日常使用?答案是三个词——响应要快、运行要便宜、结果要可靠。

这条主线跨越了图像生成模型的完整代际迭代:从生成对抗网络(GAN)到扩散模型(Diffusion Model),再到今天参数量越来越大的图像、视频乃至世界模型。他近几年的研究工作,组成了 Nunchux AI 的技术路线图。

2020年到2024年,李沐阳主导的 GAN Compression(CVPR 2020)、高效空间稀疏推理(SIGE,NeurIPS 2022)等工作,将神经网络和生成模型的计算成本大幅压缩,推理效率不断提高。2024年,他主导推出 DistriFusion,把高分辨率扩散模型的推理拆分到多张 GPU 上并行执行。

2025年,他和团队利用 SVDQuant,将大型扩散模型推进到 W4A4 推理(权重和激活值都用4位表示),进入扩散模型量化的深水区。

从论文到引擎,再到商业服务

另外两位联合创始人的背景也深嵌于这条主线:Yujun Lin 2025年4月从 HAN Lab 博士毕业,随后担任英伟达研究科学家,专攻计算机架构与机器学习交叉领域的软硬件协同设计;Zhekai Zhang 是 SVDQuant 论文的共同一作,也是 Nunchux AI 的前身、Nunchaku 推理引擎的核心开发成员。

为将 SVDQuant 的理论收益转化为实际速度,李沐阳和团队于2024年底开发出 Nunchaku 推理引擎,用系统级优化实现显著的端到端显存和延迟压缩,让一台手提电脑也能跑动原本需要工作站显卡才能部署的图像生成模型。

Nunchaku 发布后,在开源社区引起巨大反响,其主仓库在 GitHub 上已收获约3,900 stars,至今仍在迭代版本,支持通义 Z-Image 系列、ComfyUI 原生 LoRA 节点、20系显卡的 INT4 等。团队还在积极维护开发者社群,在开源图像生成用户群中建立信任。

以此为底座,Nunchux AI 推出了名为 Modelverse 的商业服务层,将30余个图像、视频和虚拟形象模型整合进一套 API 系统。允许开发者调用 Nunchux AI 针对底层系统优化后的模型,也可以通过同一接口接入合作伙伴提供的模型,运行模式分为主打快速的极速档(Radical Speed)和侧重成本的极值档(Radical Value)。

可以确认的是,公司目前已收到了来自 E