科技会重塑世界,科技革命也会改变很多人的命运。
2026年9月2号,李飞飞创立的World Labs公司发布了一个叫Atlas的新模型。
先说说它跟普通视频生成模型到底差在哪儿。
现在市面上那些视频生成模型,像Sora之类的,它们的核心工作逻辑就是猜像素。你给一段话,它根据这段话去猜下一帧画面里每个点应该是什么颜色,然后把它们拼成一段看起来连贯的视频。它追求的是画面好看、逼真,至于画面里的东西符不符合物理规律,它其实不太管,也没法管。有时候你看AI生成的视频,人会穿墙而过,杯子会自己飘起来,就是因为这个原因。这也是很多人要反复用代币抽卡一样,去赌生成的影像是好的,可用的,没有漏洞的。
但Atlas这套东西走的是另一条路。它不满足于画个平面,它要在内部先搭一个三维的空间模型出来,把所有东西都放在这个三维空间里,然后再基于这个空间去生成画面。所以他知道桌子前面有个椅子,椅子是在地上的,人走过去要绕过桌子,而不是直接穿过去。它生成的画面背后是有空间逻辑支撑的。
另外,普通视频模型对镜头的控制很差,你只能给个大概的描述,说镜头慢慢推进之类的,但具体推进到什么位置、什么角度,它有自己的想法,你说了不算。Atlas能做到像素级的相机控制,你可以指定具体的视角和运动轨迹,它基本能按照你的要求来。
还有就是输出的东西不一样。普通视频模型最后给你一段视频文件,就是个MP4。Atlas能输出显示的3D模型文件,像点云或者3D高斯泼溅那种格式,可以直接导入到别的软件里继续用。
说个粗糙的比喻吧。普通视频模型有点像那种画工很厉害的画家,你让他画个房子,他能画得跟照片一样真,但这个房子只有正面能看,你要是想绕到侧面去看一眼,他画不出来,因为他压根没画侧面。而Atlas更像一个做了建筑模型的人,他手里捏了个立体的模型,你想从哪个角度看都行,甚至能把屋顶掀开看里面的结构。
接下来谈谈会影响到哪些行业。
影视和游戏制作肯定是头一批。以前做特效电影或者3A游戏,要做一个场景,得概念设计师先画草图,然后建模师一点点建,周期很长。现在有了这个,导演或者策划可以直接用文字描述一个场景,或者给几张参考图,Atlas就能快速生成一个可以自由控制镜头、画质还挺不错的3D世界。前期用来做概念设计和预可视化,效率能提高不少。那些繁琐的、重复性的场景搭建工作,可能会被大幅压缩。
机器人领域也很有用。训练机器人需要大量的数据,尤其是它在真实环境里行动的数据,采集成本非常高。Atlas有个能力叫真实到模拟,给它几张真实环境的照片,它就能生成一个虚拟的训练场,机器人可以直接在那个虚拟环境里训练,这能省下很大一笔钱。因为商用机器人是机器人市场下半年的重头戏,很多人工智能行业都在考虑怎么训练机器人在家务,仓库等行业的落地,所以虚拟训练场就非常重要。
自动驾驶也是类似的道理。那些极端天气、突发状况的路测数据不好采集,用Atlas可以大量生成这种虚拟场景,用来训练自动驾驶的决策系统。
当然了,我是设计师,我更关心建筑设计和园林设计这块。
我觉得它不是简单的替代,更像是把设计师的工作方式给重新定义了一下。
以前设计师接到一个项目,要做方案,脑子里有个想法,但得花不少时间去画草图、建草模,才能把这个想法变成一个可以给别人看的、能讲清楚的东西。现在有了Atlas,你把这个想法用关键词或者很潦草的草图喂给它,它几秒钟就能给你生成好几个不同版本的3D空间方案。设计师可以在这些方案的基础上快速迭代,把精力更多地放在推敲空间关系、功能布局这些更核心的事情上,而不是耗在建模渲染这些技术活上。
园林设计也是一样。你可以让它模拟出这个园林在春夏秋冬不同季节的样子,或者在早上、中午、傍晚不同光线下的效果。以前做这种分析要花很长时间,现在几分钟就能看个大概。
而且Atlas这个工具不是要取代现有的设计软件。设计师可以先拿它快速生成一个空间的布局草稿,然后把模型导出来,放到3D或者SU这些专业软件里去深化细节、或者直接用这个当白模型,用来出施工图。它是工作流前端的一个加速器,帮设计师更快地度过最磨人的方案初期。
当然,这对设计师的能力要求肯定会变。以后衡量一个设计师水平的标准,可能不再是你建模多快、渲染多真,而是你的创意本身够不够好,你对空间的感受力、对功能的理解够不够深。那些初级的、以操作为主的工作,比如专门做效果图、专门翻模的岗位,需求肯定会减少。但能驾驭这些工具、能提出好方案的设计师,价值反而会更高。
或者说,未来可能人人都可以用这个来设计,效果图这个行业可能完全的会消失。
热门跟贴