来源:市场资讯
本报告摘自2026/9/6发布的研报
事件
World Labs 发布新一代世界模型 Atlas,定位为面向空间智能的 omni 模型,从零预训练,原生处理文本、图像、视频、相机位姿与 3D 深度。官方评测中,镜头可控生成任务上第三方评测者对 Atlas 的偏好率为 75%–94%;稀疏视图 3D 重建平均误差 25.3,较最优专用模型低 11.8%。目前仅向部分合作伙伴开放早期访问。我们认为,Atlas 的核心价值在于把视频生成和 3D 重建放进同一套模型里,世界模型正在走向可控制、可复用、可计算的空间。
点评
Atlas 定位于统一的世界模型底座,同时覆盖生成、重建和模拟。模型以 3D 空间作为上下文,可生成最长 1 分钟、最高 1440p 视频,也能直接输出点云和 Gaussian Splatting 等 3D 结果,后续将作为 Marble 等产品的底层模型。
Atlas 的亮点主要有三点:
1)相机位姿原生输入,可逐帧控制镜头;
2)2–3 张图片即可完成基础 3D 重建,并支持 100 张以上图片作为上下文;
3)支持时空重建,少量手机视频即可还原动态场景和机器人仿真环境。官方测试中,Atlas 在镜头控制和 3D 重建上表现领先,其中 7 个重建数据集有 6 个取得最低误差。但目前主要为官方自测,且部分竞品并不支持原生相机输入,横向结果仍需第三方验证。
与 Genie 3、Cosmos 3、Starchild-1 相比,Atlas 最突出的特点是几何能力。Genie 3 更偏实时交互,Cosmos 更偏动作和物理推理,Starchild-1 聚焦实时音视频,Atlas 则把相机、深度、视频和 3D 几何放在同一套模型里。生成的视频可以进一步转成点云和 Gaussian Splatting,直接进入现有 3D 工作流。短板也比较明确,目前还没有原生机器人动作输入,对摩擦、接触、形变和 Sim-to-Real 等关键指标也没有披露。
应用主要看机器人仿真和 3D 内容生产。机器人场景中,Atlas 可以从少量真实视频重建环境,再生成训练数据,降低 Real-to-Sim 的建模成本;内容端则有机会接入 Autodesk 等 CAD/VFX 工作流。World Labs 今年 2 月融资 10 亿美元、估值约 50 亿美元,Autodesk 投资 2 亿美元,后续商业化重点看模型能否真正进入专业 3D 工具链。
世界模型的竞争方向正在转向可控性和可复用性。Atlas 把相机位姿、深度等几何信息变成原生输入,同一个场景可以反复生成不同镜头,同时保持空间结构一致。若这一路线成立,视频生成会进一步向可编辑、可计算的 3D 世界演进,也可能压缩传统 3D 重建专用模型的技术壁垒。
风险
1)市场竞争加剧2)技术验证不及预期3)产品落地不及预期
本报告分析师:
吴叡霖
SFC HK执业证书编号:BVA376
免责声明
本公众号涉及的内容仅供参考,并不构成对所述证券的推荐、邀约或邀约邀请。同时亦不构成任何合约的成立,不构成买卖任何证券或交易的建议, 亦不构成投资建议、财务、法律、税务或其他意见。本公众号对于因此信息和内容或者据此进行投资而直接或间接引起的任何损失不承担任何责任亦不作出任何保证。
热门跟贴