输入一张卫星图,或者只写一段文字描述,10分钟后,一块消费级GPU上就长出了一座公里级的3D城市。这是高德9月10日发布的ABot-Earth 0.7给出的能力,官方称其为全球首个3D原生城市世界模型。

效率对比很直白:比传统模式提升1000倍。数字背后是一个路径选择——过去二十年,数字地球基本靠卫星影像、航拍和点云重建,现实被拍下来、拼接好,再贴到屏幕上。用户能看到什么、从哪个角度看,受制于既有素材和采集路径。

打开网易新闻 查看精彩图片

从"拍下来贴上去"到"原生生成"

ABot-Earth 0.7换了一条路。它用涵盖空间、时间等信息的时空数据训练模型,让模型建立对三维空间的原生理解,端到端一次性生成3DGS(三维高斯泼溅)格式的城市场景。

这个技术路径带来的直接变化是:模型能自主补全并生成完整、连续的三维空间。用户不再被既定路线框住,可以连续进入、自由探索,并获得实时交互反馈。城市探索和目的地浏览,因此有了在场感。

一个模型,从星球管到街景

市面上不少3D模型聚焦小尺寸场景或游戏画面生成,ABot-Earth 0.7的野心是尺寸全覆盖——在单一模型里完成从星球到城市、再到街景地标的连续生成。

不同尺度对模型的要求并不一样:

  • 城市级生成,要保住路网、街区和建筑群的整体关系
  • 推进到地标近景,要还原单体建筑的几何轮廓、立面层次和材质纹理
  • 视角从城市全貌切到地标细节,空间结构与视觉信息仍需保持一致

高德方面称,3D原生表征让这种一致性得以维持,并达到照片级视觉效果。覆盖范围上,官方给出的数字是超过196个国家和地区

语言之外,空间智能想理解什么

高德CEO郭宁给了一句判断:"大模型理解语言,高德空间智能理解世界。"在他看来,世界不只存在于语言里,还存在于二维的网络拓扑、三维的空间结构、真实世界的"流动"以及时间的变化中。

按这个逻辑,ABot-Earth 0.7的核心价值是把Earth从一个只能浏览的数字地球,变成高德空间智能理解真实世界的入口。它被定义为全球首个全模态、可预测、3D原生的城市世界模型。

已经能上手体验了

目前ABot-Earth 0.7体验官网已上线,相关能力也已落到飞行街景2.0。用户可以通过飞行街景2.0进入复杂建筑、大型景区,操控摇杆漫游3D场景。

从产品视角看,这条路径的看点不在于"又一个数字地球",而在于生成成本和时间被压到消费级GPU、10分钟的量级之后,三维空间内容的生产门槛会降到什么位置。当生成一座城和生成一张图的时间差距不再悬殊,空间智能能接住的需求,可能才刚开始被讨论。