9月10日,阿里巴巴集团旗下高德正式发布全球首个3D原生城市世界模型ABot-Earth 0.7。该模型支持从星球到街景的一体化全尺寸AI生成,覆盖超过196个国家和地区,是目前覆盖范围最广的数字地球。体验官网已同步上线,相关能力也已应用于飞行街景2.0。

技术路径革命:从“拍下来再贴上去”到3D原生生成
过去二十年,数字地球主要建立在卫星影像、航拍和点云重建之上,现实世界被拍摄、拼接后呈现,本质上仍是把现实“拍下来再贴上去”,用户能看到什么、从哪里看,往往受既有素材和采集路径限制。
ABot-Earth 0.7开创性地采用3D原生技术路径,使用涵盖空间、时间等信息的时空数据训练模型,使其建立对三维空间的原生理解,从而端到端一次性生成3DGS(三维高斯泼溅)格式的城市场景。
高德CEO郭宁表示:“大模型理解语言,高德空间智能理解世界。世界不只存在于语言里,它更存在于二维的网络拓扑、三维的空间结构、真实世界的‘流动’以及时间的变化中。”
效率跃升:10分钟生成公里级城市,提升1000倍
输入一张卫星图像或一段文字描述,模型仅用10分钟即可在一块消费级GPU上生成公里级3D城市场景,效率比传统模式提升1000倍。
更重要的是,ABot-Earth 0.7能自主补全并生成完整、连续的三维空间——用户不再受限于既定路线,而是可以连续进入、自由探索,并获得实时交互反馈,让城市探索和目的地浏览有了“在场感”。

全尺寸一致:从星球到街景的单模型连续生成
与聚焦小尺寸场景或游戏画面生成的3D模型不同,ABot-Earth 0.7能够在单一模型中完成从星球到城市、再到街景地标的全尺寸AI连续生成。
在城市级生成中,模型需要保持路网、街区和建筑群的整体关系;进入地标近景后,则要进一步还原单体建筑的几何轮廓、立面层次和材质纹理。依托3D原生表征,当视角从城市全貌推进到地标细节时,空间结构与视觉信息仍能保持一致,并达到照片级视觉效果。这种“跨尺度一致性”是传统3D重建方案难以企及的能力。
从数字地球到空间智能入口
ABot-Earth 0.7被定位为全球首个全模态、可预测、3D原生的城市世界模型,其核心价值是让数字地球从一个只能浏览的静态产品,变为高德空间智能理解真实世界的入口。
目前,该模型的能力已落地于飞行街景2.0,用户可进入复杂建筑、大型景区,操控摇杆漫游3D场景。这标志着高德正将其在导航、地图领域积累的时空数据优势,转化为空间智能的核心竞争力。
ABot-Earth 0.7的核心突破在于“3D原生”这四个字——它不再是给二维图像叠加一个三维外壳,而是让模型从训练的第一天起就在三维空间中理解世界。这种路径选择带来的直接结果是效率和一致性的双重跃升:10分钟生成一座城,跨尺度视角无缝切换。当大模型正在竞争“谁更懂语言”时,高德选择了一条差异化赛道——让AI真正“懂空间”。这不仅是一个技术产品,更是高德在AI时代重新定义自身角色的战略落子。