9月10日,阿里巴巴集团旗下高德正式发布全球首个3D原生城市世界模型 ABot-Earth 0.7。在杭州举行的高德扫街榜2026年度发布暨颁奖盛典上,高德CEO郭宁宣布了这一成果,称其将把数字地球从”只能浏览”推进到”可以理解”。
从卫星图到3D城市,只要10分钟
ABot-Earth 0.7 采用的是3D原生技术路径:用涵盖空间、时间等信息的时空数据训练模型,让它建立对三维空间的原生理解,再端到端一次性生成3DGS(3D Gaussian Splatting,三维高斯泼溅)格式的城市场景。
据官方介绍,输入一张卫星图像或一段文字描述,模型只用10分钟,就能在一块消费级GPU上生成公里级的3D城市场景,效率比传统模式提升1000倍。更关键的是,模型可以自主补全、生成完整且连续的三维空间,使用者不再受限于既定路线,而是能连续进入、自由探索,并实时获得交互反馈。

一个模型,从星球一路推到街景
与聚焦小尺寸场景或游戏画面生成的3D模型不同,ABot-Earth 0.7 可以在单一模型内完成从星球到城市、再到街景地标的全尺寸AI连续生成。
这对模型的一致性提出了很高要求:在城市级生成中,需要保持路网、街区和建筑群的整体关系;推进到地标近景后,则要进一步还原单体建筑的几何轮廓、立面层次和材质纹理。ABot-Earth 0.7 依靠3D原生表征,让视角从城市全貌推进到地标细节时,空间结构与视觉信息仍保持一致,并达到照片级视觉效果。

“大模型理解语言,高德空间智能理解世界”
郭宁在发布会上提出,理解真实世界需要三层能力:第一是鲜活而立体的三维空间表达,从地球到城市、从道路到建筑、从室外到室内,还原真实世界的细节与层次;第二是实时而连续的动态感知,从车流到人流、从路况到商户、从白天到黑夜,捕捉世界每一刻的变化;第三是精准而稳定的时空推演,从出发到到达、从单点到全局、从现在到未来,给出环环相扣的最优解。
支撑这三层能力的,是长期积累的真实世界时空样本。官方数据显示,过去十年高德导航日调用北斗卫星定位峰值近万亿次,业务覆盖全球200多个国家和地区,沉淀了来自路网、建筑、地形、街景以及每一次真实导航、避堵与纠错的海量数据。在此基础上构建的数字地球,覆盖范围超过196个国家和地区。
已落地飞行街景2.0,能力将向全行业开放
目前,ABot-Earth 0.7 的体验官网已经上线(abot-earth.amap.com),相关能力也已应用于飞行街景2.0。使用者可以通过飞行街景2.0进入复杂建筑、大型景区,用摇杆操控漫游3D场景。
在实际出行场景里,这套能力可以提前把目的地还原为可自由探索的三维空间,让使用者出发前就看清剧院座位视野、商场内部动线以及景区地形,形成身临其境的在场感。
生态方面,高德空间智能正通过手机、车机、具身机器人、智能眼镜、智能手表等物理终端进入真实生活,已有生态伙伴在多个终端方向展开合作。高德扫街榜同时宣布,梅赛德斯-奔驰成为其全球首个汽车合作伙伴。
按照高德的说法,空间智能的能力未来将持续向全行业开放,与开发者及生态伙伴一起推动空间智能在真实世界落地。