9月10日,阿里巴巴集团旗下高德正式发布全球首个3D原生城市世界模型ABot-Earth 0.7。依托3D原生技术架构与高德海量时空数据积累,ABot-Earth 0.7支持从星球到街景的一体化全尺寸AI生成,并将多种空间信息组织为可连续进入、自由探索和实时交互的三维数字孪生世界,从而构建起目前覆盖范围最广的数字地球,覆盖超过196个国家和地区。
“大模型理解语言,高德空间智能理解世界。”高德CEO郭宁认为,世界不只存在于语言里,它更存在于二维的网络拓扑、三维的空间结构、真实世界的“流动”以及时间的变化中。ABot-Earth 0.7作为全球首个全模态、可预测、3D原生的城市世界模型,其核心价值是让Earth从一个只能浏览的数字地球,变成了高德空间智能理解真实世界的入口。
3D原生重建数字地球,城市探索有了在场感
过去二十年,数字地球主要建立在卫星影像、航拍和点云重建之上,现实世界被拍摄、拼接后呈现在屏幕中,本质上仍是把现实“拍下来再贴上去”。用户能看到什么、从哪里看,往往受既有素材和采集路径限制。
ABot-Earth 0.7开创性地采用3D原生技术路径,使用涵盖空间、时间等信息的时空数据训练模型,使其建立对三维空间的原生理解,从而端到端一次性生成3DGS(3D Gaussian Splatting,三维高斯泼溅)格式的城市场景。
输入一张卫星图像或一段文字描述,模型仅用10分钟即可在一块消费级GPU上生成公里级3D城市场景,效率比传统模式提升1000倍。并且,ABot-Earth 0.7能自主补全并生成完整、连续的三维空间,用户不再受限于既定路线,而是可以连续进入、自由探索,并获得实时的交互反馈,让城市探索和目的地浏览有了在场感。
与聚焦小尺寸场景或游戏画面生成的3D模型不同,ABot-Earth 0.7能够在单一模型中,完成从星球到城市、再到街景地标的全尺寸AI连续生成。
在城市级生成中,模型需要保持路网、街区和建筑群的整体关系;进入地标近景后,则要进一步还原单体建筑的几何轮廓、立面层次和材质纹理。ABot-Earth 0.7使用3D原生表征,使视角从城市全貌推进到地标细节时,空间结构与视觉信息仍保持一致,并达到照片级视觉效果。
目前,ABot-Earth 0.7体验官网已上线,相关能力也已应用于飞行街景2.0。用户可通过飞行街景2.0进入复杂建筑、大型景区,操控摇杆漫游3D场景。
理解真实世界的入口
高德认为,理解真实世界需要三层能力:第一是三维空间表达——从地球到城市、从道路到建筑、从室外到室内,还原真实世界的细节与层次,形成亲临的在场感;第二是动态感知——从车流到人流、从路况到商户、从白天到黑夜,捕捉世界每一刻的变化与脉动;第三是时空推演——从出发到到达、从单点到全局、从现在到未来,看透真实的上下文关联,给出环环相扣的最优解。三层能力由空间表达向动态感知、再向时空推演层层递进,共同构成高德的空间智能。
在这一框架下,ABot-Earth 0.7将卫星图像、文字描述等信息表达为可进入、可交互的三维世界,成为AI理解世界如何连接、如何变化和如何运行的入口,为预测、模拟与真实场景中的决策提供支持。
过去十年,高德作为中国最大的出行导航App,日调用北斗卫星定位峰值近万亿次,覆盖全球200多个国家和地区。海量的真实世界时空样本,为高德在三维空间表达的基础上,进一步提升动态感知与时空推演能力提供数据基础。
目前,高德空间智能正通过手机、车机、具身机器人、智能眼镜、智能手表等物理终端进入真实生活,相关生态伙伴已在多个终端方向展开合作。高德扫街榜宣布梅赛德斯-奔驰成为全球首个汽车合作伙伴,成为这一生态在出行场景中的最新落点。
未来,高德空间智能的能力将持续向全行业开放,与开发者及生态伙伴共同推动空间智能在真实世界落地。
附:
ABot-Earth 0.7体验官网:https://abot-earth.amap.com/
本文由高德提供,量子位获授权转载,观点归原作者所有。