高德发布3D原生城市世界模型ABot-Earth 0.7,覆盖196个国家和地区
高德称该模型可在消费级GPU上用10分钟生成公里级3D城市场景,效率比传统模式提升1000倍,体验官网已上线并应用于飞行街景2.0。
AI解读:高德9月10日发布ABot-Earth 0.7,宣称是全球首个3D原生城市世界模型。它最直接的卖点是生成方式:输入一张卫星图或一段文字,在消费级GPU上10分钟生成公里级3D城市场景,官方称效率比传统模式提升1000倍。
和以往把卫星影像、航拍素材拼接贴到球面上的数字地球不同,这个模型直接端到端生成3DGS格式场景,并声称能自主补全连续三维空间,用户可以沿任意路线进入、探索、实时交互,而不是只能沿采集好的既定路线看。
实际能用到的入口已经明确:体验官网已上线,能力用于飞行街景2.0,可进入复杂建筑和大型景区,用摇杆漫游3D场景。覆盖范围是高德自己给出的口径,超过196个国家和地区。
需要注意,这些能力描述、效率数字、覆盖范围均来自高德方面,本次来源是高德提供、量子位获授权转载的稿件,没有第三方评测或独立验证。有没有真实体验差距,还得自己上官网点一圈才知道。
9月10日,阿里巴巴集团旗下高德正式发布全球首个3D原生城市世界模型ABot-Earth 0.7。高德称,该模型支持从星球到街景的一体化全尺寸AI生成,并将多种空间信息组织为可连续进入、自由探索和实时交互的三维数字孪生世界。按高德的说法,其数字地球覆盖超过196个国家和地区。
高德方面给出的数据是:输入一张卫星图像或一段文字描述,模型仅用10分钟即可在一块消费级GPU上生成公里级3D城市场景,效率比传统模式提升1000倍。上述能力和数字均来自高德提供、量子位获授权转载的稿件。
模型生成方式与使用入口
与过去主要建立在卫星影像、航拍和点云重建之上的数字地球不同,ABot-Earth 0.7采用3D原生技术路径,使用涵盖空间、时间等信息的时空数据训练模型,端到端一次性生成3DGS(3D Gaussian Splatting,三维高斯泼溅)格式的城市场景。高德称,该模型能自主补全并生成完整、连续的三维空间,用户不再受限于既定路线,可以连续进入、自由探索并获得实时交互反馈。
高德表示,与聚焦小尺寸场景或游戏画面生成的3D模型不同,ABot-Earth 0.7能在单一模型中完成从星球到城市、再到街景地标的全尺寸连续生成:城市级生成需保持路网、街区和建筑群的整体关系,进入地标近景后需还原单体建筑的几何轮廓、立面层次和材质纹理。目前该模型体验官网已上线,相关能力也已应用于飞行街景2.0,用户可通过飞行街景2.0进入复杂建筑、大型景区,操控摇杆漫游3D场景。
高德对空间智能能力层级的表述
高德CEO郭宁称:“大模型理解语言,高德空间智能理解世界。”他认为世界不只存在于语言里,还存在于二维的网络拓扑、三维的空间结构、真实世界的“流动”以及时间的变化中。高德方面称,ABot-Earth 0.7作为其定义的全模态、可预测、3D原生的城市世界模型,核心价值是让Earth从只能浏览的数字地球,变成高德空间智能理解真实世界的入口。
高德将理解真实世界的能力分为三层:三维空间表达、动态感知和时空推演。按其说法,ABot-Earth 0.7将卫星图像、文字描述等信息表达为可进入、可交互的三维世界,为预测、模拟与真实场景中的决策提供支持。
在数据基础上,高德称过去十年作为出行导航App,日调用北斗卫星定位峰值近万亿次,覆盖全球200多个国家和地区。高德空间智能正通过手机、车机、具身机器人、智能眼镜、智能手表等物理终端进入真实生活,相关生态伙伴已在多个终端方向展开合作;高德扫街榜宣布梅赛德斯-奔驰成为全球首个汽车合作伙伴。高德表示,未来其空间智能能力将持续向全行业开放。