
作者|孙芮
微信|lombredeau
AI已经能把一趟旅行安排得明明白白:去哪玩、吃什么、住哪里,都可以列成详细攻略。
但走进商场,找个几十米外的厕所,你可能仍然需要来回确认:走哪条通道,要不要上楼,入口究竟在哪边?
对传统导航来说,手机横着竖着都没什么差别,反正工作内容主要是三件事:报路口、算距离,以及在你走错之后提醒掉头。
但导航Live颠覆了传统导航。它先让手机“支棱”起来——把手机从支架上取下来、竖起来,摄像头开始看路,并结合位置和方向,把厕所位置转化为跟当前环境对应的视觉引导,屏幕里的数字信息也就和眼前的现实世界对应上了。
9月10日,高德地图发布扫街榜2026,并推出导航Live功能。高德导航产品负责人孙冲在接受《硅星人》采访时表示:“导航Live的本质,是一个具备‘时空上下文+现场感知+端到端行动力’的具身智能体。它让用户的手机变成了真实世界的搜索框,可以识别并解读眼前的建筑、景点、店铺和环境信息。”
听起来像是给导航装上了“AI眼睛”,但“看见”只是第一步。
比如在一座陌生城市的老街区,开车或者步行来到三个几乎挨在一起的窄巷口,传统导航可能只会提醒“前方50米右转”。方向没错,至于究竟是哪一个口,往往还得靠自己猜。
导航Live要做的,是把地图上的右转变成眼前可辨认的路:从挂着红灯笼的便利店右侧进去,留意左边正在卸货的面包车。要是你临时改了主意,想换一家本帮菜,它也能接着前面的对话继续找店,并根据当前位置和道路条件重新规划路线。
手机竖起来并不难。难的是让它知道自己看见了什么、你正身处哪里,以及接下来该做什么,高德要做的是让导航理解真实世界。

1
高德如何让导航理解真实世界
导航Live看起来只是将摄像头加入导航,但真正困难的并不是让AI识别一张图片,而是让AI理解图片背后的复杂动态的空间关系。
它需要同时理解用户在哪里、朝向哪里、眼前是什么,以及这些对象与道路、建筑、地点之间是什么关系。
例如,识别出眼前的是一家餐厅只是视觉识别;进一步确认这家餐厅对应地图中的哪个POI、距离用户多远、入口在哪里,则涉及位置、地图和空间关系的综合判断。
而这些能力背后,正是高德空间智能发挥作用的地方。可以简单理解为三个层面:
首先是动态感知,将摄像头画面、位置和传感器信息,以及实时交通等数据结合起来,让AI理解用户眼前正在发生什么;
其次是时空推演,不只判断当前看到了什么,还结合道路和交通状态理解接下来可能发生什么;
最后是三维空间表达,将地点、道路和环境等数字信息准确地对应到现实空间中,让AI的理解能够随着用户移动持续保持在正确的位置。
因此,导航Live背后是一套从“感知—理解—推演—行动”串起来的空间智能能力。摄像头让AI能够看到现实世界,而位置、地图、交通和三维空间数据,则让它真正理解自己看到的东西处于什么位置、与用户是什么关系,以及下一步可以做什么。
这也让导航Live更像一个能跟着任务一直走下去的智能体,而不是一问一答的视觉入口。它看到的不只是画面里的招牌,还包括你此刻在哪、朝哪个方向、是在走还是停着,以及周边的路况正在发生什么变化。
因此它不必等着被提问。车道快要变窄、前方弯道有盲区,或者路过一家评价不错的老店,它可以在恰当的时机主动说一句,而不是让人像用工具一样一遍遍下指令。
认出来之后,它还能接着做事。通用视觉模型识别出一个对象,通常给的是一段介绍;而导航Live识别出一个地点后,可以直接接上高德已有的能力——重算路线、指向具体入口、继续查这家店的信息,把“认出来”变成“下一步怎么走”。
1
实测导航Live,找厕所再也不是难题了
上述变化更多体现在产品逻辑上,那么实际使用导航Live,可以更直观地看到这种变化。
我们从室内找厕所,和选餐厅这两个日常化的场景做了实测。
相信大家经常会遇到室内找厕所这个难题,这是一个非常高频的导航需求。
通常情况下,我们需要打开地图搜索,从导航软件给出的POI(信息点)中选择目标位置。但在商场、景区等复杂空间中,地图上的位置并不一定能够直接转化为现实中的行动指引。
用户知道厕所距离自己只有几十米,却仍然可能需要在多个入口、楼梯、电梯和通道之间进行反复判断。
导航Live把这一步简化了。点开搜索框旁边的摄像头图标,AI获取当前环境,再结合位置和方向,把地图上的厕所POI转化成与眼前环境对应的视觉引导。

在此过程中,导航Live不仅提供了目的地信息,还尝试建立地图坐标与现实空间之间的对应关系。对于商场、街区等空间相对复杂的场景,导航Live可以帮助减少寻找时间和不必要的绕行。
第二个场景则是逛街选餐厅这类更复杂但同样高频的需求。当你在旅行过程中感到饥饿疲惫,想在附近找一家餐厅吃饭时,往往街道上的多家餐厅会让你一时难以抉择。
过去,通常需要先确认各家店名,再进入地图或点评产品搜索,查看评分、评价和推荐菜等信息。
导航Live则提供了一种更加简便的交互方式。
我们可以将摄像头对准街道,通过导航Live询问高德“这家店评分怎么样”“哪家店更适合一人食”这些问题。

导航Live可以直接识别取景框内的餐厅,点击扫街榜的图标还可以有更多餐厅评分、人均消费等信息。

这实际上是把视觉、地点和消费信息一次性关联起来:先认出眼前的餐厅,再对应到地图中的具体POI,然后取回评价信息、按你的问题组织答案。原本“识别对象—搜索对象—获取信息”的长链路,被压缩成了一次提问。
找厕所解决的是当前位置与下一步行动的关系,问餐厅解决的是现实对象与数字信息的关系,两者共同回答的是同一个问题:AI如何进入并理解你正在经历的现实场景。
1
空间智能重塑一整天生活体验
当然,高德的空间智能能力并不只服务于导航Live。飞行街景2.0,将目的地变成一个可以自由探索的三维空间,让用户能自由调整观看位置、角度和高度,在出发前就获得身临其境的在场感。扫街榜结合真实到店、专程前往、反复到店等聚合行为信号,以及经授权的评价信息,帮助用户判断一个地方值不值得去;避雷指南则把用户做好的攻略放进具体的时间、空间和交通条件中验证,看原本静态的行程是否真的可执行。
几项产品背后,其实是高德将空间智能逐步应用到出行不同环节的过程。
发布会上亮相的ABot-Earth 0.7,是高德三维空间表达能力的一项直观呈现。作为3D原生城市世界模型,它将空间、时间与现实信息组织进可连续进入、自由探索和交互的三维世界。
从扫街榜到飞行街景2.0、避雷指南、导航Live,再到ABot-Earth 0.7,高德探索的其实是同一个问题:如何让AI和现实世界对上。
今天生成一个答案已经不难,难的是让答案落在此时、此地。出行需要的从来不是一个脱离场景的回答,而是与眼前这条街、这个入口、这一刻的路况有关的信息。
要做到这一点,一端是长期积累并持续更新的地图、道路、位置和街景,一端是把这些数据变成空间理解的能力。前者决定AI能不能接触真实世界,后者决定它能不能看懂。
地图过去回答的是世界在哪里,现在要回答的是,眼前这个世界和你的下一步之间是什么关系。这也是高德成为AI进入现实世界的入口的原因。
免责声明:本文章仅代表作者个人观点,不代表本平台的立场和观点。本文章仅供信息分享,不构成对任何人的任何投资建议。用户与作者之间的任何争议,与本平台无关。如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到support@aicoin.com,本平台相关工作人员将会进行核查。