2026-10-10
今年的云栖,为什么大家都想让汽车“上班”办事?
An agent in a car,是现在进行时。A car as an agent,是将来进行时。 作者 | 高 飞 今年云栖大会,汽车依然是最受大家关注的AI场景之一,我也一样,尤其是智能座舱。Agent是今年的年度热词,我关注智能座舱理由可以从Agent的定义说起。 AI领域对Agent的研究其实有几十年的历史了。Russell和Norvig写的那本AI专业学生几乎人手一册的《人工智能:一种现代方法》里给出的定义,从1990年代到今天没怎么变过:一个能够感知环境、并对环境采取行动的系统。如果用这个尺子去量过去两年的大模型产品,数字空间的Agent已经有了很多进展,无论是Coding(编码)还是Wording(或者说Working,办公)。但这些Agent更多活在屏幕里的,和日常消费生活关联较小。 而要想让Agent走出屏幕,需要两样东西:感知真实世界的传感器,以及对真实世界施加影响的执行能力。问题就变成了:哪里有一个现成的物理空间,传感器已经装好,执行能力也已经到位,Agent进来就能开始工作?应该就没有比汽车座舱更适合的地方了。 因为座舱是Agent在物理世界里,与消费者触点最直接,也是最自然的落脚点。 一辆车的座舱,传感器出厂预装,车身系统可以操控,服务可以调度。感知、推理、行动三个条件,在几平米之内凑齐了。这样的物理空间并不多见。今年云栖大会汽车行业峰会的座舱圆桌主题就叫“智能座舱迈入Agent时代”。 上了车,大家都是i人 回溯智能座舱的发展史,聊天可能是一个公认的起点。 每一个座舱都有一个AI助手,每一个AI助手都能聊天,但是聊天却不是人们在车上的刚需。 阿里云智能集团公共事业部AI汽车行业解决方案总经理霍健是这场智能座舱圆桌的主持人。大会期间,他和我交流时说:他近期在与多家车企座舱团队交流时观察到,闲聊并不是用户使用座舱的核心场景。相比长时间对话,用户更关心系统能否在合适的时机,高效完成车控、导航和服务任务。行业从2023年起把大模型装进座舱,拟人化对话、情感交互、多轮聊天,发布会的Demo演示每次能赢得掌声。但两三年做下来,消费者的反应是:上了车,其实不太想聊天。 我猜也有很多人的打车软件上,点亮了“不想聊天”选项。 霍健自己的体验也是如此:“工作一天,已经说了很多话,开车回家时,不太可能再陪座舱聊一两个小时。” 不聊天,那大家需要座舱做什么? 之前采访北汽研究总院院长助理冯硕时,他从产品阶段的角度,把北汽座舱的发展分成三段:第一阶段做娱乐和信息,第二阶段做交互和功能,第三阶段做体验和有价值的服务,前两个阶段的逻辑是被动的:用户问什么就答什么。第三阶段的逻辑是主动的:系统能完成一个用户的目标任务。比如用户说“帮我在到家之前把晚饭点好”,自己编排路径去完成,把导航、时间预测、下单、支付串成一条链。人到了,外卖也到了。 蔚来副总裁、数字座舱与软件开发负责人吴杰在座舱圆桌上提到,NOMI从诞生那天起就有人格设定:懂我的、温暖的、得力的助手、得体的。一直恪守这个原则,这是后续一切智能提升的内核。NOMI既能陪伴,也是个得力助手,把事干成。 长城汽车技术中心副总裁姜海鹏说:原来座舱是对话,现在是接管行动目标。 Agent系统会把用户的需求转化成多任务编排,跨域协调,最终把任务完成交付。“这套系统能够帮助用户解决实际的问题,不再是单纯的对话。” 这些观点的指向是如此的一致。阿里云智能集团公共云事业部副总裁、AI汽车行业总经理李强在圆桌之前的开场致辞里直接做了点题:座舱的竞争已经从“大模型要不要上车”转变为“Agent能不能把事情办成”。这种场景其实还可以有一个古老的中文表达:出门办事。只不过过去“出门办事”是到了地方才开始办,现在座舱里有了Agent,有些事情在路上就可以顺路办了。 座舱竞争的维度就此改变。 从聊天走向办事,竞争不再只看模型有多聪明,更看模型、Agent工程与服务生态能否协同,稳定地把事情办成。 A Cloud,A Model,An Agent,A Context,A Space,A Deed 生态能把事情办成,前提是一套能力得先到位。 诺兰今年暑假的《奥德赛》开场有一句出圈的台词。Travis Scott扮演的吟游诗人用六个词就讲完了整个故事:a face,a fleet,a war,a man,a thought,a trick。 所以,我突发奇想,接下来也用六个词把座舱办事这件事讲清楚。毕竟,奥德修斯也是一直在路上的人。 这六个词是:a cloud,a model,an agent,a context,a space,a deed。一片云提供算力,一个模型提供理解,一个Agent提供行动力,一套上下文让Agent认识用户,一个空间让一切落地发生。最后:一件事被办成。 前三个是能力底座,第四个让Ag