小鹏给VLA装上“时间”,自动驾驶开始学会“预测未来”
创始人
2026-08-30 14:07:46

(来源:博客作者 博客COVER)

如果用一个词来形容827日小鹏第二代VLA的“TIME”主题发布会,大概率是:极客。

这是一场相当典型的“小鹏风格发布会”,没有太多煽情铺垫,也没有让观众激动尖叫的价格包袱,小鹏集团通用智能中心负责人刘先明在台上不紧不慢地讲着大模型架构、推理方式、TokenAI Infra等等术语。

如果在听的时候稍微一走神,甚至很容易在某个环节跟丢。

但除去这些专业术语,这场像高数课一样晦涩的发布会讲的事情其实并不复杂:小鹏想让车载自动驾驶AI,不再局限于“看清眼前发生了什么”,而是让其获得对时间的理解。

按照发布会说法,小鹏第二代VLA此次将迎来重大升级,核心变化是从过去对物理世界的“3D空间理解”升级为“4D时空理解”。全新XOS 6.3.0将在小鹏刚发布的新车G9L上首发,这个新模型的厉害之处在于它可以“记住过去,理解现在,还能推演未来”。

听起来很科幻是吧,但落在行驶中变化就具体很多了。

如果简述过去几年车企在自动驾驶方面的技术比拼,那就是一场关于“谁看得更清楚、反应更快”的竞赛。

不管是纯视觉模式还是激光雷达,从识别到车辆前方的车、行人、信号灯,再到判断道路情况,继续输出下一个动作,都是自动驾驶系统工作的“标准流程”。

但问题也出在这里,真实道路不是一张张静止图片,而是一连串“正在进行时”的状况。

一辆进进退退的车,一个反复横跳的行人,也许单帧画面上TA并没有在动,但对驾驶决策来说,意义却完全不同。

小鹏给出的解决方案是,给VLA加入“记忆”。

第二代VLA引入了Infini-VLA长时序架构,可以保留30秒内的有效信息,把此前发生的动作、位置和场景串联起来;同时,X-Foresight预测世界模型的引入,也可以让VLA根据过去30秒的信息,推理、预判未来6秒内观察对象的动作。

简单来说,二代VLA就是在此前智驾的基础上,让系统记住“刚才发生了什么”并且去猜“接下来可能会发生什么”。

对于人类司机来说,这就是驾驶时最司空见惯的方式,但是对于AI来说,这无疑是一次飞跃式的提升。

小鹏管新的推理方式称作Streaming Inference,即流式自回归推理。

过去的模型运作是按照“看-计算-输出-再看”的流程按部就班地走,而如今却成了“边看、边想、边行动”。这一推理模式更新后,官方给出的数据到端到端响应速度提升了300%

此外,新的MoT混合架构会根据城区、园区、泊车等不同任务形态调配模型能力,减少不同驾驶场景之间“串戏”的问题。

听起来很晦涩对吧,但小鹏却用几段非常直观的演示解释了这些技术问题。

比如在狭窄道路上突遇前车掉头;乡间小路上突然冲出羊群;大雾、大雨天气识别对面人物的手势;甚至还有车辆自动驶入驳船这样的非常规场景。

这次更新带来真正有意思的地方,并不是“我的车又学会在哪个犄角旮旯里开车不剐蹭了”,而在于智能驾驶开始越来越“泛用”。

过去人们关注智驾,会关心它能不能“自动泊车”能不能“自动变道”,而到了第二代VLA,车企已经开始解决的问题成了:面对一个没有训练过的复杂场景,AI能不能自己开过去?

为此,小鹏进一步把端侧模型参数量扩大3.5倍,官方称其达到主流VLA模型的15倍以上,并宣称多维综合安全能力提升20倍。

这次更新涵盖的也不止智驾,甚至座舱语音互动也得到了提升。

过去车机更多是“听一句话,完成一个指令”,有时候司机说话含糊、信息量过大,很容易让车机直接傻掉。

而这次更新后,小鹏首次加入了建立在Omni全模态模型之上的Master Agent,它可以清晰地分辨清楚司机下达的复杂指令,也可以根据指令的逻辑分配任务,简直就像个车载秘书。

所以,与其说二代VLA只是一次智驾OTA,不如说小鹏正在真正地让自己的车“长了脑子”。

发布会上,一张图片引起了全场轰动。

Car as Robot,汽车即机器人的主题一出现,小鹏的“野心”昭然若揭。

按照官方表述,第二代VLA已经可以已经实现从L2L4的“能力贯通”,而搭载这套模型的Robotaxi已经获得了广州市智能网联汽车远程测试资质,可以在相关测试道路开展主驾无安全员道路测试。

当然,这并不意味着现在的小鹏汽车都可以进行L4级别的辅助驾驶功能,至少从法律上还行不通。

更准确地说,小鹏希望让量产的辅助驾驶技术和Robotaxi不再是两套不同的体系,而是建立在同一个模型底座上;Robotaxi负责探索更新的方向,而一些成熟的能力,也会逐一下放到量产车上。

另一个词同样值得关注——“蒸馏”版本的VLA

这次发布的图灵VLA 2.0 Lite,本质上是通过Token压缩和蒸馏训练,把大模型的一部分能力部署到算力更低的平台上。其首批推送预计在9月开启,小鹏G9L Max将率先搭载。

而这件事的行业意义,比单纯的“模型又做大了多少”更值得关注。

过去,高阶的智驾意味着更昂贵的芯片、更高的算力和硬件,而这往往意味着更贵的车型。

而如果模型能力可以通过“蒸馏”的办法不断下放,那么AI能力与硬件成本之间的硬关系,则会被慢慢拆开。

换句话说,小鹏正在完成一次“科技普惠”,让高阶智驾的门槛越来越低,成为真正属于大众的技术。

同样在小鹏集团的体系下,汽车、Robotaxi、人形机器人,乃至小鹏汇天旗下的飞行汽车,本质上都会成为这一套物理AI的不同载体。

发布会披露,目前小鹏的AI Infra已经覆盖数据采集、训练、仿真、评估、部署等环节,模型单次训练数据吞吐量达到1亿clips,相比半年前增长10倍。

小鹏过去几年内不断画的“未来出行大饼”,正在慢慢由同一套技术底座串联起来。

但问题恰恰也出现在这里。小鹏的技术跑得越快,现实世界给它的边界反而越明显。

目前,中国的L3级自动驾驶已经迈过了“完全不能上路”的阶段,去年底,首批两款L3车型就获得附条件准入许可,并在北京、重庆的指定区域展开上路通行试点;今年7月份发布的L3/L4自动驾驶强制性国家标准,则要到202771日才能正式实施。

简单来说,自动驾驶虽然正在开放,但距离消费者可以在道路上真正享受把驾驶任务交给系统的自由,还有相当长的一段路。

今天的小鹏,已经拥有了足够的技术底气向消费者展示车辆如何通过复杂路口、推理未经训练的道路情况并做出判断。但对于普通消费者来说,它依旧得是一套有着明确责任边界的辅助驾驶系统。

小鹏证明了一点:自己正在越来越接近那个未来。

但这个未来什么时候真正属于消费者,还真不由小鹏说了算。

相关内容

热门资讯

重大科普!微信卡五星辅助器,微... 重大科普!微信卡五星辅助器,微乐自建房脚本免费入口(开挂自建房)工具1.微信卡五星辅助器 选牌创建新...
玩家必备科普!微乐自建房辅助工... 玩家必备科普!微乐自建房辅助工具脚本,微乐自建房脚本免费入口(开挂自建房)软件1、任何微乐自建房辅助...
安装程序教程!微信卡五星辅助器... 安装程序教程!微信卡五星辅助器,微乐小程序免费黑科技(开挂自建房)插件1、玩家可以在微信卡五星辅助器...
最新技巧!微乐家乡麻将自建房辅... 最新技巧!微乐家乡麻将自建房辅助app,微乐小程序免费黑科技(开挂自建房)工具最新技巧!微乐家乡麻将...
科技分享!微乐小程序麻将自建房... 科技分享!微乐小程序麻将自建房辅助工具插件,微乐自建房脚本免费入口(开挂自建房)app1、微乐小程序...