登录

小鹏新版VLA 9月实装:记住过去30秒,预判未来6秒,开始在「时间里」开车


速读:小鹏新版VLA 9月实装:记住过去30秒,预判未来6秒,开始在「时间里」开车。 过去的记忆和未来的推演,最终服务于每一次的加减速和转向,也让第二代VLA6.3.0版本能「在时间里流动」。 模型理解的是「前车正在掉头」这个持续发生的行为,不再只有「前方出现空位」这一帧画面。
2026年08月27日 21:36

电影《奇异博士》里,奇异博士转动阿戈摩托之眼,可以让时间向前或向后流动,到了《复仇者联盟 3》,他又在与灭霸的对决前,提前看见了多种可能的未来。

这是电影里的魔法,也是小鹏提供的现实。

8 月 27 日,小鹏开了一个物理 AI 分享会,同时展示了第二代 VLA 的全新版本。这场沟通会最大的关键词是「时间」,小鹏给车上的模型加上一个「阿戈摩托之眼」:往回转,能回溯 30 秒的世界,向前转,则开始预判未来 6 秒会发生什么。

汽车没有时间宝石,但有大模型加持,模型根据过去一段时间里累积的信息,计算出几种概率更高的后续状态,再为眼前这一刻选择动作。对智驾而言,拥有「时间线的记忆」,就能带来更加拟人化的操作。

人在开车时,从来不只看眼前这一帧,你会根据前几秒的记忆判断后方路况,也会根据前车的减速和路边的岔口预判几秒后有可能出现的小电驴。从某种意义上说,驾驶不只发生在路面上,也发生在时间里。

最新的小鹏第二代 VLA 全新 6.3.0 版本,即是一个在时间流中开车的模型,全新 VLA 将于 9 月开始面向所有 Ultra 和 Ultra SE 车型推送,小鹏 G9L Ultra 与 Ultra SE 将首发搭载,而单图灵芯片 Max 车型也将在 9 月获得第二代 VLA Lite 蒸馏版。

驾驶没有单帧答案

小鹏这次对新 VLA 的核心思路是让过去、现在与未来连在一起。

Infini-VLA 负责记住过去。它的底层架构可以支持更长的时序,小鹏考虑驾驶任务与端侧计算量,将量产版本的历史记忆设置为 30 秒。也就是说它能记住过去 30 秒发生的路面状况,并将其带入到当下的判断中。

小鹏在沟通会上展示了一段演示视频,前车在路中掉头时,车身后方一度露出可以穿过的空位,测试车没有立即加速,而是结合之前的运动过程,等待对方完成掉头后再向前。模型理解的是「前车正在掉头」这个持续发生的行为,不再只有「前方出现空位」这一帧画面。

这有点像人与别人谈话时的短期记忆,人不会每听一句话就忘掉上一句,驾驶者也不会因为前车此刻横在路中,就忘记它前面做出了准备掉头的举动。

如果说 Infini-VLA 让车辆不再忘记上文,Streaming Inference 「流式自回归推理」则负责缩短车辆理解当下的时间。按照小鹏的解释,模型可以边获取输入、边推理、边输出轨迹,不必等完整理解一段历史之后才开始动作。小鹏给出的数据是,这套流式推理让决策速度提升了 300%。

同样地,这也类似人开车时,眼睛看路、大脑判断、手脚操作同时进行。遮挡处突然出现目标时,这样的并行处理能够少留下一段等待推理完成的空白。

记得过去,着眼当下,自然也要展望未来。于是新版本 VLA 中的 X-Foresight 会根据历史状态,对未来 6 秒进行推演,Flow Matching 再对多种可能的轨迹分布进行拟合,帮助模型选择更合适的动作。

词汇是晦涩难懂的,但带来的作用是十分清晰的,新版 VLA 通过持续观察当前路况,对未发生但可能出现的情况进行预判,并做下一步决策。而现实生活中老司机们常提到的「防御性驾驶」,本质上也是一种预判。

现场视频里,一辆对向白车占据了逆向车道。测试车需要判断对方是准备等待、继续向前,还是让出一部分空间,再推演自己此刻前进会不会封死两辆车的通路。看清对方在哪里只是第一步,理解对方将要做什么,才能决定自己下一步的操作。

过去的记忆和未来的推演,最终服务于每一次的加减速和转向,也让第二代 VLA 6.3.0 版本能「在时间里流动」。

进入现实世界

架构图里的名词很多,但回到产品上,VLA 要面对的还是现实道路上的各种麻烦,小鹏的答案是使用更大的模型,这一次小鹏将模型参数量扩大了 3.5 倍。

沟通会播放的一段视频里,测试车来到了轮渡码头。渡口没有清晰的车道线,码头并非一条常规道路,但依靠模型自身的思考,车辆仍然自己找到入口,开上轮渡,跟着前车停下,轮渡靠岸后,它又随车流驶出。

另一段视频发生在狭窄山路,在急弯之后,道路前方出现了一根悬空树枝,车辆没有将它当成普通的路面障碍物停在原地,也没有朝着看似尚有空间的缝隙直接向前,而是主动减速,一边观察树枝与车身的关系,一边寻找能够通过的空间。

主题:小鹏|时间|过去|模型|未来|发生|驾驶