8月27日,小鹏发布第二代VLA大模型首次重大升级,全新版本将随XOS 6.3.0在小鹏G9L上首发。相比单纯增加识别精度,这次升级更关键的变化,是把“时间”加入模型:车辆不只识别眼前的道路,还尝试把过去、现在和未来连成一段连续过程。

打开网易新闻 查看精彩图片

具体来看,新引入的Infini-VLA长时序架构可以保留前30秒的场景信息。前车此前是否频繁减速、行人刚刚从哪里走来、旁车有没有持续靠近车道,这些连续动作不再被拆成互不相关的画面,而会成为当前判断的上下文。小鹏同时加入X-Foresight预测世界模型,推演未来6秒内交通参与者可能的行为,为车辆提前减速、避让或调整路线提供依据。

打开网易新闻 查看精彩图片

模型还采用流式自回归推理,将传统的“看完再算”改成边看、边想、边行动。小鹏称,新版本端到端响应速度提升300%,端侧模型参数量扩大3.5倍;结合更长时序轨迹预测后,多维综合安全能力提升20倍。这些数字来自公司发布,实际表现仍要等待量产车在不同道路和天气条件下验证。

打开网易新闻 查看精彩图片

时间维度之外,小鹏还推出整车大脑Master Agent,将负责驾驶的VLA与负责语言、视觉理解的VLM连接起来。系统可以把一句较模糊的需求拆成任务,再调度智驾、底盘、座舱和车身控制等模块执行。例如,用户通过语音提出靠边停车或就近泊入,车辆会自行寻找位置并完成操作。它让车机从执行单条指令,向理解意图和连续完成任务迈进一步。

打开网易新闻 查看精彩图片

这套模型也在向不同车型和场景扩展。算力较低的平台将通过蒸馏后的图灵VLA 2.0 Lite获得部分能力,首批推送预计9月启动;Robotaxi则已在广州获得远程测试资质,进入主驾无安全员道路测试阶段。小鹏还计划推动第二代VLA在欧洲落地。

打开网易新闻 查看精彩图片

对辅助驾驶而言,“理解时间”并不意味着车辆已经像人一样思考。它更准确的价值,是让模型拥有更长的上下文、更快的反应和对短期未来的预测能力。最终能否转化为更稳定、更安全的体验,仍取决于数据、算力、评估体系,以及真实道路上的持续验证。