8月27日,小鹏正式发布第二代VLA大模型首次重大升级,全新XOS 6.3.0版本将在小鹏G9L全球首发。本次升级最核心的突破,是让智驾AI从对物理世界的静态3D空间认知,进阶到动态4D时空理解,是其物理AI基座模型的一次底层能力跃迁。 传统智驾模型大多基于单帧画面做识别决策,更像“看图反应”。第二代VLA则首次将时间维度纳入模型:长时序架构可记忆前30秒的连续场景,让驾驶判断拥有完整上下文;流式自回归推理将端到端响应速度提升300%,实现边感知、边思考、边行动的并行处理;新增未来预测模块可预判6秒内周边交通参与者的行为,决策逻辑从“被动避让”转向“主动预判”。 同步落地的Master Agent整车大脑,实现了智驾与座舱的跨域融合。不同于传统语音助手的指令式交互,它能将用户意图自动拆解为多系统协同任务,比如语音下达停车指令即可自主完成找位泊入,完成从“理解”到“执行”的闭环。 从行业视角看,当下智驾内卷多集中在传感器数量、芯片算力等硬件层面,小鹏这次升级指向的是更底层的模型算法逻辑。参数量扩大3.5倍带来的泛化能力提升,既是其快速适配欧洲等海外市场的核心支撑,也让技术底座可向机器人、飞行汽车等多场景复用,物理AI的规模效应开始显现。 当然,模型能力最终要靠真实路况验证。此次升级同时推出Lite蒸馏版本,后续将覆盖更多车型,高阶智驾的普惠节奏正在加快。物理AI的竞争本质是全链路体系的长期比拼,小鹏在AI Infra上的长期投入正逐步转化为产品壁垒,实际落地效果仍有待市场检验。
8月27日,小鹏正式发布第二代VLA大模型首次重大升级,全新XOS 6.3.0版本将在小鹏G9L全球首发。本次升级最核心的突破,是让智驾AI从对物理世界的静态3D空间认知,进阶到动态4D时空理解,是其物理AI基座模型的一次底层能力跃迁。 传统智驾模型大多基于单帧画面做识别决策,更像“看图反应”。第二代VLA则首次将时间维度纳入模型:长时序架构可记忆前30秒的连续场景,让驾驶判断拥有完整上下文;流式自回归推理将端到端响应速度提升300%,实现边感知、边思考、边行动的并行处理;新增未来预测模块可预判6秒内周边交通参与者的行为,决策逻辑从“被动避让”转向“主动预判”。 同步落地的Master Agent整车大脑,实现了智驾与座舱的跨域融合。不同于传统语音助手的指令式交互,它能将用户意图自动拆解为多系统协同任务,比如语音下达停车指令即可自主完成找位泊入,完成从“理解”到“执行”的闭环。 从行业视角看,当下智驾内卷多集中在传感器数量、芯片算力等硬件层面,小鹏这次升级指向的是更底层的模型算法逻辑。参数量扩大3.5倍带来的泛化能力提升,既是其快速适配欧洲等海外市场的核心支撑,也让技术底座可向机器人、飞行汽车等多场景复用,物理AI的规模效应开始显现。 当然,模型能力最终要靠真实路况验证。此次升级同时推出Lite蒸馏版本,后续将覆盖更多车型,高阶智驾的普惠节奏正在加快。物理AI的竞争本质是全链路体系的长期比拼,小鹏在AI Infra上的长期投入正逐步转化为产品壁垒,实际落地效果仍有待市场检验。

JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图
JPG
长图