8月27日,小鹏集团举办物理AI技术分享活动,对外发布第二代VLA大模型重大版本更新,全新XOS 6.3.0系统将搭载在小鹏G9L车型。本次迭代重点拓展模型对时间维度的处理能力,推动车载智能感知从静态空间识别,向连续动态的时空理解演进,同时推进同一AI底座在汽车、人形机器人不同硬件载体之间复用。

传统车载感知模型大多基于单帧画面完成环境识别,更多处理当下时刻的道路信息。真实道路交通属于连续动态变化场景,行人、车辆的运动存在前后因果关联,仅依靠瞬时画面,难以充分判断潜在风险。据介绍,升级后的第二代VLA引入Infini-VLA长时序架构,可留存过往30秒内的道路环境数据,把碎片化的道路事件串联,为智驾决策提供更长周期的场景上下文。
新版本搭载X-Foresight预测世界模型,能够推演未来6秒周边交通参与者的运动趋势,辅助系统提前预判加塞、行人变向、车辆制动等场景变化。推理模式上采用流式自回归推理,改变以往“看—算—输出—再看”的离散工作流程,实现感知、计算、输出并行处理,缩短系统响应时延。本次升级后端侧模型参数量扩大3.5倍,同时引入MoT混合架构,针对城区、泊车等不同驾驶任务分配计算资源,减少多场景切换过程的相互干扰。
本次更新推出Master Agent整车智能体,实现VLA感知模型与VLM大语言模型的驾舱融合。该智能体可以解析用户的自然语言意图,拆解为多项子任务,统一调度智驾、底盘、车身、座舱等模块协同执行。现场演示功能包括语音指令触发靠边停车、就近泊入,将部分Robotaxi的L4级技术能力下放至量产乘用车。
技术底座的跨设备复用是本次披露的重要方向。第二代VLA基座实现L2到L4自动驾驶技术贯通,小鹏Robotaxi已经取得广州主驾无安全员道路测试资质,开展相关道路验证。同一套物理AI基座同时向人形机器人IRON完成端侧部署,支撑机器人自主执行任务。小鹏机器人业务近期完成首轮超9亿美元股权融资,投后估值超63亿美元。
为适配不同算力硬件,企业通过模型蒸馏压缩,推出VLA 2.0 Lite轻量化版本,计划9月分批推送至部分存量车型,让硬件算力相对有限的车辆也获得模型迭代收益。目前该大模型已经完成德国道路本地化测试,企业计划推进高阶智驾能力的海外落地。
小鹏方面表示,物理AI的迭代依托完整AI基础设施,涵盖数据采集、训练、仿真、评估、部署全链条。依托车队采集的真实道路数据形成数据飞轮,持续反哺模型迭代。行业观察认为,物理AI尚处在发展阶段,车企正在探索把同一套大模型底座,复用到汽车、机器人等多种硬件载体,以此摊薄研发成本,拓展具身智能的落地场景,但相关技术的大规模商业化,仍需要持续的实测验证。




