8月27日小鹏集团举办以“TIME 时间”为主题的物理AI分享暨第二代VLA全新版本体验日活动,小鹏第二代VLA大模型迎来首次重大升级,全新XOS 6.3.0版本将于小鹏G9L全球首发。此次模型升级的核心,是让AI开始真正理解时间:从过去对物理世界的静态3D空间理解,进一步走向动态4D时空理解。
小鹏集团持续在自动驾驶领域验证Scaling Law,给体验、安全和泛化性带来巨大的提升。即将发布的全新XOS 6.3.0大版本,端侧模型参数量扩大了3.5倍,与业内常见小模型拉开了数量级差距,超长时序的上下文记忆能力,让AI司机真正做到了“看得准,会思考,反应快”,推动小鹏物理AI基座模型实现从空间理解到时空理解的底层能力跃迁。全新版本还引入了整车大脑Master Agent,实现VLA+VLM的驾舱融合,并将部分Robotaxi的L4级体验下放到量产车型,为广大用户带来全新体验。
传统的模型可以识别车辆、行人、道路和交通信号,但要真正完成复杂的物理世界决策,仅仅“看见”还远远不够,车辆需要知道过去、现在、未来可能发生什么。因此,此次第二代VLA升级的核心,是让模型第一次建立起对时间维度的理解。小鹏物理世界基座模型,首次把“时间”纳入模型,AI理解世界的维度,从“3D空间”跃迁至“4D时空”。
对不断变化的道路状况,第二代VLA能够做到“边看、边想、边行动”的并行处理。遇到前车突然刹停、行人折返、旁车强行加塞等突发情况,车辆的反应像老司机一样娴熟、敏捷。小鹏X-Foresight预测世界模型首次上车,可预判6秒内发生什么,推演周边交通参与者未来的可能行为。
此外,新版模型引入MoT混合架构,通过针对不同任务动态分配模型能力,减少城区道路、园区、泊车等不同场景之间的任务干扰,把不同的问题交给不同的“专家”,让模型在不同驾驶任务之间更加稳定地切换。
第二代VLA全新版本升级的不只是智能辅助驾驶,小鹏选择用做机器人的方式重构车机大脑,首次推出Master Agent,实现VLA与VLM的驾舱融合,让车辆从“听懂一句话”进一步走向“理解用户真正想完成什么”。
值得一提的是,本次全新版本升级还带来了“语音靠边停车”“语音控制就近泊入”功能,用户只需通过语音下达停车指令,车辆即可在智驾状态下自主寻找合适位置并完成靠边停车,实现从“语音指令”到“自主执行”的完整闭环。小鹏Robotaxi的L4级能力,正通过同源技术进一步下放至量产车,为车主带来更高阶、更自然的用车体验。
红星新闻记者 张煜