会懂网AI资讯获悉,小鹏第二代VLA(视觉语言动作)大模型迎来重大升级。在小鹏物理AI体验日上,第二代VLA首次将”时间”维度纳入模型,实现从3D空间跃迁至4D时空理解。这一升级让小鹏的自动驾驶和机器人系统首次具备了对动态世界的预判能力。
具体来看,小鹏第二代VLA引入了Infini-VLA长时序架构,可记忆前30秒的世界状态;X-Foresight世界模型则能预判未来6秒的场景变化。端侧模型参数量提升3.5倍、响应速度提升300%。搭载该模型的Robotaxi已获得广州主驾无人道路测试资质,9月将向Ultra/Ultra SE车型推送。
这一升级的技术意义在于,传统的自动驾驶模型处理的是”静态快照”,而引入时间维度的VLA模型能够理解物体的运动趋势——行人下一步可能走向哪里、前车是否会变道,都能提前预判。这种对”世界如何随时间变化”的理解,正是端到端自动驾驶从”能用”迈向”好用”的关键。
业内分析认为,小鹏第二代VLA的升级,也是”世界模型”浪潮在自动驾驶领域的落地缩影。从谷歌Genie、腾讯混元3D世界模型,到蔚来端到端驾驶系统,再到小鹏的4D时空理解,头部玩家都在让AI从”理解语言”迈向”理解物理世界”。随着时间维度被纳入模型,自动驾驶和机器人的决策能力有望迎来质的飞跃,2026年作为”世界模型元年”的含金量也在不断提升。
从行业影响看,小鹏将世界模型理念落地到量产车和Robotaxi,意味着世界模型正从实验室走向真实道路。随着时间维度成为自动驾驶模型的标准配置,”感知-预测-规划”的传统链路将被”时空联合建模”取代,自动驾驶的安全性和复杂场景适应能力有望实现质的提升,对2026年密集落地的Robotaxi商业化是积极信号。






























暂无评论内容