小鹏刘先明:第二代VLA升级重点是让模型理解时间维度
8月27日,小鹏举办物理AI分享暨第二代VLA体验日活动。小鹏集团通用智能中心负责人刘先明在演讲中表示,物理AI真正的难题在于理解世界,并在充满限制的真实环境中行动。他提到,小鹏半年前提出物理AI能力公式,将能力视为模型、算力、数据、本体共同作用的结果:模型决定智能上限,数据提供世界经验,算力支撑训练与运行,本体让AI进入物理世界。

刘先明认为,真实世界不是静止图片,而是连续变化的过程。模型要像人类一样理解世界,需要先理解时间。第二代VLA升级的核心,是让模型首次建立对时间维度的理解。小鹏物理世界基座模型把时间纳入建模,AI理解世界的维度从3D空间扩展到4D时空。时间越长、信息越多,模型就越需要更快反应、更高频决策,并具备更强安全能力;模型越大,泛化能力越强,计算需求也越高。
此前模型更多接收当下信息,第二代VLA引入Infini-VLA长时序架构,可以记住前30秒的世界状态,驾驶判断因此获得更长上下文,更多有效信息进入模型。道路情况随时变化,模型需要边观察边思考。为此,第二代VLA同步提升推理效率,采用流式自回归推理,端到端响应速度提升300%,实现边看、边想、边行动的并行处理。











