🌀 AIBB-Flywheel

新闻数据飞轮
← 返回文章列表
ithome 科技 汽车 采集 2026-08-27T10:15:43+00:00

小鹏发布第二代VLA模型:引入时间维度理解4D时空

原始标题:小鹏刘先明:第二代 VLA 升级的核心,是让模型第一次建立起对时间维度的理解

来源
ithome
发布时间
2026-08-27T07:24:30
采集批次
2026-08-27-10
字数
611
URL 指纹
0922f2f168bc4d64

📌 AI 总结(223 字)

小鹏集团通用智能中心负责人刘先明在物理AI分享活动中,介绍了第二代VLA模型的核心升级。该模型首次将「时间」维度纳入物理世界基座模型,使AI理解从「3D空间」跃迁至「4D时空」。刘先明提出物理AI能力公式为「模型×算力×数据×本体」,强调真实世界是连续演进的过程。新版本引入Infini-VLA长时序架构,可记忆前30秒的驾驶信息,并采用流式自回归推理,端到端响应速度提升300%,实现「边看、边想、边行动」的并行处理,以应对道路环境的持续变化。
📄 正文(611 字)
IT之家8月27日消息,小鹏物理AI分享暨第二代VLA全新版本体验日活动正在进行中,小鹏集团通用智能中心负责人刘先明登台发表演讲。他表示,物理AI真正的难题,是理解世界,并在充满限制的真实世界里行动。

刘先明称,小鹏在半年前提出物理AI能力公式:能力 = 模型 × 算力 × 数据 × 本体。其中,模型决定智能上限,数据提供世界经验,算力支撑训练与运行,本体让AI真正落地物理世界。

刘先明认为,真实世界并不是一张张静止的图片,而是一个不断变化、连续演进的过程。模型想要像人类一样理解世界,必须首先理解什么是「时间」。第二代VLA升级的核心,是让模型第一次建立起对时间维度的理解。

据介绍,小鹏物理世界基座模型,首次把「时间」纳入模型,AI理解世界的维度,从「3D空间」跃迁至「4D时空」。时间越长、信息越多,模型就需要更快地反应、更高频的决策,并实现更强的安全能力;模型越大,泛化越强,计算需求也越高。

IT之家注意到,以前模型看到的更多是当下的信息,第二代VLA全新引入Infini-VLA长时序架构,记得前30秒的世界,驾驶判断开始拥有更长的上下文,更多有效信息进入模型。

道路情况是时刻在变化的,模型也需要边看边想,如果决策速度跟不上现实变化,也无法形成真正可靠的物理世界智能。所以,第二代VLA同步提升了模型推理效率,采用流式自回归推理,端到端的响应提速300%,实现「边看、边想、边行动」的并行处理。

🔥 关联热点