小鹏第二代VLA学会“理解时间”,物理AI应用从单一走向通用

2026-08-27 10:23 来源:中国经济网

在一场烧脑的“课堂”上,小鹏描绘出了物理AI的未来发展路径和应用场景。

8月27日,小鹏集团在总部举办了以“TIME 时间”为主题的物理AI分享会,小鹏第二代VLA大模型迎来首次重大升级,全新XOS 6.3.0版本将搭载于小鹏G9L全球首发。此次模型升级的核心,是让AI开始真正理解时间:从过去对物理世界的静态3D空间理解,进一步走向动态4D时空理解。

全新XOS 6.3.0大版本端侧模型参数量扩大了3.5倍;超长时序的上下文记忆能力让AI司机真正做到了“看得准,会思考,反应快”;全新版本还引入了整车大脑Master Agent,实现VLA+VLM的驾舱融合,并将部分Robotaxi的L4级体验下放到量产车型,为用户带来全新体验。

具体来看,首先要了解本次的升级重点是什么?

小鹏物理世界基座模型首次把“时间”纳入模型,“记住过去、理解现在、预判未来”,实现从“3D空间”跃迁至“4D时空”。第二代VLA全新引入Infini-VLA长时序架构,记得前30秒的世界,驾驶判断开始拥有更长的上下文,更多有效信息进入模型。连续发生的道路事件不再被割裂成一个个独立画面,模型可以将此前发生的动作、位置和场景串联起来,形成更加完整的时序理解。

第二代VLA还同步提升了模型推理效率,采用Streaming Inference(流式自回归推理),从离散推理走向连续推理,能够做到“边看、边想、边行动”的并行处理。遇到前车突然刹停、行人折返、旁车强行加塞等突发情况,车辆的反应像老司机一样娴熟、敏捷。

与此同时,小鹏X-Foresight预测世界模型首次上车,可预判6秒内发生什么,推演周边交通参与者未来的可能行为。预测更多种未来,才能选择更好的行动。

接下来,我们就要知道为什么我们需要一个更大的模型?更大的参数量才能实现足够强的泛化能力,让快速进入全球市场成为可能。小鹏第二代VLA全新版本端侧模型参数量提升3.5倍,是主流VLA的15倍以上,结合超前轨迹预判、超长有效时序、更快决策响应,使得多维综合安全能力提升20倍。

第二代VLA全新版本升级的不只是智能辅助驾驶,小鹏选择用做机器人的方式重构车机大脑,首次推出Master Agent,实现VLA与VLM的驾舱融合,让车辆从“听懂一句话”进一步走向“理解用户真正想完成什么”。

小鹏集团持续推进大模型升级,目标也更明确——模型能力的进化将不再局限于单一产品,而是跨越汽车、机器人、飞行汽车等不同本体,持续拓展物理AI与真实世界交互的边界。

物理世界AI基座真正的价值,不只是把单一任务做得更好,而是将模型在真实世界中学习到的能力迁移、复用到更多任务和更多本体,推动物理AI从单一产品能力走向通用能力。

搭载第二代VLA的Robotaxi近日获得广州市智能网联汽车远程测试资质,可在广州相关一、二、三级测试道路开展主驾无安全员道路测试,这意味着小鹏开始进入主驾无人的关键道路验证阶段。

除了汽车,这一能力也正在向机器人等更多本体落地。小鹏通用人形机器人IRON搭载3颗图灵AI芯片,有效算力高达2250 TOPS,依托行业领先的算力基础,小鹏物理世界基座模型已实现端侧部署,无需远程遥操作即可自主完成复杂工作任务,同时保障推理低时延与数据安全。

8月24日,小鹏机器人业务完成首轮股权融资,融资超9亿美元、投后估值超63亿美元,刷新中国具身智能行业单轮私募股权融资纪录。本轮融资由IDG资本领投、高榕创投参投,并获得腾讯、阿里巴巴两家战略投资者支持,充分体现了资本市场对小鹏集团在物理AI领域的领先地位、技术路线、规模量产能力和长期商业价值的高度认可,也进一步验证了小鹏从汽车向机器人延伸的技术路线和产业化能力。(中国经济网记者 郭跃)

查看余下全文
(责任编辑:陈梦宇)