回顾了下今天 Xianming Liu 的演讲:
小鹏在半年前提出的物理 AI 能力公式是:能力 = 模型 x 算力 x 数据 x 本体;模型决定智能上限、数据提供世界经验、算力支撑训练与运行、本体让AI真正落地物理世界。
但是,想要模型像人一样理解世界,就必须理解什么是「时间」。
所以小鹏第二代VLA升级的核心就是让 AI 理解时间,把「时间」纳入模型 AI 理解世界的维度,从「3D空间」跃迁至「4D时空」。
三大新增的核心能力:
- Infini-VLA 长时序架构,负责记住过去,支持最长 30秒有效时序;
- Streaming Inference 负责实时推理;
- X-Foresight 负责推理,可预判未来6 秒会发生什么;
- Flow Matching 是多解生成与强化学习模块,Flow Matching 让模型能够同时生成多种可能的行驶意图和路径规划。基于长时序驾驶表征,AI 可以给出多个合理的驾驶方案,生成多个候选方案后,通过强化学习从中筛选出最优、最自然、最拟人的行驶轨迹。
推送计划:
- 9 月给 Ultra/Ultra SE 用户推送第二代 VLA 的 630 版本;还会在 9 月推送第二代VLA Lite 蒸馏版,也就是单图灵用户,小鹏 G9L Max 版本将首发搭载Lite 蒸馏版本。
- 双 Orin-X 平台不同,确实会复杂点,之前给的时间是年底,现在看依然是年底。
关于 Robotaxi
第二代 VLA 已实现 L2 至 L4 能力贯通,也就是说用同一套技术底座,打通 L2 至 L4。这和之前地平线苏箐说的是一样的。
目前,搭载第二代 VLA 的 Robotaxi 近期获得广州市智能网联汽车远程测试资质。
还有就是座舱,舱驾融合是必然趋势,与之一对应的组织架构的调整,很多企业都在做了。
Xianming 是小鹏的通用智能中心的负责人,不仅负责驾的部分,舱也要兼顾起来。
今天 Xianming 也介绍了小鹏跳出传统座舱开发思路,以机器人研发逻辑打造的整车统一大脑 Master Agent。
- 打通VLA智驾模型和VLM座舱大模型,完成驾舱深度融合;
- 基于小鹏自研 Omni 全模态模型底座;
- 基于小鹏自研 Omni全模态模型底座;
- 实现从「听懂一句话」到「自主完成一整套行动」的闭环。
这里面新落地的功能就包含了语音靠边停车、语音就近泊入等。
听完今天演讲,感觉 630 这个版本会带来质的飞跃,看看明天@不是郑小康 的体验如何。
#小鹏汽车##大v聊车#
