波波快加油
26-08-27 19:19 微博认证:汽车博主

回顾了下今天 Xianming Liu 的演讲:

小鹏在半年前提出的物理 AI 能力公式是:能力 = 模型 x 算力 x 数据 x 本体;模型决定智能上限、数据提供世界经验、算力支撑训练与运行、本体让AI真正落地物理世界。

但是,想要模型像人一样理解世界,就必须理解什么是「时间」。

所以小鹏第二代VLA升级的核心就是让 AI 理解时间,把「时间」纳入模型 AI 理解世界的维度,从「3D空间」跃迁至「4D时空」。

三大新增的核心能力:

- Infini-VLA 长时序架构,负责记住过去,支持最长 30秒有效时序;

- Streaming Inference 负责实时推理;

- X-Foresight 负责推理,可预判未来6 秒会发生什么;

- Flow Matching 是多解生成与强化学习模块,Flow Matching 让模型能够同时生成多种可能的行驶意图和路径规划。基于长时序驾驶表征,AI 可以给出多个合理的驾驶方案,生成多个候选方案后,通过强化学习从中筛选出最优、最自然、最拟人的行驶轨迹。

推送计划:

- 9 月给 Ultra/Ultra SE 用户推送第二代 VLA 的 630 版本;还会在 9 月推送第二代VLA Lite 蒸馏版,也就是单图灵用户,小鹏 G9L Max 版本将首发搭载Lite 蒸馏版本。

- 双 Orin-X 平台不同,确实会复杂点,之前给的时间是年底,现在看依然是年底。

关于 Robotaxi

第二代 VLA 已实现 L2 至 L4 能力贯通,也就是说用同一套技术底座,打通 L2 至 L4。这和之前地平线苏箐说的是一样的。

目前,搭载第二代 VLA 的 Robotaxi 近期获得广州市智能网联汽车远程测试资质。

还有就是座舱,舱驾融合是必然趋势,与之一对应的组织架构的调整,很多企业都在做了。

Xianming 是小鹏的通用智能中心的负责人,不仅负责驾的部分,舱也要兼顾起来。

今天 Xianming 也介绍了小鹏跳出传统座舱开发思路,以机器人研发逻辑打造的整车统一大脑 Master Agent。

- 打通VLA智驾模型和VLM座舱大模型,完成驾舱深度融合;
- 基于小鹏自研 Omni 全模态模型底座;
- 基于小鹏自研 Omni全模态模型底座;
- 实现从「听懂一句话」到「自主完成一整套行动」的闭环。

这里面新落地的功能就包含了语音靠边停车、语音就近泊入等。

听完今天演讲,感觉 630 这个版本会带来质的飞跃,看看明天@不是郑小康 的体验如何。

#小鹏汽车##大v聊车#

发布于 上海