小鹏今儿的物理AI分享会,可以总结为:理解时间。
✅记住过去:
Infini‑VLA 架构,可以记住前面 30 秒的道路发生了什么。不是孤立看眼前,把一段时间车流、行人的行为轨迹全部串起来,有完整上下文。
✅理解现在:
流式推理,响应直接快 300%。不再是看完再算,做到边看边思考边行动,对付突发状况,反应速度是安全的底线。
✅预判未来:
X‑Foresight,可以推演未来 6 秒路上会发生的各种可能性。把预判直接放进决策逻辑,相当于给车子装了 “提前预知”。
端侧模型参数量直接拉到原来 3.5 倍,是市面上主流 VLA 的 15 倍以上,综合安全能力提升 20 倍。也做了轻量化蒸馏版本 VLA2.0 Lite,老的单图灵 Max 车型 9 月就能 OTA,这点很良心,新技术不锁新车。
不止智驾感知,Master Agent 整车大脑是另一个重头戏。
VLA 智驾大模型加上 VLM 语言大模型做驾舱融合,这个也是行业的大方向。
不是简单听懂一句指令,而是理解你到底想干什么,自动拆分任务,调度智驾、底盘、座舱一起干活。
比如直接语音喊靠边停车,车子自己找位置完成整套动作,把 Robotaxi 的 L4 同源能力下放到家用车上。
一套底座打通 L2‑L4,Robotaxi 已经在广州推进主驾无人测试,内测跑了 2000 多单。同一套模型还直接给人形机器人 IRON 用,汽车和机器人共享物理 AI 底座。顺带一提,小鹏机器人刚拿超 9 亿美元融资,投后 63 亿美刀,资本市场已经用真金白银投票。
海外也已经做完德国的道路验证,不需要海量重新训练,就能适配欧洲路况,明年上半年计划在欧洲落地。
但所有光鲜功能背后,拼到最后是 AI 基础设施。
百万车队跑出来十亿级真实世界数据,训练吞吐量半年翻 10 倍,完整的数据‑训练‑仿真‑部署闭环,才是真正的护城河。
很多人会问,理解时间到底对开车有啥意义?
通俗说:老司机开车,从来不只看眼前这一秒。会记得刚才旁边车的动向,预判下一秒路人会怎么走。
现在,AI 智驾也开始拥有这种能力。
当然技术再强也只是辅助,但这种底层基座模型的迭代,才是决定未来智驾上限的东西。
首发上车 G9L,后面老车 OTA 跟上,后续路上再看实车表现。
#小鹏第二代VLA首次模型重大升级##小鹏第二代VLA有记忆能预测会思考#
