小鹏的630版本,将在9月面向ultra和ultra se车型开启推送;另外VLA2.0 Lite蒸馏版,也预计9月开启首批推送。
一辆真正聪明的车,不是靠某一个零件厉害,而是几个东西的协作。芯片自己造、模型自己训、数据自己采、车自己造,全栈都在手里,所以才能一起放大。这次专业术语很多,我再来通俗的讲一下:
一、长时序,长上下文
这次的核心,是之前的模型只能看当前几帧的画面,而这次引入Infini-VLA长时序架构,能记住前30秒的世界,驾驶判断有了更长的上下文。比如无保护左转,横向车流明明在开始减速礼让,但是有的智驾因为只看当下这一瞬的距离,常常僵在路口不敢走。有了30秒记忆,它能回想对方排队缓行、等待的全过程,判断是礼让还是抢行,提前选好车道。
二、边看,边想,边行动,并行处理。
老的智驾系统,基本是看完画面,再想清楚,最后出动作,三步排队走,很慢,跟人是没法比的。这次有了流式自回归,像人开车时眼睛看路、脑子判断、脚搭刹车是同时发生的。并行处理,响应自然快。
不过要注意,之前小鹏披露过决策延迟从200毫秒压到80毫秒,那是另一个指标,就是去掉语言转译环节,和这次的端到端响应不是一回事。
三、推演未来6秒
X-Foresight预测世界模型首次上车,用了Flow Matching,预测更多种未来,而且不是只猜一条未来,而是同时生成好几条可能的未来,对方左转、直行、刹停各给概率,再选最安全的应对。
比如说前面的车在三点掉头,那么是有空间就无脑的怼上去,还是能预测他的行为,也就是他需要倒车,再预留空间等待对方
#小鹏第二代VLA全新版本9月开启推送##小鹏第二代VLA蒸馏版9月开启首批推送##小鹏G9LMax版首发第二代VLA蒸馏版##小鹏汽车[超话]#
发布于 北京
