今天差点忙嗝屁了,到家才有空再来看看小鹏VLA2.0 到底是如何理解时间的
【理解时间就是说AI开始有了更连续的判断】
以前很多智驾更像在做一道道截图题:这一秒看见行人,下一秒行人被大车挡住,模型掌握的信息就可能断掉。现在第二代VLA能记住过去30秒发生的事情,相当于从看照片升级成了看视频。
举个简单的例子。一个人刚刚走到大车后面,即使当前画面里看不见了,系统依然记得他之前的位置和行走方向,知道他有可能突然出现。再结合未来6秒的预测,车辆就能早点减速,而不是等人重新出现在镜头里再急刹。
另外端侧模型参数量扩大3.5倍,只是能力提升的一部分。更重要的是背后的数据循环:百万车辆每天遇到各种加塞、急刹、施工和雨夜场景,系统从中挑出模型不熟悉、判断不够好的片段,送到云端继续训练,再把升级后的模型部署回车上。
所以车端主要负责实时感知和推理,大规模训练还是在云端完成。通过模型蒸馏和Token压缩,一些算力较低的车型也能用上大模型学到的能力。
我觉得这件事最终还得看实际体验。它能不能更早发现风险,刹车是否更自然,遇到陌生道路会不会犹豫,这些比参数本身更重要。
所谓AI理解时间,说白了就是它不再只盯着眼前这一秒,而是开始把刚才发生的事和接下来可能发生的事连起来考虑。
学无止境嗷,学起来,家人们~
#小鹏第二代VLA开始理解时间##小鹏第二代VLA大模型重大升级#
发布于 上海
