那天体验理想VLA模型录了一小段素材,中间有我们对这台车模型体验的实时记录,分享一下个人看法:
1、新的版本对空间的理解更强了,在纵向控制上要比之前VLM提升很多,比如刹车就没有很急;横向的避让也会丝滑很多。
2、通过语音控制智驾,还是指令型的。能听懂向左、向右变道,加/减速、靠边停车等。
在导航和人的指令中间,会优先按照导航的路线执行。语言泛化还需要提升,能理解人的指令,但需要人给到关键指令。
比如它能听懂“找一个地方停车吧”,执行的时候需要你在区域内选中靠边停的终点。如果想让它靠边停车,就得说“靠边停车”。
4、会记忆路线的常用配速;低矮物体的识别需要提升。
个人觉得VLA第一个版本相较于上一代端到端+VLM,单从体验上来看,有体验的优化,但没有让我感觉到有技术路线上的代际飞升。期待后续版本的更新。
#理想汽车[超话]##汽场全开# http://t.cn/A6sI47Ab
发布于 北京
