前几天在广州体验完小鹏VLA‑Lite蒸馏版本,有些真实感受跟大家聊一聊。
很多人会下意识认为,Lite版本就是简单把大模型粗暴裁切、砍掉功能,做一个缩水版。但这一次实际跑下来,我的感受不一样。
VLA‑Lite底层的技术范式,跟双图灵满血6.3.0版本是同一套VLA2.0基座,并不是另起炉灶做一套简化架构。小鹏没有采取粗暴裁剪模型能力的做法,而是最大化提取630的能力带宽。
整车的认知能力、对场景的理解水平,我短短40分钟并未感觉和630有什么本质差别。但是,二者实实在在能够感知到的差距,集中体现在决策延时上面。
满血6.3.0版本的低延时是这次广州给我留下印象最深的一点。前车一旦发生动作,车辆几乎是瞬态同步做出反馈,毫秒级的响应,车流里面博弈非常干脆利落。
反观这套单图灵上面运行的Lite蒸馏版,整体能力底子很强,但响应时延能够明显感受到差异,体感有点类似于我的P7上610版本的状态。场景理解、判断逻辑跟630保持一致,只是从“看见”到“做出动作”中间,多出了一点点时间差。
630超低延时目前还是挺明显的感受
小鹏把VLA2.0蒸馏版成功跑通,意味着一套统一的技术栈,可以适配多层次算力硬件:从三图灵、双图灵的满血旗舰,一直下沉到单图灵的车型平台上面。
行业里目前已经有公司各车型单独一套架构,多套体系、多套逻辑,多套迭代、维护都相互割裂。后续升级、能力进化很难同步。这种公司的复杂架构往后就是要么不更新,要么更不起。
而小鹏是一套基座模型,依靠蒸馏技术向下适配不同算力,整条产品车队可以共享同一套大脑的进化成果。云端每一轮模型迭代,多款车型同步获得认知层面的提升。
在接下来激烈的智驾竞争当中,这是非常关键的组织能力。可以把巨额训练烧制研发的成果,高效赋能到全系的产品矩阵,让更多车型能够享受到模型化智驾带来的红利。
当然时延带来的动态博弈体验,依旧是Lite版本后续持续优化的重点。期待后续OTA迭代,可以继续把这一块的差距不断缩小。
目前我还没摸到双Orin max版的蒸馏体验。
#电动兄弟#
发布于 江苏
