小鹏第二代VLA端到端大模型纯视觉方案迎来重大升级,首次将“时间维度”纳入模型,让智驾从“看懂空间”进化到“理解时空”,全方位刷新了智能驾驶的体验上限。
一、技术范式革新:从“语言转译”到“端到端直通”
去中介化架构:第二代VLA实现了从传统“Vision → Language → Action”向“Vision → 隐式token → Action”的转变,去掉了语言中间层,让视觉信息直接生成驾驶动作,减少了信息损耗,决策更快更准。
模型规模跃升:端侧模型参数量提升3.5倍,是行业主流VLA模型的15倍以上,更强的参数量带来足够强的泛化能力,轻松应对各种复杂路况。
软硬一体协同:搭载自研图灵芯片,软硬一体化后运行速度提升12倍,一颗图灵芯片的有效算力相当于10颗Orin-X,为超大模型上车提供了算力底座。
二、4D时空理解:记住过去,预判未来
超长时序记忆:引入Infini-VLA长时序架构,模型最长可“记住”前30秒的有效历史信息。例如前车正在三点掉头,系统会记住这一状态,选择耐心等待而不冒进,前车驶离后迅速起步。
超前轨迹预判:内置X-Foresight预测式世界模型,可推演未来6秒内周边交通参与者的可能行为,提前感知路况变化并做出决策,如同拥有“预见能力”。
响应速度倍增:采用流式自回归推理,实现“边看、边想、边行动”的并行处理,端到端响应速度提升300%,面对突发状况毫秒级反应,快速避让。
三、综合体验升维:更安全、更拟人、更普惠
多维安全跃升:得益于更大的模型、更长的时序记忆和更快的响应,多维综合安全能力提升20倍,风险识别、轨迹规划、应对极端工况的能力全面增强。
拟人化驾驶质感:系统不再像“记性不好的新手”,而更像一位经验丰富的老司机。在复杂博弈场景中,如加塞预判、行人意图变化、前车异常减速等,能给出更自然、更连贯的驾驶决策。
科技平权与泛化:通过模型蒸馏技术,推出VLA 2.0 Lite版本,可将大模型能力部署到算力更低的平台,让更多老车主也能享受到技术进步的红利,并同步推进海外市场适配。