东方-JM
26-08-27 22:54 微博认证:汽车博主 微博译制视频博主

小鹏这次推第二代VLA大模型,可以说把端到端智驾的底层逻辑彻底重写了
现在的纯视觉智驾系统告别了“7秒记忆的金鱼”状态
一跃进化为能在脑海中预演未来的老司机

先把这次核心升级的干货盘清楚:

--时空架构升维:引入Infini-VLA长时序架构,系统具备长达30秒的有效上下文记忆。

--未来沙盘推演:X-Foresight预测世界模型首次上车,提前推演周边交通参与者未来6秒的可能行为。

--并发决策提速:采用流式自回归推理,端到端响应提速300%。

--大脑驾舱融合:Master Agent超级智能体上车,彻底打通智驾、座舱与底盘的垂直控制。

要实现这种老司机体验,软硬件底层重构的难度极大。大模型想要真正理解物理世界,必须建立“时间”维度。Infini-VLA负责把前序30秒的车流博弈、车道拓扑全都存进系统上下文;配合流式自回归推理,车辆实现了眼看、脑想、手动的完全同步处理。再叠加X-Foresight的概率生成,连路边行人横穿的几种可能路线都能提前算透,遇到加塞或鬼探头自然能从容应对

能把这套庞大的4D时空模型硬塞进本地车端,图灵AI芯片起到了决定性作用。把行业内几家自研芯片的车企放在一起看,技术分化非常明显:蔚来神玑重在做高单芯片的绝对物理算力冗余,以此硬抗激光雷达与高精图像的并发吞吐;特斯拉HW4和规划中的AI5则重在为纯视频序列到轨迹矢量的生成做极致优化

小鹏的解法极度聚焦端到端大模型的本地并发与推理效率。图灵芯片专门针对Transformer等大模型架构做了底层指令集定制,单核推理速度达到超20 tokens/s。配合视觉、语言加动作(VLA)的全模态融合,小鹏图灵芯片的有效算力被精准砸在了长尾场景的常识理解和动态博弈上。靠着这套深度的软硬同构,量产车的智驾处理上限又被硬生生拔高了一个身位

#东方JM##小鹏第二代VLA首次模型重大升级##小鹏第二代VLA有记忆能预测会思考#

发布于 上海