音容宛在的肥佬
25-03-31 18:39

元戎启行老总周光在自动驾驶行业是一个非常实在的大拿,他们的解决方案虽然自我定位在L2+,但是一直在紧跟着特斯拉最前沿的FSD不断进化。他对自动驾驶技术趋势的认知应该是国内最顶尖的层次。每次电动汽车百人会和英伟达GTC上,周光都会有很多深刻的观点,而且之后都用硬梆梆的产品完成市场验证。他最近对FSD13的评价非常高,认为FSDV13与原先FSDV12有技术代差,国内目前的智驾最高水平也就是向FSDV12看齐,与FSDV13差了一代。
他把人工智能分成三个阶段,基于规则的弱专家系统,基于大模型的通才系统(以GPT为代表),未来的强专家系统。目前国内厂商卖的不错的端到端1.0,实际上是弱专家系统,处于传统架构与神经网络架构的过渡阶段,而端到端2.0,比如FSDv13,国内的VLA等,正式进入了以大模型为核心的通才阶段,下一步会向强专家系统演进。
以VLA为代表的端到端2.0,在系统架构上已经与通用多模态大模型非常相似,同样要做大量的预训练、后训练、强化学习和对齐工作。虽然仅仅依赖视觉信号的传感,但是VLA有两类输入,一类是视频输入,一类是文本输入,这些文本输入是从视频信号中解析出来的文字信息,不仅包括交通标识、告示牌等还包括导航系统的提示信息,这两种输入直接会产生密切的语义关联,将驾驶行为变成一种可以用文字解释的信息序列。VLA的输出也有两种,一种是对车辆轨迹的控制信号,一种是文字表达,不仅表达要做出什么样的驾驶行为,还会运用长序列上下文能力,解释为什么要做出这样的驾驶行为。到这里,VLA模型对自动驾驶的运算,已经成为一种新的Reason过程,整个智驾技术完全透明化和白箱化,也为后面的“对齐”工作奠定了重要的基础。
周光肯定是最懂智驾和AI的高手之一,每次他做演讲都能把最复杂的技术演进讲得非常直白易懂,让我受益匪浅。衷心祝愿元戎继续大卖,让真正的前沿技术赢得市场。

发布于 广东