云霞资讯网

VLA6.3.0 终于亮相了,三个好消息和两个坏消息。昨天 G9L 的发布会上,

VLA6.3.0 终于亮相了,三个好消息和两个坏消息。

昨天 G9L 的发布会上,6.3.0 版本终于正式亮相,我把的原话截图在下面,感兴趣的小伙伴可以看一下。我个人从这段话可以理解出三个好消息和两个坏消息:

先来说说好消息:

1.第二代 VLA 大模型“肌肉狂秀”:新版本的大模型数据量扩充到了主流 VLA 模型的 15 倍,其中端到端模型参数量提升达 3.5 倍。

这里可能要看到这个数据量背后的原因。其实不仅仅是简单的扩大规模,更是模型路径变短的一个缩影,因为路径变短了,神经网络就可以构建得更深、容纳更多的参数量。另外可能也涉及到了所谓的期待新模型可以给出更短的延迟反应。

2.车型能力可以同步:在早期的 VLA2.0 上,大家有个普遍的认知,新 P7 开的很好,但是其他车型可能就是差一点,这次 6.3 据说很好的解决了这个问题。

这里可能是触发了所谓Scaling Law,大概就是所谓规模效应。就像 GPT-4 比 GPT-3.5 更聪明一样,当神经网络的参数规模突破临界点后,模型表现出了强烈的“涌现能力”与“跨域泛化”能力。系统不再死记硬背路况,而是像人类大脑一样学会了通用驾驶逻辑,因此能轻松适应不同车型和全球千奇百怪的路况。可以印证的是小鹏在全球正在快速泛化 VLA2 能力。此处 MONA 车主值得狂喜。

3.引入 30 秒的记忆和 6 秒推演,这个就是说能够将过去 30 秒 内的车辆动态、周边车流趋势、甚至几百米前看到的交通标识与障碍物信息存入高维记忆库。系统“记住”了过去半分钟发生的一切,不会因为瞬间的遮挡或盲区而失去对周围态势的掌握。然后还能基于这些记忆,向未来 6 秒去推演。

这里可以举个例子,当观察到前方右侧车辆在过去 15 秒内连续压线蠕行(30秒时序记忆),世界模型就会推演预测:“未来 3 秒内该车有 85% 的概率强行切入当前车道”。系统提前 6 秒开始减速或微调方向预留安全空间,而不是等对方贴近了才做重刹。这种“走一步看三把”的预判能力,正是老司机开车的精髓所在。

再来说说坏消息:

1.座舱进化似乎还没什么消息。公布的通过语音靠边停车的功能,其实在 ADS,HSD 和 FSD 上面也有类似的功能。现在的座舱也不是说多不好用,只能说就算是中规中矩的普通体验吧,体现不出图灵芯片的上限是什么?

2.蒸馏版体验远超预期但是还有四个月。这里的蒸馏版专门指的是双 Orin 的 max 版本的车型,这部分车主对于 VLA2 蒸馏版的需求应该非常强烈,但是昨天公布的进度来看,应该要到四季度落地。根据以往的习惯,基本就是到 12 月底了,说实话这个时间并不算短了。考虑到周边友商的升级力度,比如蔚来同步升级 4Orin 和神玑,可能还是慢了。

小鹏现在销量一路长虹,网络上再也没人说什么小鹏名字不好的事儿了,不过在我的眼里,智能化是小鹏底色的一张牌,如果这张牌守不住,就好像 10000 前面的“1”,后面再多 0,意义都很有限了。

VLA2.0 诞生是一个巨大的进步,这次 6.3.0 也会是同样巨大的进步吗?讲真的,我还蛮期待的。小鹏g9l全球首秀