智驾技术路线之争从未停歇,视觉与激光雷达、VLA与世界模型,究竟谁是未来?华为车BUCEO靳玉志在采访中给出了明确判断,认为绕过语言环节的“世界模型”才是通往高阶自动驾驶的终极路径,而非看似取巧的VLA路线。这为理解当下智驾技术的核心分歧提供了一个清晰的视角。
智能速览
智驾技术路线的争议核心在VLA与世界模型之间。
华为明确表示不会采用VLA路径,认为其并非最终方案。
华为选择的是世界模型,直接从信息输入控车,绕过语言环节。
VLA路线被比喻为“中转翻译”,而世界模型则是“直接思维”。
华为宣称其基于世界模型的ADS 4.0在体验上将一骑绝尘。
精华内容
在自动驾驶的众多技术路线中,华为为何毅然放弃主流的VLA,选择挑战世界模型这条更艰难的道路?这背后是其对技术终局的判断。
何为VLA路线
VLA,即视觉-语言-动作模型,是当前一些智驾方案的选择。其核心逻辑是将车辆传感器捕捉到的视觉信息,先转化为语言token,再通过语言大模型进行理解和推理,最终输出驾驶指令。这个过程好比翻译,将看到的信息用语言重新描述一遍再做决策,存在信息损耗和延迟的可能。
华为的世界模型
华为选择的则是世界-动作模型,即WA。该路径旨在省去语言转换的中间环节,直接通过视觉、声音等多模态信息输入,由世界模型处理后生成驾驶行为。这被比喻为用英语思维直接说英语,而非先想中文再翻译。虽然技术实现难度极大,但被认为是更接近人类驾驶本能的终极方案。
CEO的通俗比喻
华为车BUCEO靳玉志用一个生动的比喻解释了两种路线的差异。VLA像是英语初学者,先想中文再说英语,过程繁琐且不地道。而世界模型则像是英语母语者,直接用英语思维,流利自如。他认为,看似取巧的VLA路径并非通往真正自动驾驶的正确方向,直奔终局的世界模型才更具挑战性也更根本。
ADS 4.0的实力
基于世界模型,华为的ADS系统已经发展到3.3版本,其宣称的实际体验已领先行业。即将在9月推送更新的ADS 4.0,在云端采用世界引擎,车端为世界行为模型,架构更为先进。华为方面认为,ADS 4.0的落地将彻底终结关于智驾技术路线的争议。
选择VLA还是世界模型,不仅是技术路线之争,更体现了对自动驾驶未来的不同构想。华为的选择揭示了其对技术终局的押注。随着ADS 4.0的推送,市场将检验这条“终极路径”的真实成色,这无疑会让未来的智驾竞赛更具看点。