比亚迪推出混合世界模型HyWorldVLA!自动驾驶基准测试90.59分登顶全球最强
快科技8月12日消息,据盖世汽车报道,比亚迪汽车新技术研究院人工智能团队于7月29日发表首篇研究论文《HyWorldVLA》,介绍了一种混合世界模型HyworldVLA。
该模型结合了像素级和潜在空间世界建模,并采用视觉-语言-动作(VLA)架构,用于自动驾驶,在NAVSIM v1公开基准测试中以90.59的PDMS评分刷新历史最佳成绩。

据悉,HyWorldVLA的核心思路是“两条腿走路”,通常而言,像素级世界模型像放电影一样逐帧预测未来路况,细节丰富但计算昂贵、对视觉噪声敏感;潜在空间模型在压缩的抽象表征中运行,效率高却容易丢失关键细节。
比亚迪的方案在训练阶段用像素级监督充当“看门狗”,强制潜在空间保留足够的环境信息,实际推理时则只用轻量的潜在空间模型保证效率。
消融实验也验证了两者缺一不可,移除像素级预测,PDMS从90.59跌至87.50;移除潜在空间处理,则降至89.91。

而NAVSIM是当前自动驾驶领域最受关注的公开基准之一,其PDMS指标不简单比拼预测精度,而是综合考察责任碰撞、可行驶区域合规、安全距离、目标完成度和行驶舒适性,模型既不能靠“慢慢开”刷分,也不能只顾效率牺牲安全。

除v1登顶外,HyWorldVLA在指标更全面的NAVSIM v2上也拿到89.71分,领先第二名ExploreVLA近1分;在655个雨雾噪声场景测试中得分86.87,比最强基线高出19分以上,展现出明显优势。
事实上,这篇论文的意义超出了分数本身,外界对比亚迪的固有印象一直是“重制造、轻研发”,智能化更多依赖天神之眼和供应链整合,而这是比亚迪首次在自动驾驶基础模型领域公开亮相,证明其具备从0到1的AI研发能力。
此外,今年5月比亚迪刚发布自研4nm智驾芯片璇玑A3,单颗算力约700TOPS、三芯并联可达2100TOPS,从算法到芯片的完整闭环,被视为比亚迪为L3级自动驾驶进行的关键技术储备。
不过,需要指出的是,基准领先不等于量产落地,HyWorldVLA目前仍停留在论文阶段,何时装车目前尚无时间表。

编辑:若风
【本文结束】如需转载请务必注明出处:快科技
