张大妈

Google Genie3加持|Waymo最新世界模型来了!

源自小红薯:李阿由

02-12 13:40

为解决自动驾驶在现实世界中难以穷尽极端路况的难题,Waymo推出其最新的世界模型。该模型基于Google DeepMind的Genie 3技术,旨在生成高度逼真的仿真环境,让车辆在虚拟世界中积累数十亿英里的驾驶经验,有效提升应对长尾事件的能力,为自动驾驶的安全性和可靠性提供了全新解决方案。

Google Genie3加持|Waymo最新世界模型来了!智能速览

  • Waymo的自动驾驶汽车真实路测近2亿英里,但更依赖仿真环境训练。

  • 该世界模型基于Google DeepMind的Genie 3技术,并专为驾驶场景适配。

  • 能生成龙卷风、洪水、路上遇到大象等极端罕见的长尾场景。

  • 工程师可通过语言和动作控制,灵活进行各种反事实测试。

  • 不仅能生成相机画面,还能输出与真实硬件一致的激光雷达深度数据。

Google Genie3加持|Waymo最新世界模型来了!精华内容

这套世界模型究竟如何构建一个让AI安全学习的“超级驾校”?其核心优势体现在知识广度、可控精度和多模态真实感三个层面。

预见罕见路况

自动驾驶系统最大的挑战之一是应对极端罕见的长尾事件。Waymo世界模型突破了传统仿真器的局限,不仅能模拟日常的城市交通,更能主动生成如龙卷风、洪水、野火等极端天气场景,甚至是路上突然出现大象这种匪夷所思的状况。通过在虚拟环境中反复“经历”这些危险,系统能够学习并形成应对策略,从而极大提升在现实世界中的安全性。

精准场景控制

该模型赋予了工程师前所未有的控制能力。他们可以通过三种方式干预仿真:驾驶动作控制、场景布局控制和语言控制。这意味着工程师可以自由调整车辆路线、改变红绿灯状态、切换天气和昼夜,进行各种“如果当时这样会怎样”的反事实测试。这种高可控性使得对特定边缘案例的深度测试和算法优化成为可能,加速了技术的迭代。

超越视觉仿真

为了让仿真效果无限贴近现实,该模型不只生成高清的视觉画面,更重要的是,它能生成与Waymo车载硬件传感器完全一致的激光雷达深度数据。这种多模态数据的精确同步,确保了虚拟环境中的感知和决策模型能够无缝部署到真实车辆上。此外,它还能将普通的行车记录仪视频“翻译”成多模态仿真数据,极大地扩展了高质量训练数据的来源。

Waymo世界模型通过其强大的场景生成能力、灵活的控制手段和多模态的真实还原,为自动驾驶技术构建了一个高效、安全且可复现的训练闭环。这不仅加速了算法的成熟,也为未来的完全无人驾驶奠定了更坚实的安全基石。当机器能够预见并应对一切极端情况,我们离真正的无人驾驶时代还有多远?

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章