小米汽车在智能驾驶领域的进展备受关注。通过对核心团队的采访,可以清晰看到其从规则驱动到认知驱动的技术路线图,以及对端到端和VLA等前沿技术的布局。这对于理解一家科技巨头如何入局智驾赛道,提供了有价值的视角。
智能速览
小米智驾计划在2025年7月推出千万级clips的端到端版本。
小米认为智驾发展历经规则驱动、数据驱动到认知驱动三个阶段。
VLA被定义为认知驱动的新范式,并非端到端的简单升级。
世界模型主要用于云端数据闭环和仿真,不直接参与车端决策。
精华内容
从小米智驾的迭代路线,到对前沿技术的定义,其每一步都显得深思熟虑。那么,其技术底牌究竟是什么?
清晰的迭代路径
小米智驾的发展路径规划清晰。从今年3月的高精地图高速NOA起步,5月左右推进至城区NOA,并计划在10月迈向无图方案。真正的重点在端到端模型的量产上,计划在明年2月和7月分别推出基于300万和1000万clips的版本,显示出其对数据驱动发展的坚定投入。
三阶段进化论
在技术理念上,小米将智能驾驶划分为三个阶段:1.0的规则驱动、2.0的数据驱动和3.0的认知驱动。这表明其技术发展并非跳跃式进行,而是遵循行业共识的演进路径,逐步构建从基础能力到高级智能的完整体系,兼顾了技术的稳定性和前瞻性。
重新定义VLA
对于业界热门的VLA(视觉-语言-动作)模型,小米给出了自己的定义。相关负责人明确指出,VLA并非端到端的升级版,而是认知驱动下的全新范式。其核心观点在于,纯端到端模型在处理复杂逻辑和需要长时序理解的场景时,推理能力存在局限,而VLA正是为了弥补这一短板。
云端大脑的角色
小米的世界模型更多扮演“云端大脑”的角色,不直接输出车辆的控制指令。它的核心价值在于通过生成高质量数据、构建闭环仿真环境来进行强化学习训练,从而间接提升车端模型的性能。这种分工明确了云端与车端的功能边界,有利于提升整个系统的效率和安全性。
小米在智驾领域的布局展现了其务实与远见。通过清晰的技术路线图和对核心概念的深入思考,它正稳步构建自己的护城河。未来,随着VLA等技术的落地,小米能否在激烈的市场竞争中实现后来居上,值得期待。