当前位置:
AIGC文章详情

小米开源OneVL自动驾驶大模型,推理延迟仅0.24秒

源自41位全网作者

05-15 12:36

精选参考来源

内容由AI生成

精选参考来源

1. 小米技术今日正式发布并开源 Xiaomi OneVL 一步式潜空间语言视觉推理框架官方表示,该模型在业内率先实现 VLA、世界模型、潜空间推理等多个技术路线的统一,在具备 XLA 模型强悍推理能力的基础上,大幅提升了推理的速度和精度,是行业内具备开创性的方案,在精度上超越显式 CoT、在速度上对齐“仅答案”预测的潜空间 CoT 方案

2. 小米正式发布并全面开源Xiaomi OneVL自动驾驶模型。过去几年,行业一直在卷:激光雷达数量、算力芯片、端到端。但OneVL指向的是自动驾驶开始从感知时代进入推理时代,开始理解世界正在发生什么:让车不只是识别道路,而是开始像人一样理解场景、推理行为、再完成动作决策。比如:它不只是看到一辆外卖车,而是会推理“它下一秒可能突然变道”;不只是识别行人,而是会判断“这个人是不是准备横穿马路”。这已经越来越接近人类驾驶逻辑。小米这次选择了全面开源,包括模型、论文、训练框架。这有点像当年安卓开源带来的行业变化,一旦底层能力开放,行业迭代速度会被迅速拉高。智能驾驶下半场,已经不只是硬件军备竞赛,是谁更接近真正的“物理世界理解”#大v聊车##小米发布自动驾驶模型#

3. 小米正式发布一步式潜空间语言视觉推理框架——Xiaomi OneVL,同时将模型权重和训练、推理代码全面开源,与全球开发者共同推动自动驾驶的进步和迭代。通过“语言推理 + 视觉未来预测”的双重监督,Xiaomi OneVL 将可解释性与世界模型的未来预测能力统一到 latent reasoning 中,推理延迟最低0.24秒,为量产车端实时部署提供了可行路径。附上小米原文链接:网页链接#小米汽车##新能源汽车#

4. 小米发布Xiaomi OneVL一步式潜空间推理框架并全面开源!首次将VLA与世界模型统一,基于潜空间CoT一步并行生成,三项基准SOTA,NAVSIM得分88.84超越显式CoT(88.29),延迟仅0.24s(仅为VLA自回归的5.4%)。模型、代码全开源。#小米##自动驾驶# 数码闲聊站

5. 在中国的车企和科技企业大量投入下,自动驾驶走到现在,感知不再是瓶颈,模仿学习也逐渐触顶,现在更多的还是更好的策略,解决"看清了,该怎么办"。从看到到做决定,只有几十毫秒。小米这次发布的 Xiaomi OneVL,就是在回答这个问题,当自动驾驶进入"需要推理"的阶段,模型该怎么既快又准。发布了头条文章:《小米发布自动驾驶模型Xiaomi OneVL,如何解决"推理"难题?》 小米发布自动驾驶模型Xiaomi OneVL,如何解决″推理″难题?

6. #小米发布自动驾驶模型##小米自动驾驶模型XiaomiOneVL发布# 小米发布并全面开源自动驾驶模型Xiaomi OneVL:一步式潜空间语言视觉推理框架,将VLA、世界模型和潜空间推理三大技术路线统一到同一框架中,让大模型推理“又快又准”:精度上超越显式思维链,速度上对齐“仅答案”预测,推理延迟最低仅0.24秒,为传统VLA自回归推理的5.4%,为量产车端实时部署提供了可行路径

7. 小米汽车发布并全面开源自动驾驶模型 Xiaomi OneVL ——一步式潜空间语言视觉推理框架。根据官方介绍,上述模型实现 VLA、世界模型、潜空间推理等多个技术路线的统一,在具备 XLA 模型推理能力的基础上,大幅提升推理的速度和精度,在精度上超越显式 CoT、在速度上对齐「仅答案」预测的潜空间 CoT 方案。更重要的是,小米还宣布将 Xiaomi OneVL 的模型权重和训练、推理代码全面开源,与全球开发者共同推动自动驾驶的进步和迭代。小米方面称,这不只是一次对 XLA 的功能补充,而是对 XLA 技术路线中「潜空间推理」能力的一次深度探索。#小米汽车##人工智能##自动驾驶模型##42how#

8. 自动驾驶从感知、模仿进入认知推理阶段,小米发布的 OneVL 核心解决 “看清后如何快速精准决策” 难题。它采用 XLA 路线,创新 Latent CoT,将推理载体从语言转向视觉时空结构。通过双模态 latent token、双解码器监督、一步式推理三大设计,推理延迟压至 0.24 秒,速度较显式 CoT 最高提升 2.3 倍,精度更优。OneVL 统一 VLA、世界模型与潜空间推理,还具备语言 + 视觉双维可解释性,已在多项基准达 SOTA。虽面临算力、长尾场景等挑战,但为自动驾驶落地提供关键方案,且可拓展至机器人等领域。

9. “小米正式发布—— Xiaomi OneVL:一步式潜空间语言视觉推理框架。该模型在业内率先实现 VLA、世界模型、潜空间推理等多个技术路线的统一”小米在开源大模型这个领域真是一路狂飙!无数搞辅助驾驶和机器人的公司都在欢呼雀跃又可以拿小米开源的模型搞一个 Demo,融资续命了因为在这个领域,搞出来真正能用的开源模型实在太难了!需要大量的数据以及工程实操,同时还要舍得开源小米首先是拥有基座大模型,然后又有强悍的汽车业务,这是无数公司可遇而不可求的优越条件但是归根到底,就是雷总在核心技术上坚定不移的投资决心小米,掌握 AI 时代的核心科技!小米技术新突破!Xiaomi OneVL 自动驾驶模型正式发布并全面开源

10. #小米发布自动驾驶模型#小米自动驾驶模型Xiaomi OneVL:一步式潜空间语言视觉推理框架,正式发布并全面开源。该模型将VLA、世界模型和潜空间推理三大技术路线统一到同一框架中,让大模型推理“既快又准”,为量产车端实时部署提供了可行路径。欢迎全球开发者与研究人员共同参与,探索自动驾驶大模型的无限可能。 小米技术新突破!Xiaomi OneVL 自动驾驶模型正式发布并全面开源

11. #雷军谈小米自动驾驶模型#5月13日,小米技术正式发布并开源Xiaomi OneVL一步式潜空间语言视觉推理框架。小米创办人、董事长兼CEO雷军发文表示,该模型在业内率先通过潜空间推理,将VLA、世界模型统一到同一套框架中。据介绍,Xiaomi OneVL全面刷新了潜在推理方法的性能上限,在精度上超越显式CoT,速度上对齐 "仅答案" 预测潜空间CoT方案。目前模型权重与训练、推理代码已全面开源。

12. 很多人还以为小米OneVL只是一个自动驾驶论文,但我认真看完以后,发现这东西其实已经不是“车企思维”了。Tesla这几年一直在干一件事:让AI真正理解现实世界。什么Occupancy Network、World Model、本质都在解决一个问题:AI怎么预测未来,而不是只会识别画面。因为现实世界不是聊天框,车不会因为你“理解了文字”就不撞车。真正难的是理解空间、速度、惯性、摩擦力、运动趋势这些物理因果关系。所以Tesla越来越像一家“现实世界AI公司”,而不只是车企。华为则是另一条路线,更偏工程体系。ADS很强,但核心思路还是AI+规则+工程冗余,更强调中国复杂路况、安全和稳定性,本质上是通信工业体系思维。理想则更偏“AI产品化”,李想现在其实已经不怎么把车当车了,而是当AI空间,MindVLA、AI司机这些方向,本质都是在做Agent化体验。但小米这个OneVL不太一样。它已经开始研究latent reasoning(潜在推理)和世界模型了。简单说就是:AI不一定一步一步说出思维链,但它已经在内部完成了对现实世界的预测。这特别像老司机开车。真正厉害的司机,并不会脑子里默念“前车减速所以我要刹车”,而是瞬间完成空间和风险预测。这其实已经越来越接近“直觉”。更重要的是,小米可能是中国少数同时拥有:手机、汽车、IoT、摄像头、机器人、AI助手、家庭设备的一家公司。手机理解人,汽车理解道路,米家理解空间,机器人理解物体。最后这些数据会汇聚成同一个世界模型。所以我越来越觉得,自动驾驶根本不是汽车工业,而是具身智能预训练。OneVL今天是不是全球最强不重要,真正重要的是:小米已经开始进入“现实世界AI”这条主战场了。而且它选择开源,也不是单纯共享代码。真正目的其实是抢生态、抢开发者、抢AI时代的话语权。因为未来最值钱的数据,不是互联网文字,而是真实世界数据。谁能长期低成本获取现实世界数据,谁才可能拥有下一代AI的船票。#小米发布自动驾驶模型#

13. 天大 × 小米新作!VGGDrive:让自动驾驶大模型拥有3D几何感知能力

14. 小米在刚刚正式发布并全面开源自动驾驶模型Xiaomi OneVL,将VLA、世界模型和潜空间推理三大技术路线统一到同一框架中,性能刷新多项SOTA。小米在XLA推送之后,辅助驾驶体验已经相当不错了,估计在新技术落地之后,就要往国内顶级智驾前进了。虽然小米智驾因为入场晚导致起步晚,但是进步速度非常快,小米在AI领域的长期投入让他们在资金量和人才量这块有不小优势,而且大模型的研究成果也可以反哺智驾的进步。如今,小米Mimo大模型已经开源,并且在全球大模型榜单上刷过一轮榜了,没理由不相信小米可以搞好智驾大模型

15. Xiaomi OneVL 自动驾驶模型正式发布并全面开源 不是堆参数,而是把大模型推理延迟压到了0.24 秒,在保证精度的前提下,给量产智驾留了一条能跑起来的路。 统一 VLA、世界模型和潜空间推理三大技术路线,还把模型和代码全开源了,让大模型智驾离量产更近了一步。 小米原文链接:http://t.cn/AXifkdP0 #小米发布自动驾驶模型##小米自动驾驶模型XiaomiOneVL发布#

16. #微博声浪计划##听见微博# 小米发布自动驾驶大模型“Xiaomi OneVL”,整合VLA、世界模型和潜空间推理三大技术路线,推理延迟最低0.24秒,精度达行业最优。引入语言与视觉双维度可解释性设计,解决决策不透明问题。采用Apache 2.0协议全面开源,支持商用及二次开发,推动行业技术融合,助力“人车家全生态”布局。 科技事儿的微博音频

17. 【#小米发布自动驾驶模型##小米自动驾驶模型XiaomiOneVL发布#】小米今天(5月13日)发了个自动驾驶大模型——Xiaomi OneVL,还把权重和代码全开源了。简单说,它是把视觉语言模型(VLA)、世界模型和未来潜空间推理塞进同一个框架,让智驾AI"边想边开"还不卡顿。亮点在于:推理精度超过传统的显式思维链(CoT),但延迟压到最低0.24秒,只有普通VLA自回归推理的5%左右,理论上能满足车端实时部署。测试成绩在多个主流智驾基准刷到SOTA,还能用文字解释"为啥这么开"、用预测画面展示"接下来发生啥",兼顾可解释性。💬 点评:这步棋挺聪明——既秀了XLA架构下的技术肌肉,又靠开源攒学术界和开发者的好感,顺带给小米智驾做技术背书。潜空间推理统一VLA+世界模型是行业难点,能做到精度和速度双优确实有含金量。不过目前还是研究级模型,真上车还得看后续SU7/YU7的OTA表现,别光跑分好看、实车体验拉胯就行。整体来说,国内车企里愿意把核心智驾模型开源的很少,小米这波格局还可以。

18. 小米自动驾驶的隐式推理革命:OneVL如何用视觉+语言双监督超越CoT

19. 告别推理延迟!OneVL:用“视觉语言解释”实现一步到位的自动驾驶轨迹预测

20. 解决自动驾驶CoT推理的效率痛点!小米提出一步式潜在推理框架,速度比显式CoT快2.3倍 【自动驾驶论文解读】

21. 小米重磅开源具身大模型MiMo-Embodied!打通自动驾驶与机器人

22. 小米发布OneVL | 一步推理干翻CoT,延迟精度全都要

23. 小米技术新突破!Xiaomi OneVL 自动驾驶模型正式发布并全面开源

24. 小米具身大模型 MiMo-Embodied 发布并全面开源,业界首个打通自动驾驶与具身智能

25. 小米甩出“王炸”!OneVL自动驾驶模型全面开源,打破行业黑盒

26. 小米开源结合自动驾驶和机器人技术的AI模型

27. 小米正式发布并全面开源自动驾驶模型Xiaomi OneVL:一步式潜空间语言视觉推理框架,推理延迟最低仅0.24秒,让大模型推理“又快又准”

28. 端到端VLA论文解读 | 小米发布端到端VLA模型OneVL,一步推理干翻CoT,延迟精度全都要

29. 小米开源自动驾驶模型:0.24秒延迟如何定义“向实向善”

30. 小米发布并开源Xiaomi OneVL自动驾驶模型

31. 【网通社快报】小米发布全球首个跨域具身大模型MiMo-Embodied,打通自动驾驶与家居智能

32. 小米自动驾驶模型Xiaomi OneVL开源:业内率先统一VLA、世界模型路线

33. 小米正式发布并全面开源自动驾驶模型Xiaomi OneVL:精度上超越显式思维链,速度上对齐“仅答案”预测,推理延迟最低仅0.24秒

34. 小米放大招!具身大模型开源,覆盖自动驾驶+全场景智能!

35. 雷军宣布:小米自动驾驶模型Xiaomi OneVL,今天正式发布并开源,欢迎全球开发者、研究人员一起参与探索

36. 开源自动驾驶和机器。小米开源自动驾驶和机器人统一的「小米具身基座模型 MiMo-Embodied」。 人类之所以能无缝切换于「厨房做饭」、「客厅整理」和「道路驾驶」,是因为我们依赖同一套对空间、物体和动态的通用理解能力。真正的 AI 也应当具备这种通用的空间推理能力。 如果机器人🤖和自动驾驶🚗都在解决感知、理解和预测的问题,那么它们本质应该共享同一个“物理世界的认知大脑🧠”。 我们利用多阶段预训练、思维链 (CoT) 及强化学习 (RL) 微调,验证了一个核心发现:自动驾驶与机器人的数据存在强大的「正向迁移」和「相互强化」效果。#无人驾驶汽车 #小米汽车 #小米高速自动驾驶实测 #智能无人驾驶 #人车家全生态

37. 雷军:小米自动驾驶模型Xiaomi OneVL正式发布并开源;欢迎全球开发者、研究人员一起参与,探索自动驾驶大模型的更多可能性

38. 从小米新开源的MiMo-Embodied 具身大模型聊起:为啥电车巨头们都盯上了 “机器人 + 开车” 这事儿?

39. 小米发布并开源自动驾驶模型Xiaomi OneVL

40. 小米自动驾驶:凭“世界模型”与全生态冲击全球之巅?

41. 【科技和移动性亮点】小米发布面向自动驾驶汽车与机器人领域的开源人工智能模型

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章