小米MiMo登顶全球开源第一,单任务推理不到1块钱

源自195位全网作者

11:52

精选参考来源

1
之前老是有人问小米什么时候把mimo v3.0端上来。可能是听到了大家的呼唤,我们伟大的罗!圣!响应了号召,给大家端来了#小米开源MiMoV2.6大模型#。省流:在价格持平mimo v2.5的情况下,做到了强化学习RL开源权重第一,一举超过Kimi K3、通义3.8Max,简而言之就是开源模型性价比冠军。我知道很多人又要提前立场>事实开始质疑了,小米也知道很多人是怎么想的,说一千道一万要想打破质疑,最有效的方法就是事实说话。所以这次是全程直播6天,每小时烧3万美元,Token消耗、训练指标、成本全公开,在整体训练时间里,mimo v2.6的软件工程评测基准 DeepSWE v1.1 分别提升约 17 分(48.8 → 65.7)和约 14 分(58.4 → 72.6),MiMo-V2.6-Pro 在多数 Agent Benchmark 上取得了比肩 Claude Opus5 和 GPT-5.6 Sol 的效果,MiMo-V2.6-Flash 则全面超越 MiMo-V2.5-Pro,在开源大模型里真的可谓“遥遥领先”。小米也不止跑测试,mimo v2.6还实现了原生全模态+超大窗口,要知道同样作为开源,在性能大幅提升的情况下价格和mimo v2.5持平(Flash:输入1元/百万token,输出2元;Pro:输入3元,输出6元),相当于同等能力下价格为海外旗舰1/20‑1/60(达不到Claude Fable 5.1 和 GPT-6 Astra的高度也要承认),但训练成本这块真的没得说。罗圣啊,伟大!
2
#小米MiMo为何登顶开源第一#小米正式发布并开源MiMo-V2.6系列,旗舰MiMo-V2.6-Pro拿下46分,登顶Artificial Analysis开放权重模型榜,被称作当前全球最强开源模型。它支持原生全模态输入,搭载1M tokens超长上下文,在编程、复杂知识任务上能力大幅跃升。快速突破的背后,是大规模强化学习技术路线的突破,仅用数天完成高强度RL训练,实现能力跨越式增长。开源不只是放出权重,配套训练框架、任务环境一并开放,降低开发者二次开发门槛。大模型赛道竞争,已经从基础能力比拼,转向智能体、长任务、工程落地的综合较量。
全部
来源
内容由AI生成

精选参考来源

1. 之前老是有人问小米什么时候把mimo v3.0端上来。可能是听到了大家的呼唤,我们伟大的罗!圣!响应了号召,给大家端来了#小米开源MiMoV2.6大模型#。省流:在价格持平mimo v2.5的情况下,做到了强化学习RL开源权重第一,一举超过Kimi K3、通义3.8Max,简而言之就是开源模型性价比冠军。我知道很多人又要提前立场>事实开始质疑了,小米也知道很多人是怎么想的,说一千道一万要想打破质疑,最有效的方法就是事实说话。所以这次是全程直播6天,每小时烧3万美元,Token消耗、训练指标、成本全公开,在整体训练时间里,mimo v2.6的软件工程评测基准 DeepSWE v1.1 分别提升约 17 分(48.8 → 65.7)和约 14 分(58.4 → 72.6),MiMo-V2.6-Pro 在多数 Agent Benchmark 上取得了比肩 Claude Opus5 和 GPT-5.6 Sol 的效果,MiMo-V2.6-Flash 则全面超越 MiMo-V2.5-Pro,在开源大模型里真的可谓“遥遥领先”。小米也不止跑测试,mimo v2.6还实现了原生全模态+超大窗口,要知道同样作为开源,在性能大幅提升的情况下价格和mimo v2.5持平(Flash:输入1元/百万token,输出2元;Pro:输入3元,输出6元),相当于同等能力下价格为海外旗舰1/20‑1/60(达不到Claude Fable 5.1 和 GPT-6 Astra的高度也要承认),但训练成本这块真的没得说。罗圣啊,伟大!

2. #小米MiMo为何登顶开源第一#小米正式发布并开源MiMo-V2.6系列,旗舰MiMo-V2.6-Pro拿下46分,登顶Artificial Analysis开放权重模型榜,被称作当前全球最强开源模型。它支持原生全模态输入,搭载1M tokens超长上下文,在编程、复杂知识任务上能力大幅跃升。快速突破的背后,是大规模强化学习技术路线的突破,仅用数天完成高强度RL训练,实现能力跨越式增长。开源不只是放出权重,配套训练框架、任务环境一并开放,降低开发者二次开发门槛。大模型赛道竞争,已经从基础能力比拼,转向智能体、长任务、工程落地的综合较量。

3. #小米MiMo为何登顶开源第一#小米正式开源MiMo-V2.6系列,MiMo-V2.6-Pro直接拿下Artificial Analysis综合智能指数46分,在114个开放权重模型里排名第一,官方将它称作当下全球最强开源模型。 亮眼的榜单成绩只是一部分,这款模型支持文、图、视频、音频多模态输入,还搭载1M tokens超长上下文。性能跃升的核心,来自小米投入更大规模的强化学习训练。 以往开源大模型赛道大多是AI公司主导,手机厂商杀入榜单顶端,确实让人意外。多模态加上百万级上下文,不管是长文档处理、多媒体内容解析,都有很大的想象空间。当然榜单分数是纸面实力,实际落地、本地部署、真实场景的稳定性,还需要开发者持续实测。手机厂商跨界跑出这样的成绩,MiMo-V2.6,大概率会搅动国产开源大模型的竞争格局。

4. 小米MiMo-V2.6进展曝光,把大模型训练全程直播出来

5. 小米MiMo V2.6 Pro后训练5天到第二,全球前10格局将改写

6. 2026.9.17小米跌0.15%,收26.14,成交额23.19亿,总市值6734亿。 今天,小米MiMo大模型负责人罗福莉,对外公布MiMo-V2.6模型,并且直播展示强化学习训练全过程,在AI行业里属于非常少见的操作。 今年4月MiMo-v2.5开源之后,小米团队沉寂了近半年,没有急于出新版本,而是集中精力研究一个核心问题:强化学习(RL)到底能把大模型能力推到多高。这次V2.6还在强化学习训练中途,团队从三个方向做能力扩容:扩大训练算力规模、搭建多任务智能体环境、提升评分打分环节的算力投入。 这次训练包含Pro、Flash两个版本模型,训练成本高昂,平均一小时烧掉约3万美元,目前累计花费已经超过125万美元。最特别的地方是训练全程公开直播,页面上实时展示训练花费、token处理量、模型评测分数、甚至哪块显卡出现故障,所有内部训练指标所有人都能在线围观,海外AI研究者都评价这才是真正的开源。 技术上,每一轮训练会处理约20亿token,同一个问题,让模型尝试16种不同解题思路,再从中筛选优质答案来学习;整套系统采用完全异步运行,不同任务并行执行,不用排队等待,极大提升大规模智能体训练效率。同时搭建了多任务环境,让模型可以同时在多种工具框架里做任务;并且加大打分环节算力,用标准化测试案例给模型结果打分,让奖励机制更精准。 从当前评测数据看,训练刚启动1天多,模型能力已经出现明显上涨。在DeepSWE代码评测基准上,Pro版本得分63.72,Flash版本60.77,Flash起点更低、追赶速度更快。不过对比头部代码大模型还有差距,训练还没有跑完。 小米计划未来几周,逐步把这套强化学习的技术细节开源。这次动作的核心意义,不只是出新模型,而是公开验证:强化学习也可以像预训练一样,依靠扩大算力、任务环境、评分资源,持续提升智能体能力,这也是当下AI前沿最关注的方向。同时这套技术未来会落地到小米手机、汽车、机器人等终端产品。 不断成长的企业+好价格,作为长期投资者,耐心持股,静待花开。 本文仅为作者的投资思考,不做投资推荐,请独立思考,自己的资金自己负责。

7. 小米MiMo-V2.6直播强化学习训练

8. MiMo RL 直播结束! 我们把数据管线开源了

9. 小米公开直播MiMo-V2.6 RL训练,罗福莉披露20亿Token进展

10. 小米MiMo-V2.6大模型训练进展:RL技术全公开!

11. 小米MiMo-V2.6强化学习训练进展

12. 小米MiMo团队沉寂半年发力,MiMo-V2.6强化学习升级,训练直播即将开启

13. 小米MiMo团队沉寂半年有新进展,MiMo-V2.6强化学习升级,训练直播将启

14. 小米MiMo-V2.6公开直播,AI技术透明化新突破

15. 小米MiMo-V2.6强化学习升级,直播训练即将启程!

16. 小米MiMo-V2.6强化学习升级,AI领域再创新高

17. 小米MiMo-V2.6上线:强化学习技术开启AI新纪元

18. 小米MiMo团队推出强化学习新版本,实时训练直播即将开启

19. 小米MiMo团队发布强化学习新进展,MiMo-V2.6即将公开

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章