近日,小米公司发布并开源了其最新的自研大模型MiMo-V2-Flash,引发了科技界的广泛关注。这款模型以其比肩行业领先者DeepSeek-V3.2的性能、出色的推理速度和极具竞争力的成本,被视为开源大模型领域一位强有力的“重磅选手”。
MiMo-V2-Flash在架构上采用了当前前沿的混合专家(MoE)设计。其总参数量达到3090亿,但在实际运行时,激活参数仅为150亿。这种“大而精”的设计,旨在用更少的计算资源实现与顶级模型相当的性能,平衡了模型的强大能力与部署效率。

在核心性能方面,多项权威基准测试显示,MiMo-V2-Flash已跻身全球开源模型的第一梯队。尤其在代码能力上表现突出,其在SWE-bench Verified(一个模拟真实世界软件修复任务的测试)中取得了73.4%的得分,超越了所有已知的开源模型。在AIME 2025数学竞赛和GPQA-Diamond科学知识等推理测试中,其表现也位列开源模型前两名。综合来看,其整体性能与DeepSeek-V3.2、Kimi-K2等头部模型不相上下。
除了强大的性能,MiMo-V2-Flash最大的亮点在于其极致的效率和性价比。该模型通过引入多词元预测(MTP)和混合滑动窗口注意力(Hybrid SWA)等创新技术,大幅提升了推理速度。据官方数据和用户实测反馈,其输出速度最高可达每秒150个token,响应迅速,延迟感低,在与豆包、DeepSeek等模型的对比中展现出明显的速度优势。

在成本控制上,小米更是将“性价比”发挥到了极致。其API定价为每百万输入token 0.7元人民币(约0.1美元)、输出token 2.1元人民币(约0.3美元),远低于行业主流高性能模型的定价水平。这一极具吸引力的价格,加上模型采用MIT宽松协议全面开源,极大地降低了开发者和中小企业使用先进AI技术的门槛。
在功能和应用层面,MiMo-V2-Flash支持高达256k的超长上下文窗口,能够处理数百轮的智能体(Agent)交互和复杂的工具调用任务。官方演示和用户测试表明,它不仅能胜任日常对话、长文写作,还能完成生成交互式网页、编写小游戏等复杂的代码生成任务。同时,模型还支持深度思考和联网搜索功能,使其应用场景更加广泛。

不过,也有用户在实际体验中发现,尽管模型在多数场景下表现稳定,但在处理某些极其复杂的交互任务或特定刁钻问题时,仍有不稳定的情况出现,稳定性有待进一步打磨。
此次发布会由被誉为“天才少女”的小米MiMo大模型负责人罗福莉主导,她曾是DeepSeek-V2的核心开发者之一。她的加盟和MiMo-V2-Flash的发布,被外界解读为小米在底层AI技术研发上全面发力的明确信号,标志着小米正从“组装厂”向“原生科技巨头”加速转型,并致力于将强大的AI能力融入其“人车家”全生态战略中。