小米深夜亮剑AI:发布三大自研模型,万亿参数Pro版对标顶尖
小米于近日深夜发布了其自研的MiMo-V2系列三大AI模型,包括旗舰基座模型MiMo-V2-Pro、全模态基座模型MiMo-V2-Omni,以及语音合成大模型MiMo-V2-TTS。此次发布引起了科技界的广泛关注,一个重要原因是,此前在全球API聚合平台OpenRouter上匿名上线并广受好评的神秘模型“Hunter Alpha”和“Healer Alpha”,其真实身份正是此次发布的MiMo-V2-Pro和MiMo-V2-Omni的早期测试版本。
首先是旗舰基座模型MiMo-V2-Pro,其定位是为高强度的智能体(Agent)工作场景打造。根据小米公布的信息,该模型总参数量超过1万亿,激活参数为42B,并支持100万(1M)token的超长上下文处理,专为处理复杂任务、长篇文档和代码而设计。在性能方面,据称其在全球大模型综合智能排行榜Artificial Analysis上名列前茅,在国内模型中位居第二。此外,MiMo-V2-Pro在定价上采取了极具竞争力的策略,其API定价远低于性能对标的行业顶尖模型,旨在降低高端AI能力的应用门槛。
其次是全模态基座模型MiMo-V2-Omni,它被设计为AI智能体的“感官系统”,能够“看得见、听得懂、能动手”。该模型从底层融合了文本、视觉、语音等多种模态,原生支持图像、视频和超长音频的理解。据介绍,其在多模态感知、工具调用、函数执行及图形界面操作方面表现出色,能够直接应用于浏览器自动化、桌面操作等复杂场景,打通了从“感知”到“决策”再到“执行”的全链路。
最后发布的MiMo-V2-TTS是一款专为智能交互打造的语音合成大模型。它致力于解决传统AI语音生硬、缺乏情感的问题。通过自研架构和海量语音数据训练,该模型实现了对语音风格和情绪的精细控制,不仅能模仿人类自然的说话韵律,在同一句话内实现语气转折,还支持东北话、四川话、粤语等多种方言,甚至具备高质量的歌唱合成能力,旨在为AI智能体注入更具“灵魂”和温度的声音。
在落地应用与开放策略方面,小米宣布这三款模型已全面应用于小米生态内的产品,如Xiaomi Miclaw、金山办公和小米浏览器。同时,小米也向开发者开放了API接口,并推出了限时免费体验活动,以推动AI应用生态的建设。
此次三大模型的集中发布,标志着小米已初步构建起从端侧到云端、从单一文本到全模态、从基础能力到交互表达的AI大模型全栈技术布局,体现了其在AI领域的系统性投入和清晰的技术路线。

值友6512679117
校验提示文案
woshishui---
校验提示文案
woshishui---
校验提示文案
值友6512679117
校验提示文案