小米 MiMo-V2.5 API 永久降价,最高砍掉 99%
今天凌晨 0 点,小米 MiMo 官宣了一件事: MiMo-V2.5 系列 API 永久降价,生效时间 5 月 27 日 0:00 ,全球同步。
最高降幅 99%。而且不再区分上下文窗口长度, 256K 和 1M 一个价。

新价格到底有多低
拿旗舰模型 MiMo-V2.5-Pro 来说:
•缓存命中(输入):¥0.025/百万 tokens ,只要 2 分 5 。相比原始定价降了 99%
•缓存未命中(输入):¥3.00/百万 tokens ,降 57%
•输出:¥6.00/百万 tokens ,降 71%
标准版 MiMo-V2.5 更便宜:
•缓存命中:¥0.02/百万 tokens , 2 分钱
•缓存未命中:¥1.00/百万 tokens
•输出:¥2.00/百万 tokens
一百万个 token 的缓存命中价只要两分五厘——一百万 token 大概能处理 70 多万个汉字。这对做 Agent 的人来说,实际使用成本直接降到了几乎可以忽略的水平。
TTS 语音系列( MiMo-V2.5-TTS 、 VoiceDesign 、 VoiceClone )限时免费,继续维持。 V2 系列老模型价格不变,但官方建议迁移到 V2.5 。
Token Plan 体系也翻了新
Token Plan 的 Credits 额度全面重置,所有当前在有效期的用户今天 0:00 全量重置。
用量提升到原来的 5-8 倍:
•Lite :¥39/月 → 从 0.6 涨到 41 Credits
•Standard :¥99/月 → 从 2 涨到 110 Credits
•Pro :¥329/月 → 从 7 涨到 380 Credits
•Max :¥659/月 → 从 16 涨到 820 Credits
还有一些细节:闲时(北京时间凌晨 0-8 点)打八折,连续包月额外优惠。
针对 Token Plan 已过期的历史付费用户,官方说未来一周有惊喜。
背景:开源一个月后的价格调整
MiMo-V2.5 系列是 4 月 22 日发布的,到现在刚满一个月。两款模型全部 MIT 协议开源,权重挂在 HuggingFace 上。
V2.5-Pro 是 1.02T 参数的 MoE 架构,激活 42B , 1M 上下文,在 SWE-bench Pro 上 57.2%,接近 Claude Opus 4.6 和 Gemini 3.1 Pro 。 V2.5 标准版是 310B 参数/15B 激活,原生支持图文音视频全模态。
发布时国内定价是输入 ¥7.00/百万 tokens 、输出 ¥21.00/百万 tokens 。一个月后的今天直接降到 ¥3.00/¥6.00——缓存命中更是直接打到 ¥0.025 。
同时,小米之前推出的「百万亿 Token 创造者激励计划」 100T Tokens 已于 5 月 26 日全部发放完毕,提前收官。
意味着什么
大模型 API 价格战已经从"降几次价"变成了"割一次狠的"。前有 DeepSeek V4-Pro 永久 75% 折扣(输出 ¥6/百万 tokens ),后有小米 V2.5 直接干到 ¥0.025 。
当缓存命中价打到两分五的时候, Token 不再是成本瓶颈了。这会让更多开发者愿意把模型嵌入高频、实时的业务流程里——反正调用一次比查数据库还便宜。
小米这个价格策略逻辑很清楚:模型能力已经到了可以打的位置,那就用价格换市场。毕竟这个赛道现在比的不是谁能赚钱,而是谁能先把开发者生态养起来。
