API价格战国标:DeepSeek vs MiMo vs 文心 vs 千问
我是虾哥,不是程序员。
上周三中午,我正吃着外卖刷技术群,一条消息把我手里的筷子吓掉了——小米宣布MiMo V2.5系列API永久降价,最高降幅99%。100万Token的缓存命中调用,只要2.5分钱。
紧接着第二天,DeepSeek也亮了底牌:V4-Pro原本2.5折优惠5月31日到期,现在直接永久锁定原价的1/4。
百度文心5.1上周刚上线,比5.0输出便宜25%。阿里Qwen3.7-Max新品直接5折开卖。
大模型API价格战,已经从"谁先降"变成了"谁降得多"。
虾哥花了两天把这几家的定价扒了个底朝天,今天这篇就是帮各位算清楚:如果你是普通开发者,到底该选谁?
🔵 1️⃣ 四家旗舰模型,价差大到离谱
先放核心价格对比。四家各自的"旗舰主力"模型,统一按百万Token计价单位换算:
🔶 MiMo V2.5 Pro · 小米
输入(未命中) ¥3 | 输入(命中) ¥0.025 | 输出 ¥6
🔷 DeepSeek V4-Pro · 深度求索
输入(未命中) ¥3 | 输入(命中) ¥0.025 | 输出 ¥6
▪️ ERNIE 5.1 · 百度
输入(未命中) ¥4 | 输入(命中) — | 输出 ¥18
▪️ Qwen3.7-Max · 阿里(5折限时)
输入(未命中) ¥12 | 输入(命中) — | 输出 ¥36
📌 价格来源:截至2026年5月28日各平台官方公示价格。百度按≤32K上下文计;Qwen3.7-Max为5折限时价。
看懂了吗?小米MiMo和DeepSeek的输入输出定价一模一样,都是缓存未命中¥3/百万Token、输出¥6/百万Token。这不是巧合,是直接贴身肉搏。
而百度文心5.1输出价¥18,是前两者的3倍;阿里Qwen3.7-Max就算打了5折,输出¥36,是MiMo的6倍。
当然,定价≠能力。但如果你脑子里有个"每月API预算200块"的框,这差距就是雪崩级的。
🟠 2️⃣ 缓存命中价:真正的"卷王"指标
这次降价最有意思的,是缓存命中价。
啥意思?你调API,大部分请求的system prompt和上下文是重复的。平台检测到这些重复内容已经处理过,就只收你一个超低价——这就是"缓存命中"。
MiMo V2.5 Pro的缓存命中价:¥0.025/百万Token。100万Token只要2.5分钱。比降价前降了99%。
DeepSeek V4-Pro也一样:¥0.025/百万Token。
对于做Agent工作流的开发者来说,这意味着什么?你的系统提示词、RAG检索结果、历史对话——这些反复出现的部分,成本直接打到接近零。
虾哥算了一笔账:如果你每天跑1000次Agent请求,system prompt大约3000 token,历史对话均5000 token,一个月30天。光缓存这部分,按老价格可能要花几百块,现在不到1块钱。
🔵 3️⃣ Token套餐包:小米和DeepSeek的"内卷"新战场
光看单价还不够,还得看套餐。
小米这次炸裂的地方在于,套餐价格不变,但Token额度暴涨50-68倍:
Lite套餐 · 月费¥39
0.6万Credits → 41万Credits(增幅≈68倍)
Standard套餐 · 月费¥99
2万Credits → 110万Credits(增幅≈55倍)
Pro套餐 · 月费¥329
7万Credits → 380万Credits(增幅≈54倍)
Max套餐 · 月费¥659
16万Credits → 820万Credits(增幅≈51倍)
📌 数据来源:小米技术2026年5月27日公告
39块钱包月,Agent场景高缓存命中率下能用500Million+ Token。这在半年前根本不可想象。
DeepSeek还没推Token Plan套餐,目前只有按量后付费。但它的5月31日"暗涨"需要注意——2.5折优惠结束后,永久价锁定原价1/4,也就是输入¥3、输出¥6,这跟现在优惠期价格一样。
等等,一样的吗?对,DeepSeek相当于把2.5折优惠永久化了,不是涨价,但也别期待再降了。
🟠 4️⃣ 百度和阿里:不是不卷,是打法不同
百度文心5.1的输出价¥18/百万Token,看着比MiMo贵3倍,但百度有两张暗牌:
🃏 第一张:ERNIE 4.5 Turbo
输入¥0.8/百万Token、输出¥3.2/百万Token。这才是百度真正的性价比杀手——比MiMo V2.5(非Pro版)的输出¥2还贵一点,但整体跟MiMo Pro组成了一个"第二梯队"。
🃏 第二张:ERNIE X1.1
深度思考模型,输入¥1/百万Token、输出¥4/百万Token。对标DeepSeek-R1,但价格只有R1的一半。
所以百度的策略很清楚:旗舰5.1卖品牌和稳定性,Turbo/X1.1抢开发者。
至于阿里Qwen3.7-Max,12/36的定价即使打5折也偏贵。但Qwen的优势从来不在价格——开源生态、多模态能力、和阿里云基础设施的深度绑定,才是它的护城河。对成本不是特别敏感的企业场景,Qwen仍然是安全牌。
🔵 5️⃣ 照妖镜:100块能跑多少请求?
光列价目表没感觉,虾哥用一个典型场景来算:你做了个AI写作助手,每次请求平均输入3000 token(含system prompt+用户输入)、输出800 token。假设缓存命中率70%。
预算:100元/月,能跑多少次?
🔶 MiMo V2.5 Pro
单次请求 ≈ ¥0.0064 → 100元可跑 ≈15,600次
🔷 DeepSeek V4-Pro
单次请求 ≈ ¥0.0064 → 100元可跑 ≈15,600次
🟢 ERNIE 4.5 Turbo
单次请求 ≈ ¥0.0036 → 100元可跑 ≈27,700次
▪️ ERNIE 5.1
单次请求 ≈ ¥0.0174 → 100元可跑 ≈5,700次
▪️ Qwen3.7-Max (5折)
单次请求 ≈ ¥0.0384 → 100元可跑 ≈2,600次
📌 计算逻辑:70%命中下,输入2100 token走缓存命中价,900 token走未命中价;百度/阿里无缓存命中机制,输入全走未命中。
有意思了。ERNIE 4.5 Turbo居然是最便宜的,100块能跑27,700次。原因很简单:它的输入价¥0.8/百万Token和输出价¥3.2/百万Token本身就低,不靠缓存也能打。
而MiMo Pro和DeepSeek V4-Pro并列第二,因为它们有缓存命中价加持,70%命中场景下拖低了均摊成本。
但如果你的场景缓存命中率很低(比如每次都是全新的长文本输入),MiMo Pro和DeepSeek的未命中输入¥3/百万Token就比ERNIE 4.5 Turbo的贵了。这点要注意。
🟠 6️⃣ 虾哥的实话:按场景选,别按价格选
扒完价格表,虾哥想说一个可能得罪人的观点:API价格已经卷到头了,再卷也卷不出10倍差距了。
真正决定你选谁的,不是"谁最便宜",而是这三件事:
✅ 场景1:Agent工作流(高缓存命中)
→ 首选 MiMo V2.5 Pro 或 DeepSeek V4-Pro。缓存命中价¥0.025/百万Token,Agent长system prompt反复调用的场景碾压级优势。
✅ 场景2:长文本处理(低缓存命中)
→ 首选 ERNIE 4.5 Turbo。输入¥0.8/百万Token是目前最低的未命中输入价,每次处理全新长文档最划算。
✅ 场景3:企业级生产环境
→ 看稳定性,不看价格。百度千帆和阿里百炼的SLA保障、客服体系、合规能力,是目前个人开发者平台给不了的。生产环境出一次故障,省下的API费全赔回去。
还有一句掏心窝的话:小米和DeepSeek的价格战中,真正受伤的是他们自己的利润表。小米Q1归母净利润47.23亿,但财报里也说了要"未来三年砸600亿投入AI"。DeepSeek母公司幻方量化本身就是对冲基金,模型业务短期不赚钱靠母体输血。
所以别光看今天的低价,还得看这个价格能不能撑两年。
最后总结一张速查卡,收藏备用👇
🤖 Agent/工作流
→ MiMo V2.5 Pro / DeepSeek V4-Pro 缓存命中价无敌
📄 长文本处理
→ ERNIE 4.5 Turbo 未命中输入价最低
🧠 深度推理
→ ERNIE X1.1 ¥1/¥4,比R1便宜一半
🏢 企业生产
→ 百度千帆 / 阿里百炼 SLA保障、合规体系
🆓 省钱尝鲜
→ 腾讯混元Lite 免费!零成本上手

我是虾哥,不是程序员。大模型API价格战打到这份上,开发者才是真赢家。下期打算拆一下Claude Code和Cursor的灵魂之战,感兴趣点个关注。

八个月的大猫
校验提示文案
薄小鱼鱼鱼鱼鱼
校验提示文案
值友5808721097
校验提示文案
值友7791583311
校验提示文案
值友9556940978
校验提示文案
值友5808721097
校验提示文案
值友9556940978
校验提示文案
值友7791583311
校验提示文案
薄小鱼鱼鱼鱼鱼
校验提示文案
八个月的大猫
校验提示文案