8月17日零时起,DeepSeek V4 全面涨价:旗舰 Pro 输出从6 元涨到27 元(高峰时段),缓存命中输入更是涨了11 倍。知乎开发者社区炸锅是意料之中的事,但有个数字需要先澄清:网上流传的某编程平台用量「从6.33万次减少到3800次、缩水94%」,这个口径同时采用了临时双倍促销额度和平台早期显示值,会夸大常态额度的变化,按修正口径计算约减少四分之三。36氪夸大了,但冲击是实打实的。
这波涨价,跟腾讯云用户有什么关系
关系不小。腾讯云 CloudBase 几乎同一时间官宣,完全跟随官方同步调价并引入相同峰谷机制,价格分毫不差。知乎也就是说,你在腾讯云里调用的 DeepSeek 系列模型,同样执行峰谷价:工作日白天是高峰,其余时间半价。今年六月,腾讯云才刚宣布 DeepSeek-V4 系列模型降价,与 DeepSeek 官方同步。知乎不到两个月,风向就变了。
这半年,腾讯云经历了什么
把 2026 年上半年的动作按时间排一遍,你会发现它其实一直在动:
3 月中旬:腾讯云宣布混元大模型价格全面上调,涨幅高达463%,这是本轮AI价格战中,首个大规模涨价的头部厂商。知乎
差不多同期:腾讯云于3月结束GLM5、MiniMax2.5等第三方模型的免费公测。知乎HY2.0 系列在 3-4 月经历两轮调价,Instruct 输入价一度涨了463%。知乎
6 月:跟随 DeepSeek 官方下调 V4 系列价格。
7 月 6 日:混元 Hy3 正式发布并开源;8 月初,WorkBuddy 里的 Hy3 限时免费再度延期,一直用到 2026 年 8 月 31 日。知乎
8 月 13 日至 17 日:DeepSeek 官宣涨价、新价格生效,CloudBase 同步跟涨;「腾讯云为何不再提供 DeepSeek V4 Flash/Pro Preview」也成了开发者社区的新疑问,8 月 21 日上了知乎热问。
半年时间,从降价到涨价,从免费公测到按量算账,方向变了,动作很密集。
反直觉的反转:先涨价的,现在反而最便宜
这是很多人没想到的数字。以 8 月 18 日更新的 9 家国产厂商旗舰定价横评:如果只看「最便宜」,答案是:腾讯混元 Hy3(1元/4元),比 Kimi K3 便宜25 倍。知乎按每百万 Token 输入/输出计,这目前是国产旗舰里的地板价。
对比挺微妙:3 月腾讯涨价时,开发者社区一片哀嚎,觉得大模型白菜价时代要终结了;到了 8 月,DeepSeek V4-Pro 高峰输出已到 27 元,国产旗舰价格整体抬升,先涨完价的反而成了旗舰里的价格洼地。
当然也得说句实在话:同一份横评点明,Hy3 便宜有便宜的原因,能力覆盖和生态成熟度跟 Kimi K3、DeepSeek 不在一个量级,便宜的旗舰往往只是「旗舰的价格」,不是「旗舰的能力」。所以正确姿势不是一个模型全换成 Hy3,而是按任务难度分流。Hy3 的实际使用数据也说明它确实在被当成主力用:上线后调用量比前代 Hy2 涨了68倍,平台上超过六成用户主动把它设成默认模型。知乎
两笔真正肉疼的账
这次涨价的实际冲击有多大,看两笔真实的账。
第一笔,轻度用户的账。有 AI 博主晒出自己的账单:267 次请求、消耗约 7673 万 Token,其中缓存命中输入占了 98.35%,旧价2.99 元→ 新价峰谷7.27 元。知乎成本翻了 2.43 倍,而这还只是轻中度用量。为什么缓存命中杠杆这么大?因为编程 Agent 会反复读取代码、历史对话和工具调用结果,缓存单价虽低,却会被数千万甚至上亿 Token 的用量放大——这次 V4-Pro 缓存命中输入从 0.025 元涨到 0.3 元,是本轮涨幅最大的计费项。

第二笔,订阅平台的账。涨价的连锁反应最先砸向把模型用量打包成固定月费的第三方平台:DeepSeek 涨价后,OpenCode 给 V4-Flash 配置的套餐使用价值降为 30 美元,V4-Pro 只有 15 美元,均未达到部分成熟模型可获得的 60 美元。36氪社区里有人直接喊退订。上游价格表一动,最先重新分配的是这些平台的额度和毛利,最后才传导到你我的工具账单上。

四个省钱动作,两个坑
价格战的时代结束了,但省钱的空间没有消失,只是换了地方。对在用腾讯云调大模型 API 的人来说,下面几件事现在就能做。
1、抓住 Hy3 的免费窗口。WorkBuddy 里的 Hy3 免费用到 8 月 31 日,混元新用户的免费额度也值得领:混元:10 款主力共享 100 万 token。知乎这 100 万 token 免费额度有效期长达一年,在同类免费额度里少见这么长的窗口,别放过期。

2、把批量任务挪到闲时。在腾讯云调 DeepSeek 系列要记住:工作日9:00–12:00、14:00–18:00是高峰,其余时间(晚上、周末)半价。知乎定时报表、批量处理、Agent 长任务挪到晚上或周末跑,成本直接减半。
3、认真做缓存命中率。调价后命中价虽然涨了11 倍,但相对未命中仍便宜30 倍。知乎诀窍是保持前缀稳定:系统提示词、工具定义等固定内容放在最前面且不要插入时间戳、随机数——腾讯云混元的缓存机制要求输入完全一致才能命中。有项目认真做缓存优化后,整体Token开销砍掉三成以上。知乎
4、设预算告警,给模型分级。先给自己的月度 Token 消耗设一条预算告警,超过阈值就停掉批处理任务,批量任务跑起来时尤其要设。简单的分类、抽取任务用轻量模型,复杂推理才上旗舰;再用 max_tokens 限制输出长度。这里还有一笔容易被忽视的账:输出价格通常是输入的3-10倍。知乎代码生成、长文写作这类输出长的任务,真正花钱的是输出,评估模型别只看标价,看「实际花费 / 有效产出」。
两个坑,别踩。
坑一:别碰「低至1折」的 API 中转站。官方定价15美元/百万Token的Claude3.5Sonnet,在某些中转站里能卖到1折甚至更低的价格。知乎这背后是黑灰产业链,额度来源、数据去向、封号风险全是问题,账单再贵也别走这条捷径。
坑二:别把鸡蛋放在一个模型里。这次涨价证明,任何一家厂商都可能随时调价。把任务按能力、速度、价格拆分,规划推理给一家、执行给一家、批量简单任务再给一家——架构上能一天内切换到另一家模型,比赌任何一家不涨价都可靠。
最后,两件值得继续盯的事
第一,免费窗口在收窄,但还没关死。Hy3 免费到 8 月底,之后是否继续延期、混元免费额度会不会缩水,值得盯一下。
第二,涨价还在继续。智谱:年内三次提价,一季度提价约83%,但调用量逆势增长400%。知乎回看这一轮:从"永久降价"到"涨幅较大",只隔了90天。知乎涨价潮之后,厂商拼的不再是谁更便宜,而是谁能用更少的调用、更稳定的结果完成任务。对我们用户来说,学会算账、学会分散,价格战结束后的日子,照样能过得划算。