DeepSeek 官宣涨价,网传最高涨 30 倍?我把账单算明白了:先别囤钱,真正管用的是缓存和时段

源自8位全网作者

08:46

8月6日,DeepSeek 发布公告,“计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大,请合理安排您的使用”。36氪没有具体数字,没有生效日期,只留下一句"具体方案以正式通知为准"。然后社区就炸了,各种版本的涨幅开始满天飞:4倍、8倍、最高30倍。

更拧巴的是大环境:7月30日,OpenAI 把 GPT-5.6 Luna 的 API 价格砍了80%;8月10日,Anthropic 干脆取消了 Claude Sonnet 5 原定9月生效的50%涨价,2美元/10美元的价格长期不变。36氪美国两家头部在拼命往下压价,被叫做"价格屠夫"的 DeepSeek 反而要涨。

作为一个用 DeepSeek API 跑代码、每月自掏 token 费的人,我这两天把官方计价页、OpenRouter 的供应商数据、行业媒体的报道和开发者社区讨论全翻了一遍。结论先放这儿:涨价大概率是真要来了,但网传的"30倍"大概率吓唬人;囤余额基本没用,真正能保住你账单的是缓存和时段。下面把账算给你看。

一、先辟谣:三个"涨幅"不是一回事

现在流传的涨幅数字,其实来自三个完全不同的地方,混在一起看就会恐慌。

第一个是官方口径。公告只说"预计涨幅较大",没有任何具体数字,也没说6月底上线的峰谷计费还保不保留。所有精确到倍的数字,截至本文发稿都只是推测。

第二个是社区推测的"4倍"。知乎上有开发者梳理了定价史:V4-Pro 预览版发布时定过一个原价,后来官方给了个2.5折的限时优惠,再后来这个折扣被宣布永久化——大家现在用的就是这个折扣价,所以这次涨价最自然的方向就是涨回原价,也就是当前价格的4倍。知乎这个数字有完整的定价沿革做支撑,是目前可信度最高的推测。

DeepSeek 官宣涨价,网传最高涨 30 倍?我把账单算明白了:先别囤钱,真正管用的是缓存和时段

第三个是吓人的"30倍"。它的出处其实是一篇行业分析:DeepSeek 官方的缓存命中价大约是每百万 Token 0.0028美元,只有第三方平台同类价格的一成左右。分析者按约78%的缓存命中率测算,DeepSeek 就算把缓存读取这一项单独提价30倍,也才刚刚和第三方平台打平。36氪注意,这说的是"理论上有这么大的提价空间",不是"要涨30倍"。普通输入、输出的价格要真涨30倍,DeepSeek 就直接退出"最便宜模型"的位置了,这不符合它现在的策略。

所以合理的心理预期是:整体涨幅按2-4倍做准备,缓存读取可能单独涨得更多,但"全线30倍"基本可以排除。

二、你的账单从来不是"单价×涨幅"这么简单

很多人算账只算"现在每月花10块,涨4倍就是40块"。但 DeepSeek 的账单其实是三个数相乘:基础定价 × 峰谷倍数 × 缓存命中率

先看基础定价(现行价格,单位:元/百万 Token):

型号

缓存命中输入

未命中输入

输出

V4-Flash

0.02

1

2

V4-Pro

0.025

3

6

这和 DeepSeek 开放平台当前公示的价格一致:V4-Flash 缓存命中输入 0.02 元、未命中 1 元、输出 2 元,V4-Pro 分别是 0.025 元、3 元、6 元。小红书

DeepSeek 官宣涨价,网传最高涨 30 倍?我把账单算明白了:先别囤钱,真正管用的是缓存和时段

再看峰谷。6月底上线的峰谷计费现在还有效:工作日 9:00-12:00、14:00-18:00 两个时段,API 调用价格直接翻倍。小红书注意,这恰好就是你坐在工位上跑 Agent 的时间。官方没说涨价后峰谷机制保不保留,如果保留,白天跑任务的开发者面对的就是"涨价×2"的乘法效应——基础价涨4倍再叠加高峰翻倍,个别时段的体感成本能到现在的8倍。

最后是缓存,这是三个乘数里最夸张的一个。缓存命中时输入价 0.02元/百万,未命中是 1元/百万——差了50倍。也就是说,缓存命中率这一个变量,对账单的影响比这次涨价本身还大。

这不是理论值。GitHub 上有个为 DeepSeek 优化的开源编码工具,作者晒出真实账单:单日处理 4.35 亿输入 Token,实际扣费 12.34 美元。知乎同样的工作量如果没有缓存优化,要 61 美元,缓存一项就省了80%。

DeepSeek 的缓存也是实测最能打的。知乎答主"苏迟但到"做过一个持续3天、2万多次请求的测试:每隔40分钟向各家模型发一批请求,最长隔12小时再发相同内容看缓存是否还在。结果 DeepSeek 无论工作时间还是非工作时间,命中率始终保持100%,隔12小时都不失效。36氪MiniMax 非工作时间约90%、工作时间掉到70%;GLM 最惨,2分钟后命中率约80%,3分钟掉到50%,5分钟只剩25%。

所以涨价落地前,最实际的一步不是骂街,而是确认你现在用的工具链有没有把缓存用起来。如果你的 Agent 框架每轮都在改写历史消息、删除前几轮的推理内容,前缀一变,几十万历史 Token 就全部按未命中的原价重新计费——有开发者实测,同一个模型在不同工具里的成本能差出4倍甚至10倍,主要差异就在缓存命中率。

三、涨完还值得买吗?把全网的价目表拉齐看

这是最核心的问题。我把官方、OpenRouter 供应商数据和各家最新定价拉到同一张表里(单位:美元/百万 Token):

模型

输入

输出

备注

DeepSeek V4-Flash(官方)

0.14

0.28

缓存命中仅约0.0028

DeepSeek V4-Flash(DeepInfra 等第三方)

0.09

0.18

注意是 FP4 精度版

GLM-5.2(OpenRouter 第三方报价)

0.07

0.22

比 DeepSeek 还低

Kimi K3

约2.8(20元)

约14(100元)

长程 Agent 旗舰,还限购

Claude Sonnet 5

2

10

刚取消50%涨价计划

GPT-5.6 Luna

降价80%后

ChatGPT 文字聊天已免费不限量

再看完成任务的真实成本。Artificial Analysis 的测算显示,V4-Flash 跑完一组标准 benchmark 的平均成本约3美分,而 GPT-5.6 Sol 是 1.86 美元——差了60倍。36氪就算 DeepSeek 真涨4倍,它和美国旗舰之间仍然隔着一个数量级的价格带。开发者社区 DRadar 的开源任务实测也是同一个结论:高推理档位成本以数倍甚至数十倍递增,V4-Flash 落在"能力略低、成本大幅降低"的区域。

DeepSeek 官宣涨价,网传最高涨 30 倍?我把账单算明白了:先别囤钱,真正管用的是缓存和时段

结论很清楚:涨价后的 DeepSeek 大概率仍是"能干活的大模型里最便宜的那一档",只是从"白菜价"变成"正常价"。真正该重新评估的不是"还用不用",而是"哪些活儿值得换模型"。

顺便说几个替代品现状,都是这几天刚发生的。智谱 GLM-5.2 在 OpenRouter 上被第三方打到 0.07 美元输入、0.22 美元输出,比 DeepSeek 还便宜,但要接受缓存表现差一大截的现实。微博Kimi K3 走的是高端路线,发布没几天就因为需求超过算力暂停了新订阅。36氪阿里千问 App 则在8月10日推出了办公助理订阅和视频生成充值,成了继豆包之后第二个开始收费的月活过亿 AI 应用。知乎OpenAI 那边则在疯狂送,ChatGPT 文字聊天已经免费不限量,适合把轻问答分流过去。整个行业的方向是一致的:免费和地板价的时代在收尾。

四、避坑:第三方便宜,但坑都藏在细节里

看到官方要涨价,很多人第一反应是转投第三方平台——毕竟 OpenRouter 上 DeepInfra 的 V4-Flash 报价只有官方的64%。36氪但有三个坑必须先说清楚。

DeepSeek 官宣涨价,网传最高涨 30 倍?我把账单算明白了:先别囤钱,真正管用的是缓存和时段

第一,精度可能不一样。DeepInfra 明确标注自己跑的是 FP4 版本,而 DeepSeek 官方开放的权重仓库里有 BF16、FP8 等多种精度,官方 API 到底用什么精度并没有完整公开。36氪第三方便宜的一部分原因,就在这儿。

第二,真实成本可能更高。有开发者拿一个100多个仓库的代码库做过对照实验:同样的 Prompt、同样的任务,一边用第三方订阅服务 OpenCodeGo,一边直连 DeepSeek 官方 API。结果短任务第三方平均贵4倍,长会话差距超过10倍。36氪原因就是前面说的缓存——第三方路由的缓存命中率明显更低,会话越长,缓存未命中的累积成本越高。

另外还有开发者实测,经某些第三方路由的 V4-Flash 上下文实际只有 600k 左右,超了会被压缩截断,官方才是完整的 1M 上下文。36氪

第三,“包月订阅"的账不能只看标价。OpenCodeGo 这类服务首月5美元、之后每月10美元,宣传"10美元换60美元额度”。但额度是平台内部计价,和你钱包里的真金白银不是一回事——如果你每月实际只花10美元,界面上显示消耗了多少额度并不重要。反过来,如果你用量大到要碰它的限额(每5小时12美元、每周30美元、每月60美元),那它未必比直连官方划算。

一句话总结:第三方适合短任务和尝鲜,长会话、重 Agent 负载,直连官方大概率更便宜也更完整。

五、别做这件傻事:囤余额

涨价公告一出,已经有人问"要不要趁现在多充点余额"。

对大多数 API 服务来说,充值的是余额,不是价格——扣费按调用发生时的价格执行。也就是说,你今天充进去的钱,涨价后照样按新价格扣。除非正式方案里明确写"已充余额按原价消耗",否则囤余额锁不住低价,只是把钱提前压进去。

真正能"锁定低价"的只有三条路:一是现在就把缓存和调用时段优化到位,这是确定性最高的省钱方式;二是关注第三方包月订阅,用固定成本对冲涨价(注意上面的坑);三是如果你的量真的很大,V4-Flash 的权重是开放的,许可证允许商业使用,有卡的团队可以评估自部署——知乎上已经有开发者用32G内存+24G显卡跑出每秒36字的速度。

六、对号入座:四类人四个动作

免费聊天党(只用 App/网页版聊天):这次涨的是 API,日常使用仍然免费,不用焦虑,看个热闹就行。

轻度 API 用户(每月几块到几十块):不用囤钱。就算涨4倍,你的月账单可能也就是从一杯奶茶钱变成两杯。建议只做两件事:给余额设置预警(有真实案例,开了预警都被扣到负数,高峰期翻倍扣费比想象中快),以及把非急活挪出工作日 9:00-12:00、14:00-18:00 两个高峰时段。

重度 Agent 用户(白天长时间跑编码/数据处理):你是这次涨价最疼的人群。按顺序做三件事:①先查工具链的缓存配置,确认历史消息前缀稳定、没有不必要的重写;②把可批量的任务排到夜间和周末;③等正式方案出来再决定去留,重点看两个细节——峰谷翻倍是否保留、涨价后你的主力场景相对 GLM、Kimi 还有没有性价比。

企业和团队:斯坦福数字经济实验室今年4月调研了51个成功落地的企业 AI 项目,42%认为底层模型完全可以替换,在规则明确的常规任务里这个比例是71%。36氪与其纠结单一模型涨不涨价,不如搭一层多模型路由:规划和复杂推理留给旗舰,分类、抽取、格式转换这类活儿全部分给便宜模型。Agent 时代的成本公式是"单价×Token数×步骤数×重试次数",每一步都选对模型,比砍任何一刀单价都管用。

接下来盯什么

DeepSeek 这次涨价,本质是流量压上来之后的供需再平衡。8月1日一天,V4-Flash 单日处理了8万亿 Token,其中5万亿来自免费试用额度,3万亿来自付费调用。36氪服务器冒烟了,价格就是最直接的调节阀。海外开发者平台 OpenCode 的工程师 dax 就推测,这次涨价很可能不是因为"亏钱",而更像是一种流量调控手段。36氪

DeepSeek 官宣涨价,网传最高涨 30 倍?我把账单算明白了:先别囤钱,真正管用的是缓存和时段

正式方案落地前,有三件事值得盯:一是官方公告的具体涨幅和峰谷机制去留,这决定重度用户的最终去留;二是老余额是否按原价消耗的表述,这决定"囤钱党"要不要行动;三是 V4-Pro 正式版的发布节奏和定价,社区还有未经证实的泄露价格在流传,等官宣再信。

对大多数人来说,结论可以一句话概括:DeepSeek 涨价后依然是全网最便宜的一档生产力模型,先别慌着跑;把缓存、时段这两件事做好,比囤什么都实在。等正式方案出来,我会第一时间再算一遍新账。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章