今天凌晨零点,DeepSeek把国内大模型圈第一套"峰谷计价"规则跑通了第一笔计费请求。知乎没有铺天盖地的官宣,深夜悄悄更新后台规则,等开发者早上查账单才反应过来:API的成本逻辑,彻底换玩法了。
先上数字,都是多方交叉核对过的:
V4-Pro:高峰时段缓存命中输入0.3元/百万token,原来是0.025元,涨了1100%;输出27元/百万token,原来6元,涨350%
V4-Flash:高峰缓存命中输入从0.02元涨到0.1元(+400%),输出从2元涨到9元(+350%)
高峰时段:每天9:00-12:00、14:00-18:00;其余17个小时算闲时,闲时价格统一是高峰的一半
综合算下来,这轮涨幅从50%到1100%不等。知乎

先别慌:谁不受影响,谁真的肉疼
先划清楚边界。这次调价只动API接口,网页版和App照样免费,你日常跟DeepSeek聊天、写周报、改文案,一分钱不多花。知乎另外辟个谣:传得很凶的"V3涨价1100%"是误传,这次调价核心是V4-Pro系列,跟V3没关系。知乎
真正肉疼的是三类人:
业务必须跑在高峰时段的——客服、实时推荐、在线编码辅助,成本直接翻倍,躲不掉;
多任务挤在一起跑的——批量任务和实时任务都堆在上午,全踩在价格高点;
按上季度单价做预算的——高峰成本翻了三倍,缺口月底才暴露。
社区里已经有人晒账单了:一个Agent跑了一晚上,直接烧掉半个月饭钱。知乎还有人特意避开了高峰用,对比两天的消耗和花费,结论还是太贵了。知乎更直观的案例:有团队单日高峰调用成本从约600元涨到2700元。知乎
为什么敢涨:这不是抢钱,是算力在说真话
很多人第一反应是"涨价赶客",但把信号摆出来看,恰恰相反——这是算力不够用的信号。
第一,Agent时代token消耗是几十倍上百倍地涨。 传统对话一轮几百token,Agent跑一个任务要反复推理、调工具、读结果。光OpenCode一个平台,V4-Flash单日处理的token就干到8万亿,比OpenRouter全平台日均总量还高。知乎
第二,DeepSeek确实有底气。 最新一周的调用量榜单显示,中国模型周调用量36.84万亿token,美国约10.26万亿,连续十六周全球第一。微博DeepSeek V4-Flash正式版周调用11.2万亿,连续两周蝉联单模型榜首,环比还涨了27%。知乎你薅了两年的那个便宜模型,现在已经是全球被调用最多的模型之一。用户粘性够了,提价顺理成章。
第三,整个行业在走出价格战。 前两年烧钱补贴抢开发者,现在烧不动了——高端芯片紧、电费涨、折旧贵,长期低价就是用得越多亏得越多。而且涨完之后,DeepSeek依然比海外旗舰便宜得多,价格大约只有Claude Fable 5的四分之一不到。知乎白菜价时代结束了,但还没到挨宰的程度。
省钱路一:错峰+缓存,先把能拧的旋钮拧了
峰谷定价的本质,跟电网峰谷电价一个逻辑:用价格杠杆把非实时任务从高峰挤到闲时。所以第一招就是把能挪的任务挪走:
批量推理、数据清洗、长文档解析
离线多模态处理——批量图片理解、视频抽帧打标、OCR入库这类不要求实时返回的活儿
Agent的定时巡检、报告生成类任务
挪到闲时(12:00-14:00、18:00-次日9:00,以及周末),价格直接砍半。微博
但要泼一盆冷水:闲时价也只是高峰的一半,比涨价前还是贵。 V4-Flash输出闲时是4.5元/百万token,原来是2元。错峰能止血,回不到从前。
第二招是把缓存命中率做高。缓存命中输入即使涨到0.3元,也远低于全价输入,系统提示词、知识库前缀这些重复内容尽量保持稳定,别动不动改一个字让缓存全部失效。
省钱路二:换备胎,免费额度和低价替代盘点
这条路信息差最大,逐个说:
学生党直接领钱。 阿里云"云工开物"学生认证,每年能领300元抵扣金,全日制专科到博士都能领。知乎关键细节:这笔钱可以抵扣百炼上的DeepSeek V4 Pro/Flash正式版和通义千问系列——包括qwen的VL看图问答(多模态),但文生图、视频生成、embedding向量化接口不抵扣,调了直接扣现金。扣费顺序是新人免费token→300元抵扣金→自己的钱,全程自动。注意只有阿里直供模型能用券,三方直供不生效;券有效期一年,不能提现不能转卖。

普通用户薅新人额度。 百炼新用户免费token、各家开放平台的试用额度,趁着这波涨价挨个注册一遍,“蹬光了一个平台的套餐,赶紧去蹬下一个”——这话糙理不糙。知乎
海外低价档。 Meta最新的Muse Spark 1.2玩了个"同一模型两个价签":标准档输入1.25美元/百万token、输出4.25美元;贡献档更便宜,但要授权你的数据用于训练。在意隐私的选标准档,纯跑实验不介意数据的可以看看贡献档。微博
国产平替看场景。 小米MiMo V2.5做日常办公、Demo应用口碑不错,社区都在催v3。知乎但注意Kimi 2.7现在跟V4-Pro高峰价差不多了,"平替"不等于便宜,切之前先查实时价目表。微博

避坑提醒:第三方API中转站价格确实低,但模型版本不透明、稳定性看运气,跑生产任务别拿账单开玩笑。
省钱路三:重度用户算一笔本地部署的账
如果你是长期高频调用、尤其多模态图片理解这类任务量大的用户,这轮涨价其实重新改变了"租还是买"的平衡点。
Qwen3.8系列上周刚全线开源。小红书27B版本社区实测已经能在消费级显卡上跑起来,支持文本、图像多模态输入。知乎本地部署的账很好算:一张卡的硬件成本,除以你未来一两年的调用量,跟API账单比一比——调用量越大、隐私要求越高,本地越划算;偶尔用用,还是API省心。显存选哪个版本、有哪些隐性成本,站内这两天已经有实测文章,这里不重复展开。

更大的判断:算力定价的"电网化"才刚开始
这次调价最值得记住的不是数字,而是机制。过去一年所有大模型都是固定单价,企业预算就是月调用量乘以单价。知乎从今天起,同一个模型上午调和晚上调价差一倍,预算和调度都得加上时间维度。
而且大概率不是孤例。算力供给的瓶颈已经从"有没有"变成"高峰够不够",当最便宜的那家都开始用价格劝你错峰,其他厂商跟进峰谷定价只是时间问题。知乎免费或近乎免费的AI午餐,从今天开始计时收费了。知乎这不是DeepSeek变坏,只是它从一个用补贴换用户的创业公司,长成了一个要算账的生意。
接下来值得盯的三个信号:
其他国产厂商是否跟进峰谷计价——跟进了就是行业新常态,得把"时序调度"做进工作流;
算力扩容节奏——社区有说法称下半年国产算力芯片放量后价格会回落,先观望别当真;
调用量榜单变化——涨价后V4-Flash的榜首位置坐不坐得稳,直接决定这波定价能不能持续。
最后聊一句:你有用DeepSeek API在跑的项目吗?这波账单涨了多少、打算错峰还是换模型?评论区聊聊,顺便把这篇转给还在无脑跑高峰的同事。