上周,B站一条视频的评论区里,一条留言被顶了上去:"涨价前我一天大概蹬20块左右,涨价后梁文峰时间段差不多一百,梁文谷一百出头,一天两百多,果断换GPT了。"类似的吐槽在评论区里刷屏,不少人接着交换起省钱方案。哔哩哔哩"梁文峰时间段"是社区给 DeepSeek 高峰时段起的新外号。调侃归调侃,这次调价是真打到重度用户的钱包了。
到底涨了多少
先看官方公告。8月17日零时起,旗舰模型 V4 Pro 的高峰时段输出价从每百万 tokens 6元涨到27元,涨幅350%;缓存命中输入价从0.025元涨到0.30元,是原来的12倍。36氪高峰时段指北京时间9:00-12:00、14:00-18:00,其余时间为空闲时段,空闲价格是高峰的一半。界面新闻
更便宜的 V4 Flash 也没躲过。它的高峰时段单任务成本从0.027美元涨到0.11美元,能力不变,价格翻了四倍。钛媒体
《财经》的实测更直观:1亿 token 的成本从17.5元涨到高峰时段的102.2元,涨了5.8倍。钛媒体下图就是 DeepSeek-V4-Flash 目前的峰谷价格:每百万 tokens,输出高峰9元、空闲4.5元;输入(缓存未命中)高峰3元、空闲1.5元;缓存命中输入高峰0.10元、空闲0.05元。

但有个被标题掩盖的另一半:这不是简单普涨,而是分时计价。六天后,DeepSeek 又调了一次——8月23日零时起,周六周日全天不再区分峰谷,统一按低谷价收费。36氪一周两调,一次抬价、一次变相降价,看似自相矛盾,实则是同一件事:高峰时段的算力不够分了,用价格把对时间不敏感的需求分流去夜里和周末。而且即便涨完,V4 Pro 高峰1亿 token 成本仍只有 OpenAI 同类的约22%、智谱的约36%。钛媒体“还是便宜"仍然成立,只是不再"便宜得离谱”。
为什么涨
明面上的原因是算力墙。V4 Flash 上线时靠"斩杀线"级低价冲量,单日调用一度冲到8万亿 tokens,碾压全平台日均总量,OpenCode 官方都发了容量不足公告。钛媒体便宜引来的流量洪峰,把自己冲到了墙上。
背后的原因是资本叙事。据外媒 The Information 援引知情人士,DeepSeek 今年前7个月收入约7000万美元(折合人民币约4.75亿元),已经是2025年全年营收的约10倍。36氪
同期净亏损约7.15亿元,但毛利率很能打:通过 API 销售模型访问权限的毛利率达到82.9%,整体毛利率44.6%。钛媒体下图是主要大模型公司的毛利率对比,DeepSeek 的 API 业务毛利已经站进第一梯队,仅次于或比肩海外头部。

钱要花在刀刃上——DeepSeek 正在推进新一轮融资,目标募资约500亿元人民币,对应估值约5000亿元,而今年6月它刚完成同样规模的首轮融资。36氪资本市场要看的不是"多少人在用",而是"收入质量撑不撑得住"。所以这次调价本质是把流量换成收入:用高峰价筛出愿意付钱的人,用闲时折扣留住价格敏感的人。
谁来接盘了
价格之王一涨价,对手动作比谁都快。OpenAI 把轻量级 Luna 的价格砍了80%,从1美元降到0.2美元;谷歌 Gemini 3.7 Flash 直接打五折。钛媒体目前值得注意的几个选项:
模型 | 价格动作 | 单任务成本 | 备注 |
|---|---|---|---|
OpenAI Luna | 降价80%($1→$0.2) | 约$0.05 | 同为52分档,不到DeepSeek高峰价一半 |
智谱GLM-5.3-Flash | 9月9日前促销:输入$0.075/输出$0.25每百万tokens | 约$0.045 | 按原价算反而更贵,见下文 |
谷歌Gemini 3.7 Flash | 直接五折 | — | 适合已在海外生态的用户 |
Kimi K3 | 高价带稳定 | 约$0.84 | 能力60分档,不是省钱选项 |
这里有两个必须注意的点。
第一,GLM-5.3-Flash 的"DeepSeek 三分之一价"是促销价,有开发者按原价测算,它反而比 DeepSeek 涨价后的高峰价贵约46.6%,缓存定价尤其被吐槽。知乎9月9日之后还便不便宜,要看智谱的续价诚意。
第二,DeepSeek 还没输。截至8月25日的 OpenRouter 周榜里,V4 Flash 调用量仍以11.6万亿 tokens 居首,但身后的对手增速更快,周调用增幅普遍在27%-29%。钛媒体用户正在用脚投票。
三种人,三种算法
按用量强度对号入座。
轻度用户(一天几块钱):影响其实不大。有B站用户实测,Flash 在空闲期平均每百万 tokens 大概7分钱,正常用就行,唯一要养成的是"周末跑批"的习惯。哔哩哔哩
重度用户(一天几十到几百块):两条路。一是时间套利:把批量生成、测试类任务挪到闲时或周末,成本直接压到一半以下——记住高峰时段是工作日9:00-12:00、14:00-18:00,周末全天都是谷价。二是换模型:写代码为主可以试 GLM-5.3-Flash 促销(9月9日前)或 Luna。但换之前记住三个坑:促销价不等于常态价;credits 和 tokens 不是一个计量单位;订阅制普遍有周限额和缓存命中率差异,实际成本要实测。

极客型用户:已经有人本地部署 V4 Flash,或转用第三方聚合平台。前者吃硬件,后者吃信任——部分中转平台半夜明显更慢,数据安全也是黑盒,重要任务要谨慎。
接下来值得盯的信号
GLM-5.3-Flash 9月9日促销结束后会不会涨价,这决定替代逻辑是否成立;
DeepSeek 第二轮融资是否落地——融资压力越大,后续调价动力越强;
社区有用户传闻9月1日还有调整,官方未证实,留意公告;
OpenAI Luna 的80%降价能持续多久,补贴一退,替代方案也会跟着退。
便宜用大模型的时代没有结束,只是变成了一件有技术含量的事。会算时段、会算单位、会算促销周期的人,依然能薅到性价比;只默认续费的人,就成了别人价格战的买单者。