最近关注 DeepSeek 圈子的人,应该都刷到过一句话:"梁圣降级为牢梁。"小红书上一篇《DeepSeek涨价细节,我宣布梁圣降级为牢梁》拿了一千四百多赞、四百多条评论;知乎上那篇"梁圣的恩情还不完"的高赞回答,作者自己在八月中旬回来补了一句:“还敢涨价十几倍是吧”。小红书知乎情绪可以理解。
今年上半年,用 DeepSeek 约等于"便宜":有人晒"高强度玩了一天才用了三块钱",小红书用户说"一个月五块钱的生活"。知乎小红书那时候它的口碑约等于一句话:全网最便宜的强模型,没有之一。
但 8 月 17 日之后,这些日子一去不返。有玩角色扮演的用户发帖求助,说涨价后贵了好多、只敢在谷时玩,问要不要换个模型。小红书也有人晒账单,以前 3 块钱够用一天,现在直接飙到 20+。小红书钱不是原来的钱,心情也不是原来的心情了。
这半个月 DeepSeek 到底干了什么?涨了多少?谁受影响?该不该跑?我把知乎、微博、小红书、36氪近一个月的信息翻了一遍,帮你一次算清楚。
先说结论:App 聊天不受影响,API 付费党进入"分时电价"时代
最重要的事实放在最前面:这轮涨价针对的是 API 计费,免费的 DeepSeek App 和网页聊天不受影响。小红书如果你只是拿它聊天、写文案、做情绪陪伴,这篇对你没有账单层面的冲击——但仍建议看完,因为涨价的连锁反应,正在传导到你用的第三方订阅套餐和工具上。
对 API 付费用户,变化分三步落地。8 月 6 日,官网公告"计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大"。小红书8 月 13 日,价格表公布,17 日零点起生效,同时引入"峰谷定价"——高峰时段定在上午 9 点到 12 点、下午 2 点到 6 点,夜间空闲时段价格直接减半。知乎8 月 22 日,再打一个补丁:周末全天统一按低谷价收费。36氪

至于涨幅,官方口径和社区测算对不齐:有知乎用户翻出 5 月的背景——5 月 25 日官宣"永久降价",把原价输入 12 元/百万 tokens、输出 24 元降到 3 元/6 元,5 月 31 日生效——据此判断这次"大幅涨价"本质是从四分之一价恢复原价,涨 4 倍。知乎有人按自己常用档位测算,涨了大概 5 倍。知乎微博的 8 月大模型月报则直接写"12 倍涨价"。微博不同模型、不同时段涨幅不一,但共识是一致的:上半年那个地板价,回不来了。
为什么涨价:不是亏钱,是"腾卡训练"
有意思的是,DeepSeek 并不缺钱。据媒体报道,DeepSeek 七个月营收 4.75 亿元、暴涨 10 倍,API 毛利率高达 82.9%。36氪赚钱的生意为什么还要涨价?
知乎一篇高赞回答把因果链讲得很清楚:直接原因是 V4 Flash 太猛了。7 月 31 日正式版上线后,性能多方面反超自家更贵的 V4 Pro,涨价前的单价却断层便宜——是自家 Pro 的 1/12.4、GLM 5.2 的 1/15.7、Kimi K3 的 1/53.6。知乎换句话说,同样的活儿,别家要贵十几倍,性能还未必更好。
结果是 agent 重度用户全涌了过来:8 月 5 日,OpenCode 平台单日 7.5 万亿 tokens 里,V4 Flash 独占 6.3 万亿,占比 84%。知乎这帮 agent 用户不是普通聊天党,单个 agent 会话最高消耗 1440 万 tokens,一次会话约 0.1277 美元、折合人民币不到一块钱,便宜到"用的人根本懒得优化"。全网最低单价,承接了最费卡的负载,算力池瞬间被蹬穿。DeepSeek 员工也在官方交流群里承认:涨价就是为了腾出算力卡训练新模型。OpenCode 创始人的说法更直接,涨价不是因为亏钱,而是为了劝退用户。知乎
同一个月里的"翻车"与"救场"
如果说涨价是"收刀",那 8 月 13 日同天发布的 V4 Pro 正式版(编号 0813)就是当众翻车。官方纸面数据其实很唬人:1.6 万亿参数 MoE、单次激活 490 亿、1M 上下文,Terminal-Bench 2.1 从预览版的 72.1 拉到 87.9,DeepSWE 从 12.8 跳到 62.7,还加了 low/high/max 三档思考强度。小红书微博账面很华丽,但这次社区没买账。
实测的普遍反馈是明显不及预期,一条 580 赞的知乎回答直言"远不如灰测的表现,现在也只比 flash 略强一些"。知乎第三方评测平台 Artificial Analysis 的对比数据更扎心:0813 的综合智能分 53,而便宜得多的 Flash 0731 是 52——只贵出 1 分的能力,输出速度却只有 Flash的一半左右(约 64 tok/s 对 118 tok/s),社区博主的锐评结论也是完全没必要用,它能干的 flash 也能干。小红书随后官方撤回了 V4 Pro 正式版的公告,社区猜测从"上错模型"到"误删回测模型"满天飞。知乎

更戏剧的是两天后:有人发现 DeepSeek Harness(DSH,随 Pro 一起开源、主打"一切皆插件"的 Agent 基座)在 Linux 极简模式下,能让 V4 Pro 恢复到灰度测试中期的水平,社区的解释是训练时一直使用 dsh 极简模式导致过拟合。知乎于是就有了那句流传甚广的锐评——极简模式是神,其他模式是区。知乎
8 月 19 日,DeepSeek 又被曝开始新一轮灰度测试,能力超过上次灰测,相关问题阅读量冲到 540 万+。知乎从"梁文锋"到"梁文疯",社区情绪两周坐了趟过山车。
好消息也有:8 月 21 日 V4-Flash-Vision-Exp 多模态模型上线,视觉理解便宜到"1000 张图只要 1 块钱"。36氪8 月 31 日,这套权重又登陆 HuggingFace 开源,采用宽松的 MIT License,公开内容覆盖模型文件、Tokenizer 和最小化推理实现。微博权重放出来的当天,社区就开始整活了。
有人拿它做无向量数据库的视觉 RAG,把几百页的图文图书先理解、再索引成目录树,查询时视觉细看页面。知乎9 月 2 日,App 的识图模式还悄悄支持了联网搜索。哔哩哔哩
避坑清单:接下来最容易踩的三个坑
一是第三方套餐的额度缩水。DeepSeek 涨价生效当天,OpenCode Go 套餐就把 Flash 模型的调用量削减了 94%——每 5 小时额度从 63300 砍到 3800。知乎如果你正通过 OpenCode、TraeWork 这类第三方套餐间接使用 DeepSeek 模型,先去核对额度规则,别等任务跑到一半被断粮。
二是别指望"开源自部署"捡便宜。OpenCode 团队找了一圈供应商,没人给得出 DeepSeek 涨价前的原厂价格——第三方自己部署的成本,比官方 API 售价还高。知乎开源不等于能便宜自用,你缺的不是权重,是卡。
三是警惕看不见的"缩水版"。8 月 24 日,Pi 的核心贡献者公开质疑 AI Token 黑箱:“你以为买的是 DeepSeek Flash,到手可能是 1.5 bit 缩水版”——量化掺假、缓存锁死这类操作,用户端根本看不见。36氪指控真假尚无官方回应,但它提醒我们:低价套餐可能在看不见的地方打折,账单异常时记得留好用量证据。
怎么选:四类人的决策路径
聊天、轻用户:继续白嫖 App,这轮涨价与你无关。
写代码、跑 agent 的重度用户:Flash + 错峰是最优解。按社区整理的调价前后价格测算,这轮 Flash 的涨幅其实比 Pro 更狠——涨价前 Pro 单价是 Flash 的 12.4 倍,新价格表上只剩约 3 倍,说明官方就是想让你为"便宜"付出代价。小红书但即便如此,Flash 仍是全家最划算的干活模型:谷时价格再砍半,周末全天都是谷价。已经有程序员开玩笑说"周末倒班上班"——批式、异步的任务全排到夜间和周末跑,AI 算力也可以薅"分时电价"。顺带说个反常识:峰谷定价对 agent 本来没什么用,因为 agent 负载不上下班,这正是官方两周内追加"周末全天谷价"补丁的原因。

关键任务用户:别硬省。微博上有个热传实测:复杂网络故障排查,DeepSeek V4 Flash 和 GLM 5.3 Flash 跑了很多轮猜想验证都没找到根因,换更贵的 Kimi K3 花 3 块钱解决了。微博“低端任务看不出区别,关键任务显差异”——重要活儿,给贵模型留预算。
想换供应商的用户:价格战才刚开始。8 月平均每天发布 1.1 个大模型。微博千问头一回开源 Max 级旗舰权重,Kimi K3 放出 2.8T 参数开源版,智谱 GLM-5.3-Flash 则被媒体称为"新的斩杀线"。36氪9 月 2 日又有报道称,神秘"牛来"模型在占据推理成本 90% 的输出成本上,比 DeepSeek 还低 30%。36氪DeepSeek 点燃的价格战,现在烧回了它自己脚下。
我的判断:"价格屠夫"时代结束,但地板价锚还在
回看八月,DeepSeek 涨价的本质是从"获客定价"切换到"供给定价"——当算力成为瓶颈,价格跟着卡走,不跟着对手走。“性价比用户是最忠诚的,也是最不忠诚的”,那条被转疯的知乎评论算是把这波流失说透了。知乎但营收暴涨 10 倍和 82.9% 的毛利率说明,留下的生产力用户已经用脚投票。36氪
对我们这些消费者,接下来值得盯两个信号:一是 8 月 19 日灰测的新模型什么时候转正、Pro 的修复版能不能拿出对得起价格的表现;二是这轮友商砍价(GLM-5.3-Flash、“牛来”)DeepSeek 接不接招。如果价格战继续打,"牢梁"说不定还得降回来。
在那之前,记住三句话:Flash 能干的别用 Pro,任务能挪就挪到夜间和周末,关键任务给贵模型留几块钱预算。这是当下用 DeepSeek 最划算的姿势。