8月6日,DeepSeek在开发者后台挂出一条不到50字的公告:计划近期整体上调API服务的定价,预计涨幅较大。知乎这是那个把大模型价格打成白菜价的"价格屠夫",两年来第一次正式预告涨价。到今天(8月10日),涨多少、哪天生效都还没公布,但社区已经吵了四天:有人传最高涨30倍,有人连夜囤额度,也有人连夜迁模型。这篇不站队,只把全网信号摊开,替你把窗口期里真正值得做的几笔账算清楚。
先对号入座:这次涨的是谁的钱
先说结论:涨的是API,不是你的免费聊天框。公告针对的是API服务定价,官方App和网页版的免费对话入口目前没有任何收费变化的官方消息,纯聊天用户不用囤会员,也不用迁移。真正被波及的是三类人:自己持Key接工具、跑Agent的开发者,账单直接变;用第三方套壳应用、知识库、AI写作工具的用户,后端如果挂在DeepSeek上,后续可能遇到工具方涨价或悄悄换模型;按DeepSeek价格做成本模型的创业团队,定价假设要重算。一位独立开发者的说法很典型:对于普通用户影响不大,但对独立开发者、高频调用AI API的场景,成本变化还是比较明显。小红书
涨多少:按"会大涨"准备,别按"30倍"决策
官方口径只有"预计涨幅较大",没有数字,没有日期。社区流传的"最高30倍""3倍"都还没实锤,知乎高赞回答直接吐槽:拉倒吧,怎么可能30倍?!知乎也有人算了笔账:就算真涨30倍,DeepSeek也未必丢掉最便宜交椅——这当然是段子,但它提醒了一件事,恐慌本身比涨价更贵。可参考的实数是一份开发者账单实测:8月2日1.34亿Token花了4.9元,折合每百万Token约0.037元;8月9日2400万Token花了1.67元,折合约0.070元,实际成本上涨约 1.9 倍。小红书单个案例里混着用量结构和峰谷时段的扰动,不能当官方涨幅用,但方向是确定的:账单已经在动了。

为什么偏偏在最火的时候涨
导火索是挤爆的服务器。8月1日当天,DeepSeek V4 Flash在其平台上单日处理Token总量达8万亿——其中5万亿来自免费试用,3万亿来自开发者付费调用。知乎8月4日,官方API又因前所未有的访问量上午几乎不可用。另一边算力账单在敲门:中国 AI 算力需求 2026Q1 同比涨 417%,供给只涨 128%,H100 租金半年涨约四成。知乎
行业也在集体转身。智谱2026年一季度API调用定价较2025年底提升约83%,调用量仍增长400%;月之暗面随着Kimi K3发布,输入价格涨幅超3倍、输出价格接近4倍;腾讯云连续两次宣布涨价。知乎DeepSeek是最后一块地板,现在地板自己抬了。有意思的是海外在反向走:OpenAI 六月砍 Luna 80%、谷歌把 Flash-Lite 压到 $0.3。知乎价格战没有结束,只是分裂成了两个战场。
窗口期四件事,比囤额度更值钱
① 别急着换模型。同一批基准跑下来,DeepSeek成本只需0.03美元,而Anthropic旗舰模型Claude Fable 5要3.15美元——DeepSeek便宜超过100倍。知乎智力分上V4 Flash(AA指数50)也只比GPT-5.6 Luna低1分。就算整体翻倍,在同智力档里它依然是地板价,恐慌性迁移大概率是把便宜账单换成贵账单。
② 把缓存命中率抠出来。缓存命中的输入,价格是未命中的1/50到1/120。Flash:命中0.02元,未命中1元。Pro:命中0.025元,未命中3元。知乎而且context caching是自动的,请求前缀和历史请求逐字节匹配的部分就按缓存价计费,不用改一行API代码。要改的是prompt结构:共享前缀里混进时间戳、任务参数,缓存立刻作废,全部按原价收。养Agent的人,这一条比任何迁移都省钱。
③ 重任务挪去平峰。峰谷计费已经在执行:工作日高峰时段(9:00-12:00、14:00-18:00)全部计费项价格翻倍,夜间、周末及法定节假日执行平峰原价。知乎能批处理的跑批、评测、数据清洗扔到夜里和周末,账单直接对折。
④ 把按量换成包月。OpenCode Go被社区叫作"ds伪官方包月套餐":目前每月10刀(约70元)可以享受到几乎不限量的,相当于约200-400人民币API价格的deepseek-flash和小米Mimo模型调用。知乎只要便宜、不写代码的,看美团LongCat,9.9元一个月,缓存命中0元,聪明程度一般但够用;要全模态(识图、生视频)的看MiniMax 49元档。月用量折下来不到几百元的,直连官方API依然最省心。

真要迁移,先看这张对照表
把主流模型的官方按量价摆在一起(涨价前快照,元/百万Token):DeepSeek V4 Flash输入1元、输出2元,V4 Pro输入3元、输出6元;GLM-5.2 ¥8/¥28、MiniMax ¥2.1/¥8.4、DeepSeek ¥1/¥2 与 ¥3/¥6、Qwen3.7-Max ¥12/¥36。知乎而Kimi K3官方定价页标着输入(缓存未命中)20元、输出100元,deepseek-v4-flash的输出价格大约是kimi-k3的1/50。知乎

按输出价口径的性价比帕累托前沿是:DeepSeek V4 Flash → GPT-5.6 Luna → Grok 4.5 → Kimi K3 → Claude Opus 5,其余模型均被「更便宜且不更弱」的模型支配。知乎翻译成人话:写代码、跑Agent这种量大场景,目前同价位没有能平替Flash的;真要换,也是往订阅制换,不是往另一家按量API换。
接下来盯三个信号
一是官方正式通知里的涨幅和生效日期,那才是靴子落地,现在的传闻一律打折听;二是你正在用的第三方工具是否发涨价或换模型公告,套壳工具悄悄换模型比涨价更值得防;三是Qwen3.8-Max的开源权重,行业盯的窗口是8月10日到14日,若如期放出,这张性价比天梯图会重画一次。知乎免费午餐的时代没结束,但"算着用"的时代,从这纸公告开始正式计时。