8月17日0点,DeepSeek V4新定价正式生效:V4-Pro结束公测转为商用,同时引入了峰谷分时价格。微博也是在这一周,8月13日晚,Qwen3.8-27B宣布开源。两件事撞在一起,「要不要转本地部署」一夜之间从极客话题变成了成本问题。这篇文章把这笔账算给你看。
先说清楚:这次到底涨了多少
新价格按峰谷两套计费(单位:元/百万tokens):
V4-Flash:谷时缓存命中输入0.05、未命中输入1.5、输出4.5;峰时分别为0.1、3、9
V4-Pro:谷时0.15、4.5、13.5;峰时0.3、9、27
峰时指北京时间9:00–12:00和14:00–18:00,一天7小时;其余17小时算谷时,谷时价格是峰时的一半。微博照此计算,V4-Pro峰时价格里,缓存命中输入涨了1100%,未命中输入涨200%,输出涨350%;V4-Flash峰时三项也分别涨了400%、200%、350%。微博对最常用的Flash来说,白天高峰期输出价格直接到了9元/百万tokens,这才是真正刺痛人的数字。

谁在喊疼
社区反应很直接。微博上#大批AI博主停更了#的话题被顶了起来,靠低价API养活内容产能的作者第一批感受到冲击。微博知乎476赞的高票回答说得更具体:「70亿会缩水到14亿。因为DeepSeek Flash缓存命中涨价到5倍」。知乎依赖大量缓存命中跑长对话、跑批量任务的人,成本结构直接变了。也有人只是拿AI摸鱼玩跑团,「一个月也就30来块,今天一早上就给我干了一半预算」。知乎
平台侧的动作更快:编程Agent平台OpenCodeGo把套餐里的Flash模型调用量削减了94%。知乎OpenCode则宣布要做cheapseek,也就是自己部署DeepSeek。知乎连华强北都有了反应,「封板了,显卡一天一个价」。知乎

不过也有反方声音。知乎一条125赞的回答认为「DeepSeek V4 Flash走API价格其实是合理的」。知乎摩根大通的分析也判断,DeepSeek定价弹性依然充足,行业成本基准的地位没有变。微博所以这件事的本质不是「绝对贵」,而是重度用户的成本结构被重排了。
核心测算:本地电费 vs 云端账单
以「一张24G显存的显卡跑Qwen3.8-27B」为本地方案。三个前提先说清楚(估算值,可以替换成你自己的实际数据):整机推理功率按0.4度电/小时;居民电价按0.55元/度;速度参考社区实测——4090跑Q4量化约80 tok/s,保守按60 tok/s计。哔哩哔哩

本地侧成本很简单:24小时不停机,一天9.6度电,约5.3元,月电费约158元;只白天跑8小时,一天约1.8元,月电费53元上下。
云端以V4-Flash输出价计算:峰时9元/百万tokens,谷时4.5元。两边一除,回本点就出来了:
主要在白天峰时用:5.3 ÷ 9 ≈ 每天60万输出tokens
主要在谷时用:5.3 ÷ 4.5 ≈ 每天118万输出tokens
60万输出tokens是什么概念?跑Agent和写代码的人都知道,一轮任务动辄消耗上万tokens,重度Agent用户日耗百万tokens并不少见。而且Agent场景输入远多于输出,云端未命中输入峰时也要3元/百万了;本地输入只花时间、不花钱——上面这个回本点,还没把输入成本的优势算进去。
如果你需要专门买卡,再加折旧:按3000元的二手24G卡、24个月折旧算,每天多出约4元成本,回本点上移到每天约100万输出tokens(峰时)或210万(谷时)。
三类人,三个结论
第一类,手里已有16G以上显存的卡、白天峰时重度跑Agent或代码:回本点60万/天,值得迁。部署路径这一周已经被社区验证透了。16G显存跑UD-Q3_K_XL量化,速度能到70 tok/s上下。哔哩哔哩24G跑Q4能到80 tok/s、带128k上下文。哔哩哔哩甚至有人用扩到48G显存的4090单卡,跑qwen3.8-27b-nvfp4接500k上下文。知乎

第二类,月账单只有几十块的轻中度用户(玩跑团、写东西、闲聊):别折腾。电费加部署时间、维护成本,未必比API便宜。更实际的方案是把批量任务挪到每天17小时的谷时,直接省一半。
第三类,想专门买卡的:先算折旧,别急。华强北显卡价格已经在波动,追高买卡的风险比涨价本身更大。
三句劝退的话,先说在前面
第一,能力有差距。本地27B不等于DeepSeek V4旗舰。社区的普遍口径是「日常开发辅助够用」,复杂长任务还是得上云端旗舰,别带着「同智能四分之一价格」的预期进场。

第二,涨价不等于绝对贵。对比下来,V4-Pro谷时价格仍低于GLM-5.2和Kimi K3,缓存命中输入0.3元也明显低于同档约2元的水平。微博能把负载挪到谷时的话,DeepSeek依然是云上性价比最高的选择之一。
第三,这个模型有已知问题。Qwen3.8-27B存在「雷霆思考」的长思考现象,社区目前流行用Cold-Fusion思考压缩版过渡(相关视频已有1.3万播放、195条评论在讨论),或者等官方修复。哔哩哔哩
接下来值得盯的信号
一是硅基流动、阿里腾讯等第三方部署会不会跟涨——这个问题在知乎有765万浏览,是影响下一步的最大变量。知乎二是Qwen3.8后续的35B-A3B、122B-A10B会不会开源,社区已经在排队等。哔哩哔哩三是DeepSeek把腾出来的算力拿去干什么,社区的主流解读是集中训练,如果是真的,下一代模型值得等。微博涨价是厂商的自由,电费是自己的。这笔账算完,迁不迁,你心里应该有数了。