当前位置:
AIGC文章详情

DeepSeek高峰价涨了350%,Qwen3.8-27B恰好同周开源:本地部署的回本点,我们替你算了一遍

源自133位全网作者

04:15

8月17日0点,DeepSeek V4新定价正式生效:V4-Pro结束公测转为商用,同时引入了峰谷分时价格。微博也是在这一周,8月13日晚,Qwen3.8-27B宣布开源。两件事撞在一起,「要不要转本地部署」一夜之间从极客话题变成了成本问题。这篇文章把这笔账算给你看。

先说清楚:这次到底涨了多少

新价格按峰谷两套计费(单位:元/百万tokens):

  • V4-Flash:谷时缓存命中输入0.05、未命中输入1.5、输出4.5;峰时分别为0.1、3、9

  • V4-Pro:谷时0.15、4.5、13.5;峰时0.3、9、27

峰时指北京时间9:00–12:00和14:00–18:00,一天7小时;其余17小时算谷时,谷时价格是峰时的一半。微博照此计算,V4-Pro峰时价格里,缓存命中输入涨了1100%,未命中输入涨200%,输出涨350%;V4-Flash峰时三项也分别涨了400%、200%、350%。微博对最常用的Flash来说,白天高峰期输出价格直接到了9元/百万tokens,这才是真正刺痛人的数字。

DeepSeek高峰价涨了350%,Qwen3.8-27B恰好同周开源:本地部署的回本点,我们替你算了一遍

谁在喊疼

社区反应很直接。微博上#大批AI博主停更了#的话题被顶了起来,靠低价API养活内容产能的作者第一批感受到冲击。微博知乎476赞的高票回答说得更具体:「70亿会缩水到14亿。因为DeepSeek Flash缓存命中涨价到5倍」。知乎依赖大量缓存命中跑长对话、跑批量任务的人,成本结构直接变了。也有人只是拿AI摸鱼玩跑团,「一个月也就30来块,今天一早上就给我干了一半预算」。知乎

平台侧的动作更快:编程Agent平台OpenCodeGo把套餐里的Flash模型调用量削减了94%。知乎OpenCode则宣布要做cheapseek,也就是自己部署DeepSeek。知乎连华强北都有了反应,「封板了,显卡一天一个价」。知乎

DeepSeek高峰价涨了350%,Qwen3.8-27B恰好同周开源:本地部署的回本点,我们替你算了一遍

不过也有反方声音。知乎一条125赞的回答认为「DeepSeek V4 Flash走API价格其实是合理的」。知乎摩根大通的分析也判断,DeepSeek定价弹性依然充足,行业成本基准的地位没有变。微博所以这件事的本质不是「绝对贵」,而是重度用户的成本结构被重排了。

核心测算:本地电费 vs 云端账单

以「一张24G显存的显卡跑Qwen3.8-27B」为本地方案。三个前提先说清楚(估算值,可以替换成你自己的实际数据):整机推理功率按0.4度电/小时;居民电价按0.55元/度;速度参考社区实测——4090跑Q4量化约80 tok/s,保守按60 tok/s计。哔哩哔哩

DeepSeek高峰价涨了350%,Qwen3.8-27B恰好同周开源:本地部署的回本点,我们替你算了一遍

本地侧成本很简单:24小时不停机,一天9.6度电,约5.3元,月电费约158元;只白天跑8小时,一天约1.8元,月电费53元上下。

云端以V4-Flash输出价计算:峰时9元/百万tokens,谷时4.5元。两边一除,回本点就出来了:

  • 主要在白天峰时用:5.3 ÷ 9 ≈ 每天60万输出tokens

  • 主要在谷时用:5.3 ÷ 4.5 ≈ 每天118万输出tokens

60万输出tokens是什么概念?跑Agent和写代码的人都知道,一轮任务动辄消耗上万tokens,重度Agent用户日耗百万tokens并不少见。而且Agent场景输入远多于输出,云端未命中输入峰时也要3元/百万了;本地输入只花时间、不花钱——上面这个回本点,还没把输入成本的优势算进去。

如果你需要专门买卡,再加折旧:按3000元的二手24G卡、24个月折旧算,每天多出约4元成本,回本点上移到每天约100万输出tokens(峰时)或210万(谷时)。

三类人,三个结论

第一类,手里已有16G以上显存的卡、白天峰时重度跑Agent或代码:回本点60万/天,值得迁。部署路径这一周已经被社区验证透了。16G显存跑UD-Q3_K_XL量化,速度能到70 tok/s上下。哔哩哔哩24G跑Q4能到80 tok/s、带128k上下文。哔哩哔哩甚至有人用扩到48G显存的4090单卡,跑qwen3.8-27b-nvfp4接500k上下文。知乎

DeepSeek高峰价涨了350%,Qwen3.8-27B恰好同周开源:本地部署的回本点,我们替你算了一遍

第二类,月账单只有几十块的轻中度用户(玩跑团、写东西、闲聊):别折腾。电费加部署时间、维护成本,未必比API便宜。更实际的方案是把批量任务挪到每天17小时的谷时,直接省一半。

第三类,想专门买卡的:先算折旧,别急。华强北显卡价格已经在波动,追高买卡的风险比涨价本身更大。

三句劝退的话,先说在前面

第一,能力有差距。本地27B不等于DeepSeek V4旗舰。社区的普遍口径是「日常开发辅助够用」,复杂长任务还是得上云端旗舰,别带着「同智能四分之一价格」的预期进场。

DeepSeek高峰价涨了350%,Qwen3.8-27B恰好同周开源:本地部署的回本点,我们替你算了一遍

第二,涨价不等于绝对贵。对比下来,V4-Pro谷时价格仍低于GLM-5.2和Kimi K3,缓存命中输入0.3元也明显低于同档约2元的水平。微博能把负载挪到谷时的话,DeepSeek依然是云上性价比最高的选择之一。

第三,这个模型有已知问题。Qwen3.8-27B存在「雷霆思考」的长思考现象,社区目前流行用Cold-Fusion思考压缩版过渡(相关视频已有1.3万播放、195条评论在讨论),或者等官方修复。哔哩哔哩

接下来值得盯的信号

一是硅基流动、阿里腾讯等第三方部署会不会跟涨——这个问题在知乎有765万浏览,是影响下一步的最大变量。知乎二是Qwen3.8后续的35B-A3B、122B-A10B会不会开源,社区已经在排队等。哔哩哔哩三是DeepSeek把腾出来的算力拿去干什么,社区的主流解读是集中训练,如果是真的,下一代模型值得等。微博涨价是厂商的自由,电费是自己的。这笔账算完,迁不迁,你心里应该有数了。

内容由AI生成

精选参考来源

1. 【#DeepSeek正式涨价##DeepSeek新定价生效#】根据深度求索DeepSeek官方公告,DeepSeek-V4系列API全新定价自8月17日0时正式生效

2. 【#梁文锋不当价格屠夫了#】#涨价的DeepSeek还有价格优势吗#曾被业界戏称为大模型“价格屠夫”的DeepSeek,正在收起屠刀。

3. 【价格优势收窄之后#梁文锋不想当价格屠夫了#】#大批AI博主停更了#曾被业界戏称为大模型“价格屠夫”的DeepSeek,正在收起屠刀。

4. DeepSeekV4大幅涨价后,现在谁才是你心中的大模型性价比之选?

5. 涨价后的DeepSeek体验感怎么样?

6. 如何评价DeepSeek涨价后,OpenCodeGo套餐的Flash模型调用量削减94%?

7. OpencodeGo也涨价了,哪里还有便宜DeepSeek?

8. 本地部署Deepseek,选择什么显卡最有性价比?

9. Deepseek涨价了,有哪些便宜的替代方案?

10. 【#摩根大通解读DeepSeek涨价#】#DeepSeek定价灵活性#8月17日,#DeepSeek正式涨价#。

11. DSFlash2双倍Token生成速度,Qwen3.8-27b-Q4,80Token每秒,4090显卡24GB本地部署

12. 本地大模型运行成本实测

13. 16G显存Qwen3.827B本地部署Hermes实现PPT自由

14. 对于DeepSeek的涨价行为,以后面对付费大模型,我们该如何选择?

15. Qwen3.8 27b本地化部署最完整测评

16. 27B实测:一张显卡,在家跑出Opus级智能

17. 专治Qwen3.827B雷霆思考!思考压缩版Qwen3.827B测评:DavidAU/Qwen3.8-27B-Cold-Fusion

18. 怎么看DeepSeek8月17日涨价后的价格,这个峰谷定价你接受吗?

19. 看起来DeepSeek大幅涨价一个重要原因是,需要集中算力练模型

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章