8月17日零点,DeepSeek V4系列API新价格正式生效。这波不是象征性微调——旗舰V4-Pro的缓存命中输入价从0.025元/百万tokens调到高峰0.3元,最高涨幅1100%,「价格屠夫」正式收刀。钱江视频
涨价当晚,微博有人晒出账单截图直呼「deepseek涨价后一看账单真是惊呆我了」。微博开发者的吐槽更扎心——以前跑个大任务花不到2块钱,现在啥都没干10块钱就没了,谁都受不了。微博知乎上「DeepSeekV4大幅涨价后,现在谁才是你心中的大模型性价比之选?」一天冲了近百万浏览。知乎连#大批AI博主停更了#这样的词条都跟着上了热搜。
一、到底涨了多少
综合多方对官方公告的比对,这次调价有三个关键点:一是全线上涨;二是首次引入峰谷定价;三是最终落地的价目明显高于6月底披露的方案——单看V4 Pro输出,空闲价13.5元就已超过原定方案里12元的高峰价。钱江视频完整价目如下:
项目 | 原价(元/百万tokens) | 新价·空闲 | 新价·高峰 |
|---|---|---|---|
V4-Pro 缓存命中输入 | 0.025 | 0.15 | 0.3 |
V4-Pro 缓存未命中输入 | 3 | 4.5 | 9 |
V4-Pro 输出 | 6 | 13.5 | 27 |
V4-Flash 缓存命中输入 | 0.02 | 0.05 | 0.1 |
V4-Flash 缓存未命中输入 | 1 | 1.5 | 3 |
V4-Flash 输出 | 2 | 4.5 | 9 |

高峰时段为工作日9:00-12:00和14:00-18:00,高峰价约为空闲时段的一倍。知乎涨幅落到真实账单上是什么概念:一位主要用V4 Flash跑执行任务的AI博主,单日267次请求、消耗约7673万tokens,按旧价约2.99元,套用新峰谷价后升至7.27元,是原来的2.43倍——而这还只是轻中度用量。钱江视频
反证也要说在前面:即便涨完,V4在同级里仍不算贵——知乎有答主对比过,V4-Pro高峰输出27元/百万tokens,仍低于GLM同级约28元、Grok约43元,更远低于Kimi的百元档。知乎所以这轮真正被刺痛的不是「把AI当工具偶尔用用」的人,而是把API当免费劳动力、任务高频跑的开发者和小团队。
二、一波人正在被推向本地部署
连锁反应来得很快。涨价第二天,知乎就出现标题为「DeepSeek涨价,V4已经用不起了:转私有化部署」的体验帖。知乎微博也有人直接宣布算力疯狂涨价,昨晚又在家部署了27B开源模型。微博
迷你主机这边,有观察者直接把文章标题写成「AI迷你主机迎来新希望」——同期铭凡上架了面向本地推理的大内存AI NAS,零刻首款「为本地AI而生」的SEi AI也刚好在涨价前开卖,时机巧得像剧本。知乎IT之家

但丑话必须说在前面:本地部署不等于同级平替。目前家用机跑得顺的主要是27B到35B这个档位的量化模型,能力上比V4-Pro低一档。所以更现实的姿势是混合策略——高频、中低难度的任务挪到本地,硬任务继续走云端,只是从「全走云」变成「云打底、本地扛量」。
三、回本表:账单多少才值得买台本地机器
先算本地这一侧的成本:
硬件:零刻目前在售的三台「能跑AI」的机器——ME Pro 470准系统4795元起(内存硬盘自备,眼下DDR5涨得凶,配齐落地大概万元档);SEi AI售价11895元起,配160TOPS独立NPU加24GB专用推理内存,社区拆解的说法是整机价格约一半花在那张M.2 NPU卡上。哔哩哔哩GTR9 Pro(AI Max 395+128GB统一内存)去年秋天4TB顶配国补后低至11999元。哔哩哔哩今年7月新增的128G+4T顶配版已标价28599元。IT之家内存涨价潮下,大内存版本的购入成本还在被持续推高,以实时页面为准。
电费:迷你主机推理整机功耗大致在60-130W,按每天12小时、居民电价算,一个月约20元上下。
再算云端这一侧。已有知乎用户拿8月17日当天的两段真实账单做拆解,确认新峰谷价确实进入了实际计费。知乎以一个重度coding agent用量为例(每天约500万缓存命中输入+100万输出、峰谷各占一半地用):旧价每月约180元;按新价峰谷混合估算,每月接近700元。而纯轻度用户只用Flash加专挑空闲时段,每月仍能压在几十元。
按机器12000元、月电费20元,且本地接管大部分高频任务、云端支出大幅下降的口径估算:
涨价后月账单 | 回本周期 | 结论 |
|---|---|---|
100元 | 超过10年 | 别迁 |
300元 | 约43个月 | 不划算 |
600元 | 约20个月 | 边缘,看需求 |
1000元 | 约12个月 | 可以动手 |
2000元 | 约6个月 | 该上了 |
注意这是理想口径:如果你最终是混合用法、云端账单只降七成,回本周期要相应再拉长四成左右。
四、谁该迁,谁别迁
别迁的两种人:
一是月账单100元以内的轻度用户。Flash加空闲时段足够把成本压回涨价前的量级,甚至有微博网友爆料,腾讯正在办微信小程序开发大赛,参赛可领10亿tokens的V4-Flash免费额度(报名截至10月17日),薅羊毛比买机器实际。微博
二是必须吃V4-Pro级能力的用户。本地27B量化模型是能力降级,花一万多买台机器去干几十块钱API就能干好的活,账算不过来。
值得迁的两种人:
三是月账单500元以上、任务高频且中低难度的agent重度用户,回本周期两年以内;
四是对隐私、离线、7×24常驻有硬需求,或者本来就想要一台桌面主机/NAS、AI只是顺带的用户——机器不算纯为涨价买单,回本表只是锦上添花。
还有一类建议观望: 赌价格回落的人。会不会回落、什么时候回落,眼下谁也说不准;而内存涨价同样在推高本地机器的购入价格——等,两边都有成本。
五、真要迁,零刻这三台怎么选
GTR9 Pro:跑大模型的天花板。128GB统一内存是最大底气,能跑更大参数量的模型,社区此前实测同一台395有人能把DeepSeek系量化模型跑到26 tokens/秒,也有人因配置不同卡在个位数。坑在价格:从国补11999元到顶配28599元,大内存版本的身价肉眼可见地往上走,且同一台395不同配置、不同内存分配下性能差异巨大,买前务必确认内存配置。

SEi AI:推理专用,干活办公两不误。160TOPS独立NPU加24GB专用推理内存,推理不吃CPU和内存,适合「一台机器跑模型、一台机器干活」或者单主机多任务。坑在生态:推理基于llama.cpp但支持尚未进主线,新模型要等厂商适配。哔哩哔哩LLM Studio暂不支持,Windows用户需要单独安装驱动和推理框架,最新版生态以Ubuntu为主。
ME Pro 470:门槛最低,但别指望它专攻AI。准系统4795元起,双盘位/四盘位可选,本质是「亦PC亦NAS」的全能位。IT之家HX470平台跑27B级量化模型属于「能跑不快」。适合本来就想要一台多盘位主机、AI是附加题的人,不适合为跑模型单独买它。
六、接下来值得盯的三个信号
DeepSeek的后续定价动作和算力建设进度——如果真回落,上面这张回本表要重算;
DDR5/LPDDR5的价格走势——本地机器的购入成本眼下还在被推高;
零刻SEi AI的固件与推理框架更新——NPU适配能不能进主流生态,决定它是「新物种」还是「新形态税」。
最后留个作业:你的DeepSeek账单涨价后变了多少?欢迎在评论区对一下真实账单——文中的回本表是按公开价目和假设用量算的,真实账单永远比估算有说服力。