8月17日零点,DeepSeek的峰谷定价正式生效。微博缓存命中输入从每百万token 0.025元涨到0.3元,涨幅1100%;旗舰V4-Pro高峰输出从6元涨到27元。知乎微博上"不敢轻易地喊AI帮忙了"冲上话题,知乎有人哀嚎"一个月30来块的跑团预算,一早上就干掉一半,得找个新的API了"。知乎
先说一个很多自媒体没讲清楚的事:这次涨价只动API,网页版和App的免费聊天、写作完全不受影响。如果你只是日常用DeepSeek聊聊天、写写东西,这篇可以划走,你一分钱不会多花。
真正被这刀砍到的,是调API的开发者和小团队。而这些人现在问得最多的问题就是:DeepSeek涨价了,换到千问(Qwen)能省钱吗?
我把账算了一遍,结论可能跟你想的不一样。
先看新价格到底怎么收
DeepSeek把每天切成两段:高峰是北京时间9:00-12:00、14:00-18:00,其余是空闲时段,空闲价格一律是高峰的一半。知乎注意这个高峰时段,基本就是打工人的"摸鱼高峰期"。
V4-Pro(同日结束测试转正,版本0813)高峰价:输出27元/百万token,缓存未命中输入9元,缓存命中输入0.3元;空闲时段分别是13.5元、4.5元、0.15元。轻量版V4-Flash高峰输出也从2元涨到9元。

什么概念?有重度用户算了笔账:高峰时段重度调用,日费从原来10元左右涨到40-50元。知乎更狠的是那些重度依赖缓存命中的Agent产品——以前缓存命中接近白送(0.025元),很多人账单里缓存占比超过一半,现在这部分涨12倍,按老用法整体账单能翻好几倍。知乎
顺便说个背景:这不是DeepSeek一家的事。今年腾讯云已经两次涨价,智谱年内三连涨,阿里云、百度智能云也先后上调。知乎同时大洋彼岸是反着来的——OpenAI把轻量模型Luna砍价80%,Anthropic取消了涨价计划。国内这波是算力成本刚性上涨(DeepSeek单日token处理量已经到8万亿)叠加Agent需求爆发,"绝对低价"的窗口是真的在关闭。
换到千问能省钱吗?先泼盆冷水
很多人直觉是:DeepSeek贵了,那就换千问。但把两家旗舰的价目表摆在一起,你会发现这个直觉是错的。
按千问官方8月初公布的价格,Qwen3.8-Max国内API:输入12元/百万token,输出36元,隐式缓存命中1.5元。知乎对比DeepSeek V4-Pro:就算涨完价,高峰输出27元也比千问的36元便宜,高峰输入9元比12元便宜,缓存命中0.3元更是只有千问1.5元的五分之一。
也就是说,纯为了省钱从DeepSeek迁到Qwen3.8-Max,账单大概率不降反升。千问Max档位的价值在能力面:1M上下文、文本/图片/视频多模态输入、这次主打的编程与办公场景跃升——它是"能力升级"的选项,不是"省钱"的选项。知乎

那千问这边到底有没有真便宜的路?有,但不是"换个API"这么简单。
千问真正的三张省钱牌
第一张:开源的Qwen3.8-27B,本地跑,token直接归零。
这是我认为这轮涨价里千问手里最硬的一张牌。8月14日开源的Qwen3.8-27B是Apache 2.0协议、可免费商用,原生多模态、26.2万上下文,开源两天下载破100万、冲上HuggingFace趋势榜第一,社区已经攒出500多个量化版本。微博关键是它够小:24GB显存的消费级显卡就能跑,社区有人在一块3090上把量化方案调出单人每秒82 token的速度。知乎知乎
对之前每月在DeepSeek API上花几十块的个人用户(跑团、角色扮演、个人小助手这类),把常用场景搬到本地27B,边际成本直接归零——这是比"换个便宜API"彻底得多的降本。当然丑话说前面:本地路线的隐性成本是硬件、电费和折腾时间,而且这代模型默认思考开得比较满,社区实测简单问题也可能"想太久",部署前建议先看看参数怎么调,别开箱即用。知乎

第二张:TokenPlan订阅制,重度用户改吃自助。
千问现在推的TokenPlan订阅(个人版139元档已上线,含qwen3.8-max调用),逻辑和API按量计费完全不同:用量越大越划算。知乎如果你是那种"账单越跑越心慌"的重度对话用户,月费封顶的订阅制天然对冲涨价风险。这笔账很简单:把你现在每月的API账单乘个1.5的安全系数,跟订阅价比一下就知道值不值。
第三张:免费额度,学生党和新用户先薅再说。
百炼平台有新用户免费token额度;全日制在校生做"云工开物"学生认证,每年能领300元抵扣金,可以抵扣百炼上调用qwen-plus等模型的API费用,有效期一年,计费时优先扣免费额度再扣抵扣金。知乎钱不多,但对学生党做课设、毕设、RAG小项目,够把迁移成本覆盖掉了。
不搬家也行:三个动作比换平台省得更多
如果你的业务已经在DeepSeek上跑稳了,其实有三件事比迁移更划算:
一、把非实时任务挪到空闲时段。批处理、离线评测、向量重建、日报生成这类任务,从高峰挪到空闲,单价直接打五折。有开发者说得实在:现在写队列不光要写优先级,还得写一份"成本日历"。知乎
二、把缓存命中率当KPI管。稳定cache key、失败重试别换格式重发——缓存命中和未命中的价差是30倍(0.3元 vs 9元),这是新价目表里最陡的一档坡。
三、给任务分级路由。关键路径用贵模型,边角任务降到V4-Flash空闲档(输出4.5元/百万token),混着用才是涨价时代的正确姿势。
到底该不该换?对号入座
普通网页版/App用户:跟你没关系,继续免费用。
个人轻度API用户(每月几十块):优先看本地Qwen3.8-27B路线,或者纯空闲时段调度,别急着换平台。
靠缓存命中率活着的Agent产品:先把两边账单按自己的输入/输出/缓存比例各算一遍,盲迁大概率更贵。
需要长文档、多模态、办公集成:Qwen3.8-Max值得上,但记住你买的是能力,不是便宜。
学生党:先把百炼免费额度和300元学生抵扣金领了再说。
最后留三个值得继续盯的信号:一是DeepSeek涨价后一周的调用量和二次调价动向;二是智谱、腾讯云这些同样在涨价的厂商会不会继续跟涨;三是Qwen3.8生态的补位速度——联发科Day-0端侧适配、移动云MoMA上架Max都在这两天发生,开源生态涨得快,本地路线的体验还会继续变好。微博知乎

"绝对便宜"的时代结束了,但会算账的人,从来不怕涨价。