DeepSeek最高涨1100%,海外却砍价80%:算完十几款主流模型的账,AI省钱的路变了

源自14位全网作者

03:39

这周,如果你是用大模型 API 的开发者,心情大概率坐了一轮过山车。

8月17日零点,DeepSeek 新定价正式生效,早上起来账单就刷满了首页:有人的任务从原来的2.99元,按新价一算直接涨到7.27元微博知乎。还有人只问了2个简单问题,8毛钱就没了微博。最夸张的是缓存命中输入的价格,从每百万 token 0.025元直接干到高峰0.3元,涨幅1100%知乎。而在大洋彼岸,一件声量小得多但同样重要的事正在发生:OpenAI 把 GPT-5.6 Luna 的价格砍了80%,Anthropic 干脆取消了原定的涨价。同一周,国内涨、海外降,这笔 AI 账得重新算一遍了。

这次涨了多少?先看明细

新定价8月17日0时正式生效,同时 V4-Pro 结束测试、全面转为正式版商用服务微博。旗舰 V4-Pro 涨得最狠:缓存命中输入从0.025元涨到高峰0.3元/百万 token(+1100%),缓存未命中输入从3元涨到9元(+200%),输出从6元涨到27元(+350%);V4-Flash 也跟着涨,缓存命中输入从0.02元涨到0.1元(+400%),输出从2元涨到9元(+350%)知乎

还有两个细节值得注意。一是这次在行业里第一次上了峰谷分时定价:工作日9:00-12:00、14:00-18:00算高峰,其余17个小时都是闲时,闲时一律半价知乎微博。二是这不是拍脑袋的决定,官方8月13日才正式发公告,只给了用户4天缓冲知乎。而早在6月底就流传过一版峰谷方案,最终落地的闲时价13.5元,已经超过了当时拟定的高峰价微博

DeepSeek最高涨1100%,海外却砍价80%:算完十几款主流模型的账,AI省钱的路变了

不止 DeepSeek 在涨

把视角拉远一点,这是整个行业的涨价年:智谱年内三次提价,一季度提价约83%,调用量反而逆势增长400%;豆包旗舰价接近翻倍;腾讯混元 HY2.0 Instruct 输入价一度涨了463%;Kimi K3 定价较前代涨超3.5倍,高价发布三天后就暂停了C端新用户订阅;头部厂商里,只有百度的 ERNIE 5.1 反而降了价知乎

那涨完之后,DeepSeek 在国产旗舰里处于什么位置?把9家旗舰的价格拉个横评(元/百万 token,输入/输出):Kimi K3 是20/100,Qwen3.8-max 是12/36,DeepSeek V4-Pro 高峰9/27,GLM-5.2 是8/28,豆包 Seed-2.1 Pro 是6/30,ERNIE 5.1 是4~6/18~22,MiniMax M3 永久5折后约2.1/8.4,阶跃 step-3.7-flash 是1.35/8.1,腾讯混元 Hy3 是1/4知乎

能看出来的第一件事:涨价之后,DeepSeek 已经不是最便宜的旗舰了,高峰输入价摸到了 Kimi K3 的一半知乎

第二件事是个伏笔:只要能吃上缓存,涨后的0.3元命中价依然比同档位的1.2-2元便宜一个数量级——这也是后面要讲的最重要的省钱抓手知乎

为什么偏偏这时候涨?

第一本是调用量的账。每经援引 OpenRouter 数据测算,上周全球大模型调用量75.3万亿 token,周环比涨9.13%,其中中国模型36.84万亿,对美国模型的10.26万亿,连续16周第一;DeepSeek V4-Flash 单模型周调用就有11.2万亿,连续两周排第一知乎。调用量爆表,算力就成了稀缺资源,价格是最直接的调节阀门。

第二本是 Agent 的账。这轮调用暴涨主要是 Agent 类应用带起来的,单次任务吃的 token 是传统对话的几十倍到上百倍,光 OpenCode 一个平台,V4 Flash 单日处理的 token 就干到了8万亿知乎。这种用法,补贴价根本扛不住。

第三本是生意的账。按投资者交流中透露的说法,梁文锋的定价哲学是以服务器10个月回本为基准,只赚合理利润知乎小红书。补贴换规模是早期打法,商业化这一步迟早要走。

同一时间,海外在反向操作

这是这轮行情里最有意思的部分。7月30日,OpenAI 把 GPT-5.6 Luna 的 API 价格直接砍了80%,降到每百万 token 输入0.2美元、输出1.2美元,Terra 下调20%知乎小红书

Anthropic 推出了价格约为先前旗舰一半的 Claude Opus 5,还取消了原定9月1日生效的 Sonnet 5 涨价计划知乎小红书。另有消息称 GPT-5.6 Sol 的 OpenRouter 渠道价也砍了半,这条目前只有一个来源,先观望小红书

砍完价,Luna 便宜到什么程度?按 Artificial Analysis 的单任务平均成本评测:Luna 以0.05美元垫底,DeepSeek V4 Pro 是0.25美元,GLM-5.2 是0.33美元,Claude Opus 5 要2.34美元,Claude Fable 5 要3.14美元知乎

DeepSeek最高涨1100%,海外却砍价80%:算完十几款主流模型的账,AI省钱的路变了

有人把主流模型的智能指数和单次任务成本画成了一张散点图(数据截至8月初),左上角性价比最高的那一簇,几乎全被降价后的海外新模型占了小红书

为什么会分化?我的理解是:国内是需求先爆了,算力顶不住,用价格筛选需求;海外是在用降价抢开发者生态,锁使用习惯。两边都是商业策略,没有对错,但对用户的启示很明确——国产模型永远更便宜的时代,过去了。

连锁反应已经开始

最先流血的是承诺保价的第三方平台。DeepSeek 涨价后,OpenCode Go 套餐里 V4 Flash 的五小时调用量从63300次跌到3800次,一天跌掉94%知乎微博小红书

月限额也从60美元被砍到15美元,后来才恢复到30美元,用户排队退订,此前信誓旦旦要保住低价的 CEO 也承认"并不容易"知乎小红书

腾讯云 CloudBase 几乎同一时间官宣,完全跟随官方同步调价,连峰谷机制都一模一样知乎

DeepSeek最高涨1100%,海外却砍价80%:算完十几款主流模型的账,AI省钱的路变了

落到个人开发者身上,疼得更具体。AI 博主叨哥胡侃晒出自己的账单:涨价前可劲折腾,近2000万 token 只花3.14元;涨价后峰时用 V4 Pro 问一个简单问题,200万 token 就花了3.4元微博。另一位博主栋见加电,问了2个问题,8毛钱没了,直呼这次涨价有点猛微博

DeepSeek最高涨1100%,海外却砍价80%:算完十几款主流模型的账,AI省钱的路变了

这里必须把话说清楚:这次调价只动 API 接口,如果你平时只用 DeepSeek 的网页版和 App,一切跟你没关系,日常聊天写作依然免费知乎知乎。这轮冲击主要打在开发者,以及背后用 API 计费的产品上。

四招省钱,按需取用

第一招,错峰。闲时半价,周末全天都是闲时。批量翻译、数据清洗、定时报告这些不急的任务,挪到晚上或周末跑,成本直接减半知乎知乎

第二招,把缓存命中率拉满。这是涨价后最值钱的一招:命中价相对未命中仍便宜30倍知乎。做法也简单——系统提示词固定下来,长上下文放前面,重复任务尽量复用同一套前缀。再避个坑:各家的上下文缓存是完全独立的,中途在同一会话里换模型,之前积累的上下文会被当作全新输入全额扣费,不仅不省钱,反而烧得更多小红书

第三招,按任务分模型。批量简单任务用便宜或免费的:GLM-4.7-Flash 目前免费,腾讯混元 Hy3 只要1元/4元,阶跃 step-3.7-flash 是1.35元/8.1元,都比 DeepSeek 的闲时价还低知乎。旗舰留给真正的硬任务。

第四招,免费渠道别浪费。微信小程序成长计划正在送10亿 token 的大模型额度,个人开发者有项目的话可以先把免费额度领了知乎。海外降价之后,Luna 也是 GPT-5.6 家族里最便宜、最快的那一档,跑量大、简单的任务没有比它更划算的了知乎

接下来值得盯的三个信号

第一,盯 DeepSeek 自己的调用量变化。调用量如果持续下滑,说明价格还需要回调;如果很快稳住,说明涨价筛出了真需求,其他国产厂跟涨的胆子会更大。第二,盯 Kimi、Qwen、GLM 跟不跟。它们现在的定价已经比涨价后的 DeepSeek 贵,有跟涨空间,跟了的话,便宜的国产旗舰就又少一个。第三,盯海外降价是不是可持续。Luna 的0.2美元如果能稳住三个月,很多国产应用的性价比锚点会整体移动——到时候可能不是国产贵了,而是海外变成了新的性价比基准。

最后问一句:你的 AI 月供是多少?涨价之后账单变了吗?评论区聊聊。

内容由AI生成

精选参考来源

1. DeepSeek 涨价后谁才是国产最便宜的旗舰?9 家国产厂商旗舰模型定价横评,性价比格局彻底洗牌

2. 什么?!GPT-5.6 Luna 直接变成最便宜的大模型了?5分钱跑完一轮任务!

3. 最高涨1100%,DeepSeek今起涨价,你薅了两年的便宜要结束了

4. 【价格优势收窄之后 #梁文锋不想当价格屠夫了#】#大批AI博主停更了#曾被业界戏称为大模型“价格屠夫”的DeepSeek,正在收起屠刀。8月17日0时,DeepSeek API新价格正式生效。此次调整不仅覆盖V4 Pro和V4 Flash的价格,还将峰谷定价引入V4系列,将北京时间9:00—12:00、14:00—18:00划定为高峰时段,其余17个小时为空闲时段;空闲价格为高峰价格的一半。调整后,旗舰模型DeepSeek V4 Pro高峰时段缓存命中输入、缓存未命中输入和输出价格分别达到每百万Token 0.3元、9元和27元,较此前分别上涨1100%、200%和350%;V4 Flash对应的高峰期价格,也分别上涨了400%、200%和350%。当Token不再完全“白菜价”,谁的钱包会最受伤? 涨价幅度不小这是一场事先张扬的涨价。早在6月底,DeepSeek便通知用户,计划在V4正式版上线后引入峰谷定价,以“更合理地配置资源、提升服务稳定性”。按照当时的方案,V4 Pro每百万Tokens缓存命中输入、缓存未命中输入和输出的平时价格分别为0.025元、3元和6元,高峰价格分别为0.05元、6元和12元;V4 Flash高峰时段三项价格则分别为0.04元、2元和4元。该方案原计划随7月中旬上线的V4正式版实施。但此后模型发布延期,峰谷价格也未按原定时间落地。8月6日,DeepSeek再次在开放平台发布通知,并向部分API用户发送邮件,明确表示近期将整体上调API服务价格,且“预计涨幅较大”,提醒用户提前规划用量,但未同步公布具体价格和生效日期。约一周后,DeepSeek V4 Pro正式版和最终调价方案陆续上线。作为V4系列的旗舰模型,V4 Pro面向复杂推理、编程和Agent任务,支持100万Token上下文、最长38.4万Token输出,以及思考模式、工具调用和OpenAI Responses API等功能。又过了4天,新价格正式生效。值得一提的是,DeepSeek最终落地的新定价明显高于6月底披露的早期峰谷方案。以V4 Pro输出为例,6月底方案中的平时和高峰价格分别为6元和12元,最终的空闲和高峰价格则达到13.5元和27元,空闲时段价格已经超过此前拟定的高峰价格。可以看到,这次调整并不只是利用峰谷价差引导用户错峰调用,而是在保留分时计费框架的同时,整体抬高了V4系列API的价格。涨价之后,DeepSeek与其他国产旗舰模型之间的价差也在缩小。以高峰时段为例,V4 Pro缓存未命中输入和输出价格分别为每百万Token 9元和27元。作为参照,智谱此前的期间模型GLM-5.2对应价格约为8元和28元,两者已经进入相近区间;月之暗面的旗舰模型Kimi K3缓存未命中输入和输出价格则分别为20元和100元,仍明显高于V4 Pro。 不过,不同模型的能力、推理强度和适用场景并不相同,单纯比较Token价格并不能直接判断性价比。DeepSeek的价格优势也没有完全消失:V4 Pro空闲时段缓存未命中输入和输出价格分别为4.5元和13.5元,仍低于上述两款模型;其缓存命中输入价格最高为0.3元,也明显低于GLM-5.2和Kimi K3约2元的水平。这意味着,涨价后的DeepSeek已不再像此前那样与部分国产旗舰模型拉开数量级价差。对于开发者而言,模型选择也将从单纯比较价目表,转向比较完成同一项任务所需的调用次数、Token消耗和最终效果。 谁受伤?从应用场景看,受此次DeepSeek涨价影响较大的首先是需要长期运行Agent的个人开发者和技术团队。这类用户不仅Token消耗量大,任务又通常需要连续保留上下文,难以通过缩短对话或频繁开启新会话降低成本。AI博主、个人开发者“人工大黑”主要使用DeepSeek V4 Flash处理浏览器检索、程序纠错和服务器环境部署等执行任务。他向记者展示的8月8日调用记录显示,当天,他共发起267次请求,消耗约7673万Token。其中,缓存命中输入约7547万Token,占总量的98.35%,缓存未命中输入约105万Token,输出约21万Token。按照调整前的价格计算,人工大黑的这些调用约花费2.99元;根据实际调用时段套用新的峰谷价格后,费用将上升至7.27元,是原来的2.43倍。而这个用量,据人工大黑介绍,还只是轻度到中度之间的一个用量。对人工大黑而言,此次涨价中最难承受的是缓存命中输入价格上涨。“对于我们这种使用Agent的用户,典型模式是高复用的长上下文会话。”他说,编程Agent会反复读取代码、历史对话和工具调用结果,缓存单价虽然不高,却会被数千万甚至上亿Token的用量放大。而缓存命中输入恰恰是本轮DeepSeek涨幅最大的计费项目,高峰时段,V4 Pro和Flash的涨幅分别达1100%、400%。不过,哪项涨价对账单影响最大,仍取决于具体业务的Token结构。对高缓存命中、长上下文复用的Agent用户,缓存价格上涨可能构成主要成本增量;而批量撰写营销文案、商品介绍、小说剧本和长篇报告等业务,通常输入要求较短、模型生成内容较长,属于输出密集型业务,更容易受到输出价格上涨影响。对后者而言,DeepSeek V4 Pro高峰时段每百万Token输出价格从6元涨到27元,这一涨幅可能成为主要成本压力。受新定价影响较大的另一类用户,是那些必须在国内工作时间内实时响应的企业应用,譬如在线客服、实时编程助手。这些应用无法简单地将用户请求延后到DeepSeek定义的空闲时间,因而难以充分利用优惠的空闲价格。此外,依赖第三方低价Coding Plan的高强度开发者,也将受到较大冲击。过去,一些开发者并不直接按照DeepSeek官网API价格付费,而是通过OpenCode等第三方编程套餐获得更低成本的调用额度。人工大黑介绍,对调用量很大的用户而言,这类套餐曾是重要的低价渠道。事实上,DeepSeek涨价后,OpenCode已调整其Go套餐的使用上限。OpenCode公布的额度对比显示,V4 Flash的限额由此前每5小时约63300次降至3800次,降幅约94%;V4 Pro则由3450次降至1050次。其表示,此次调整是为了反映DeepSeek涨价带来的成本变化,同时正在研究如何以接近此前的价格继续提供相关模型。不过,成本上涨,并不意味着重度用户会立刻离开DeepSeek。人工大黑表示,执行类任务仍会继续使用V4 Flash。在他的实际体验中,虽然V4 Pro正式版的提升较为有限,但V4 Flash的输出速度可达到约150 Token/s,能力也处于其认为的及格线之上,“如果按API价格计算,涨价后的性价比依然较高”。但开发者的选择正在变得更加精细。人工大黑早就不是让一个模型包办所有任务,而是使用GLM处理部分编程工作,借助Kimi完成规划和逻辑推理,再把大量执行任务交给V4 Flash。当越来越多开发者开始根据能力、速度和价格拆分任务,大模型厂商也将迎来一场比价格战更严格的考试。价格战比的是谁能把Token卖得更便宜,价值战考验的则是,模型能否用更少的调用、更短的时间和更稳定的结果完成任务。低价可以吸引开发者尝试,真正的能力才能让他们长期留下。过去,DeepSeek凭借低价重新定义了大模型API的价格下限;如今,它需要回答一个新的问题:当价格优势收窄之后,模型本身是否仍有足够的价值,让开发者继续留下?戳更多#黄仁勋称失去中国市场美国AI必败#>>(中国新闻周刊) 钱江视频的微博视频

5. 【#DeepSeek正式涨价##DeepSeek新定价生效#】根据深度求索DeepSeek官方公告,DeepSeek-V4系列API全新定价自8月17日0时正式生效,同时V4-Pro结束测试阶段,全面转为正式版商用服务。本次调价取消统一计费模式,采用行业少见的算力错峰分级计价,高峰时段收费标准较空闲时段直接翻倍。DeepSeek-V4-Flash空闲时段输入缓存命中0.05元、输入缓存未命中1.5元、输出4.5元,高峰时段输入缓存命中0.10元、输入缓存未命中3.0元、输出9.0元。DeepSeek-V4-Pro空闲时段输入缓存命中0.15元、输入缓存未命中4.5元、输出13.5元,高峰时段输入缓存命中0.30元、输入缓存未命中9.0元、输出27.0元。两款模型均支持工具调用、Responses API、Anthropic兼容接口、对话续写以及FIM补全功能,最大上下文输出长度384K。官方表示推出峰谷定价意在优化算力资源调配,引导开发者错峰部署任务。两款V4系列模型均支持384K超长上下文,原生适配FIM代码补全、工具调用、对话续写、多类API兼容接入,可覆盖长文本解析、代码开发、智能体部署、企业批量推理等商用场景。推行峰谷定价核心目的是平衡日间算力拥堵问题,通过市场化价格调节,引导企业与开发者错峰调度任务,平抑高峰期算力负载,整体提升平台服务稳定性。官方划定高峰时段为每日9:00-12:00、14:00-18:00,其余时间为空闲时段,空闲时段定价为高峰时段的一半,计费单位为元/百万tokens。 (快科技)

6. #DeepSeek正式涨价#涨价前,可劲折腾,花了近2000万token,只要3.14涨价峰时的 V4 pro版本,一个简单问题200万token,花了3.4差了10倍token用量

7. #DeepSeek正式涨价#问了2个问题,8毛钱,这次涨价有点猛,基本都翻几倍了,随便用用就2块没了。

8. 如何评价GPT-5.6系列大幅降价, Luna比DeepSeek更便宜?

9. GPT-5.6 Sol 通过 OpenRouter 途径砍半降价

10. 你的AI月供是多少

11. DeepSeek调价!OpenCode Go受牵连

12. DeepSeek涨价首日,调用量跌94%

13. 2026 年 8 月全球 AI「智商-成本」图

14. 微信小程序成长计划:6 个月免费 CloudBase + 10 亿 Token,个人开发者的一次零成本全栈机会

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章