DeepSeek涨价用户"几天一充"、GLM免费说收就收:4笔国产模型编程账单横评

源自238位全网作者

04:21

8月17日,DeepSeek新价格正式生效,峰谷分时计费首次落地。两周过去,最先感到疼的是拿它跑编程Agent的个人开发者。微博上有人算完账单:“之前一天就用两三个点的套餐额度,现在一天就干了20%”。微博另一位更直接——“本来以为deepseek涨价不会有什么感觉,结果现在从一个月一充变成几天一充还消费降级到flash了”。微博

而就在涨价的同一周里,智谱、阿里、腾讯相继甩出新牌:GLM-5.3-Flash匿名霸榜后官宣开源、Qwen3.8-Flash一块钱输入、混元Hy4 preview开源。一个月前大家还说"DeepSeek一统天下",一个月后,“四家公司在一周之内,走出了四种完全相反的路线”。知乎这不是又一场参数跑分热闹,而是你9月续订、换模型、薅羊毛之前必须算清楚的一笔账。

第一笔账:DeepSeek到底涨了多少?取决于你怎么用

官方口径先摆出来:V4-Flash缓存未命中的输入从0.1元涨到1元/百万tokens,输出从0.2元涨到2元,“峰时价格更夸张,部分时段涨幅超过1100%”。知乎但"涨了多少倍"这个问题,官方价格表回答不了你——计费按模型、输入输出、缓存命中、时段四个维度浮动,不同用法差异巨大。

知乎用户靳伟做了一件大多数人没做的事:拿自己某个月账单的实际用量(Flash与Pro约9:1),套进新价格表逐项重算,“涨价幅度在2.06倍到4.11倍之间。混合下来大概是3.x倍”。知乎不是传言的"10倍",也不是温和调整。另一篇行业文章给出的第三方核算口径同样值得参考:“工作日高峰时段API调用价格大幅上调,经第三方核算显示,输出价格最高涨至旧版的4.7倍”。知乎

所以第一笔账的正确打开方式不是骂涨价,而是翻出你的费用清单看两个数:缓存命中率高峰用量占比。命中率高、主要用闲时的重度用户,体感涨幅可能只有一倍多;反过来,白天连轴跑Agent的,3倍打底。靳伟重算后的结论也顺势成了社区金句:涨价后DeepSeek的费用已经大大超出他的GLM Coding Plan,“梁圣重新变成梁子”。知乎DeepSeek官方提供了详细的用量和费用计算清单——涨价后第一次续费前,值得认真拉一遍。

第二笔账:GLM-5.3-Flash的"免费气泡"与"说收就收"

8月的另一条主线,始于8月20日空降OpenRouter的匿名模型Ox-Alpha(社区称"牛来"):“100万上下文、多模态、完全免费”,在OpenCode里基本不限量,凭能打的Coding能力几天内把DeepSeek的累计使用量压到身后。知乎社区当了一周侦探,靠分词器指纹和错误码锁定东家——8月26日智谱认领并上线开源GLM-5.3-Flash(320B总参、18B激活),“这是GLM-5系列的首个原生多模态模型”,权重MIT协议同步上HuggingFace。知乎

更有意思的是认领之后。“身份公开,免费体验也很快结束”,OpenCode晒出的使用数据显示:“刚刚结束免费期的GLM-5.3-Flash迅速退潮,DeepSeekV4Flash重新冲上单日使用量第一”。微博这场"榜一争夺战"其实是今年最诚实的一次价格敏感度实验:免费时登顶,一收费用户立刻用脚投票。嘴上都在聊SWE-bench,掏钱跑Agent时诉求极其朴素——好用、便宜、额度够大。

但要泼两盆冷水。第一,OpenCode Go现在的GLM-5.3-Flash定价是"每百万Token输入0.075美元、输出0.25美元,同时还要按照2倍额度消耗",看着便宜,实际成本要自己乘回去。微博第二,国内促销价大约只有涨价后DeepSeek的三分之一,但"这是促销价(9月9日截止)。原价算下来,有开发者测算GLM-5.3-Flash比DeepSeek涨价后还贵约46.6%"。知乎换句话说:现在"香"是窗口期的香,按促销价锁定长期套餐就是给自己埋雷。

第三笔账:Qwen3.8-Flash,以及"不吃API"的第三条路

智谱官宣同夜,阿里出手:“Qwen3.8-Flash,125B总参但每个token只激活6B,输入1元/百万tokens,输出3元”。翻译成人话:四家Flash里推理成本最低的一档,拼的不是参数是效率。知乎

更值得注意的是开源分支Flash-Next把价格战延伸到了电费层面:"24GB显存+128GB内存,塞下94GB大模型"的量化版已经有人在晒,M5 Max的Mac上能跑到50t/s。知乎知乎对于每天烧几百万token的Agent重度用户,"自有显卡+开源权重"第一次成了算得过账的对照组。当然,本地部署的速度和长上下文能力跟云端旗舰仍有差距,它更像一条备份路线,而不是全家桶。

第四笔账:Hy4 preview,盲测数据先咽一半

8月28日腾讯亮牌:“2026/8/28正式开源(Apache2.0),混元当前最强旗舰预览版;官方称属早期Preview、将快速迭代。【规格】MoE架构,总参770B/激活49B,上下文1Mtokens”,定位软件工程、办公分析这类真实任务。微博参数层面它确实是四家Flash里堆得最狠的,官方还放出了"腾讯内部盲测(163名专家+203名外部用户):略优于GLM-5.3和Kimi K3"的说法。知乎但"preview"三个字要细品:上一代Hy3也是preview先发、正式版两个月后才落地;所谓"略优"来自厂商内部盲测,社区独立跑分出来之前,小红书博主那句"但"略胜 GLM"这句 我一个字不信"代表了不少人的态度。小红书这类vendor-reported数据的正确用法是收藏观察,而不是今天就迁移。

对表口径:哪些数字能信,哪些要等

把四家的信息按证据强度排个序,你就不容易被带节奏:

信息

类型

可信度处理

DeepSeek新价格表、峰谷规则

官方公告

直接采信,但要代入自己的用量结构

GLM-5.3-Flash开源、MIT、320B-A18B

官方发布

直接采信

2.06–4.11倍的实际涨幅

个人账单重算

可复现,换成你的用量再算一遍

OpenCode"榜一"涨跌

平台方自晒数据

方向可信,绝对值存疑

“GLM原价比DS贵46.6%”

社区测算

提示风险用,别当定价依据

Hy4"略胜GLM/K3"

厂商盲测

打折看,等独立跑分

另有一条容易被忽略的免费暗线:Meta在OpenCode上的Muse Spark 1.2 Contributor,价格比DeepSeek V4 Flash还低,但"用户需要同意Meta使用自己的Prompt和模型输出训练未来的模型"。微博白嫖的代价写在协议里,涉密项目、有合规要求的工作代码,这条直接划掉。

2个窗口与日历动作

  • ZCode的3亿Token周末窗口:8月28日(周五)20:00到8月31日(周一)09:00,“所有登录用户均可免费领取 GLM-5.3 flash的3 亿 Token 体验额度,新用户、老用户、Coding Plan 订阅用户均可参加”,需要先把ZCode升到3.10,在客户端活动卡片点领取,每账号一次,不影响原套餐权益。微博截至发稿领取窗口还剩不到48小时,拿它跑个真实项目验证能力,比看一百篇测评划算。

  • GLM CodingPlan的7天体验卡:官方"针对未订阅套餐的用户免费发放7天体验卡,每天限量10,000张"。知乎提醒一句社区实测:“我用zcode,大概小半天就可以用5.3f把智普送的7天体验卡(2000分)用完”。知乎它是给你试驾的,不是给你省月费的。

然后是三个日历节点:9月9日前,别按促销价买任何长期套餐;9月9日当晚,原价重测一轮"智谱 vs 涨价后DeepSeek";Hy4正式版和独立跑分出来之前,把"略胜"当预告而不是结论。

按人下菜:你现在该动什么

  • 每天烧百万token以上的Agent重度用户:先拉DeepSeek费用清单算命中率和时段占比,再决定去留;GLM的周末免费窗口先领了实测,Qwen3.8-Flash的1元输入值得进对照组。

  • 轻度日用、月预算一两百:最优解是体验卡和免费窗口轮着薅,暂时不用做任何迁移决定。

  • 手上有24G以上显卡:Qwen3.8-Flash-Next本地部署,把电费当新定价,云端模型降级为精修工具。

  • 在意隐私或接公司项目:避开一切"同意训练换低价"的Contributor模式,国产套餐里优先选有明确数据处理条款的方案。

大模型调用价格连跌两年后,这个夏天开始集体掉头——“OpenAI、谷歌、Anthropic也相继上调价格或收紧免费额度。过去两年持续走低的模型调用价格曲线,在2026年夏天开始集体掉头”。知乎对普通开发者来说,8月反而可能是今年最幸福的一个月:四家公司抢着送便宜窗口,而这种窗口期不会持续太久。先把账算清,再动手薅,9月见分晓。

内容由AI生成

精选参考来源

1. Deepseek涨价不算不知道一算吓一跳,之前一天就用两三个点的套餐额度,现在一天就干了20%。

2. 本来以为deepseek涨价不会有什么感觉,结果现在从一个月一充变成几天一充还消费降级到flash了

3. DeepSeek涨价12倍后的8月:智谱免费、阿里1元、腾讯770B——国产大模型打疯了

4. DeepSeek今天已经涨价了,大家用了吗,感觉如何?

5. 阿里发布Qwen3.8-Flash:1元/百万Tokens,大模型的“斩杀线”被重新划定了

6. 智谱GLMCodingPlan7天体验卡免费领!手慢无!

7. 大模型圈上演“榜一争夺战”:GLM-5.3-Flash结束免费期迅速退潮

8. 24GB显存+128GB内存,塞下Qwen3.8Flash94GB大模型:MoE把消费级显卡玩出新花样

9. mac上跑qwen3.8-flash能到50t/s!

10. 腾讯混元Hy4preview上线+测评速览

11. 腾讯Hy4 Preview开源,他说自己略胜K3

12. 薅羊毛!GLM5.3F三亿token领取攻略

13. 手慢无!GLMCodingPlan针对未订阅套餐的用户免费发放7天体验卡,每天限量10,000张

14. 如何看待GLM-5.3-Flash?

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章