Token上货架39元起、5090炒到4万:这个9月,本地部署"装机省钱"的账被掀了

源自26位全网作者

09-08 07:32

9月3日,天猫"AI空间站"(Token充值中心)上线,首批挂牌阿里云、智谱、Kimi、MiniMax、DeepSeek五家大模型厂商,大模型第一次像话费一样摆上电商货架。红星资本局五天后,显卡日报的数据刷了屏:5090D 32GB版涨至38999元、24GB版24999元,双双刷新历史最高,不带D的5090现货四万元起步。显卡日报

这两件事本来各是各的新闻,但它们撞在同一个星期,把"本地部署圈"最经典的那句话——“订阅烧钱,不如攒台机器自己跑”——的账本掀了个底朝天。过去半年你大概率刷到过"235B随便跑""8G也能跑大模型"的帖子,心里盘算着双11凑个整机。现在先把计算器放下,看看9月的行情把这笔账换成了什么数字。

货架上的Token:标价、套餐、账单,是三回事

先看货架这边给了什么。智谱天猫官方旗舰店的订阅档位是月付:个人Lite 118元、Pro 538元、Max 1078元,团队版598元/席位(2席起购),套餐基于GLM-5.3,官方口径适配ZCode、Claude Code、Codex等20多个主流编程智能体。知乎阿里云同期的活动更激进:新客免费领100万Token,TokenPlan订阅39元/月起,全模型通享低至4.5折,覆盖Qwen3.8、Wan3.0等150余款模型。阿里云活动页

Token上货架39元起、5090炒到4万:这个9月,本地部署

Token上货架39元起、5090炒到4万:这个9月,本地部署

API按量这边也在透明化:GLM-5.3在Z.ai的定价表与5.2、5.1逐项持平,输入价$1.40/百万token。知乎DeepSeek V4Flash的缓存价被用户拎出来只有1毛/百万token。知乎注意,agent负载里缓存命中率能到九成以上,真实成本要看缓存行,不是看官网大字。

但"云便宜"的另一面,翻翻账单就知道:DeepSeek在8月17日给自家API做了峰谷定价上调,评论区直接吵翻。知乎智谱订阅被用户点名"严重超售,根本无法兑现token订阅"。知乎还有人吐槽API充值100块"什么都没做就没了",才52.4万上下文。知乎所以货架价只是入口费,套餐有配额墙,按量API的真实价格要到第一张账单才显形。这是看低价之前要先垫的一句。

攒机这边:三股推力把入场券抬成了"硬通货"

再看硬件。5090为什么从13500元的官方指导价一路炒到四万?把这轮涨价拆开,是三股力同时拧绳:需求端游戏玩家和AI开发者在抢同一批货——32GB显存的5090本来就是个人跑大模型微调/推理的"标准答案";供给端显卡产能被大客户锁单,零售货少;定价端两头需求都硬,官方没有降价动机。知乎

最能说明问题的细节是:英伟达今年3月PAX East、8月QuakeCon、9月5日PAX West连续三场展会搞"原价售卡",玩家要满场找一个穿绿衬衫的人、靠运气兑一张1999美元的5090。知乎官方要靠展会制造"原价存在过"的话题,恰恰说明MSRP在市场端已经名存实亡。国内行情更直白:5070Ti京东自营八千七起步,5080一万二到一万四,5090现货三万到四万还大部分是5090D特供版。知乎

Token上货架39元起、5090炒到4万:这个9月,本地部署

而且这轮涨价不只显卡。DDR5现货9月初涨停,内存条半年涨了数倍、固态硬盘翻倍——这意味着不止独显机,连过去被当成"平价入门"的128G大内存迷你主机也在变贵。知乎消费级Q3出货再砍15-20%,社区对行情的预期基本压在"27年下半年之前别看跌"。知乎

Token上货架39元起、5090炒到4万:这个9月,本地部署

三笔账:这笔钱现在到底怎么算

把两边数字拼起来,以2026年9月行情做静态估算(不含券、不含活动波动)。

账一,对标顶配套餐: 智谱Max档1078元/月,连续订37个月约3.99万元——一台5090D 32G的现价。要是用39元入门档,对标的硬件钱能订八十多年。"买卡回本"这条路在套餐口径下已经不成立。

账二,对标重度API账单: 知乎"本地部署划算还是买Token划算"那个问题浏览量近70万,高赞用户的实账是5个多月智能体烧了6千多元,约1200元/月——照这个强度,一台四万的机器要回本约3年。知乎而这笔回本的前提是你能接受27B档本地模型和云端旗舰的能力差,它是"降档回本",不是"等效回本"。

账三,别漏了电费: 5090公版功耗锁575W,解锁到1000W的双16PIN旗舰性能还能再高一截。知乎按0.6元/度粗算:每天跑4小时重推理约41-81元/月;7×24挂本地智能体的话约249-499元/月。也就是说,全天候本机比1078元套餐便宜,但比39元套餐贵一个数量级——"本地=免费"从电费这步就不成立。

Token上货架39元起、5090炒到4万:这个9月,本地部署

三笔账合起来一句话:云在用4.5折和39元往下打,硬件被AI需求往上抬,"为了省钱去本地"的账在2026年9月基本关死了。

但本地部署没死:它只剩三本和钱无关的账

价格账关了,另外三本账反而更清楚:数据不能外发的(客户材料、未公开稿件、涉密内容),一位测评博主对苹果新AI硬件的建议原话就是"除非模型已适配或数据不能外发,才值得当天买"。哔哩哔哩Token消耗焦虑的——有个人开发者晒过一次跨文件重构,6小时后收到账单:输入加输出烧了将近80万token,按新定价算这一天够交半个月房租。知乎这种负载本地跑完账单是0;以及要躲开限流、超售、峰谷波动的。这三件事货架再便宜也替代不了。所以"该不该本地部署"的问题没变,变的是答案的排序:以前第一问是"值不值",现在第一问是"你有没有非本地不可的理由"。

谁现在动手,谁再等等

  • 轻度、尝鲜用户:直接天猫领新客免费额度、上39元档试水,机箱侧板先别开。

  • 月账单上千的重度智能体用户:优先套餐+按量API双轨,先盯超售投诉是否收敛;用硬件对冲订阅风险,现在对冲成本太高。

  • 数据不能外发/离线刚需:卡该买还得买,但当固定资产看——32GB大显存卡这轮成了保值硬通货,社区共识是"别轻易出";务必走正规渠道,涨价行情里翻新卡、矿卡混进二手市场的概率暴增。

  • 预算受限的入门党:有人给出双二手5060Ti 16G压进9000元、且比5090好出手的路线,但多卡跑MoE档的实际体验要自己实测过再上车。知乎

Token上货架39元起、5090炒到4万:这个9月,本地部署

接下来值得盯的信号:英伟达会不会办第四场原价售卡(办得越多说明原价越假);Q4内存合约价是否掉头,那是128G大内存机回价的先决条件;Kimi、MiniMax、阶跃与天猫接洽的二期开店和首批套餐的真实兑付;以及"像充话费一样买AI"带来的搜索量暴涨40倍的热度会退到哪里。知乎这四个信号,比双11的加购物车更能决定你今年要不要装机。

(硬件能不能跑得动哪些模型的档位表,站内此前已有实测合集,本篇只算钱不重复。)

内容由AI生成

精选参考来源

1. 智谱、Kimi们布局电商卖Token:三大运营商没走通的路,大模型厂商亲自下场

2. RTX5090价格暴涨:四万元起步|显卡日报9月7日

3. 大模型集体上天猫开卖Token,普通人到底该不该买?怎么买不踩坑?

4. 阿里云大模型活动:新客免费领100万Tokens,搭配TokenPlan订阅方案低至39元/月起

5. GLM5.3API价格与接口详解:max规格比默认档贵出35倍

6. DeepSeekV4大幅涨价后,现在谁才是你心中的大模型性价比之选?

7. 怎么看DeepSeek8月17日涨价后的价格,这个峰谷定价你接受吗?

8. GLM5.3正式开源,有什么值得关注的亮点?

9. 如何评价GLM-5.3?

10. 如何评价此次显卡涨价?

11. 别等显卡降价了:涨价才是趋势

12. RTX5090卖到5090,梗都成真了,现在买显卡是不是疯了?

13. 内存涨4倍、固态翻倍、显卡溢价——2026年9月装机和买本的时机到底在哪儿

14. 内存和显卡的价格还会降价吗?

15. 本地模型部署划算还是付费买Token划算?

16. 供电竟成RTX5090DLSS5性能瓶颈,公版落后双16PIN5090闪电性能超过20%!

17. 苹果刚造出最好的本地AI硬件,但先别急着买。-Kai-中配

18. Astra的token个人开发者还撑得住吗?

19. 本地跑模型,买两张5060ti16g,是不是比买一张5090抢强?

20. 大模型上天猫卖Token了:“像充话费一样买AI”

21. 【2026可靠的电源】驾驭RTX5080/5090:1000W及以上电源推荐

22. 幸运还是不幸?索泰为用户RTX4090免费升级至RTX5090,原因竟然是……

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章