这个夏天,AI编程订阅打得比电商大促还热闹。DeepSeek 8月17日正式执行峰谷调价,一批按量付费的老用户连夜搬家;智谱、Kimi、阿里百炼、火山方舟、腾讯、京东云、三大运营商,前后脚把"Token Plan"端上桌,社区里的横评帖已经卷到把10家平台的官方价格页逐条对比。小红书
但热闹背后,评论区吵得最凶的不是谁家便宜,而是:为什么同样标着"1亿Token",有人用得飞起,有人三天就见底?
答案不在价格,在口径。最近把十家平台的官方价格页、额度规则和社区实测对了一遍,发现这套订阅游戏里藏着三道坎,下单前不问清楚,省的钱全会变成学费。
第一道坎:你看到的"亿",可能根本不是Token
这是最容易翻车的地方。同样写着大数字,计量单位可能是四种完全不同的东西:
第一种,原始Token。调一次模型,输入输出多少Token就扣多少,所见即所得。百度千帆Token Plan目前就是这个口径——官方明确"不再区分模型倍率、输入输出或缓存命中",所有模型按实际Token消耗统一扣减。个人版四档,Mini每月1000万、Lite约4200万、Pro约2.3亿、Max约7亿Token。
第二种,积分/Credits。腾讯TokenHub今年7月把套餐计量改成了积分,同一个套餐换个模型,输入、输出、缓存的系数可能完全不同——标着1亿积分,跑出来的Token数要打个问号。小红书Step(阶跃星辰)官方写的是"1M Credits≈¥1",Credits更接近成本计量单位,也不是Token。火山方舟Agent Plan的"燃料值"同理,要拿系数换算两次才能估出大概的Token单价。小红书
第三种,调用次数。智谱老套餐写"约80 Prompt/5h",听着不多,但官方估算1个Prompt通常会触发15—20次底层模型调用,它和别家"6000次/5h"根本不在一个分母上。小红书
第四种,视频秒数、生图张数这类混合额度。有些套餐把文本、图片、视频额度塞进同一个"量包",看着量大,实际能用在写代码上的没多少。

所以比价第一步不是比数字,是先问一句:这个套餐的计量单位,到底是原始Token,还是带系数的积分?社区里那份流传很广的10家横评,结论第一条就是这个:最容易踩坑的不是"买贵了",而是把不同单位当成同一个东西。小红书
第二道坎:同样是Token,倍率和时段还在暗处加价
就算单位统一了,也不代表每一笔消耗等价。两个常见的暗扣:
一是模型倍率。不少平台按模型设不同倍率,旗舰模型1次调用扣2倍、3倍额度,输入输出缓存各一个系数。你以为买的是1亿,主力模型一跑,实际可用量直接腰斩。字节方舟社区口碑不错,但连推荐它的博主都要提醒一句:不同模型倍率差异大,实际可用量需按常用模型估算。知乎
二是时间窗口。DeepSeek这次涨价就是典型:高峰时段(9:00-12:00、14:00-18:00)V4 Flash输入¥3/百万Token、输出¥9/百万Token,闲时打对折。小红书价格本身不算离谱,但复杂到连帮用户算账的博主都要感叹"无法简单说到底涨价了多少"。知乎有用户吐槽,本来白天摸鱼跑跑AI一个月三十来块,调价后"一早上就给我干了一半预算"。
反过来的玩法也有:百度千帆8月14日起搞了个"夜享Tokens加赠计划",每晚21:00到次日08:00共11小时,GLM-5.2、DeepSeek-V4-Flash-0731等指定模型按2折消耗,个人版企业版全量生效。按开发者测算的Lite档口径,夜间折算单价能压到每百万Token一毛钱以内。小红书把白天舍不得跑的长任务挪到夜里,确实能省下一大截。

但要泼盆冷水:注意"指定模型"四个字。夜间2折不是全模型通用,刚Day0上架千帆的GLM-5.3目前走的是API和企业版通道。知乎看任何折扣权益,先翻权益细则里的模型清单,比看标题折扣数字重要得多。
第三道坎:比价格更贵的,是限流、补扣和可用性
这道坎不写在价格页上,全写在吐槽帖里。
最狠的是京东云:有用户囤了它家TokenPlan,先是遭遇"之前扣点扣少了,现在要补扣",理由是算法出错;接着五小时和周限额全部拉满,直接被"强平";后来连GLM-5都连不上了,最后只能关掉自动续费走人。知乎
限流也是重灾区。阿里百炼有用户买了139元档测试,“睡了一会醒过来一看rate limit了”。MiniMax用户吐槽Max档"天天算力短缺,模型又贵又卡"。智谱为了抢购体验把新套餐改成"不用抢但价格翻倍",Kimi则在K3发布后收紧供应,有对比测试实测,K3切换后其月度可用量已降至约28M。知乎
这里有个很多人忽略的账:可用率也是成本。失败请求、重复上下文、Agent链路重跑,每一次重试都在烧Token。单价再便宜,调用链经常返工,总成本未必低。有开发者拿千帆Token Plan连跑100次同样的代码任务,可用率99%。知乎晚高峰实测GLM-5.2生成速度86.7 TPS,对面按量计费的平台是61 TPS——当然这只是单人实测,样本有限,但至少说明"套餐=慢"的刻板印象不成立。千帆这次升级还取消了原Coding Plan的三层滑动窗口限流。知乎套餐额度内不再卡5小时、周限额,对跑长链路Agent的人是实打实的减负。
所以,到底该怎么选?
给三个下单前必问的问题,当checklist用:
一问单位:额度是原始Token还是积分/Credits?换算成你主力模型的单价再比。
二问窗口:有没有5小时/周限额?有没有峰谷差价?你的使用时间段正好落在哪个区间?
三问边界:套餐Key是不是"专用Key"?这类订阅大多只允许在官方支持的IDE、CLI、Agent工具里交互使用,明确禁止自动脚本、应用后端、非交互批处理,更不能共享转售。小红书想拿套餐Key当通用API用的,趁早死心,买按量。

对应到人群:
轻度尝鲜、先跑通流程:各家入门档+首购优惠就够。千帆个人版每天10点有首购五折秒杀,最低4.9元拿1000万Token,试错成本很低,缺点是限量,要抢。知乎
日常主力是写代码/跑Agent的中重度用户:优先选原始Token口径、无时间窗限流的套餐,夜间能跑任务的再把夜享2折用起来。
从DeepSeek按量迁移的用户:如果你习惯白天干活,注意DeepSeek高峰时段正好覆盖白天工位时间,包月套餐的确定性更强;如果你本来就在夜间跑批量任务,DeepSeek闲时半价+缓存折扣依然能打,不必急着搬家。
企业采购:看席位管理、用量分析和发票流程,千帆企业版四档席位+共享积分包是标准打法,GLM-5.3这类新模型Day0接入企业版也算加分项。知乎

最后说句大实话:这个赛道规则变得极快,今天是折扣,明天可能就是限购;今天不抢购,明天就翻倍。下单前去官方价格页复核一遍,永远比相信任何一篇横评(包括这篇)更靠谱。
你家主力是哪家的套餐?踩过什么口径的坑?评论区聊聊。