最近半年,国内大模型订阅市场的剧情,基本可以概括为两个字:收紧。智谱把旗舰模型的购买从抢购改成直接购买,代价是价格翻倍;Kimi发布新旗舰模型Kimi-K3后,反而收紧了供应。知乎阿里云百炼的Coding Plan已经彻底停售。小红书DeepSeek官方调价之后,用户在opencode和open router集体反水,开发者社区里怨声载道。小红书就在这个当口,百度千帆却在8月14日推出了一个反向操作:Token Plan夜间调用,低至2折。
这事值得停下来看一眼。不是因为"打折"两个字,而是因为在整个行业都在把低价套餐往回拉的时候,突然有人把折扣开到了2折——这背后到底值不值得买,账得算清楚。
先说清楚:这次到底上线了什么
8月14日起,百度千帆Token Plan个人版与企业版同步开启「夜享Tokens加赠计划」:每日21:00至次日08:00,夜间调用低至2折。知乎
与此同时,DeepSeek-V4-Flash-0731也上线了千帆Token Plan:总参数2840亿、激活参数130亿,支持100万Token超长上下文,可在思考与非思考两种模式之间切换,9项Agent基准测试成绩全面超越前代预览版。知乎国际独立基准平台Artificial Analysis给出的智能指数为50分,比此前版本高出10分。

对订阅用户来说,变化很直接:不用额外配置,订阅之后就能直接调用这款新模型,并且叠加夜间2折权益。官方的说法是"同样的额度能跑更多轮前沿模型调用"。
Token Plan是个什么东西,凭什么值得聊
给不熟悉的朋友补一句背景:Token Plan是百度千帆今年7月中旬推出的订阅服务,定位是"个人的AI算力流量包",用来取代原来的Coding Plan。个人版有Mini、Lite、Pro、Max四档月度套餐,覆盖从AI新手到重度开发者的不同需求。知乎每天上午10点开放首购五折秒杀、每日限量,最低4.9元就能拿下1000万Token的调用额度。
它真正有意思的地方在计费方式上。Token Plan采用的是统一Token抵扣机制,不区分模型倍率、不区分输入输出、也不区分缓存命中,所有模型都按实际消耗的Token统一扣额度。知乎今年7月有位博主把国内10家AI Coding套餐的规则逐条对了一遍,给出的结论是:百度千帆是目前最直观的原始Token口径。小红书别小看这一点——同样标着"1亿"额度,有的平台指的是带模型倍率的积分,有的是Credits成本单位,换算下来差别巨大,买错单位等于隐性涨价。
另一个对重度用户很实际的改动,是取消了原Coding Plan的高峰期限流。Agent长链路执行、批量代码生成这类高强度场景,可以在套餐额度内稳定调用,不用盯着时间段干活。知乎模型池这边也比较全:ERNIE-5.1、GLM-5.2、GLM-5.1、Kimi-K2.6、DeepSeek-V4系列都在里面,一个Key可以来回切换,还兼容Cursor、Windsurf、Cline、Cherry Studio等10多种主流AI Coding工具和智能体框架,同时支持OpenAI和Anthropic两种协议——你现在用的Claude Code、Cursor工作流基本可以无缝接进来。

企业版则走的是另一套逻辑:轻享版、标准版、高级版、尊享版四档席位套餐,这次新增的尊享版面向高强度AI开发场景,支持成员管理、席位分配、用量分析,再配一个共享积分包灵活扩容。知乎说白了,个人版解决"我一个月要花多少Token"的问题,企业版解决"一个团队的钱到底花在哪了"的问题。
夜间2折到底值多少,分人
先泼一盆冷水:如果你的用法是白天坐在电脑前,用Cursor一行一行地交互式写代码,那这个夜间折扣对你基本没用——21:00到次日08:00的窗口,你大概率在睡觉。
但如果你手里有大量"挂起来跑"的任务,这笔账就完全不一样了。夜间窗口一共11个小时,占全天接近一半。Agent长链路任务、批量代码生成、夜间跑测试、大规模数据清洗和批量评测,这类对实时性不敏感的负载只要排到晚上执行,同样的订阅额度,实际能干的事接近翻倍。对于在跑多Agent工作流或者做批量测试的团队,这可能是目前主流订阅里最容易被忽略的一块"隐藏额度"。

再补一个大背景,解释千帆为什么敢在这个时间点降价。DeepSeek官方调价后社区反弹不小,但第三方渠道并没有跟着涨:两天过后,其他V4-Flash的提供方维持原有大概2块每百万输出的价格,并提供50%的折扣,提供方就包括streamlake、gmicloud和百度千帆。小红书模型厂自己定价的时代正在松动,"Token工厂"之间的竞争开始接管价格。
另一边,百度刚发布的二季度财报显示,AI云基础设施收入73亿元、同比增长50%。知乎其中GPU云同比增长283%,已连续四个季度实现三位数增长。知乎算力端有底气,订阅端才敢让利,这两件事是连在一起的。
当然,Token消耗这件事,永远比你想象的快。有用户在社区记录了自己从Coding Plan切换到Token Plan之后的真实消耗:写代码、改文案、跑分析,半天就干掉了1000万Token。小红书Agent时代的调用量是普通聊天的几十倍,"1000万"这个数字看着唬人,真跑起来几天就见底。
所以我的建议是从低档位开始:首购五折秒杀每天上午10点开放,每日限量发售,最低只需4.9元。知乎额度不够再升档,官方支持随时升档,比一上来囤个Max然后发现用不完要稳妥得多。
谁适合买,谁可以直接划走
适合出手的,大概是这三类人:一是夜猫子型开发者,手里有可以挪到夜间执行的Agent任务和批量负载,2折窗口就是纯收益;二是多模型切换用户,不想分别给各家充值,一个Key在ERNIE、GLM、Kimi、DeepSeek之间横跳,统一Token口径让每笔消耗都看得懂;三是被高峰期429限流、被"抢购式订阅"折磨过的人,不限流加每日限量秒杀的组合,至少把"用得上"这件事变确定了。
不太适合的也很明确:用量极轻的用户,一个月跑不了几次任务,蹲个4.9元首购当体验装就够了,没必要按月续;只认某一家模型的重度用户,比如只用GLM或者只用Kimi,直接去模型原厂订阅往往权益更聚焦;还有一类要特别提醒——套餐Key属于订阅专用Key,规则上只允许在官方支持的工具里交互式使用,拿去做自动化脚本、应用后端、非交互批处理,或者共享、转售Key,都属于违规,下单前想清楚自己的用法。小红书
至于要不要长期锁死在一家平台上,社区里有个说法我觉得挺中肯:大模型竞争现在太激烈了,3个月前某个模型还不错,3个月后就可能掉队。知乎所以不必执着于"选一家用一年",按季度甚至按月滚动评估,才是这个市场现阶段该有的姿势。
最后,留几个值得继续盯的信号
往回看,Coding Plan这个品类2025年9月诞生,到2026年3月,9家平台28款套餐打价格战,最便宜的7块9一个月,约等于不要钱。微博然后它就经历了限售、涨价、下架、集体转向Token计量,前后不到一年。靠补贴堆出来的地板价时代已经结束,下半场比的是谁能把价格和供给稳定地做下去。
接下来值得盯三个信号:一是夜间2折会不会从活动变成常驻权益;二是Token Plan的模型池上新速度,DeepSeek-V4-Flash-0731之后还有没有同级别的跟进;三是DeepSeek官方的定价调整会不会进一步传导到各家订阅套餐——如果传导发生,现在这波2折的含金量只会更高。
你手里的AI订阅每个月花多少,Token够烧吗?评论区聊聊你的账本。