卖AI的公司,开始带头省AI了。7月起微软给各业务部门设了「AI Token预算目标」,还把内部默认模型换成了更便宜的GPT-5.6。36氪另一边,自己掏钱订AI工具的个人用户,账单也早就不淡定了,小红书上有开发者晒出「一个月到底要花多少钱?这笔支出到底值不值?」的认真盘点。小红书当连卖算力的微软都开始给员工限Token,你每月交的那笔AI会员费,到底有多少是白烧的?
从「烧Token算英雄」到全行业限流,只用了四个月
把时间线拉回去看,这波转向其实有清晰的拐点。今年3月,Meta、OpenAI的员工还在内部排行榜上比拼Token消耗量;5月亚马逊推出按AI使用量打分的KiroRank,结果员工开始让Agent跑低价值任务「刷榜」,月底排行榜被关停,高管专门提醒员工「请不要为了使用AI而使用AI」。36氪
但Token洪水已经漫过来了:Atlassian的月度AI支出一年内涨到原来的三倍、超过1500万美元;Uber到4月就烧光了2026全年的AI编程预算,随后给每人每工具设了每月1500美元的上限。36氪Citi要求按任务难度选模型,Adobe取消了员工对Claude的无限使用。共同解法只有一个:简单任务别再默认最强模型,能降级就降级。微软7月的预算卡死,只是这条链条上最后落下的一块——连卖算力的公司都开始像管其他关键资源一样管Token了。
你的账单,其实已经变了
别以为这只是大厂的内部管理学,个人用户的计费规则在同一时间被重写了。6月1日起,GitHub Copilot全面转向按使用量计费:月费不变,但订阅里包含的是与月费等额的AI Credits,用量按输入、输出、缓存的Token消耗,以所用模型的公开API价格结算。GitHub Blog翻译成人话:你烧多少钱,取决于你点了哪个模型。
这条规则的弹性,比很多人大得多。6月1日Copilot从29美元/月固定费改成按量计费后,第一个完整账单周期社区就晒炸了:知乎有人盘点「有人账单翻25倍」,小红书有人直接以「Copilot账单暴涨100倍」做标题。小红书知乎重度Agent用户更直观,有人晒出面板:Copilot这个月的账单已经1000刀了,一个工具一个月烧掉约7200元人民币,比很多人一年的订阅费都贵。小红书

功课一:默认模型,决定你账单的上限
把这些账单拆开看,最大的变量从来不是「用了多少」,而是「用了谁」。微软内部降本的第一刀不是砍用量,而是把默认模型换成更便宜的GPT-5.6,理由直白:比其他模型更便宜。36氪模型之间的价差,远比订阅档位之间的价差大:社区流传的一张每百万Token价格对比图里,顶级旗舰模型的输出价格要到46美元一档,而DeepSeek V4 Flash这一档在图上几乎贴地。

这也是Copilot按量计费里最隐蔽的税点:同样10美元月费,Credits的消耗速度取决于模型倍率,而GitHub官方对计费口径的说明只有一句——按各模型公布的API费率扣费。GitHub Blog默认Auto的时候,你甚至不知道今天这个任务被派给了哪一档模型,有用户吐槽:加钱让AI多想,一共几档没说。小红书
功课二:降级≠降质,官方数据已经画了线
很多人对「能降级就降级」的第一反应是:输出还能不能用?GitHub在6月的路由技术文章里给过一组可以直接抄作业的结论:跨语言评估中,智能路由的质量与英语基线的差距保持在4个点以内。GitHub Blog也就是说,把「无脑最强模型」换成「按任务选模型」,质量损失是个位数百分比,不是断崖。

更激进的是他们的HyDRA路由系统:在5个模型混跑的生产池里,按策略保守或激进,分别省下12.9%到72.5%的成本,激进档仍能平衡住质量。GitHub Blog翻译成人话:同一批任务,「派谁去干」这一步做对,账单能省一半以上,产出未必掉。

普通订阅用户,抄这三问就够了
大厂降本功课,落到个人账单上,其实就三步。先打开Copilot的usage页看两个数:这个月Credits被Agent会话吃掉了多少、哪个模型吃得最多——官方给路由系统定的原则同样适用个人:不是把每个任务都派给最大的模型,也不是都派给最便宜的。GitHub Blog
再问自己三个问题:输入结构是不是固定的(同一个仓库的日常补全)?输出有没有明确对错(能跑、能测、能核对)?失败了是不是容易发现、重跑成本低?三个都是「是」的任务,交给低档模型或Auto,省下的就是净利润;任何一个「否」的任务,比如架构设计、疑难bug排查,把最强模型留给它们。这和Citi内部的路数一致:按任务难度选模型,不要所有任务都用最昂贵的版本。36氪
如果你是轻度到中度用户,还有一条更直接的参考答案:知乎上有人问「每个月多少钱可以肆无忌惮使用大模型」,高赞回答是——70块,买一个opencodego套餐,选deepseek-v4-flash通过ccswitch接入Claude Code。知乎国产低价模型扛日常、旗舰订阅留在项目密集期再开,是眼下很多人算完账之后的现实路线。不想折腾也没关系,至少先做到一条:别急着冲更高档的Max计划,先看满两个月的真实账单再决定。
最后把微软内部邮件里那句话送给大家:我们的目标不是减少Token,而是提高每个Token带来的影响力。36氪它说的是公司,也说的是每一个按回车的人:该最大化的从来不是用量,而是你真正做成的事。接下来值得盯两个信号:一是Copilot会不会再调各模型的Credit倍率,账单入口8月3日刚停用Billing Preview、规则仍在调整。小红书二是微软正探索让Microsoft 365的部分AI请求优先调用自家MAI模型、而不是更贵的外部模型,若成真,订阅的性价比会被重新写一遍。