微软把人均AI额度砍到十分之一、OpenAI把200美元档砍半:AI编程的无限量时代正在落幕,你的订阅续费该落在哪一档

源自116位全网作者

09:57

同一周里落了地的两条新闻,说的都是同一件事:钱。

10月5日,The Information报道,Meta和微软正在同步削减员工内部使用Claude;几乎同时,研究机构SemiAnalysis放出了一份对九家AI订阅套餐的逐Token实测,测出来的结论是:OpenAI在9月底已经把200美元档的用量砍掉了一半。The InformationSemiAnalysis
把这两条放在一起看,一个趋势就很清楚了:AI编程的「无限量时代」正在结束。企业端在收预算,订阅端在收补贴,而被收的,恰恰是「每天让AI写代码」的重度用户——也就是正在看这篇文章的你。

下面把三笔账算清楚:微软为什么受不了、OpenAI和Anthropic各自砍了什么,以及个人的续费到底该怎么定。尤其是OpenAI老用户,你的旧额度只保留到10月29日。

第一笔账:企业端——微软把人均AI额度砍到了十分之一

先说事实,都来自The Information的报道。

Meta这边,内部使用Claude Code的员工从年初约6万人降到了近期约3万人,砍半。一部分原因是春季裁员把7.8万人的团队砍了约10%;更大的原因是自家工具顶了上来——内部工具MetaCode用户已超3万,对标Claude Code的MuseCode有超过6000名员工在用,8月起已经开始找外部客户测试。微博

微软这边,管理层年初预计今年内部在Anthropic上至少花10亿美元,如今这笔预算已被砍掉超过三分之一,工程师被引导转向GitHub Copilot的命令行版本。微博
更狠的是另一个数字:微软云和AI部门有6万多人,此前每人每月可以在AI模型上花10万美元,最近多数情况下降到了约1万美元——十分之一。报道说,部分工程师对此有怨言,觉得不能再随意用模型了。The Information

人均每月10万美元听着夸张,但跑过Agent的人都知道这不是段子。微博上有博主国庆假期盘了自己的用量:5天烧掉近140亿Token,一边打游戏一边让Agent干活,一边看电影一边让Agent干活。The Information报道里那句话说得更直白:工程师一天让AI写几小时代码,消耗的Token很容易折算成上千美元。微博The Information

微软把人均AI额度砍到十分之一、OpenAI把200美元档砍半:AI编程的无限量时代正在落幕,你的订阅续费该落在哪一档

不过,把这个事件读成「Claude不行了」就跑偏了。两个反证要放在桌上:

一是微软企业客户通过微软平台购买Anthropic服务的支出仍在增长——收的是员工用量,不是客户生意;二是9月Nvidia、Palantir等公司收紧部分先进模型的使用,动机是担心模型厂商留存企业数据,跟成本是两码事。The Information
真正的信号是:当Agent把Token消耗推到过去的十几倍,没有任何组织能继续「额度无感」。微软的做法——设额度、设监控、引导转向更便宜的工具——其实值得每个个人用户抄作业。

第二笔账:根源——A16Z的数据说明,这笔账单谁也藏不住

无巧不成书,a16z在9月底刚更新了90多页的《市场状况II》报告,博主「数字生命卡兹克」国庆期间把它拆开讲了。里面有几组数字,正好解释了为什么大小公司都在这个季度集体收预算。

先看消耗端。OpenRouter平台的数据显示:今年2月起,Agent产生的Token已经超过人类直接聊天;到8月,Agent的七天平均日用量达到7.3万亿Token,一年增长14倍。周处理总量从2025年9月的4.7万亿涨到2026年9月的126.2万亿,同比27倍,今年6月到9月连续翻了两倍。微博

再看个人付费端,一个金字塔:AI付费用户的中位数只有25美元/月,但最顶部的1%平均每月花903美元,且这个数字18个月里又涨了80%。顶部1%的总消费(占19.5%)已经超过了底部50%的总和(16.6%)。

微软把人均AI额度砍到十分之一、OpenAI把200美元档砍半:AI编程的无限量时代正在落幕,你的订阅续费该落在哪一档

还有一个和编程党直接相关的结构差异:Claude的付费用户里,7.3%买的是100美元起步的Max计划,而ChatGPT和Gemini都只有1.3%——用Claude的人群,本来就是重度干活的那批人,也天然是账单最重的那批人。微博

微软把人均AI额度砍到十分之一、OpenAI把200美元档砍半:AI编程的无限量时代正在落幕,你的订阅续费该落在哪一档

a16z给这个现象挂的标签是「杰文斯悖论」:单位智能越来越便宜,总消耗却不降反升,连H100的租金都重新走高。对平台来说,这意味着订阅费「看起来赚钱」,实际越用越亏——这就引出了第三笔账。

第三笔账:订阅端——OpenAI明砍用量,Anthropic毛利率只剩6%

这部分来自SemiAnalysis的套餐实测。方法很硬核:不看宣传,一种Token一种Token地测,反复发请求记录进度条每跳一格消耗多少,再按API标价折算成「API等价价值」——同样的用量如果走API按量付费要花多少钱。测试场景就是编程Agent这类重度使用。SemiAnalysis

OpenAI侧的动作,9月29日DevDay前后官宣:

  • 200美元Pro档用量从Plus的20倍降到10倍,直接砍半;

  • 新增500美元档,独享每秒约300 Token的Ultrafast模式;

  • 但这个500美元档的顶配模型Astra,用量只比砍之前的200美元档多21%;

  • 改完之后,100、200、500美元三档每美元换到的Token一样多。此前200美元档补贴最重,每美元价值约是100美元档的两倍——现在,补贴没有了;

  • 老用户的旧额度保留到10月29日,之后续费按新规矩来。

所以对当下在200美元档之间挑的人来说,Claude给的量更多:SemiAnalysis实测,同为200美元档,Claude订阅折算价值约为OpenAI的5倍(按两家主推的中档日常主力模型对比,Anthropic的Opus 5.5对OpenAI的GPT-6.1 Sol)。顶配档差距不大——OpenAI的GPT-6 Astra用满约值2897美元,Anthropic的Fable 5.1约值2485美元,但Claude套餐里Fable最多只能占一半额度,用完这一半,另一半还能跑别的模型。<#&!53#&!>SemiAnalysis

微软把人均AI额度砍到十分之一、OpenAI把200美元档砍半:AI编程的无限量时代正在落幕,你的订阅续费该落在哪一档

先别急着得出「Claude更值」的结论。SemiAnalysis还算了一笔更扎心的账:订阅只占Anthropic收入约一成,却吃掉超过四成推理算力。假设用户平均只用掉两成额度,Opus 5.5订阅的毛利率约6%,顶配Fable 5.1约80%。SemiAnalysis

6%意味着什么?意味着这门生意数学上撑不了太久。Anthropic的减补贴方式是「越贵的模型给得越少」:Opus 5.5在9月22日发布后API价格降了两成、缓存读取降了六成,订阅额度虽然上调(Max档约多20%、Pro档约多50%),但仍不足以抵消降价,按美元折算,Opus订阅的价值其实比之前略低。SemiAnalysis测试时还发现,三个同款账号里有一个额度低了约20%,厂商确认那是一次「极小范围」的A/B测试——额度这东西,随时会变。SemiAnalysis

微软把人均AI额度砍到十分之一、OpenAI把200美元档砍半:AI编程的无限量时代正在落幕,你的订阅续费该落在哪一档

竞争层面还有个耐人寻味的细节:OpenAI负责Codex的Tibo承诺,未来28天每天要么上线一项改进、要么给全体用户重置额度。SemiAnalysis的判断是,OpenAI靠反复重置额度攒下的好感,已经让Anthropic几次收回了原定的限额收紧计划。SemiAnalysis
翻译一下:你现在享受到的量,处在两家补贴战的夹缝里。而夹缝迟早会合拢——OpenAI已经动手,Anthropic只是时间问题。

那个人怎么续费?三档人,三种打法

先立一个视角:别只盯「每美元多少Token」,要盯「每美元完成多少任务」。卡兹克在拆解里说得在理——便宜模型一旦陷入混乱或反复返工,Token消耗可能是强模型的几倍,单任务综合成本反而更贵。微软给员工设额度、做监控,本质上就是在逼大家算这笔账。

轻度档(月支出50元以内):这一档目前是国产套餐的甜点区。火山方舟Coding Plan Lite活动价头两个月9.9元(原价40元),2.5折活动到11月8日;MiniMax Plus年付折合约40.8元/月,直接标注每月6亿以上M3 Token,最容易算清用不用得完。两个纪律:不年付、不被首月价钩着自动续费——火山Pro档头两个月49.9元很香,第三个月回到200元时,要和GLM Lite(118元/月)、MiniMax Max重新比一次,不能顺着首月价一路续下去。知乎

日常主力档(20~200美元/月,每天让Agent改代码):被OpenAI砍量的朋友,10月29日旧额度到期前把账算好——之后200美元档只有一半的量。三个选项各有代价:降到100美元档,先测一周够不够;平移Claude的200美元档,当下量是5倍,但要接受Anthropic后续收紧的风险;真重度再考虑OpenAI新500美元档,但先算清那21%的增量值不值2.5倍的价钱。无论选哪个,建议抄微软的作业:给自己设一条月度额度线,超了就降模型档位,而不是超预算。

重度档(100美元以上/月、多Agent并行):按A16Z的口径你已经在顶部1%里,这群人平均月花903美元且还在涨。这一档的问题不是「贵不贵」,而是「赚不赚得回来」。两个可抠的细节:一是GLM Coding Plan改积分制后,工作日14:00~18:00算高峰时段,非高峰调用只按50%抵扣,长任务尽量排到非高峰;二是国产套餐写「支持Claude Code/Codex」,只是客户端能接入,背后跑的仍是对应国产模型——别按原版Claude的期待去付钱。知乎

顺带一句避坑:知乎有用户晒出自己前后被封了四个Claude账号(含20倍MAX和Pro),没有一个用超过一个月;中转渠道兜售的各种「稳定套餐」「上车位」,同样带着资金和封号风险。平台补贴越收紧,这类渠道越容易鱼龙混杂,主工作流别押在上面。知乎

接下来值得盯的五个信号

  1. 10月29日:OpenAI老用户旧额度到期,看砍价后的第一波用户流向,以及OpenAI会不会再出安抚动作——Tibo那个28天承诺就是前奏。

  2. Anthropic对Max档动不动手:6%的毛利率是迟早要面对的数学题,盯官方的额度调整和A/B测试频率。

  3. Meta MuseCode的外测进展:自研工具已经开始找外部客户,如果大厂自研工具批量商用,价格战会多一个玩家。

  4. 11月8日:火山方舟2.5折活动结束,看国产Coding Plan的价格带会不会跟着重排。

  5. OpenRouter的Token增速:只要Agent用量还在按倍翻,平台收补贴就会加速——这是上面所有账本的底层变量。

最后说一句。这轮补贴退潮对真正拿AI干活的人未必是坏事:它说明AI编程正在从「促销期」进入「常态商品期」,价格会更诚实,规则会更透明。无量薅羊毛的时代在结束,但把单任务成本算清楚的时代,才刚刚开始。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章