这周提效圈最火的问题,不是"怎么用好",而是"我是不是被偷偷降级了"
9月16日,一条微博在Codex用户里传得很快,三个省略号里全是体感:20x Pro全网断货、订阅没恢复、用的人都觉得被降智了。点赞不算高,但评论区全是同病相怜的人。微博
这不是个例。把这几天各平台的讨论摆在一起看,它已经是一场成规模的"降智风波":
9月9日,B站UP主DP发布《GPT-6 Astra大规模降额降智》深度解析,播放3.6万、评论1223条。一个技术视频能吵出1223条评论,本身就说明积压了多少焦虑。哔哩哔哩
9月12日,每秒上千token的高速模型Codex-Spark被宣布下周停用,从上线到退役只活了7个月。哔哩哔哩
9月15日,OpenAI首次正面回应账号限制问题,“Selected model is at capacity”(所选模型超出容量)的报错从零星变成全天候。哔哩哔哩
9月17日,B站视频《GPT-6降智,路由GPT-5.6-luna铁证如山》冲到2.8万播放、348条评论。同一天,知乎出现了专门的问题:你最近用Codex有遇到降智或额度消耗异常快的情况吗?哔哩哔哩知乎
9月18日,有人晒出工单申诉成功,标题却写着"我以为从牢房出来了,结果又进去了"。哔哩哔哩

用Codex做周报、做选题库、甚至非程序员拿它干活的人已经不少,但这个月大家共同的体感是:活儿没变,模型变笨了,额度变紧了。
问题是:降智到底是不是你的错觉?额度烧得快,是模型的事还是你自己的事?在决定补额度、换工具还是继续等之前,这笔账值得拆开算。
先分清:三种"降智"根本不是同一件事
把全网反馈归类后,"Codex变笨了"其实混着三个来源完全不同的问题。不拆开,怎么修都是白折腾。
第一种:模型侧真的被"换了芯"——但官口径不承认
社区最硬的"证据流"是指纹检测:有用户反馈,付费调用GPT-6后,响应里返回的模型指纹是luna或5.5。也就是说,你以为买的是满血,实际被路由到了小模型。知乎
值得注意的还有反馈的分布:吐槽降智最集中的是国区账号,最夸张的"降成luna的赶脚"。知乎
但要注意证据边界:"官方主动降级"目前只是社区基于响应指纹的判断,OpenAI自己没承认过。官方的口径是另一套:即使付费订阅有效,某些模型或功能的访问权限也可能因账户活动被暂时受限,系统会自动重新评估,影响可用性的活动停止后权限恢复;至于判定标准,官方称无法提供更多详情。知乎
同期流出的一个对照实验也有参考价值:同一账号直连时正常,放进第三方转发通道后立刻变差。这说明"变笨"至少有一部分发生在通道层,而不是全在OpenAI的机房里。哔哩哔哩
第二种:算力短缺引发的大范围限流
DP那条1223条评论的视频,核心结论指向同一个根因:GPT-6 Astra上线后算力供不应求,官方升级风控、收紧额度。外部表现就是20x Pro停止新订阅、存量额度消耗异常快、全天候at capacity。
这里有个背景值得知道:8月30日,OpenAI刚给Codex和ChatGPT Work付费用户做过一次"集体回血"的重置补偿。Codex负责人Tibo当时的表态也记录在案:产品没做好就补偿。36氪36氪
所以这轮风波里"等官方修好再发补偿"不是玄学,是有过先例的——知乎那条高赞回答甚至提前写好了剧本:等算力不紧张了,Tibo就会出来说解决了某个Bug,现在好了。知乎
第三种:其实是你自己的上下文在拖后腿
小红书上有篇2891赞、4502收藏的帖子,观点正好对着干:感觉智商不够,可能不是模型问题,而是你的上下文、缓存和工具配置正在拖后腿。它给了4个设置:小红书
把固定的项目规则、AGENTS.md放prompt前面,让缓存吃满,别重复付上下文钱;
长任务定期让Codex清理失效方案、重复日志和无关历史,或直接新开会话;
别装一堆用不上的MCP和Skill,工具越多上下文负担越大;
别频繁切模型、切目录、切配置,稳定才能持续复用缓存。

知乎《Codex为什么突然胡言乱语了》描述的典型症状也对得上:一个小问题改了十几个文件,只是让它修个Bug,最后连目录结构都给你重构了。这更像上下文失控,而不是模型降级的专属特征。知乎
顺带辟一个民间偏方:微博上有人宣称"听信了说中文导致降智,改成全英文对话"。目前没有任何证据支持语言影响路由——对照实验指向的是通道和账号状态。别为了玄学牺牲表达精度。微博
花10分钟,按这个顺序自诊
三种原因对应三条完全不同的处理路径,所以先诊断、再花钱:
Step 1|验指纹:跑一次社区在用的"鹈鹕测试",这个测降智的小工具这周被腾讯科技报道了,开源项目is-gpt-nerfed也会逐轮检查响应里是否在你没改设置的情况下换了模型、降低了推理级别。或用固定任务比对响应里的模型标识与报错字段。出现at capacity或指纹明显不是订阅模型 → 属于第一/二种,往下看Step 2;正常 → 跳到Step 3。哔哩哔哩微博
Step 2|分通道:同一账号、同一任务,直连跑一遍、中转通道跑一遍。直连正常而通道变差 → 换直连,问题结束;两条路都异常 → 提工单申诉(这几天已有申诉成功恢复的案例,虽然有人反映"放出来又关进去"的反复),这个阶段不建议花钱补额度——你的账号本身在受限状态,补了也可能用不出来。
Step 3|清上下文:按小红书那4条设置做一轮瘦身——固定规则前置、清理无关MCP、压缩会话、稳定配置——再复测。明显回血 → 降智是错觉,改的是习惯不是工具。
三本账:谁该等、谁该动、谁先别掏钱

存量20x Pro用户:等,但留证据。你们正处风暴中心,但断货状态下想加钱都加不了——连做AI资讯产品的博主都公开喊话"最近我的Codex额度,已经烧到我有点用不起的程度了"。别去第三方溢价收额度,这周"白嫖XX刀额度"的教程不少,转发通道恰恰是对照实验里最容易出问题的环节,省下的钱可能赔在返工上。申诉入口走官方工单,把模型指纹记录截好。微博
没订到/想入坑的人:现在不是买入窗口。新品停售、存量不稳、老型号还在退役(Codex-Spark仅存活7个月就是前车之鉴:模型层的"高速通道"说关就关)。刚需的话,先用免费档或按token计费的API干单线程的活——AgentsAPI公测时官方口径明确:Harness托管不额外收费,开发者按实际使用的模型Token和工具付费。烧多少看得见,反而好算账。36氪
有交付压力的重度用户:别再单押一个harness。B站一条328赞视频的玩法值得抄:额度总是不够用,就让ChatGPT负责思考和规划,Codex专心执行,把"想"和"干"拆开。单个模型降智不至于全线崩盘。运营、律师这类拿Codex当办公主力的人尤其如此——你们省下来的其实是别人的排期,工具冗余度就是交付确定性。哔哩哔哩

继续盯三个信号
订阅是否恢复开放:20x断货帖说的"订阅至今还没恢复"是最新状态,放开日基本就是算力缓解日;
官方是否复制8月30日的"回血"动作:有先例在,这次补偿的力度和形式值得对比;
"luna路由"的说法有没有第二方实锤:目前指纹证据来自社区单点,如果更多独立测试复现,性质就从"体验问题"变成"消费欺诈争议",那时候该说的话和现在不一样。
最后说句实在的:算力短缺时代的"降智",最贵的损失从来不是那些被路由掉的token,而是你在没诊断清楚之前,就替模型背下了这个锅、或者替焦虑开了这个包。先花10分钟自诊,再决定掏不掏钱。