国庆假期里,AI编程圈最好看的戏不是新模型发布,而是OpenAI当众立了个"军令状"。
美东时间10月4日,负责Codex和ChatGPT Work的Thibault Sottiaux(圈内都叫他Tibo)在X上放话:接下来28天,每天要么上线一项多数用户能明确感知到的改进,要么给全员来一次额度完整重置。微博

这话一出,中文社区直接过年了。有人顺手把办公室氛围本土化:凝心聚力大干二十八天,攻坚克难抢占AI高地!有人开始连载《今天起,Tibo可能要连发28个重置?!》。还有人翻出旧账——Tibo的照片甚至被人P成了小丑。"重置哥"这个外号,现在比本名还响。微博微博微博
有位被Codex折磨出后遗症的网友说得最传神:现在跟真人聊天,都怕对方突然蹦出来一句"5小时限额已用完"。微博
先别光顾着乐。这份军令状已经进入交付阶段:第1天兑现了,兑得挺实在,也挺有讲究。而它背后还压着一份刚出炉的实测数据,那份数据才真正决定你这个月的AI编程月费,该不该继续留在OpenAI这边。
第1天交付核验:提速50%是真的,但一分额度都没动
美东时间10月5日,Tibo公布第一项改进:通过ChatGPT订阅使用GPT-6 Astra和GPT-6.1 Sol,默认速度提升约50%,用户不用改任何设置,两小时内生效。军令状立下的第一天,承诺至少在形式上兑现了。微博
拆开看具体数字:默认档输出速度从每秒30个token提到50个。对这个数字敏感的人会意识到它的实际价值——Codex原本有个"快速模式",速度换代价,额度按标准档的2.5倍消耗。现在不切模式也能快一截,等于把过去要多付2.5倍价钱才能买到的速度,直接塞进了标准档。这波交付的真金白银,是省下了快速模式的溢价。微博

覆盖面也不窄:OpenAI自家全系产品,外加通过"用ChatGPT登录"接入的第三方工具——OpenCode、Pi、Amp、Devin都在内,这是9月29日DevDay上线的能力。如果你平时就是在第三方工具里烧Codex的额度,你可能是这次军令状第1天受益最大的人。微博
但也要看清楚:这次交付没碰额度结构的任何一条——倍率没加、5小时窗口没动、7天周期额度没变。速度是全体用户都能感知的东西,完美贴合"对多数用户有用的改进"这个承诺口径,又不用付出额度成本。考题第一天,答得相当有技巧。
为什么偏偏是现在立军令状:一份新实测把压力摆上了台面
背景大家都熟:9月29日DevDay前后,OpenAI把200美元Pro档的用量从Plus的20倍砍到10倍,新增500美元档,独享每秒约300 token的Ultrafast模式,老用户的旧额度保留到10月29日。DevDay现场,官方甚至自己玩起了"Reset Co.(重置公司)“的梗。过去几个月,每当用户骂额度,Tibo就大手一挥全员重置,社区早就习惯了"骂归骂,等重置”。微博微博
但这次不一样,因为军令状前后,半导体研究机构SemiAnalysis甩出了一份很狠的实测。
他们把Anthropic、OpenAI等九家的订阅套餐一个一个token地测:反复发请求,记录进度条每跳一格用掉多少token,再按API标价折算成美元。结论是:在日常主力模型上,同样200美元,Claude订阅折算出来的额度价值约是OpenAI的5倍。微博

差距不在顶配。200美元档用满,OpenAI的GPT-6 Astra约值2897美元API用量,Anthropic的Fable 5.1约值2485美元,差不太多。区别在于Claude套餐里Fable最多占一半额度,另一半还能跑别的模型。真正的鸿沟在中档主力位:Anthropic的Opus 5.5对OpenAI的GPT-6.1 Sol,这一档Claude各套餐价值约为OpenAI的5倍。就算承认Sol的API单价本来就便宜、按美元比不完全公平,SemiAnalysis换成纯token数量对比,Claude仍然领先一大截。微博
还有个更狠的细节:砍完之后,OpenAI的100、200、500美元三档,每美元换到的token一样多——而之前200美元档是补贴最重的,每美元价值约是100美元档的两倍。也就是说,这轮砍额度实际上把Pro用户原来占的便宜"拉平"了。至于新500美元档,Astra用量只比砍完的200美元档多21%,值不值,你自己算。微博

华尔街见闻把话说得更直白:这是"真实的产品危机"——Claude Opus 5.5不仅能力更强、额度还更耐用,GPT-6.1 Sol价格砍到对手五分之一都没扳回口碑。评论区用户一针见血:28天改进里要是没有一个能打过Opus 5.5的模型,其他都白搭。微博
签到奖励还是知耻后勇?先看清这场信任危机
争议其实在军令状之前就摆上了台面。SpaceX AI GrokBot团队的Lauren Tan发了张"Hype与Quality"对比图,颇有挑衅意味地直指OpenAI,Tibo迅速回应,一来一回吵到了所有人眼前。重度用户的失望更具体:DevDay时许诺20项新功能,发布之后额度变少、模型变慢,被寄予厚望的GPT-6.1 Sol纸面性能漂亮,真干活时速度仍逊Claude一截。36氪
Tibo此前还发帖宣布OpenAI已经"锁定方向",接下来只做四类事:简化产品、提高效率、突破性功能、新模型。但军令状一出,评论区最高频的问题只剩一句:这次值得相信吗?微博36氪

质疑派的声音很有代表性:这不就是AI版的每日签到领奖励,跟游戏厂商被骂了就发补偿礼包一个路数,先把重度用户哄回来再说。也有博主点出关键:这是一份承诺,不是已经交付的28项功能。而"完整重置"到底是什么意思、覆盖谁,Tibo到现在也没解释。微博微博
务实派的角度反而清奇:对那些天天把额度用光的重度用户来说,这军令状几乎稳赚——上新了,体验变好;交不出作业,全员重置额度,等于官方发粮。微博上真有人晒出国庆战绩:“好消息:1天之内,赶在tiboreset之前用光了codex额度”,坏消息是这20倍额度的Astra并没有实质性推进项目。你看,额度焦虑里有多少水分,这条微博全招了。微博微博
SemiAnalysis则从第三方视角揭了底:OpenAI此前多次重置额度攒下的好感,是Codex最近用户猛涨的原因之一,甚至逼得Anthropic几次收回了原定的限额收紧计划。翻译一下:重置是OpenAI最便宜也最有效的留客工具,而军令状等于把这个工具公开化、日程化了。微博
再往深一层是经济账。SemiAnalysis估算:订阅只占Anthropic收入约一成,却吃掉超过四成的推理算力。假设用户平均只用掉两成额度,Opus 5.5订阅的毛利率约6%,Fable 5.1约80%。所以两家其实都在减补贴,只是路子不同——Anthropic动刀子,越贵的模型给得越少;OpenAI动铡刀,所有模型一刀切。微博
看懂这层,你对军令状的预期就该校准了:提速、界面、工作流这些外围体验,Tibo可以天天发;但额度上的结构性慷慨,动的是两家的毛利率,28天签到大概率签不回来。还有位博主的解读更长远:以天为单位推新功能救不了基础模型能力,"28天后"可能才是Tibo预期中重大更新的落点,军令状是他给自己上的公开鞭策。微博
28天追踪清单:每天三问、盯住三个日期
如果你是正在付钱的Codex订阅用户,这28天是个罕见的"公开可验证"观察窗口。给你一套具体的追踪方法。
每天只需问三个问题:
当天的更新,动额度结构了吗?(倍率、5小时和7天窗口、重置范围)
动模型能力了吗?新模型、Sol档大升级、上下文限制都算。顺带一提,GPT5.6明明支持1M上下文、Codex却只给用272k还不允许用户调整,这个问题在知乎被顶了好几天。知乎
如果都没动,那就是提速类外围交付,打个卡就行,不用激动。
三个日期要标在日历上:
10月29日:Pro老用户的旧额度(20倍)到期,10倍新额度全面接管。那时军令状刚好走到第25天,OpenAI有没有诚意基本看得清了,这天实际上就是你的续费预演日。
11月1日前后(Day 28):军令状终点,也是社区猜测的"重大更新"落点。
你自己的扣费日:如果落在28天之内,恭喜,你续费时手里有一份完整的交付记录做依据。
分人群的当下动作:
拿Sol当日常主力跑量的:5倍价值差是结构性的,别指望签到签回来。可以现在就开始混合配置——知乎上有人问codex是不是已经超越claudecode了,高赞回答说得实在:各有胜场,难题给一家、跑量给另一家,工具党别站队。把这28天当免费对比试用期。知乎
顶配Astra用户:顶配档两家折算价值差不多,不用急着动,安心享受提速。
第三方工具用户(OpenCode/Pi/Amp/Devin):第1天就吃到红利,目前是这次军令状里最舒服的一批人,观望即可。
天天把额度用光的:你盼拖更就好。上新你体验变好,交不上作业全员重置,横竖不亏。
最后补两条大背景,帮你校准预期。一条在企业面:The Information10月5日报道,Meta内部用Claude Code的员工从年初约6万降到3万,微软把计划中给Anthropic的超10亿美元支出砍掉三分之一以上,工程师每月AI预算从10万美元直接压到1万。连大厂都开始给AI编程的账单算细账,个人订阅的"慷慨期"整体在退潮。微博

另一条在商业面:ChatGPT推出全新视觉广告格式,10月晚些时候将在美国启动测试。订阅的账算不平的时候,广告的账就该上场了。微博
这28天,等于OpenAI当着所有人的面做一场"留客实验"。作为用户,最好的姿势不是站队,而是把每天的交付都变成自己续费决策的证据。
你在盯军令状的第几天?你觉得"重置哥"这次会掏真家伙,还是28个签到礼包?评论区聊聊。