今天(8月26日)是OpenAI给Assistants API划定的关闭日。微信还在依赖这套接口的应用,今天起调用就会失效。五天之后还有下一刀:8月31日起,ChatGPT登录态的Codex将不再提供GPT-5.4。这一轮退役不是零散的版本清理,而是一串排好队的时间节点,而且每一刀都切在真实的生产链路上。这篇文章把时间线、影响范围和迁移到GPT-5.6的成本账一次说清,照着过一遍,基本能判断自己要不要动、什么时候动、动的话账该怎么算。
一、退役时间线总表:五个节点,两个已经贴脸
日期 | 事件 | 影响对象 |
|---|---|---|
2026-07-23(已发生) | 15个模型快照一夜下线,Codex品牌API模型全部退役 | 写死旧快照名的生产代码 |
2026-08-26(今天) | Assistants API关闭 | 依赖assistants接口的应用 |
2026-08-31 | GPT-5.4 / GPT-5.4-mini从ChatGPT登录的Codex下线 | 用ChatGPT账号登录Codex的用户 |
2026-10-23(社区梳理) | GPT-4、GPT-4o、GPT-3.5 Turbo、o1、o1-pro、o3-mini、o4-mini集中退场 | 仍跑在4o / 3.5 Turbo上的生产系统 |
2026-12-01 / 12-11 | 旧GPT Image模型、旧GPT-5与o3快照移除 | 图片生成与旧快照调用方 |
7月23日那次已经给所有人演示过后果:OpenAI一口气下线了15个模型快照,其中最扎眼的一条:所有Codex品牌的API模型全部退役。微信还在直连这些端点的代码当天就开始报错,不是降级,而是硬失败。下一波大的在10月23日:GPT-4、GPT-4o、GPT-3.5 Turbo、o1、o1-pro、o3-mini、o4-mini将集中退场。微信需要说明,这个日期目前主要来自社区对第三方退役日历的梳理,是否还有调整,迁移前要以官方弃用页为准。再往后,旧GPT Image模型将在12月1日移除,较旧的GPT-5与o3模型快照将在12月11日移除。微信
二、急迫分级:谁这周必须动,谁可以等到十月
第一档是今天就要收尾的:所有依赖Assistants API的应用,窗口已经到头,剩下的工作是评估替代接口和改造量。第二档要在8月31日前动手:OpenAI在2026年7月31日的Codex更新日志中确认:8月31日起,GPT-5.4和GPT-5.4 mini将不再向“使用 ChatGPT 登录的 Codex”提供。<#&!53#&!>微信官方给出的替代关系是GPT-5.4换GPT-5.6 Terra,GPT-5.4 mini换GPT-5.6 Luna。什么值得买社区
第三档可以排期,但要立项:还跑着GPT-4o、GPT-3.5 Turbo生产系统的团队,窗口到十月。社区里有开发者分享过教训:之前用GPT-4o的时候月费用控制在600美元以内,升级到新一代之后直接翻了快五倍。知乎迁移不是改个名字那么轻,这笔账后面细算。
也有一类暂时不用动的:GPT-5.4系列仍保留在OpenAI API接口中,直接调用API的用户和用自己API密钥认证的Codex会话,不受这次Codex调整的影响。什么值得买社区不过“这次不受影响”不等于永久可用,10月那波同样会波及还停在老模型上的调用。
接班的GPT-5.6是三档分工:官方模型文档把Terra定位为日常工作主力,把Luna定位为适合定义清楚、可重复、高频工作的模型。微信下面这张7月上旬整理的中文定位表,可以作为认识三档的起点,表中价格是发布时的口径,7月30日调价后是多少,下文重新算。

三、迁移成本账:换到GPT-5.6,不一定更便宜
先看发布日三档的定价:以每百万token计算,Sol输入5美元、输出30美元;Terra输入2.5美元、输出15美元;Luna输入1美元、输出6美元。微信发布日的官方三档定价卡如下。

但发布不到一个月,官方价格就变了:7月30日,OpenAI就把Luna的输入价格从每百万token 1美元降到0.20美元,输出价格从6美元降到1.20美元,Terra同步降价20%。Sol的标准价格保持不动,却新增最高提速2.5倍、收费翻倍的Fast模式。今日头条也就是说,上图里的发布日定价,现在只有Sol还成立。
对还跑在GPT-4o上的团队,最反直觉的一点是:平替未必省钱。按公开价格口径,GPT-4o每百万token输入2.50美元、输出10.00美元。知乎Terra的输入比4o便宜0.5美元,输出却贵了2美元。拿一个常见量级算账:每月100万次调用,平均每次1000输入token、500输出token,跑在GPT-4o上每月约7500美元;换Terra约8000美元,反而贵了约7%;换Luna约800美元,能省近九成。输出占比越高的业务,越容易在“升级”里吃亏。照着官方映射直接搬、不算自己业务的输入输出结构,很可能把账单越迁越贵。
四、省钱杠杆和一个限时半价窗口
选型成本要按单任务代价算,不是按单价算:模型选择应综合考虑任务从开始到完成的全部成本:运行轮数、工具调用次数、返工频率、人工复核时间。什么值得买社区36氪降价报道里的Artificial Analysis模型成本与能力散点图能说明这一点:Luna落在低价区间,它的价值不只是便宜,而是把过去因成本跑不起的高频任务,变成工作流里的常规步骤。用OpenAI自己的定位说,这是把支撑Agent干活的模型,卖到过去简单小模型的价位。今日头条

换到新模型后,最直接的省钱杠杆是提示缓存:对于GPT-5.6及更高版本的模型,缓存写入费用按模型未缓存输入费用的1.25倍计费,而缓存读取费用继续享受90%的缓存输入费用折扣。微信系统提示、长文档前缀这类重复内容多的场景,收益最大。
另一个维度是计费档位:OpenAI的官方价格表已经同时区分标准、批处理、弹性和Fast模式,还区分短上下文、长上下文、缓存写入和区域数据处理。今日头条不需要实时返回的批量任务,排进批处理通道就行,别为用不上的实时性付钱。
还有一个正在进行的限时窗口:8月17日,OpenRouter宣布GPT-5.6 Sol调用费用下调50%。今日头条Vercel也宣布限时半价,优惠持续到9月18日,OpenRouter暂未设限。什么值得买社区
不过这个半价有两个前提。其一,折扣仅适用于非BYOK(自带密钥)请求,即通过平台路由OpenAI提供商的流量方可享受半价,自带Key仍按OpenAI原价计费。今日头条其二,这次折扣只发生在OpenRouter和Vercel AI Gateway两个平台,不包括OpenAI官方API,也没有同步到Azure、Bedrock等其他渠道。知乎
对正在迁移的团队,这个窗口最适合干的事是回归测试:更稳的做法是建立自己的评测集,把真实PR、历史Bug、文档生成、测试补齐、SQL修复、数据分析脚本等任务抽样出来,对不同模型和不同网关跑同一批任务。知乎趁半价把候选模型跑一遍,9月18日促销结束后,手里才有做决策的数据。
五、避坑清单:迁移路上最容易翻车的四件事
第一,别把模型名写死。7月23日的批量退役已经证明:任何还在生产环境直连这些端点的代码,当天就会开始失败——不是降级,是硬失败。微信模型引用尽量走别名或配置,给系统留一条能平稳降级的路。
第二,迁移时别只改模型选择器。7月31日更新日志明确列出workspace defaults、saved model settings、managed configurations、custom agents和scheduled tasks。微信加上项目脚本里的显式指定,一共有六类入口要逐个排查,其中定时任务最容易漏,因为它不会立刻报错,只会在下次触发时安静地失败。
第三,切换模型后必须回归测试。官方映射只给方向,不给结果等价的保证,至少核对配置回显指向新模型、退出状态正常、输出能被下游解析;无人值守的任务,建议多观察几轮再全面切换。
第四,迁移完记得把默认配置也翻一遍:reasoning retention(保留推理过程)和compaction(上下文压缩)这两个开关在官方文档里,默认是关闭的。今日头条有转述OpenAI技术博客的文章称,两个开关一起打开后,GPT-5.6在ARC-AGI-3基准上的成绩翻了三倍,提升幅度来自单一二手转述,不同任务的实际收益自然会有差异,但至少说明:换新模型后沿用默认配置,可能只拿到了它的一部分能力。
六、值得继续盯的三个信号
一是官方弃用页的更新。社区梳理的10月23日、12月11日这两个大波日期,来自第三方退役日历的汇总,OpenAI官方deprecations页是最终准绳。微信排迁移计划以官方页为准,别只信二手梳理。
二是半价窗口结束后的价格走向。有分析机构指出,若半价促销令Sol在这两个平台的用量翻倍,外界可能误读为市场份额的变化,而这一判断可能并不反映真实的市场格局。今日头条9月18日促销退场后,Sol的实际调用量回落多少、OpenAI是否跟进官方调价,能看出这轮价格战的真实水位。
三是Fast模式的扩散。官方表示,这轮调整也会进入Codex和ChatGPT Work。今日头条用双倍价格换最高2.5倍速度,对延迟敏感的场景值不值,值得按自己的业务单独算一次时间账。
长期看,一个常被忽略的动作是建一份模型资产清单,把项目里所有调用的模型名、调用位置和弃用状态列成表。模型alias本来就是为这种滚动升级设计的,但前提是你得在截止日前主动改,而不是等它404。微信退役潮不会停,清单在手,比每次断服后满世界搜代码省事得多。