Codex向订阅用户开放“百万上下文”:3行配置解锁,但第一批用户半天就烧穿了配额

源自7位全网作者

04:57

8月17日,Codex产品负责人Tibo在X上发了一条帖子:GPT-5.6 Sol的百万级上下文窗口,ChatGPT订阅用户也能自己开了,方法是改配置文件里的三行。帖子发出来几个小时,论坛从"过年状态"变成了"兄弟们先别急"和"我额度怎么没了"。知乎我刷了一天知乎、微博和论坛,把第一批冲进去的勇士踩的坑归了归类:基本上是同一批三个坑。在你把那三行配置粘贴进去之前,值得先花三分钟搞清楚它们。

Codex向订阅用户开放“百万上下文”:3行配置解锁,但第一批用户半天就烧穿了配额

这次解锁的到底是什么

GPT-5.6 Sol文档化的上下文窗口是105万token,但这能力此前只开放给用API key接入的用户;订阅账号在Codex里拿到的默认窗口要小得多——没改这个配置的时候,GPT5.6模型默认的上下文是235K。知乎跑到上限后,Codex会把之前的代码修改、工具输出、调试日志压缩成一份摘要,再轻装继续干活。Tibo已经把改法写成了文档:可以通过修改配置的方式来将上下文支持100M。知乎具体操作是在用户目录下.codex文件夹里的config.toml最顶部、任何[section]标题之前加上三行配置,保存、重启、新建一个任务即可生效,用任意文本编辑器或IDE打开都行(Mac按shift+command+.显示隐藏目录)。

Codex向订阅用户开放“百万上下文”:3行配置解锁,但第一批用户半天就烧穿了配额

```toml
model = “gpt-5.6-sol”
model_context_window = 1000000
model_auto_compact_token_limit = 900000
```

Codex向订阅用户开放“百万上下文”:3行配置解锁,但第一批用户半天就烧穿了配额

第三行的意思是:跑到90万token左右才开始压缩历史。也就是说,在此之前,几十万的token家当每一轮都得一路背着。Tibo原帖里还有一句值得反复读的话:默认的上下文限制,是团队在性能和成本之间调到最优的值,这次只是因为问的人太多才写成文档。这句话,就是后面所有坑的伏笔。

第一批用户踩中的三个坑

第一个坑,额度掉得肉眼可见地快。根据OpenAI的计费规则,输入超过272K token的请求,整次请求的输入价格按2倍计算,输出价格按1.5倍——注意不是超出部分加价,是整次请求统一上调。知乎这是API侧口径,订阅账号的额度怎么折算官方没明说,但社区的体感反馈方向一致:开启百万上下文后token消耗速度大约翻倍,Plus用户的周额度可能一两个大任务就到限。开放当天就有微博用户晒出惨状:plus额度这就用完了,被逼着去看一个月700块的Pro。微博更何况Sol本身就比GPT-5.5更爱追加工具调用、拉起子Agent,同一个任务要多跑好几轮交互,消耗再往上放大一档。

第二个坑,变大的是记忆容量,不是它的脑子。知乎很多人以为百万上下文等于聪明好几倍,但OpenAI公布的MRCR v2评测数据:Sol在256K-512K区间准确率91.5%,512K-1M区间降到73.8%,下降接近20个百分点。知乎就像老板一次甩给你100份文件让你找一句话:文件都在你手里,但东西越多越容易找错重点。“记得住"和"找得准”,是两回事。

第三个坑,速度。上下文窗口越大,首token响应时间越长,满窗口请求下TTFT可能达到数秒甚至十几秒,和默认配置下的响应速度有明显差距。知乎论坛里也有人反馈,开到1M之后压缩次数确实少了,但Codex也开始变慢了。知乎这两件事不矛盾:一个是隔段时间收拾一次行李,一个是从头到尾拖着所有行李,都累,只是累法不一样。

谁该开:按任务配窗口

日常写个功能、修个Bug、改个页面,真的没必要每次都开着百万上下文。知乎默认配置的压缩不是缺陷:很多被压缩掉的"早期细节"本来就是噪声,遗忘在某种程度上是一种筛选,帮模型丢掉噪声、留下重点。

稍微复杂一些的大仓库任务,可以试试450K到512K。知乎这个区间的性价比通常比直接拉满舒服。只有真的需要保留大量原始日志、跨文件细节,或者准备让Codex连续干几个小时的任务,建议用命令行方式临时开启,任务结束后回到默认。知乎别一上来就把油门焊死。

两个补充。如果你中间套了中转站、OpenCodex、codex shim之类的第三方管理工具,配置可能被重新注入或覆盖,本地显示1M不代表中转服务端真的放行;最简单的排查是绕开所有中转,用官方账号直连、新建一个任务测试。知乎改完记得随便提个问题,然后使用/status命令,查看上下文占用情况——有人刚开就显示800多K,那是系统上下文占了100多K。知乎心里有数,才知道自己的额度是怎么没的。

Codex向订阅用户开放“百万上下文”:3行配置解锁,但第一批用户半天就烧穿了配额

两件没定论的事,和值得观察的信号

坦白说,有两件事现在还没定论。一是272K加价规则在API侧有官方口径,但订阅额度是否按同一规则折算,OpenAI没有公开解释,论坛里"超272K额度直接翻倍"的说法,在官方明确之前只能当经验参考。二是这波反馈之后,官方会不会重新调整默认窗口或额度策略——毕竟默认值是"调到最优"的结果,不是不能改的祖传参数。

但方向是清楚的:围绕上下文和额度的拉锯远没结束。过去几个月,一家延长旗舰模型试用、另一家就取消使用限制并重置全量用户额度的戏码已经上演了好几轮,一个拼命留人,一个疯狂松绑。Token不是无限免费的矿泉水,而是高峰限电时的空调:谁的供给被挤爆,谁就只能靠规则把需求削平。

社区早就用行动投票了。怕写嗨了超额度的用户,把M5Stack秒表直接改成了Claude和Codex的实体额度屏,上半屏Claude下半屏Codex,扫一眼就知道今天还能不能接着造。微博当一个工具需要硬件外设来帮人盯着花钱,当额度重置能让人"瞬间感觉赚到了",这套计费机制就已经不只是技术问题,而是每个订阅用户每月的真实账单问题。

长上下文肯定有用,前提是清楚自己拿什么换。粘贴配置之前,先问自己一句:手头这个任务,配得上好几倍的token吗?有人一天把codex从100%直接干剩了20%,第二天额度重置还觉得赚到了。微博这种日子,配置开多大,本质上是给自己的账单投票。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章