当前位置:
AIGC文章详情

Claude Code 被疑“偷偷降智”,Codex 周活却破了 2000 万:Hacker News 151 条评论没吵出答案,但这三笔账算清楚了

源自100位全网作者

09:07

这两天 Hacker News 上发生的事,对 Claude Code 付费用户来说有点扎心:一边是 160 分、151 条评论的质疑帖,说 Anthropic 疑似在 Claude Code 里 A/B 测试"偷偷降低 effort";另一边,OpenAI Codex 负责人 Tibo 官宣周活突破 2000 万。Hacker News36氪同一时间,一个 Ruby 开发者写的《一周用 Codex 多于 Claude 的快速印象》挂在首页,116 条评论吵成了"AI 编程工具到底该怎么选"的现场直播。

我替你把这几个帖子、评论区、还有中美两边的数据都翻了一遍。结论先说:这不是"谁赢谁输"的故事,是"要不要换、怎么换才不亏"的问题。下面按顺序讲。

先辟个谣:Claude Code 没有"崩",但确实踩了刹车

中文社区这两天传得最凶的是"大量用户退订、神话破灭"。但对照数据,这个说法不准确。第三方追踪平台 TickerTrends 的数字显示,截至 8 月 10 日,Claude Code 的年化收入估算约 151.2 亿美元,四周增长 5.2%——注意,是增速降到个位数,收入本身还在涨。36氪今年 2 月它的年化收入还只有约 25 亿美元,四个月翻了五倍多,现在只是从狂飙切入了巡航。

Claude Code 被疑“偷偷降智”,Codex 周活却破了 2000 万:Hacker News 151 条评论没吵出答案,但这三笔账算清楚了

真正难看的是对比:同一套估算口径下,Codex 同期四周增长 20.8%,接近 Claude Code 的 4 倍。7 月初 Claude Code 的估算规模还是 Codex 的 2.4 倍,五周之后缩到约 1.7 倍。要说明的是,Codex 这边没有官方收入数字,是 TickerTrends 按 OpenAI 企业收入乘 45% 的假设推出来的,精度有限。36氪但趋势方向和 OpenAI 官方口径对得上——6 月 Codex 周活破 500 万,7 月底 Codex 加 ChatGPT Work 合计约 1000 万,这周直接干到 2000 万。

Claude Code 被疑“偷偷降智”,Codex 周活却破了 2000 万:Hacker News 151 条评论没吵出答案,但这三笔账算清楚了

还有个容易被忽略的细节:这 2000 万里不全是程序员。OpenAI 6 月披露,知识工作者已占 Codex 用户约 20%,包括分析师、营销、运营、投行人,这批人的增速是开发者的 3 倍。36氪所以"程序员正在抛弃 Claude Code"这个叙事本身就不成立——更准确的说法是:Claude Code 把最容易转化的程序员吃得差不多了,而 Codex 正在从 ChatGPT 这个巨大入口里拉新。

HN 那个 160 分的"降智"质疑帖,证据到底硬不硬

这是评论区吵得最凶的部分,我帮你把正反双方都摆出来。

质疑的起点是一条推文:有人直接问 Claude Code 当前的 effort 级别,模型报了个偏低的值,于是怀疑 Anthropic 在做"降本"的 A/B 测试。支持这个检测方式的人解释:effort 级别本来就是写在系统提示词里的,所以模型"知道"自己被设成了什么档。还有人说用 ccusage 这类工具查日志,发现明明只开了 Opus,记录里却冒出了 Sonnet。一位用户更直接,说自己原来是 200 美元档的订阅,昨天取消了,降到 20 美元档,只在 Codex 额度用完的时候才回来用一下。Hacker News

但反方的质疑同样值得听:effort 这种内部参数,模型自述未必可靠,“问它它就说"不等于真的被降档了。Hacker News而且 Claude Code 最近本来就在改版——8 月初 Auto 模式成了默认,8 月中官方还推了周配额促销,体验变化有很多正当来源,未必是"偷偷降智”。

我的判断:证据不足以坐实"故意降智",但足以说明一件事——订阅用户对"我付的钱换到的算力是不是变少了"这件事,容忍度已经到临界点了。HN 上还有一个 295 分、265 条评论的帖子专门讨论 Claude Code 的周配额规则,知乎上也同步出现了"简单任务跑几轮额度就掉光"的吐槽。知乎对做决策的你来说,重要的不是 Anthropic 有没有作弊,而是:你续费的性价比感知在下降,而对面正好在涨价期做促销。

那个换用一周的开发者,到底体验到了什么

这篇《一周用 Codex 多于 Claude》的作者 Lucian Ghinda 是 Ruby/Rails 开发者,他的 10 条观察我浓缩成四条,都是干货:

一是"性格"不同。他的原话是:Claude 会主动超额交付,猜你可能还想要什么然后直接做了;Codex 更像一个只干你交代的事的搭档,看到可能要收尾就停下。All about coding急活他还是下意识开 Claude——“不是它更好,是更熟”。

二是代码风格。Codex 写的 Ruby 代码注释少、架构克制;Claude 爱造抽象、加类型签名、写大段注释。这点直接引爆了评论区,成了整篇帖子最大的战场。

三是速度错觉。Codex 改代码确实快,但改完之后会反复跑测试、做 review,总时间没省。有人补了一句大实话:Codex 擅长的是"边界清晰的硬问题"——性能优化、搜索类任务、数学证明这种可以暴力循环验证的活。Hacker News遇到模糊需求,它的"过度防御"(给所有东西加校验、枚举、状态机)反而添乱。

四是 Codex 也翻车。他让 Codex 处理分支同步,结果它把三层分支关系 rebase 到了 main 上,生出一个 4000 多行的 PR。All about coding

评论区里最值得一看的是"注释战争"。有人贴出 Claude 典型的注释风格——“// add 返回 x 和 y 的和;// 根据 addition-implementation-plan.md 第 2.1 节……”——然后说"光读这注释就让我绝望,真该换 OpenAI 了"。最高亮的两条短评,一条是"注释少通常是坏事,但 AI 生成的注释少通常是好事";另一条更狠,说 Claude 假设人类以后不会再读代码了,它的注释就是写给下一个 Claude 看的。Hacker News这句话不管对不对,确实是今年 AI 编程圈最有解释力的一句黑话。

换工具不是免费的,这三笔账要算进去

第一笔是配置文件和生态。HN 上 374 分、219 条评论的帖子在呼吁 Claude Code 支持 AGENTS.md(多家 Agent 工具共用的说明文件标准),目前官方还没跟进。社区方案是做软链接,或者在 CLAUDE.md 里写一行"去读 AGENTS.md"——但有用户实测,Claude 会随机忽略这种间接指令。Hacker News反过来,OpenAI 8 月中旬上线了迁移工具,能把 Claude Code 的配置、技能"一键搬进 Codex",还开源了 Codex Harness。36氪两边的生态策略差异很明显:一个在筑墙,一个在拆墙。你在 Claude Code 里攒的 skills、CLAUDE.md、工作流,是真实的沉没成本,换之前先掂量一下能不能带走。

Claude Code 被疑“偷偷降智”,Codex 周活却破了 2000 万:Hacker News 151 条评论没吵出答案,但这三笔账算清楚了

第二笔是云环境的坑。本周 HN 有个 148 分的帖子:有团队在 AWS Bedrock 上跑 Codex,发现缓存读写比不到 5%,缓存写入极贵却从未被命中,账单直接飙到正常水平的约 10 倍。Hacker News帖子里给出的临时解法是在配置里关掉 web_search。如果你的团队正考虑把 Codex 接到 Bedrock 这类托管环境,这个 issue(openai/codex 仓库第 37674 号)值得先翻一遍再动手。

第三笔是订阅本身的算法。两边的档位都是 20 美元档和 200 美元档大致对应(以各家官网实时为准),200 美元档才有旗舰模型的完整配额。HN 上 20 美元档用户晒过自己的用量:周配额跑满大约每月 1500 万 token。Hacker News如果你是重度用户,真正要比较的不是"哪个工具好",而是"哪个档位的额度配得上我的工作流"——有公司用户已经直接给团队采购了 ChatGPT Pro 来跑 Codex,理由是"被速度震撼,像第一次用 Claude Code"。

所以,到底换不换?分三种情况

第一种:你是重度 Claude Code 用户,工作流里攒了大量 skills 和 CLAUDE.md,团队也用得顺。不用换。数据上 Claude Code 收入还在涨,企业端(Workato 统计里它占 AI 编程用量的 80%)地位没动摇,现在换的迁移成本大于收益。但你该做一件事:把自己的使用成本和产出记两周账,如果额度焦虑持续加重,再启动迁移不迟。

第二种:你本来就同时订阅两边,或者主要用 200 美元档。值得认真试一周。方法照抄那个 HN 楼主就行:挑两三个边界清晰的任务(性能优化、重构、写测试)交给 Codex,保留急活给 Claude,同时把 Claude 的 skills 文件夹指给 Codex 让它转换格式。一周后比三样东西:任务完成质量、总耗时、账单。

第三种:你在 AWS Bedrock 或类似托管环境跑 Agent,正在评估给团队上 Codex。先把缓存问题解决了再谈,不然 10 倍账单比任何效率提升都来得快。

接下来值得盯的三个信号

一是模型换代。OpenAI 手里有还没发布的 Astra,据称 Agent 编程能力有明显跃升;Anthropic 那边下一代模型的内部测试传闻也越来越多。36氪工具层的差距随时可能被模型层一次改写——这也是为什么现在押死任何一边都不明智。

二是 TickerTrends 下一期数据。看 Claude Code 的增速是个位数企稳还是继续下滑,Codex 的估算收入能不能兑现成 OpenAI 企业业务那 50% 的增长。36氪

Claude Code 被疑“偷偷降智”,Codex 周活却破了 2000 万:Hacker News 151 条评论没吵出答案,但这三笔账算清楚了

三是 AGENTS.md 之争。如果 Claude Code 最终跟进这个标准,换工具的成本会断崖式下降;如果继续不跟进,那就是它自己在替对手做迁移广告。

HN 上有人把订阅制 AI 编程工具叫作"献给阿尔吉侬的花束即服务"——能力是借来的,还随时可能被收回。这话刻薄,但对你我这样的付费用户来说,真正的应对方式不是忠诚,而是保持随时能走的姿态。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章