最近关注AI编程工具的朋友应该能感觉到,社区里最热的问题悄悄换了一轮。
四五月份,大家还在到处问“Codex和Claude Code到底选哪个”,B站那条《用了三个月Codex,我不想回Claude Code了》播放超过32万,标题本身就在制造站队。哔哩哔哩
但从六月开始,高赞帖陆续换了方向。小红书上一条《Claude和Codex怎么一起用?》的提问拿到1.87万赞、2.7万收藏。小红书B站最新的Codex保姆级教程播放量冲到226万。哔哩哔哩分工经验帖从六月一路更新到八月,就在四天前,还有人在转一位海外工程师一周深度对比后的10条实战结论。小红书
社区共识基本收敛了:这不是单选题,是分工题。今天把散落在小红书、知乎、B站的分工玩法一次性捋清楚,顺便算一笔账:你到底需不需要同时为两个工具付钱。
问题为什么从“选谁”变成“怎么分工”
三个原因。
第一,两个工具的能力边界高度重叠。小红书上一篇1030赞的新手向帖子说得很直白:两者都能做网页、App原型、小工具、代码修复,都能开权限接管电脑干重复活,也都支持MCP和Skills,会一个,另一个基本触类旁通。小红书
第二,性格差异是真实存在的。四天前被热议的那份海外工程师对比里有个说法挺传神:Codex克制,“你说啥它做啥,做完就停”,代码注释少、更干净,速度快一点但收尾较真,会反复跑测试;Claude Code更像同事,会揣摩意图、自动多干活,主动性更强,但有时添乱。小红书
第三,也是最现实的:额度都不够用,钱包都会疼。Claude Code从每月20美元的Pro起步,重度用户要上100美元甚至200美元的Max,国内用户还得叠加封号风险。小红书Codex并进了ChatGPT,免费账户也有额度,Plus每月20美元,官方还经常重置额度。哔哩哔哩知乎
第一派:按任务分工,最常见
流传最广的一份分工模板是这样的:传统工程活给Codex——CRUD、管理后台、权限系统、数据库接口、老项目维护,这类活要的不是惊艳,是稳定、完整、能落地,需求拆清楚之后Codex推代码、补逻辑比较稳;短板是“UI能用但不好看”,界面要单独再调。小红书前沿探索活给Claude Code——Agent工作流、产品原型、UI交互、复杂提示词设计,第一版完成度通常更舒服。

还有一种更狠的主从打法:Claude Code当主控,Codex只做试错。复杂需求、陌生仓库、交付收口走Claude Code一条主线,先读上下文、拆计划再一路推进;Codex专门去跑两三个备选方案、验证脚本、做独立分支实验,拿到结果收回主线,绝不让试错位直接接管项目。小红书
这两种玩法的内核是同一句话:主线只留一个。双持最大的翻车方式,就是两个工具轮流推进同一件事——上下文碎了,token烧得飞快,最后你都不知道谁在负责。
第二派:写审分离,一个写一个查
这个玩法被多篇帖子独立验证过,逻辑类似那句老话:自己写的代码自己查,顺着同一个思路走,盲区三遍都看不出来;换一个Agent来验收,视角不一样,问题反而一眼能看到。
一套典型的五步流程:Claude Code先出修改方案,人工确认后实施代码、跑测试;再让Codex独立审核,追踪逻辑、找Bug、识别边界情况和高优先级风险;然后由人判断审核意见是否成立,确认无误再合并提交。小红书

也有人玩交叉组合:Codex写、Claude Code查;或者Claude Code出架构方案,Codex负责落地。里面有个关键细节值得抄:聊天记录和md文件都留在本地,切换Agent时直接让新的那个读本地文件,不用写交接文档——文件本身就是上下文。小红书
但要提醒一句:写审分离适合复杂、高风险、影响面大的改动。只是改个文案、调个按钮,别上全套,那是把简单活做复杂。
第三派:其实不用双持,省钱
这可能是对多数人最实在的一派。很多分工帖的作者本身就是双订阅用户,他们的前提是“已经都买了”。只有一个订阅的人,玩法完全不同:在单个订阅内按任务切换,主力活交给订阅的模型,试错的活让对方家的免费额度去跑;或者像不少国内玩家那样,把DeepSeek、GLM这些模型接进开源客户端,把成本压到最低。知乎知乎上一个“用AI编程每个月花费多少”的提问下有个很典型的对照:有人一个月在各种coding plan上烧掉3080元,也有人的回答是,最顺手的那家一个月只花19块。知乎
双持成本账:最低每月约280元
说说钱。Codex跟着ChatGPT订阅走,Plus每月20美元(约140元),免费账户也有部分额度;Claude Code要单独订阅,Pro每月20美元,重度要上100到200美元的Max,国内用户还要把封号风险和支付渠道的折腾算进去。
双持的最低配置是ChatGPT Plus加Claude Pro,每月约40美元,折合人民币280元上下;Claude升到Max档,每月轻松过千甚至到1500元以上。还有一笔隐性成本别忘了:分工没想清楚就双持,其中一边的订阅基本在吃灰。

参考一个企业侧的数据:据金融时报援引支付平台Ramp的统计,Anthropic最贵的旗舰模型发布两个多月后,在企业AI工具总支出里只占约11%,更便宜的Opus系列在支出上已经反超旗舰。36氪狂热一年多之后,企业客户的结论是“95%的能力、一半的价格”更划算。个人其实同理——先想清楚自己的活儿到底哪里需要顶配。
三类人,三个动作
最后给三个可以直接对号入座的动作,仅供参考:
刚开始观望的:别双持,选一个。预算敏感、想低门槛入门,从Codex开始,ChatGPT自带、免费额度能先试水;有IDE经验、要啃复杂重度需求,再考虑Claude Code。
已经订阅了一个的轻度用户:先别急着买第二个。用对方的免费额度,把你主力工具干不好的任务跑一两周,确认真的互补,再加订阅。
重度、有交付需求的:可以双持加写审分离,但记住主线只留一个,另一个做试错和审核;5分钟能改完的小活直接在IDE里改掉,别开Agent。
最后留两个观察信号:Claude家的新模型Opus 5.1被曝本周发布。36氪消息称其主打编程能力和长时间运行的Agent能力,如果属实,Claude这一侧的上限还会抬一抬,但分工逻辑不会因此失效——分工分的是任务属性,不是跑分。新模型落地后,拿你日常的活儿跑一周再决定要不要迁移额度和订阅,比抢首发更稳。
别再争谁更强了。真正贵的从来不是订阅费,是每周都在重新搞明白一个工具。