就这一周,四家全动手了。
10月7日 Anthropic 发布 Haiku 5.5,顺手给 Max 和 Team 订阅挂上了每月 API 额度;GPT-6.1 Sol 也在这几天上线;Copilot 官宣月底支持本地模型;10月9日字节的 TRAE 把 TraeWork 和 TraeCode 两条线合并成一个入口。模型和工具一起变,横评立刻刷屏,知乎这两天连着冒出「Copilot、Cursor、Codex 与 Claude Code,我究竟要为谁付费」「目前AI编程工具哪个最好用」这类新问题。微博
先说结论:「谁最强」这个问题本身已经过时了。一是跑分不准,二是工具已经趋同,真正要对表的,是你是哪类人。
先泼冷水:官方跑分和你的项目,测的不是一个东西
知乎上流传一份开发者实测:用2个月、25个真实 session、5万行代码做对比,结果排序和官方 benchmark 差了4位。原因不复杂——官方测试多是单文件、单函数、单 PR 的题,真实项目一次改动要动5到32个文件,跨语言,还带着历史包袱和内部术语。说白了:跑分测的是模型的上限,你的项目测的是它的下限。知乎
所以别把任何横评排序当付款依据,下面只说能自己验证的东西。
一年前那条「IDE vs Agent」的分界线,被三家自己抹掉了
去年的答案还很简单:Cursor、TRAE 是 IDE,你写代码 AI 在旁边帮;Claude Code 是 Agent,任务丢过去它自己干完再叫你。这一年里这条线被三家亲手抹掉了。Cursor 3 在4月加了专门跑 Agent 的 Agents Window,可以同时开好几个 Agent,那个界面里甚至已经看不到代码编辑器。Claude Code 出了桌面版和 VS Code 扩展,官方文档直接写着「No terminal required」;TRAE 把 SOLO 做成独立 App 又升级成 TRAE Work,手机网页都能给 AI 派活。知乎

现在三家都既能盯着改,也能整个交出去。真正分成两类的,是用工具的人:一类想盯着 AI 改的每一行代码,diff 不看完不放心;另一类想把活整个交出去,最后只验收结果。
自检方法特别简单:回想你昨天一天,是自己敲代码的时间多,还是描述需求然后看 diff 的时间多。前一种,补全更值钱;后一种,agent 更值钱。
想清楚自己是哪类人,工具就跟着出来了
「盯每一行」型,先看 Cursor。可视化是它的主场:AI 改了哪几个文件、每处改动长什么样,一眼看到,不满意选中让它重写,或者自己上手改两行,Tab 补全的手感目前还是最黏的。但价格要算清:Pro 每月20美元,里面的第三方模型额度也是20美元,Claude Opus 5.5 这类模型按官方 API 价格扣,长任务上下文一大,额度很快见底。有重度用户晒出过单月1275美元的超额账单。知乎还有高赞吐槽公司500美元的套餐额度不经烧。选它,就要养成看额度表的习惯,并接受月底可能被吓一跳。知乎知乎

「交活验收」型,主力在 Claude Code 和 Codex 里二选一。
Claude Code 的强项是长链路:完整需求丢过去,它自己读代码、拆任务、改文件、跑测试,中途不用一直盯着。Pro 档现在默认就是9月发布的 Opus 5.5,用量按5小时一个周期算,另有每周上限。花费有个官方口径可以参照:Anthropic 的成本文档10月初还挂着这组数——企业部署平均每个开发者每个活跃日约13美元,每月150到250美元,90%的用户每天低于30美元。订阅档要留意的是「撞墙」:额度吃紧会降速,跑着的长任务肉眼可见地变慢。知乎知乎

Codex 适合异步长任务和批量检查,每次跑完直接报 tokens used,账单透明;codex exec 能塞进脚本跑完即退,codex review 出的补丁直接 git apply 落地。但它有个隐蔽的固定开销:真正读文件花的是小头,每次开新会话都要重付的「前言」才是大头,光把环境和规则装进上下文就是几千 token。所以 Codex 的正确姿势是攒问题,别碎问。知乎
这两者的差别,本质是订阅制怕撞墙、按量制怕失控——你的花钱习惯决定哪个更适合你。
轻度用户、主要在 IDE 里小修小改的,Copilot Pro 就够了:它就是个插件,VS Code、JetBrains 装上就能用,不用换编辑器,补全不吃额度。注意它今年6月从按请求次数改成按 token 折算额度,同样10美元的订阅,重度用户能用的量变了。公司采购看 Business 档19美元/人/月、Enterprise 档39美元/人/月,额度组织内共享,管理员能给每人设预算。知乎
学生和零预算党,路线更清楚:TRAE 国内版练手成本最低——每天签到150积分、每月登录送500,内置17款模型免费档都能调。但注意,「TRAE 完全免费」的说法已经过时:7月底起改成按 token 扣积分的积分制,会员单月49元起,免费档没有 GPT 和 Claude。另一个选择是 OpenCode,MIT 协议、能接75家以上的 provider、自带免费模型,但它给的是选择权不是省心——把 provider 配明白,一个下午就没了。知乎知乎
两个一票否决项,比功能优先
第一是数据条款。公司代码先看隐私配置再看模型强弱:Cursor 有 Privacy Mode,开启后代码不会被拿去训练,Teams 档能全团队强制开;Claude 的 Team 和 Enterprise 档默认不拿你的内容训练。最重要的一条:别拿个人订阅跑公司仓库,真出了事是你自己背锅。知乎
第二是迁移成本。你习惯了一套工作流再迁走,那个折腾程度比每月差几刀大多了。所以选定一个就踏实用一个月,比刷十篇横评管用。知乎
最后说点比换工具更划算的事
四家现在都支持在仓库里放一个说明文件(AGENTS.md 或 CLAUDE.md),把代码风格、目录约定、测试命令写进去让 agent 先读。用过的人的共识是:这个文件写得好不好,对效果的影响比换工具还大——测试命令都没写的话,agent 只能瞎猜,产出的代码连自验都做不到。知乎
<#&!53#&!>
也别指望「装了就变强」。一位把五个工具都装过、用了四个月的开发者说得挺狠:这些工具只放大你本来就有的工作流,会拆任务的人用哪个都省,不会拆任务的换五个工具只是换五种烧钱姿势。知乎
顺便一提,多工具并存已经是常态:有横评引用 JetBrains《2025开发者生态报告》的数据,87%的开发者日常在用 AI 工具,59%的人同时开着3款以上。常见的省心配法是一个订阅制 agent 当主力,再配一个不吃额度的补全。知乎
还在犹豫要不要长期投入的,先拿 TRAE 练几个小项目。练手的过程里你会摸清自己是「盯每一行」还是「交活验收」型,等项目复杂到它搞不定了,下一步换哪个自然就清楚了。
最后提醒:今年各家价格变动非常频繁——Copilot 改按量、TRAE 改积分制、Claude Code 换默认模型和额度规则。文中数字都是10月上旬核的,付款前再去官网看一眼最新价格,这个动作比任何横评都靠谱。