今天早上发布了一份调查,值得每一个关心"AI提效"的人认真看看。
JetBrains 发布了连续第十年的《2026年开发者生态系统调查报告》,覆盖全球超过 1.5 万名专业开发者,调查时间是今年 5 到 7 月。几个数字很扎眼:约 90% 的专业开发者每周至少使用一次 AI 编程 Agent,68% 每天都在用;Claude Code 的使用率半年翻倍,从年初的 18% 涨到 39%,反超长期霸榜的 GitHub Copilot 登顶(后者从约 30% 跌到 21%);Cursor 的工作场景使用率反而从 18% 掉到 12%,在国内市场从 28% 跌到 16%。36氪
只看这份报告,结论似乎是:AI 已经全面接管工作流,没用上的人该焦虑了。
但你再看看社区里这几个月的讨论,完全是另一个故事。
知乎上有个热帖,标题就是一场灵魂拷问:为何AI编程的速度远超人类,但是程序员利用AI编程的工作效率却只提升了30%而已?知乎另一个问题更直白:"为什么刚开始觉得 AI 编程很厉害,用久了就不行了?"高赞回答的原话是:明明每件具体的任务都在以 10 倍甚至 20 倍的速度完成,但整体就是快不起来。知乎
微博有条 1184 赞的帖子说得特别扎心:“看到 AI 提效,第一反应不是轻松,而是后背发凉。以前做一份报表要一下午,现在 AI 十分钟搞定。本以为能早点下班,结果老板说:既然效率提高了,那今天再追加两份分析吧”。微博
还有更狠的。有人在公司写了份 AI 使用复盘,“它用赤裸裸的数字表明,AI 工具让我的工作效率降低了。在一家将人工智能应用作为战略重点的公司里,这样的文件根本不应该存在”。知乎
一边是 90% 的采用率,一边是"只快了 30%"“感觉更累了”“工时没减少”。到底谁在说谎?
答案是都没说谎。我对照了几组硬数据和全网几十个亲历帖,发现这个悖论比想象中更真实,而且原因能说得清清楚楚。
先看三组互相"打架"的数据。
第一组:AI 评估机构 METR 在 2025 年年中发布的随机对照试验。16 位资深开源开发者,用 246 个真实 Issue 做实验,结果是用上 AI 工具的开发者平均慢了 19%,95% 置信区间 [-40%, -2%],统计显著。知乎更扎心的是:参与者在实验前预估 AI 能帮自己提速 24%,做完实验后依然坚信自己快了 20%。“我感觉我很猛,实际上我慢了”——这个感知与现实的错位,可能是整个研究最重要的发现。

第二组:微软研究院在微软、埃森哲和另一家世界 500 强做的三组随机试验,4867 名开发者参加。用上 AI 编程工具后,开发者完成的任务数量平均增加了约 26%。知乎
第三组:知乎热帖《AI 写了 60% 的代码,为什么企业研发效率还是没飞起来?》里的高赞算术:写代码本来就只占软件开发总工作量的 20% 不到。知乎
三组数据,三个方向:资深开发者端到端完成任务慢了 19%,普通人任务吞吐量涨了 26%,而 AI 真正能提速的环节只占整体工作量的不到 20%。看起来矛盾,拼在一起其实严丝合缝。
效率去哪了?三个去向。
第一个去向:算术天花板。那个 20% 是关键。写代码的环节就算快上一倍,对整体的贡献也就 10% 左右;剩下 80% 是需求理解、方案设计、联调、测试、评审、维护——这些环节 AI 还没怎么提速,有的反而变慢了。写材料的职场工作同理:成文时间从一下午缩到十分钟,但对齐口径、修改逻辑、过审的环节一步没少。
第二个去向:成本从"写"转移到了"审"。METR 在论文里自己给了解释:用 AI 写代码的本质,是把"写"的成本转移到"审"的成本上,审查成本大于写作成本,总账就是亏的。知乎社区里佐证很多:有人在"现在还有人坚持古法编程吗"的问题下说,自己"调试和阅读 AI 代码的时间增加了 120%"。知乎还有个更根本的问题被反复讨论——AI 天生擅长局部优化、临时修补、绕过障碍,多人协作的项目里,它产出的可能是技术债,而技术债是复利滚的。这就是为什么用得最深的人往往体会最复杂:单点都快了,整体要收拾的东西反而多了。
对策社区其实已经摸出来了:别让 AI 猜,把规则提前写进项目文档。现在主流的 Agent 工具甚至把这做成了内置功能,一条 /init 命令,就能生成一份 AGENTS.md 项目说明文件,把规范、命令、禁区一次性交代清楚。

第三个去向:省下的时间被组织收走了。这是最扎心也最少被讨论的一条。30% 那个问题下有回答说得透:“本来瓶颈是编程,如今编程是快了,但在公司里,员工间的协调还是瓶颈”。知乎单环节提速,其他环节不动,总产出不变;更麻烦的是,组织考核不变的话,提效的果实会直接变成更高的产出预期。报表十分钟搞定?那再做两份。小红书上《用 AI 把 12 人裁到 3 人,效率提升还是陷阱?》有 1496 人在评论区吵翻。小红书游戏行业还出现了"推行 AI 提效后,策划开始加班赶工期"的真事,从业者吐槽:“提效提效,时间砍得多那叫增加工作量,砍得少那才叫提效”。知乎
所以效率并没有蒸发,它只是被换算成了更多任务、更高预期和更复杂的善后。
那怎么办?当然不是不用。90% 的人不是傻子。真正该调整的是投入方向。看了一圈深度用户的复盘,被反复验证有效的就三件事,而且都不是"让生成更快":
一、把精力投给上下文,而不是提示词。用 Agent 辅助科研的高赞文章说得很透:AI 产出的瓶颈不是提示词不够长,而是它缺少"研究目标、数据约定、分析流程和验收标准"。知乎写代码是把 CLAUDE.md、PROJECT.md 这类项目文档写清楚,做办公室把需求单和验收标准写明白再交给 AI。这些不写清楚,AI 就用猜的,你事后花的时间更多。

二、把精力投给验证,而不是生成。既然成本瓶颈在"审",就尽量让机器替你审:自动化测试、验收清单、双模型交叉核对。有媒体今天评论另一条新闻时说:AI 走进生产,考验的是体系能不能接住。36氪个人的体系,就是你的验证资产。
三、换一把尺子。判断 AI 到底有没有帮你,别看单点动作快不快,看整件事的交付周期有没有缩短。前者提升、后者没动,说明瓶颈已经搬家了,你的资源也要跟着搬过去。
最后说几句大实话:
如果你是干活的人,别焦虑工具排名。半年前头部还是 Copilot,现在是 Claude Code,Cursor 工作场景已经在掉——榜单变得比学习速度还快,追是追不完的。真正增值的,是你围绕自己业务攒下的上下文和验证资产。
如果你是定考核的人,这份报告其实是个提醒:当 90% 的人手上都有 Agent,按代码量、文档量计件的老办法正在快速失效。接下来比的不是谁的工具新,是谁先改流程。
如果你还在观望,可以盯一个信号:你所在的团队什么时候开始讨论"用了 AI 之后流程该怎么改",而不只是"谁在用 AI"。前者出现,才是真提效的开始。
这一轮竞争的分水岭,不是谁用上了 AI,而是谁先想明白:效率不是工具跑出来的,是工作流设计出来的。