最近开发者社区的风向有点一边倒。打开知乎、B站的 AI 编程话题,隔三差五就是《当 Copilot 开始掉队》《Cursor、Claude Code、Copilot,谁才是真正的第一梯队》。一边是"还值不值得续"的灵魂拷问,另一边,GitHub 在八月悄悄密集上线了一整批东西:独立 App、CLI 正式版、SDK 正式版、Plan Agent、沙箱、BYOK——两边说的像不是同一个产品。
今天把这事捋清楚。如果你是 Copilot 个人订阅用户,或者公司已经买了 license,建议看完这篇再决定换不换工具。
"掉队"要先拆成三条线看
真正掉队的只有一条线:Agent 心智。这两年会用 AI 的开发者,用法正在从"帮我补全这一行"变成"替我把这个任务跑完",而这一波声量被 Claude Code 和 Cursor 拿走了。行业里流传 Claude Code 的 ARR 到了 25 亿美元、Cursor 估值突破 500 亿美元(这两个数字都出自博主汇总,没有权威披露,当个热闹程度的参考)。还有博主统计,Copilot 在 AI 编程工具里的份额从 42% 滑到了 37%。知乎这些判断听着刺耳,但方向是真实的:在"AI 独立干活"这件事上,Copilot 确实不是大家第一个想到的名字了。
没掉队的有两条线。一条是企业侧:Copilot 付费订阅用户早已突破 200 万。微博GitHub 官方企业案例里的口径依然漂亮——55% 任务加速、67% 代码审查提速。知乎官方宣传嘛,打个折听,但起码说明企业盘子没有跑。另一条是平台侧,这就是八月有意思的地方。
GitHub 八月到底上了什么:一张全景图
1)Copilot App:独立的桌面应用。 以前 Copilot 只活在你的编辑器里,现在它有了自己的家:一个叫 “My Work” 的集中视图,可以同时挂多个 Agent——一个在排查生产 bug,一个在处理 PR Review,一个在搭新模块的脚手架,互不打架。知乎最近还加了堆叠会话和拉取请求管理。翻译一下:AI 从"打字助手"变成了"异步同事",你不用盯着它干活,回来验收就行。

2)Copilot CLI 正式 GA。 终端原生的编码 Agent,支持多步工作流。核心是两个挡位:Plan 模式让它先出方案给你看,Autopilot 模式让它自己跑构建、跑 git 命令。不想开 IDE 的场景(服务器上改东西、跑脚本、自动化任务)终于有着落了。
3)Copilot SDK 正式 GA。 支持 Node.js、Python、Go、.NET、Rust、Java 六种语言。这个对个人开发者感知弱一点,但它意味着你可以把 Copilot 的 Agent 能力嵌进自己的工具里——内部 CI/CD 助手、文档机器人、自动审查流水线,不用从零搭编排层。
4)Plan Agent:把 Issue 直接指派给 AI。 这是四个里面最实用的。像给同事派活一样,把仓库里的 Issue 分给 Copilot,它在独立沙箱里读代码、定位文件、修改、跑测试,最后提一个 Draft PR 等你审。小红书补测试、修小 bug、改文档、清技术债这类边界清晰的任务最合适。云端 Agent 用哪个模型、推理强度拉多高,官方也开放了自定义。GitHub

一句话总结:Copilot 正在从"编辑器里的插件",变成一套"你可以调度的 AI 开发团队"。连办公 IM 都没放过——八月下旬 Copilot 还进了 Microsoft Teams 和 Slack,支持在群里共享 Agent 的工作进展。GitHubAutomations 也能用评论直接触发。GitHub骂它掉队的人和夸它进化的人,其实用的是它的两个不同侧面。

模型货架也换了
八月还有个容易被忽略的变化:Copilot 里的模型越来越像"超市"了。
8 月 11 日微软发布自研编程模型 MAI-Code-1.1-Flash,直接在 Copilot 全平台上线。GitHub价格砍了约 73%:输入从每百万 token 0.75 美元降到 0.20 美元,输出从 4.50 降到 1.20。小红书微软自己给的产品指标比跑分更值得看——代码留存率(接受建议后又撤销的比例的反面)涨了 4%,用户回访率涨 9%。注意一个时间点:旧版 9 月 10 日下线,不留过渡期。

货架上同时还在上新:8 月初 Kimi K3 进入 Copilot,8 月中 Grok 4.6 和 Gemini 3.7 Flash 先后上线。GitHub国产模型也没缺席——BYOK(自带密钥)能力已经在 Copilot CLI 和 App 上正式开放,支持接任意 OpenAI 兼容端点。知乎像 GLM 这类模型按量接入,账单和订阅分开算,成本结构完全不一样。
对用户的意义很直接:在 Copilot 里不用再赌单一模型,贵的用在对的地方,便宜的跑量。
但该泼的冷水要泼
Plan Agent 有明确边界。 有知乎用户实测两周跑了 15 个 Issue:边界清晰的 bug 修复和小功能,5-10 分钟出 Draft PR,手动做要 30-40 分钟。知乎但跨模块重构这类任务成功率明显低(他给的数字是不到 40%),而且效果强依赖项目的测试覆盖——没有测试的老仓库,Agent 提的 PR 风险很高。另外代码要在云端处理,有"代码不出网"合规要求的公司这条路直接走不通。15 个 Issue 是个人样本,判断方向够,别当精确数据。
Credit 消耗是真痛点。 改成按 token 计费之后,Agent 场景是消耗大头,微博上有人吐槽"公司 copilot 额度一天消耗了一个月的 1/3"。微博跑 Plan Agent 之前,先掂量一下自己的额度水位。
单平台依赖有了现实案例。 8 月 17 日 GitHub 宕机 7 小时 47 分钟,Issues、PR、Actions、Copilot 一起歇菜。哔哩哔哩更微妙的是,宕机当天竞品 Cursor 顺势发布了自己的代码托管平台 Origin。36氪对把全部工作流押在一个平台上的团队来说,"平台挂了怎么办"从理论题变成了实战题。
四种人,四种用法
公司买了 license 的打工人:不用急着换。先把编辑器内的补全、PR 摘要、代码解释用满,这是 Copilot 目前完成度最高的部分。Agent 功能看公司合规脸色——代码能出网再碰。
个人 Pro/Pro+ 订阅者:值得花一个周末把 Plan Agent 跑起来。在自己的副业仓库上,挑几个"修 bug、补测试、改文档"级别的 Issue 丢给它,体验一次"回来审 PR"的工作方式。顺手记一下 9 月 10 日旧版 MAI-Code 下线这个节点,看看新模型在你的任务上是不是真的又便宜又稳。
开源项目维护者:这波最大的红利人群。每天收到的标准化小 Issue 可以批量交给 Plan Agent,把精力留给架构讨论和 PR 审查。记住一条铁律:Agent 的 PR 必须人审,重点看边界处理、测试是不是真覆盖了改动点、有没有引入不安全的依赖。
CLI/自动化爱好者:Copilot CLI + BYOK 是性价比玩法。终端里用国产模型按量计费跑日常任务,重活再切回强模型,一套订阅吃两种成本结构。还有个低门槛玩法是 Automations:在 PR 评论里写一句指令就能触发预设流程,比如自动生成文档、跑检查,配置一次长期复用。

最后劝退一种人:如果你期待的是"丢个需求就完全撒手、明天收成品",现在任何工具都做不到,Copilot 也做不到。这一代 Agent 的真实位置是"干得多、盯得少,但不能不盯"。
接下来值得盯的三个信号
一是微软自研模型替换第三方模型的节奏——七月初就有报道称微软在核心产品里推自研 AI 替换 OpenAI 和 Anthropic 的模型。36氪如果 Copilot 的默认模型全面转向自研,体验和定价都会变。二是 Cursor Origin 的开放进度,代码托管这一层第一次有了像样的挑战者。三是官方内置国产模型(比如 GLM)什么时候落地,落地之前,BYOK 是唯一通路。
工具这东西,最怕的不是选错,而是拿着新地图走老路。Copilot 八月这批更新,值得每个还在交订阅费的人花两小时亲手摸一遍——值不值,手感会告诉你。