今天(8月12日)有一条 GitHub Copilot 用户不该错过的消息。
微软正式发布了新的AI编程模型 MAI-Code-1.1-Flash,并且已经在 GitHub Copilot 里全面上线,价格只有前代的四分之一,Terminal-Bench 测试提升 22%,还新增了图像识别能力。微博微软 AI 负责人 Mustafa Suleyman 也在 X 上发帖确认:相比 6 月发布的那款模型,效率提升 25%、质量更高、成本只有四分之一。小红书

更关键的是新闻末尾那句:旧版模型将于 9 月停用。
如果你正在用 Copilot,尤其是付了订阅费的用户,这条消息值得花三分钟想清楚。它不只是"多了个新模型",而是微软这半年"换模型、砍成本"战略的一次集中落地——而且直接关系到你的订阅费花得值不值。
先把时间线捋一遍,你会发现这步棋不突然
很多人对 Copilot 的印象还停留在"微软+OpenAI"。但看看最近三个月发生了什么:
6 月,GitHub Copilot 调整计费方式,Agent 类功能开始按用量计费——AI 代理的账单是按"动作数"算的,不是按对话轮次算的。知乎
7 月,彭博社报道,微软已经开始把 Excel、Outlook 里的一部分 AI 提示词,悄悄切到自研的 MAI 模型上跑,每周处理几万条请求。36氪
还是 7 月,微软 AI 模型业务负责人 Suleyman 公开表态:“我们支付给 Anthropic 大量资金,目标是减少并最终消除这一成本”。36氪
8 月初,微软首款自研代码模型进入 Copilot,开始接管高频流量。知乎
然后就是今天,MAI-Code-1.1-Flash 上线,价格砍到前代的四分之一,旧版 9 月停用。
连起来看,逻辑很清楚:微软正在一步步把第三方模型从自家产品里替换出去,换成自研的。
为什么?因为太贵了。有知乎作者算过一笔账:DeepSeek V4 Pro 的折扣价大约是每百万输入 token 0.435 美元、每百万输出 token 0.87 美元,而 Anthropic 旗舰模型的输出价格是每百万 token 50 美元,两者差价高达 57 倍。知乎当你的产品每天有千万级用户在调用模型,每一次调用都是真金白银往外流。所以微软两手准备:一边拿开源模型当谈判筹码,一边加速上自研 MAI。今天这个 1.1-Flash,就是这盘棋落在"编程"这颗子上的最新一步。
对用户来说算好消息吗?大部分是,但有两个坑
先说好的一面:
第一,成本下降是所有"性价比"故事的前提。模型成本降到四分之一,Copilot 才有空间在同样的订阅价格下给更多额度,甚至未来降价。对免费额度用户来说这是实打实的利好——微软只有成本降下来,才可能大方。
第二,能力没缩水。Terminal-Bench 提升 22%(Suleyman 的口径是效率提升 25%),还新增了图像识别——截个报错图、界面图让它直接写代码,这在以前是不支持的。微软此前公布的官方基准图也能佐证这条路线:上一代 MAI-Code 模型在 SWE-Bench Verified 等编码测试里,用更少的 token 跑出了比 Claude Haiku 4.5 更高的通过率,新一代是在这个基础上继续往前。

第三,微软的 Copilot 产品线整体还在涨。Microsoft 365 Copilot(企业版)付费用户从 1 月的 1500 万涨到 4 月的 2000 万,虽然跟 ChatGPT 超过 5000 万的付费用户比差距还很大,但至少方向不是收缩。36氪
但有两个坑要注意:
其一,旧版 9 月停用。如果你的团队工作流里锁定了某个具体模型版本(不少企业用户会锁),需要尽快验证新模型兼容性,别等到 9 月自动切换时才发现不对劲。
其二,自研模型不等于体验已经被验证。最近两个月社区对 Copilot 的口碑挺分裂:有人直言它被高估了,补全是强项但改代码、跨文件能力一般;也有人吐槽"Copilot 里的模型没有一些最新的版本"是它最大的问题。知乎MAI-Code-1.1-Flash 在真实项目里能不能打平 OpenAI、Anthropic 的顶级模型,目前还没有经过大规模验证——跑分只是一个维度,建议用自己的日常任务实测。
另外提一个值得警惕的安全信号:8 月初安全公司 Noma 披露了一种针对 GitHub 新推出的 Agentic Workflows 的提示注入攻击方式(被命名为 GitLost)——攻击者只需要在公开 Issue 里藏一句指令,就可能诱导拥有跨仓库权限的 AI Agent 泄露私有数据,全程不需要任何黑客技术和访问凭据。36氪这跟今天的新模型没有直接关系,但提醒很直接:Agent 模式的权限别给太大,跨仓库的 token 要慎用。
不同人群怎么办,直接说结论
如果你是 Copilot 付费用户:先别急着续费或退订。接下来一两周,在模型选择器里把 MAI-Code-1.1-Flash 用起来,重点测自己的日常任务——补全、重构、解释代码,和现在常用的模型对比。如果表现能打,你的订阅就变更值了;如果不行,9 月停用旧版正好是一个决策节点。
如果你是免费额度用户:可以保持关注。模型成本降到四分之一,是微软扩大免费额度的前提条件。免费用户大概率是这波降本最先受益的人群。
如果你在犹豫要不要转投 Cursor 或 Claude Code:别被"Copilot 不行了"的论调带着走。按企业支出数据推算,Copilot 目前仍以约 30% 的份额排第一,Cursor 约 26%,Claude Code 约 18%,但 Copilot 的护城河确实在变窄。知乎更实际的做法是按任务类型匹配:日常写代码多,Copilot 依然是省事的;经常重构、跨文件改动多,Cursor 的 Agent 体验更成熟;经常啃大型老代码库,Claude Code 的长上下文有优势。有开发者干脆两个都订,一个月 30 美元,按场景切换,用他的话说就是"Copilot 帮你省手速,Cursor 帮你省脑子"。知乎

如果你是企业 IT 管理者:需要多操心两件事——模型版本切换的兼容验证,以及 Agent 权限边界的收紧,都赶在 9 月之前做完。
最后,几个值得继续盯的信号
一是微软预告的 Copilot 超级 App 整合,计划 8 月推出,届时 AI 编程工具和高级功能会拆成付费附加模块,订阅结构怎么拆,直接影响钱包。36氪
二是 MAI-Code-1.1-Flash 的成本下降会不会传导到 Copilot 的高级请求计费上——如果额度变大方,免费和低档用户受益最大。
三是 9 月旧版停用后社区的实际反馈,那是自研模型质量的第一次大规模检验。
总结一句:微软这波降本,本质是为了自己的利润表,但如果跑得顺,用户有机会跟着捡到实惠。这个"成本四分之一"的新模型到底能不能打,接下来一个月,先自己试试,再下结论。