GitHub Models 7月30日正式下线,微软内部也叫停「烧Token」:AI白嫖时代收尾,想好往哪迁再掏钱

源自6位全网作者

04:48

先给结论:如果你一直靠免费 AI 额度过日子,那个"一个 GitHub 账号就能白玩各种大模型、不绑卡也能薅"的时代,正在被亲手关上。而动手关门的,恰恰是看起来最舍得送 AI 的微软。

最近接连发生了三件事,都集中在过去一个月,我按时间线给你捋清楚。

第一件:GitHub Models 已于 7 月 30 日正式下线

GitHub Models 可能有些人不熟,简单说就是 GitHub(微软旗下)两年前开的一家"免费大模型网吧":只要一个 GitHub 访问令牌,就能在官方 Playground 里调用把玩各种大模型,还能接进 GitHub Actions 自动化流程、做提示词管理和模型对比。知乎

它最大的卖点就是"免费额度"——不用注册 Azure、不用绑信用卡,有 GitHub 账号就能玩到 GPT、Claude、Llama 这些模型,曾经是不少 AI coding 用户和尝鲜党的白嫖天堂。

现在,7 月 30 日正式关闭。模型 Playground、模型目录、推理 API、BYOK(自带密钥)接口全部不可用,影响所有用户,包括此前仍有活跃调用的老账号。如果你的程序还在调用 GitHub Models 接口,请求会直接失败。知乎

而且倒下的不止它一个。有开发者在 8 月上旬复盘了自己常用的 13 个免费大模型入口,一个月里就挂了 4 个:除了随官方退役的 GitHub Models GPT-4.1 和 GPT-4o-mini,ModelScope 的 DeepSeek-V4-Flash 下架、OpenRouter 的 Llama-3.3 免费档结束、SambaNova 更是直接倒闭。知乎

GitHub Models 7月30日正式下线,微软内部也叫停「烧Token」:AI白嫖时代收尾,想好往哪迁再掏钱

这里要说两点:

一是微软和 GitHub 官方都没有解释下线原因。社区普遍猜测是免费额度叠加 GitHub 的超大体量,Token 消耗太猛、微软扛不住了——但这只是推测,不是官方口径。

二是给容易混淆的人划个重点:GitHub Models 和 GitHub Copilot 是两个独立产品,这次下线不影响 Copilot 的正常使用,Copilot 用户不用慌。

第二件:微软内部叫停"Tokenmaxxing",连自己员工都不能随便烧 Token 了

8 月 5 日前后,一封微软内部邮件被外媒 404 Media 曝出。微软执行副总裁 Jay Parikh 直接提醒员工:“Tokenmaxxing 不是我们追求的目标”.404 Media

所谓 Tokenmaxxing,就是为了让 AI 发挥最大能力,不断增加调用次数、塞更长的上下文、让模型生成更多内容。这在早期是被鼓励的——不少公司甚至觉得"AI 用得越狠,数字化转型越深入"。

但微软现在掉头了:从今年 7 月开始,各业务部门都背上了"AI Token 预算目标",员工可以查看并追踪自己的个人 Token 消耗,还把成本更低的 GPT-5.6 设成了内部默认模型。

为什么?不是因为微软缺钱。最新财报显示,微软全年营收、运营利润、净利润全都在涨。它是在重新算一笔账:砸进去这么多钱用 AI,到底换回了多少实际价值?

数据挺扎眼:许多微软工程师每月的 Token 消耗成本在几百到几千美元之间。而这还发生在一家"卖 AI"的公司内部。一位微软员工匿名对 404 Media 说了句很扎心的话:“如果作为 AI 基础设施提供方的公司,都承担不起自家 AI 产品的成本,那买你家 AI 服务的其他公司该怎么办?”

第三件:Copilot 两个月前就转按量计费了,免费额度早就在收紧

其实信号早有。大约两个月前,GitHub Copilot 转向了基于使用量的计费模式,当时就有不少用户抱怨自己的 Token 限额根本不够用。微博现在,微软还在探索让 Microsoft 365 里的部分 AI 请求优先走自家的 MAI 模型,而不是调用更贵的 Anthropic 和 OpenAI。

GitHub Models 7月30日正式下线,微软内部也叫停「烧Token」:AI白嫖时代收尾,想好往哪迁再掏钱

不止微软。亚马逊、Adobe、Atlassian、花旗此前都已开始限制员工过度消耗 Token。OpenAI 的 Codex 最近也恢复了 5 小时使用限制,"无限火力"成了历史。有行业统计称,国内日均 Token 消耗已经到了 180 万亿级别,比两年前的千亿级涨了上千倍——这些 Token,大多是 AI 智能体"不聊天、光干活"烧掉的。

所以把三件事串起来,信号很清楚:AI 推理成本的账单到了,“比谁投入多"的阶段过去了,整个行业切换到"看回报”。免费补贴的窗口,正在收窄。

那普通白嫖党怎么办?按情况对号入座

别一上来就把所有平台都开通,先看清自己是哪一类。

GitHub Models 7月30日正式下线,微软内部也叫停「烧Token」:AI白嫖时代收尾,想好往哪迁再掏钱

第一类:原来用 GitHub Models 的推理 API 开发正经 AI 应用。
官方的直接迁移路径是 Microsoft Foundry。部署好模型、替换新的密钥和端点,原有业务代码通常不用大改,用量计入 Azure 订阅。注意一点:Foundry 不像 GitHub Models 那样预先配好可用模型,你得自己先选择并部署模型,而且不同区域能部署的模型可能不同。

第二类:主要拿 GitHub Models 辅助写代码、理解代码、改仓库。
这种其实不用迁到新的模型平台,直接用 GitHub Copilot 更简单。Copilot App 已经向所有 Copilot 套餐开放,包括免费版。原来的 BYOK 功能没有消失,而是被整合进了 Copilot——你可以自带 OpenAI、Anthropic、Azure OpenAI 的密钥,甚至接 Ollama、vLLM 这类本地模型。用自己的提供商时,GitHub 只提供交互界面,账单和配额由模型服务商说了算。

第三类:想直接掌控模型、账单和 API Key。
那就跳过中间平台,直接连 OpenAI、Anthropic、Gemini 这些厂商的 API。项目本来跑在 AWS 上的用 Bedrock,深度用 Google 生态的直接 Gemini API,没必要为了接棒 GitHub Models 专门迁去 Azure。提醒一句:别把某一家厂商的请求格式写死在业务代码里,留一层统一接口,不然下次再有模型下线,迁移成本又会失控。

第四类:只是偶尔调用模型、用量很小。
云 API 通常比自己搭 GPU 服务器省事。别追求"平台开得多",选一个主平台、再备一个接口,一般就够了。

顺带提醒还想继续用免费档的人:活着不等于好用。同一份复测里剩下的 9 个免费入口,首字节延迟从 Cerebras 的 576 毫秒到火山引擎 GLM-5.2 的 17.5 秒,差距拉到 30 倍,智谱 GLM-4.7-Flash 甚至只返回空结果。免费额度正在从"白嫖天堂"变成"排队引流位"。

GitHub Models 7月30日正式下线,微软内部也叫停「烧Token」:AI白嫖时代收尾,想好往哪迁再掏钱

两个坑,提前标出来

坑一:免费中转站。 免费 Token 渠道一收紧,各种"公益中转站"就冒出来了,有些背后的 Token 来源不明,随时可能投毒——篡改返回数据、往工具调用里注入脚本。记住"免费的才是最贵的",来路不明的渠道别接关键业务。

坑二:账单分散。 迁移后费用可能不再集中在 GitHub,而是散到 Azure、OpenAI、Anthropic 各处。如果全绑一张卡,后期很难分清哪笔扣款属于哪个项目。建议设好预算预警,能按项目分账就分账。另外,别再沿用已经失效的 GitHub Models Token,新密钥放环境变量或密钥管理服务,千万别提交到 Git 仓库。

接下来值得盯的三个信号

  1. GitHub Copilot 免费版和各种免费额度会不会进一步收紧——按量计费已经是前奏。

  2. 微软 Microsoft 365 的自研 MAI 模型会不会大规模替代外部模型——这直接影响后续订阅是变便宜还是变限量。

  3. 头部大模型的定价调整——成本压力最终会传导到每一个订阅的价格上。

一句话收尾:这次微软关掉的不是一个免费功能,而是"AI 白嫖"这一整个时代。还在靠免费额度过日子的,现在就该想清楚迁到哪条路、每月准备多少预算,别等工具断了、账单爆了才手忙脚乱。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章