3小时40分、3.7万份报告:AI编程「最黑暗一夜」之后,备胎这笔账该分档算了

源自223位全网作者

05:12

9月3日晚上9点20多分(北京时间,对应美东时间早晨9点23分),北美刚上班的开发者发现:Claude 的对话框转圈卡死,ChatGPT 一发消息就报错,Grok 的页面一片空白。三家互相竞争的产品,选了同一个早晨一起躺平。故障监测平台 Downdetector 上,OpenAI 的用户报告超过1.2万份,Claude 约1200份,Grok 约1000份,这被多家报道称为有记录以来最大规模的 AI 集体宕机。知乎 也有统计口径显示,事件峰值期间,全球针对 OpenAI 服务的故障报告超过3.7万份,其中80%集中在 ChatGPT。知乎

如果你是把活儿交给 Claude Code、Codex 的重度用户,这一晚不是八卦,是一份体检报告。宕机本身4小时就结束了,真正留下来的问题是:你准备的备胎,是不是真的。 下面先把这晚到底挂了什么捋一遍,再算账:备胎分几档、哪档值得你花钱。

一、92分钟,三家全灭:这次到底挂了什么

把各家状态页和知乎两篇长文的梳理拼在一起,时间线是这样的:

  • 北京时间21:23,Anthropic 报告 Claude 系列错误率飙升,Mythos 5.1、Fable 5.1、Opus 等核心模型一起中招,网页、API、Claude Code 全线中断;

  • 约2分钟后,xAI 的 Grok 全端下线;

  • 大约一个半小时后,ChatGPT 与 Codex 加入——OpenAI 状态页记录 ChatGPT 有15个组件、Codex 有4个组件受影响;

  • Cursor 发公告:因上游依赖的 Claude、ChatGPT、Grok 故障,部分服务被迫中断;

  • 谷歌 Gemini、微软 Copilot 同期也收到大量中断反馈;

  • 部分服务当天深夜就陆续恢复,整个事件持续约3小时40分钟,到北京时间9月4日凌晨才全部回来。

根因上,三家的说法对不齐:Anthropic 技术人员称是"基础设施问题",xAI 为孟菲斯数据中心故障致歉、顺带提到了"计算合作伙伴",OpenAI 发言人则说是"路由错误"。知乎 业内推测指向共享的云底座——微软 Azure 同期宕机报告飙升,而三家公司都以不同形式依赖 Azure 提供云服务;也有 Cloudflare 论,2024年11月它一次故障就同时让 xAI 和 ChatGPT 宕机。知乎 至于微博上传的"算力集群断电",目前仍是传闻,未经证实。

所以先把第一个结论钉死:官方根因还没定论,唯一确认的是"地基是共享的"。 xAI 那句"计算合作伙伴",等于承认了公开的秘密——头部 AI 公司跑在同一层云上。Hugging Face 联合创始人 Thomas Wolf 在宕机时问了句"这种情况下你会用哪个 AI?“,几小时后自己更正:掉线的是所有闭源 AI 云服务。知乎 更魔幻的是,宕机当口 ChatGPT 官号还在发新模型预热,配文是"星星几乎排列好了”,网友把这条翻出来群嘲:建议先把机房修好,再谈星星。几小时后,OpenAI 在北京时间9月4日凌晨正式发布 GPT-6 Astra,总裁 Greg Brockman 那句"欢迎来到 AGI 时代"随即刷屏。知乎

二、真正的伤亡名单,不是"不会写代码"

事件过后,#AI编程时代最黑暗的一晚# 上了热搜,"古法编程复兴"的自嘲刷屏:“平时都说效率起飞,AI 一趴窝立刻原形毕露”,“对着空白文档愣了三分钟”。微博 评论区被顶起来的几条自白是:“我还以为我被封号了呢”“难怪刚才我 Cursor 光转圈”“检查代码突然崩溃,一直重复同一行文字”。微博 国内 AI 服务基本没受波及。微博 但当晚转场流量瞬间灌进来时,也有用户反馈个别国产模型明显变卡、甚至把 App 卡退。

技能退化的焦虑是真的,但那是慢性病。这次事件暴露的急性伤,是工作流中断,而且按人不同:

  1. Agent 重度用户最惨。 Claude Code、Codex 全端掉线,正在跑的长任务死没死都不知道,上下文和改了一半的代码,要么现场抢救,要么整段重跑。

  2. API 和脚本玩家其次。 CI、自动化流水线、拿模型接口做的小项目,宕机几小时就是几小时零产出。

  3. Tab 补全用户影响最小。 但一次集体掉线把"平时不敢关的那扇门"亮了出来:你的代码能不能在 AI 缺席的4小时里维持现状,取决于上一次提交是什么时候。

还有一个反常识的发现:很多人的"备胎"和"主号"是同一个地基。 Gemini、Copilot 当晚照样收到大量中断报告,连 Cursor 都公告了自己被上游连坐。你花月费办的第二订阅,很可能和主号一起倒下。判断备胎真假的标准就一句话:主号挂掉时,它是否在另一朵云、另一家厂商、或者另一台机器上。 不在,就是假冗余。

三、备胎分档的账:哪一档值得花钱

档0:0元热身,人人都该做。

  • 习惯比工具便宜:宕机时最大的损失往往是没提交的半截活儿。有知乎用户分享的做法是"建一个git仓库,提交后才能改下一轮",回撤版本、重开任务,代价都是分钟级。知乎

  • 免费的窗口先用:集体掉线当晚,智谱在 X 上发了句"We are still up"——我们还在线。它随即宣布:即日起至9月20日,每晚23点至次日9点,GLM-5.3-Flash 在 Z Code 中免费使用,套餐内其他 Agent 额度翻倍;TRAE 基础版也是免费的字节系 AI 原生 IDE,当原型备胎够用。知乎

  • 适合:vibe coding 入门者、学生党、所有轻度用户。这一档省下的是慌乱。

档1:现金成本最低,切换成本最高的"自有 harness"。

  • DeepSeek 开源的编码 Agent 框架 DeepSeek Harness(dsh),36氪有篇分析直接把问题挑明了——人人都能整个自己的 DeepSeek Harness,为什么还要给 Claude Code 们充会员?36氪 小红书上的保姆级安装教程长期霸榜,B站搬运的中配教程标题更直接:安装指南——10分钟搭建开源编码代理,原标题就叫"一个你真正拥有的免费 Claude Code"。哔哩哔哩

  • 本地路线也有真案例:有人用 Ollama 本地代理,把 Claude Desktop 的 Opus 槽位换成了 Kimi K3,绕开了官方模型围墙。36氪 Meta 开源的300亿参数本地 Agent 模型 Muse Glimmer,单卡就跑得动。小红书

  • 坑在这里:现金几乎不花钱,但硬件和配置是门槛,而且最大的坑是平时从没测过。备胎如果从没在你机器上完整跑通过一个任务,出事那晚它就不算数。

  • 适合:Agent 重度用户、代码不能上云的、手里有张单卡的人。

档2:付费第二条流水线,只给靠它挣钱的人。

  • 第一原则:别再买同地基的第二订阅。真要冗余,往另一朵云、另一个厂商、或者国产服务上配。

  • 生产端走多厂商路由的,有两个等着你的坑:有知乎作者踩过,SDK 默认重试机制会把超时请求重新投递,同一段生成计费两次,账单突然暴涨;另一篇"四个坑"实战贴里,一家限流、流量灌进备胎、熔断没设好,备胎秒变第二个案发现场。知乎

  • 成本参照:刚发布的 GPT-6 Astra API 定价每百万 token 输入10美元、输出50美元,是上一代的2.5倍,Fable 5.1 定价持平——双流水线的人,往后两家的账单一起涨,这笔要算进年成本。

  • 适合:接单、跑批、宕机直接等于断收入的。

分界线怎么画:多数个人重度用户,档0 做扎实 + 档1 测热一个备胎,就足以扛住今晚这种场面;档2 是营收工具,拿"4小时损失 × 年宕机概率"去对年费,别为情绪多买一份"安全感"。

四、接下来看三个信号

  1. 官方根因结论。 Azure、Cloudflare 还是最后别的——根因落定之前,"同地基冗余到底躲不躲得掉"的判断都只能先记着,出了结论这笔账值得重算一遍。

  2. 免费夜窗会不会有人跟。 智谱的 23点-9点 免费期给到9月20日,如果更多厂商跟进错峰补贴,这是把档1 备胎测热的最低成本窗口。

  3. 模型发布节奏。 9月2日 Fable 5.1、9月3日 Gemini 3.8 Flash 和 Meta 的 Muse Spark 1.3、9月4日凌晨 GPT-6 Astra——三天四款。但 ARC Prize 提醒了所有人:Astra 自报 ARC-AGI-3 得分99.9%,换统一 Standard harness 测最高只有62.7%,差距来自框架而非模型。知乎决定下限的是你的 harness 和流水线,决定上限的才是模型。

AI 编程最黑暗的一晚,随着凌晨的恢复就翻篇了。真正留下来的是一个新习惯:下次想再办一个订阅、再开一个新模型窗口之前,先问一句——这是新主号,还是真备胎。

内容由AI生成

精选参考来源

1. AI集体宕机:最强模型与最脆弱时刻

2. AI大模型集体掉线的这天,OpenAI宣布人类进入AGI

3. #AI编程时代最黑暗的一晚#平时一个个都说有了AI以后编程效率起飞,真等几个常用AI一起趴窝,立刻原形毕露哈哈哈。以前写代码是人类指挥电脑,现在已经变成先看看AI能不能上班。那一晚不是程序员不会写了,是大家突然被迫重新体验了一遍没有AI辅助的上古生活。#热点观点##热点跨界共创#

4. 更新,多方消息确认,美国主要几家AI公司都处于宕机状态,Claude、ChatGPT和Grok都不能使用。现在X上闹麻了……(更新,已经恢复了)#海外新鲜事##ChatGPT崩了#

5. #ChatGPT崩了#好家伙,ChatGPT、Claude、Grok...多家全球主流AI集体宕机。刚翻了一圈,说法五花八门,有说是算力集群电力故障,也传出来各种脑洞传闻。可信度比较高的是底层云基础设施异常。目前部分服务已经陆续恢复。国内AI服务基本没受波及。也能看出来,高度依赖同一批算力,风险还是挺大的...全文

6. 那些使用AI编程的有遇到过重大失误吗?

7. 人人都能整个“自己的DeepSeek Harness”,那我们为啥还在给Claude Code们充会员?

8. [中配]DeepSeekHarness安装指南:10分钟搭建开源编码代理

9. Claude Desktop被"偷梁换柱":Opus 5槽位里跑着Kimi K3,Ollama一个本地代理绕开了Anthropic的围墙?

10. Meta 开源 300 亿模型,本地跑得动

11. 大模型API账单突然暴涨,问题出在超时重试

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章