AI集体宕机:最强模型与最脆弱时刻

2026年9月3日,美东时间早晨9点30分。
北美刚上班的开发者们打开常用的AI工具,发现页面加载转圈、接口调用报错、对话框停在原地不动。Claude的对话框停在原地转圈,ChatGPT的请求反复报错,Grok的页面只剩一片空白。三款彼此竞争的产品,在同一个早晨同时失灵。
这是有报告以来最大规模的AI宕机事件。故障监测平台Downdetector上,OpenAI收到的用户报告超过1.2万份,Claude约1200份,Grok约1000份。谷歌Gemini与微软Copilot同期亦收到大量中断报告。
92分钟之内,三家头部AI公司相继失联。从Claude率先报告异常算起,三家在92分钟内相继宣布服务中断,网页端、App与API全部无法访问。AI编程工具Cursor也承认,部分服务因依赖的Claude、ChatGPT和Grok故障而受损。
三家公司同时掉线,引发了外界对共享底层基础设施的强烈质疑。
——
同一片地基
故障发生后,各家AI公司的回应指向同一个方向。
OpenAI状态页记录了一则题为“ChatGPT和Codex出现高错误率”的事件,显示ChatGPT共15个组件、Codex共4个组件受到影响。Anthropic技术部门员工CJ Avilla在社交媒体透露,事件由“基础设施问题”引发。
唯一给出明确解释的是xAI。SpaceXAI发布简短声明,就孟菲斯数据中心的故障向Grok用户及受影响的“计算合作伙伴”致歉。
“计算合作伙伴”这个说法,承认了一个公开的秘密:头部AI公司共用同一批底层算力。业内消息指出,微软Azure同期宕机报告飙升,而OpenAI、Anthropic和xAI三家均以不同形式依赖Azure提供云服务。另一个对故障来源的推测则指向云服务公司Cloudflare——2024年11月,Cloudflare一次故障曾同时让xAI和ChatGPT宕机。
大模型产品越做越强大,但依然跑在共享的底层网络和云服务器之上。一旦底座出问题,上层应用集体“熄火”。三款彼此竞争的模型,地基是共享的。
这不是哪家公司的修复速度问题,而是AI行业对底层基础设施的集体依赖。
——
“星星几乎排列好了”
宕机正酣时,ChatGPT官方账号发来一句预告:“The stars are almost aligned(星星几乎排列好了)”。
Astra在拉丁语中意为星辰、群星。
宕机平息几小时后,OpenAI正式发布旗舰模型GPT-6 Astra,称其为“目前全球最智能、且对齐程度最高的模型”。它为计算机操作、网页浏览、软件工程、网络安全、科学研究及专业工作设定了新的技术巅峰。公司总裁格雷格·布罗克曼表示:“几年后回头看,今天就是AGI时代的起点”。
Astra动用超过10万块GPU,在得州Stargate算力基地完成训练。它的上下文窗口达到105万词元。它可以直接模拟人的操作去使用电脑软件——填写网页表单、更新客户资料、整理日程、检索资料生成总结报告,这些日常办公任务,它可以从头到尾独立做完。
“星星几乎排列好了”与三大服务集体熄火,在同一天先后抵达。
——
一边是“AGI时代”,一边是集体宕机
这次事件有一个细节值得单独拿出来看。
宕机进行时,Hugging Face联合创始人Thomas Wolf转发了汇总三家宕机消息的推文,附上一句提问:“这种情况下你会用哪个AI?”几小时后,他更正了自己的说法——宕机的是所有闭源AI服务。结合他此前“发起第一次自主AI攻击的是闭源模型,完成防御的却是开源模型”的判断,这次宕机被不少人读作又一个论据:闭源阵营的集中性风险,正在以各种形式暴露。
但问题不在于哪家模型更强,而在于它们站在同一片地基上。一个上游节点的故障,就能让头部产品同时倒下。这是2026年9月3日最讽刺的画面:AI行业用十年时间造出了“全球最智能的模型”,却连让这个模型稳定运行三个小时的底层基础设施都保障不了。
最强模型诞生的当天,主流AI集体宕机。AGI宣言的第一天,以一场集体宕机开场。人们一边庆祝“AGI时代”的到来,一边看着对话框转圈、请求报错、页面空白。
这才是AI行业最真实的底色。技术走得太快,基础没有跟上。
,
作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~
