X上有个机器人叫isclaudedownbot,工作极其单调:盯着Claude的登录状态,一旦挂了,就发一个词:Yes。36氪8月25日凌晨4点11分,它又发了一个Yes。这一次没人笑得出来——就在这一天里,Claude连着崩了三次,官方状态页红了又绿、绿了又红,像心电图。
8月24日这一天发生了什么
北京时间8月24日中午12点50分,状态页亮起第一次红灯,用户屏幕上跳出的报错码整齐划一:529 Overloaded。玩过API的人都熟悉429,那是限流,相当于餐厅告诉你点得太快请稍等;529则是整个系统彻底超载,相当于餐厅直接跑出来通知你:对不起,咱们后厨着火了。36氪这把火从中午12点50分一路烧到下午3点36分,前后折腾了将近三个小时。
受灾名单有点长:Mythos 5、Fable 5、Opus 5、Opus 4.8四款模型一起趴窝,claude.ai、API、Claude Code、Cowork全线告急。36氪其中Opus 5正是7月底发布时被官方定为Claude Max订阅默认模型的那款。Anthropic官网

而且一次没崩完。8月25日刚过零点,登录系统再次挂掉,claude.ai和Claude Code订阅全部被波及,折腾六分钟才缓过来;凌晨4点整又卡了八分钟。一天之内,三连。
对刷网页的人来说,恢复意味着刷新一下继续干活;对跑长任务的Agent来说,一次中断赔掉的不是宕机那几分钟,而是它此前已经烧掉的全部时间、上下文和算力。Reddit上有位用户吐槽,自己辛辛苦苦跑了九个小时的自动化流程,硬生生断在这次大宕机里,全部白干。36氪这笔账,状态页记不了,也没有人赔。
红了13天:8月的状态页像一张排班表
单独看,8月24日这次事故很大,但不孤立。按状态页记录往回翻:截至8月24日,这个月24天里已经有13天留下事故记录。36氪逐天翻下去更像排班表:20日一天爆了两起,19日到16日每天雷打不动各一起,15日Fable 5直接崩了约四个小时。
更往前翻,最惨烈的是8月5日,一崩就是7.5个小时。36氪
把时间轴拉长看:从2026年1月算到现在,Claude已经累计了184次故障记录。36氪八个月,平均每月超过20次。
但Anthropic挂出来的官方数字是另一副样子:90天可用率,claude.ai 99.33%,API 99.43%,Claude Code 99.35%。36氪看着还行?有两笔账要算清楚。
第一,企业级服务的及格线是99.9%。36氪99.33%和99.9%只差0.57个百分点,但换算成时间:99.9%意味着每月最多停约43分钟,99.33%意味着约4.8小时,差了6.7倍。单是8月5日那一场7.5小时的事故,就已经把这个月的额度一次性烧穿。
第二,可用率这把尺子换场景了。这个指标诞生在古典互联网年代,那时宕机意味着网页打不开,刷新一下就能接着干,损失就是刷新的那几秒。而现在,Agent的长任务一旦被打断,赔进去的是它已经投入的全部时间、上下文和算力。这种损失,可用率记不进去,也没人赔给你。
另一把火:变笨争议
服务在崩的同时,社区里还烧着另一把火:模型在变笨。
官方的说法完全是另一个故事。Opus 5在7月底上线时,官方的定位是接近Fable 5的前沿智能,价格只有一半。Anthropic官网
在Frontier-Bench、GDPval-AA这类编码和知识工作基准上,官方给Opus 5的结论是达到当前最先进水平,而且成本比前代Opus 4.8更低。Anthropic官网

用户的体感却在另一边。有网友直言Claude遭遇了史无前例的最严重智力退化,Opus 5根本没法用,自己已经退回去用Opus 4.8。36氪主动往回退版本,这种操作在卷上天的AI圈并不多见。
还有人拿同一个棘手任务做对比:Opus 5开xHigh档要熬一个小时,换另一家的同档模型,15分钟搞定。36氪
AMD的AI总监Stella Laurenzo更是亲自下场,把团队用过的6852个Claude Code会话全翻了出来,画出一条断崖:1月底模型平均思考深度还有约2200个字符,到3月上旬只剩560个,跌了75%。36氪
更微妙的是,同一时期,Claude Code的思考内容开始对用户隐藏,仅仅一周之内,隐藏比例就从1.5%一路推到了100%。36氪换句话说,模型在肉眼可见地变笨的同时,你连它是怎么变笨的都看不见了。
公允地说:无论是AMD的统计还是网友的对比,都属于单方样本和体感级证据,不足以定论变笨。但可以确定的是,对8月24日的宕机和容量约束,Anthropic至今没有给出任何技术解释。信息不透明的时候,体感就会填补真空。
商业面:营收在狂飙,增速在跳水
把这两把火和商业数据放在一起看,画面更有意思。
按Anthropic向潜在投资者披露的初步数据,今年二季度营收超过115亿美元,去年同期只有7.87亿美元,一年做到约14.6倍。微博
截至7月底,其年化营收运行率已达650亿美元,IPO据称最快9月或10月初启动。微博但增长率的另一面是:第三方平台TickerTrends追踪显示,Claude Code的ARR增速从百分之六七十,断崖跌到百分之五点二;而老对手Codex同期增速百分之二十点八,整整四倍,两家差距一个多月缩小二十亿美元。哔哩哔哩
知乎上有人把它总结为Claude Code增长熄火,AI编程工具进入洗牌期。知乎大客户也开始施压:Shopify CEO Tobi Lütke公开表示,如果Claude Code继续拒绝读取AGENTS.md及.agents/skills,他正在考虑在Shopify内部禁用Claude Code。微博
其实官方自己的性价比图表早已埋了伏笔:在Sonnet 5的发布页上,上一代中杯模型还远够不到旗舰Opus 4.8的水位,而新一代的曲线已经压了上去。Anthropic官网花更少的钱买到够用的能力,这正是用户开始算账、开始迁移时最常引用的依据。

算力和工程能力被暴涨的需求拉到极限,8月红了13天的状态页和报错里的容量约束,是这条增长曲线的一面;增速跳水和大客户施压,是另一面。对掏了订阅费的用户来说,直接翻译过来就是:你依赖的服务变得更不稳,同时也更难离开——这正是最难受的组合。
怎么办?先对号入座
先别急着退订,也别急着搬家,先看你是哪一波。
第一波,轻度用户(免费或偶尔用):宕机对你的影响有限,看个热闹就行,不用动手。
第二波,订阅打工人(付了Pro/Max,天天用它写代码、写报告):最稳的动作不是搬家,而是备好第二引擎。同家族里,Sonnet档可以顶班——官方评测对比显示,Sonnet 5的得分已经接近Opus 4.8,价格更低。Anthropic官网跨品牌还有Codex,国内也有GLM、Kimi、DeepSeek等编码工具可以顶上。一边亮红灯的时候,活儿不停。

第三波,跑长任务的Agent重度用户(按小时、按通宵跑):你的损失函数和别人不一样。三件事:任务切块加检查点,一次中断只损失最近一块;长任务不要绑死在单一供应商上;重试和续跑逻辑写进流程。前面那个9小时的损失,没有任何人赔。
第四波,企业API采购:合同里写清SLA赔付条款和故障切换架构。99.4%看着不差,但够不到99.9%的及格线,而Agent类负载会把每次中断的损失放大。
国内用户还要多说一句风险:Anthropic并未对中国大陆开放服务,通过非官方渠道使用本身就带着账号管理风险。这个8月,小红书上有人在打卡Claude不封号挑战,从Day08一路数到Day10。小红书B站评论区里,高赞留言也多是封号才是大头、封了两个号已经不想折腾了这类吐槽。哔哩哔哩哔哩哔哩把工作全部押在一个账号上之前,先把这一条想清楚。
值得继续盯的信号
最后留几个持续观察的线头:
Anthropic会不会对8月24日的宕机给出技术解释——两天过去仍然沉默,本身就是一个信号;
9月是否还会大面积出现容量约束类报错——这能分辨是算力补上了,还是需求还在爆;
状态页和StatusGator这类第三方聚合直接看红灯频率,那是最直接的体征;
Claude Code的增速会不会回升,以及Shopify的AGENTS.md之争如何收场——这决定用户接下来还有多少议价权。
529这个错误码,官方解释是超载。但对把活儿押给AI的人来说,真正超载的,可能不只是服务器。