事故根源是服务器大规模过载:Anthropic的推理基础设施在多个模型层面同时饱和,导致几乎所有请求都以HTTP **529“Overloaded”(过载)**错误返回。
受影响的服务几乎是“全军覆没”。Anthropic的状态页面将所有主要服务标记为“重大宕机”:
所有模型——包括Opus 5、Sonnet、Haiku等——同时出现错误率飙升。
对于许多用户来说,屏幕上突然出现的“529 Overloaded”可能令人困惑。它到底是什么意思?
HTTP 529是Anthropic特定的状态码,意味着API的推理服务器已满负荷运转。这和你的账户被限速(那会是HTTP 429错误)或你的请求有bug完全是两码事。
Claude的官方文档明确指出,529代表“API在所有用户间暂时处于满负荷状态”。Claude Code工具会自动重试几次,如果仍然失败,才会将错误展示给用户。
简单来说,这是一个“舰队级”的过载信号:你请求的模型在当前区域的需求量,超出了Anthropic的供应能力。这并非你的代码或API密钥的问题——只是因为服务器太忙了。
Anthropic方面: 公司在UTC时间19:49开始调查,并于20:33公开确认问题,表示“我们已经发现一个导致多个模型出现高错误率的问题,正在努力解决”。最终在UTC时间22:36恢复了全部服务。
用户方面: 社交媒体和专业论坛上,大量用户报告自己在任务中途被“卡住”。开发人员丢失了正在进行的Claude Code会话,无法提交代码、编写文档或完成任何依赖AI持续辅助的工作流程。这一事件迅速在X(原Twitter)上成为热门话题,成千上万的专业人士意识到,当Claude下线时,他们竟然没有备选方案。
7月29日的宕机绝非偶然事件。回顾整个2026年,Claude一直遭受着反复出现的服务中断,其核心原因如出一辙:需求增长远远快于Anthropic基础设施的扩容速度。
以下是2026年至今的几次重大事故:
| 日期 | 持续时间 | 主要症状 |
|---|---|---|
| 3月2日 | 约3小时 | 错误率升高,529过载 |
| 3月18日 | 约2小时 | 服务器过载 |
| 3月19日 | 约1小时 | 服务器过载 |
| 3月26-27日 | 长时间 | 网络基础设施降级 |
| 6月2日 | 约6小时 | Claude Code子代理系统故障,引发平台全面过载 |
| 6月5日 | 约2小时 | 模型分阶段恢复(Opus 4.6在17分钟内恢复,Opus 4.8则瘫痪了约2小时) |
| 6月12日 – 7月1日 | 数周 | Anthropic因容量问题暂停了Claude Fable 5和Mythos |
| 7月6日 | 约1.5小时 | 多个模型出现错误 |
| 7月17日 | 约1小时 | 529过载错误——与本次模式相同 |
| 7月29日 | 约2.8小时 | 529过载——所有服务,所有模型 |
到2026年6月,Claude在12天内遭遇了10次重大服务中断。TechTimes报道指出,Anthropic已公开承认“对Claude的需求增长快于其基础设施建设”。公司据称与SpaceX达成了计算合作协议以解决底层容量短缺问题,但7月29日的事件表明,基础设施的追赶速度仍然滞后。
本次宕机事件深刻地揭示了专业团队深度依赖AI工具所蕴含的结构性风险:
总而言之,2026年7月29日的Claude宕机事件,是一次对整个AI生态的“压力测试”。它不仅暴露了Anthropic当前基础设施的瓶颈,更向所有将AI工具深度集成到核心业务流程的团队敲响了警钟:享受AI带来效率红利的同时,必须正视并管理好“单点故障”这一结构性风险。