
接下来 60 秒怎么解决 Claude 过载?
把对话换成另一个 Claude 模型,再重试一次。如果状态页点名了多个模型,就把这段对话转到别家的模型上。第一步管用,是因为按 Anthropic 的 Claude Code 错误参考里的说法,容量是“按模型分别计算的”,所以 Opus 满载并不代表 Haiku 也满了。按顺序来:
- 先复制没发出去的消息,再去碰刷新按钮。
- 对照下面的表格看提示的措辞。容量或过载提示不是你的用量上限;带有重置时间的提示才是。
- 切换模型。在 claude.ai 里点发送按钮旁边的模型名称;Anthropic 说切换会“从 Claude 的下一条回复开始”生效,所以对话还在。在 Claude Code 里运行
/model。 - 打开 status.claude.com。如果故障只点名了一个模型,就印证了第 3 步。如果写的是“multiple models”,说明所有 Claude 模型都受影响,这时请把对话转到 GPT 或 Gemini。
- 一分钟后只重试一次,不要连点二十次。Claude Code 在向你显示错误之前,已经自动重试了最多 10 次。
| 在哪里看到 | 提示内容 | 含义 | 第一步 |
|---|---|---|---|
| claude.ai、桌面端或手机端聊天 | "Due to unexpected capacity constraints, Claude is unable to respond to your message. Please try again soon." | 所有用户的需求量太大;Anthropic 说这类提示不会出现在状态页上 | 几分钟后重试,或者换模型 |
| 终端里的 Claude Code | "API Error: Repeated 529 Overloaded errors" | 你选的模型在每次重试中都处于满载状态 | 用 /model 换另一个模型,或设置备用链 |
| Claude Code,某个模型很忙 | "Opus is experiencing high load, please use /model to switch to Sonnet"(桌面应用显示 "Switch to Sonnet.") | 只是这一个模型的容量吃紧 | 按提示切换 |
| Claude API | HTTP 529 overloaded_error:"The API is temporarily overloaded." | 流量来自“所有用户” | 先退避,再在代码里改用另一个模型 |
| 任意 Claude 应用,作对比 | "5-hour limit reached - resets [time]" | 这是你自己的用量上限,不是过载 | 等到显示的时间;换模型没有用 |
Claude 现在是过载了,还是只有你这边有问题?
去看 status.claude.com(status.anthropic.com 会跳转到这里),它把 claude.ai、Claude API、Claude Code、Claude Cowork 和 Console 的故障分开发布。不过状态页显示绿色,并不能证明 Claude 没问题。Anthropic 的错误信息指南(2026 年 5 月 18 日更新)说,容量提示属于负载管理:“Capacity issues will not appear on our status page because they represent normal load management rather than technical problems.” 状态页是绿色却出现容量提示,属于时间短的那种;状态页上发布了故障,则属于时间长的那种,而这个时间有多长,我们量过。
2026 年 10 月 3 日,我们通读了 status.claude.com 的历史记录中 2026 年 8 月和 9 月的每一起故障。38 起故障里,有 24 起是模型错误或模型性能下降,其余是登录、计费、连接器和单个应用的问题。其中 12 起的标题点名了具体模型,比如“Elevated errors for Claude Sonnet 5”。从发布开始到发布已解决通知,它们的中位数是 35 分钟,最长不超过 95 分钟。另外 12 起写的是“multiple models”“all models”或所有 Claude 服务,中位数是 112 分钟。最长的一起发生在 8 月 5 日,持续了 429 分钟。故障点名了具体模型时,换一个 Claude 模型就是解法;没有点名时,等待大约要花两个小时。其他指南里常说的“2 到 5 分钟”,说的只是那些根本不会出现在状态页上的容量波动。
时间段也有讲究。24 起里有 13 起开始于美国东部时间工作日的上午 9 点到下午 6 点,这个时间窗只占一周总时数的 27%,所以美国工作时间承担的故障大约是其应占份额的两倍。
某个 Claude 模型过载时,应该换成哪个?
Claude Haiku 4.5 是最稳妥的选择。2026 年 8 月和 9 月点名具体模型的 12 起故障中,它只出现在 1 起里,而 Claude Sonnet 5 出现在 7 起里。数据来自对 status.claude.com 故障标题的统计,查看日期为 2026 年 10 月 3 日。一起故障可能点名多个模型,所以这一列加起来会超过 12。
| 故障标题中点名的模型 | 2026 年 8、9 月的故障数 | 最长时长 |
|---|---|---|
| Claude Sonnet 5 | 7 | 95 分钟 |
| Claude Fable 5 或 5.1 | 4 | 95 分钟 |
| Claude Mythos 5 或 5.1 | 3 | 95 分钟 |
| Claude Opus 5 | 3 | 93 分钟 |
| Claude Haiku 4.5 | 1 | 80 分钟 |
这个规律和 Anthropic 自己的建议一致。Claude Code 在 Opus 繁忙时的提示是让你“use /model to switch to Sonnet”。当出问题的是 Sonnet 时,就换 Opus 或 Haiku。按任务来选:改写或快速问答用 Haiku,难的部分用 Opus,下一条消息再换回你常用的模型。
Claude 的 529 overloaded_error 是什么意思?
529 overloaded_error 是 Claude API 在告诉你,它此刻没有容量处理你的请求。请求本身没有问题。Anthropic 的 API 错误参考(2026 年 10 月 3 日查看)把它定义为“The API is temporarily overloaded”,并提醒说 529 错误“can occur when the API experiences high traffic across all users.” 有三个长得很像的错误,处理办法各不相同:
| 错误码和类型 | 谁的问题 | 怎么做 |
|---|---|---|
529 overloaded_error | Anthropic 的容量问题,所有客户都一样 | 退避并重试,然后把请求发给另一个模型 |
429 rate_limit_error | 你的组织:触发了速率限制、月度支出上限,或流量陡增 | 放慢速度;支出上限引起的 429 会“keeps failing until access resumes” |
500 api_error | 意外的内部错误 | 用指数退避重试;如果持续出现,带上请求 ID 联系支持 |
504 timeout_error | 耗时很长的请求超时了 | 使用流式传输或 Message Batches API |
流式代码里有一个陷阱:API 已经返回 200 之后,错误仍可能以流内错误事件的形式到达。如果你只检查 HTTP 状态码,就会漏掉在回答中途出现的过载。
过载错误会占用你的 Claude 用量上限吗?
不会。Claude Code 的错误参考用一句话说清了:“A 529 is not your usage limit and doesn't count against your quota.” 你的用量上限是一个 token 额度,从会话的第一条消息起五小时后重置。它的提示会写明重置时间,这种情况请看 Claude usage limit reached。过载不会给出时间,因为你的账户没有任何变化。
多付钱买到的是优先级,不是免疫。Claude Max 在 Anthropic 定价页(2026 年 10 月 3 日查看)上列出了“Priority access at high traffic times”,这是 Anthropic 唯一针对容量出售的套餐条目。上面统计的每一起故障,都是针对 claude.ai、API 或 Claude Code 整体发布的,没有哪个套餐被排除在外。Claude Pro vs Claude Max 分析了更高档的套餐还能买到什么。
怎样让 Claude Code 和 API 自动切换备用模型?
给 Claude Code 设一条备用链,给你的 API 客户端一份模型列表,这样过载就会变成一次切换,而不是一次失败。Claude Code 可以用 claude --fallback-model sonnet,haiku 为单次会话设置,也可以在设置里写 "fallbackModel": ["claude-sonnet-5", "claude-haiku-4-5"] 长期保留。按 Anthropic 的模型配置文档,主模型过载或不可用时,它会按顺序尝试列表里的模型。一条链最多三个模型,而且只对当前这一轮生效,所以下一条消息还会先试你的主模型。启动时不会有任何确认信息,你看到的第一个提示就是切换本身。
对长时间运行的任务,还有两个设置值得注意。CLAUDE_CODE_MAX_RETRIES 可以改掉默认的 10 次重试,CLAUDE_CODE_RETRY_WATCHDOG=1 则让无人值守的会话对 429 和 529 容量错误无限重试,而不是直接失败(见环境变量)。
在 API 方面,Anthropic 的 SDK 对 5xx 错误“twice by default”做指数退避重试,并且遵守 retry-after 响应头。批处理任务可以调大 max_retries,然后自己捕获 529:在 Python 里用 except anthropic.APIStatusError as e,检查 e.status_code == 529,再把同样的消息发给列表里的下一个模型。顺便从 Claude Code 学一条规则:遇到速率限制、计费或认证错误时,它从不切换模型,因为换模型解决不了你自己账户的问题。
所有 Claude 模型都过载时,60 秒的备用方案是什么?
换另一家厂商的模型,把你的对话贴过去,前提是账号已经注册好了,才能在一分钟内完成。用一段话把任务写成摘要(目标、已经定下的事、最后一次成功的操作),存在备忘录里,贴到 GPT 或 Gemini 中接着做。姊妹篇ChatGPT 宕机时用什么列出了其他服务商及其状态页。
发布本文的 Whizi 把 Claude 和 GPT、Gemini 放在同一个聊天里。在对话中途切换模型,会把现有对话发给新选的模型(切换如何运作),而且生成失败会退款,不会扣费。它的短板是:在 Whizi 里发给 Claude 的消息依然会到达 Anthropic,所以涉及多个模型的故障也会让 Whizi 里的 Claude 一并不可用,解法同样是切换到 GPT 或 Gemini。Starter 只有 Claude Haiku,Claude Sonnet 和 Opus 需要每月 $29.99 的 Pro。所有套餐都限制为每小时 60 条消息。Whizi 没有开发者 API,既替代不了 Claude Code,也替代不了你的 API 备用方案(Whizi 中的 Claude)。
- 刷新任何东西之前,先复制没发出去的消息
- 在选择器里或用 /model 换成另一个 Claude 模型;容量是按模型分别计算的
- 打开 status.claude.com:故障只点名一个模型就换模型,点名多个模型就换厂商
- 一分钟后只重试一次;Claude Code 已经自动重试了最多 10 次
- 设置
claude --fallback-model sonnet,haiku或fallbackModel列表,下次过载时自动切换 - 准备好另一家厂商的账号,并备一段一段话的任务摘要
常见问题
Claude 过载错误会持续多久?
容量提示通常几分钟内就会消失,Anthropic 也说过几分钟后再试。状态页上发布的故障则持续更久。2026 年 8 月和 9 月 status.claude.com 上的 24 起模型故障,持续时间中位数为 82 分钟:点名具体模型的是 35 分钟,同时波及多个模型的是 112 分钟。
为什么 Claude 说它现在容量已满?
因为所有用户的需求超过了你所用模型的容量,与你的账户无关。Anthropic 帮助中心称这属于正常的负载管理,会“as demand patterns shift throughout the day”而缓解。这类情况不会发布到状态页上。最快的办法是在选择器里换成另一个 Claude 模型。
Claude 过载和 Claude 宕机是一回事吗?
不是。过载是某个模型的容量不足,而服务本身仍在运行;宕机则是 status.claude.com 上发布的一起故障。2026 年 8 月和 9 月发布的 24 起模型故障中,有一半点名了具体模型,所以即使在故障期间,另一个 Claude 模型往往仍然能回答。