
接下來 60 秒,怎麼解決 Claude 過載?
把對話換成另一個 Claude 模型,再重試一次。如果狀態頁點名了好幾個模型,就把這段對話轉到別家廠商。第一步之所以有效,是因為依照 Anthropic 的 Claude Code 錯誤參考文件,容量是「按模型各自計算」(is tracked per model)。所以 Opus 滿載,並不代表 Haiku 也滿載。依序這樣做:
- 先複製尚未送出的訊息,再去碰重新整理。
- 對照下表的用字。 容量或過載訊息不是你的使用上限;附有重置時間的訊息才是。
- 切換模型。 在 claude.ai 點送出按鈕旁的模型名稱;Anthropic 表示變更會「從 Claude 的下一則回覆開始」生效,所以對話會保留。在 Claude Code 則執行
/model。 - 打開 status.claude.com。 事故只點名一個模型,就證實第 3 步有效。若寫的是「multiple models」,代表所有 Claude 模型都受影響,請把對話帶到 GPT 或 Gemini。
- 等一分鐘後重試一次,不要重試二十次。 Claude Code 在顯示錯誤給你之前,已經自動重試最多 10 次了。
| 你在哪裡看到 | 訊息內容 | 代表什麼 | 第一步 |
|---|---|---|---|
| claude.ai、桌面版或手機版對話 | 「Due to unexpected capacity constraints, Claude is unable to respond to your message. Please try again soon.」 | 所有使用者的需求量;Anthropic 表示這不會出現在狀態頁 | 幾分鐘後重試,或換模型 |
| 終端機裡的 Claude Code | 「API Error: Repeated 529 Overloaded errors」 | 你選的模型在每次重試期間都維持滿載 | 用 /model 換另一個模型,或設定備援鏈 |
| Claude Code,某個忙碌的模型 | 「Opus is experiencing high load, please use /model to switch to Sonnet」(桌面版 app 顯示「Switch to Sonnet.」) | 那一個模型的容量不足 | 照訊息建議切換 |
| Claude API | HTTP 529 overloaded_error:「The API is temporarily overloaded.」 | 流量來自「所有使用者」 | 先退避,再用程式改走另一個模型 |
| 任何 Claude app,作為對照 | 「5-hour limit reached - resets [time]」 | 你自己的使用上限,不是過載 | 等到顯示的時間;換模型沒有幫助 |
Claude 現在是過載了,還是只有你遇到?
請查看 status.claude.com(status.anthropic.com 會導向這裡),它會把 claude.ai、Claude API、Claude Code、Claude Cowork 和 Console 的事故分開發布。不過狀態頁一片綠,並不代表 Claude 沒事。Anthropic 的錯誤訊息指南(2026 年 5 月 18 日更新)說,容量訊息屬於負載管理:「Capacity issues will not appear on our status page because they represent normal load management rather than technical problems.」狀態頁是綠的卻出現容量訊息,屬於短的那種;狀態頁有公告事故,則是長的那種,而我們量測了到底多長。
2026 年 10 月 3 日,我們讀完了 status.claude.com 歷史紀錄中 2026 年 8、9 月的每一起事故。38 起事故中,有 24 起是模型錯誤或模型效能下降,其餘是登入、帳單、連接器和單一 app 的問題。其中 12 起的標題點名了特定模型,例如「Elevated errors for Claude Sonnet 5」。從公告開始到標示解決,中位數為 35 分鐘,最長不超過 95 分鐘。另外 12 起寫的是「multiple models」、「all models」或所有 Claude 服務,中位數為 112 分鐘。最長的一起發生在 8 月 5 日,持續了 429 分鐘。事故點名模型時,換另一個 Claude 模型就是解法;沒有點名時,等待大約要花兩小時。其他指南常說的「2 到 5 分鐘」,只適用於那些根本不會出現在狀態頁的容量小波動。
時段也有影響。24 起中有 13 起發生在美東時間平日上午 9 點到下午 6 點之間,這個時段只占一週時數的 27%,所以美國上班時間承受的事故約為其比例的兩倍。
某個模型過載時,該換成哪個 Claude 模型?
Claude Haiku 4.5 是最安全的選擇。2026 年 8、9 月點名特定模型的 12 起事故中,它只出現在 1 起,而 Claude Sonnet 5 出現在 7 起。這是依 status.claude.com 事故標題統計,2026 年 10 月 3 日讀取。一起事故可能點名多個模型,所以這一欄加起來會超過 12。
| 事故標題中點名的模型 | 事故數,2026 年 8、9 月 | 最長 |
|---|---|---|
| Claude Sonnet 5 | 7 | 95 分鐘 |
| Claude Fable 5 或 5.1 | 4 | 95 分鐘 |
| Claude Mythos 5 或 5.1 | 3 | 95 分鐘 |
| Claude Opus 5 | 3 | 93 分鐘 |
| Claude Haiku 4.5 | 1 | 80 分鐘 |
這個規律與 Anthropic 自己的建議一致。Claude Code 在 Opus 忙碌時的訊息,是叫你「use /model to switch to Sonnet」。輪到 Sonnet 出問題時,就改用 Opus 或 Haiku。依工作選擇:改寫或快速問答用 Haiku,困難的部分用 Opus,下一則訊息再回到你平常用的模型。
Claude 的 529 overloaded_error 是什麼意思?
529 overloaded_error 是 Claude API 在告訴你,它現在沒有容量處理你的請求,請求本身沒有問題。Anthropic 的 API 錯誤參考文件(2026 年 10 月 3 日讀取)將它定義為「The API is temporarily overloaded」,並提醒 529 錯誤「can occur when the API experiences high traffic across all users.」另外有三個看起來很像、但處理方式不同的錯誤:
| 代碼與類型 | 誰的問題 | 該怎麼做 |
|---|---|---|
529 overloaded_error | Anthropic 的容量,所有客戶都一樣 | 先退避重試,再把請求送到另一個模型 |
429 rate_limit_error | 你的組織:速率限制、每月支出上限,或流量急遽上升 | 放慢速度;支出上限造成的 429 會「keeps failing until access resumes」 |
500 api_error | 意外的內部錯誤 | 用指數退避重試;若持續發生,附上 request ID 聯絡支援 |
504 timeout_error | 請求太長而逾時 | 改用串流或 Message Batches API |
串流程式碼有一個陷阱:API 可能已經回了 200,錯誤才以串流中的錯誤事件抵達。如果你只檢查 HTTP 狀態,就會漏掉在回答進行到一半時才出現的過載。
過載錯誤會算進你的 Claude 使用上限嗎?
不會。Claude Code 的錯誤參考文件用一句話說明:「A 529 is not your usage limit and doesn't count against your quota.」你的使用上限是一份 token 額度,在工作階段第一則訊息的五小時後重置。它的提示會寫出重置時間,這部分請看 Claude 已達使用上限。過載不會寫出任何時間,因為你的帳號沒有任何變化。
多付錢買到的是優先權,不是免疫。Claude Max 在 Anthropic 定價頁(2026 年 10 月 3 日讀取)列有「Priority access at high traffic times」,這是 Anthropic 唯一針對容量販售的方案項目。上面統計的每一起事故,都是針對整個 claude.ai、API 或 Claude Code 發布,沒有哪個方案被排除在外。Claude Pro 與 Claude Max 比較會說明更高階的方案還買到什麼。
如何讓 Claude Code 和 API 自動切換備援?
替 Claude Code 設定備援鏈,替 API 用戶端準備一份模型清單,過載就會變成一次切換,而不是一次失敗。Claude Code 可用 claude --fallback-model sonnet,haiku 在單次工作階段中啟用,或在設定檔寫入 "fallbackModel": ["claude-sonnet-5", "claude-haiku-4-5"] 長期保留。依 Anthropic 的模型設定文件,主要模型過載或無法使用時,它會依序嘗試清單中的項目。一條鏈最多三個模型,而且只在當次回合切換,所以下一則訊息會再試你的主要模型。啟動時不會有任何確認,你看到的第一個通知就是切換本身。
長時間的工作還有兩個設定很重要。CLAUDE_CODE_MAX_RETRIES 可以改掉預設的 10 次重試,而 CLAUDE_CODE_RETRY_WATCHDOG=1 會讓無人看管的工作階段對 429 和 529 容量錯誤無限重試,而不是直接失敗(環境變數)。
在 API 方面,Anthropic 的 SDK 會對 5xx 錯誤「twice by default」以指數退避重試,並遵守 retry-after 標頭。批次工作可以調高 max_retries,然後自己攔截 529:在 Python 中用 except anthropic.APIStatusError as e,檢查 e.status_code == 529,再把相同的 messages 送到清單中的下一個模型。同時借用 Claude Code 的一條規則:遇到速率限制、帳單或驗證錯誤時,絕不切換模型,因為換模型修不了你自己帳號的問題。
當所有 Claude 模型都過載時,60 秒的備案是什麼?
改用另一家廠商的模型,並貼上你的對話內容;只有在帳號已經存在時,才做得到一分鐘內完成。把任務寫成一段摘要(目標、已決定的事、最後有效的做法)存在筆記裡,貼到 GPT 或 Gemini,然後繼續。姊妹篇ChatGPT 掛掉時該用什麼列出了其他供應商和它們的狀態頁。
發布這篇文章的 Whizi,把 Claude 與 GPT、Gemini 放在同一個對話中。在對話途中切換模型,會把現有對話送給新選的模型(切換方式說明),而生成失敗時會退還額度,不會扣款。它的限制在於:在 Whizi 裡傳給 Claude 的訊息仍然會送到 Anthropic,所以跨多個模型的事故也會讓 Whizi 的 Claude 項目一起失效。解法一樣是切到 GPT 或 Gemini。Starter 只有 Claude Haiku,Claude Sonnet 和 Opus 需要每月 $29.99 的 Pro。所有方案都限制每小時 60 則訊息。Whizi 沒有開發者 API,所以不能取代 Claude Code,也不能取代你 API 的備援機制(Whizi 中的 Claude)。
- 重新整理任何東西之前,先複製尚未送出的訊息
- 在模型選單或用 /model 換成另一個 Claude 模型;容量是按模型各自計算
- 打開 status.claude.com:事故只點名一個模型就換模型,點名多個模型就換廠商
- 等一分鐘後重試一次;Claude Code 已經自動重試最多 10 次
- 設定
claude --fallback-model sonnet,haiku或fallbackModel清單,讓下次過載時自動切換 - 備妥第二家廠商的帳號,並準備一段任務摘要
常見問題
Claude 過載錯誤會持續多久?
容量訊息通常在幾分鐘內消失,Anthropic 也建議幾分鐘後再試。狀態頁上公告的事故則持續較久。2026 年 8、9 月 status.claude.com 上的 24 起模型事故,持續時間中位數為 82 分鐘:點名特定模型的為 35 分鐘,同時影響多個模型的為 112 分鐘。
為什麼 Claude 說它現在容量已滿?
因為所有使用者的需求超過了你所用模型的容量,與你的帳號無關。Anthropic 說明中心稱它為正常的負載管理,會「as demand patterns shift throughout the day」而緩解。這類情況不會發布在狀態頁。在選單切換到另一個 Claude 模型,是最快的繞過方式。
Claude 過載和 Claude 當機是同一件事嗎?
不是。過載是某個模型的容量不足,但服務仍在運作;當機則是 status.claude.com 上公告的事故。2026 年 8、9 月公告的 24 起模型事故中,有一半點名特定模型,所以即使在事故期間,另一個 Claude 模型往往仍能回應。