Claude überlastet (Fehler 529): erst das Modell wechseln, dann den Anbieter

Kurzantwort

Claude überlastet (HTTP 529, overloaded_error) heißt: Anthropic hat für dieses Modell keine Kapazität mehr, nicht dass du dein Nutzungslimit erreicht hast. Wechsle zuerst das Claude-Modell, dann den Anbieter. Von 24 Modellstörungen auf status.claude.com im August und September 2026 nannte die Hälfte konkrete Modelle; die andere Hälfte traf mehrere Modelle gleichzeitig und dauerte im Median 112 Minuten.

A terracotta Claude starburst on a black plinth behind a row of five chrome hourglasses, each with its sand at a different level.

Was hilft bei "Claude überlastet" in den nächsten 60 Sekunden?

Wechsle im Chat zu einem anderen Claude-Modell und versuche es einmal erneut. Nennt die Statusseite mehrere Modelle, verschiebe den Thread zu einem anderen Anbieter. Der erste Schritt funktioniert, weil die Kapazität laut Anthropics Claude-Code-Fehlerreferenz "is tracked per model" ist. Ein volles Opus sagt also nichts über Haiku. Der Reihe nach:

  1. Kopiere die ungesendete Nachricht aus dem Eingabefeld, bevor du die Seite neu lädst.
  2. Lies den Wortlaut und vergleiche ihn mit der Tabelle unten. Eine Kapazitäts- oder Überlastungsmeldung ist nicht dein Nutzungslimit; eine Meldung mit Reset-Zeit ist es.
  3. Wechsle das Modell. Klicke in claude.ai auf den Modellnamen neben dem Senden-Button; laut Anthropic gilt der Wechsel "starting with Claude's next response", der Thread bleibt also erhalten. Führe in Claude Code /model aus.
  4. Öffne status.claude.com. Ein Vorfall, der ein Modell nennt, bestätigt Schritt 3. Einer mit "multiple models" betrifft jedes Claude-Modell, nimm den Thread dann mit zu GPT oder Gemini.
  5. Versuche es nach einer Minute einmal erneut, nicht zwanzigmal. Claude Code hat bereits bis zu 10 Mal wiederholt, bevor es dir den Fehler zeigt.
Wo du es siehstDie MeldungWas sie bedeutetErste Lösung
claude.ai, Desktop- oder Mobil-Chat"Due to unexpected capacity constraints, Claude is unable to respond to your message. Please try again soon."Nachfrage bei allen Nutzern; laut Anthropic erscheint das nie auf der StatusseiteIn ein paar Minuten erneut versuchen oder Modell wechseln
Claude Code im Terminal"API Error: Repeated 529 Overloaded errors"Das gewählte Modell blieb bei jedem Versuch ausgelastet/model auf ein anderes Modell oder eine Fallback-Kette einrichten
Claude Code, ein ausgelastetes Modell"Opus is experiencing high load, please use /model to switch to Sonnet" (die Desktop-App sagt "Switch to Sonnet.")Kapazität dieses einen ModellsWechseln, wie die Meldung sagt
Claude APIHTTP 529 overloaded_error: "The API is temporarily overloaded."Verkehr "across all users"Pausieren, dann im Code auf ein anderes Modell ausweichen
Jede Claude-App, zum Vergleich"5-hour limit reached - resets [time]"Dein eigenes Nutzungslimit, keine ÜberlastungAuf die angezeigte Zeit warten; ein Modellwechsel hilft nicht

Ist Claude gerade überlastet, oder liegt es nur an dir?

Prüfe status.claude.com (status.anthropic.com leitet dorthin weiter). Dort werden Vorfälle getrennt für claude.ai, die Claude API, Claude Code, Claude Cowork und die Console gemeldet. Eine grüne Seite spricht Claude aber nicht frei. Anthropics Leitfaden zu Fehlermeldungen, aktualisiert am 18. Mai 2026, sagt, die Kapazitätsmeldung sei Lastmanagement: "Capacity issues will not appear on our status page because they represent normal load management rather than technical problems." Eine Kapazitätsmeldung bei grüner Seite ist die kurze Sorte. Ein gemeldeter Vorfall ist die lange Sorte, und wir haben gemessen, wie lange.

Vorfälle mit genannten Modellen endeten binnen 95 Minuten; breitere dauerten 7 Stunden
02468StundenNur genannteModelle (12)15 min95 minkürzestelängsteMedian 35 minMehrere oder alleModelle (12)26 min429 minkürzestelängsteMedian 112 min

Am 3. Oktober 2026 haben wir jeden Vorfall in der Historie von status.claude.com für August und September 2026 gelesen. Von 38 Vorfällen waren 24 Modellfehler oder eingeschränkte Modellleistung. Der Rest betraf Logins, Abrechnung, Konnektoren und einzelne Apps. Zwölf Titel nannten konkrete Modelle, etwa "Elevated errors for Claude Sonnet 5". Sie dauerten vom gemeldeten Beginn bis zur Entwarnung im Median 35 Minuten, nie länger als 95. Die anderen 12 sprachen von "multiple models", "all models" oder jedem Claude-Dienst und dauerten im Median 112 Minuten. Der längste, am 5. August, dauerte 429 Minuten. Nennt der Vorfall Modelle, ist ein anderes Claude-Modell die Lösung. Tut er es nicht, kostet Warten etwa zwei Stunden. Die "2 bis 5 Minuten", die andere Ratgeber nennen, beschreiben nur die Kapazitätsspitzen, die nie auf der Statusseite landen.

Auch der Zeitpunkt zählt. Dreizehn der 24 begannen an einem Werktag zwischen 9 und 18 Uhr Eastern, einem Fenster, das 27 % der Wochenstunden ausmacht. Die US-Arbeitszeit trug also etwa doppelt so viel, wie ihr Anteil erwarten ließe.

Zu welchem Claude-Modell solltest du wechseln, wenn eines überlastet ist?

Claude Haiku 4.5 ist der sicherste Wechsel. Es wurde im August und September 2026 in 1 der 12 Vorfälle genannt, die konkrete Modelle nannten, gegenüber 7 bei Claude Sonnet 5. Gezählt anhand der Vorfallstitel auf status.claude.com, gelesen am 3. Oktober 2026. Ein Vorfall kann mehrere Modelle nennen, deshalb ergibt die Spalte mehr als 12.

Im Vorfallstitel genanntes ModellVorfälle, Aug und Sep 2026Längster
Claude Sonnet 5795 min
Claude Fable 5 oder 5.1495 min
Claude Mythos 5 oder 5.1395 min
Claude Opus 5393 min
Claude Haiku 4.5180 min

Das Muster passt zu Anthropics eigenem Rat. Claude Codes Meldung für ein ausgelastetes Opus sagt "use /model to switch to Sonnet". Hat Sonnet Probleme, ist Opus oder Haiku der Weg. Wähle nach Aufgabe: Haiku für eine Umformulierung oder eine schnelle Antwort, Opus für den schwierigen Teil, und kehre mit der nächsten Nachricht zu deinem üblichen Modell zurück.

Was bedeutet der Claude-Fehler 529 overloaded_error?

Ein 529 overloaded_error heißt, dass die Claude API gerade keine Kapazität für deine Anfrage hat. Die Anfrage selbst ist in Ordnung. Anthropics API-Fehlerreferenz, gelesen am 3. Oktober 2026, definiert ihn als "The API is temporarily overloaded" und warnt, 529-Fehler "can occur when the API experiences high traffic across all users." Drei ähnliche Fehler brauchen andere Lösungen:

Code und TypWessen ProblemWas tun
529 overloaded_errorAnthropics Kapazität, für alle KundenPausieren und wiederholen, dann die Anfrage an ein anderes Modell schicken
429 rate_limit_errorDeine Organisation: ein Ratenlimit, ein monatliches Ausgabenlimit oder ein steiler Anstieg des VerkehrsLangsamer senden; ein 429 wegen Ausgabenlimit "keeps failing until access resumes"
500 api_errorEin unerwarteter interner FehlerMit exponentiellem Backoff wiederholen; bei Fortbestehen den Support mit der Request-ID kontaktieren
504 timeout_errorEine lange Anfrage mit ZeitüberschreitungStreaming oder die Message Batches API nutzen

Eine Falle im Streaming-Code: Ein Fehler kann eintreffen, nachdem die API schon mit 200 geantwortet hat, als Fehler-Event im Stream. Prüfst du nur den HTTP-Status, übersiehst du eine Überlastung, die mitten in der Antwort auftritt.

Zählt ein Überlastungsfehler gegen dein Claude-Nutzungslimit?

Nein. Die Fehlerreferenz von Claude Code sagt es in einer Zeile: "A 529 is not your usage limit and doesn't count against your quota." Dein Nutzungslimit ist ein Token-Budget, das fünf Stunden nach der ersten Nachricht der Sitzung zurückgesetzt wird. Seine Sperre nennt eine Reset-Zeit, und Claude-Nutzungslimit erreicht behandelt genau diesen Fall. Eine Überlastung nennt keine Zeit, weil sich an deinem Konto nichts geändert hat.

Mehr zu zahlen kauft Priorität, keine Immunität. Claude Max führt "Priority access at high traffic times" auf Anthropics Preisseite auf, gelesen am 3. Oktober 2026, und das ist die einzige Planzeile, die Anthropic gegen Kapazitätsengpässe verkauft. Jeder Vorfall in der obigen Zählung wurde für claude.ai, die API oder Claude Code insgesamt gemeldet, ohne dass ein Tarif ausgenommen war. Claude Pro vs Claude Max wägt ab, was der größere Tarif sonst noch bringt.

Wie lassen sich Claude Code und die API von selbst auf ein anderes Modell umstellen?

Gib Claude Code eine Fallback-Kette und deinem API-Client eine Modellliste, damit aus einer Überlastung ein Wechsel statt eines Fehlers wird. Claude Code akzeptiert claude --fallback-model sonnet,haiku für eine Sitzung oder "fallbackModel": ["claude-sonnet-5", "claude-haiku-4-5"] in den Einstellungen, um sie dauerhaft zu behalten. Laut Anthropics Docs zur Modellkonfiguration probiert es die Einträge der Reihe nach durch, wenn das Hauptmodell überlastet oder nicht verfügbar ist. Eine Kette ist auf drei Modelle begrenzt und wechselt nur für den aktuellen Zug, die nächste Nachricht probiert also wieder dein Hauptmodell. Beim Start wird die Kette nicht bestätigt. Der erste Hinweis ist der Wechsel selbst.

Zwei weitere Einstellungen zählen bei langen Aufgaben. CLAUDE_CODE_MAX_RETRIES ändert den Standardwert von 10 Wiederholungen, und CLAUDE_CODE_RETRY_WATCHDOG=1 lässt eine unbeaufsichtigte Sitzung 429- und 529-Kapazitätsfehler unbegrenzt wiederholen, statt zu scheitern (Umgebungsvariablen).

Bei der API wiederholen Anthropics SDKs 5xx-Fehler "twice by default" mit exponentiellem Backoff und beachten den Header retry-after. Erhöhe max_retries für Batch-Arbeit und fange den 529 dann selbst ab: in Python except anthropic.APIStatusError as e, prüfe e.status_code == 529 und sende dieselben Nachrichten an das nächste Modell deiner Liste. Übernimm dabei eine Regel von Claude Code: Es wechselt das Modell nie bei einem Ratenlimit-, Abrechnungs- oder Authentifizierungsfehler, weil ein anderes Modell dein eigenes Konto nicht reparieren kann.

Was ist der 60-Sekunden-Ausweg, wenn jedes Claude-Modell überlastet ist?

Das Modell eines anderen Anbieters mit deinem eingefügten Thread, was nur dann eine Minute dauert, wenn das Konto schon existiert. Halte eine einabsätzige Zusammenfassung der Aufgabe (das Ziel, was entschieden ist, das Letzte, das funktioniert hat) in einer Notiz bereit, füge sie in GPT oder Gemini ein und mach weiter. Der Schwesterratgeber was du nutzt, wenn ChatGPT ausfällt listet die anderen Anbieter und ihre Statusseiten auf.

Whizi, das diese Seite veröffentlicht, hält Claude neben GPT und Gemini in einem Chat bereit. Ein Modellwechsel mitten im Gespräch schickt den bestehenden Thread an das neu gewählte Modell (so funktioniert der Wechsel), und eine fehlgeschlagene Generierung wird erstattet, nicht berechnet. Wo es schlechter abschneidet: Eine Nachricht an Claude in Whizi erreicht weiterhin Anthropic, ein Vorfall über mehrere Modelle legt also auch Whizis Claude-Zeilen lahm. Die Lösung ist derselbe Wechsel zu GPT oder Gemini. Starter hat nur Claude Haiku, und Claude Sonnet und Opus brauchen Pro für $29.99 im Monat. Jeder Tarif ist auf 60 Nachrichten pro Stunde begrenzt. Ohne Entwickler-API ersetzt Whizi weder Claude Code noch deinen API-Fallback (Claude in Whizi).

Checkliste
  • Kopiere die ungesendete Nachricht, bevor du irgendetwas neu lädst
  • Wechsle in der Auswahl oder mit /model zu einem anderen Claude-Modell; die Kapazität wird pro Modell erfasst
  • Öffne status.claude.com: Ein Vorfall mit einem genannten Modell heißt wechseln, einer mit mehreren Modellen heißt Anbieter wechseln
  • Versuche es nach einer Minute einmal erneut; Claude Code hat schon bis zu 10 Mal wiederholt
  • Richte claude --fallback-model sonnet,haiku oder eine fallbackModel-Liste ein, damit die nächste Überlastung von selbst umschaltet
  • Halte das Konto eines zweiten Anbieters bereit, mit einer einabsätzigen Aufgabenzusammenfassung

Häufige Fragen

Wie lange dauert der Fehler "Claude überlastet"?

Eine Kapazitätsmeldung klärt sich meist binnen Minuten, und Anthropic rät, es in ein paar Minuten erneut zu versuchen. Ein gemeldeter Vorfall dauert länger. Die 24 Modellstörungen auf status.claude.com im August und September 2026 dauerten im Median 82 Minuten, 35, wenn sie konkrete Modelle nannten, und 112, wenn sie mehrere gleichzeitig trafen.

Warum sagt Claude, es sei gerade ausgelastet?

Weil die Nachfrage aller Nutzer die Kapazität des gewählten Modells übersteigt, nicht wegen etwas an deinem Konto. Anthropics Hilfecenter nennt es normales Lastmanagement, das sich löst, "as demand patterns shift throughout the day". Es wird nicht auf der Statusseite gemeldet. Der schnellste Ausweg ist ein Wechsel zu einem anderen Claude-Modell in der Auswahl.

Ist "Claude überlastet" dasselbe wie ein Ausfall von Claude?

Nein. Eine Überlastung bedeutet, dass die Kapazität für ein Modell knapp ist, während der Dienst läuft. Ein Ausfall ist ein gemeldeter Vorfall auf status.claude.com. Im August und September 2026 nannte die Hälfte der 24 gemeldeten Modellvorfälle konkrete Modelle, sodass selbst während eines Vorfalls oft noch ein anderes Claude-Modell antwortete.

Noch eine Frage?

Schreib sie hier hin. Sobald du registriert bist, beantwortet Whizi sie.