Fehlerbehebung · Verfügbarkeit

Was 529 Overloaded tatsächlich bedeutet

Laut der offiziellen Fehlerreferenz von Claude Code (Stand 2026-10-08) bedeutet ein 529, dass die API vorübergehend ausgelastet ist – es ist nicht Ihr Nutzungslimit und wird nicht auf Ihr Kontingent angerechnet. Eine Änderung an Ihrem Code hilft nicht; eine Änderung Ihrer Retry-Strategie schon.

Aktualisiert 2026-10-08

Abo-Kontingent aufgebraucht oder ständig 429? Wechseln Sie zu einer API mit Bezahlung pro Token und arbeiten Sie mit einem Key weiter.

#Claude API#529#Overloaded#Retry-Strategie

Vier Punkte

529

Überlastung beim Anbieter

Wird zurückgegeben, wenn die serverseitige Kapazität knapp ist. Unabhängig vom Kontingent Ihres Keys, Ihren Parametern oder dem Request-Body.

429

Sie werden per Rate Limit gedrosselt

Dieser Fehler bedeutet, dass Sie Ihre eigene Rate oder Ihr eigenes Kontingent überschritten haben. 529 und 429 erfordern unterschiedliche Behandlung – teilen Sie sich keinen Codepfad.

Backoff

Die einzige wirksame Maßnahme auf Client-Seite

Exponentielles Backoff mit Jitter. Sofortige Wiederholungen verschärfen die Überlastung und führen schneller zu einem Rate Limit.

Mehrere Routen

Strukturelle Entschärfung

Wenn dieselbe Arbeit bei einem anderen Anbieter landen kann, bedeutet ein überlasteter Anbieter keinen Ausfall mehr. Der Preis dafür: Sie müssen Unterschiede zwischen den Modellen in Kauf nehmen.

Wie sich 529 von 429 und 503 unterscheidet

529 bedeutet, dass der Server gerade überlastet ist – ein Kapazitätsproblem, meist vorübergehend. 429 bedeutet, dass Sie Ihre eigene Rate- oder Kontingentgrenze erreicht haben – ein Kontingentproblem. 503 bedeutet in der Regel, dass der Dienst nicht verfügbar ist oder gewartet wird. Keiner dieser Codes heißt, dass Ihre Anfrage fehlerhaft war, aber die Behandlung unterscheidet sich: Bei 529 sind Backoff und Wiederholung angebracht, bei 429 langsameres Senden oder höhere Limits, bei 503 Abwarten und ein Blick auf die Statusseite. Alle drei in einem einzigen catch-Block zusammenzufassen, ist der häufigste Fehler bei der Fehlerbehandlung.

Warum die Diskussion regelmäßig wieder aufflammt

Immer wenn ein neues Modell erscheint oder eine große Migration stattfindet, wird die Kapazität beim Anbieter für eine Weile knapp, und die Diskussion über 529 nimmt zu. Diese Wellen klingen meist ab, sobald Kapazität hinzukommt – für jemanden mit einer Deadline ist das Warten auf den Ausbau durch den Anbieter aber keine Option.

Reihenfolge der Diagnose

Erstens

Bestätigen Sie, dass der Statuscode wirklich 529 und nicht 429 ist. Die Response-Bodys unterscheiden sich; zählen Sie beide in Ihren Logs getrennt.

Zweitens

Prüfen Sie die Statusseite des Anbieters. Bei einem breiten Vorfall ist jede Änderung auf Client-Seite bestenfalls eine Linderung.

Drittens

Prüfen Sie, ob Ihre eigene Retry-Logik die Überlastung verstärkt: fehlender Jitter, fehlende Obergrenze und sofortige Wiederholung verstärken sie alle. In Claude Code lässt sich seit Version 2.1.292 (2026-10-06) die Basisverzögerung für 529-Wiederholungen mit CLAUDE_CODE_OVERLOADED_RETRY_BASE_DELAY_MS verlängern.

Klären Sie vor dem erneuten Versuch, welchen Code Sie tatsächlich erhalten haben

Was gesichert ist

Ein 529 signalisiert eine serverseitige Kapazitätsüberlastung und hat nichts mit dem Inhalt der Anfrage zu tun – diese Semantik ist in der Dokumentation der Modellhersteller festgehalten. Die offizielle Fehlerreferenz von Claude Code (geprüft am 2026-10-08) zeigt die Meldung „API Error: Repeated 529 Overloaded errors. The API is at capacity — this is usually temporary.“ und hält fest: „A 529 is not your usage limit and doesn't count against your quota.“ Ein 529 ist also nicht Ihr Nutzungslimit und wird nicht auf Ihr Kontingent angerechnet. Da die Kapazität pro Modell erfasst wird, können Sie mit /model auf ein anderes Modell wechseln und weiterarbeiten. Laut Claude-Code-CHANGELOG sendet ein fehlschlagender Modellaufruf seit 2.1.286 mit den Standard-Retry-Einstellungen höchstens 14 Anfragen, und 2.1.292 hat CLAUDE_CODE_OVERLOADED_RETRY_BASE_DELAY_MS hinzugefügt. Exponentielles Backoff mit Jitter ist eine vielfach bewährte clientseitige Reaktion.

Nicht als Tatsache behandeln

Behauptungen wie „529 bedeutet, dass der Anbieter Vielnutzer stillschweigend drosselt“ sind nicht belegt und werden hier nicht aufgestellt. Der Unterschied zwischen 529 und 429 ist öffentlich dokumentiert; wer beide vermischt, greift zur falschen Abhilfe.

Zwei Reaktionen

Nur Backoff auf Client-Seite

Einfach umzusetzen und senkt die Zahl der Fehlschläge messbar. Solange der Upstream jedoch überlastet bleibt, können Sie nur abwarten.

Arbeit auf mehrere Upstreams verteilen

Ein überlasteter Anbieter bedeutet nicht mehr automatisch Ausfall. Der Preis dafür: Sie müssen unterschiedliche Eigenheiten der Modelle in Kauf nehmen, und jede Route hat ihre eigenen Fehlerbilder.

Retries richtig umsetzen

Drei Punkte. Erstens: exponentielles Backoff statt eines festen Intervalls – eine Sekunde warten, dann jedes Mal verdoppeln. Zweitens: zufälligen Jitter hinzufügen – wenn alle Clients gleich lange warten, wiederholen sie synchron in einer Welle, was die Überlastung verlängert. Drittens: Obergrenzen sowohl für die Anzahl der Wiederholungen als auch für die Gesamtwartezeit setzen, sonst wächst Ihre Aufgabenwarteschlange bei einer einzigen Überlastung unbegrenzt. Außerdem gilt: Bricht eine Streaming-Anfrage mittendrin ab, wiederholen Sie nicht blind von vorn, sondern prüfen Sie zuerst, ob sich das bereits Empfangene fortsetzen lässt. Wenn Sie Claude Code nutzen: Laut Dokumentation wiederholt es vorübergehende Fehler automatisch bis zu 10 Mal mit exponentiellem Backoff, bevor es einen Fehler anzeigt (erneut geprüft am 2026-10-08); Version 2.1.286 (GitHub-Release vom 2026-09-30) hat die Zählung der Wiederholungen geändert – laut Changelog „one limit now covers a whole model call, so with the default retry settings a failing call sends at most 14 requests“, also deckt ein Limit den ganzen Modellaufruf ab, und mit den Standardeinstellungen sendet ein fehlschlagender Aufruf höchstens 14 Anfragen; und Version 2.1.292 (GitHub-Release vom 2026-10-06) hat die Umgebungsvariable CLAUDE_CODE_OVERLOADED_RETRY_BASE_DELAY_MS eingeführt – laut Changelog „to set a longer base delay for the backoff when retrying an overloaded (529) request“, also um für Wiederholungen nach einem 529 eine längere Basisverzögerung des Backoffs festzulegen. Einen Standardwert für diese Variable nennt der Changelog nicht, und diese Seite rät keinen.

Was QCode hier leisten kann und was nicht

Was möglich ist: Mit einem Key wechseln Sie bei Überlastung zu einer anderen Modellfamilie, statt auf die Erholung eines einzelnen Modells zu warten. Was nicht möglich ist: Wir sind nicht der Modellhersteller und können dessen Serverkapazität nicht ändern; auch Anfragen über QCode können fehlschlagen. Wir bieten die Möglichkeit, die Modellfamilie zu wechseln, kein Versprechen makelloser Verfügbarkeit.

FAQ

Sollte ich meine Anfrageparameter ändern, wenn ich einen 529 erhalte?

Nein. 529 hat nichts mit dem Inhalt der Anfrage zu tun; weder das Ändern von max_tokens oder von Modellparametern noch das Kürzen des Prompts lässt den Fehler verschwinden. Ändern Sie stattdessen die Retry-Strategie.

Kann ich für 529 und 429 dieselbe Retry-Logik verwenden?

Nicht empfehlenswert. Bei 529 sollten Sie abwarten und dieselbe Anfrage erneut senden; 429 bedeutet, dass Sie Ihre Senderate senken oder Ihre Limits erhöhen müssen – blinde Wiederholungen lösen das Limit immer wieder aus.

Wie lange sollte ich warten?

Üblich ist ein Start bei einer Sekunde, die sich mit jedem Versuch verdoppelt, mit zufälligem Jitter sowie Obergrenzen für die Zahl der Wiederholungen und die Gesamtwartezeit. Die genauen Werte hängen davon ab, wie viel Latenz Ihre Aufgabe verträgt. In Claude Code (offizielle Dokumentation und CHANGELOG, Stand 2026-10-08): CLAUDE_CODE_MAX_RETRIES legt die Zahl der Wiederholungen fest, Standard 10; seit 2.1.286 sendet ein fehlschlagender Modellaufruf mit den Standardeinstellungen höchstens 14 Anfragen; seit 2.1.292 können Sie mit CLAUDE_CODE_OVERLOADED_RETRY_BASE_DELAY_MS eine längere Basisverzögerung für Wiederholungen nach einem 529 festlegen.

Was ist, wenn eine Streaming-Anfrage mittendrin einen 529 erhält?

Prüfen Sie zuerst, ob das bereits Empfangene brauchbar ist. Wenn ja, setzen Sie fort; nur wenn nicht, wiederholen Sie die gesamte Anfrage. Ein blinder Neustart verursacht doppelte Abrechnung und verschärft die Überlastung.

Bekommt auch QCode 529-Fehler?

Ja, das kann vorkommen. Die Überlastung bei den Modellherstellern ist real, und auch wir sind davor nicht gefeit. Wir können dieselbe Arbeit auf eine andere Modellfamilie verlagern – wir versprechen aber nicht, dass keine Fehler auftreten.

Bedeutet Multi-Route, dass es keinen Single Point of Failure gibt?

Nein. Mehrere Routen senken die Wahrscheinlichkeit, dass ein einzelner Ausfall Ihre Arbeit stoppt, aber jede Route hat ihre eigenen Fehlerbilder, und auch die Routing-Schicht selbst kann ausfallen. Das ist eine Abmilderung, keine Beseitigung.

Quellen

Die Semantik der Statuscodes folgt der offiziellen API-Dokumentation des jeweiligen Modellherstellers. Das Retry-Verhalten von Claude Code und CLAUDE_CODE_OVERLOADED_RETRY_BASE_DELAY_MS stammen aus dem Claude-Code-CHANGELOG von Anthropic (Einträge 2.1.286 und 2.1.292), den GitHub-Release-Seiten beider Versionen und der Fehlerdokumentation von Claude Code, alle am 2026-10-08 abgerufen und geprüft. Diese Seite nennt bewusst keine Verfügbarkeitsquoten von Dritten – solche Zahlen ändern sich im Lauf der Zeit, und wir haben keine verlässliche unabhängige Messung, auf die wir verweisen könnten.

Wenn eine Route überlastet ist, nehmen Sie eine andere

Ein Key für mehrere Modellfamilien – wechseln Sie und arbeiten Sie weiter, wenn eine Route unter Druck steht.

Weiterführende Artikel

Die Semantik der Statuscodes folgt hier der offiziellen Dokumentation des jeweiligen Modellherstellers und kann sich zwischen Versionen ändern; die Angaben zu Claude Code wurden am 2026-10-08 mit dem offiziellen CHANGELOG und der Dokumentation abgeglichen, die maßgeblich bleiben. Nichts auf dieser Seite ist eine Verfügbarkeitszusage.

Erst testen, dann entscheiden

Unsicher bei der Tarifwahl? Beginnen Sie mit Starter ($8.57/Monat) und wechseln Sie auf einen höheren Tarif, wenn Sie zufrieden sind — der ungenutzte Wert des alten Tarifs geht auf Ihr Guthaben zurück.