Zurück zu den Leitfäden
Fehlerbehebung·15. September 2026·6 Min. Lesezeit

Claude API 529 overloaded_error — was es bedeutet und wie man es übersteht

529 ist der eine Claude-Fehler, den dein Code nicht verursacht hat: Anthropic selbst ist überlastet. Du kannst das nicht beheben, sondern nur kontrolliert abfangen. Das bedeutet geduldige Retries, ein Fallback-Modell und niemals eine Verschärfung des Ausfalls durch sofortige Retry-Stürme.

529 ist der eine Claude-Fehler, den dein Code nicht verursacht hat: Anthropic selbst ist überlastet. Du kannst das nicht beheben, sondern nur kontrolliert abfangen. Das bedeutet geduldige Retries, ein Fallback-Modell und niemals eine Verschärfung des Ausfalls durch sofortige Retry-Stürme.

Der Fehler

응답 (HTTP 529)
{
  "type": "error",
  "error": { "type": "overloaded_error",
             "message": "Overloaded" }
}

Ursachen und Lösungen im Überblick

UrsacheLösung
Überlastung auf Anbieterseite (Tage mit neuen Modellveröffentlichungen, regionale Ausfälle). Sie tritt gleichzeitig bei allen Kunden auf.Warten Sie mit Backoff und Jitter. Deployen Sie die App nicht erneut, sondern prüfen Sie die Statusseite von Anthropic.
Dein Burst-Traffic traf während eines bereits angespannten Ausfalls ein.Batchaufgaben zeitlich verteilen; eine Verzögerung von 10 Minuten behebt das meistens.
Verwechslung mit 429. In den Logs sehen sie ähnlich aus, aber die Ursachen sind völlig verschieden.429 bedeutet, dass du dein Limit überschritten hast (der Server ist normal), 529 bedeutet, dass der Server überlastet ist (dein Limit und dein Guthaben sind normal). Nur 429 enthält den Hinweis Retry-After.
Es ist kein Fallback definiert, sodass das Anbieterproblem unverändert bis zum Endnutzer weitergereicht wird.Die Reihenfolge der Fallbacks festlegen. Innerhalb derselben Modellfamilie (Sonnet → Haiku) ist das Verhalten ähnlich; über Anbieter hinweg (Claude → GPT) lässt sich auch ein vollständiger Ausfall überstehen.

Retries so gestalten, dass der Ausfall nicht verschärft wird

Behandle 529 wie „429 ohne Retry-After“. Beginne mit exponentiellem Backoff ab etwa 2 Sekunden, füge Jitter hinzu, begrenze die Wartezeit auf 30–60 Sekunden, gib nach ungefähr fünf Versuchen auf und stelle die Aufgabe in eine Warteschlange. Entscheidend ist der Jitter. Ohne ihn kehren alle Clients im selben Moment zurück und verlängern genau die Überlastung, der sie entkommen wollten.

Nicht verwerfen, sondern weiterleiten

Für latenzkritische Pfade eine Fallback-Kette definieren. Bei einem OpenAI-kompatiblen Endpunkt musst du nur eine Zeichenfolge ändern — weder ein neues SDK noch ein neues Konto ist nötig:

failover.py
PREFERRED = ["claude-sonnet-5", "claude-haiku-4-5", "gpt-5-6-terra"]

def complete(messages):
    last = None
    for model in PREFERRED:
        try:
            return client.chat.completions.create(
                model=model, messages=messages, max_tokens=800)
        except APIStatusError as e:
            if e.status_code not in (429, 500, 529):
                raise
            last = e          # 과부하 — 다음 후보로
    raise last

Den eigenen Code erst zuletzt verdächtigen

Wenn nur eine bestimmte Anfrageart mit 529 fehlschlägt, während andere Aufrufe zur selben Zeit funktionieren, handelt es sich nicht um einen vollständigen Ausfall. Prüfe, ob dieser Pfad ungewöhnlich große Prompts sendet oder in einer engen Schleife fortlaufend aufgerufen wird. Wenn dagegen alle Aufrufe gleichzeitig mit 529 fehlschlagen und sich die Lage von selbst beruhigt, ist die Ursache die Kapazität. Dann solltest du Retries und Fallbacks anpassen, nicht den Code refaktorieren.

Wenn Sie Kunavo verwenden

Kunavo leitet Claude über mehrere vorgelagerte Pfade weiter. Dank des Multimodellkatalogs bedeutet der anbieterübergreifende Fallback lediglich, „bei demselben Schlüssel und demselben Guthaben nur den Modellnamen zu ändern“. Du brauchst für den obigen Code kein zweites Konto. Trotzdem werden die aufgetretenen 529-Fehler nicht berechnet. Kapazität und Preis sind zwei verschiedene Fragen. Für die zweite Frage findest du die Preise pro Modell in der Claude-API-Preisliste.

Häufig gestellte Fragen

Ist 529 mein Fehler?

Nein. Es handelt sich um ein Kapazitätsproblem auf Anbieterseite. Deine Verantwortung besteht nur in zwei Punkten: den Ausfall nicht zu verstärken (Backoff und Jitter) und einen Ausweichpfad für den Fall bereitzuhalten, dass der Ausfall länger als die zulässige Latenz dauert.

Was ist der Unterschied zwischen 529 und 429?

429 bedeutet, dass du dein Limit überschritten hast, während der Server normal funktioniert. 529 bedeutet, dass der Server selbst überlastet ist und dein Limit normal ist. Beide Fehler können wiederholt werden, aber nur 429 enthält den Hinweis Retry-After.

Wie lange hält der 529-Status normalerweise an?

Das lässt sich nicht vorhersagen oder garantieren. Daher ist die richtige Lösung ein begrenzter Backoff mit Warteschlange, nicht eine fest im Code verankerte Wartezeit. Wenn der betreffende Pfad eine zulässige Latenz hat, übernimmt der Fallback, statt dass du weiter wartest.

Werden Aufrufe, die mit 529 fehlschlagen, trotzdem berechnet?

Über Kunavo werden sie nicht berechnet. Anfragen, die mit einem Fehler enden, sind nicht abrechenbar. Bei einem direkten Vertrag gelten die Abrechnungsregeln des jeweiligen Anbieters.

Verwandte Anleitungen

Weitere Informationen zur Fehlersemantik finden Sie unter Fehlerreferenz; einen Schlüssel erhalten Sie in einer Minute über Registrierung und die Authentifizierungsanleitung.