529 ist der einzige Claude-Fehler, der nicht durch dein Programm verursacht wird: Überlastet ist die Anthropic-Seite. Du kannst das nicht beheben, sondern nur sauber abfangen — mit geduldigen Wiederholungsversuchen und Backoff, einem Fallback-Modell für latenzempfindliche Pfade und niemals mit sofortigen Wiederholungen, die den Ausfall durch eine Flut von Anfragen verstärken.
Der Fehler
{
"type": "error",
"error": { "type": "overloaded_error",
"message": "Overloaded" }
}Ursachen und Lösungen im Überblick
| Ursache | Lösung |
|---|---|
| Überlastung beim Anbieter (Veröffentlichung eines neuen Modells, regionaler Ausfall). Alle Kunden sind gleichzeitig betroffen. | Warte mit Backoff und Jitter; prüfe die Statusseite von Anthropic, statt deine eigene Anwendung neu bereitzustellen. |
| Dein eigener Spitzenverkehr trifft genau auf bereits knappe Kapazitäten. | Verteile Batch-Arbeiten zeitlich; normalerweise ist das Problem nach zehn Minuten vorbei. |
| Verwechslung mit 429. In den Logs sehen beide ähnlich aus, ihre Ursachen sind jedoch völlig verschieden. | 429 bedeutet, dass du dein eigenes Limit überschritten hast (der Server ist gesund); 529 bedeutet, dass der Server selbst überlastet ist (dein Kontingent ist in Ordnung). Nur 429 enthält einen Retry-After-Hinweis. |
| Es wurde kein Fallback definiert, sodass das Problem des Anbieters bis zum Endbenutzer durchgereicht wird. | Lege zuerst eine Fallback-Reihenfolge fest — innerhalb derselben Serie (Sonnet → Haiku) ist das Verhalten ähnlicher; anbieterübergreifend (Claude → GPT) überstehst du auch einen Ausfall des gesamten Anbieters. |
Verhindere, dass Wiederholungen den Ausfall verstärken
Behandle 529 wie „429 ohne Retry-After“: exponentieller Backoff ab etwa 2 Sekunden, mit Jitter und einem Limit von 30–60 Sekunden; gib nach ungefähr fünf Versuchen auf und stelle die Aufgabe in eine Warteschlange. Wirklich entscheidend ist der Jitter: Ohne ihn kehren alle Clients im selben Moment zurück und verlängern die Überlastung, der sie entkommen wollten, unverändert.
Nicht ausfallen, sondern ausweichen
Definiere die Fallback-Kette für latenzempfindliche Pfade im Voraus. An einem OpenAI-kompatiblen Endpunkt bedeutet das lediglich, eine Zeichenfolge zu ändern — du brauchst kein zusätzliches SDK und kein weiteres Konto:
PREFERRED = ["claude-sonnet-5", "claude-haiku-4-5", "gpt-5-6-terra"]
def complete(messages):
last = None
for model in PREFERRED:
try:
return client.chat.completions.create(
model=model, messages=messages, max_tokens=800)
except APIStatusError as e:
if e.status_code not in (429, 500, 529):
raise
last = e # 過載 —— 試下一個
raise lastErst zuletzt den eigenen Code verdächtigen
Wenn nur eine bestimmte Anfrage 529 erhält, während andere Aufrufe zur gleichen Zeit funktionieren, liegt kein vollständiger Ausfall vor: Prüfe, ob dieser Pfad ungewöhnlich große Prompts sendet oder in einer kurzen Schleife wiederholt Anfragen stellt. Wenn dagegen alle Aufrufe gleichzeitig 529 liefern und sich nach einiger Zeit von selbst erholen, ist die Ursache die Kapazität — angepasst werden sollten Retries und Fallbacks, nicht die Architektur.
Wenn Sie Kunavo verwenden
Kunavo verteilt Claude auf mehr als einen Upstream-Pfad, und der Multi-Modell-Katalog macht anbieterübergreifende Fallbacks zu einer Sache nach dem Muster „derselbe Schlüssel, dasselbe Guthaben, nur der Modellname ändert sich“ — der obige Code braucht kein zweites Konto. Selbst wenn weiterhin 529-Fehler bei dir ankommen, werden sie nie berechnet. Kapazität und Preis sind zwei verschiedene Fragen; zu Letzterem findest du die Einzelpreise der Modelle in der Preistabelle für die Claude API.
Häufig gestellte Fragen
Ist 529 mein Problem?
Nein. Das ist ein Kapazitätsproblem auf Anbieterseite. Deine beiden Aufgaben bestehen lediglich darin, den Ausfall nicht zu verstärken (Backoff und Jitter) und bei einer Dauer über dein Latenzbudget hinaus eine Ausweichmöglichkeit zu haben.
Was ist der Unterschied zwischen 529 und 429?
429 bedeutet, dass du dein eigenes Limit überschritten hast; der Server ist gesund. 529 bedeutet, dass der Server selbst überlastet ist; dein Kontingent ist in Ordnung. Beide Fehler können wiederholt werden, aber nur 429 enthält einen Retry-After-Hinweis.
Wie lange dauert 529 normalerweise?
Das lässt sich nicht vorhersagen und nicht garantieren — deshalb lautet die richtige Antwort „begrenzter Backoff plus Warteschlange“ und nicht eine fest im Programm eingetragene Wartezeit. Wenn der Pfad ein Latenzbudget hat, sollte ein Fallback übernehmen, statt zu warten.
Werden mit 529 fehlgeschlagene Aufrufe berechnet?
Über Kunavo nicht: Anfragen, die mit einem Fehler enden, werden nicht abgerechnet. Wenn du direkt einen Vertrag mit dem Anbieter hast, gelten dessen Abrechnungsregeln.
Verwandte Anleitungen
- „Fehler beim Nachrichten-Streaming“ in ChatGPT: Ursachen und Lösungen
- Claude-Kosten 2026 – Abopreise, API-Gebühren und Break-even-Punkt
- Claude-Code-Kosten 2026 — Abonnement und API-Verbrauch, tatsächliche Kosten und Break-even-Punkt
Weitere Informationen zur Fehlersemantik finden Sie unter Fehlerreferenz; einen Schlüssel erhalten Sie in einer Minute über Registrierung und die Authentifizierungsanleitung.