529 es el único error de Claude que no causa tu programa: la saturación está en el lado de Anthropic. No puedes repararla; solo puedes gestionarla mejor con reintentos pacientes y retroceso, un modelo de respaldo preparado para las rutas sensibles a la latencia y sin reintentos inmediatos en ráfaga que amplifiquen la incidencia.
El error
{
"type": "error",
"error": { "type": "overloaded_error",
"message": "Overloaded" }
}Causas y soluciones de un vistazo
| Causa | Solución |
|---|---|
| Saturación en el proveedor (día de lanzamiento de un modelo nuevo o incidencia regional). Todos los clientes pueden encontrarla simultáneamente. | Espera usando retroceso con jitter; consulta la página de estado de Anthropic en lugar de volver a desplegar tu aplicación. |
| Tu propio pico de tráfico coincide con una capacidad ya tensionada. | Distribuye los trabajos por lotes a lo largo del tiempo; normalmente desaparece tras esperar diez minutos. |
| Confundirlo con 429. En los registros ambos se parecen mucho, pero sus causas son completamente distintas. | 429 significa que superaste tu propio límite (el servidor está sano); 529 significa que el servidor está sobrecargado (tu cuota está bien). Solo 429 incluye una indicación Retry-After. |
| No definir un respaldo permite que el problema del proveedor llegue directamente al usuario final. | Define primero el orden de respaldo: dentro de la misma familia (Sonnet → Haiku) el comportamiento es más parecido; entre proveedores (Claude → GPT) puedes superar una incidencia que afecte a todo un proveedor. |
Evita que los reintentos amplifiquen la incidencia
Trata 529 como «un 429 sin Retry-After»: retroceso exponencial desde unos 2 segundos, con jitter, un límite de 30〜60 segundos y abandono tras aproximadamente cinco intentos para enviar el trabajo a una cola. Lo que realmente funciona es el jitter: sin él, todos los clientes vuelven al mismo tiempo y prolongan intacta la congestión de la que intentaban escapar.
No caigas: rodéalo
Define de antemano una cadena de respaldo para las rutas sensibles a la latencia. En endpoints compatibles con OpenAI, basta con cambiar una cadena; no necesitas integrar otro SDK ni abrir otra cuenta:
PREFERRED = ["claude-sonnet-5", "claude-haiku-4-5", "gpt-5-6-terra"]
def complete(messages):
last = None
for model in PREFERRED:
try:
return client.chat.completions.create(
model=model, messages=messages, max_tokens=800)
except APIStatusError as e:
if e.status_code not in (429, 500, 529):
raise
last = e # 過載 —— 試下一個
raise lastDeja para el final la sospecha sobre tu propio programa
Si solo un tipo de solicitud produce 529 mientras las demás llamadas funcionan al mismo tiempo, no se trata de una incidencia general: comprueba si esa ruta envía prompts anormalmente grandes o realiza envíos consecutivos en un bucle muy corto. En cambio, si todas las llamadas empiezan a producir 529 simultáneamente y se recuperan solas después de un tiempo, la causa es la capacidad; debes ajustar los reintentos y el respaldo, no reestructurar el código.
Si llamas a través de Kunavo
Kunavo distribuye Claude entre más de una ruta ascendente y su catálogo multimodelo convierte el respaldo entre proveedores en «la misma clave, el mismo saldo, solo cambia el nombre del modelo»: el código anterior no necesita una segunda cuenta. Incluso si un 529 llega hasta ti, nunca se cobra. La capacidad y el precio son dos cuestiones distintas; sobre este último, el precio de cada modelo aparece en Tabla de costes de la API de Claude.
Preguntas frecuentes
¿El 529 es problema mío?
No. Es un problema de capacidad del proveedor. Tu responsabilidad se limita a dos cosas: no amplificar la incidencia (retroceso y jitter) y tener una vía de escape cuando la incidencia supere tu presupuesto de latencia.
¿Cuál es la diferencia entre 529 y 429?
429 significa que superaste tu propio límite y el servidor está sano; 529 significa que el servidor está sobrecargado y tu cuota está bien. Ambos pueden reintentarse, pero solo 429 incluye una indicación Retry-After.
¿Cuánto suele durar un 529?
No se puede predecir ni garantizar; por eso la respuesta correcta es «retroceso limitado más una cola», no fijar en el código un tiempo de espera. Si esa ruta tiene un presupuesto de latencia, debe hacerse cargo un respaldo, no una espera.
¿Se cobran las llamadas que fallan con 529?
A través de Kunavo, no: las solicitudes que terminan con un error no se incluyen en la facturación. Si contratas directamente con el proveedor, depende de sus reglas de facturación.
Guías relacionadas
- Causas y soluciones del error «Se produjo un error durante la transmisión de mensajes» de ChatGPT
- Coste de Claude 2026 — precios de suscripción, tarifas de API y punto de equilibrio
- Costes de Claude Code 2026 — suscripción y API de pago por uso, importes reales y punto de equilibrio
Encontrarás más detalles sobre el significado de los errores en referencia de errores; obtener una clave lleva un minuto mediante registro y la guía de autenticación.