Volver a las guías
Solución de problemas·15 de septiembre de 2026·6 min de lectura

API de Claude 529 overloaded_error — qué significa y cómo superarlo

El 529 es el único error de Claude que no provoca tu código. La sobrecarga está en Anthropic y no hay nada que puedas corregir. Solo puedes absorberla correctamente: reintentos pacientes con retroceso, un modelo de respaldo para rutas sensibles a la latencia y ninguna avalancha de reintentos inmediatos que agrave la incidencia.

El 529 es el único error de Claude que no provoca tu código. La sobrecarga está en Anthropic y no hay nada que puedas corregir. Solo puedes absorberla correctamente: reintentos pacientes con retroceso, un modelo de respaldo para rutas sensibles a la latencia y ninguna avalancha de reintentos inmediatos que agrave la incidencia.

El error

응답 (HTTP 529)
{
  "type": "error",
  "error": { "type": "overloaded_error",
             "message": "Overloaded" }
}

Causas y soluciones de un vistazo

CausaSolución
Sobrecarga del proveedor (día de lanzamiento de un modelo nuevo, incidencia regional). Aparece simultáneamente para todos los clientes.Espera con retroceso y jitter. No vuelvas a desplegar la aplicación; consulta la página de estado de Anthropic.
Tu tráfico en ráfaga se solapó con una capacidad ya ajustada.Distribuye temporalmente los trabajos por lotes. Retrasarlos solo 10 minutos suele resolverlo.
Confusión con el 429. En los registros parecen similares, pero la causa es completamente distinta.El 429 significa que superaste el límite (el servidor está normal); el 529 significa que el servidor está sobrecargado (tus límites y saldo están normales). Solo el 429 incluye la indicación Retry-After.
No hay un respaldo definido, por lo que el problema del proveedor se transmite directamente al usuario final.Define el orden de respaldo. Dentro de la misma familia (Sonnet → Haiku), el comportamiento es similar; al cambiar de proveedor (Claude → GPT), puedes superar una incidencia general.

Diseñar reintentos que no agraven la incidencia

Trata el 529 como un «429 sin Retry-After». Usa retroceso exponencial desde unos 2 segundos, añade jitter, fija un límite de 30–60 segundos y, después de unas cinco veces, abandona y pon el trabajo en cola. La clave es el jitter. Sin él, todos los clientes vuelven en el mismo instante y prolongan la sobrecarga de la que intentaban salir.

No lo descartes: pásalo a otra ruta

Define una cadena de respaldos para las rutas sensibles a la latencia. Si el endpoint es compatible con OpenAI, solo tienes que cambiar una cadena; no necesitas crear otro SDK ni otra cuenta:

failover.py
PREFERRED = ["claude-sonnet-5", "claude-haiku-4-5", "gpt-5-6-terra"]

def complete(messages):
    last = None
    for model in PREFERRED:
        try:
            return client.chat.completions.create(
                model=model, messages=messages, max_tokens=800)
        except APIStatusError as e:
            if e.status_code not in (429, 500, 529):
                raise
            last = e          # 과부하 — 다음 후보로
    raise last

Sospechar de tu propio código es el último recurso

Si solo un tipo concreto de solicitud devuelve 529 y otras llamadas del mismo momento pasan, no es una incidencia general. Comprueba si esa ruta envía un prompt anormalmente grande o realiza llamadas consecutivas dentro de un bucle estrecho. Si, por el contrario, todas las llamadas devuelven 529 a la vez y luego se recuperan por sí solas, la causa es la capacidad. En ese caso debes ajustar los reintentos y el respaldo, no refactorizar.

Si llamas a través de Kunavo

Kunavo enruta Claude por más de una ruta ascendente y, gracias al catálogo multimodelo, el respaldo entre proveedores consiste en «cambiar solo el nombre del modelo con la misma clave y el mismo saldo». No necesitas una segunda cuenta para el código anterior. Aun así, los 529 recibidos no se cobran. Capacidad y precio son preguntas distintas. Para la segunda, los precios por modelo son tabla de precios de la API de Claude.

Preguntas frecuentes

¿Es culpa mía el 529?

No. Es un problema de capacidad del proveedor. Tu responsabilidad se limita a dos cosas: no amplificar la incidencia (retroceso y jitter) y preparar una vía alternativa para cuando la incidencia supere la tolerancia de latencia.

¿Cuál es la diferencia entre 529 y 429?

El 429 significa que superaste el límite y el servidor funciona con normalidad. El 529 significa que el propio servidor está sobrecargado y tu límite es normal. Ambos deben reintentarse, pero solo el 429 incluye la indicación Retry-After.

¿Cuánto suele durar el estado 529?

No se puede predecir ni garantizar. Por eso la respuesta correcta es retroceso con límite superior y cola, no insertar en el código un tiempo de espera fijo. Si la ruta tiene una tolerancia de latencia, el respaldo debe hacerse cargo en lugar de esperar.

¿También se cobran las llamadas que fallan con 529?

A través de Kunavo, no. Las solicitudes que terminan con error no se facturan. Si tienes un contrato directo, se aplican las reglas de facturación del proveedor correspondiente.

Guías relacionadas

Encontrarás más detalles sobre el significado de los errores en referencia de errores; obtener una clave lleva un minuto mediante registro y la guía de autenticación.