Volver a las guías
Solución de problemas·15 de septiembre de 2026·6 min de lectura

Error 529 overloaded_error de la API de Claude — significado y forma correcta de actuar

El 529 es el único error de Claude que no causa tu propio código. La congestión está del lado de Anthropic y no puedes corregirla. Solo puedes «absorberla» correctamente: reintentos persistentes con retroceso exponencial, un modelo de respaldo para las rutas sensibles a la latencia y evitar ráfagas de reintentos inmediatos que empeoren la incidencia. Estas tres medidas constituyen toda la respuesta.

El 529 es el único error de Claude que no causa tu propio código. La congestión está del lado de Anthropic y no puedes corregirla. Solo puedes «absorberla» correctamente: reintentos persistentes con retroceso exponencial, un modelo de respaldo para las rutas sensibles a la latencia y evitar ráfagas de reintentos inmediatos que empeoren la incidencia. Estas tres medidas constituyen toda la respuesta.

El error

レスポンス(HTTP 529)
{
  "type": "error",
  "error": { "type": "overloaded_error",
             "message": "Overloaded" }
}

Causas y soluciones de un vistazo

CausaSolución
Congestión del proveedor (día de lanzamiento de un modelo nuevo, incidencia regional). Ocurre simultáneamente para todos los usuarios.Esperar con retroceso y jitter. Comprobar la página de estado de Anthropic en vez de volver a desplegar la aplicación.
Tu ráfaga de solicitudes se superpuso a una capacidad ya saturada.Distribuir temporalmente el procesamiento por lotes. Retrasarlo 10 minutos suele resolverlo.
Confundirlo con un 429. Se parecen en los registros, pero la causa es completamente distinta.Un 429 significa que tú superaste el límite (el servidor está bien); un 529 significa que el servidor está sobrecargado (tu saldo y tus límites están bien). Solo el 429 incluye Retry-After.
No se ha definido un respaldo, por lo que el problema del proveedor llega directamente al usuario final.Definir el orden de respaldo. Dentro de la misma familia (Sonnet → Haiku), el comportamiento es parecido; entre proveedores (Claude → GPT), permite superar una incidencia general.

Diseñar reintentos que no agraven la incidencia

Trata el 529 como un «429 sin Retry-After». Usa retroceso exponencial desde unos 2 segundos, con jitter, un límite de 30–60 segundos y abandona después de unas 5 veces para enviar el trabajo a una cola. Lo importante es el jitter. Sin él, todos los clientes regresan al mismo tiempo y prolongan exactamente la congestión de la que intentaban salir.

No lo descartes: desvíalo

Prepara una cadena de respaldos para las rutas sensibles a la latencia. Con un endpoint compatible con OpenAI, solo cambia una cadena; no necesitas añadir SDK ni cuentas:

failover.py
PREFERRED = ["claude-sonnet-5", "claude-haiku-4-5", "gpt-5-6-terra"]

def complete(messages):
    last = None
    for model in PREFERRED:
        try:
            return client.chat.completions.create(
                model=model, messages=messages, max_tokens=800)
        except APIStatusError as e:
            if e.status_code not in (429, 500, 529):
                raise
            last = e          # 過負荷 — 次の候補へ
    raise last

Sospechar de tu propio código es el último paso

Si solo ciertos tipos de solicitudes producen 529 y otras llamadas del mismo momento funcionan, no se trata de una incidencia general. Comprueba si esa ruta envía prompts anormalmente grandes o dispara llamadas en un bucle corto. En cambio, si todas las llamadas se convierten simultáneamente en 529 y luego se recuperan por sí solas, la causa es la capacidad. En ese caso debes ajustar los reintentos y el respaldo, no refactorizar.

Si llamas a través de Kunavo

Kunavo distribuye Claude entre varias rutas ascendentes y, gracias al catálogo multimodelo, el respaldo entre proveedores consiste en «cambiar solo el nombre del modelo con la misma clave y el mismo saldo». No necesitas una segunda cuenta para el código anterior. Aun así, los 529 que se producen no se cobran. Capacidad y precio son problemas distintos. Para lo segundo, consulta los precios por modelo en tabla de precios de la API de Claude.

Preguntas frecuentes

¿Es culpa mía el 529?

No. Es un problema de capacidad del proveedor. Tu responsabilidad se reduce a dos cosas: no amplificar la incidencia (retroceso y jitter) y preparar un destino de desvío para cuando la incidencia supere tu tolerancia de latencia.

¿Cuál es la diferencia entre 529 y 429?

El 429 significa que tú superaste el límite y el servidor funciona con normalidad. El 529 significa que el servidor está sobrecargado y tus límites y saldo son normales. Ambos pueden reintentarse, pero solo el 429 incluye la indicación Retry-After.

¿Cuánto suele durar un 529?

No se puede predecir ni garantizar. Por eso la respuesta correcta es «retroceso con límite superior y cola», no codificar un tiempo de espera fijo. Si esa ruta tiene una tolerancia de latencia, el respaldo debe hacerse cargo en vez de esperar.

¿Se cobran las llamadas que fallan con 529?

A través de Kunavo, no. Las solicitudes que terminan con error no se facturan. Con un contrato directo, se aplican las reglas de facturación de cada proveedor.

Guías relacionadas

Encontrarás más detalles sobre el significado de los errores en referencia de errores; obtener una clave lleva un minuto mediante registro y la guía de autenticación.