Voltar aos guias
Solução de problemas·15 de setembro de 2026·6 min de leitura

Erro 529 overloaded_error da API Claude — o que significa e como lidar com ele

529 é o único erro do Claude que seu código não causou: a própria Anthropic está sobrecarregada. Você não pode corrigi-lo — apenas tratá-lo corretamente. Isso significa novas tentativas pacientes com backoff, um modelo de fallback para caminhos sensíveis à latência e, acima de tudo, nada de rajadas imediatas de retry que ampliem a falha.

529 é o único erro do Claude que seu código não causou: a própria Anthropic está sobrecarregada. Você não pode corrigi-lo — apenas tratá-lo corretamente. Isso significa novas tentativas pacientes com backoff, um modelo de fallback para caminhos sensíveis à latência e, acima de tudo, nada de rajadas imediatas de retry que ampliem a falha.

O erro

Antwort (HTTP 529)
{
  "type": "error",
  "error": { "type": "overloaded_error",
             "message": "Overloaded" }
}

Causas e soluções em resumo

CausaSolução
Sobrecarga do lado do provedor (dias de lançamento, incidentes regionais). Afeta todos os clientes ao mesmo tempo.Backoff com jitter; consulte a página de status da Anthropic em vez de reimplantar sua aplicação.
Seu próprio pico de carga coincide com uma capacidade que já está sob pressão.Distribua os trabalhos em lote; um atraso de dez minutos normalmente resolve a situação.
Confusão com 429: um limite de velocidade se parece nos logs, mas tem uma causa completamente diferente.429 significa que você excedeu seus limites (o servidor está saudável); 529 significa que o servidor está sobrecarregado (seu limite está em ordem). Apenas 429 fornece uma indicação Retry-After.
Nenhum fallback definido, então um problema do provedor chega ao usuário final.Defina uma cadeia de fallback — dentro da mesma família (Sonnet → Haiku), o comportamento permanece semelhante; entre provedores (Claude → GPT), você também sobrevive a uma interrupção completa.

Tentar novamente sem agravar a falha

Trate 529 como um 429 sem Retry-After: backoff exponencial a partir de cerca de 2 segundos, com jitter, limitado a 30–60 segundos; depois de aproximadamente cinco tentativas, desista e coloque o trabalho em uma fila. O jitter é essencial: sem ele, todos os clientes retornam ao mesmo tempo e prolongam exatamente a sobrecarga da qual tentam sair.

Desviar em vez de falhar

Para caminhos sensíveis à latência, defina uma cadeia de fallback. Em um endpoint compatível com OpenAI, isso é apenas uma string alterada — nenhum segundo SDK, nenhuma segunda conta:

failover.py
PREFERRED = ["claude-sonnet-5", "claude-haiku-4-5", "gpt-5-6-terra"]

def complete(messages):
    last = None
    for model in PREFERRED:
        try:
            return client.chat.completions.create(
                model=model, messages=messages, max_tokens=800)
        except APIStatusError as e:
            if e.status_code not in (429, 500, 529):
                raise
            last = e          # überlastet — nächste Stufe versuchen
    raise last

Só então examine seu próprio código

Se 529 ocorrer apenas em um tipo de solicitação e outras chamadas no mesmo momento funcionarem, não é uma falha generalizada do provedor: verifique se esse caminho envia prompts excepcionalmente grandes ou dispara em um loop apertado. Se ocorrer simultaneamente em todas as chamadas e desaparecer sozinho, foi capacidade — então o trabalho pertence ao retry e ao fallback, não a uma refatoração.

Se você estiver chamando pela Kunavo

A Kunavo executa o Claude por mais de um caminho upstream, e o catálogo multimodelo torna o failover entre provedores uma simples alteração do nome do modelo usando a mesma chave e a mesma cobrança — o padrão acima não precisa de uma segunda conta. Erros 529 que ainda chegarem até você nunca serão cobrados. Capacidade e preço são duas questões separadas; para a segunda, as tarifas por modelo estão na lista de preços da API Claude.

Perguntas frequentes

Um 529 é culpa minha?

Não. É um problema de capacidade do lado do provedor. Sua responsabilidade se limita a não agravar a falha (backoff, jitter) e ter um destino alternativo caso o incidente dure mais que seu orçamento de latência.

529 ou 429 — qual é a diferença?

429 significa que você excedeu seus limites; o servidor está saudável. 529 significa que o próprio servidor está sobrecarregado; seu limite está em ordem. Ambos podem ser repetidos; apenas 429 traz uma indicação Retry-After.

Quanto costuma durar uma fase de 529?

Não é previsível nem algo que se possa garantir — por isso, a resposta correta é um backoff limitado junto com uma fila, não um tempo de espera codificado na aplicação. Se seu caminho tem um orçamento de latência, use o fallback em vez de esperar.

As chamadas 529 malsucedidas são cobradas?

Na Kunavo, não: uma solicitação que termina com erro não é cobrada. Em um contrato direto, isso depende das regras de cobrança do provedor correspondente.

Guias relacionados

Mais detalhes sobre o significado dos erros estão em referência de erros; obter uma chave leva um minuto por meio de cadastro e da guia de autenticação.