529 é o único erro da Claude que não é causado pelo seu programa: quem está sobrecarregado é o lado da Anthropic. Você não pode corrigi-lo; só pode lidar melhor com ele — novas tentativas pacientes com espera progressiva, um modelo de reserva para caminhos sensíveis à latência e, acima de tudo, nenhuma sequência de novas tentativas imediatas que amplifique a falha.
O erro
{
"type": "error",
"error": { "type": "overloaded_error",
"message": "Overloaded" }
}Causas e soluções em resumo
| Causa | Solução |
|---|---|
| Sobrecarga no provedor (dia de lançamento de um novo modelo, falha regional). Todos os clientes podem enfrentar isso simultaneamente. | Aguarde usando espera progressiva com jitter; consulte a página de status da Anthropic, em vez de reimplantar seu aplicativo. |
| Seu próprio pico de tráfego coincidiu com uma capacidade que já estava sob pressão. | Distribua os trabalhos em lote ao longo do tempo; normalmente esperar dez minutos resolve. |
| Confundir com 429. Nos logs, os dois parecem muito semelhantes, mas as causas são completamente diferentes. | 429 significa que você excedeu seu próprio limite (servidor saudável); 529 significa que o servidor está sobrecarregado (sua franquia está normal). Apenas 429 inclui uma indicação Retry-After. |
| Não definir uma reserva faz com que o problema do provedor chegue diretamente aos usuários finais. | Defina primeiro a ordem de reserva — na mesma família (Sonnet → Haiku), o comportamento é mais parecido; entre provedores (Claude → GPT), você consegue atravessar uma falha que afete o provedor inteiro. |
Impedir que novas tentativas ampliem a falha
Trate 529 como um "429 sem Retry-After": comece com espera progressiva exponencial de cerca de 2 segundos, adicione jitter, limite a 30〜60 segundos, desista após aproximadamente cinco tentativas e coloque o trabalho em uma fila. O que realmente funciona é o jitter: sem ele, todos os clientes voltam no mesmo instante e prolongam intacto o congestionamento do qual tentavam escapar.
Não caia; contorne
Defina antecipadamente uma cadeia de reserva para caminhos sensíveis à latência. Em endpoints compatíveis com a OpenAI, isso significa apenas mudar uma string — não é preciso conectar outro SDK nem abrir outra conta:
PREFERRED = ["claude-sonnet-5", "claude-haiku-4-5", "gpt-5-6-terra"]
def complete(messages):
last = None
for model in PREFERRED:
try:
return client.chat.completions.create(
model=model, messages=messages, max_tokens=800)
except APIStatusError as e:
if e.status_code not in (429, 500, 529):
raise
last = e # 過載 —— 試下一個
raise lastSó depois suspeite do seu próprio programa
Se apenas um tipo de solicitação retorna 529 enquanto outras chamadas no mesmo momento funcionam, não é uma falha geral: verifique se esse caminho está enviando prompts excepcionalmente grandes ou fazendo envios consecutivos em um loop muito curto. Por outro lado, se todas as chamadas começarem a retornar 529 ao mesmo tempo e depois se recuperarem sozinhas, a causa é capacidade — o que deve ser ajustado são as novas tentativas e a reserva, não uma refatoração.
Se você estiver chamando pela Kunavo
A Kunavo distribui a Claude por mais de um caminho upstream, e o catálogo de vários modelos transforma a reserva entre provedores em "a mesma chave, o mesmo saldo, apenas mudar o nome do modelo" — o código acima não precisa de uma segunda conta. Mesmo quando um 529 ainda chega até você, ele nunca é cobrado. Capacidade e preço são questões diferentes; sobre o segundo, os preços de cada modelo estão listados em tabela de preços da Claude API.
Perguntas frequentes
529 é um problema meu?
Não. Este é um problema de capacidade no provedor. Sua responsabilidade é apenas dupla: não amplificar a falha (espera progressiva e jitter) e ter para onde desviar quando a falha ultrapassar seu orçamento de latência.
Qual é a diferença entre 529 e 429?
429 significa que você excedeu seu próprio limite e o servidor está saudável; 529 significa que o servidor está sobrecarregado e sua franquia está normal. Ambos podem ser repetidos, mas apenas 429 inclui uma indicação Retry-After.
Quanto tempo um 529 costuma durar?
Não é possível prever nem garantir — por isso a resposta correta é "espera progressiva limitada e fila", não definir um tempo de espera fixo no programa. Se o caminho tem um orçamento de latência, quem deve assumir é a reserva, não a espera.
Chamadas que falham com 529 são cobradas?
Pela Kunavo, não: solicitações encerradas com erro não entram na cobrança. Se você contratar diretamente com o provedor, depende das regras de cobrança de cada um.
Guias relacionados
- Causas e soluções para “Ocorreu um erro no streaming de mensagens” do ChatGPT
- Custos do Claude em 2026 — preços das assinaturas, tarifas da API e ponto de equilíbrio
- Custo do Claude Code em 2026 — assinatura e cobrança variável da API, valores reais e ponto de equilíbrio
Mais detalhes sobre o significado dos erros estão em referência de erros; obter uma chave leva um minuto por meio de cadastro e da guia de autenticação.