«Erro no fluxo de mensagens» aparece quando a conexão pela qual o ChatGPT entrega sua resposta gradualmente é interrompida antes que a resposta termine. Quase nunca isso é causado pelo que você escreveu: as causas habituais são sobrecarga do lado da OpenAI, um link instável, uma extensão do navegador ou uma conversa que ficou longa demais. Regenerar a resposta resolve a maioria dos casos; quando não resolve, uma única verificação informa se o problema é seu.
O erro
Error en el flujo de mensajes
(La misma avería con otras redacciones: «Transmisión interrumpida.
Esperando el mensaje completo», «Vaya...parece que algo ha salido
mal.» El síntoma es idéntico — la respuesta se detiene a medias
y nunca se completa.)Causas e soluções em resumo
| Causa | Solução |
|---|---|
| Sobrecarga ou incidente do lado da OpenAI. Afeta todos os planos ao mesmo tempo, incluindo Plus e Pro, e é a causa mais provável quando o erro se repete a cada poucos minutos. | Consulte status.openai.com. Durante um incidente, nada do que você alterar no seu equipamento muda o resultado — esperar é a solução. |
| Conexão instável: alternância entre Wi-Fi e dados móveis, VPN ou proxy corporativo, sinal móvel fraco. O streaming mantém uma única conexão aberta por muito tempo, por isso ela pode ser interrompida onde um carregamento normal de página passaria. | Desative a VPN ou o proxy e tente novamente por outro link (Wi-Fi ⇄ dados móveis). |
| Ambiente do navegador: uma extensão que injeta conteúdo na página, um cache desatualizado ou uma sessão expirada. | Tente novamente em uma janela privada. Se funcionar ali, a causa é uma extensão ou o cache — desative as extensões, limpe os dados do site e faça login novamente. |
| A conversa é longa demais ou os anexos são pesados demais. Cada turno reenvia toda a conversa, portanto a geração demora mais e é interrompida com mais facilidade. | Leve os pontos principais para uma nova conversa. Divida os arquivos grandes em vez de anexá-los inteiros. |
Os três gestos dos primeiros 90 segundos
Gere a resposta novamente → recarregue a página (no celular, feche o aplicativo completamente e abra-o novamente) → saia da conta e entre de novo. Uma interrupção pontual é resolvida por uma dessas três ações, e esse é o caso normal. Se, ao contrário, ela parar sempre exatamente no mesmo ponto, isso indica que uma das causas específicas abaixo está atuando, e não uma falha transitória.
Decida primeiro se o problema é seu
Este é o passo que as outras listas de soluções ignoram e o que mais economiza tempo. Abra status.openai.com. Se houver um incidente em andamento, nenhum ajuste local o resolverá e esperar é a única opção. Se nada aparecer, a causa é local e o próximo passo a delimita. Fazer essa verificação antes de alterar configurações evita passar vinte minutos limpando caches durante uma indisponibilidade.
Isole a causa local de fora para dentro
Siga esta ordem, porque cada camada descarta todas as anteriores: (1) desligar a VPN e o proxy; (2) abrir uma janela privada — isso remove extensões e cache de uma só vez; (3) testar outro navegador ou dispositivo; (4) mudar de rede. A camada a partir da qual volta a funcionar é a causa. Se o erro aparece apenas em conversas longas, nenhuma das quatro é responsável: leve o essencial para uma nova conversa.
Para desenvolvedores: a mesma interrupção na API
Ao chamar a API com stream: true, essa mesma falha chega como uma conexão Server-Sent Events que termina sem finish_reason. O status HTTP é 200 — tudo estava funcionando quando os cabeçalhos foram enviados —, portanto verificar apenas o código de status não detecta o problema; sob carga, também aparecem 429 e 529 overloaded_error. Três medidas tornam o caso administrável: (1) tratar um fluxo terminado sem finish_reason como passível de nova tentativa, não como uma resposta completa; (2) tentar novamente 429, 500 e 529 com backoff exponencial mais jitter; (3) se houver um proxy no caminho, verificar seu idle timeout e desativar o buffering das respostas — um proxy que armazena respostas transforma um fluxo funcional em um bloqueio longo. Para delimitar a causa, transmita primeiro sem proxy:
# Transmitir directamente, sin proxy por medio, y ver dónde se detiene.
curl -N https://api.kunavo.com/v1/chat/completions \
-H "Authorization: Bearer $KUNAVO_API_KEY" \
-H "content-type: application/json" \
-d '{"model":"claude-sonnet-5","stream":true,
"max_tokens":300,
"messages":[{"role":"user","content":"cuenta despacio del 1 al 20"}]}'Se você estiver chamando pela Kunavo
O Kunavo é um gateway de API de IA, e um fluxo interrompido é uma condição operacional prevista que ele foi projetado para absorver, não uma exceção. Quando um modelo tem vários canais upstream configurados e a primeira tentativa falha, a solicitação é tentada novamente em outro canal dentro da mesma chamada; assim, um problema transitório no upstream aparece como um sucesso um pouco mais lento, em vez de um erro. Solicitações com falha nunca são cobradas. Como GPT e Claude podem ser acessados com uma única chave, contornar um modelo sobrecarregado significa alterar o nome do modelo, não a integração. O padrão de novas tentativas e backoff para o caso de streaming está detalhado em Erros de streaming de APIs de LLM.
Perguntas frequentes
«Erro no fluxo de mensagens»: a culpa é minha?
Quase nunca. A mensagem indica que a conexão que transportava a resposta foi interrompida antes de terminar. O que você escreveu não causa isso. As causas são carga do lado da OpenAI, uma rede instável, uma extensão do navegador ou uma sessão expirada, ou uma conversa que cresceu o suficiente para que as respostas expirassem.
O que faço se regenerar não resolver?
Consulte primeiro status.openai.com — durante um incidente, nada local ajuda. Se não houver incidente, abra uma janela privada em outra rede: esse único teste remove extensões, cache e seu link habitual de uma só vez. Se funcionar ali, reintroduza cada elemento até descobrir qual faz o problema voltar. Se falhar em todos os lugares e apenas em uma conversa longa, leve os pontos essenciais para uma nova conversa.
Isso também acontece em outras IAs?
A redação é do ChatGPT, mas qualquer assistente que entregue respostas em streaming pode ser interrompido da mesma maneira. O Claude exibe uma mensagem informando que não foi possível gerar a resposta completa; em uma chamada direta à API, isso aparece como um fluxo SSE que termina sem finish_reason ou, sob carga, como um 529 overloaded_error.
Por que isso acontece mais em conversas longas?
Cada turno reenvia toda a conversa, portanto uma conversa longa significa uma geração mais longa mantida em uma única conexão aberta. Quanto mais tempo ela permanece aberta, mais oportunidades existem para um timeout de proxy, uma mudança de rede ou um problema no upstream interrompê-la. Começar uma nova conversa com um resumo do que importa costuma ajudar mais do que qualquer ajuste no navegador.
Guias relacionados
- Erros de streaming de LLM — cortes de SSE, streams travados e uso ausente
- Erro 529 overloaded_error da API do Claude — o que é e como absorvê-lo
- Preços do Claude em 2026: Pro, Max, a API por tokens e qual sai mais barato
Mais detalhes sobre o significado dos erros estão em referência de erros; obter uma chave leva um minuto por meio de cadastro e da guia de autenticação.