“Erro no fluxo de mensagens” aparece quando a conexão pela qual o ChatGPT entrega a resposta pouco a pouco é interrompida antes que a resposta esteja completa. Quase nunca é causado pela sua entrada: as causas quase sempre são uma sobrecarga do lado da OpenAI, uma conexão instável, uma extensão do navegador ou um chat que ficou longo demais. Regenerar a resposta resolve a maioria dos casos — e, se não resolver, uma única consulta à página de status informa se o problema está sequer do seu lado.
O erro
Fehler im Nachrichtenstrom
(Gleiche Störung, andere Formulierungen: „Streaming unterbrochen.
Warte auf die vollständige Nachricht", „Hmm...da ist wohl etwas
schiefgelaufen." Symptom ist immer dasselbe — die Antwort bleibt
mitten im Satz stehen und wird nie fertig.)Causas e soluções em resumo
| Causa | Solução |
|---|---|
| Sobrecarga ou interrupção do serviço do lado da OpenAI. Afeta todos os planos simultaneamente, incluindo Plus e Pro, e é a causa mais provável quando o erro retorna a cada minuto. | Verifique status.openai.com. Durante uma interrupção, nenhuma configuração do seu lado mudará alguma coisa — esperar é a solução. |
| Conexão instável: alternância entre Wi-Fi e rede móvel, VPN ou proxy corporativo, sinal fraco. O streaming mantém uma única conexão longa aberta e é interrompido onde um carregamento normal de página ainda passaria. | Desative a VPN ou o proxy e tente novamente por outra conexão (Wi-Fi ⇄ rede móvel). |
| Ambiente do navegador: uma extensão que interfere na página, um cache desatualizado ou uma sessão expirada. | Tente novamente em uma janela privada. Se funcionar ali, o problema está em uma extensão ou no cache — desative as extensões, limpe os dados do site e entre novamente. |
| O chat está longo demais ou os anexos são grandes demais. Cada turno envia todo o histórico novamente, a geração demora mais e é mais provável que seja interrompida. | Transfira os pontos principais para um novo chat. Divida arquivos grandes em vez de anexá-los por completo. |
As três ações para os primeiros 90 segundos
Regenerar a resposta → recarregar a página (no aplicativo, encerrá-lo completamente e reiniciá-lo) → sair e entrar novamente. Um fluxo interrompido uma única vez é resolvido por uma dessas três etapas, e uma ocorrência única é o caso normal. Se, por outro lado, ele for interrompido sempre no mesmo ponto, isso indica que uma das causas específicas abaixo está presente, e não que seja acaso.
Primeiro esclareça se o problema realmente é seu
Esta é a etapa que as demais instruções ignoram e que economiza mais tempo. Abra status.openai.com. Se houver uma interrupção em andamento, nenhuma configuração local ajudará e esperar é a única solução. Se não houver nada ali, a causa está do seu lado e a próxima etapa a delimita. Quem faz esta verificação antes de mexer nas configurações não passa vinte minutos limpando o cache durante uma interrupção.
Delimite a causa local de fora para dentro
Siga esta ordem, pois cada etapa exclui todas as anteriores: (1) desative a VPN e o proxy; (2) abra uma janela privada — isso remove extensões e cache de uma só vez; (3) use outro navegador ou dispositivo; (4) troque de rede. A etapa a partir da qual volta a funcionar é a causa. Se o erro ocorrer apenas em chats longos, nenhuma das quatro é culpada — transfira os pontos principais para um novo chat.
Para desenvolvedores: a mesma interrupção na API
Em uma chamada com stream: true, a mesma interrupção aparece como uma conexão de Server-Sent Events que termina sem finish_reason. O status HTTP é 200 — os cabeçalhos estavam corretos quando foram enviados —, portanto uma verificação apenas do código de status não detecta a interrupção; sob carga, também aparecem 429 e 529 overloaded_error. Três medidas tornam isso tolerável: (1) tratar um stream encerrado sem finish_reason como repetível, não como resposta concluída; (2) tentar novamente em 429, 500 e 529 com backoff exponencial mais jitter; (3) atrás de um proxy, verificar o tempo limite de inatividade e desativar o buffering da resposta — um proxy que armazena em buffer transforma um stream funcional em um longo bloqueio. Para delimitar a causa, primeiro faça streaming sem proxy:
# Direkt streamen, kein Proxy dazwischen, und beobachten, wo es abbricht.
curl -N https://api.kunavo.com/v1/chat/completions \
-H "Authorization: Bearer $KUNAVO_API_KEY" \
-H "content-type: application/json" \
-d '{"model":"claude-sonnet-5","stream":true,
"max_tokens":300,
"messages":[{"role":"user","content":"Zähle langsam von 1 bis 20"}]}'Se você estiver chamando pela Kunavo
A Kunavo é um gateway de API de IA e trata streams interrompidos como um estado operacional, não como uma exceção. Quando vários canais upstream estão configurados para um modelo e a primeira tentativa falha, a mesma solicitação é repetida por outro canal dentro da mesma chamada — uma interrupção temporária no upstream se transforma em um sucesso um pouco mais lento, em vez de um erro. Solicitações que falharam nunca são cobradas. Como GPT e Claude estão acessíveis por uma única chave, basta usar outro nome de modelo quando um modelo estiver sobrecarregado, em vez de criar uma segunda integração. O padrão de retry e backoff para o caso de streaming está escrito integralmente em Erros de streaming de APIs de LLM.
Perguntas frequentes
“Erro no fluxo de mensagens” é culpa minha?
Praticamente nunca. A mensagem informa que a conexão que transportava a resposta foi interrompida antes que ela terminasse. Sua entrada não causa isso. As causas são carga do lado da OpenAI, uma conexão instável, uma extensão do navegador ou sessão expirada, ou um chat que ficou tão longo que as respostas atingem um tempo limite.
O que fazer quando regenerar não ajuda?
Primeiro verifique status.openai.com — durante uma interrupção, nada local ajudará. Se não houver interrupção, abra a página em uma janela privada usando outra rede: esse único teste remove simultaneamente extensões, cache e sua conexão habitual. Se funcionar ali, reative tudo individualmente até que volte a falhar. Se falhar em todos os lugares e somente em um único chat longo, transfira os pontos principais para um novo chat.
Isso também acontece em outros chats de IA?
A formulação vem do ChatGPT, mas qualquer assistente que transmita respostas pode ser interrompido da mesma forma. O Claude exibe uma mensagem informando que a resposta não pôde ser gerada completamente; em uma chamada direta à API, isso aparece como um fluxo SSE que termina sem finish_reason ou, sob carga, como 529 overloaded_error.
Por que isso acontece com mais frequência em conversas longas?
Cada turno envia novamente todo o histórico, então uma conversa longa significa uma geração mais demorada em uma única conexão aberta. Quanto mais tempo essa conexão permanece aberta, mais oportunidades há para um tempo limite de proxy, uma mudança de rede ou uma interrupção no serviço interrompê-la. Geralmente, um novo chat com um resumo do essencial ajuda mais do que qualquer configuração do navegador.
Guias relacionados
- Erros de streaming de LLM — cortes de SSE, streams travados e uso ausente
- Erro 529 overloaded_error da API Claude — o que significa e como lidar com ele
- Preços da API do Gemini 2026 — tarifas por modelo, cerca de 70% abaixo da tabela do Google
Mais detalhes sobre o significado dos erros estão em referência de erros; obter uma chave leva um minuto por meio de cadastro e da guia de autenticação.