Voltar aos guias
Solução de problemas·5 de setembro de 2026·6 min de leitura

“Streaming interrompido. Aguardando a mensagem completa” — o que significa e como resolver

“Streaming interrompido. Aguardando a mensagem completa” aparece quando a conexão que transmite a resposta do ChatGPT para o seu navegador cai antes que a resposta termine. Quase nunca isso é causado pelo que você escreveu: as causas habituais são sobrecarga do lado da OpenAI, um link instável, uma extensão do navegador ou uma conversa que ficou longa demais. Regenerar resolve a maioria dos casos; quando não resolve, uma verificação de status informa se o problema é realmente seu.

Última revisão em .

“Streaming interrompido. Aguardando a mensagem completa” aparece quando a conexão que transmite a resposta do ChatGPT para o seu navegador cai antes que a resposta termine. Quase nunca isso é causado pelo que você escreveu: as causas habituais são sobrecarga do lado da OpenAI, um link instável, uma extensão do navegador ou uma conversa que ficou longa demais. Regenerar resolve a maioria dos casos; quando não resolve, uma verificação de status informa se o problema é realmente seu.

O erro

shown in the ChatGPT thread
Streaming interrupted. Waiting for the complete message...

(related wording for the same failure: "Error in message stream",
 "Hmm...something seems to have gone wrong." The symptom is the same —
 the answer stops partway and never completes.)

Causas e soluções em resumo

CausaSolução
Sobrecarga ou incidente do lado da OpenAI. Afeta todos os planos ao mesmo tempo, incluindo Plus e Pro, e é a causa mais comum quando o erro se repete a cada poucos minutos.Consulte status.openai.com. Durante um incidente, nada do seu lado muda o resultado — esperar é a solução.
Uma conexão instável: uma mudança de Wi-Fi, uma VPN ou proxy corporativo ou um sinal móvel fraco. O streaming mantém uma conexão de longa duração aberta, por isso ela pode ser interrompida onde carregamentos comuns de páginas continuam funcionando.Desative a VPN ou o proxy e tente novamente por outro link (Wi-Fi para dados móveis ou o contrário).
Ambiente do navegador: uma extensão que injeta conteúdo na página, um cache desatualizado ou uma sessão expirada.Tente novamente em uma janela privada. Se funcionar ali, a causa é uma extensão ou o cache — desative as extensões, limpe os dados do site e faça login novamente.
A conversa é longa demais ou os anexos são pesados demais. Uma conversa muito longa é reenviada a cada turno, portanto as respostas demoram mais e têm maior probabilidade de serem interrompidas.Leve os pontos principais para uma nova conversa. Divida os arquivos grandes em vez de anexá-los inteiros.

Os três dos 90 segundos

Gere a resposta novamente, recarregue a página (se estiver no celular, feche completamente o aplicativo e abra-o novamente) e depois saia da conta e entre de novo. Uma conexão interrompida uma única vez é restabelecida por uma dessas três ações, e a maioria dos casos ocorre uma só vez. Se ela parar exatamente no mesmo ponto todas as vezes, isso indica que a causa é uma das específicas abaixo, e não uma interrupção transitória.

Decida se o problema é realmente seu

Este é o passo que as outras listas de soluções ignoram e o que mais economiza tempo. Abra status.openai.com. Se houver um incidente, nenhuma configuração no seu computador mudará algo, e a única solução será esperar. Se nada aparecer, a causa é local e o próximo passo a isola. Fazer isso antes de começar a alterar configurações evita que você passe vinte minutos limpando caches por causa de uma indisponibilidade.

Isole a causa local de fora para dentro

Percorra as camadas nesta ordem, porque cada uma descarta tudo o que vem antes: (1) desligue a VPN e o proxy; (2) abra uma janela privada, que remove extensões e cache de uma só vez; (3) tente outro navegador ou dispositivo; (4) mude de rede. A camada na qual começa a funcionar é a causa. Se o erro aparece apenas em conversas longas, nenhuma das quatro é o problema — leve os pontos principais para uma nova conversa.

Para desenvolvedores: a mesma interrupção na API

Ao chamar a API com stream: true, essa falha chega como uma conexão Server-Sent Events que termina sem finish_reason. O status HTTP é 200 — tudo estava funcionando quando os cabeçalhos foram enviados —, portanto apenas verificações do código de status não a detectarão; sob carga, você também verá 429 e 529 overloaded_error. Três medidas tornam o problema suportável: (1) tratar um fluxo terminado sem finish_reason como passível de nova tentativa, não como uma resposta concluída; (2) tentar novamente 429, 500 e 529 com backoff exponencial mais jitter; (3) se você estiver atrás de um proxy, verificar seu idle timeout e desativar o buffering das respostas — um proxy que faz buffering transforma um fluxo funcional em uma longa paralisação. Reproduza o problema primeiro sem o proxy:

stream-test.sh
# Stream directly, no proxy in the path, and watch where it stops.
curl -N https://api.kunavo.com/v1/chat/completions \
  -H "Authorization: Bearer $KUNAVO_API_KEY" \
  -H "content-type: application/json" \
  -d '{"model":"claude-sonnet-5","stream":true,
       "max_tokens":300,
       "messages":[{"role":"user","content":"count slowly from 1 to 20"}]}'

Se você estiver chamando pela Kunavo

O Kunavo é um gateway de API de IA, e os fluxos interrompidos são uma condição que ele foi projetado para absorver, não uma exceção. Quando um modelo tem mais de um canal upstream configurado e a primeira tentativa falha, a solicitação é tentada novamente em outro canal dentro da mesma chamada; assim, um problema transitório no upstream aparece como um sucesso um pouco mais lento, em vez de um erro. Solicitações com falha nunca são cobradas. Como GPT e Claude podem ser acessados com uma única chave, um modelo sobrecarregado pode ser contornado alterando o nome do modelo, sem mudar a integração. O padrão de novas tentativas e backoff para o caso de streaming está descrito em Erros de streaming de APIs de LLM.

Perguntas frequentes

“Streaming interrompido, aguardando a mensagem completa” é culpa minha?

Quase nunca. A mensagem significa que a conexão que transportava a resposta foi interrompida antes que ela terminasse. O que você escreveu não causa isso. As causas são carga do lado da OpenAI, uma rede instável, uma extensão do navegador ou uma sessão desatualizada, ou uma conversa que cresceu o suficiente para fazer as respostas expirarem.

E se regenerar não resolver?

Consulte primeiro status.openai.com — durante um incidente, nada local ajuda. Se não houver incidente, abra uma janela privada em outra rede: esse único teste remove extensões, cache e seu link habitual de uma só vez. Se funcionar ali, reintroduza cada elemento até o problema voltar. Se falhar em todos os lugares e apenas em uma conversa longa, leve os pontos principais para uma nova conversa.

Isso acontece em outros chats de IA?

A redação é do ChatGPT, mas qualquer assistente que transmita respostas pode cair da mesma forma. O Claude exibe uma mensagem informando que não foi possível concluir a resposta; em uma chamada direta à API, isso aparece como um fluxo Server-Sent Events que termina sem um finish_reason ou, sob carga, como um 529 overloaded_error.

Por que o erro aparece mais frequentemente em conversas longas?

Cada turno reenvia toda a conversa, portanto uma conversa longa significa uma geração mais longa mantida em uma única conexão. Quanto mais tempo essa conexão permanece aberta, mais chances existem de um timeout de proxy, uma mudança de rede ou um problema no upstream interrompê-la. Começar uma nova conversa com um resumo do que importa costuma melhorar mais do que qualquer configuração do navegador.

Sou cobrado quando um fluxo é interrompido?

Nas assinaturas do ChatGPT não há cobrança por mensagem, portanto nada é perdido além do tempo. Na API, a cobrança segue os tokens que o provedor realmente produziu, então um fluxo que morre cedo custa menos que um completo — e, no Kunavo, uma solicitação que falha completamente não é cobrada.

Guias relacionados

Mais detalhes sobre o significado dos erros estão em referência de erros; obter uma chave leva um minuto por meio de cadastro e da guia de autenticação.