Voltar aos guias
Solução de problemas·15 de setembro de 2026·6 min de leitura

Causas e soluções para “Ocorreu um erro no streaming de mensagens” do ChatGPT

“Ocorreu um erro no streaming de mensagens” aparece quando a conexão que transmite a resposta do ChatGPT caractere a caractere é interrompida antes do fim. Quase nunca é causado pelo que você digitou: as causas comuns são carga excessiva no lado da OpenAI, uma conexão instável, extensões do navegador ou uma conversa que ficou longa demais. Regenerar a resposta resolve a maioria dos casos; se não resolver, basta consultar a página de status uma vez para saber se o problema não está do seu lado.

“Ocorreu um erro no streaming de mensagens” aparece quando a conexão que transmite a resposta do ChatGPT caractere a caractere é interrompida antes do fim. Quase nunca é causado pelo que você digitou: as causas comuns são carga excessiva no lado da OpenAI, uma conexão instável, extensões do navegador ou uma conversa que ficou longa demais. Regenerar a resposta resolve a maioria dos casos; se não resolver, basta consultar a página de status uma vez para saber se o problema não está do seu lado.

O erro

ChatGPT 對話中顯示的訊息
訊息串流發生錯誤

(同一種故障的其他說法:「串流已中斷。正在等待完整訊息」、
 「Hmm...something seems to have gone wrong.」
 症狀都一樣 —— 回覆停在一半,永遠不會產生完。)

Causas e soluções em resumo

CausaSolução
Carga excessiva ou falha no lado da OpenAI. Afeta simultaneamente todos os planos, inclusive Plus e Pro; se o erro se repetir a cada poucos minutos, esta é a causa mais provável.Consulte status.openai.com. Durante uma falha, nenhum ajuste local mudará o resultado; esperar é a única solução.
Conexão instável: alternância entre Wi-Fi e rede móvel, VPN ou proxy corporativo, ou sinal móvel fraco. O streaming mantém uma única conexão aberta por muito tempo, por isso pode cair mesmo quando páginas comuns carregam normalmente.Desative a VPN ou o proxy e tente novamente usando outra conexão (Wi-Fi ⇄ rede móvel).
Ambiente do navegador: extensões que injetam conteúdo na página, cache expirado ou sessão de login inválida.Tente novamente em uma janela anônima. Se funcionar no modo anônimo, a causa é uma extensão ou o cache — desative as extensões, limpe os dados do site e faça login novamente.
Conversa longa ou anexo grande. A cada rodada, toda a conversa é enviada novamente, o tempo de geração aumenta e a probabilidade de interrupção também.Leve os pontos principais para uma nova conversa. Envie arquivos grandes em partes, em vez de anexar tudo de uma vez.

Experimente estas três ações nos primeiros 90 segundos

Regenerar a resposta → recarregar a página (no aplicativo, fechá-lo completamente e abri-lo novamente) → sair e entrar outra vez. Uma interrupção pontual costuma ser resolvida por uma dessas três ações — e interrupções pontuais são o caso normal. Por outro lado, se sempre parar no mesmo ponto, isso indica uma causa específica abaixo, não um evento aleatório.

Primeiro, determine se o problema está do seu lado

Esta é a etapa que outros guias ignoram, embora seja a que mais economiza tempo. Abra status.openai.com. Se houver uma falha em andamento, nenhuma configuração local mudará algo; esperar é a única solução. Se não houver falha, a causa está localmente e o próximo passo reduzirá o escopo. Faça essa verificação antes de alterar configurações para não passar vinte minutos limpando o cache durante uma falha oficial.

Reduza as causas locais de fora para dentro, uma camada por vez

Siga esta ordem, pois cada camada elimina todas as possibilidades acima dela: ① desative VPN e proxy ② abra uma janela anônima (removendo extensões e cache de uma vez) ③ troque de navegador ou dispositivo ④ troque de rede. A camada após a qual tudo voltar ao normal é a causa. Se o erro ocorrer apenas em conversas longas, nenhuma das quatro camadas é o problema — levar os pontos principais para uma nova conversa é a solução.

Para desenvolvedores: como a mesma interrupção aparece na API

Ao chamar a API com stream: true, a mesma falha aparece como uma conexão Server-Sent Events que termina sem finish_reason. O código HTTP é 200 — tudo está normal no momento em que os cabeçalhos são enviados — portanto verificar apenas o código de status não detecta o problema; sob carga alta, também podem aparecer 429 e 529 overloaded_error. Três medidas tornam isso tolerável: (1) tratar um streaming que termina sem finish_reason como passível de nova tentativa, não como resposta concluída; (2) usar novas tentativas com recuo exponencial e jitter para 429, 500 e 529; (3) se houver um proxy intermediário, verificar o idle timeout e desativar o buffer de resposta — um proxy que armazena respostas pode transformar um streaming normal em uma conexão aparentemente travada por muito tempo. Para esclarecer o problema, faça primeiro o streaming diretamente, sem proxy:

stream-test.sh
# 直接串流、路徑上不放 Proxy,觀察它停在哪裡。
curl -N https://api.kunavo.com/v1/chat/completions \
  -H "Authorization: Bearer $KUNAVO_API_KEY" \
  -H "content-type: application/json" \
  -d '{"model":"claude-sonnet-5","stream":true,
       "max_tokens":300,
       "messages":[{"role":"user","content":"請慢慢從 1 數到 20"}]}'

Se você estiver chamando pela Kunavo

A Kunavo é um gateway de API de IA, e interrupções de streaming são um estado operacional esperado aqui, não uma exceção. Quando um modelo tem vários canais upstream e a primeira tentativa falha, a mesma solicitação tenta outro canal dentro da mesma chamada; assim, uma instabilidade momentânea do upstream vira um “sucesso um pouco mais lento”, não um erro. Solicitações com falha nunca são cobradas. Como GPT e Claude compartilham a mesma chave, quando um modelo está sobrecarregado você troca o nome do modelo, não toda a integração. A implementação completa de novas tentativas e recuo em cenários de streaming está em Erros de streaming de APIs de LLM.

Perguntas frequentes

“Ocorreu um erro no streaming de mensagens” é culpa minha?

Quase nunca. A mensagem significa que a conexão que transportava a resposta foi interrompida antes de ela terminar. O conteúdo que você digitou não causa isso. As causas são carga no lado da OpenAI, rede instável, extensões do navegador ou sessão de login inválida, ou uma conversa longa o suficiente para causar timeout.

O que fazer se regenerar ainda não funcionar?

Primeiro consulte status.openai.com — durante uma falha oficial, nenhum ajuste local ajudará. Se não houver falha, abra uma janela anônima usando outra rede: esse teste elimina simultaneamente extensões, cache e sua conexão habitual. Se funcionar no modo anônimo, reative cada item individualmente até o erro reaparecer. Se falhar em todos os lugares e apenas em uma conversa longa, leve os pontos principais para uma nova conversa.

Outras IAs também apresentam o mesmo erro?

Essa expressão é específica do ChatGPT, mas qualquer assistente que responda por streaming pode ser interrompido da mesma forma. O Claude exibe uma mensagem indicando que não conseguiu gerar a resposta completa; ao chamar a API diretamente, isso aparece como um streaming SSE que termina sem finish_reason ou, sob carga alta, como 529 overloaded_error.

Por que isso acontece mais em conversas longas?

A conversa inteira é enviada novamente a cada rodada, portanto, quanto mais longa a conversa, mais tempo a geração permanece na mesma conexão aberta. Quanto mais tempo a conexão fica aberta, mais oportunidades há para um timeout do proxy, uma troca de rede ou uma instabilidade do upstream interrompê-la. Iniciar uma nova conversa com um resumo costuma ser mais eficaz do que alterar qualquer configuração do navegador.

Guias relacionados

Mais detalhes sobre o significado dos erros estão em referência de erros; obter uma chave leva um minuto por meio de cadastro e da guia de autenticação.