“Ocorreu um erro no streaming de mensagens” aparece quando a conexão que transmite a resposta do ChatGPT caractere a caractere é interrompida antes do fim. Quase nunca é causado pelo que você digitou: as causas comuns são carga excessiva no lado da OpenAI, uma conexão instável, extensões do navegador ou uma conversa que ficou longa demais. Regenerar a resposta resolve a maioria dos casos; se não resolver, basta consultar a página de status uma vez para saber se o problema não está do seu lado.
O erro
訊息串流發生錯誤
(同一種故障的其他說法:「串流已中斷。正在等待完整訊息」、
「Hmm...something seems to have gone wrong.」
症狀都一樣 —— 回覆停在一半,永遠不會產生完。)Causas e soluções em resumo
| Causa | Solução |
|---|---|
| Carga excessiva ou falha no lado da OpenAI. Afeta simultaneamente todos os planos, inclusive Plus e Pro; se o erro se repetir a cada poucos minutos, esta é a causa mais provável. | Consulte status.openai.com. Durante uma falha, nenhum ajuste local mudará o resultado; esperar é a única solução. |
| Conexão instável: alternância entre Wi-Fi e rede móvel, VPN ou proxy corporativo, ou sinal móvel fraco. O streaming mantém uma única conexão aberta por muito tempo, por isso pode cair mesmo quando páginas comuns carregam normalmente. | Desative a VPN ou o proxy e tente novamente usando outra conexão (Wi-Fi ⇄ rede móvel). |
| Ambiente do navegador: extensões que injetam conteúdo na página, cache expirado ou sessão de login inválida. | Tente novamente em uma janela anônima. Se funcionar no modo anônimo, a causa é uma extensão ou o cache — desative as extensões, limpe os dados do site e faça login novamente. |
| Conversa longa ou anexo grande. A cada rodada, toda a conversa é enviada novamente, o tempo de geração aumenta e a probabilidade de interrupção também. | Leve os pontos principais para uma nova conversa. Envie arquivos grandes em partes, em vez de anexar tudo de uma vez. |
Experimente estas três ações nos primeiros 90 segundos
Regenerar a resposta → recarregar a página (no aplicativo, fechá-lo completamente e abri-lo novamente) → sair e entrar outra vez. Uma interrupção pontual costuma ser resolvida por uma dessas três ações — e interrupções pontuais são o caso normal. Por outro lado, se sempre parar no mesmo ponto, isso indica uma causa específica abaixo, não um evento aleatório.
Primeiro, determine se o problema está do seu lado
Esta é a etapa que outros guias ignoram, embora seja a que mais economiza tempo. Abra status.openai.com. Se houver uma falha em andamento, nenhuma configuração local mudará algo; esperar é a única solução. Se não houver falha, a causa está localmente e o próximo passo reduzirá o escopo. Faça essa verificação antes de alterar configurações para não passar vinte minutos limpando o cache durante uma falha oficial.
Reduza as causas locais de fora para dentro, uma camada por vez
Siga esta ordem, pois cada camada elimina todas as possibilidades acima dela: ① desative VPN e proxy ② abra uma janela anônima (removendo extensões e cache de uma vez) ③ troque de navegador ou dispositivo ④ troque de rede. A camada após a qual tudo voltar ao normal é a causa. Se o erro ocorrer apenas em conversas longas, nenhuma das quatro camadas é o problema — levar os pontos principais para uma nova conversa é a solução.
Para desenvolvedores: como a mesma interrupção aparece na API
Ao chamar a API com stream: true, a mesma falha aparece como uma conexão Server-Sent Events que termina sem finish_reason. O código HTTP é 200 — tudo está normal no momento em que os cabeçalhos são enviados — portanto verificar apenas o código de status não detecta o problema; sob carga alta, também podem aparecer 429 e 529 overloaded_error. Três medidas tornam isso tolerável: (1) tratar um streaming que termina sem finish_reason como passível de nova tentativa, não como resposta concluída; (2) usar novas tentativas com recuo exponencial e jitter para 429, 500 e 529; (3) se houver um proxy intermediário, verificar o idle timeout e desativar o buffer de resposta — um proxy que armazena respostas pode transformar um streaming normal em uma conexão aparentemente travada por muito tempo. Para esclarecer o problema, faça primeiro o streaming diretamente, sem proxy:
# 直接串流、路徑上不放 Proxy,觀察它停在哪裡。
curl -N https://api.kunavo.com/v1/chat/completions \
-H "Authorization: Bearer $KUNAVO_API_KEY" \
-H "content-type: application/json" \
-d '{"model":"claude-sonnet-5","stream":true,
"max_tokens":300,
"messages":[{"role":"user","content":"請慢慢從 1 數到 20"}]}'Se você estiver chamando pela Kunavo
A Kunavo é um gateway de API de IA, e interrupções de streaming são um estado operacional esperado aqui, não uma exceção. Quando um modelo tem vários canais upstream e a primeira tentativa falha, a mesma solicitação tenta outro canal dentro da mesma chamada; assim, uma instabilidade momentânea do upstream vira um “sucesso um pouco mais lento”, não um erro. Solicitações com falha nunca são cobradas. Como GPT e Claude compartilham a mesma chave, quando um modelo está sobrecarregado você troca o nome do modelo, não toda a integração. A implementação completa de novas tentativas e recuo em cenários de streaming está em Erros de streaming de APIs de LLM.
Perguntas frequentes
“Ocorreu um erro no streaming de mensagens” é culpa minha?
Quase nunca. A mensagem significa que a conexão que transportava a resposta foi interrompida antes de ela terminar. O conteúdo que você digitou não causa isso. As causas são carga no lado da OpenAI, rede instável, extensões do navegador ou sessão de login inválida, ou uma conversa longa o suficiente para causar timeout.
O que fazer se regenerar ainda não funcionar?
Primeiro consulte status.openai.com — durante uma falha oficial, nenhum ajuste local ajudará. Se não houver falha, abra uma janela anônima usando outra rede: esse teste elimina simultaneamente extensões, cache e sua conexão habitual. Se funcionar no modo anônimo, reative cada item individualmente até o erro reaparecer. Se falhar em todos os lugares e apenas em uma conversa longa, leve os pontos principais para uma nova conversa.
Outras IAs também apresentam o mesmo erro?
Essa expressão é específica do ChatGPT, mas qualquer assistente que responda por streaming pode ser interrompido da mesma forma. O Claude exibe uma mensagem indicando que não conseguiu gerar a resposta completa; ao chamar a API diretamente, isso aparece como um streaming SSE que termina sem finish_reason ou, sob carga alta, como 529 overloaded_error.
Por que isso acontece mais em conversas longas?
A conversa inteira é enviada novamente a cada rodada, portanto, quanto mais longa a conversa, mais tempo a geração permanece na mesma conexão aberta. Quanto mais tempo a conexão fica aberta, mais oportunidades há para um timeout do proxy, uma troca de rede ou uma instabilidade do upstream interrompê-la. Iniciar uma nova conversa com um resumo costuma ser mais eficaz do que alterar qualquer configuração do navegador.
Guias relacionados
- Erros de streaming de LLM — cortes de SSE, streams travados e uso ausente
- Erro 529 overloaded_error da Claude API — o que esse erro significa e como superá-lo
- Custos do Claude em 2026 — preços das assinaturas, tarifas da API e ponto de equilíbrio
Mais detalhes sobre o significado dos erros estão em referência de erros; obter uma chave leva um minuto por meio de cadastro e da guia de autenticação.