«Error en el flujo de mensajes» aparece cuando la conexión mediante la que ChatGPT te entrega su respuesta por partes se interrumpe antes de que la respuesta termine. Casi nunca se debe a lo que has escrito: las causas habituales son una sobrecarga del lado de OpenAI, una conexión inestable, una extensión del navegador o una conversación demasiado larga. Regenerar la respuesta resuelve la mayoría de los casos; cuando no basta, una sola comprobación indica si el problema está en tu entorno.
El error
Erreur dans le flux de messages
(Même panne, autres formulations : « Streaming interrompu.
En attente du message complet », « Hmm...quelque chose semble
avoir mal tourné. » Le symptôme est identique — la réponse
s'arrête en cours de route et ne se termine jamais.)Causas y soluciones de un vistazo
| Causa | Solución |
|---|---|
| Sobrecarga o incidencia del lado de OpenAI. Afecta simultáneamente a todos los planes, incluidos Plus y Pro, y es la causa más probable cuando el error vuelve cada pocos minutos. | Consulta status.openai.com. Durante una incidencia, nada de lo que cambies localmente modifica el resultado; esperar es la solución. |
| Conexión inestable: cambio entre Wi‑Fi y 4G, VPN o proxy corporativo, señal móvil débil. El streaming mantiene abierta una sola conexión durante mucho tiempo, por lo que falla donde una carga de página normal funcionaría. | Desactiva la VPN o el proxy y vuelve a intentarlo con otra conexión (Wi‑Fi ⇄ móvil). |
| Entorno del navegador: una extensión que se inyecta en la página, una caché obsoleta o una sesión caducada. | Vuelve a intentarlo en navegación privada. Si funciona allí, la causa es una extensión o la caché: desactiva las extensiones, borra los datos del sitio y vuelve a iniciar sesión. |
| Conversación demasiado larga o archivos adjuntos demasiado pesados. Cada turno reenvía todo el historial, por lo que la generación tarda más y se interrumpe con mayor facilidad. | Traslada lo esencial a una conversación nueva. Divide los archivos grandes en lugar de adjuntarlos completos. |
Las tres acciones de los primeros 90 segundos
Regenerar la respuesta → recargar la página (en móvil, cerrar completamente la aplicación y volver a abrirla) → cerrar sesión y volver a iniciarla. Una interrupción puntual se resuelve con una de estas tres acciones, y lo puntual es lo normal. Si, en cambio, se detiene exactamente en el mismo punto cada vez, es señal de que interviene una de las causas concretas siguientes y no un hecho aleatorio.
Determina primero si el problema está en tu entorno
Este es el paso que omiten otras listas de solución de problemas y el que más tiempo ahorra. Abre status.openai.com. Si hay una incidencia en curso, ningún ajuste local cambiará nada y esperar es la única opción. Si no se indica ninguna, la causa es local y el paso siguiente la acota. Hacer esta comprobación antes de tocar la configuración evita pasar veinte minutos borrando cachés durante una interrupción del servicio.
Aísla la causa local de fuera hacia dentro
Procede en este orden, ya que cada paso descarta todo lo anterior: (1) desactiva la VPN y el proxy; (2) abre una ventana de navegación privada —elimina las extensiones y la caché de una sola vez—; (3) prueba otro navegador u otro dispositivo; (4) cambia de red. El paso a partir del cual vuelve a funcionar señala la causa. Si el error solo aparece en conversaciones largas, ninguna de las cuatro opciones es la causa: traslada lo esencial a una conversación nueva.
Para desarrolladores: la misma interrupción en el lado de la API
Al llamar a la API con stream: true, el mismo fallo se presenta como una conexión Server-Sent Events que termina sin finish_reason. El estado HTTP es 200 —todo funcionaba al enviar las cabeceras—, por lo que una comprobación del único código de estado no lo detecta; bajo carga se añaden 429 y 529 overloaded_error. Tres medidas lo hacen tolerable: (1) tratar un flujo terminado sin finish_reason como susceptible de reintento, no como una respuesta completa; (2) reintentar los códigos 429, 500 y 529 con backoff exponencial y jitter; (3) detrás de un proxy, comprobar su tiempo de espera por inactividad y desactivar el almacenamiento en búfer de respuestas; un proxy que almacena en búfer convierte un flujo funcional en un bloqueo prolongado. Para acotar el problema, transmite primero sin proxy:
# Streamer directement, sans proxy sur le chemin, et voir où ça s'arrête.
curl -N https://api.kunavo.com/v1/chat/completions \
-H "Authorization: Bearer $KUNAVO_API_KEY" \
-H "content-type: application/json" \
-d '{"model":"claude-sonnet-5","stream":true,
"max_tokens":300,
"messages":[{"role":"user","content":"compte lentement de 1 à 20"}]}'Si llamas a través de Kunavo
Kunavo es una puerta de enlace de API de IA, y un flujo interrumpido es allí un estado operativo previsto, no una excepción. Cuando hay varios canales ascendentes configurados para un modelo y el primer intento falla, la solicitud se repite en otro canal dentro de la misma llamada: una incidencia ascendente pasajera se convierte en un éxito ligeramente más lento en lugar de un error. Las solicitudes fallidas nunca se facturan. Como GPT y Claude están disponibles con una sola clave, evitar un modelo saturado equivale a cambiar el nombre del modelo, no la integración. El esquema de repetición y backoff para el caso del streaming se detalla en Errores de transmisión de la API de LLM.
Preguntas frecuentes
«Error en el flujo de mensajes»: ¿es culpa mía?
Casi nunca. El mensaje indica que la conexión que transportaba la respuesta se interrumpió antes del final. Lo que has escrito no es la causa. Las causas son la carga del lado de OpenAI, una red inestable, una extensión del navegador o una sesión caducada, o una conversación que se ha vuelto lo bastante larga como para que las respuestas agoten el tiempo de espera.
¿Qué hago si regenerar no basta?
Comprueba primero status.openai.com; durante una incidencia, nada local ayuda. Si no hay ninguna incidencia, abre una ventana privada en otra red: esta única prueba elimina de una vez las extensiones, la caché y tu conexión habitual. Si funciona, vuelve a añadir cada elemento de uno en uno hasta que vuelva a fallar. Si falla en todas partes y solo en una conversación larga, traslada lo esencial a una conversación nueva.
¿Ocurre también con otras IA?
La formulación es propia de ChatGPT, pero cualquier asistente que transmita sus respuestas puede fallar de la misma manera. Claude muestra un mensaje que indica que no pudo generar la respuesta completa; en una llamada directa a la API, esto aparece como un flujo SSE que termina sin finish_reason o, bajo carga, como un 529 overloaded_error.
¿Por qué el error vuelve con más frecuencia en conversaciones largas?
Cada turno reenvía todo el hilo, por lo que una conversación larga implica una generación más larga mantenida en una única conexión abierta. Cuanto más tiempo permanece abierta esa conexión, más oportunidades hay de que un tiempo de espera del proxy, un cambio de red o un fallo ascendente la interrumpan. Empezar de nuevo con una conversación nueva y un resumen de lo esencial suele cambiar más las cosas que cualquier ajuste del navegador.
Guías relacionadas
- Errores de streaming de LLM: cortes SSE, streams bloqueados y uso no informado
- Error 529 overloaded_error de la API de Claude: qué es y cómo gestionarlo
- Precios de la API de Gemini 2026 — tarifas por modelo, ejemplos y acceso más barato
Encontrarás más detalles sobre el significado de los errores en referencia de errores; obtener una clave lleva un minuto mediante registro y la guía de autenticación.