« Erreur dans le flux de messages » apparaît lorsque la connexion par laquelle ChatGPT fournit sa réponse morceau par morceau s’interrompt avant que celle-ci soit complète. Votre saisie n’est presque jamais en cause : la cause est presque toujours une surcharge du côté d’OpenAI, une connexion instable, une extension de navigateur ou une conversation devenue trop longue. Régénérer la réponse résout la majorité des cas — et si ce n’est pas le cas, un seul regard sur la page d’état vous indique si le problème vient réellement de vous.
L’erreur
Fehler im Nachrichtenstrom
(Gleiche Störung, andere Formulierungen: „Streaming unterbrochen.
Warte auf die vollständige Nachricht", „Hmm...da ist wohl etwas
schiefgelaufen." Symptom ist immer dasselbe — die Antwort bleibt
mitten im Satz stehen und wird nie fertig.)Causes et solutions en bref
| Cause | Solution |
|---|---|
| Surcharge ou panne du côté d’OpenAI. Elle touche simultanément tous les forfaits, y compris Plus et Pro, et constitue la cause la plus probable lorsque l’erreur réapparaît à intervalles de quelques minutes. | Vérifiez status.openai.com. Pendant une panne, aucun réglage de votre côté ne changera quoi que ce soit — attendre est la solution. |
| Connexion instable : basculement entre Wi-Fi et réseau mobile, VPN ou proxy d’entreprise, réception faible. La diffusion maintient une seule connexion longue ouverte et se rompt là où une simple ouverture de page passe encore. | Désactivez le VPN ou le proxy et réessayez via une autre connexion (Wi-Fi ⇄ réseau mobile). |
| Environnement du navigateur : une extension qui intervient dans la page, un cache obsolète ou une session expirée. | Réessayez dans une fenêtre privée. Si cela fonctionne, le problème vient d’une extension ou du cache — désactivez les extensions, supprimez les données du site, puis reconnectez-vous. |
| La conversation est trop longue ou les pièces jointes sont trop volumineuses. Chaque tour renvoie tout l’historique, la génération dure plus longtemps et s’interrompt plus facilement. | Transférez les points essentiels dans une nouvelle conversation. Divisez les fichiers volumineux au lieu de les joindre entièrement. |
Les trois manipulations pour les 90 premières secondes
Régénérez la réponse → rechargez la page (dans l’application, quittez-la complètement puis redémarrez-la) → déconnectez-vous et reconnectez-vous. Un flux interrompu une seule fois se résout avec l’une de ces trois étapes, et un incident ponctuel est le cas normal. En revanche, s’il s’interrompt toujours au même endroit, cela indique qu’une des causes précises ci-dessous est présente et qu’il ne s’agit pas d’un hasard.
Commencez par déterminer si le problème vient réellement de vous
C’est l’étape que les autres guides omettent et celle qui fait gagner le plus de temps. Ouvrez status.openai.com. Si une panne est en cours, aucun réglage local ne vous aidera et attendre est la seule solution. Si rien n’y figure, la cause vient de votre côté et l’étape suivante permet de la cerner. Effectuer cette vérification avant de modifier les réglages évite de passer vingt minutes à supprimer le cache pendant une panne.
Cerner la cause locale, de l’extérieur vers l’intérieur
Procédez dans cet ordre, car chaque niveau exclut tout ce qui le précède : (1) désactivez le VPN et le proxy ; (2) ouvrez une fenêtre privée — cela supprime les extensions et le cache en une seule étape ; (3) essayez un autre navigateur ou un autre appareil ; (4) changez de réseau. Le niveau à partir duquel le service refonctionne est la cause. Si l’erreur n’apparaît que dans les longues conversations, aucun des quatre éléments n’est responsable — transférez alors les points essentiels dans une nouvelle conversation.
Pour les développeurs : la même interruption dans l’API
Lors d’un appel avec stream: true, la même panne se manifeste par une connexion Server-Sent Events qui se termine sans finish_reason. Le statut HTTP est 200 — les en-têtes ont bien été envoyés —, une simple vérification du code d’état ne détecte donc pas l’interruption ; sous charge, les erreurs 429 et 529 overloaded_error peuvent également apparaître. Trois mesures permettent de la gérer : (1) traiter un flux terminé sans finish_reason comme réessayable, et non comme une réponse terminée ; (2) réessayer les erreurs 429, 500 et 529 avec un backoff exponentiel et un jitter ; (3) derrière un proxy, vérifier son délai d’inactivité et désactiver la mise en tampon des réponses — un proxy qui met en tampon transforme un flux fonctionnel en longue attente bloquée. Pour isoler le problème, commencez par diffuser sans proxy :
# Direkt streamen, kein Proxy dazwischen, und beobachten, wo es abbricht.
curl -N https://api.kunavo.com/v1/chat/completions \
-H "Authorization: Bearer $KUNAVO_API_KEY" \
-H "content-type: application/json" \
-d '{"model":"claude-sonnet-5","stream":true,
"max_tokens":300,
"messages":[{"role":"user","content":"Zähle langsam von 1 bis 20"}]}'Si vous appelez via Kunavo
Kunavo est une passerelle d’API IA et traite les flux interrompus comme un état opérationnel, et non comme une exception. Si plusieurs canaux en amont sont configurés pour un modèle et que la première tentative échoue, la même demande est répétée via un autre canal dans le cadre du même appel — une panne temporaire en amont devient ainsi une réussite un peu plus lente plutôt qu’une erreur. Les demandes échouées ne sont jamais facturées. Comme GPT et Claude sont accessibles avec une seule clé, il suffit d’utiliser un autre nom de modèle lorsqu’un modèle est surchargé, plutôt que de créer une seconde intégration. Le modèle de nouvelle tentative et de backoff pour le cas de la diffusion est détaillé dans Erreurs de streaming de l’API LLM.
Questions fréquentes
« Erreur dans le flux de messages » est-ce ma faute ?
Presque jamais. Le message indique que la connexion transportant la réponse a été interrompue avant la fin de celle-ci. Votre saisie n’en est pas la cause. Les causes sont une charge élevée du côté d’OpenAI, une connexion instable, une extension de navigateur ou une session expirée, ou encore une conversation devenue si longue que les réponses expirent.
Que faire si la régénération ne fonctionne pas ?
Commencez par vérifier status.openai.com — pendant une panne, aucune action locale ne sera utile. S’il n’y a pas de panne, ouvrez la page dans une fenêtre privée via un autre réseau : ce test unique élimine simultanément les extensions, le cache et votre connexion habituelle. Si cela fonctionne, réactivez chaque élément un par un jusqu’à ce que le problème réapparaisse. Si le problème survient partout et uniquement dans une longue conversation, transférez les points essentiels dans une nouvelle conversation.
Cela se produit-il aussi dans d’autres conversations IA ?
Cette formulation vient de ChatGPT, mais tout assistant qui diffuse ses réponses peut s’interrompre de la même manière. Claude affiche un message indiquant que la réponse n’a pas pu être générée entièrement ; lors d’un appel direct à l’API, cela apparaît comme un flux SSE qui se termine sans finish_reason, ou, sous charge, comme une erreur 529 overloaded_error.
Pourquoi cela arrive-t-il plus souvent dans les longues conversations ?
Chaque tour renvoie tout l’historique, ce qui signifie qu’une longue conversation entraîne une génération plus longue sur une seule connexion ouverte. Plus cette connexion reste ouverte, plus un délai d’expiration du proxy, un changement de réseau ou une interruption en amont a la possibilité de la rompre. Une nouvelle conversation contenant un résumé de l’essentiel apporte généralement plus qu’un réglage du navigateur.
Guides associés
- Erreurs de streaming LLM — coupures SSE, flux bloqués et utilisation manquante
- Erreur Claude API 529 overloaded_error — ce qu’elle signifie et comment la laisser passer
- Tarifs de l’API Gemini 2026 — tarifs par modèle, environ 70 % sous le tarif public de Google
La sémantique détaillée des erreurs est disponible dans référence des erreurs ; obtenir une clé prend une minute via inscription et la guide d’authentification.