L’erreur apparaît lorsque la connexion qui transmet progressivement la réponse de ChatGPT est interrompue avant la fin de la réponse. Elle est presque toujours indépendante de votre saisie : les causes courantes sont une charge élevée côté OpenAI, une connexion instable, des extensions de navigateur ou une conversation devenue trop longue. Regénérer la réponse résout la plupart des cas ; si cela échoue, une seule consultation de la page d’état permet de déterminer si le problème ne vient pas de votre côté.
L’erreur
訊息串流發生錯誤
(同一種故障的其他說法:「串流已中斷。正在等待完整訊息」、
「Hmm...something seems to have gone wrong.」
症狀都一樣 —— 回覆停在一半,永遠不會產生完。)Causes et solutions en bref
| Cause | Solution |
|---|---|
| OpenAI est fortement chargé ou connaît une panne. Cela peut toucher toutes les formules, y compris Plus et Pro ; si l’erreur revient toutes les quelques minutes, c’est la cause la plus probable. | Consultez status.openai.com. Pendant une panne, aucun réglage de votre côté ne changera le résultat ; attendre est la seule solution. |
| Connexion instable : bascule entre Wi-Fi et réseau mobile, VPN ou proxy d’entreprise, signal mobile faible. Le streaming maintient une connexion unique ouverte longtemps ; il peut donc être interrompu même lorsque les pages web ordinaires se chargent correctement. | Désactivez le VPN ou le proxy et réessayez via une autre connexion (Wi-Fi ⇄ réseau mobile). |
| Environnement du navigateur : extensions qui injectent du contenu dans la page, cache obsolète ou session de connexion expirée. | Réessayez en fenêtre privée. Si cela fonctionne en mode privé, la cause est une extension ou le cache — désactivez les extensions, effacez les données du site et reconnectez-vous. |
| Conversation trop longue ou pièce jointe trop volumineuse. À chaque tour, l’intégralité de la conversation est renvoyée, ce qui allonge la génération et augmente le risque d’interruption. | Transférez les points essentiels dans une nouvelle conversation. Fournissez les fichiers volumineux par morceaux au lieu de joindre l’ensemble. |
Essayez ces trois solutions pendant les 90 premières secondes
Regénérez la réponse → actualisez la page (dans l’application, fermez-la complètement puis rouvrez-la) → déconnectez-vous puis reconnectez-vous. Une interruption ponctuelle de la connexion se résout généralement par l’une de ces trois actions, et les interruptions ponctuelles sont la norme. En revanche, si l’arrêt se produit toujours au même endroit, cela indique une cause précise ci-dessous plutôt qu’un incident aléatoire.
Déterminer d’abord si le problème vient de votre côté
C’est l’étape que les autres guides omettent, alors qu’elle fait gagner le plus de temps. Ouvrez status.openai.com. Si une panne est en cours, aucun réglage local ne changera quoi que ce soit : attendre est la seule solution. S’il n’y a aucune panne, la cause est locale et l’étape suivante en réduira le périmètre. Faites cette vérification avant de modifier les réglages afin de ne pas passer vingt minutes à vider le cache pendant une panne officielle.
Réduire progressivement les causes locales, de l’extérieur vers l’intérieur
Suivez cet ordre, car chaque niveau élimine toutes les possibilités situées au-dessus : ① désactivez le VPN et le proxy ② ouvrez une fenêtre privée (ce qui retire en une fois les extensions et le cache) ③ changez de navigateur ou d’appareil ④ changez de réseau. Le niveau après lequel tout redevient normal est la cause. Si l’erreur ne survient que dans les longues conversations, aucun des quatre niveaux n’est en cause — transférez les points essentiels dans une nouvelle conversation.
Pour les développeurs : à quoi ressemble la même interruption dans l’API
Avec un appel API utilisant stream: true, le même problème se manifeste par une connexion Server-Sent Events qui se termine sans finish_reason. Le code HTTP est 200 — tout semble normal au moment où les en-têtes sont envoyés — si bien qu’un contrôle du seul statut ne suffit pas ; sous forte charge, des erreurs 429 et 529 overloaded_error peuvent également apparaître. Trois mesures rendent le problème tolérable : (1) traiter un flux qui se termine sans finish_reason comme réessayable, et non comme une réponse terminée ; (2) réessayer les erreurs 429, 500 et 529 avec un recul exponentiel et une temporisation aléatoire ; (3) si un proxy est utilisé, vérifier son délai d’inactivité et désactiver la mise en mémoire tampon des réponses — un proxy qui met en tampon transforme un flux normal en longue attente apparente. Pour isoler le problème, commencez par diffuser directement sans proxy :
# 直接串流、路徑上不放 Proxy,觀察它停在哪裡。
curl -N https://api.kunavo.com/v1/chat/completions \
-H "Authorization: Bearer $KUNAVO_API_KEY" \
-H "content-type: application/json" \
-d '{"model":"claude-sonnet-5","stream":true,
"max_tokens":300,
"messages":[{"role":"user","content":"請慢慢從 1 數到 20"}]}'Si vous appelez via Kunavo
Kunavo est une passerelle d’API IA ; les interruptions de streaming y constituent un état de fonctionnement prévu, pas une exception. Lorsqu’un modèle dispose de plusieurs canaux amont et que la première tentative échoue, la même requête réessaie via un autre canal dans le même appel ; une instabilité temporaire de l’amont devient donc une « réussite légèrement plus lente » plutôt qu’une erreur. Les requêtes échouées ne sont jamais facturées. Comme GPT et Claude partagent la même clé, lorsqu’un modèle est surchargé, il suffit de modifier le nom du modèle, pas toute l’intégration. La méthode complète pour réessayer et appliquer un recul exponentiel en streaming se trouve dans Erreurs de streaming de l’API LLM.
Questions fréquentes
« Une erreur s’est produite lors du streaming des messages » est-ce de ma faute ?
Presque jamais. Ce message signifie que la connexion qui transporte la réponse a été coupée avant la fin de celle-ci. Votre saisie n’en est pas la cause. Les causes sont la charge côté OpenAI, un réseau instable, des extensions de navigateur ou une session de connexion expirée, ou encore une conversation assez longue pour provoquer l’expiration du délai de réponse.
Que faire si la régénération échoue encore ?
Consultez d’abord status.openai.com — aucun réglage local ne sert à quelque chose pendant une panne officielle. S’il n’y a pas de panne, essayez un autre réseau dans une fenêtre privée : ce test élimine simultanément les extensions, le cache et votre connexion habituelle. Si le mode privé fonctionne, réactivez les éléments un par un jusqu’à reproduire l’erreur. Si tout échoue et que le problème ne concerne qu’une conversation longue, transférez les points essentiels dans une nouvelle conversation.
Les autres IA peuvent-elles produire la même erreur ?
Cette formulation appartient à ChatGPT, mais tout assistant répondant en streaming peut être interrompu de la même manière. Claude affiche un message indiquant qu’il ne peut pas générer entièrement la réponse ; lors d’un appel direct à l’API, le phénomène se manifeste par un flux SSE qui se termine sans finish_reason ou, sous forte charge, par une erreur 529 overloaded_error.
Pourquoi cela arrive-t-il plus souvent dans les longues conversations ?
À chaque tour, l’intégralité de la conversation est renvoyée ; plus la conversation est longue, plus la génération dure sur la même connexion ouverte. Plus la connexion reste ouverte, plus un délai d’expiration du proxy, un changement de réseau ou un incident côté amont peut l’interrompre. Démarrer une nouvelle conversation avec un résumé est généralement plus efficace que de modifier les paramètres du navigateur.
Guides associés
- Erreurs de streaming LLM — coupures SSE, flux bloqués et utilisation manquante
- Erreur Claude API 529 overloaded_error — ce que cette erreur signifie et comment la surmonter
- Tarifs de Claude 2026 — prix des abonnements, tarifs API et seuil de rentabilité
La sémantique détaillée des erreurs est disponible dans référence des erreurs ; obtenir une clé prend une minute via inscription et la guide d’authentification.