„Fehler im Nachrichtenstream“ wird angezeigt, wenn die Verbindung, über die ChatGPT seine Antwort Stück für Stück liefert, vor Abschluss der Antwort unterbrochen wird. Das liegt fast nie an dem, was Sie geschrieben haben: Übliche Ursachen sind eine Überlastung auf Seiten von OpenAI, eine instabile Verbindung, eine Browsererweiterung oder eine zu lang gewordene Unterhaltung. Das erneute Generieren der Antwort behebt die meisten Fälle; wenn das nicht ausreicht, zeigt Ihnen eine einzige Prüfung, ob das Problem bei Ihnen liegt.
Der Fehler
Erreur dans le flux de messages
(Même panne, autres formulations : « Streaming interrompu.
En attente du message complet », « Hmm...quelque chose semble
avoir mal tourné. » Le symptôme est identique — la réponse
s'arrête en cours de route et ne se termine jamais.)Ursachen und Lösungen im Überblick
| Ursache | Lösung |
|---|---|
| Überlastung oder Störung auf Seiten von OpenAI. Betrifft alle Tarife gleichzeitig, einschließlich Plus und Pro, und ist die wahrscheinlichste Ursache, wenn der Fehler alle paar Minuten wiederkehrt. | Prüfen Sie status.openai.com. Während einer Störung ändert nichts, was Sie bei sich ändern, das Ergebnis — warten ist die Lösung. |
| Instabile Verbindung: Wechsel zwischen WLAN und 4G, VPN oder Unternehmensproxy, schwaches Mobilfunksignal. Streaming hält eine einzelne Verbindung lange offen und bricht daher an einer Stelle ab, an der das gewöhnliche Laden einer Seite funktionieren würde. | Deaktivieren Sie VPN oder Proxy und versuchen Sie es über eine andere Verbindung erneut (WLAN ⇄ Mobilfunk). |
| Browserumgebung: eine Erweiterung, die sich in die Seite einfügt, ein veralteter Cache oder eine abgelaufene Sitzung. | Versuchen Sie es im privaten Browsing-Modus erneut. Wenn es dort funktioniert, liegt die Ursache bei einer Erweiterung oder dem Cache — deaktivieren Sie Erweiterungen, löschen Sie die Websitedaten und melden Sie sich erneut an. |
| Zu lange Unterhaltung oder zu große Anhänge. Bei jedem Durchlauf wird der gesamte Verlauf erneut gesendet, sodass die Generierung länger dauert und leichter abbricht. | Übertragen Sie das Wesentliche in eine neue Unterhaltung. Teilen Sie große Dateien auf, statt sie vollständig anzuhängen. |
Die drei Handgriffe der ersten 90 Sekunden
Antwort neu generieren → Seite neu laden (auf Mobilgeräten die App vollständig beenden und erneut öffnen) → abmelden und wieder anmelden. Eine einmalige Unterbrechung lässt sich mit einem dieser drei Handgriffe beheben, und einmalig ist der Normalfall. Wenn es dagegen jedes Mal exakt an derselben Stelle abbricht, deutet das darauf hin, dass eine der unten genannten konkreten Ursachen vorliegt und kein Zufallsereignis.
Zuerst feststellen, ob das Problem bei Ihnen liegt
Diesen Schritt überspringen andere Fehlerbehebungslisten, obwohl er am meisten Zeit spart. Öffnen Sie status.openai.com. Wenn gerade ein Vorfall vorliegt, ändert keine lokale Einstellung etwas daran, und Warten ist die einzige Möglichkeit. Wenn nichts gemeldet wird, liegt die Ursache lokal, und der nächste Schritt grenzt sie ein. Diese Prüfung vor Änderungen an den Einstellungen verhindert, dass Sie während eines Ausfalls zwanzig Minuten lang Caches leeren.
Die lokale Ursache von außen nach innen eingrenzen
Gehen Sie in dieser Reihenfolge vor; jeder Schritt schließt alles Vorherige aus: (1) VPN und Proxy deaktivieren; (2) ein privates Browserfenster öffnen — dadurch werden Erweiterungen und Cache mit einem einzigen Handgriff umgangen; (3) einen anderen Browser oder ein anderes Gerät ausprobieren; (4) das Netzwerk wechseln. Der Schritt, ab dem es wieder funktioniert, weist auf die Ursache hin. Wenn der Fehler nur in langen Unterhaltungen auftritt, ist keiner der vier Schritte die Ursache: Übertragen Sie das Wesentliche in eine neue Unterhaltung.
Für Entwickler: derselbe Abbruch auf API-Seite
Beim Aufruf der API mit stream: true zeigt sich derselbe Ausfall als eine Server-Sent-Events-Verbindung, die ohne finish_reason endet. Der HTTP-Status ist 200 — beim Senden der Header war alles in Ordnung — daher erkennt eine Prüfung nur des Statuscodes den Fehler nicht; unter Last kommen 429 und 529 overloaded_error hinzu. Drei Maßnahmen machen das beherrschbar: (1) einen beendeten Stream ohne finish_reason als erneut auszuführenden Versuch behandeln, nicht als vollständige Antwort; (2) 429, 500 und 529 mit exponentiellem Backoff und Jitter erneut versuchen; (3) hinter einem Proxy dessen idle timeout prüfen und das Puffern von Antworten deaktivieren — ein Proxy, der puffert, verwandelt einen funktionierenden Stream in eine lange Blockade. Zur Eingrenzung streamen Sie zunächst ohne Proxy:
# Streamer directement, sans proxy sur le chemin, et voir où ça s'arrête.
curl -N https://api.kunavo.com/v1/chat/completions \
-H "Authorization: Bearer $KUNAVO_API_KEY" \
-H "content-type: application/json" \
-d '{"model":"claude-sonnet-5","stream":true,
"max_tokens":300,
"messages":[{"role":"user","content":"compte lentement de 1 à 20"}]}'Wenn Sie Kunavo verwenden
Kunavo ist ein KI-API-Gateway, und ein unterbrochener Stream ist dort ein vorgesehener Betriebszustand, keine Ausnahme. Wenn für ein Modell mehrere Upstream-Kanäle konfiguriert sind und der erste Versuch fehlschlägt, wird die Anfrage innerhalb desselben Aufrufs über einen anderen Kanal erneut ausgeführt: Ein vorübergehender Upstream-Vorfall wird zu einem etwas langsameren Erfolg statt zu einem Fehler. Fehlgeschlagene Anfragen werden niemals berechnet. Da GPT und Claude mit einem einzigen Schlüssel zugänglich sind, bedeutet das Umgehen eines überlasteten Modells, den Modellnamen zu ändern, nicht die Integration. Das Schema für Wiederholungen und Backoff im Streaming-Fall wird ausführlich beschrieben in Streaming-Fehler bei LLM-APIs.
Häufig gestellte Fragen
„Fehler im Nachrichtenstream“: Liegt es an mir?
Fast nie. Die Meldung bedeutet, dass die Verbindung, über die die Antwort übertragen wurde, vor dem Ende getrennt wurde. Das von Ihnen Geschriebene ist nicht die Ursache. Ursachen sind die Auslastung auf OpenAI-Seite, ein instabiles Netzwerk, eine Browsererweiterung oder eine abgelaufene Sitzung oder eine Unterhaltung, die lang genug geworden ist, dass Antworten ablaufen.
Was tun, wenn erneutes Generieren nicht ausreicht?
Prüfen Sie zuerst status.openai.com — während eines Vorfalls hilft nichts Lokales. Wenn kein Vorfall vorliegt, öffnen Sie in einem anderen Netzwerk ein privates Fenster: Dieser einzelne Test umgeht gleichzeitig Erweiterungen, Cache und Ihre übliche Verbindung. Wenn es funktioniert, fügen Sie jedes Element einzeln wieder hinzu, bis der Fehler erneut auftritt. Wenn es überall und nur in einer langen Unterhaltung fehlschlägt, übertragen Sie das Wesentliche in eine neue.
Passiert das auch bei anderen KIs?
Die Formulierung stammt von ChatGPT, aber jeder Assistent, der seine Antworten streamt, kann auf dieselbe Weise abbrechen. Claude zeigt eine Meldung an, dass die vollständige Antwort nicht generiert werden konnte; bei einem direkten API-Aufruf zeigt sich das als SSE-Stream, der ohne finish_reason endet, oder unter Last als 529 overloaded_error.
Warum tritt der Fehler in langen Unterhaltungen häufiger auf?
Jede Runde sendet den gesamten Gesprächsverlauf erneut, daher bedeutet eine lange Unterhaltung eine längere Generierung über eine einzige offene Verbindung. Je länger diese Verbindung offen bleibt, desto mehr Gelegenheiten gibt es für ein Proxy-Timeout, einen Netzwerkwechsel oder einen kurzen Upstream-Aussetzer, sie zu unterbrechen. Mit einer neuen Unterhaltung und einer Zusammenfassung des Wesentlichen zu beginnen, bewirkt normalerweise mehr als jede Browsereinstellung.
Verwandte Anleitungen
- LLM-Streaming-Fehler — SSE-Abbrüche, hängende Streams und fehlende Nutzungsdaten
- Claude-API-Fehler 529 overloaded_error — was er bedeutet und wie du ihn abfängst
- Gemini-API-Preise 2026 — Tarife nach Modell, Beispiele und günstigerer Zugriff
Weitere Informationen zur Fehlersemantik finden Sie unter Fehlerreferenz; einen Schlüssel erhalten Sie in einer Minute über Registrierung und die Authentifizierungsanleitung.