„Streaming unterbrochen. Warten auf die vollständige Nachricht“ erscheint, wenn die Verbindung, über die die ChatGPT-Antwort an deinen Browser gestreamt wird, abbricht, bevor die Antwort beendet ist. Fast nie liegt es an dem, was du eingegeben hast: Häufige Ursachen sind eine Belastung auf der Seite von OpenAI, eine instabile Verbindung, eine Browser-Erweiterung oder ein zu lang gewordener Thread. Eine erneute Generierung behebt die meisten Fälle; wenn das nicht funktioniert, zeigt dir eine einzige Statusprüfung, ob das Problem überhaupt bei dir liegt.
Der Fehler
Streaming interrupted. Waiting for the complete message...
(related wording for the same failure: "Error in message stream",
"Hmm...something seems to have gone wrong." The symptom is the same —
the answer stops partway and never completes.)Ursachen und Lösungen im Überblick
| Ursache | Lösung |
|---|---|
| Belastung oder eine Störung auf der Seite von OpenAI. Betrifft alle Tarife gleichzeitig, einschließlich Plus und Pro, und ist die häufigste Ursache, wenn der Fehler alle paar Minuten erneut auftritt. | Prüfe status.openai.com. Während einer Störung ändert nichts auf deiner Seite das Ergebnis — Warten ist die Lösung. |
| Eine instabile Verbindung: ein Wechsel zwischen WLAN-Netzwerken, ein VPN oder Unternehmens-Proxy oder ein schwaches Mobilfunksignal. Streaming hält eine einzelne, langlebige Verbindung offen und bricht daher an einer Stelle ab, an der gewöhnliche Seitenaufrufe noch funktionieren. | Schalten Sie VPN oder Proxy aus und versuchen Sie es erneut über eine andere Verbindung (WLAN zu Mobilfunk oder umgekehrt). |
| Browserumgebung: Eine Erweiterung greift in die Seite ein, der Cache ist veraltet oder die Sitzung ist abgelaufen. | Versuchen Sie es in einem privaten Fenster erneut. Wenn es dort funktioniert, liegt die Ursache an einer Erweiterung oder am Cache — deaktivieren Sie Erweiterungen, löschen Sie die Websitedaten und melden Sie sich erneut an. |
| Der Thread ist zu lang oder die Anhänge sind zu groß. Eine sehr lange Unterhaltung wird mit jeder Nachricht erneut gesendet, daher dauern Antworten länger und werden eher abgeschnitten. | Übertragen Sie die wichtigsten Punkte in einen neuen Chat. Teilen Sie große Dateien auf, anstatt sie vollständig anzuhängen. |
Die drei Schritte für 90 Sekunden
Generieren Sie die Antwort neu, laden Sie die Seite neu (auf Mobilgeräten: beenden Sie die App vollständig und öffnen Sie sie erneut) und melden Sie sich anschließend ab und wieder an. Eine einmalige unterbrochene Verbindung wird durch einen dieser drei Schritte behoben, und in den meisten Fällen tritt sie nur einmal auf. Wenn der Vorgang jedes Mal an derselben Stelle stoppt, deutet das darauf hin, dass eine der unten genannten spezifischen Ursachen vorliegt und nicht nur eine vorübergehende Unterbrechung.
Stellen Sie fest, ob die Ursache überhaupt bei Ihnen liegt
Diesen Schritt überspringen andere Fehlerbehebungslisten, dabei spart er am meisten Zeit. Öffnen Sie status.openai.com. Wenn dort ein Vorfall angezeigt wird, kann keine Einstellung auf Ihrem Gerät etwas ändern; die einzige Lösung besteht darin zu warten. Wenn nichts angezeigt wird, liegt die Ursache lokal, und der nächste Schritt grenzt sie ein. Wenn Sie dies tun, bevor Sie Einstellungen ändern, verschwenden Sie nie zwanzig Minuten damit, wegen eines Ausfalls Caches zu leeren.
Grenzen Sie die lokale Ursache von außen nach innen ein
Gehen Sie die Ebenen in dieser Reihenfolge durch, da jede Ebene alles darüber ausschließt: (1) VPN und Proxy ausschalten; (2) ein privates Fenster öffnen, wodurch Erweiterungen und Cache in einem Schritt entfernt werden; (3) einen anderen Browser oder ein anderes Gerät ausprobieren; (4) das Netzwerk wechseln. Die Ebene, auf der es funktioniert, ist die Ursache. Wenn der Fehler nur in langen Threads auftritt, ist keine der vier Ebenen das Problem — übertragen Sie die wichtigsten Punkte in einen neuen Chat.
Für Entwickler: Derselbe Abbruch bei der API
Wenn Sie die API mit stream: true aufrufen, tritt dieser Fehler als Server-Sent-Events-Verbindung auf, die ohne finish_reason endet. Der HTTP-Status ist 200 — beim Senden der Header war alles in Ordnung — daher erkennen alleinige Statuscode-Prüfungen den Fehler nicht; unter hoher Auslastung sehen Sie außerdem 429 und 529 overloaded_error. Drei Dinge machen den Fehler beherrschbar: (1) Behandeln Sie einen Stream, der ohne finish_reason endet, als wiederholbar und nicht als abgeschlossene Antwort; (2) wiederholen Sie 429, 500 und 529 mit exponentiellem Backoff plus Jitter; (3) prüfen Sie bei einem Proxy dessen Leerlauf-Timeout und schalten Sie die Antwortpufferung aus — ein puffernder Proxy verwandelt einen funktionierenden Stream in einen langen Stillstand. Reproduzieren Sie den Fehler zunächst ohne Proxy:
# Stream directly, no proxy in the path, and watch where it stops.
curl -N https://api.kunavo.com/v1/chat/completions \
-H "Authorization: Bearer $KUNAVO_API_KEY" \
-H "content-type: application/json" \
-d '{"model":"claude-sonnet-5","stream":true,
"max_tokens":300,
"messages":[{"role":"user","content":"count slowly from 1 to 20"}]}'Wenn Sie Kunavo verwenden
Kunavo ist ein AI-API-Gateway, und unterbrochene Streams sind ein Zustand, den es abfangen soll, keine Ausnahme. Wenn mehr als ein Upstream-Kanal für ein Modell konfiguriert ist und der erste Versuch fehlschlägt, wird die Anfrage innerhalb desselben Aufrufs über einen anderen Kanal wiederholt. Dadurch erscheint ein vorübergehendes Upstream-Problem als etwas langsamere erfolgreiche Antwort statt als Fehler. Fehlgeschlagene Anfragen werden niemals berechnet. Da GPT und Claude über einen einzigen Schlüssel erreichbar sind, kann ein überlastetes Modell umgangen werden, indem Sie den Modellnamen statt der Integration ändern. Das Retry- und Backoff-Muster für den Streaming-Fall ist beschrieben in Streaming-Fehler bei LLM-APIs.
Häufig gestellte Fragen
Liegt es an mir, wenn „Streaming unterbrochen, auf die vollständige Nachricht wird gewartet“ angezeigt wird?
Fast nie. Die Meldung bedeutet, dass die Verbindung, über die die Antwort übertragen wurde, vor Abschluss der Antwort unterbrochen wurde. Was Sie eingegeben haben, verursacht dies nicht. Ursachen sind eine hohe Auslastung auf der Seite von OpenAI, ein instabiles Netzwerk, eine Browsererweiterung oder eine veraltete Sitzung beziehungsweise ein Thread, der lang genug geworden ist, um bei Antworten ein Timeout zu verursachen.
Was ist, wenn die Neugenerierung das Problem nicht behebt?
Prüfen Sie zuerst status.openai.com — während eines Vorfalls hilft lokal nichts. Wenn kein Vorfall vorliegt, öffnen Sie in einem anderen Netzwerk ein privates Fenster: Dieser einzelne Test entfernt Erweiterungen und Cache und verwendet gleichzeitig eine andere Verbindung. Wenn es dort funktioniert, fügen Sie die Komponenten einzeln wieder hinzu, bis der Fehler erneut auftritt. Wenn es überall fehlschlägt und nur in einer langen Unterhaltung, übertragen Sie die wichtigsten Punkte in einen neuen Chat.
Tritt das auch bei anderen AI-Chats auf?
Die Formulierung stammt von ChatGPT, aber jeder Assistent, der Antworten streamt, kann auf dieselbe Weise abbrechen. Claude zeigt eine Meldung an, dass die Antwort nicht abgeschlossen werden konnte; bei einem direkten API-Aufruf erscheint dies als Server-Sent-Events-Stream, der ohne finish_reason endet, oder unter hoher Auslastung als 529 overloaded_error.
Warum tritt der Fehler in langen Unterhaltungen häufiger auf?
Bei jeder Nachricht wird der gesamte Thread erneut gesendet, daher bedeutet eine lange Unterhaltung eine längere Generierung über eine einzige Verbindung. Je länger diese Verbindung offen ist, desto mehr Möglichkeiten gibt es für ein Proxy-Timeout, einen Netzwerkwechsel oder eine Upstream-Störung, sie zu unterbrechen. Einen neuen Chat mit einer Zusammenfassung der wichtigen Punkte zu starten, bringt normalerweise mehr als jede Browsereinstellung.
Wird mir etwas berechnet, wenn ein Stream unterbrochen wird?
Bei ChatGPT-Abonnements gibt es keine Gebühr pro Nachricht, daher geht außer der Zeit nichts verloren. Bei der API richtet sich die Abrechnung nach den Tokens, die der Anbieter tatsächlich erzeugt hat; ein frühzeitig abbrechender Stream kostet daher weniger als ein vollständiger — und bei Kunavo wird eine Anfrage, die vollständig fehlschlägt, überhaupt nicht berechnet.
Verwandte Anleitungen
- LLM-Streaming-Fehler — SSE-Abbrüche, hängende Streams und fehlende Nutzungsdaten
- Claude API 529 overloaded_error — was es bedeutet und wie man es übersteht
- Claude-API-Anfrage-Timeouts und „Streaming wird dringend empfohlen“ — die 10-Minuten-Regel
Weitere Informationen zur Fehlersemantik finden Sie unter Fehlerreferenz; einen Schlüssel erhalten Sie in einer Minute über Registrierung und die Authentifizierungsanleitung.