Zurück zu den Leitfäden
Kosten·11. September 2026·Aktualisiert am 5. Oktober 2026·9 Min. Lesezeit

Kosten der ChatGPT API 2026 — Wie die OpenAI API abrechnet, GPT-6-Preise und tatsächliche Kosten

Ein ChatGPT-Abonnement beinhaltet kein API-Guthaben — hier bleiben die meisten hängen. Diese Seite trennt die beiden Konten und listet die aktuellen Preise der einzelnen Modelle der OpenAI API sowie die tatsächlichen Kosten einer Anfrage auf.

Die ChatGPT API ist im Grunde die OpenAI API: Abrechnung nach Token, keine Monatsgebühr. Mit Stand vom 5. Oktober 2026 beträgt der offizielle Preis für OpenAIs aktuelles Flaggschiff GPT-6 Astra pro 1M Token $10,00 für Eingabe / $50,00 für Ausgabe, bei Kunavo $4,00 / $20,00; das tägliche Arbeitspferd GPT-5.6 Terra kostet $0,70 / $4,20 (offiziell $2,00 / $12,00), GPT-6 Sol und GPT-6 Luna, neu eingeführt am 22. September, kosten $0,80 / $4,00 beziehungsweise $0,04 / $0,20. Ausgabe ist teurer als Eingabe; Reasoning-Token von Reasoning-Modellen werden ebenfalls nach dem Ausgabepreis berechnet.

Der häufigste Stolperstein: ChatGPT-Abonnement und OpenAI API sind zwei getrennte Konten. Ein ChatGPT-Plus-Abonnement enthält weder API-Schlüssel noch API-Kontingent. Für Programmaufrufe brauchst du einen separaten Schlüssel und zahlst separat nach Token. Diese Seite behandelt nur den zweiten Teil – Aufrufe aus Programmen.

Preise geprüft am 5. Oktober 2026. Die offiziellen OpenAI-API-Preise findest du unter openai.com/api/pricing, die monatlichen ChatGPT-Preise unter chatgpt.com/pricing (Planpreise ändern sich häufig; diese Seite gibt sie nicht wieder). Die Zahlen auf der Kunavo-Seite stammen aus dem hiesigen Modellkatalog und entsprechen den tatsächlich über die API berechneten Beträgen.

ChatGPT-Abonnement vs. OpenAI API – zwei getrennte Konten

ChatGPT-AbonnementOpenAI API
Wofür wird bezahlt?Monatliche Plan-Gebühr (Free, Go, Plus, Pro usw.)Nach Token, ohne Monatsgebühr
VerwendungChatten auf chatgpt.com und in der AppAufrufe aus deinen Programmen, Produkten und Skripten
API-KeyNicht enthaltenJa
LimitNutzungslimit des PlansRatenlimits und dein eigenes Budget
Monate ohne NutzungMonatsgebühr wird berechnet$0

Wann lohnt sich ein Abonnement? Mit $20 erhältst du bei GPT-5.6 Sol ungefähr 1.600 Dialogrunden und bei GPT-5.6 Terra ungefähr 4.600 Runden (je Runde 2.000 Eingabe- / 700 Ausgabe-Token). Wenn du nur selbst viel in ChatGPT chattest, monatlich mehr als das nutzt und das Planlimit ausreicht, ist die Monatsgebühr günstiger. Für Programmaufrufe oder stark schwankende Nutzung ist die Abrechnung nach Token günstiger.

GPT-API-Preistabelle – pro 1M Token

ModellOffiziell von OpenAI (Eingabe / Ausgabe)Kunavo (Input / Output)PreisunterschiedGeeignet für
GPT-6 Astra$10,00 / $50,00$4,00 / $20,00Etwa 60 % günstigerSchwierigste Schlussfolgerungen, langfristiges agentisches Programmieren
GPT-6 Sol$2,00 / $10,00$0,80 / $4,00Etwa 60 % günstigerKomplexes Programmieren und agentische Workflows (OpenAIs Positionierung)
GPT-6 Luna$0,10 / $0,50$0,04 / $0,20Etwa 60 % günstigerGünstigste Stufe: fokussierte Aufgaben in großen Mengen wie Klassifizierung, Extraktion und Routing
GPT-5.6 Sol$5,00 / $30,00
aktueller Aktionspreis $4,00 / $20,00 (mindestens bis 21. November 2026)
$2,00 / $12,00Etwa 60 % günstiger
etwa 40 % günstiger als der Aktionspreis
GPT-5.6-Flaggschiff für anspruchsvolle Schlussfolgerungen und Programmierung
GPT-5.6 Terra$2,00 / $12,00$0,70 / $4,20Etwa 65 % günstigerGPT-5.6 für den Alltag: RAG, Kundendienst, Umschreibungen
GPT-5.5$5,00 / $30,00$2,00 / $12,00Etwa 60 % günstigerVorgänger-Flaggschiff für bestehende Codebasen

GPT-6 Astra ist OpenAIs aktuelles Flaggschiff, vorgestellt am 3. September 2026. Bei Kunavo kostet die Ausgabe ungefähr 1,7-mal so viel wie bei GPT-5.6 Sol – verwende es für Aufgaben, bei denen günstigere Modelle scheitern, nicht als Standard. GPT-5.5 und GPT-5.6 Sol haben denselben Preis pro Token (die Berechnung für Cache-Schreibvorgänge unterscheidet sich, siehe unten). Wichtig ist außerdem: GPT-Modelle, die über Kunavo aufgerufen werden, akzeptieren derzeit nur Texteingaben. Für Bildverständnis verwende Claude.

GPT-6 Sol und GPT-6 Luna sind zwei Modelle, die OpenAI am 22. September 2026 eingeführt hat. Laut OpenAI bauen beide auf den technischen Fortschritten von GPT-6 Astra auf; beide haben ein Kontextfenster von 1.050.000 Token und eine maximale Ausgabe von 128.000 Token. OpenAI positioniert GPT-6 Sol für komplexes Programmieren und agentische Workflows; bei Kunavo kostet es $0,80 / $4,00. GPT-6 Luna beschreibt OpenAI als effizientestes Modell für fokussierte Aufgaben in großen Mengen; bei Kunavo kostet es $0,04 / $0,20 und ist das günstigste GPT in dieser Tabelle. Neue Projekte müssen nicht mehr mit GPT-5.6 Sol beginnen: GPT-6 Sol kostet bei Kunavo $0,80 / $4,00; sowohl der Eingabe- als auch der Ausgabepreis liegt unter GPT-5.6 Sol mit $2,00 / $12,00.

Was eine einzelne Anfrage tatsächlich kostet

Eine Preistabelle ist weniger hilfreich als eine konkrete Anfrage. Die folgenden Werte wurden vollständig aus den Kunavo-Preisen der obigen Tabelle berechnet:

VerwendungToken (Eingabe / Ausgabe)GPT-6 LunaGPT-5.6 TerraGPT-6 SolGPT-5.6 SolGPT-6 Astra
Eine Runde eines kurzen Dialogs1.000 / 300$0,0001$0,002$0,002$0,0056$0,01
Eine RAG-Antwort6.000 / 500$0,00034$0,0063$0,0068$0,018$0,034
Eine schwierige Aufgabe20.000 / 3.000$0,0014$0,027$0,028$0,076$0,140
100.000 Datensätze im Batch500 / 20 × 100.000$2,40$43,40$48,00$124,00$240,00

GPT-6 Sol oder GPT-5.6 Terra? Der Ausgabepreis von GPT-6 Sol ist niedriger als der von Terra, der Eingabepreis jedoch höher. Daher ist Terra bei Anfragen mit viel Eingabe und wenig Ausgabe – wie der RAG-Antwort und dem Batch mit 100.000 Datensätzen oben – günstiger. Je größer der Ausgabeanteil, desto vorteilhafter ist GPT-6 Sol.

Zwei Dinge können den tatsächlichen Betrag über den Tabellenwert erhöhen. Erstens Reasoning-Token: Reasoning-Modelle erzeugen vor der Antwort Denktoken, die nicht in der Antwort erscheinen, aber zum Ausgabepreis berechnet werden; je schwieriger die Aufgabe, desto größer die Abweichung. Zweitens erneute Anfragen: Fehlgeschlagene Anfragen werden nicht berechnet, aber wenn du nach einer erfolgreichen Antwort wegen eines falschen Formats erneut fragst, kostet jede Anfrage. Sieh den tatsächlichen Wert unter usage nach und rechne mit deinen eigenen Zahlen:

gpt_cost.py
# OpenAI API 的費用,用實際 token 數算。
# Kunavo 費率,每 1M token USD:(input, output)
RATES = {
    "gpt-6-astra":   (4.00, 20.00),
    "gpt-6-sol":     (0.80, 4.00),
    "gpt-6-luna":    (0.04, 0.20),
    "gpt-5-6-sol":   (2.00, 12.00),
    "gpt-5-6-terra": (0.70, 4.20),
}

def cost(model, inp, out):
    i, o = RATES[model]
    # reasoning token 不會出現在回覆裡,但按「輸出」費率計費
    return inp / 1e6 * i + out / 1e6 * o

print(cost("gpt-5-6-terra", 6_000, 500))       # RAG 回答一次
print(cost("gpt-6-astra", 20_000, 3_000))      # 難題一次
print(cost("gpt-6-luna", 500, 20) * 100_000)   # 10 萬筆批次

Lange Prompts und Caching: zwei Regeln, die den Preis ändern

Anfragen über 272K Token. Bei GPT-5.5, GPT-5.6 Sol und Terra sowie GPT-6 Astra, Sol und Luna – also jedem Modell in der Tabelle – wird bei einem Prompt von mehr als 272K Token in einer einzelnen Anfrage die gesamte Anfrage mit 2-fachem Eingabe- / 1,5-fachem Ausgabepreis berechnet. Dies ist OpenAIs veröffentlichte Regel für lange Kontexte; Kunavo berechnet auf dieselbe Weise. Daher bleibt der Rabatt gegenüber den offiziellen Preisen vor und nach der Schwelle gleich. Lange Dokumente, die sich in Abschnitte aufteilen lassen, sollten möglichst unter 272K Token bleiben.

Cache. Cache-Lesezugriffe kosten 10% des Eingabepreises; Cache-Schreibzugriffe kosten für GPT-6 Astra, GPT-6 Sol, GPT-6 Luna, GPT-5.6 Sol und GPT-5.6 Terra wird das 1,25-Fache des Eingabepreises berechnet und GPT-5.5 zum regulären Eingabepreis. Wenn dieselbe lange Systemanweisung immer wieder gesendet wird, ist dies der größte Hebel. Die Funktionsweise steht in der Cache-Dokumentation.

Von bestehendem OpenAI-Code wechseln

Kunavo ist ein OpenAI-kompatibler Endpunkt; das SDK muss nicht gewechselt werden: Ändere die beiden Werte base_url und den Schlüssel; chat.completions und responses funktionieren unverändert.

gpt_kunavo.py
from openai import OpenAI

client = OpenAI(
    api_key="sk-kn-...",
    base_url="https://api.kunavo.com/v1",  # 只改這一行
)

resp = client.chat.completions.create(
    model="gpt-5-6-terra",
    messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)

Die vollständigen Schritte stehen im Schnellstart, die Endpunktspezifikation in der Dokumentation zu Chat Completions (Englisch).

Ehrlich gesagt: Wann OpenAI direkt die bessere Wahl ist

Das Gateway verwendet gemeinsame Kapazität: Es gibt weder ein dediziertes Kontingent noch eine vertraglich garantierte SLA. Wenn du garantierte Kontingente, bestimmte Ratenlimits oder eine SLA benötigst, schließe direkt mit OpenAI einen Vertrag. Wer nur in ChatGPT chattet und nicht programmiert, braucht keine API – wie oben berechnet, ist ein Monatsplan für intensive Chat-Nutzung meist günstiger.

Zahlungen in Taiwan

Das Guthaben von Kunavo läuft über Stripe und unterstützt Karten einschließlich JCB (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay und Google Pay. Es gilt ein Prepaid-Modell mit einer Mindestaufladung von $10; das Guthaben verfällt nicht, und fehlgeschlagene Requests werden nicht berechnet. Je höher die Aufladung, desto höher der Bonus: $100 ergeben $110, $1.000 ergeben $1.200 und $5.000 ergeben $6.250.

Taiwan hat keinen lokalen Zahlungsweg – Jko und LINE Pay stehen nicht auf der Liste der verfügbaren Optionen. Bei Teamnutzung kann jeder Schlüssel unter /app/keys ein monatliches Ausgabenlimit (nach Erreichen Antwort 402) und eine IP-Allowlist erhalten; Kosten können einzelnen Personen zugeordnet werden. Einzelheiten stehen in der Abrechnungsdokumentation.

Kosten der GPT API senken

  1. Modell nach Aufgabengröße auswählen. Für große, einfache Aufgaben wie Klassifizierung, Extraktion und Routing zuerst GPT-6 Luna testen, für allgemeine Aufgaben Terra oder GPT-6 Sol verwenden und nur bei Aufgaben, die damit nicht gut gelingen, auf Astra wechseln – in der Tabelle oben kann derselbe Vorgang bis zu 100-mal unterschiedlich viel kosten.
  2. Ausgabe begrenzen. Mit max_tokens und Ausgabeformat-Beschränkungen die Länge begrenzen; bei Aufgaben, bei denen sich die Reasoning-Stärke reduzieren lässt, diese reduzieren.
  3. Cache aktivieren. Statische System-Prompts an den Anfang setzen und ihren Inhalt nicht bei jeder Anfrage ändern; Cache-Lesezugriffe kosten nur 10% des Eingabepreises.
  4. Prompts unter 272K Token halten. Darüber wird die gesamte Anfrage mit 2-fachem Eingabe- / 1,5-fachem Ausgabepreis berechnet.

Um die Kosten für einen ganzen Monat zunächst zu schätzen, verwende den OpenAI API-Kostenrechner (Englisch). Wenn dein Problem die Rate und nicht die Kosten sind, siehe OpenAI API-Ratenlimits (Englisch). Vergleiche andere Anbieter mit demselben Verfahren: Claude-Kosten und -Abonnements; wenn du diese GPT-Modelle mit Codex verwendest, findest du die Abrechnung von Abonnement und API-Schlüssel unter Codex-Kosten.

Häufig gestellte Fragen

Wie viel kostet die ChatGPT API?

Die ChatGPT API ist die OpenAI API: Abrechnung nach Token, keine Monatsgebühr, getrennte Abrechnung von ChatGPT-Abonnements. 5. Oktober 2026 Die offiziellen OpenAI-Preise pro 1M Token betragen für GPT-6 Astra Eingabe $10,00 / Ausgabe $50,00, für GPT-6 Sol $2,00 / $10,00, für GPT-6 Luna $0,10 / $0,50, für GPT-5.6 Sol $5,00 / $30,00 (OpenAI bietet das Modell derzeit zum Aktionspreis von $4,00 / $20,00 an; auf der offiziellen Preisseite steht, dass dieser mindestens bis 21. November 2026 gilt) und für GPT-5.6 Terra $2,00 / $12,00; bei Kunavo kosten dieselben Modelle $4,00 / $20,00, $0,80 / $4,00, $0,04 / $0,20, $2,00 / $12,00 und $0,70 / $4,20.

Wie rechnet die OpenAI API ab?

Abrechnung nach Token: Deine Eingaben (System-Prompt, Dialog, Dateien) zählen als Eingabe, vom Modell erzeugte Inhalte als Ausgabe. Für beide gibt es eigene Preise pro 1M Token; Ausgabe ist teurer. Reasoning-Token, die ein Reasoning-Modell vor der Antwort erzeugt, erscheinen nicht in der Antwort, werden aber zum Ausgabepreis berechnet. Keine Monatsgebühr, ohne Aufrufe $0; fehlgeschlagene Anfragen werden nicht berechnet, aber wenn du nach einer erfolgreichen Antwort selbst erneut fragst, kostet jede Anfrage erneut.

Kann ich die API mit ChatGPT Plus verwenden?

Nein. ChatGPT-Pläne (Free, Go, Plus, Pro usw.) sind Monatsgebühren für chatgpt.com und die App; sie enthalten weder einen API-Schlüssel noch API-Kontingent. Für die OpenAI API brauchst du einen separaten Schlüssel und zahlst separat nach Token. Umgekehrt erhöht eine API-Zahlung dein ChatGPT-Nutzungslimit nicht. Beide Guthaben werden nicht miteinander verrechnet.

Wie viel kostet GPT-6?

Kunavo bietet derzeit GPT-6 Astra, GPT-6 Sol und GPT-6 Luna an. Das Flaggschiff GPT-6 Astra (von OpenAI am 3. September 2026 vorgestellt) kostet offiziell pro 1M Token $10,00 für Eingabe / $50,00 für Ausgabe, bei Kunavo $4,00 / $20,00; Etwa 60 % günstiger. Eine schwierige Aufgabe (20.000 Eingabe- / 3.000 Ausgabe-Token) kostet ungefähr $0,140. GPT-6 Sol und GPT-6 Luna, am 22. September eingeführt, kosten bei Kunavo $0,80 / $4,00 beziehungsweise $0,04 / $0,20. Wenn der Prompt einer einzelnen Anfrage bei einem dieser drei Modelle 272K Token überschreitet, wird die gesamte Anfrage mit 2-fachem Eingabe- / 1,5-fachem Ausgabepreis berechnet.

Wie viel kosten GPT-6 Sol und GPT-6 Luna über die API?

OpenAI führte diese beiden Modelle am 22. September 2026 ein. Beide haben ein Kontextfenster von 1.050.000 Token und eine maximale Ausgabe von 128.000 Token. OpenAI positioniert GPT-6 Sol für komplexes Programmieren und agentische Workflows; der offizielle Preis pro 1M Token beträgt $2,00 für Eingabe / $10,00 für Ausgabe, bei Kunavo $0,80 / $4,00 (Etwa 60 % günstiger). GPT-6 Luna beschreibt OpenAI als effizientestes Modell für fokussierte Aufgaben in großen Mengen; offiziell $0,10 / $0,50, bei Kunavo $0,04 / $0,20 (Etwa 60 % günstiger). Eine RAG-Antwort (6.000 Eingabe- / 500 Ausgabe-Token) kostet ungefähr $0,00034.

Gibt es bei der OpenAI API ein kostenloses Kontingent?

OpenAI bietet keine kostenlose Stufe für GPT-APIs; bereits der erste Aufruf wird nach Token berechnet. Auch Kunavo ist nicht kostenlos, hat aber keine Monatsgebühr: Das Prepaid-Guthaben beträgt mindestens $10, wird nach Verbrauch abgezogen, verfällt nicht und kostet in Monaten ohne Aufrufe $0.

Wie viel kostet ungefähr ein einzelner GPT-API-Aufruf?

Das hängt vom Modell und der Tokenanzahl ab. Für eine RAG-Antwort (6.000 Eingabe- / 500 Ausgabe-Token) gelten bei Kunavo folgende Kosten je Modell: GPT-6 Luna ungefähr $0,00034, GPT-5.6 Terra ungefähr $0,0063, GPT-6 Sol ungefähr $0,0068, GPT-5.6 Sol ungefähr $0,018 und GPT-6 Astra ungefähr $0,034. Diese Beträge enthalten keine Reasoning-Token; maßgeblich ist die Anzahl der Ausgabe-Token im usage-Feld der Antwort.

Wie bezahle ich die OpenAI API in Taiwan?

Kunavo verwendet Stripe für Prepaid-Zahlungen: Visa, Mastercard, American Express, JCB, UnionPay, Apple Pay und Google Pay werden unterstützt. Die Mindestaufladung beträgt $10, das Guthaben verfällt nicht, und Aufladungen ab $100 enthalten einen Bonus. In Taiwan gibt es keine lokalen Zahlungswege – JkoPay und LINE Pay stehen nicht zur Verfügung; internationale Karten sind die einzige Möglichkeit.

Was muss ich an bestehendem OpenAI-SDK-Code ändern?

Nur zwei Dinge: base_url auf https://api.kunavo.com/v1 ändern und den Schlüssel durch einen Kunavo-Schlüssel mit Präfix sk-kn- ersetzen. Sowohl chat.completions als auch responses funktionieren unverändert; bei model genügt eine Modell-ID wie gpt-6-astra oder gpt-5-6-terra. Mit demselben Schlüssel kannst du auch Claude aufrufen.