Zurück zu den Leitfäden
Preise·11. September 2026·10 Min. Lesezeit

OpenAI API Kosten 2026 — was GPT pro Anfrage wirklich kostet

Die OpenAI API rechnet pro Token ab, ein ChatGPT-Abo ist davon getrennt. Aktuelle Tarife pro Modell, was eine Anfrage wirklich kostet — und die zwei Fallen, an denen jede Schätzung scheitert.

Die OpenAI API kostet pro Token, nicht pro Monat. Input- und Output-Tokens haben getrennte Tarife, und Output ist der teurere Teil. Auf Kunavo reicht die Spanne von $0,07 / $0,42 pro 1M Tokens für GPT-5.6 Luna bis $4,00 / $20,00 für GPT-6 Astra, OpenAIs neuestes Flaggschiff; das Arbeitspferd GPT-5.6 Terra liegt bei $0,70 / $4,20 — je nach Modell 60–65% unter OpenAIs Listenpreis. Ein ChatGPT-Abo ist davon getrennt: Es enthält keine API-Nutzung, und die API braucht kein Abo.

Stand der Tarife: 11. September 2026. Die Kunavo-Tarife liest diese Seite live aus dem Modellkatalog — was hier steht, ist das, was die API abrechnet. Die Spalte „OpenAI-Liste“ gibt OpenAIs veröffentlichten Preis für dasselbe Modell wieder; die Quelle ist openai.com/api/pricing.

ChatGPT-Abo und OpenAI API: zwei Produkte, zwei Rechnungen

Wer nach „ChatGPT API Kosten“ sucht, will oft zuerst etwas anderes wissen: ob das bestehende ChatGPT-Abo die API schon abdeckt. Die Antwort ist nein.

Was Sie nutzenWie abgerechnet wirdFür wen
ChatGPT (Free, Plus, Pro …)Pauschal pro Monat, mit den Nutzungsgrenzen des PlansMenschen, die im Chatfenster arbeiten
OpenAI API (Key + Guthaben)Pro Token, keine MonatsgebührEigene Software, Automatisierung, Agenten

Ein Abo enthält weder einen API-Key noch API-Guthaben und senkt die API-Rechnung um keinen Cent; umgekehrt erweitert API-Guthaben nicht die Kontingente in ChatGPT. Die Abo-Preise nennt OpenAI auf openai.com/chatgpt/pricing; sie ändern sich oft, deshalb stehen sie hier nicht. Diese Seite behandelt nur die API — den Teil, der pro Token kostet.

OpenAI API Preise pro Modell

Tarife in USD pro Million Tokens, wie von Kunavo abgerechnet. Die Spalte „OpenAI-Liste“ ist der veröffentlichte Preis für dasselbe Modell.

ModellInput / 1MOutput / 1MOpenAI-Liste (Input / Output)Ersparnis
gpt-6-astra$4,00$20,00$10,00 / $50,00~60%
gpt-5-6-sol$2,00$12,00$5,00 / $30,00~60%
gpt-5-5$2,00$12,00$5,00 / $30,00~60%
gpt-5-6-terra$0,70$4,20$2,00 / $12,00~65%
gpt-5-6-luna$0,07$0,42$0,20 / $1,20~65%

Live-Tarife stehen immer auf der Preisseite und auf jeder Modellseite, etwa GPT-6 Astra. Welches Modell wofür:

  • gpt-6-astra — OpenAIs neuestes Flaggschiff (seit 3. September 2026): Reasoning an der Spitze und lange agentische Coding-Läufe. Für die schwierige Minderheit der Aufgaben.
  • gpt-5-6-sol — Top-Reasoning und agentisches Coding; der sinnvolle Standard am oberen Ende.
  • gpt-5-6-terra — das Arbeitspferd der 5.6-Familie für RAG, Assistenten und die meisten Produktionsaufgaben.
  • gpt-5-6-luna — hohes Volumen, niedrige Latenz: Klassifizieren, Extrahieren, Umformatieren.
  • gpt-5-5 — das Flaggschiff der Vorgängergeneration. GPT-5.6 Sol kostet auf Kunavo denselben Tarif ($2,00 / $12,00); wer noch auf gpt-5-5 läuft, wechselt mit einem geänderten Modellnamen auf die neuere Generation, ohne Mehrkosten pro Token.

Was GPT-6 Astra mehr kostet. Gegenüber GPT-5.6 Sol kostet GPT-6 Astra beim Input das 2-Fache und beim Output das 1,7-Fache. Die ehrliche Empfehlung: GPT-5.6 Sol oder GPT-5.6 Terra als Standard, Astra gezielt dort, wo ein Vergleich mit denselben Eingaben zeigt, dass Sol nicht reicht — der Modellname ist ein einziges Wort im Request, der Test also billig.

Ein Aufschlag für sehr lange Anfragen. Oberhalb von 272.000 Prompt-Tokens rechnen GPT-5.5, die GPT-5.6-Familie und GPT-6 Astra die gesamte Anfrage mit dem 2-fachen Input- und dem 1,5-fachen Output-Tarif ab. Wer ganze Codebasen oder lange Dokumente in einen Aufruf packt, sollte diese Schwelle kennen: Sie kann stärker wirken als die Modellwahl.

Was eine Anfrage wirklich kostet

Gerechnet zu Kunavo-Tarifen, ohne Caching und ohne Reasoning-Tokens — also die Untergrenze dessen, was auf der Rechnung steht:

AufgabeTokens (Input / Output)GPT-5.6 LunaGPT-5.6 TerraGPT-5.6 SolGPT-6 Astra
Kurze Chat-Runde1.000 / 300$0,000196$0,00196$0,0056$0,01
RAG-Antwort6.000 / 500$0,00063$0,0063$0,018$0,034
Agentischer Coding-Schritt25.000 / 1.200$0,00225$0,0225$0,0644$0,124
Schwere Reasoning-Aufgabe20.000 / 3.000$0,00266$0,0266$0,076$0,14
Batch: 100.000 Klassifizierungen500 / 20 je Aufruf$4,34$43,40$124,00$240,00

Mit der Mindestaufladung von $10 laufen rund 1.590 RAG-Antworten auf GPT-5.6 Terra. Zwischen GPT-5.6 Luna und GPT-5.6 Sol liegt beim Output ein Faktor von rund 29 — bei einfachen Aufgaben ist die Modellwahl der größte einzelne Hebel. Zum Nachrechnen mit eigenen Zahlen:

openai_kosten.py
# OpenAI-Tarife auf Kunavo (USD pro 1M Tokens): (Input, Output)
RATES = {
    "gpt-6-astra":   (4, 20),
    "gpt-5-6-sol":   (2, 12),
    "gpt-5-5":       (2, 12),
    "gpt-5-6-terra": (0.7, 4.2),
    "gpt-5-6-luna":  (0.07, 0.42),
}

def kosten(model: str, frisch: int, output: int, cache_treffer: int = 0) -> float:
    """frisch = nicht gecachter Input; output schließt Reasoning-Tokens ein."""
    i, o = RATES[model]
    return (
        frisch / 1_000_000 * i
        + output / 1_000_000 * o
        + cache_treffer / 1_000_000 * i * 0.10  # Cache-Treffer: 10 % des Input-Tarifs
    )

print(kosten("gpt-5-6-luna", 1_000, 300))     # kurze Chat-Runde
print(kosten("gpt-5-6-terra", 6_000, 500))    # RAG-Antwort
print(kosten("gpt-5-6-sol", 25_000, 1_200))   # agentischer Coding-Schritt
print(kosten("gpt-6-astra", 20_000, 3_000))   # schwere Reasoning-Aufgabe

# Ein Monat auf Sol: 3 Mio. frische und 12 Mio. gecachte Input-Tokens,
# 1 Mio. Output-Tokens (Cache-Writes nicht eingerechnet)
print(kosten("gpt-5-6-sol", 3_000_000, 1_000_000, cache_treffer=12_000_000))

Zwei Kostenfallen, die jede Schätzung verfehlt

Erstens: Reasoning-Tokens. Reasoning-Modelle wie GPT-6 Astra oder GPT-5.6 Sol denken vor der Antwort in internen Tokens. Die erscheinen nicht im Antworttext, werden aber zum Output-Tarif abgerechnet. Die Beispielrechnungen auf dieser Seite enthalten sie nicht; bei schweren Aufgaben liegt die echte Rechnung deshalb darüber. Die tatsächliche Zahl steht in jeder Antwort unter usage (completion_tokens_details.reasoning_tokens).

Zweitens: Wiederholungen. Eine Antwort, die erfolgreich zurückkam und in Ihrem Code verworfen wird — falsches Format, ein erneuter Versuch —, ist bezahlt. Bei Agenten ist eine sichtbare Aufgabe oft ein Dutzend abgerechneter Durchläufe, und dort ist der Abstand zwischen Schätzung und Rechnung am größten. Anfragen, die bei Kunavo selbst fehlschlagen, werden nicht berechnet.

Prompt Caching

Schickt Ihre Anwendung bei jeder Anfrage denselben langen System-Prompt oder dieselben Dokumente, werden Cache-Treffer mit 10% des Input-Tarifs berechnet — bei GPT-5.6 Sol also $0,20 statt $2,00 pro 1M Tokens. Das Schreiben in den Cache kostet auf Kunavo bei GPT-5.6 Sol, Terra, Luna und GPT-6 Astra das 1,25-Fache des Input-Tarifs, bei GPT-5.5 den normalen Input-Tarif. Wie man den Cache trifft, steht in der Caching-Dokumentation.

Bestehenden OpenAI-Code umstellen

Kunavo ist OpenAI-kompatibel: Sie ändern die base_url und den Key, sonst nichts. chat.completions und responses behalten ihre Form, und die Antwort trägt wie gewohnt das Feld usage, aus dem sich jede Rechnung nachvollziehen lässt.

openai_kunavo.py
from openai import OpenAI

client = OpenAI(
    api_key="sk-kn-...",
    base_url="https://api.kunavo.com/v1",  # statt api.openai.com
)

resp = client.chat.completions.create(
    model="gpt-5-6-terra",
    messages=[{"role": "user", "content": "Fasse diese Rechnung in drei Sätzen zusammen."}],
)
print(resp.choices[0].message.content)
print(resp.usage)  # Input-, Output- und Reasoning-Tokens: die Grundlage der Abrechnung

Den Key (sk-kn-…) legen Sie nach der Registrierung im Dashboard an. Dort setzen Sie pro Key auch ein monatliches Ausgabenlimit — ist es erreicht, antwortet der Key mit 402 — und eine IP-Allowlist. Die Schritte zeigt der Schnellstart.

OpenAI API aus Deutschland bezahlen

Kunavo rechnet über Stripe ab, als Prepaid-Guthaben: kein Abo und keine Einrichtung eines OpenAI-Platform-Kontos. Im Checkout stehen zur Wahl:

  • Karten: Visa, Mastercard, American Express, JCB und UnionPay — Debitkarten von Visa und Mastercard funktionieren wie Kreditkarten
  • Klarna
  • Apple Pay und Link

Die SEPA-Lastschrift wird derzeit nicht angeboten. Aufladungen sind in US-Dollar ausgewiesen; Stripe zeigt den Betrag im Checkout in Ihrer Währung an. Die Mindestaufladung beträgt $10; größere Aufladungen bringen Bonusguthaben: Aus $100 werden $110,00, aus $1.000 werden $1.250,00 und aus $5.000 werden $7.000,00. Das Guthaben verfällt nie, und fehlgeschlagene Anfragen werden nicht berechnet. Details stehen in der Billing-Dokumentation.

Ehrlich gesagt: Wann der direkte Weg zu OpenAI besser ist

Kunavo ist ein Gateway mit geteilter Kapazität: Es gibt kein eigenes Kontingent für Ihr Konto und kein vertragliches SLA. Wer eine garantierte Quote oder ein SLA braucht, etwa für ein Produkt mit zugesagter Verfügbarkeit, sollte direkt bei OpenAI einkaufen. Diese Seite behauptet nicht, diesen Fall abzudecken.

Und für Menschen, die den ganzen Tag im Chatfenster arbeiten, ist ein ChatGPT-Abo oft die günstigere Wahl. Die Rechnung ist eine Division: Abo-Preis ÷ Kosten einer Chat-Runde = Break-even. Eine Runde mit 2.000 Input- und 700 Output-Tokens kostet auf GPT-5.6 Sol rund $0,0124, auf GPT-5.6 Terra rund $0,00434. Wer Monat für Monat mehr Runden dreht, als diese Division ergibt, und dabei in den Grenzen des Plans bleibt, fährt mit dem Abo besser. Die API gewinnt bei Software, Automatisierung und schwankender Nutzung — dort, wo ein ruhiger Monat nichts kosten soll.

OpenAI API Kosten senken — in dieser Reihenfolge

  1. Das Modell zur Aufgabe wählen. Das größte Modell als Standard stehen zu lassen ist die häufigste Ursache einer überraschenden Rechnung. Klassifizieren und Extrahieren gehen an gpt-5-6-luna, der Alltag an gpt-5-6-terra, die schwierige Minderheit an Sol oder Astra.
  2. Output deckeln. Output kostet ein Mehrfaches des Inputs, und Reasoning zählt dazu — ein Limit über max_tokens wirkt deshalb doppelt.
  3. Prompt Caching nutzen. Ein langer, stabiler System-Prompt kostet als Cache-Treffer ein Zehntel des Input-Tarifs.
  4. Weniger Kontext mitschicken. Wenige präzise RAG-Abschnitte statt der halben Wissensbasis — und unter der 272.000-Token-Schwelle bleiben, wo es geht.

Mit eigenen Zahlen nachrechnen: Der OpenAI API Preisrechner rechnet gecachten Input und Reasoning-Tokens mit ein, der Token-Rechner stellt Claude, GPT und Gemini nebeneinander. Die Gegenstücke für die anderen Anbieter: Claude Preise und Gemini API Preise. Wenn nicht die Kosten, sondern Limits bremsen: OpenAI API Rate Limits (auf Englisch).

Häufige Fragen

Was kostet die OpenAI API?

Die OpenAI API wird pro Token abgerechnet, ohne Monatsgebühr: Input- und Output-Tokens haben getrennte Tarife, und Output ist der teurere Teil. Auf Kunavo kostet GPT-5.6 Luna $0,07 / $0,42 pro 1M Tokens (Input / Output), GPT-5.6 Terra $0,70 / $4,20, GPT-5.6 Sol $2,00 / $12,00 und OpenAIs neuestes Flaggschiff GPT-6 Astra $4,00 / $20,00. OpenAIs Listenpreise für dieselben Modelle liegen bei $0,20 / $1,20, $2,00 / $12,00, $5,00 / $30,00 und $10,00 / $50,00. Stand: 11. September 2026.

Ist die API im ChatGPT-Abo enthalten?

Nein. Ein ChatGPT-Abo wie Plus oder Pro bezahlt die Nutzung von ChatGPT selbst — im Browser, in der App, auf dem Desktop. Es enthält weder einen API-Key noch API-Guthaben und senkt die API-Rechnung um keinen Cent. Wer GPT aus eigener Software aufruft, braucht einen API-Key und zahlt pro Token, getrennt vom Abo. Umgekehrt erweitert API-Guthaben nicht die Kontingente in ChatGPT.

Was kostet eine Anfrage an die ChatGPT API?

Was umgangssprachlich „ChatGPT API“ heißt, ist die OpenAI API mit den GPT-Modellen, und sie rechnet jede Anfrage nach Tokens ab. Zu Kunavo-Tarifen kostet eine RAG-Antwort mit 6.000 Input- und 500 Output-Tokens auf GPT-5.6 Terra rund $0,0063, ein agentischer Coding-Schritt mit 25.000 / 1.200 Tokens auf GPT-5.6 Sol rund $0,0644 und eine schwere Aufgabe mit 20.000 / 3.000 Tokens auf GPT-6 Astra rund $0,14. Reasoning-Tokens kommen zum Output-Tarif hinzu.

Kann ich die OpenAI API kostenlos testen?

Kunavo gibt kein Startguthaben, verlangt aber auch keine Monatsgebühr und keine Mindestlaufzeit. Der kleinste Einstieg ist die Mindestaufladung von $10 — damit laufen rund 1.590 RAG-Antworten auf GPT-5.6 Terra. Das Guthaben verfällt nie, ein Monat ohne Aufrufe kostet nichts, und fehlgeschlagene Anfragen werden nicht berechnet.

Wie werden Reasoning-Tokens abgerechnet?

Zum Output-Tarif. Reasoning-Modelle wie GPT-6 Astra oder GPT-5.6 Sol denken vor der Antwort in internen Tokens; die stehen nicht im Antworttext, aber in der Abrechnung. Die tatsächliche Zahl liefert jede Antwort im Feld usage (completion_tokens_details.reasoning_tokens). Bei schweren Aufgaben ist das der häufigste Grund, warum die echte Rechnung über einer Schätzung liegt; ein Limit über max_tokens deckelt ihn.

Was kostet GPT-6 Astra?

GPT-6 Astra ist seit dem 3. September 2026 OpenAIs neuestes Flaggschiff; OpenAI listet es mit $10,00 / $50,00 pro 1M Tokens. Auf Kunavo kostet es $4,00 / $20,00 — rund 60% unter der Liste. Gegenüber GPT-5.6 Sol ist das beim Input das 2-Fache und beim Output das 1,7-Fache; Astra lohnt sich deshalb für die schwierige Minderheit der Aufgaben, bei der Sol nachweislich nicht reicht. Oberhalb von 272.000 Prompt-Tokens wird auch bei Astra die gesamte Anfrage mit dem 2-fachen Input- und dem 1,5-fachen Output-Tarif berechnet.

Kann ich aus Deutschland per SEPA-Lastschrift bezahlen?

Nein, die SEPA-Lastschrift wird derzeit nicht angeboten. Im Stripe-Checkout stehen Karten (Visa, Mastercard, American Express, JCB, UnionPay), Klarna, Apple Pay und Link zur Wahl; eine Debitkarte von Visa oder Mastercard funktioniert wie eine Kreditkarte. Es ist ein Prepaid-Guthaben ab $10 Mindestaufladung, ohne Abo, und es verfällt nie.

Funktioniert mein bestehender OpenAI-Code mit Kunavo?

Ja. Kunavo ist OpenAI-kompatibel: Sie setzen base_url auf https://api.kunavo.com/v1 und tauschen den Key gegen einen Kunavo-Key (sk-kn-…); chat.completions und responses behalten ihre Form. Die Modellnamen lauten gpt-6-astra, gpt-5-6-sol, gpt-5-6-terra, gpt-5-6-luna und gpt-5-5. Derselbe Key ruft auch Claude, Gemini sowie Bild- und Videomodelle auf.