Zurück zu den Leitfäden
Preise·3. September 2026·Aktualisiert am 4. Oktober 2026·8 Min. Lesezeit

GPT-API-Preise 2026 – GPT-6-, GPT-5.6- und GPT-5.5-Tokentarife und tatsächliche Kosten

Die GPT-API wird ab dem ersten Aufruf ohne kostenlose Stufe pro Token abgerechnet. Wir stellen die aktuellen Tarife der GPT-5-Familie den OpenAI-Listenpreisen gegenüber und erklären die beiden Fallstricke, die den Rechnungsbetrag tatsächlich bestimmen, sowie die Zahlungsmöglichkeiten aus Korea.

Die GPT-API wird mit Eingabe- und Ausgabetarifen pro 1M Tokens abgerechnet; es gibt weder eine Monatsgebühr noch eine kostenlose Stufe. Diese Seite stellt die aktuellen Tarife der GPT-5- und GPT-6-Familie den OpenAI-Listenpreisen gegenüber, enthält Rechenbeispiele zur direkten Prüfung der Kosten eines einzelnen Requests, erklärt die zwei Kostenfallen, die den Rechnungsbetrag beeinflussen (Reasoning-Tokens und Langtextaufschlag), und beschreibt die Zahlung aus Korea.

Die Tarife wurden am 4. Oktober 2026 überprüft — die OpenAI-Listenpreise stammen von openai.com/api/pricing, die Kunavo-Tarife werden in Echtzeit aus dem Modellkatalog gelesen.

Tariftabelle der GPT-5- und GPT-6-Familie

ModellOpenAI-Listenpreis (Eingabe / Ausgabe)Kunavo (Eingabe / Ausgabe)Differenz
GPT-6 Luna$0.10 / $0.50$0.04 / $0.20Etwa 60 % Ersparnis
GPT-6 Sol$2.00 / $10.00$0.80 / $4.00Etwa 60 % Ersparnis
GPT-5.6 Terra$2.00 / $12.00$0.70 / $4.20Etwa 65 % Ersparnis
GPT-5.5$5.00 / $30.00$2.00 / $12.00Etwa 60 % Ersparnis
GPT-5.6 Sol$5.00 / $30.00
Aktionspreis $4.00 / $20.00(bis mindestens 21. November 2026)
$2.00 / $12.00Etwa 60 % Ersparnis
etwa 40 % gegenüber dem Aktionspreis
GPT-6 Astra$10.00 / $50.00$4.00 / $20.00Etwa 60 % Ersparnis

Die GPT-6-Familie ist OpenAIs neue Generation. GPT-6 Astra wurde am 3. September 2026 als OpenAIs Spitzenmodell veröffentlicht, gefolgt von GPT-6 Sol und GPT-6 Luna am 22. September 2026. OpenAI erklärt, dass beide Modelle auf den Fortschritten aufbauen, die GPT-6 Astra ermöglicht haben. Sol ist für komplexe Programmierung und Agenten-Workflows vorgesehen, Luna wird als „effizientestes Modell für fokussierte Massenarbeit“ positioniert. Beide Modelle haben einen Kontext von 1,050,000 Tokens und eine maximale Ausgabe von 128,000 Tokens.

Das günstigste GPT-Modell bei Kunavo ist GPT-6 Luna ($0.04 / $0.20). GPT-6 Sol ($0.80 / $4.00) hat einen niedrigeren Ausgabetarif als GPT-5.6 Terra ($4.20). Allerdings ist der Eingabepreis bei GPT-5.6 Terra ($0.70) niedriger; bei Anfragen, bei denen die Eingabetoken das 2-Fache der Ausgabetoken überschreiten, ist Terra günstiger. Wenn Sie lange Prompts senden und nur kurze Antworten erhalten, berechnen Sie beide Modelle direkt anhand der Tarife in der obigen Tabelle.

Was kostet ein einzelner Request tatsächlich?

Anhand der Tariftabelle allein ist das schwer einzuschätzen, daher sollten Sie selbst nachrechnen. Der folgende Code verwendet exakt dieselben Zahlen wie die Tabelle oben; ändern Sie nur die Tokenzahlen, um die Kosten für Ihren eigenen Workload zu berechnen.

gpt_cost.py
# Kunavo GPT 요율(1M 토큰당 USD): (input, output)
RATES = {
    "gpt-5-6-terra": (0.70, 4.20),
    "gpt-5-5":       (2.00, 12.00),
    "gpt-5-6-sol":   (2.00, 12.00),
    "gpt-6-sol":     (0.80, 4.00),
    "gpt-6-luna":    (0.04, 0.20),
}

def cost(model: str, in_tokens: int, out_tokens: int) -> float:
    i, o = RATES[model]
    # 주의: GPT-5 계열 추론 모델의 reasoning 토큰은 출력 요율로 과금됩니다.
    return in_tokens / 1_000_000 * i + out_tokens / 1_000_000 * o

print(cost("gpt-5-6-terra", 1_000, 300))  # 짧은 턴
print(cost("gpt-5-6-terra", 6_000, 500))  # RAG 답변
print(cost("gpt-5-5", 20_000, 3_000))     # 어려운 문제
print(cost("gpt-5-6-sol", 20_000, 3_000)) # GPT-5.6 플래그십
print(cost("gpt-6-sol", 20_000, 3_000))   # GPT-6 Sol
print(cost("gpt-6-luna", 1_000, 300))     # 가장 저렴한 짧은 턴

Zwei Faktoren, die den Rechnungsbetrag bestimmen

1. Reasoning-Tokens werden als Ausgabe abgerechnet. Reasoning-Modelle der GPT-5-Familie erzeugen unsichtbare Denk-Tokens, die zum Ausgabetarif berechnet werden. Auch bei einer dreizeiligen Antwort entspricht der Rechnungsbetrag daher möglicherweise nicht drei Zeilen. Begrenzen Sie max_tokens und senken Sie die Reasoning-Stärke, soweit die Aufgabe es erlaubt; dies ist die direkteste Möglichkeit zur Kostensenkung.

2. Langtextaufschlag. OpenAI wendet bei Requests mit mehr als 272.000 Eingabe-Tokens auf den gesamten Request (einschließlich Cache-Eingaben) das Zweifache für Eingaben und das 1,5-Fache für Ausgaben an. Kunavo wendet dasselbe Intervall auch auf GPT-5.5, GPT-5.6 Sol und Terra sowie GPT-6 Astra, Sol und Luna an. In diesem Intervall werden die Tarife aus der Tabelle für Eingaben verdoppelt und für Ausgaben mit 1,5 multipliziert; der Rabatt gegenüber dem Listenpreis bleibt unverändert. Bei kontextintensiven Aufgaben wie RAG mit vollständigen Dokumenten oder Codebasisanalysen kann das Überschreiten dieses Intervalls die Kosten stärker beeinflussen als die Wahl des Modells. Teilen Sie Eingaben nach Möglichkeit so auf, dass sie unter 272.000 Tokens bleiben.

In bestehenden OpenAI-Code integrieren

Kunavo ist ein OpenAI-kompatibler Endpoint, daher müssen Sie das SDK nicht ändern. Ersetzen Sie nur base_url eine Zeile und den Schlüssel.

gpt_kunavo.py
from openai import OpenAI

client = OpenAI(
    api_key="sk-kn-...",
    base_url="https://api.kunavo.com/v1",   # 이 한 줄만 바꾸면 됩니다
)

resp = client.chat.completions.create(
    model="gpt-5-6-terra",
    messages=[{"role": "user", "content": "안녕하세요"}],
)
print(resp.choices[0].message.content)

Mit demselben Schlüssel können auch Claude-, Bild- und Videomodelle aufgerufen werden — die Modellliste finden Sie im Modellkatalog, Details zu den Endpoints im Schnellstart.

Zahlung aus Korea

Die Zahlung wird über Stripe abgewickelt und erfolgt als Vorauszahlung. Internationale und inländische Kredit- und Debitkarten (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay und Google Pay werden unterstützt. Sie laden ab mindestens $10 auf, und das Guthaben wird entsprechend der Nutzung abgezogen; das Guthaben verfällt nicht. Ein OpenAI-Konto oder ein separater Vertrag ist nicht erforderlich.

Wenn die Zahlungsseite in KRW angezeigt wird, erscheinen KakaoPay, Naver Pay, PAYCO, Samsung Pay und inländische Karten als Kunavo-Auflademethoden. Zu den inländischen Karten gehören auch Karten ohne aktivierte Auslandszahlungen; Toss wird nicht unterstützt. Diese Methoden laden Ihr Kunavo-Guthaben auf und sind keine direkte Zahlung an OpenAI. Die Preise werden in USD festgelegt, und Stripe rechnet sie zum Wechselkurs zum Zahlungszeitpunkt in KRW um. Dieser Wechselkurs enthält die vom Käufer gezahlte Umrechnungsgebühr von 2–4 % (bei Zahlung in Dollar fällt sie nicht an; die genannten inländischen Methoden werden nur bei Zahlung in KRW angezeigt). Alle Zahlungsmethoden finden Sie in der Zahlungsdokumentation; die Kostenübersicht für Claude steht unter Claude-API-Preise und -Zahlung.

Vier Hebel zur Kostensenkung

  1. Reduzieren Sie die Ausgabe. Einschließlich Reasoning-Tokens ist die Ausgabe am teuersten. Eine Begrenzung von max_tokens und die Anpassung der Reasoning-Stärke bringen die schnellste Ersparnis.
  2. Senken Sie die Modellklasse entsprechend der Aufgabengröße. Beginnen Sie bei Massenaufgaben wie Klassifizierung, Extraktion und Zusammenfassung mit dem günstigsten GPT-6 Luna und wechseln Sie nur dann in eine höhere Klasse, wenn Luna nicht ausreicht. Der Ausgabetarif von Luna entspricht dem Ausgabetarif des Spitzenmodells GPT-6 Astra geteilt durch 100.
  3. Verwenden Sie Caching für wiederholte Kontextpräfixe (Funktionsweise).
  4. Bündeln Sie Aufgaben, die keine Echtzeit erfordern. Wenn Nutzer nicht warten müssen, können Sie durch parallele Ausführung den Durchsatz erhöhen.

Wenn die Zahlung der OpenAI API blockiert ist, lesen Sie OpenAI API payment methods.

Häufig gestellte Fragen

Wie viel kostet die GPT API?

Die Preise gelten pro 1M Token. Mit Stand vom 4. Oktober 2026 beträgt der offizielle OpenAI-Listenpreis für GPT-5.6 Terra $2.00 für die Eingabe / $12.00 für die Ausgabe; bei Kunavo kostet dasselbe Modell $0.70 / $4.20. Die weiteren Kunavo-Tarife sind: GPT-6 Luna $0.04 / $0.20, GPT-6 Sol $0.80 / $4.00, GPT-5.5 $2.00 / $12.00, GPT-5.6 Sol $2.00 / $12.00 und GPT-6 Astra $4.00 / $20.00. Unter diesen ist GPT-6 Luna das günstigste GPT-Modell.

Wie viel kostet die GPT-6 API?

Listenpreise für die von OpenAI am 22. September 2026 veröffentlichten Modelle GPT-6 Sol und GPT-6 Luna sowie für das am 3. September 2026 veröffentlichte GPT-6 Astra (pro 1M Token, Eingabe / Ausgabe): GPT-6 Sol $2.00 / $10.00, GPT-6 Luna $0.10 / $0.50, GPT-6 Astra $10.00 / $50.00. Kunavos Preise pro 1M Token für Eingabe / Ausgabe: GPT-6 Sol $0.80 / $4.00, GPT-6 Luna $0.04 / $0.20, GPT-6 Astra $4.00 / $20.00. Alle drei Modelle sind etwa 60% günstiger als der Listenpreis. GPT-6 Luna ist das günstigste GPT-Modell auf Kunavo, und der Ausgabepreis von GPT-6 Sol liegt unter dem von GPT-5.6 Terra ($4.20) (Der Eingabepreis ist bei Terra niedriger: $0.70). Bei Anfragen mit mehr als 272.000 Eingabe-Token gilt wie bei OpenAI für die gesamte Anfrage das 2-Fache des Eingabepreises und das 1,5-Fache des Ausgabepreises.

Kann ich die GPT API kostenlos nutzen?

OpenAI bietet keine kostenlose Stufe für die GPT API an — ab dem ersten Aufruf werden Tokens abgerechnet. Auch Kunavo ist nicht kostenlos, arbeitet aber nicht mit einem Abonnement, sondern nutzungsbasiert: Ab einer Mindestaufladung von $10 wird nur die tatsächliche Nutzung vom Guthaben abgezogen, das nicht verfällt. In Monaten ohne Nutzung sind es $0.

Werden Reasoning-Tokens von GPT-5 separat berechnet?

Reasoning-Modelle der GPT-5-Familie erzeugen unsichtbare Reasoning-Tokens, die zum Ausgabetarif abgerechnet werden. Auch wenn die Antwort kurz erscheint, kann der Rechnungsbetrag daher hoch sein. Begrenzen Sie max_tokens und senken Sie die Reasoning-Stärke, soweit es die Aufgabe erlaubt — im Tarifmodell ist die Ausgabe immer der teurere Teil.

Sind Requests mit langen Eingaben teurer?

Ja. OpenAI wendet bei Requests mit mehr als 272.000 Eingabe-Tokens auf den gesamten Request (einschließlich Cache-Eingaben) das Zweifache für Eingaben und das 1,5-Fache für Ausgaben an; Kunavo wendet dasselbe Intervall auch auf GPT-5.5, GPT-5.6 Sol und Terra sowie GPT-6 Astra, Sol und Luna an. Der Rabatt gegenüber dem Listenpreis bleibt vor und nach diesem Intervall gleich. Bei kontextintensiven Aufgaben wie RAG mit vollständigen Dokumenten oder Codebasisanalysen kann das Überschreiten dieses Intervalls die Kosten stärker beeinflussen als die Modellwahl.

Wie kann ich die Kosten der GPT API senken?

In der Reihenfolge ihrer Wirkung gibt es vier Maßnahmen: Ausgabe reduzieren (einschließlich Reasoning-Tokens ist die Ausgabe am teuersten), die Modellklasse an die Größe der Aufgabe anpassen (für umfangreiche Klassifizierungs- oder Extraktionsaufgaben zuerst das günstigste GPT-6 Luna testen), Prompt-Caching für wiederholte Kontextpräfixe verwenden und Aufgaben bündeln, wenn keine Echtzeit erforderlich ist. Zusätzlich wirkt sich der Wechsel auf einen günstigeren Endpoint durch eine Änderung von base_url multiplizierend aus.

Wie bezahle ich die GPT-API-Kosten aus Korea?

Kunavo wickelt Zahlungen über Stripe ab — internationale und inländische Kredit- und Debitkarten (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay und Google Pay werden unterstützt. Es handelt sich um ein vorausbezahltes nutzungsabhängiges Modell, bei dem Sie ab mindestens $10 aufladen und das Guthaben entsprechend der Nutzung abnimmt; das Guthaben verfällt nicht. Wenn die Zahlungsseite in KRW angezeigt wird, erscheinen auch KakaoPay, Naver Pay, PAYCO, Samsung Pay und inländische Karten (einschließlich Karten ohne aktivierte Auslandszahlungen). Toss wird nicht unterstützt. Alle diese Methoden laden Ihr Kunavo-Guthaben auf; es handelt sich nicht um eine direkte Zahlung an OpenAI. Ein OpenAI-Konto oder ein separater Vertrag ist nicht erforderlich. Beginnen Sie mit der Registrierung und erstellen Sie anschließend einen API-Schlüssel.

Kann ich bestehenden OpenAI-SDK-Code unverändert verwenden?

Ja. Kunavo bietet einen OpenAI-kompatiblen Endpoint. Ändern Sie base_url zu https://api.kunavo.com/v1 und ersetzen Sie nur den Schlüssel. Der übrige Code kann unverändert bleiben; mit demselben Schlüssel können auch Claude-, Bild- und Videomodelle aufgerufen werden.