Die GPT-API wird nutzungsabhängig pro Token abgerechnet. Es gibt keine Monatsgebühr; Eingabe- und Ausgabe-Token haben getrennte Preise, wobei Ausgaben teurer sind. Mit Stand vom 4. Oktober 2026 betragen die Kunavo-Tarife pro 1M Token für gpt-5-6-terra $0.70 Eingabe / $4.20 Ausgabe und für gpt-5-5 $2.00 / $12.00 – beide liegen unter dem offiziellen OpenAI-Preis. Das am 22. September 2026 veröffentlichte gpt-6-luna kostet $0.04 / $0.20 und ist das günstigste GPT-Modell bei Kunavo.
Eine Sache sollte zuerst geklärt werden: Der ChatGPT-Monatstarif und die OpenAI API sind verschiedene Produkte mit getrennter Abrechnung. Ein ChatGPT-Abonnement beinhaltet keinen API-Schlüssel und senkt die API-Rechnung nicht. Diese Seite behandelt ausschließlich Letzteres, also die Kosten für Aufrufe aus Code.
Die Tarife wurden am 4. Oktober 2026 überprüft. Die Zahlen auf der Kunavo-Seite werden aus dem Katalog dieser Website geladen und weichen daher nicht von den tatsächlichen Rechnungsbeträgen ab. Für die offiziellen OpenAI-Preise siehe die OpenAI-Preisseite.
Tariftabelle für GPT-5 / GPT-6
USD pro 1M Token. „Offizieller OpenAI-Preis“ ist der veröffentlichte Preis desselben Modells. Bei Modellen mit laufender Promotion führen wir unten den Preis auf, den OpenAI derzeit tatsächlich berechnet.
| Modelle | Eingabe / 1 Mio. | Ausgabe / 1 Mio. | Offizieller OpenAI-Preis |
|---|---|---|---|
gpt-6-luna | $0.04 | $0.20 | $0.10 / $0.50 |
gpt-6-sol | $0.80 | $4.00 | $2.00 / $10.00 |
gpt-5-6-terra | $0.70 | $4.20 | $2.00 / $12.00 |
gpt-5-5 | $2.00 | $12.00 | $5.00 / $30.00 |
gpt-6-astra | $4.00 | $20.00 | $10.00 / $50.00 |
gpt-5-6-sol | $2.00 | $12.00 | $5.00 / $30.00 Derzeit Aktionspreis $4.00 / $20.00 (mindestens bis 21. November 2026) |
Die aktuellen Preise werden immer auf der Preisseite und auf den jeweiligen Modellseiten angezeigt. Eine Übersicht aller Modelle finden Sie in der Modellübersicht.
GPT-6 ist die neue Generation von OpenAI. GPT-6 Astra wurde am 3. September 2026 als OpenAIs Spitzenmodell veröffentlicht, gefolgt von GPT-6 Sol und GPT-6 Luna am 22. September 2026. OpenAI beschreibt beide Modelle als „auf den Fortschritten aufbauend, die GPT-6 Astra ermöglicht haben“: Sol ist für komplexes Programmieren und agentische Workflows gedacht, Luna als „das effizienteste Modell für fokussierte Verarbeitung großer Mengen“. Beide haben einen Kontext von 1,050,000 Tokens und eine maximale Ausgabe von 128,000 Tokens.
Bei Kunavo ist GPT-6 Luna mit $0.04 / $0.20 das günstigste GPT-Modell. GPT-6 Sol kostet $0.80 / $4.00, und der Ausgabepreis liegt unter dem von GPT-5.6 Terra ($4.20). Allerdings ist der Eingabepreis bei GPT-5.6 Terra ($0.70) niedriger; bei Anfragen, bei denen die Eingabetoken das 2-Fache der Ausgabetoken überschreiten, ist GPT-5.6 Terra günstiger (ein Vergleich ist in der Tabelle unten möglich). Anfragen mit mehr als 272.000 Eingabetokens werden wie bei den anderen GPT-5.x- / GPT-6-Modellen gemäß den Vorgaben von OpenAI für die gesamte Anfrage zum 2-fachen Eingabepreis und zum 1,5-fachen Ausgabepreis abgerechnet.
Was kostet eine Anfrage tatsächlich?
| Verwendung | Tokens | gpt-6-luna | gpt-6-sol | gpt-5-6-terra | gpt-5-5 |
|---|---|---|---|---|---|
| Kurzer 1-Turn | 1.000 Eingabe / 300 Ausgabe | $0.0001 | $0.0020 | $0.0020 | $0.0056 |
| Eine RAG-Antwort | 6.000 Eingabe / 500 Ausgabe | $0.0003 | $0.0068 | $0.0063 | $0.0180 |
| Schwierige Aufgabe | 20.000 Eingabe / 3.000 Ausgabe | $0.0014 | $0.0280 | $0.0266 | $0.0760 |
| Batch mit 100.000 Einträgen | 500 Eingabe / 20 Ausgabe × 100.000 | $2.40 | $48.00 | $43.40 | $124.00 |
Wenn Sie mit Ihren eigenen Zahlen rechnen möchten, können Sie dies unverändert verwenden.
# Kunavo の GPT 料率(1M トークンあたり USD): (input, output)
RATES = {
"gpt-5-6-terra": (0.70, 4.20),
"gpt-5-5": (2.00, 12.00),
"gpt-5-6-sol": (2.00, 12.00),
"gpt-6-sol": (0.80, 4.00),
"gpt-6-luna": (0.04, 0.20),
}
def cost(model: str, in_tokens: int, out_tokens: int) -> float:
i, o = RATES[model]
# 注意: GPT-5 系の推論モデルは reasoning トークンも出力料率で課金される。
return in_tokens / 1_000_000 * i + out_tokens / 1_000_000 * o
print(cost("gpt-5-6-terra", 1_000, 300)) # 短い 1 ターン
print(cost("gpt-5-6-terra", 6_000, 500)) # RAG の回答 1 件
print(cost("gpt-5-5", 20_000, 3_000)) # 難しい問題
print(cost("gpt-5-6-sol", 20_000, 3_000)) # GPT-5.6 のフラッグシップ
print(cost("gpt-6-sol", 20_000, 3_000)) # GPT-6 Sol
print(cost("gpt-6-luna", 1_000, 300)) # いちばん安い 1 ターンZwei Fallstricke, die Ihre Rechnung verfälschen
Der erste sind Reasoning-Tokens. Reasoning-Modelle der GPT-5-Serie erzeugen intern Denktokens, bevor sie eine Antwort ausgeben. Diese erscheinen zwar nicht im Antworttext, werden aber zum Ausgabepreis berechnet. Die Tabelle oben enthält keine Reasoning-Tokens, daher liegt die tatsächliche Rechnung bei schwierigen Aufgaben höher. Die Anzahl der Ausgabetokens im Feld usage ist der tatsächliche Wert.
Der zweite sind Wiederholungsversuche. Auch Anfragen, die nach dem Verbrauch von Tokens auf nachgelagerter Ebene fehlschlagen, werden berechnet. Bei agentischen Workloads entspricht eine für den Nutzer sichtbare Aufgabe abrechnungstechnisch oft mehreren Hin-und-zurück-Runden, daher ist die Abweichung hier am größten. Anfragen, die bei Kunavo fehlschlagen (also den Upstream nicht erreichen), werden nicht berechnet.
Bestehenden OpenAI-Code verbinden
Sie müssen nur die eine Zeile mit base_url und den Schlüssel ändern. Sowohl chat.completions als auch responses funktionieren unverändert weiter.
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1", # 変えるのはこの 1 行だけ
)
resp = client.chat.completions.create(
model="gpt-5-6-terra",
messages=[{"role": "user", "content": "こんにちは"}],
)
print(resp.choices[0].message.content)Mit demselben Schlüssel können Sie auch Claude, Bild- und Videomodelle aufrufen. Die Anleitung finden Sie im Schnellstart, die Endpunktübersicht in der Dokumentation zu Chat Completions.
Aus Japan bezahlen
Kunavo-Guthaben wird beim Stripe-Checkout mit Karten einschließlich JCB (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay, Google Pay und Link unterstützt. Es handelt sich um eine vorausbezahlte Wallet mit einer Mindestaufladung von $10; das Guthaben verfällt nicht. Für Monate ohne Nutzung fällt keine Gebühr an. Zahlung in Convenience Stores und PayPay werden nicht unterstützt. Die gesetzlich vorgeschriebenen Angaben für inländische Unternehmen finden Sie unter Angaben gemäß dem Gesetz über spezifizierte Handelsgeschäfte; Einzelheiten zur Abrechnung stehen in der Abrechnungsdokumentation.
Vier Stellschrauben zur Kostensenkung
- Wählen Sie die Stufe nach der Größe der Aufgabe. Verwenden Sie nicht standardmäßig das Spitzenmodell. Für umfangreiche Verarbeitung wie Klassifizierung, Extraktion und Formatierung sollten Sie mit dem günstigsten Modell
gpt-6-lunabeginnen, das OpenAI für diesen Zweck vorsieht, und nur bei Bedarf hochstufen. Wie die Tabelle oben zeigt, unterscheiden sichgpt-6-lunaundgpt-5-5selbst bei derselben RAG-Antwort um etwa das 53-Fache. - Begrenzen Sie die Ausgabe. Die Ausgabe ist teurer als die Eingabe, daher wirken sich
max_tokensund die Vorgabe des Ausgabeformats unmittelbar aus. Bei Reasoning-Modellen wirkt sich dies doppelt aus. - Nutzen Sie Prompt-Caching. Wenn Sie bei jeder Anfrage denselben System-Prompt senden, ist der Cache der größte Hebel. Die Funktionsweise wird in der Cache-Dokumentation erklärt.
- Fügen Sie keinen für die Eingabe irrelevanten Verlauf hinzu. Wenn Sie zu einer anderen Aufgabe wechseln, löschen Sie die Unterhaltung. Lange Verläufe werden jedes Mal vollständig berechnet.
Wenn Sie Modelle anderer Anbieter vergleichen möchten, stellt die Claude-Preisübersicht sie nach derselben Berechnungsmethode gegenüber. Wenn Sie nur die nutzungsabhängigen Kosten der Codex CLI sehen möchten, finden Sie diese in der Codex-Preisübersicht.
Häufig gestellte Fragen
Wie viel kostet die GPT API?
Die Abrechnung erfolgt nutzungsabhängig pro Token, mit getrennten Preisen für Eingaben und Ausgaben. Mit Stand vom 4. Oktober 2026 betragen die Kunavo-Tarife pro 1M Token für gpt-5-6-terra $0.70 Eingabe / $4.20 Ausgabe, für gpt-5-5 $2.00 / $12.00 und für gpt-5-6-sol $2.00 / $12.00. Die offiziellen OpenAI-Preise für dieselben Modelle betragen jeweils $2.00 / $12.00, $5.00 / $30.00 und $5.00 / $30.00 (gpt-5-6-sol wird derzeit von OpenAI zum Aktionspreis von $4.00 / $20.00 angeboten; laut Preisseite gilt dieser mindestens bis 21. November 2026). Das am 22. September 2026 veröffentlichte gpt-6-sol kostet $0.80 / $4.00, gpt-6-luna $0.04 / $0.20 (offizieller OpenAI-Preis: $2.00 / $10.00 bzw. $0.10 / $0.50); gpt-6-luna ist das günstigste GPT-Modell. Es gibt keine Monatsgebühr.
Wie viel kostet die GPT-6-API?
OpenAI-Listenpreise (pro 1M Token, Eingabe / Ausgabe): GPT-6 Sol $2.00 / $10.00, GPT-6 Luna $0.10 / $0.50, GPT-6 Astra $10.00 / $50.00 (Sol und Luna wurden am 22. September 2026, Astra am 3. September 2026 veröffentlicht). Kunavos Preise pro 1M Token für Eingabe / Ausgabe betragen für gpt-6-sol $0.80 / $4.00, für gpt-6-luna $0.04 / $0.20 und für GPT-6 Astra $4.00 / $20.00. Alle sind etwa 60% günstiger als der Listenpreis. gpt-6-luna ist das günstigste GPT-Modell auf Kunavo, und der Ausgabepreis von gpt-6-sol liegt unter dem von gpt-5-6-terra ($4.20) (der Eingabepreis von gpt-5-6-terra ist bei $0.70 niedriger). Bei Anfragen mit mehr als 272.000 Eingabe-Token wird wie bei OpenAI die gesamte Anfrage mit dem 2-Fachen des Eingabepreises und dem 1,5-Fachen des Ausgabepreises abgerechnet.
Sind die ChatGPT-Monatsgebühr und die Preise der OpenAI API dasselbe?
Nein, es handelt sich um verschiedene Produkte mit getrennter Abrechnung. Kostenpflichtige ChatGPT-Tarife sind Monatsgebühren für die Nutzung der Oberfläche unter chat.openai.com; sie enthalten kein API-Kontingent und keinen API-Schlüssel. Die API wird pro Token abgerechnet und hat keine Monatsgebühr, sondern berechnet nur die tatsächlichen Aufrufe. Für Aufrufe aus Code brauchst du die API; ein ChatGPT-Abonnement senkt deine API-Rechnung keinen einzigen Yen.
Wie viel kostet eine GPT-API-Anfrage tatsächlich?
Eine RAG-Antwort mit 6.000 Eingabe- und 500 Ausgabe-Token kostet bei gpt-5-6-terra ungefähr $0.0063 und beim günstigsten gpt-6-luna ungefähr $0.0003. Bei einem schwierigen Problem mit 20.000 Eingabe- und 3.000 Ausgabe-Token kostet gpt-5-5 etwa $0.0760 und gpt-5-6-sol etwa $0.0760. Alle Werte verwenden Kunavo-Tarife und enthalten keine Reasoning-Token.
Wie werden Reasoning-Token abgerechnet?
Sie werden zum Ausgabepreis berechnet. Reasoning-Modelle der GPT-5-Reihe erzeugen intern Token, bevor sie antworten. Diese erscheinen nicht im Antworttext, aber auf der Rechnung. Das ist der häufigste Grund dafür, dass eine Schätzung niedriger ausfällt als die tatsächliche Rechnung; bei schwierigen Problemen ist die Abweichung größer. Lies die Zahl der Ausgabe-Token im Feld usage, um den tatsächlichen Wert zu ermitteln, und verwende diesen statt einer Schätzung.
Wie kann man GPT günstiger nutzen?
Vier Maßnahmen, beginnend mit der wirkungsvollsten. Wähle die Stufe nach der Größe des Problems und setze nicht standardmäßig das Spitzenmodell ein (der Ausgabepreis des Spitzenmodells gpt-6-astra beträgt das 100-Fache des Ausgabepreises des günstigsten Modells gpt-6-luna). Begrenze die Ausgabe mit max_tokens und der Vorgabe eines Ausgabeformats. Nutze Prompt-Caching. Füge der Eingabe keinen irrelevanten Verlauf hinzu. Wenn du die Anfragen zusätzlich an einen Endpunkt mit Preisen unter den offiziellen OpenAI-Preisen richtest, kommen dessen Einsparungen zu denen der vier Maßnahmen hinzu.
Funktioniert bestehender Code mit dem OpenAI-SDK unverändert?
Ja. Kunavo ist ein OpenAI-kompatibler Endpunkt. Du musst nur eine Zeile ändern, um base_url auf https://api.kunavo.com/v1 zu setzen, und den Schlüssel austauschen. Sowohl chat.completions als auch responses funktionieren in derselben Form, und die Modellnamen können unverändert verwendet werden. Mit demselben Schlüssel kannst du auch Claude sowie Bild- und Videomodelle aufrufen.
Wie bezahlt man GPT-API-Kosten aus Japan?
Kunavo-Guthaben wird beim Stripe-Checkout mit Karten einschließlich JCB (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay, Google Pay und Link unterstützt. Es handelt sich um eine vorausbezahlte Wallet mit einer Mindestaufladung von $10; das Guthaben verfällt nicht und für Monate ohne Nutzung fällt keine Gebühr an. Fehlgeschlagene Requests werden nicht berechnet. Zahlung in Convenience Stores und PayPay werden nicht unterstützt.