Zurück zu den Leitfäden
Modelle·24. September 2026·Aktualisiert am 29. September 2026·5 Min. Lesezeit

GPT-6-API – Preise für Astra, Sol und Luna, Modell-IDs und Aufrufe

OpenAIs GPT-6-Familie umfasst drei Modelle – Astra, Sol und Luna. Hier findest du die API-Preise bei OpenAI und Kunavo, den passenden Einsatz je Modell, die Stufe für lange Prompts mit doppeltem Eingabepreis sowie funktionierenden Code für die Responses- und Chat-Completions-APIs.

Zuletzt überprüft am .

GPT-6 ist OpenAIs aktuelle Modellfamilie: GPT-6 Astra, veröffentlicht September 3, 2026, sowie GPT-6 Sol und GPT-6 Luna, veröffentlicht September 22, 2026. OpenAI listet sie mit $10.00 / $50.00, $2.00 / $10.00 und $0.10 / $0.50 pro 1 Mio. Eingabe- / Ausgabetokens. Auf Kunavo sind alle drei mit $4.00 / $20.00, $0.80 / $4.00 und $0.04 / $0.20 verfügbar — 60 % unter dem OpenAI-Listenpreis — als gpt-6-astra, gpt-6-sol und gpt-6-luna, jeweils mit einem Kontextfenster von 1.050.000 Tokens und bis zu 128.000 Ausgabetokens.

Preise der GPT-6 API

Die veröffentlichten Preise von OpenAI neben denen von Kunavo, jeweils pro 1 Mio. Tokens. Zwischengespeicherte Eingaben kosten bei OpenAI und Kunavo ein Zehntel des Eingabepreises, Cache-Schreibvorgänge das 1,25-Fache davon:

ModellOpenAI Eingabe / AusgabeKunavo Eingabe / AusgabeKunavo Cache-Lesen / -Schreiben
GPT-6 Astra$10.00 / $50.00$4.00 / $20.00$0.40 / $5.00
GPT-6 Sol$2.00 / $10.00$0.80 / $4.00$0.08 / $1.00
GPT-6 Luna$0.10 / $0.50$0.04 / $0.20$0.004 / $0.05

Ein Prompt mit mehr als 272K Eingabetokens wird für die gesamte Anfrage mit 2x den Eingabe- und Cache-Sätzen sowie 1.5x dem Ausgabesatz berechnet — OpenAIs Stufe, die auf Kunavo genauso angewendet wird. Reasoning-Tokens werden bei jedem GPT-6-Modell als Ausgabe berechnet. OpenAIs Einführungshinweis nennt für Sol und Luna „50 % niedrigere API-Preise“ als die Aktionspreise von GPT-5.6; auf Kunavo kostet GPT-6 Sol $0.80 / $4.00 gegenüber GPT-5.6 Sol mit $2.00 / $12.00. Alle GPT-Preise findest du im Leitfaden zu GPT-API-Preisen; der OpenAI API-Preisrechner berechnet einen gesamten Workload über die GPT-6-Modelle hinweg.

Welches GPT-6-Modell soll ich aufrufen?

ModellOpenAI positioniert es fürVeröffentlicht
gpt-6-astraAnspruchsvollste End-to-End-Arbeit3. September 2026
gpt-6-solKomplexe Programmierung und agentische Workflows22. September 2026
gpt-6-lunaFokussierte Aufgaben mit hohem Volumen22. September 2026
  • Programmieragenten und mehrstufige Tool-Nutzung — gpt-6-sol (Preis: ein Fünftel von Astras Preis). Beginne hier und wechsle nur dann zu einem leistungsfähigeren Modell, wenn dieses Modell nicht ausreicht.
  • Die anspruchsvollste Arbeit mit langem Zeithorizont — gpt-6-astra, OpenAIs leistungsfähigstes Modell.
  • Klassifizierung, Extraktion, Routing, Massenaufgaben — gpt-6-luna; setze reasoning_effort auf low oder none, um Reasoning-Tokens niedrig zu halten.

GPT-6 auf Kunavo aufrufen

Kunavo stellt die GPT-6-Modelle über die Responses API bereit, für die OpenAI sie entwickelt, sowie über Chat Completions. Behalte das OpenAI-SDK bei und ändere base_url:

gpt6_responses.py
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["KUNAVO_API_KEY"],
    base_url="https://api.kunavo.com/v1",
)

# GPT-6 models reason before they answer; reasoning bills as output.
resp = client.responses.create(
    model="gpt-6-sol",
    reasoning={"effort": "medium"},
    input="Write a migration plan for splitting this monolith into services.",
)
print(resp.output_text)
gpt6_chat.py
# The same models on Chat Completions — swap the id for gpt-6-luna or
# gpt-6-astra and nothing else changes. reasoning_effort maps to
# the Responses API's reasoning.effort.
resp = client.chat.completions.create(
    model="gpt-6-luna",
    reasoning_effort="low",
    messages=[{"role": "user", "content": "Classify this ticket: 'refund not received'"}],
)
print(resp.choices[0].message.content)

Für Codex verweist du einen benutzerdefinierten Anbieter auf Kunavo und setzt gpt-6-sol — die Codex-CLI-Seite enthält die Konfiguration. Schlüssel werden unter /app/keys erstellt.

Häufig gestellte Fragen

Wie viel kostet die GPT-6 API?

OpenAI listet GPT-6 Astra mit $10.00 Eingabe / $50.00 Ausgabe pro 1 Mio. Tokens, GPT-6 Sol mit $2.00 / $10.00 und GPT-6 Luna mit $0.10 / $0.50; zwischengespeicherte Eingaben kosten ein Zehntel des Eingabepreises und Cache-Schreibvorgänge das 1,25-Fache davon. Auf Kunavo kosten dieselben drei Modelle $4.00 / $20.00, $0.80 / $4.00 und $0.04 / $0.20 — 60 % unter dem OpenAI-Listenpreis — nutzungsabhängig ohne Abonnement.

Was ist der Unterschied zwischen GPT-6 Astra, Sol und Luna?

Astra ist OpenAIs leistungsfähigstes GPT-6-Modell, veröffentlicht 3. September 2026, und laut OpenAI „für die anspruchsvollste End-to-End-Arbeit entwickelt“. Sol und Luna folgten am 22. September 2026 und bauen laut OpenAI „auf den Fortschritten hinter GPT-6 Astra auf“: Sol richtet sich an komplexe Programmier- und agentische Workflows zum Fünftel des Astra-Listenpreises, Luna ist OpenAIs „effizientestes Modell für fokussierte Aufgaben mit hohem Volumen“ zu $0.10 / $0.50 pro 1 Mio. Tokens. Alle drei verfügen über ein Kontextfenster von 1.050.000 Tokens und maximal 128.000 Ausgabetokens.

Wie lauten die GPT-6-Modell-IDs?

gpt-6-astra, gpt-6-sol und gpt-6-luna — dieselben Zeichenfolgen in OpenAIs API und auf Kunavo, sowohl unter /v1/responses als auch unter /v1/chat/completions.

Berechnet die GPT-6 API für lange Prompts mehr?

Ja. OpenAI berechnet einen Prompt mit mehr als 272K Eingabetokens für die gesamte Anfrage mit 2x den Eingabe- und Cache-Sätzen sowie 1.5x dem Ausgabesatz, bei allen drei Modellen. Kunavo wendet dieselbe Stufe auf die eigenen Preise an; eine Anfrage mit mehr als 272K Eingabetokens an GPT-6 Sol wird mit $1.60 Eingabe / $6.00 Ausgabe pro 1 Mio. Tokens berechnet.

Kann ich GPT-6 Sol in Codex verwenden?

Ja. Codex kommuniziert über die Responses API mit einem benutzerdefinierten Anbieter, den Kunavo nativ bereitstellt; setze das Modell im Anbieterblock auf gpt-6-sol. OpenAI bietet GPT-6 Sol und Luna außerdem in Codex für ChatGPT-Plus-, Pro-, Business-, Enterprise- und Edu-Tarife an — dieser Zugriff ist von der API-Abrechnung getrennt.