Zurück zu den Leitfäden
Modelle·2. Juli 2026·Aktualisiert am 12. September 2026·7 Min. Lesezeit

Gemini-3-API – Preise, Verfügbarkeit und der aktuelle Weg zum Aufruf von Gemini

Gemini 3 ist Googles aktuelle Modellfamilie – 3 Pro, 3.1 Pro und eine Flash-Reihe bis Gemini 3.8 Flash. Hier finden Sie die API-Preise zu Googles Listen- und Einführungspreisen, welche Slugs bei Kunavo live sind und den OpenAI-kompatiblen Code, mit dem Sie sie heute aufrufen.

Zuletzt überprüft am .

Gemini 3 ist Googles aktuelle Modellfamilie — Gemini 3 Pro und Gemini 3.1 Pro bilden die Spitzenmodelle, während die Flash-Reihe von Gemini 3 Flash bis Gemini 3.8 Flash reicht — nativ multimodal, mit einem Kontext von 1 Mio. Token und Chain-of-Thought-Reasoning. Sie können die Gemini-3-API heute über Kunavo mit einem einzigen OpenAI-kompatiblen Endpunkt aufrufen: Gemini 3.1 Pro zu $0.70 / $4.20 pro 1 Mio. Token, etwa 65 % unter Googles Listenpreis von $2.00 / $12.00, sowie Gemini 3.8 Flash, das neueste Flash-Modell, zu $0.525 / $2.625 — 30 % unter dem Einführungspreis von $0.75 / $3.75, den Google bis 31. Dezember 2026 für 3.x Flash berechnet. Dieser Leitfaden zeigt die Kosten jeder Stufe, welche Slugs aktiv sind und den Code für ihre Aufrufe.

Hinweis zur Verfügbarkeit. Die Gemini-3-Pro-Stufe ist bei Kunavo aktiv: gemini-3-1-pro läuft mit $0.70 / $4.20 pro 1 Mio., etwa 65 % unter Googles Listenpreis von $2.00 / $12.00. Bei Flash ist gemini-3-8-flash ($0.525 / $2.625) das neueste Modell, gemini-3-7-flash ($0.525 / $2.625) die vorherige Version und gemini-3-6-flash ($1.05 / $5.25) weiterhin verfügbar — obwohl es jetzt mehr als beide anderen und mehr als Googles eigenen Einführungspreis kostet. Zwei Slugs bleiben reserviert und deaktiviert — die ursprünglichen gemini-3-pro und gemini-3-flash — weil die von uns getesteten Upstream-Quellen dafür unsere Zuverlässigkeitsschwelle nicht erfüllen: anhaltende 503-Fehler und fehlerhafte Parameterverarbeitung (eine Quelle ignoriert maxOutputTokens vollständig). Wir aktivieren einen Slug erst, wenn eine Quelle diese Tests besteht. Gemini 2.5 Flash bleibt ebenfalls am selben Endpunkt aktiv.

Preise der Gemini-3-API

Googles offizielle Preise für die Familie neben den Kosten jeder Stufe bei Kunavo. Für die 3.x-Flash-Modelle berechnet Google bis 31. Dezember 2026 einen Einführungspreis; daher zeigt die Tabelle diesen Preis — den Sie heute bei direktem Bezug zahlen würden — neben dem anschließend geltenden Standardpreis:

ModellEingabe / 1 Mio.Ausgabe / 1 Mio.Status bei Kunavo
Gemini 3 Pro (Google-Liste, ≤200.000 Kontext)$2.00$12.00Reserviert — nicht aktiviert
Gemini 3.1 Pro bei Kunavo$0.70$4.20Aktiv (Google-Liste $2.00 / $12.00)
Gemini 3 Flash (Google-Liste)$0.50$3.00Reserviert — nicht aktiviert
Gemini 3.6 / 3.7 / 3.8 Flash (Googles Einführungspreis bis 31. Dezember 2026)$0.75$3.75Direkt über Google; Standardpreis $1.50 / $7.50 ab 1. Januar 2027
Gemini 3.8 Flash bei Kunavo — neuestes Modell$0.525$2.625Aktiv — 30 % unter Googles Einführungspreis
Gemini 3.7 Flash bei Kunavo$0.525$2.625Aktiv — 30 % unter Googles Einführungspreis
Gemini 3.6 Flash bei Kunavo$1.05$5.25Aktiv — 40 % über Googles Einführungspreis; verwenden Sie 3.7 oder 3.8 Flash
Gemini 2.5 Flash bei Kunavo$0.09$0.75Verfügbar

Der Kunavo-Preis jedes aktuellen Gemini-Modells neben Googles Preis sowie ausgearbeitete Kostenbeispiele stehen im Preisleitfaden für die Gemini-API.

Gemini-3.8-Flash-API: Preis und Googles Einführungspreis

Gemini 3.8 Flash ist Googles neuestes Flash-Modell, veröffentlicht am 2. September 2026 und ausgelegt auf langfristige Softwareentwicklung und agentische Ausführung, mit einem Kontextfenster von 1.048.576 Token und bis zu 65.536 Ausgabetoken. Bei Kunavo kostet die Gemini-3.8-Flash-API $0.525 für Eingaben / $2.625 für Ausgaben pro 1 Mio. Token und wird als gemini-3-8-flash am selben Endpunkt wie jedes andere Modell aufgerufen.

Google berechnet für seine 3.x-Flash-Modelle — 3.6, 3.7 und 3.8 Flash — bis 31. Dezember 2026 einen Einführungspreis von $0.75 / $3.75 pro 1 Mio. Token und ab 1. Januar 2027 den Standardpreis von $1.50 / $7.50. Gegenüber dem Preis, den Google heute berechnet, sind Kunavos Gemini 3.8 Flash und Gemini 3.7 Flash ($0.525 / $2.625) 30 % günstiger. Das gilt nicht für Gemini 3.6 Flash: Mit $1.05 / $5.25 kostet es 40 % mehr als Googles Einführungspreis; daher sollten Sie 3.7 und 3.8 Flash verwenden — beide sind neuer und günstiger.

Kunavo bietet einen einzigen OpenAI-kompatiblen Schlüssel und ein vorausbezahltes Guthaben für Gemini, Claude, GPT sowie die Bild- und Videomodelle, ohne Google-Cloud-Projekt und ohne Berechnung fehlgeschlagener Anfragen. Es bietet jedoch keine dedizierte Kapazität: Kunavo nutzt gemeinsam verwendete Kapazität ohne dediziertes Kontingent und ohne vertragliche SLA. Wenn Sie eines davon benötigen, rufen Sie Google direkt auf.

Gemini 3.6 Flash — was sich geändert hat

Gemini 3.6 Flash (veröffentlicht am 21. Juli 2026) war das erste 3.x-Flash-Modell, das wir bereitstellen konnten, und das Modell hinter den Reasoning-Token-Messungen in diesem Abschnitt. Googles Standardpreis beträgt $1.50 für Eingaben / $7.50 für Ausgaben pro 1 Mio. Token — bei Standardpreisen derselbe Eingabepreis wie bei Gemini 3.5 Flash, während die Ausgabe etwa 17 % günstiger ist — aber bis 31. Dezember 2026 berechnet Google einen Einführungspreis von $0.75 / $3.75. Google positioniert es für agentische Aufgaben mit langem Zeithorizont und behauptet, damit die Tokenkosten bei mehrstufigen Entwicklungsaufgaben deutlich zu senken.

Die Zahl, die Ihre Rechnung tatsächlich bestimmt, steht nicht auf der Preisliste: 3.6 Flash denkt standardmäßig, und das Denken dominiert den Ausgabenzähler. In unseren Tests verbrauchte eine faktische Antwort mit einem Satz ungefähr 120–140 Reasoning-Token, um 7 sichtbare Ausgabetoken zu erzeugen. Reasoning-Token werden zum Ausgabepreis berechnet. Die tatsächlichen Kosten einer kurzen 3.6-Flash-Antwort liegen daher eher bei 150 Ausgabetoken als bei 7 — ungefähr 20-mal höher als die naive Schätzung. Daraus ergeben sich zwei praktische Konsequenzen:

  • Setzen Sie kein kleines max_tokens. Alles unter etwa 150 wird vor der Ausgabe einer Antwort durch das Reasoning verbraucht; Sie erhalten ein abgeschnittenes Fragment und bezahlen trotzdem für das Denken.
  • Planen Sie für Reasoning, nicht für sichtbare Ausgaben. Für kurze Anfragen mit hohem Volumen ist eine nicht denkende Flash-Stufe in der Praxis meist günstiger, selbst bei einem höheren Preis pro Token.

Gemini 3.6 Flash ist bei Kunavo weiterhin aktiv als gemini-3-6-flash zu $1.05 / $5.25 pro 1 Mio., kostet damit jedoch 40 % mehr als die $0.75 / $3.75, die Google bis 31. Dezember 2026 berechnet, und mehr als Kunavos eigene Preise für die neueren Modelle. Für neue Arbeiten verwenden Sie gemini-3-8-flash oder gemini-3-7-flash zu $0.525 / $2.625, 30 % unter Googles Einführungspreis. Auch diese Modelle denken, halten Sie daher max_tokens großzügig bemessen.

Gemini heute über Kunavo aufrufen

Kunavo stellt Gemini hinter dem OpenAI-kompatiblen Endpunkt /v1/chat/completions bereit — behalten Sie das OpenAI-SDK bei und ändern Sie base_url, ohne Google-Cloud-Projekt. Damit wird die Gemini-3.8-Flash-API aufgerufen; ersetzen Sie die Modellzeichenfolge durch gemini-3-7-flash, gemini-3-1-pro oder gemini-2-5-flash, und sonst ändert sich nichts:

gemini_chat.py
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["KUNAVO_API_KEY"],
    base_url="https://api.kunavo.com/v1",
)

# Gemini 3.8 Flash is Google's newest Flash. Mind the max_tokens: the 3.x Flash
# models think before they answer and reasoning bills as output, so a small
# cap can be spent thinking and return a truncated answer.
resp = client.chat.completions.create(
    model="gemini-3-8-flash",
    max_tokens=1024,
    messages=[{"role": "user", "content": "Summarize this contract in 5 bullets."}],
)
print(resp.choices[0].message.content)

Das Erstellen eines Schlüssels dauert eine Minute — siehe den Leitfaden für Gemini-API-Schlüssel. Derselbe sk-kn--Schlüssel erreicht auch Claude, GPT, Nano Banana-Bilder und Veo-3-Videos.

Welche Gemini-Stufe sollte ich aufrufen?

  • Aufgaben mit langem Kontext und Reasoning — gemini-3-1-pro zu $0.70 für Eingaben / $4.20 für Ausgaben. Dies ist Googles Flaggschiff-Stufe für Coding, Agenten und multimodale Analyse sowie die Pro-Stufe, die wir bereitstellen.
  • Agentische Arbeit mit schrittweisem Reasoning — gemini-3-8-flash zu $0.525 / $2.625, 30 % unter Googles Einführungspreis, oder gemini-3-7-flash zum gleichen Preis, wenn Ihre Prompts dort validiert wurden. Reasoning mit Flash-Latenz; planen Sie mit Reasoning-Token statt sichtbaren Ausgaben.
  • Anfragen mit hohem Volumen und niedriger Latenz — gemini-2-5-flash zu $0.09 für Eingaben / $0.75 für Ausgaben bleibt die kosteneffiziente Wahl; es denkt standardmäßig nicht, weshalb es bei kurzen Antworten günstig bleibt.
  • Nicht 3.6 Flash, wenn der Preis entscheidend ist — gemini-3-6-flash zu $1.05 / $5.25 kostet bei Kunavo mehr als 3.7 und 3.8 Flash sowie mehr als Googles eigenen Einführungspreis; behalten Sie es nur für Prompts, die bereits damit validiert wurden.
  • Für das nächste Upgrade entwickeln — programmieren Sie gegen die OpenAI-kompatible Struktur und behandeln Sie die Modellzeichenfolge als Konfiguration; neue Gemini-Slugs werden hinter demselben Endpunkt verfügbar.

Häufig gestellte Fragen

Was ist die Gemini-3-API?

Gemini 3 ist Googles aktuelle Modellfamilie — Gemini 3 Pro und 3.1 Pro, Gemini 3 Flash sowie die neueren Modelle Gemini 3.6, 3.7 und 3.8 Flash — nativ multimodal, mit einem Kontext von 1 Mio. Token und Chain-of-Thought-Reasoning. Die Gemini-3-API ermöglicht den programmgesteuerten Aufruf: direkt über Google AI Studio / Vertex AI oder über ein OpenAI-kompatibles Gateway wie Kunavo, das heute Gemini 3.1 Pro sowie die Modelle 3.6, 3.7 und 3.8 Flash bereitstellt.

Kann ich die Gemini-3-API heute über Kunavo aufrufen?

Ja. Gemini 3.1 Pro ist als gemini-3-1-pro zu $0.70 Eingabe / $4.20 Ausgabe pro 1 Mio. Token verfügbar — etwa 65% unter Googles Listenpreis von $2.00 / $12.00 — und es ist die richtige Wahl für die Pro-Stufe. Auf der Flash-Seite ist Gemini 3.8 Flash (gemini-3-8-flash) mit $0.525 / $2.625 am neuesten, 30% unter dem Einführungspreis von $0.75 / $3.75, den Google für 3.x Flash bis 31. Dezember 2026 berechnet; Gemini 3.7 Flash (gemini-3-7-flash) kostet genauso viel, und Gemini 3.6 Flash (gemini-3-6-flash) wird weiterhin für $1.05 / $5.25 angeboten, also über Googles Einführungspreis. Alle laufen über den OpenAI-kompatiblen Endpunkt, ohne dass ein Google-Cloud-Projekt erforderlich ist. Die ursprünglichen Slugs gemini-3-pro und gemini-3-flash bleiben reserviert und sind nicht aktiviert — die von uns für diese Modelle getesteten Upstream-Quellen erfüllen unsere Zuverlässigkeitsanforderungen nicht (anhaltende 503-Fehler, fehlerhafte Parameterverarbeitung).

Wie viel kostet die Gemini-3-API?

Googles offizielle Listenpreise betragen $2.00 für Eingaben / $12.00 für Ausgaben pro 1 Mio. Token bei Gemini 3 Pro und 3.1 Pro (bis zu 200.000 Token Kontext) sowie 0,50 $ / 3,00 $ bei Gemini 3 Flash. Für Gemini 3.6, 3.7 und 3.8 Flash berechnet Google bis 31. Dezember 2026 einen Einführungspreis von $0.75 / $3.75 und danach ab 1. Januar 2027 den Standardpreis von $1.50 / $7.50. Bei Kunavo zahlen Sie $0.70 / $4.20 für Gemini 3.1 Pro (etwa 65 % unter dem Listenpreis), $0.525 / $2.625 für Gemini 3.8 Flash und Gemini 3.7 Flash (30 % unter Googles Einführungspreis) sowie $1.05 / $5.25 für Gemini 3.6 Flash, also mehr als Googles Einführungspreis.

Welches Gemini-3-Flash-Modell sollte ich verwenden — 3.6, 3.7 oder 3.8?

Verwenden Sie für neue Arbeiten Gemini 3.8 Flash (gemini-3-8-flash): Es ist Googles neuestes Flash-Modell, veröffentlicht am 2. September 2026, und kostet bei Kunavo $0.525 / $2.625 pro 1 Mio. Token — 30 % unter dem Preis von $0.75 / $3.75, den Google heute berechnet. Gemini 3.7 Flash (gemini-3-7-flash) kostet genauso viel und eignet sich für Prompts, die bereits damit validiert wurden. Gemini 3.6 Flash kostet mit $1.05 / $5.25 mehr als beide und 40 % mehr als Googles eigener Einführungspreis; wählen Sie es daher nicht nach dem Preis aus.

Wie viel kostet die Gemini-3.6-Flash-API?

Googles Standardpreis für Gemini 3.6 Flash beträgt ab 1. Januar 2027 $1.50 pro 1 Mio. Eingabetoken und $7.50 pro 1 Mio. Ausgabetoken; bis 31. Dezember 2026 berechnet Google einen Einführungspreis von $0.75 / $3.75. Bei Kunavo kostet gemini-3-6-flash $1.05 / $5.25 — 40% über Googles Einführungspreis — daher ist Gemini 3.8 oder 3.7 Flash, beide neuer und bei Kunavo für $0.525 / $2.625 erhältlich, der bessere Kauf. Die Preisliste unterschätzt außerdem die tatsächlichen Kosten, weil 3.6 Flash standardmäßig Reasoning verwendet und Reasoning-Token zum Ausgabepreis abgerechnet werden: Beim Test verbrauchte eine Antwort mit einem Satz etwa 120–140 Reasoning-Token, um 7 sichtbare Ausgabetoken zu erzeugen. Plane anhand der Reasoning-Token statt anhand der sichtbaren Ausgabe und vermeide ein max_tokens-Limit unter etwa 150, da sonst das Reasoning-Budget die Antwort aufbraucht, bevor eine Antwort ausgegeben wird.

Wie erhalte ich einen Gemini-3-API-Schlüssel?

Google AI Studio für einen direkten Schlüssel oder einen einzigen Kunavo-Schlüssel, der heute Gemini 3.1 Pro, die 3.x-Flash-Modelle und 2.5 Flash abdeckt — zusätzlich zu Claude und GPT — siehe den Schlüssel-Leitfaden.

Welche Gemini-3-Modell-IDs sind bei Kunavo aktiv?

gemini-3-8-flash (das neueste Flash-Modell, $0.525 / $2.625 pro 1 Mio.), gemini-3-7-flash, gemini-3-6-flash und gemini-3-1-pro ($0.70 / $4.20) sind bei Kunavo aktiv. Nur die ursprünglichen Slugs gemini-3-pro und gemini-3-flash bleiben reserviert, bis eine Quelle unsere Zuverlässigkeitsschwelle erfüllt.