Zurück zu den Leitfäden
Kosten·11. September 2026·Aktualisiert am 5. Oktober 2026·9 Min. Lesezeit

Gemini-API-Kosten 2026 — kostenlose Stufe, Modellpreise und Gemini 3.8 Flash

„Gemini-Kosten“ umfasst eigentlich drei Dinge: kostenlose Stufe, App-Abonnement und API-Abrechnung pro Token. Diese Seite trennt sie, listet die aktuellen Preise aller Modelle auf und zeigt offen, welches Modell beim direkten Kauf bei Google günstiger ist.

Die Gemini-API wird nach Token abgerechnet und hat keine Monatsgebühr. Zum kostenlosen Ausprobieren bietet Google AI Studio eine kostenlose Stufe mit Ratenlimits. Für den Produktiveinsatz zahlst du pro 1M Token mit getrennten Preisen für Eingaben und Ausgaben. Mit Stand vom 5. Oktober 2026 kostet bei Kunavo Gemini 3.8 Flash $0.525 Eingabe / $2.625 Ausgabe. Google berechnet für 3.x Flash derzeit den zeitlich begrenzten Aktionspreis $0.75 / $3.75 (bis 31. Dezember 2026, ab 2027 wieder der Standardpreis von $1.50 / $7.50); Kunavo ist etwa 30 % günstiger als dieser Aktionspreis. Die Vorgängerversion Gemini 2.5 Flash kostet $0.09 / $0.75, Gemini 3.1 Pro $0.70 / $4.20.

Eine Ausnahme muss zuerst erwähnt werden: Gemini 3.6 Flash. Bei Kunavo kostet es $1.05 / $5.25, etwa 40% teurer als der Google-Aktionspreis – während der Aktion ist ein direkter Aufruf bei Google günstiger. 3.7 und 3.8 Flash sind beide neuer und günstiger, Wähle 3.6 daher nicht aufgrund des Preises.

Die Preise wurden am 5. Oktober 2026 überprüft. Die offiziellen Preise und Informationen zur kostenlosen Stufe von Google findest du unter ai.google.dev/gemini-api/docs/pricing; die Zahlen auf der Kunavo-Seite stammen aus dem Modellkatalog dieser Website und entsprechen den tatsächlich abgerechneten API-Beträgen.

„Gemini-Kosten“ sind eigentlich drei Dinge

OptionWofür wird bezahlt?API-Schlüssel vorhandenFür wen geeignet
Kostenlose Stufe (Google AI Studio)$0, mit RatenlimitsJa (eingeschränkt)Ausprobieren, Lernen, kleine persönliche Tools
Google-AI-Abonnement (Pro / Ultra der Gemini-App)Feste MonatsgebührNeinNur in der Gemini-App verwenden, ohne Programmierung
API mit nutzungsabhängiger AbrechnungNach Token, ohne MonatsgebührJaIn Produkte integrieren, Batch-Verarbeitung, Kostenkontrolle

Das häufigste Missverständnis betrifft die mittlere Zeile: Ein Google-AI-Pro-Abonnement erhöht das API-Kontingent nicht. Die Monatsgebühr der App und die Entwickler-API werden getrennt abgerechnet. Für Aufrufe aus Code musst du weiterhin die kostenlose Stufe oder die Token-Abrechnung verwenden. Wenn du dagegen nur in der Gemini-App chattest und nicht programmierst, reicht die kostenlose Version oder ein Abonnement; eine API brauchst du nicht.

Ist die Gemini API kostenlos? Was kann die kostenlose Stufe?

Es gibt eine kostenlose Stufe, die tatsächlich $0 kostet: Erstelle in Google AI Studio einen Schlüssel und führe Aufrufe innerhalb des Ratenlimits kostenlos aus – ideal zum Testen von Modellen und für Prototypen. Die konkreten Limits passt Google nach eigenem Ermessen an; diese Seite nennt keine veraltenden Zahlen. Siehe Googles Preisseite und die Dokumentation zu Ratenlimits.

Die Grenze ist ebenfalls klar: Ratenlimits reichen für produktiven Traffic nicht aus und können sich jederzeit ändern. Deshalb musst du für den Produktiveinsatz bezahlen. Kunavo bietet kein kostenloses Kontingent, dafür auch keine Monatsgebühr – Prepaid-Guthaben ab $10, Abrechnung nach Verbrauch, $0 in Monaten ohne Aufrufe.

Gemini-API-Preise – je Modell pro 1M Token

ModellKunavo EingabeKunavo AusgabeGoogle offiziell (Eingabe / Ausgabe)Vergleich mit Googles aktuellem Preis
Gemini 3.8 Flash$0.525$2.625Aktionspreis $0.75 / $3.75 (ab 2027 $1.50 / $7.50)etwa 30% günstiger als der Google-Aktionspreis
Gemini 3.7 Flash$0.525$2.625Aktionspreis $0.75 / $3.75 (ab 2027 $1.50 / $7.50)etwa 30% günstiger als der Google-Aktionspreis
Gemini 3.6 Flash$1.05$5.25Aktionspreis $0.75 / $3.75 (ab 2027 $1.50 / $7.50)etwa 40% teurer als der Google-Aktionspreis
Gemini 3.1 Pro$0.70$4.20$2.00 / $12.00Etwa 65 % günstiger
Gemini 2.5 Flash$0.09$0.75$0.30 / $2.50Etwa 70 % günstiger

Die drei 3.x-Flash-Zeilen vergleichen den heute tatsächlich von Google berechneten Aktionspreis, nicht den Standardpreis von 2027. Beim Vergleich mit dem Standardpreis würden die Zahlen besser aussehen, aber das ist nicht der Preis, den du derzeit an Google zahlst. Für Gemini 3.1 Pro gilt zusätzlich: Wenn der Prompt einer einzelnen Anfrage mehr als 200K Token enthält, wird die gesamte Anfrage mit dem zweifachen Eingabe- und 1,5-fachen Ausgabepreis berechnet. Die Spezifikationen der Modelle stehen auf den Seiten Gemini 3.8 Flash, Gemini 3.1 Pro und Gemini 2.5 Flash; alle Preise findest du auf der Preisseite.

Preis für Gemini 3.8 Flash – tatsächliche Kosten einer Anfrage

Eine Preistabelle ist weniger anschaulich als eine konkrete Anfrage. Die folgenden Werte wurden vollständig aus den Tarifen der obigen Tabelle berechnet:

VerwendungToken (Eingabe / Ausgabe)3.8 Flash (Kunavo)3.8 Flash (Google-Aktionspreis)2.5 Flash3.1 Pro
Eine Chat-Runde1,000 / 300$0.0013$0.0019$0.00031$0.002
Eine RAG-Antwort8,000 / 500$0.0055$0.0079$0.0011$0.0077
Eine Analyse eines langen Dokuments20,000 / 2,000$0.016$0.022$0.0033$0.022
Klassifizierung von 100.000 Dokumenten500 / 20 × 100,000$31.50$45.00$6.00$43.40

Ein Faktor, der die Rechnung erhöhen kann: Reasoning-Token. Gemini 3.x Flash und 3.1 Pro „denken“ zuerst und antworten dann. Reasoning-Token erscheinen nicht im Antwortinhalt, werden aber zum Ausgabepreis berechnet. In der obigen Tabelle sind sie nicht enthalten, daher können die tatsächlichen Kosten schwieriger Aufgaben höher sein – maßgeblich ist die Zahl der usage Ausgabe-Token in der Antwort. Berechne es mit deinen eigenen Zahlen:

gemini_cost.py
# Gemini API 的費用,直接用實際 token 數算。
# 費率為每 1M token USD:(input, output)
RATES = {
    "gemini-3-8-flash": (0.525, 2.625),
    "gemini-3-1-pro":   (0.70, 4.20),
    "gemini-2-5-flash": (0.09, 0.75),
}

def cost(model, inp, out):
    i, o = RATES[model]
    return inp / 1e6 * i + out / 1e6 * o  # 思考 token 按輸出費率計

print(cost("gemini-3-8-flash", 8_000, 500))         # RAG 回答一次
print(cost("gemini-2-5-flash", 500, 20) * 100_000)  # 10 萬筆分類

Gemini mit dem vorhandenen OpenAI-SDK aufrufen

Kunavo ist ein OpenAI-kompatibler Endpunkt: Ändere base_url und den Schlüssel und trage bei model die Gemini-Modellbezeichnung ein; ein Google-Cloud-Projekt oder Abrechnungskonto ist nicht erforderlich. Mit demselben Schlüssel kannst du auch Claude-, GPT-, Bild- und Videomodelle aufrufen.

gemini_kunavo.py
from openai import OpenAI

client = OpenAI(
    api_key="sk-kn-...",
    base_url="https://api.kunavo.com/v1",  # 只改這一行
)

resp = client.chat.completions.create(
    model="gemini-3-8-flash",
    messages=[{"role": "user", "content": "用三句話說明什麼是 token"}],
)
print(resp.choices[0].message.content)
print(resp.usage)  # 這次請求計費用的 token 數

Die vollständigen Schritte findest du unter Schnellstart. Wenn du einen Schlüssel direkt bei Google beantragen möchtest, siehe So erhältst du einen Gemini-API-Schlüssel (Englisch).

Ehrlich gesagt: Wann du besser direkt Google kontaktierst

  • Wenn du ein garantiertes Kontingent oder eine SLA benötigst. Das Gateway verwendet gemeinsam genutzte Kapazität ohne dediziertes Kontingent und ohne vertraglich garantierte SLA. Wenn du diese Anforderungen erreichst, beantrage sie direkt bei Google.
  • Wenn du ausschließlich Gemini 3.6 Flash verwenden kannst. Während der Aktion berechnet Google bei direkter Nutzung weniger als Kunavo.
  • Wenn du nur in der App chattest. Ohne Programmierung reichen die kostenlose Version oder ein Google-AI-Abonnement; die API brauchst du nicht.

Wenn du dagegen einen Schlüssel für Gemini, Claude und GPT gleichzeitig verwenden, kein Google-Cloud-Abrechnungskonto eröffnen oder die Kosten mit Prepaid-Guthaben begrenzen möchtest, ist dieser Weg geeignet.

Zahlungen in Taiwan

Direkt an Google zahlen: In Google Cloud müssen Sie die Abrechnung für das Projekt aktivieren und eine internationale Kreditkarte hinterlegen. Kunavo-Guthaben läuft über Stripe und unterstützt Karten einschließlich JCB (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay und Google Pay. Es gilt das Vorauszahlungsprinzip, mit einer Mindestaufladung von $10; das Guthaben verfällt nicht und fehlgeschlagene Requests werden nicht berechnet. Für eine einzelne Aufladung ab $100 gibt es einen zusätzlichen Bonus ($100 werden als $110 gutgeschrieben).

In Taiwan gibt es keine lokalen Zahlungswege – JKO Pay und LINE Pay stehen nicht auf der Liste der verfügbaren Methoden; internationale Karten sind der einzige Weg. Details zur Abrechnung findest du in der Abrechnungsdokumentation.

Gemini-Kosten senken

  1. Wähle zunächst das richtige Modell. Wenn du die 3.x-Generation brauchst, verwende 3.8 oder 3.7 Flash: Beide sind neuer und günstiger als 3.6. Einfache Aufgaben in großen Mengen, etwa Klassifizierung und Extraktion, gehören zu 2.5 Flash.
  2. Lass das Modell kürzer schreiben. Ausgaben sind teurer als Eingaben. Gib im Prompt Ausgabeformat und -länge vor; das wirkt am direktesten.
  3. Übermittle weniger Kontext. RAG sollte wenige, präzise Ausschnitte abrufen, statt die gesamte Wissensdatenbank zu senden – jede Übermittlung wird vollständig als Eingabe berechnet.
  4. Halte Prompts für 3.1 Pro unter 200K Token. Darüber wird die gesamte Anfrage mit dem zweifachen Eingabe- und 1,5-fachen Ausgabepreis berechnet.

Die Schreibweise für Routing steht im Leitfaden zur KI-Kostenoptimierung (Englisch). Wenn du andere Anbieter mit demselben Verfahren vergleichen möchtest, lies OpenAI-API-Kosten und Claude-Kosten.

Häufig gestellte Fragen

Wie viel kostet die Gemini API?

Die Gemini API wird nach Token abgerechnet, hat keine Monatsgebühr und verwendet getrennte Preise für Eingaben und Ausgaben. Mit Stand vom 5. Oktober 2026 betragen die Kunavo-Tarife pro 1M Token für Gemini 3.8 Flash $0.525 Eingabe / $2.625 Ausgabe, für Gemini 3.1 Pro $0.70 / $4.20 und für Gemini 2.5 Flash $0.09 / $0.75. Google berechnet für 3.x Flash derzeit einen zeitlich begrenzten Aktionspreis von $0.75 / $3.75 (bis 31. Dezember 2026, ab 2027 $1.50 / $7.50). Google AI Studio bietet außerdem eine kostenlose Stufe mit Ratenlimits zum Ausprobieren.

Kann man die Gemini API kostenlos nutzen?

Zum Ausprobieren ja, für den Produktiveinsatz ist sie jedoch nicht geeignet. Google AI Studio bietet eine kostenlose Stufe mit Ratenlimits; Aufrufe innerhalb des Limits kosten $0. Die konkreten Limits legt Google fest und kann sie ändern; maßgeblich ist die Google-Preisseite für die Gemini API. Für produktiven Traffic ist eine Zahlung erforderlich: entweder direkt an Google oder über ein Gateway mit Token-Abrechnung. Kunavo bietet kein kostenloses Kontingent, aber auch keine Monatsgebühr – das Prepaid-Guthaben beginnt bei $10 und wird nach Verbrauch belastet; Monate ohne Aufrufe kosten $0.

Wie viel kostet Gemini 3.8 Flash?

Mit Stand vom 5. Oktober 2026 kostet bei Kunavo Gemini 3.8 Flash pro 1M Token $0.525 Eingabe / $2.625 Ausgabe. Google berechnet derzeit für 3.x Flash den zeitlich begrenzten Aktionspreis $0.75 / $3.75 bis zum 31. Dezember 2026; der Preis bei Kunavo ist etwa 30% günstiger als der Google-Aktionspreis. Ab dem 1. Januar 2027 kehrt Google zum Standardpreis von $1.50 / $7.50 zurück. Eine RAG-Antwort mit 8.000 Eingabe- und 500 Ausgabe-Token kostet bei Kunavo ungefähr $0.0055.

Lohnt sich Gemini 3.6 Flash noch?

Es wird nicht empfohlen, dieses Modell wegen des Preises zu wählen. Kunavos Gemini 3.6 Flash kostet $1.05 / $5.25, der Preis ist etwa 40% teurer als der Google-Aktionspreis; während des Aktionszeitraums ist es daher günstiger, 3.6 direkt bei Google aufzurufen. 3.7 Flash und 3.8 Flash sind beide neuer als 3.6 und bei Kunavo ebenfalls günstiger als 3.6 ($0.525 / $2.625). Wechseln Sie einfach zu einem neueren Modell, es sei denn, Ihr Programm benötigt zwingend 3.6.

Kann ich Gemini API mit einem Google-AI-Pro-Abonnement verwenden?

Nein. Die kostenpflichtigen Abonnements der Gemini-App (Google AI Pro / Ultra) und die Gemini API für Entwickler sind zwei getrennte Produkte mit getrennten Abrechnungen. Die Monatsgebühr enthält kein API-Kontingent und keinen API-Schlüssel. Für Aufrufe aus Code musst du weiterhin die kostenlose Stufe oder die Token-Abrechnung verwenden. Umgekehrt erweitert ein API-Schlüssel die Funktionen der App nicht.

Kann ich die Gemini API ohne ein Google-Cloud-Abrechnungskonto verwenden?

Ja, über ein OpenAI-kompatibles Gateway. Bei Kunavo kannst du mit demselben Schlüssel mit dem Präfix sk-kn- Gemini aufrufen, ohne ein Google-Cloud-Projekt oder Abrechnungskonto. Claude und GPT nutzen dasselbe Guthaben. Der Nachteil: Dieser Weg verwendet gemeinsam genutzte Kapazität ohne dediziertes Kontingent und ohne vertraglich garantierte SLA. Für garantierte Kontingente oder SLAs sollte ein ausreichend großes Unternehmen direkt bei Google beantragen.

Wie bezahlt man die Gemini API aus Taiwan?

Direkt an Google zahlen: In Google Cloud müssen Sie die Abrechnung für das Projekt aktivieren und eine internationale Kreditkarte hinterlegen. Kunavo verwendet Vorauszahlung über Stripe: Visa, Mastercard, American Express, JCB, UnionPay, Apple Pay und Google Pay werden unterstützt, die Mindestaufladung beträgt $10, das Guthaben verfällt nicht und fehlgeschlagene Requests werden nicht berechnet. In Taiwan gibt es keinen lokalen Zahlungsweg — Jko und LINE Pay gehören nicht zur Liste der verfügbaren Zahlungsmethoden.