Für Gemini gibt es drei Preisoptionen. Kostenlose Stufe (kostenlose API-Stufe von Google AI Studio, mit Ratenbegrenzungen und nicht für den Produktionseinsatz geeignet), Googles Abonnement (kostenpflichtiger Tarif der Gemini-App, fester Monatsbetrag ohne API-Schlüssel) und nutzungsabhängige API-Abrechnung (pro Token, ohne Monatsgebühr, $0 ohne Aufrufe). Diese drei Optionen sind getrennte Produkte; der Abschluss einer Option gewährt keinen Zugriff auf eine andere.
Entwickler suchen meistens nach der dritten Option. Kunavo bietet diese API etwa 70% günstiger als Googles Listenpreis an. Diese Seite behandelt die aktuellen Tarife nach Modell, nachvollziehbare Rechenbeispiele und die günstigste Art, Gemini in der Produktion aufzurufen.
Die drei Preisoptionen unterscheiden
| Weg | Wofür bezahlt wird | Ist ein API-Schlüssel enthalten? |
|---|---|---|
| Kostenlose Stufe (Google AI Studio) | $0, mit Ratenbegrenzungen | Ja (mit Einschränkungen) |
| Abonnement (kostenpflichtiger Tarif der Gemini-App) | Feste Monatsgebühr | Nein |
| Nutzungsabhängige API-Abrechnung | Pro Token, ohne Monatsgebühr | Ja |
Das häufigste Missverständnis betrifft die mittlere Zeile. Auch wenn Sie den kostenpflichtigen Tarif der Gemini-App bezahlen, erhöht sich Ihr API-Nutzungskontingent nicht. Das Monatsabonnement der App und die API für Entwickler werden getrennt abgerechnet; für Aufrufe aus Code benötigen Sie in jedem Fall einen Schlüssel und nutzungsabhängige Abrechnung oder die kostenlose Stufe. Da sich die konkreten Ratenbegrenzungen der kostenlosen Stufe nach Googles Maßgabe häufig ändern, prüfen Sie die Zahlen in der offiziellen Google-Dokumentation. Wir behandeln sie hier nicht – für den Produktionseinsatz scheidet die kostenlose Stufe ohnehin aus.
Gemini-Preisübersicht
Die Tarife gelten pro 1 Mio. Tokens, in USD, und entsprechen den bei Kunavo berechneten Beträgen. Die Spalte „Googles Listenpreis“ enthält die veröffentlichten Preise von Google für dasselbe Modell und wird zum Vergleich angezeigt.
| Modelle | Eingabe / 1 Mio. | Ausgabe / 1 Mio. | Googles Listenpreis (Eingabe / Ausgabe) | Ersparnis |
|---|---|---|---|---|
gemini-2-5-flash | $0.09 | $0.75 | $0.30 / $2.50 | Etwa 70% |
gemini-3-1-pro | $0.70 | $4.20 | $2.00 / $12.00 | Etwa 65% |
Flash ist die zentrale Wahl für große Verarbeitungsmengen; Pro ist für anspruchsvollere Schlussfolgerungen, Bilderkennung und Aufgaben mit langem Kontext gedacht. Die aktuellen Tarife werden immer auf der Preisseite und den jeweiligen Modellseiten (gemini-2-5-flash, gemini-3-1-pro) angezeigt.
So funktioniert die Tokenabrechnung bei Gemini
Abgerechnet werden Eingabetokens (alles, was Sie senden – System-Prompt, abgerufener Kontext und Benutzernachricht) und Ausgabetokens (das vom Modell Generierte). Da Ausgaben teurer sind, ist der größte Hebel für die Gemini-Rechnung, wie viel Sie das Modell schreiben lassen. Bilder und Audio werden in Tokens umgerechnet und über denselben Zähler abgerechnet.
Rechenbeispiele
Dies sind konkrete Werte anhand der Tarife von Kunavo für Gemini 2.5 Flash. Nur in der letzten Zeile wird Gemini 3.1 Pro verwendet.
| Workload | Tokens (Eingabe / Ausgabe) | Modelle | Kosten |
|---|---|---|---|
| Eine Chatbot-Runde | 1,000 / 300 | Flash | $0.0003 |
| RAG-Antwort | 8,000 / 500 | Flash | $0.0011 |
| Batch-Klassifizierung (pro Dokument) | 500 / 20 | Flash | $0.00006 |
| Analyse mit langem Kontext | 20,000 / 2,000 | Pro | $0.0224 |
Bei diesen Tarifen kostet ein Klassifizierungs-Batch mit 100.000 Dokumenten in Flash ungefähr $6; 1 Million Chatbot-Unterhaltungen kosten ungefähr $315. Die Berechnung kann unverändert ausgeführt werden.
# Kunavo の Gemini 2.5 Flash 料率(1M トークンあたり、USD)
IN_RATE, OUT_RATE = 0.09, 0.75
def cost(in_tokens: int, out_tokens: int) -> float:
return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE
print(cost(1_000, 300)) # チャットボット 1 ターン -> $0.000315
print(cost(8_000, 500)) # RAG の回答 1 件 -> $0.001095
print(cost(500, 20) * 100_000) # 10 万件のバッチ処理 -> 約 $6.00Kunavo-Preise und Stripe-Zahlungen
Sie benötigen weder ein Abonnement noch ein Google-Cloud-Projekt. Laden Sie Guthaben auf (über Stripe oder eine lokale Zahlungsmethode); bei jedem Aufruf wird der Betrag anhand der oben genannten Tokenpreise vom Guthaben abgezogen. Die nutzungsabhängige Abrechnung beginnt mit einer Mindestaufladung von $10; Guthaben verfällt nicht, und größere Aufladungen erhalten Bonusguthaben. Ein Guthaben deckt Gemini und alle anderen Modelle – Claude, GPT, Bild, Video und Audio – ab, sodass Sie keine getrennten Rechnungen verschiedener Anbieter abgleichen müssen.
Welches Gemini-Modell sollte ich wählen?
- gemini-2-5-flash – Standard für Chat, Extraktion, Klassifizierung, Zusammenfassung und die meisten RAG-Anwendungen. Schnell und die günstigste leistungsfähige Option.
- gemini-3-1-pro – Verwenden Sie dieses Modell, wenn Flash nicht präzise genug ist, etwa für mehrstufige Schlussfolgerungen, Code, Bilderkennung oder extrem lange Kontexte.
Eine gute Strategie ist das Routing nach Schwierigkeitsgrad. Häufige Fälle werden mit Flash verarbeitet; nur wenn die Prüfung fehlschlägt, wird zu Pro eskaliert. Ein Routing-Muster mit Code steht im Leitfaden zur Optimierung der KI-Kosten.
Die Gemini-Rechnung senken
- Auf eine niedrigere Stufe wechseln. Senden Sie die einfachen 80% an Flash und reservieren Sie Pro für die schwierigen 20%.
- Die Ausgabe begrenzen. Setzen Sie
max_tokensund Stoppsequenzen – Ausgaben werden auf der teureren Seite des Zählers abgerechnet. - Die Eingabe begrenzen. Rufen Sie einige hochwertige RAG-Chunks ab, statt die gesamte Wissensbasis in den Kontext zu packen.
- Batches bilden. Bündeln Sie unabhängige Aufrufe, halten Sie die Latenz niedrig und vermeiden Sie eine Flut von Wiederholungsversuchen.
Auch Googles Bild- und Videomodelle können mit demselben Schlüssel aufgerufen werden. Die Preise pro Bild bzw. Video finden Sie unter Preise für Nano Banana Pro und Preise für Veo 3.
Häufig gestellte Fragen
Wie viel kostet Gemini?
Für Gemini gibt es drei Preisoptionen: die kostenlose Stufe von Google AI Studio ($0, mit Ratenbegrenzungen), das kostenpflichtige Abonnement der Gemini-App (fester Monatsbetrag, ohne API-Schlüssel) und die nutzungsabhängige API-Abrechnung (pro Token, ohne Monatsgebühr). Wenn Sie die API aus Code aufrufen, ist die dritte Option relevant. Bei Kunavo kostet Gemini 2.5 Flash pro 1 Mio. Tokens für Eingaben $0.09 und für Ausgaben $0.75; gemini-3-1-pro kostet $0.70 für Eingaben und $4.20 für Ausgaben – jeweils etwa 70% bzw. 65% weniger als Googles Listenpreis.
Wie viel kostet Gemini Pro?
gemini-3-1-pro kostet bei Kunavo pro 1 Mio. Tokens $0.70 für Eingaben und $4.20 für Ausgaben; gegenüber Googles Listenpreis von $2.00 bzw. $12.00 ist das etwa 65% günstiger. Eine Anfrage mit 20.000 Eingabe- und 2.000 Ausgabetokens kostet ungefähr $0.0224. Pro ist für anspruchsvolle Schlussfolgerungen, Bilderkennung und Aufgaben mit langem Kontext gedacht; bei großen Verarbeitungsmengen ist es um Größenordnungen günstiger, auf die Flash-Stufe zu wechseln.
Kann man Gemini kostenlos nutzen?
Google AI Studio bietet eine kostenlose Stufe für die Gemini API an, sodass Aufrufe innerhalb der Ratenbegrenzungen $0 kosten. Für Prototypen reicht das aus, aber die Ratenbegrenzungen können sich nach Googles Maßgabe ändern und reichen für Produktionsverkehr nicht aus. Wenn Sie die Nutzung in der Produktion planen, scheidet diese Option daher aus. Bei Kunavo gibt es keinen kostenlosen Tarif, dafür aber auch keine Monatsgebühr: Die tatsächliche Nutzung wird vom vorausbezahlten Guthaben abgezogen, und in einem Monat ohne Aufrufe beträgt der Preis $0.
Kann ich die API nutzen, wenn ich einen kostenpflichtigen Tarif der Gemini-App abonniere?
Nein. Das kostenpflichtige Abonnement der Gemini-App und die Gemini API für Entwickler sind getrennte Produkte mit getrennten Abrechnungen. Die Monatsgebühr enthält kein API-Nutzungskontingent und keinen API-Schlüssel. Für Aufrufe aus Code benötigen Sie zusätzlich einen Schlüssel und nutzungsabhängige Abrechnung oder die kostenlose Stufe. Umgekehrt erweitert ein API-Schlüssel die Funktionen der App nicht.
Wie viel kostet Gemini 2.5 Flash?
Bei Kunavo kostet Gemini 2.5 Flash pro 1 Mio. Eingabetokens $0.09 und pro 1 Mio. Ausgabetokens $0.75 – etwa 70% weniger als Googles Listenpreis von $0.30 bzw. $2.50. Eine typische Chatbot-Runde mit 1K Eingabe- und 300 Ausgabetokens kostet ungefähr $0.0003.
Ist Gemini günstiger als Claude oder GPT?
Gemini 2.5 Flash gehört im Vergleich zu jedem anderen Modell zur günstigsten Klasse leistungsfähiger Modelle – bei großen Verarbeitungsmengen liegt es unter Claude Haiku und den meisten GPT-Stufen. Die vollständige Vergleichstabelle finden Sie auf der Preisseite.
Wie kann ich die Kosten der Gemini API senken?
Wechseln Sie auf die Flash-Stufe, begrenzen Sie die Ausgabe, schränken Sie den abgerufenen Kontext ein und führen Sie Aufrufe als Batch aus. Einzelheiten finden Sie im Leitfaden zur Kostenoptimierung. Informationen zum Start mit Gemini-Aufrufen finden Sie unter So erhalten Sie einen Gemini-API-Schlüssel.