Die Gemini-API wird nach Token abgerechnet und hat keine Monatsgebühr. Zum kostenlosen Ausprobieren bietet Google AI Studio eine kostenlose Stufe mit Ratenlimits. Für den Produktiveinsatz zahlst du pro 1M Token mit getrennten Preisen für Eingaben und Ausgaben. Mit Stand vom 5. Oktober 2026 kostet bei Kunavo Gemini 3.8 Flash $0.525 Eingabe / $2.625 Ausgabe. Google berechnet für 3.x Flash derzeit den zeitlich begrenzten Aktionspreis $0.75 / $3.75 (bis 31. Dezember 2026, ab 2027 wieder der Standardpreis von $1.50 / $7.50); Kunavo ist etwa 30 % günstiger als dieser Aktionspreis. Die Vorgängerversion Gemini 2.5 Flash kostet $0.09 / $0.75, Gemini 3.1 Pro $0.70 / $4.20.
Eine Ausnahme muss zuerst erwähnt werden: Gemini 3.6 Flash. Bei Kunavo kostet es $1.05 / $5.25, etwa 40% teurer als der Google-Aktionspreis – während der Aktion ist ein direkter Aufruf bei Google günstiger. 3.7 und 3.8 Flash sind beide neuer und günstiger, Wähle 3.6 daher nicht aufgrund des Preises.
Die Preise wurden am 5. Oktober 2026 überprüft. Die offiziellen Preise und Informationen zur kostenlosen Stufe von Google findest du unter ai.google.dev/gemini-api/docs/pricing; die Zahlen auf der Kunavo-Seite stammen aus dem Modellkatalog dieser Website und entsprechen den tatsächlich abgerechneten API-Beträgen.
„Gemini-Kosten“ sind eigentlich drei Dinge
| Option | Wofür wird bezahlt? | API-Schlüssel vorhanden | Für wen geeignet |
|---|---|---|---|
| Kostenlose Stufe (Google AI Studio) | $0, mit Ratenlimits | Ja (eingeschränkt) | Ausprobieren, Lernen, kleine persönliche Tools |
| Google-AI-Abonnement (Pro / Ultra der Gemini-App) | Feste Monatsgebühr | Nein | Nur in der Gemini-App verwenden, ohne Programmierung |
| API mit nutzungsabhängiger Abrechnung | Nach Token, ohne Monatsgebühr | Ja | In Produkte integrieren, Batch-Verarbeitung, Kostenkontrolle |
Das häufigste Missverständnis betrifft die mittlere Zeile: Ein Google-AI-Pro-Abonnement erhöht das API-Kontingent nicht. Die Monatsgebühr der App und die Entwickler-API werden getrennt abgerechnet. Für Aufrufe aus Code musst du weiterhin die kostenlose Stufe oder die Token-Abrechnung verwenden. Wenn du dagegen nur in der Gemini-App chattest und nicht programmierst, reicht die kostenlose Version oder ein Abonnement; eine API brauchst du nicht.
Ist die Gemini API kostenlos? Was kann die kostenlose Stufe?
Es gibt eine kostenlose Stufe, die tatsächlich $0 kostet: Erstelle in Google AI Studio einen Schlüssel und führe Aufrufe innerhalb des Ratenlimits kostenlos aus – ideal zum Testen von Modellen und für Prototypen. Die konkreten Limits passt Google nach eigenem Ermessen an; diese Seite nennt keine veraltenden Zahlen. Siehe Googles Preisseite und die Dokumentation zu Ratenlimits.
Die Grenze ist ebenfalls klar: Ratenlimits reichen für produktiven Traffic nicht aus und können sich jederzeit ändern. Deshalb musst du für den Produktiveinsatz bezahlen. Kunavo bietet kein kostenloses Kontingent, dafür auch keine Monatsgebühr – Prepaid-Guthaben ab $10, Abrechnung nach Verbrauch, $0 in Monaten ohne Aufrufe.
Gemini-API-Preise – je Modell pro 1M Token
| Modell | Kunavo Eingabe | Kunavo Ausgabe | Google offiziell (Eingabe / Ausgabe) | Vergleich mit Googles aktuellem Preis |
|---|---|---|---|---|
| Gemini 3.8 Flash | $0.525 | $2.625 | Aktionspreis $0.75 / $3.75 (ab 2027 $1.50 / $7.50) | etwa 30% günstiger als der Google-Aktionspreis |
| Gemini 3.7 Flash | $0.525 | $2.625 | Aktionspreis $0.75 / $3.75 (ab 2027 $1.50 / $7.50) | etwa 30% günstiger als der Google-Aktionspreis |
| Gemini 3.6 Flash | $1.05 | $5.25 | Aktionspreis $0.75 / $3.75 (ab 2027 $1.50 / $7.50) | etwa 40% teurer als der Google-Aktionspreis |
| Gemini 3.1 Pro | $0.70 | $4.20 | $2.00 / $12.00 | Etwa 65 % günstiger |
| Gemini 2.5 Flash | $0.09 | $0.75 | $0.30 / $2.50 | Etwa 70 % günstiger |
Die drei 3.x-Flash-Zeilen vergleichen den heute tatsächlich von Google berechneten Aktionspreis, nicht den Standardpreis von 2027. Beim Vergleich mit dem Standardpreis würden die Zahlen besser aussehen, aber das ist nicht der Preis, den du derzeit an Google zahlst. Für Gemini 3.1 Pro gilt zusätzlich: Wenn der Prompt einer einzelnen Anfrage mehr als 200K Token enthält, wird die gesamte Anfrage mit dem zweifachen Eingabe- und 1,5-fachen Ausgabepreis berechnet. Die Spezifikationen der Modelle stehen auf den Seiten Gemini 3.8 Flash, Gemini 3.1 Pro und Gemini 2.5 Flash; alle Preise findest du auf der Preisseite.
Preis für Gemini 3.8 Flash – tatsächliche Kosten einer Anfrage
Eine Preistabelle ist weniger anschaulich als eine konkrete Anfrage. Die folgenden Werte wurden vollständig aus den Tarifen der obigen Tabelle berechnet:
| Verwendung | Token (Eingabe / Ausgabe) | 3.8 Flash (Kunavo) | 3.8 Flash (Google-Aktionspreis) | 2.5 Flash | 3.1 Pro |
|---|---|---|---|---|---|
| Eine Chat-Runde | 1,000 / 300 | $0.0013 | $0.0019 | $0.00031 | $0.002 |
| Eine RAG-Antwort | 8,000 / 500 | $0.0055 | $0.0079 | $0.0011 | $0.0077 |
| Eine Analyse eines langen Dokuments | 20,000 / 2,000 | $0.016 | $0.022 | $0.0033 | $0.022 |
| Klassifizierung von 100.000 Dokumenten | 500 / 20 × 100,000 | $31.50 | $45.00 | $6.00 | $43.40 |
Ein Faktor, der die Rechnung erhöhen kann: Reasoning-Token. Gemini 3.x Flash und 3.1 Pro „denken“ zuerst und antworten dann. Reasoning-Token erscheinen nicht im Antwortinhalt, werden aber zum Ausgabepreis berechnet. In der obigen Tabelle sind sie nicht enthalten, daher können die tatsächlichen Kosten schwieriger Aufgaben höher sein – maßgeblich ist die Zahl der usage Ausgabe-Token in der Antwort. Berechne es mit deinen eigenen Zahlen:
# Gemini API 的費用,直接用實際 token 數算。
# 費率為每 1M token USD:(input, output)
RATES = {
"gemini-3-8-flash": (0.525, 2.625),
"gemini-3-1-pro": (0.70, 4.20),
"gemini-2-5-flash": (0.09, 0.75),
}
def cost(model, inp, out):
i, o = RATES[model]
return inp / 1e6 * i + out / 1e6 * o # 思考 token 按輸出費率計
print(cost("gemini-3-8-flash", 8_000, 500)) # RAG 回答一次
print(cost("gemini-2-5-flash", 500, 20) * 100_000) # 10 萬筆分類Gemini mit dem vorhandenen OpenAI-SDK aufrufen
Kunavo ist ein OpenAI-kompatibler Endpunkt: Ändere base_url und den Schlüssel und trage bei model die Gemini-Modellbezeichnung ein; ein Google-Cloud-Projekt oder Abrechnungskonto ist nicht erforderlich. Mit demselben Schlüssel kannst du auch Claude-, GPT-, Bild- und Videomodelle aufrufen.
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1", # 只改這一行
)
resp = client.chat.completions.create(
model="gemini-3-8-flash",
messages=[{"role": "user", "content": "用三句話說明什麼是 token"}],
)
print(resp.choices[0].message.content)
print(resp.usage) # 這次請求計費用的 token 數Die vollständigen Schritte findest du unter Schnellstart. Wenn du einen Schlüssel direkt bei Google beantragen möchtest, siehe So erhältst du einen Gemini-API-Schlüssel (Englisch).
Ehrlich gesagt: Wann du besser direkt Google kontaktierst
- Wenn du ein garantiertes Kontingent oder eine SLA benötigst. Das Gateway verwendet gemeinsam genutzte Kapazität ohne dediziertes Kontingent und ohne vertraglich garantierte SLA. Wenn du diese Anforderungen erreichst, beantrage sie direkt bei Google.
- Wenn du ausschließlich Gemini 3.6 Flash verwenden kannst. Während der Aktion berechnet Google bei direkter Nutzung weniger als Kunavo.
- Wenn du nur in der App chattest. Ohne Programmierung reichen die kostenlose Version oder ein Google-AI-Abonnement; die API brauchst du nicht.
Wenn du dagegen einen Schlüssel für Gemini, Claude und GPT gleichzeitig verwenden, kein Google-Cloud-Abrechnungskonto eröffnen oder die Kosten mit Prepaid-Guthaben begrenzen möchtest, ist dieser Weg geeignet.
Zahlungen in Taiwan
Direkt an Google zahlen: In Google Cloud müssen Sie die Abrechnung für das Projekt aktivieren und eine internationale Kreditkarte hinterlegen. Kunavo-Guthaben läuft über Stripe und unterstützt Karten einschließlich JCB (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay und Google Pay. Es gilt das Vorauszahlungsprinzip, mit einer Mindestaufladung von $10; das Guthaben verfällt nicht und fehlgeschlagene Requests werden nicht berechnet. Für eine einzelne Aufladung ab $100 gibt es einen zusätzlichen Bonus ($100 werden als $110 gutgeschrieben).
In Taiwan gibt es keine lokalen Zahlungswege – JKO Pay und LINE Pay stehen nicht auf der Liste der verfügbaren Methoden; internationale Karten sind der einzige Weg. Details zur Abrechnung findest du in der Abrechnungsdokumentation.
Gemini-Kosten senken
- Wähle zunächst das richtige Modell. Wenn du die 3.x-Generation brauchst, verwende 3.8 oder 3.7 Flash: Beide sind neuer und günstiger als 3.6. Einfache Aufgaben in großen Mengen, etwa Klassifizierung und Extraktion, gehören zu 2.5 Flash.
- Lass das Modell kürzer schreiben. Ausgaben sind teurer als Eingaben. Gib im Prompt Ausgabeformat und -länge vor; das wirkt am direktesten.
- Übermittle weniger Kontext. RAG sollte wenige, präzise Ausschnitte abrufen, statt die gesamte Wissensdatenbank zu senden – jede Übermittlung wird vollständig als Eingabe berechnet.
- Halte Prompts für 3.1 Pro unter 200K Token. Darüber wird die gesamte Anfrage mit dem zweifachen Eingabe- und 1,5-fachen Ausgabepreis berechnet.
Die Schreibweise für Routing steht im Leitfaden zur KI-Kostenoptimierung (Englisch). Wenn du andere Anbieter mit demselben Verfahren vergleichen möchtest, lies OpenAI-API-Kosten und Claude-Kosten.
Häufig gestellte Fragen
Wie viel kostet die Gemini API?
Die Gemini API wird nach Token abgerechnet, hat keine Monatsgebühr und verwendet getrennte Preise für Eingaben und Ausgaben. Mit Stand vom 5. Oktober 2026 betragen die Kunavo-Tarife pro 1M Token für Gemini 3.8 Flash $0.525 Eingabe / $2.625 Ausgabe, für Gemini 3.1 Pro $0.70 / $4.20 und für Gemini 2.5 Flash $0.09 / $0.75. Google berechnet für 3.x Flash derzeit einen zeitlich begrenzten Aktionspreis von $0.75 / $3.75 (bis 31. Dezember 2026, ab 2027 $1.50 / $7.50). Google AI Studio bietet außerdem eine kostenlose Stufe mit Ratenlimits zum Ausprobieren.
Kann man die Gemini API kostenlos nutzen?
Zum Ausprobieren ja, für den Produktiveinsatz ist sie jedoch nicht geeignet. Google AI Studio bietet eine kostenlose Stufe mit Ratenlimits; Aufrufe innerhalb des Limits kosten $0. Die konkreten Limits legt Google fest und kann sie ändern; maßgeblich ist die Google-Preisseite für die Gemini API. Für produktiven Traffic ist eine Zahlung erforderlich: entweder direkt an Google oder über ein Gateway mit Token-Abrechnung. Kunavo bietet kein kostenloses Kontingent, aber auch keine Monatsgebühr – das Prepaid-Guthaben beginnt bei $10 und wird nach Verbrauch belastet; Monate ohne Aufrufe kosten $0.
Wie viel kostet Gemini 3.8 Flash?
Mit Stand vom 5. Oktober 2026 kostet bei Kunavo Gemini 3.8 Flash pro 1M Token $0.525 Eingabe / $2.625 Ausgabe. Google berechnet derzeit für 3.x Flash den zeitlich begrenzten Aktionspreis $0.75 / $3.75 bis zum 31. Dezember 2026; der Preis bei Kunavo ist etwa 30% günstiger als der Google-Aktionspreis. Ab dem 1. Januar 2027 kehrt Google zum Standardpreis von $1.50 / $7.50 zurück. Eine RAG-Antwort mit 8.000 Eingabe- und 500 Ausgabe-Token kostet bei Kunavo ungefähr $0.0055.
Lohnt sich Gemini 3.6 Flash noch?
Es wird nicht empfohlen, dieses Modell wegen des Preises zu wählen. Kunavos Gemini 3.6 Flash kostet $1.05 / $5.25, der Preis ist etwa 40% teurer als der Google-Aktionspreis; während des Aktionszeitraums ist es daher günstiger, 3.6 direkt bei Google aufzurufen. 3.7 Flash und 3.8 Flash sind beide neuer als 3.6 und bei Kunavo ebenfalls günstiger als 3.6 ($0.525 / $2.625). Wechseln Sie einfach zu einem neueren Modell, es sei denn, Ihr Programm benötigt zwingend 3.6.
Kann ich Gemini API mit einem Google-AI-Pro-Abonnement verwenden?
Nein. Die kostenpflichtigen Abonnements der Gemini-App (Google AI Pro / Ultra) und die Gemini API für Entwickler sind zwei getrennte Produkte mit getrennten Abrechnungen. Die Monatsgebühr enthält kein API-Kontingent und keinen API-Schlüssel. Für Aufrufe aus Code musst du weiterhin die kostenlose Stufe oder die Token-Abrechnung verwenden. Umgekehrt erweitert ein API-Schlüssel die Funktionen der App nicht.
Kann ich die Gemini API ohne ein Google-Cloud-Abrechnungskonto verwenden?
Ja, über ein OpenAI-kompatibles Gateway. Bei Kunavo kannst du mit demselben Schlüssel mit dem Präfix sk-kn- Gemini aufrufen, ohne ein Google-Cloud-Projekt oder Abrechnungskonto. Claude und GPT nutzen dasselbe Guthaben. Der Nachteil: Dieser Weg verwendet gemeinsam genutzte Kapazität ohne dediziertes Kontingent und ohne vertraglich garantierte SLA. Für garantierte Kontingente oder SLAs sollte ein ausreichend großes Unternehmen direkt bei Google beantragen.
Wie bezahlt man die Gemini API aus Taiwan?
Direkt an Google zahlen: In Google Cloud müssen Sie die Abrechnung für das Projekt aktivieren und eine internationale Kreditkarte hinterlegen. Kunavo verwendet Vorauszahlung über Stripe: Visa, Mastercard, American Express, JCB, UnionPay, Apple Pay und Google Pay werden unterstützt, die Mindestaufladung beträgt $10, das Guthaben verfällt nicht und fehlgeschlagene Requests werden nicht berechnet. In Taiwan gibt es keinen lokalen Zahlungsweg — Jko und LINE Pay gehören nicht zur Liste der verfügbaren Zahlungsmethoden.