Das Kontingent der Gemini CLI stammt nun aus einer kostenpflichtigen Beziehung: einer Gemini-Code-Assist-Lizenz, die Google auf 1.500 Anfragen pro Nutzer und Tag im Standard-Tarif bzw. 2.000 im Enterprise-Tarif begrenzt, oder einem nutzungsabhängig abgerechneten Schlüssel – einem Gemini-API-Schlüssel oder einem Gemini-Enterprise-Agent-Platform-Schlüssel –, für den Googles Seite zu Ratenlimits überhaupt keine tägliche Anfragezahl veröffentlicht, sondern nur modellbezogene Limits, die Sie in AI Studio einsehen. Die Quelle, aus der die meisten Antworten weiterhin zitieren – die Anmeldung mit einem persönlichen Google-Konto im kostenlosen Tarif, Google AI Pro oder Google AI Ultra – bedient die Gemini CLI seit dem 18. Juni 2026 nicht mehr.
Genau dieses Datum macht die Frage schwieriger, als sie aussieht. Die README des Google-eigenen Repositorys, abgerufen am 21. September 2026 vom Branch main, wirbt weiterhin mit "Kostenloser Tarif: 60 Anfragen/Min. und 1.000 Anfragen/Tag mit persönlichem Google-Konto". Das ist kein Fehler, den jemand korrigiert hätte, und es ist die Zahl, die die meisten Artikel von Drittanbietern übernehmen.
Woher Ihr Kontingent der Gemini CLI heute stammt
| Authentifizierungspfad | Tägliches Kontingent | Status am 21. September 2026 |
|---|---|---|
| Mit Google anmelden – Code Assist für Einzelpersonen, Google AI Pro, Google AI Ultra | Früher 1.000 / 1.500 / 2.000 Anfragen | Bedienung seit dem 18. Juni 2026 eingestellt |
| Mit Google anmelden – Code-Assist-Standard-Lizenz | 1.500 Anfragen pro Nutzer und Tag | Verfügbar |
| Mit Google anmelden – Code-Assist-Enterprise-Lizenz | 2.000 Anfragen pro Nutzer und Tag | Verfügbar |
| Gemini-API-Schlüssel | Nutzungsabhängig abgerechnet; Googles Seite zu Ratenlimits veröffentlicht keine tägliche Anfragezahl, und modellbezogene Limits sind nur in AI Studio einsehbar | Mit einem kostenpflichtigen Schlüssel aktiv; unbezahlte Schlüssel ungeklärt (siehe unten) |
| Gemini-Enterprise-Agent-Platform-Schlüssel (ehemals Vertex AI) | Der Express-Modus gibt für die Preview-Modelle von Gemini 3.x die Anfragen pro Minute mit "Dynamic" an | Aktiv; der Express-Modus ist 90 Tage lang kostenlos, nur für neue Google-Cloud-Nutzer |
Zwei offizielle Quellen legen den Stichtag fest. Googles Ankündigung vom 19. Mai 2026: "Am 18. Juni 2026 werden Gemini CLI und die IDE-Erweiterungen von Gemini Code Assist keine Anfragen mehr für Nutzer von Google AI Pro und Ultra bedienen, ebenso wenig für diejenigen, die das Angebot kostenlos über Gemini Code Assist für Einzelpersonen nutzen." Und die Seite zur Einstellung, deren Fußzeile als Datum der letzten Aktualisierung den 02.09.2026 angibt: "Dies gilt auch für die Nutzung von Gemini CLI. Im Rahmen der Einstellung können Sie die Option ‚Login with Google‘ nicht mehr verwenden, um auf die IDE-Erweiterungen oder Gemini CLI zuzugreifen." Ihre FAQ beantwortet die Frage zu Standard/Enterprise direkt – diese Abonnements sind nicht betroffen.
Die aktuellen Zahlen stammen von Googles Kontingentseite für Code Assist (zuletzt aktualisiert am 18.09.2026), und der dort beschriebene Mechanismus ist wichtiger als die Zahlen. Die Kontingente für den Agent-Modus und die Gemini CLI sind kombiniert; eine Eingabeaufforderung kann mehrere Modellanfragen erzeugen; die Tageslimits werden "über alle Interaktionen mit jeder Modellversion oder -familie aggregiert"; und sobald das Maximum erreicht ist, können "über diese Schnittstellen keine weiteren Anfragen an irgendein Modell gestellt werden, bis das Kontingent zurückgesetzt wird". Der Wechsel zu einem kleineren Modell verschafft Ihnen auf diesem Pfad also keinen zusätzlichen Spielraum, und 1.500 bedeutet nicht 1.500 Eingabeaufforderungen. Google sagt nicht, wann diese Zurücksetzung erfolgt – die möglicherweise gelesene Regel mitternachts pazifischer Zeit ist für die Gemini API dokumentiert, nicht für den Lizenzpfad, und ihre Übertragung wäre eine Vermutung.
Eine weitere Falle auf derselben Seite: Die Zeilen mit "2 Anfragen pro Sekunde", 6.000 pro Tag und 960 pro Tag beziehen sich auf Kontingente von Gemini für Google Cloud für Codevervollständigung und Chat im Cloud-Assist-Panel. Sie sind nicht das Budget des Agent-Modus der CLI, und eine übernommene Zahl ist falsch, auch wenn beide Zahlen real sind.
Vier offizielle Google-Seiten, die Ihnen die falsche Zahl nennen
| Seite | Was dort weiterhin steht | Warum das irreführend ist |
|---|---|---|
| README des Repositorys | "Kostenloser Tarif: 60 Anfragen/Min. und 1.000 Anfragen/Tag mit persönlichem Google-Konto" | Beschreibt den Anmeldepfad, der am 18.06.2026 abgeschaltet wurde; verlinkt auf die Kontingentseite von Code Assist, die diese Aussage nicht mehr unterstützt |
| Kontingentdokumentation von geminicli.com | Eine Tabelle mit Code Assist (Individual) 1.000, Google AI Pro 1.500, Google AI Ultra 2.000 und Gemini-API-Schlüssel im kostenlosen Tarif 250 | In der eigenen Fußzeile steht "Zuletzt aktualisiert: 18. Juni 2026" – eingefroren am Tag der Umstellung |
| Tarifseite von geminicli.com | Kostenlos, Google AI Pro und Google AI Ultra als Möglichkeiten zur Ausführung der Gemini CLI dargestellt | Steht direkt unter einem Website-weiten Banner, das besagt, dass diese Nutzer von der CLI entfernt wurden |
| codeassist.google | "kostenlos", Gemini 2.5 "Gemini 3 kommt bald", 6.000 Codeanfragen täglich | Erschien vor der Gemini-3-Reihe und der Einstellung; die Zahl 6.000 gehört zu einem anderen Kontingentsystem |
geminicli.com ist keine Domain eines Domainbesetzers – es ist die vom Repository selbst deklarierte Startseite, und genau deshalb ist sie gefährlich. Verwerfen Sie sie wegen ihres veralteten Stands, nicht wegen fehlender offizieller Herkunft. Ihr Banner widerspricht derzeit dem eigenen Fließtext: "Nutzer des kostenlosen Tarifs und von Google One: Die Gemini CLI wurde am 18. Juni 2026 durch die Antigravity CLI ersetzt." Wenn Banner und Tabelle voneinander abweichen, sind das Banner und die datierte Einstellungsseite die spätere maßgebliche Aussage.
Eine Frage, die keine First-Party-Seite beantwortet. Auf dem API-Schlüssel-Pfad heißt es in Googles Blog vom 19. Mai, dass die CLI über kostenpflichtige API-Schlüssel erreichbar bleibt. Der Abschaltungsbeitrag vom 18. Juni der Maintainer ergänzt lediglich: "Enterprise-Nutzer mit Gemini-Code-Assist-Lizenzen und API-Schlüssel-Authentifizierung bleiben vollständig unbeeinträchtigt" – ein Satz, dessen Subjekt Enterprise-Nutzer sind und der daher nicht besagt, dass ein unbezahlter Schlüssel weiterhin funktioniert. Nichts, was nach dem 18. Juni datiert ist, behandelt unbezahlte Schlüssel, und die Zahl von 250 Anfragen pro Tag für unbezahlte Nutzer findet sich nur in der eingefrorenen Kontingentdokumentation. Behandeln Sie einen unbezahlten Schlüssel als ungeprüft, nicht als Budget.
Auf welchem Pfad bin ich, und wie sieht das Limit aus?
Bevor Sie etwas ändern, bestätigen Sie die Abrechnungsbeziehung. Die Gemini CLI dokumentiert /auth als "einen Dialog, in dem Sie die Authentifizierungsmethode ändern können", und /stats model als Anzeige von "modellspezifischen Nutzungsstatistiken einschließlich Tokenanzahlen und Kontingentinformationen"; die Kontingentdokumentation ergänzt, dass beim Beenden am Ende einer Sitzung ebenfalls eine Nutzungsübersicht erscheint. Beides ist dokumentiertes Verhalten, das am 21. September 2026 gelesen wurde, kein hier getestetes Verhalten.
Zwei verschiedene Fehler führen zu ähnlich aussehenden Unterbrechungen und erfordern unterschiedliche Maßnahmen. Das Erreichen eines Kontingents wird dokumentiert als Angebot einer ausdrücklich benannten Auswahl: "Wenn Sie dieses Limit erreichen, erhalten Sie die Möglichkeit, zu Gemini 2.5 Pro zu wechseln, für höhere Limits ein Upgrade durchzuführen oder anzuhalten. Außerdem wird Ihnen mitgeteilt, wann Ihr Nutzungslimit zurückgesetzt wird"; zusätzlich erscheint eine Aufforderung, auf Gemini 2.5 Flash zurückzufallen, wenn das Limit von Gemini 2.5 Pro erreicht ist. Ein Kapazitätsfehler bedeutet dagegen eine Überlastung des Modells: Laut Dokumentation fragt die CLI, ob Sie Gemini 3 Pro weiter versuchen oder auf Gemini 2.5 Pro zurückfallen möchten, wobei "Weiter versuchen" ein exponentielles Backoff verwendet. Warten behebt den zweiten Fall; nur eine Zurücksetzung, eine Lizenz oder ein anderer Abrechnungspfad behebt den ersten.
Es gibt außerdem einen Fallback, der ohne Nachfrage erfolgt. Laut Dokumentation wechselt die CLI, wenn sie eine Ratenbegrenzung beim standardmäßigen "pro"-Modell erkennt, "automatisch für die aktuelle Sitzung zum 'flash'-Modell"; interne Dienstprogrammanfragen mit gemini-2.5-flash-lite "fallen stillschweigend" auf andere Modelle zurück, wenn das Kontingent erschöpft ist, ohne das konfigurierte Modell zu ändern. Bei einem nutzungsabhängig abgerechneten Schlüssel ist das sowohl für die Rechnung als auch für die Ausgabe relevant: Das Modell, das geantwortet hat, ist nicht immer das Modell, das Sie ausgewählt haben.
Die vier Maßnahmen am Limit und was jede kostet
| Position | Veröffentlichter Preis | Quelle, geprüft am 21. September 2026 |
|---|---|---|
| Code Assist Standard, monatliche Bindung | $22.80 pro Lizenz / Monat | Google-Cloud-Preise (auch als $0.031232877 / Stunde aufgeführt) |
| Code Assist Standard, 12-monatige Bindung | $19.00 pro Lizenz / Monat | Dieselbe Tabelle; alle Abonnements werden monatlich abgerechnet |
| Code Assist Enterprise, monatliche Bindung | $54.00 pro Lizenz / Monat | Die Edition, deren Funktionsaufzählung erhöhte tägliche Limits für die Gemini CLI nennt |
| Code Assist Enterprise, 12-monatige Bindung | $45.00 pro Lizenz / Monat | Dieselbe Tabelle |
| Gemini API, gemini-3.1-pro-preview | $2.00 Eingabe / $12.00 Ausgabe pro 1M (Eingabeaufforderungen ≤200k); kostenloser Tarif "Nicht verfügbar" | Gemini-API-Preise, Seite zuletzt aktualisiert am 16.09.2026 |
| Gemini API, gemini-3.8-flash | $0.75 Eingabe / $3.75 Ausgabe bis zum 31. Dezember 2026; $1.50 / $7.50 ab dem 1. Januar 2027 | Dieselbe Seite; dieselbe datierte Stufe gilt für 3.7 und 3.6 Flash |
| Gemini API, gemini-3.5-flash | $1.50 Eingabe / $9.00 Ausgabe pro 1M, pauschal | Dieselbe Seite – hierfür gibt es keinen Einführungsrabatt |
| Gemini API, gemini-2.5-pro / gemini-2.5-flash | $1.25 / $10.00 (Eingabeaufforderungen ≤200k) und $0.30 / $2.50 pro 1M | Dieselbe Seite; dies sind die dokumentierten Fallback-Modelle der CLI |
Die Überschrift der Google-Cloud-Preistabelle selbst lautet "Gemini license type / License fees (monthly commitment) / License fees (12-month commitment)" und druckt neben dem Betrag nicht die Wörter "per user" – das Kontingent gilt ausdrücklich pro Nutzer und Tag, lesen Sie die Gebühr daher als pro Lizenz, bis Sie die Sitzplatzbedingungen in Ihrer eigenen Bestellung bestätigt haben.
Maßnahme eins: warten. Kostenlos und richtig, wenn die Unterbrechung durch einen Kapazitätsfehler statt durch ein erreichtes Kontingent verursacht wird. Maßnahme zwei: eine Lizenz kaufen. Dies ist die einzige Maßnahme, die das tägliche Anfragekontingent auf dem Anmeldepfad erhöht, und sie ist die von Google für die Gemini CLI dokumentierte Maßnahme. Maßnahme drei: zu einem nutzungsabhängig abgerechneten Schlüssel wechseln. Dadurch entfällt die tägliche Anfrageobergrenze und wird durch eine Abrechnung pro Token plus Ausgabenlimit ersetzt: Googles Seite zu Ratenlimits veröffentlicht ausgabenbasierte Limits von $10, $50 und $200 pro rollierende zehn Minuten für die Stufen 1 bis 3; bei Überschreitung wird 429 RESOURCE_EXHAUSTED zurückgegeben, und es wird darauf hingewiesen, dass Limits "nicht garantiert sind" und modellbezogene Werte nur in AI Studio sichtbar sind. Die Abrechnungsseite (zuletzt aktualisiert am 20.09.2026) vermerkt außerdem für die Nutzung der Gemini API den Wechsel von Postpay zu Prepay mit einem Mindestkauf von $5 Guthaben. Die Variante der Agent Platform für denselben Wechsel hat ein eigenes kostenloses Zeitfenster: Der Express-Modus (zuletzt aktualisiert am 18.09.2026) ermöglicht neuen Google-Cloud-Nutzern, ihn bis zu 90 Tage lang ohne Angabe von Abrechnungsinformationen auszuprobieren, und erklärt, dass der kostenlose 90-Tage-Tarif für bestehende Cloud-Nutzer oder sobald die Abrechnung aktiviert wird entfällt.
Maßnahme vier: den Client wechseln. Googles eigene Empfehlung ist Antigravity, und Sie sollten wissen, was Sie dafür an Flexibilität aufgeben, bevor Sie wechseln: Die Tarifdokumentation von Antigravity erklärt, dass derzeit "keine Unterstützung besteht für: Bring-your-own-key oder Bring-your-own-endpoint für zusätzliche Ratenlimits"; Nutzern ohne AI Pro oder Ultra wird lediglich ein "Bedeutendes Kontingent, wöchentlich erneuert" und ein "Wöchentliches Ratenlimit" zugesagt, ohne dass auf dieser Seite eine Zahl genannt wird; und das kostenpflichtige Kontingent wird "alle fünf Stunden erneuert" – bei Pro "bis das Wochenlimit erreicht ist" –, wobei die Limits laut Google "mit dem Umfang der vom Agenten ausgeführten Arbeit korrelieren" und nicht mit der Anzahl der Eingabeaufforderungen. Für diese Seite wurde keine Antigravity-CLI-Binärdatei installiert, und es wird kein Vergleich von Geschwindigkeit oder Kompatibilität behauptet.
Was kein Kontingent der Gemini CLI erhöht: ein Google-AI-Plus-Abonnement für $4.99/Monat oder ein Google-AI-Pro-Abonnement für $19.99/Monat (gemini.google/subscriptions, geprüft am 21. September 2026). Seit dem 18. Juni 2026 erwerben diese Abonnements Limits für die Gemini-App und Antigravity. Die AI-Ultra-Stufen für $100 und $200 stammen aus Googles Ankündigung vom 19. Mai 2026 und nicht aus der Abonnementseite und unterliegen demselben Vorbehalt.
Was ein benutzerdefinierter Endpunkt kann und nicht kann
Die Gemini CLI dokumentiert zwar eine Überschreibung der Basis-URL, sie ist jedoch enger gefasst, als es scheint. GOOGLE_GEMINI_BASE_URL überschreibt die Basis-URL für Gemini-API-Anfragen "bei Verwendung der gemini-api-key-Authentifizierung", muss HTTPS verwenden, sofern sie nicht auf localhost zeigt, und besitzt ein separates Gegenstück, GOOGLE_VERTEX_BASE_URL, für den Vertex-Pfad – den Google inzwischen in Gemini Enterprise Agent Platform umbenannt hat, während die CLI die alten Variablennamen beibehielt. Im veröffentlichten Quelltext von v0.60.0 wählt das alleinige Setzen dieser Variable einen Authentifizierungstyp aus, der in keiner veröffentlichten Dokumentation erscheint (GATEWAY = 'gateway'), dessen Schlüssel auf eine leere Zeichenfolge zurückfällt. Lesen Sie das als Code, nicht als unterstützte Funktion; es kann sich ohne Changelog-Eintrag ändern.
Daraus folgen drei Grenzen, und sie entscheiden, ob dies überhaupt eine Antwort auf eine Kontingentfrage ist. Die Basis-URL wird als httpOptions.baseUrl an das GoogleGenAI-SDK übergeben, daher verwendet jede Anfrage weiterhin das native Protokoll von Google und wird standardmäßig mit einem x-goog-api-key-Header authentifiziert; das Auth-Enum enthält keinen OpenAI-kompatiblen oder Anthropic-Provider. Kunavos API ist ausschließlich OpenAI-kompatibel und mit Anthropic Messages kompatibel – ihr Routenbestand bei diesem Commit umfasst /v1/chat/completions, /v1/responses und /v1/messages und keinen Gemini-nativen generateContent-Pfad –, daher ist sie kein direkt einsetzbares Ziel für diese Variable, und keine Seite hier sollte etwas anderes behaupten. Das ist eine Schlussfolgerung aus Protokollstruktur und Routenbestand, kein Laufzeittest. Außerdem existiert die Überschreibung nur auf dem API-Schlüssel-Pfad; daher erhöht, erweitert oder setzt das Verweisen auf ein beliebiges Gateway ein Google-seitiges Tageskontingent niemals zurück, sondern wechselt Sie zu einer anderen Abrechnungsbeziehung, deren Kontingent dann dem entspricht, was dieses Konto besitzt.
Die ehrliche Version der Kunavo-Option lautet daher: Wechseln Sie den Client, nicht den Endpunkt. Gemini CLI vs Claude Code vergleicht die beiden Agents, und die Dokumentation zum Gemini-API-Schlüssel beschreibt stattdessen, wie Gemini-Modelle über einen OpenAI-kompatiblen Pfad erreicht werden. Kunavo hat keinen dieser Clients zur Laufzeit gegen seinen Endpunkt getestet; eine veröffentlichte Einrichtungsanleitung ist eine Konfigurationsreferenz, kein Kompatibilitätstest.
Eine Beispielschätzung bei einem Clientwechsel
Dies ist anschauliche Tokenarithmetik, keine gemessenen Aufgabenkosten und keine Rechnungsobergrenze. Nehmen wir eine Agent-Sitzung an, die 300.000 nicht zwischengespeicherte Eingabetokens sendet und 20.000 Ausgabetokens empfängt. Die Preise sind aktuelle Kunavo-Katalogpreise pro Million Tokens; vergleichen Sie sie mit den Google-Listenpreisen in der obigen Tabelle.
| Modell | Eingabe / Ausgabe pro 1 Mio. | Schätzung, eine Sitzung | Schätzung, zehn Sitzungen |
|---|---|---|---|
| Gemini 3.1 Pro | $0.70 / $4.20 | $0.294 | $2.94 |
| Gemini 3.8 Flash | $0.525 / $2.625 | $0.210 | $2.10 |
| Gemini 2.5 Flash | $0.09 / $0.75 | $0.042 | $0.42 |
Widerstehen Sie der Versuchung, zwischen den beiden Welten umzurechnen. Eine Code-Assist-Lizenz misst Anfragen pro Nutzer und Tag, ein Token-Schlüssel misst Tokens, und Google selbst sagt, dass eine Eingabeaufforderung mehrere Modellanfragen erzeugen kann – daher gibt es keinen Umrechnungskurs zwischen $22.80 pro Monat und einem Betrag pro Sitzung. Der einzig ehrliche Vergleich besteht darin, dieselbe begrenzte Aufgabe auf beiden Systemen auszuführen und den jeweiligen Kontodatensatz zu lesen. Der Katalogbetrag von Kunavo ist eine Abrechnungsuntergrenze, keine Obergrenze: Wenn der vorgelagerte Anbieter seine Kosten meldet, ist die Rechnung der höhere Wert aus den Katalogkosten und den vorgelagerten Kosten multipliziert mit dem anwendbaren Aufschlag. Cache-Kosten und externe Tools liegen außerhalb dieses Beispiels, und die minimale Aufladung beträgt $10 als Prepaid-Guthaben – eine Mindestfinanzierung, keine Aufgabengebühr und kein Abonnement. Siehe Abrechnungsdetails.
Welche Route gewinnt, wenn
| Weg | Vorteile, wenn | Worauf Sie verzichten |
|---|---|---|
| Code-Assist-Lizenz, direkt von Google | Sie verwenden ein Workspace- oder Cloud-Konto und möchten den Anmeldepfad, Googles eigene Backend-Funktionen und eine vorhersehbare Abrechnung pro Sitzplatz | Eine harte tägliche Anfrageobergrenze, die zwischen Agent-Modus und CLI geteilt wird, ohne verfügbare Basis-URL-Überschreibung auf diesem Pfad |
| Gemini-API-Schlüssel, direkt von Google | Sie möchten die Modelle eines Anbieters mit dessen eigenem Kontext-Caching und Batch-Preisen sowie nutzungsabhängige Abrechnung statt einer Tagesobergrenze | Ausgabenlimits für ein rollierendes Zehn-Minuten-Fenster, modellbezogene Limits, die Sie nur in AI Studio einsehen können, und eine Preisstufe ab dem 1. Januar 2027 für mehrere Flash-IDs |
| Ein OpenAI-kompatibles Gateway | Sie wechseln zwischen Modellen verschiedener Anbieter und möchten einen Schlüssel und ein Guthaben | Von der Gemini CLI selbst nicht erreichbar – die oben beschriebene Protokollgrenze – daher bedeutet dies, einen anderen Client auszuführen |
| Ein Verbraucherabonnement | Eine Nutzung der Gemini-App oder von Antigravity zum Pauschalpreis passt zu Ihnen | Seit dem 18. Juni 2026 erwirbt es überhaupt kein Gemini-CLI-Kontingent, und die Tarifseite von Antigravity nennt kein numerisches Limit und dokumentiert weder Bring-your-own-key noch Bring-your-own-endpoint für zusätzliche Ratenlimits |
| Ein lokales Modell | Kleine oder private Aufgaben ohne Gebühr pro Anfrage | Eine Fähigkeitslücke gegenüber gehosteten Frontier-Modellen, die erforderliche Hardware für den Betrieb eines solchen Modells und kein Zugang zum eigenen Kontingentsystem der Gemini CLI |
Wenn Sie die Arbeit zu einem anderen Agent statt zu einem anderen Google-Tarif verschieben, beginnen Sie mit der OpenCode-Integration oder der Cline-Einrichtung, vergleichen Sie die Preise im Modellkatalog und erstellen Sie ein Kunavo-Konto, sobald Sie bereit sind, einen Schlüssel mit Guthaben zu versehen. Einen umfassenderen Überblick über die Gemini-Preise finden Sie unter Gemini-API-Preise; die entsprechende Frage zum verschwundenen kostenlosen Tarif bei einem anderen Agent finden Sie unter Codex-Nutzungslimits.
Häufig gestellte Fragen
Wie hoch ist das Gemini CLI-Kontingent im Jahr 2026?
Googles aktuelle Kontingenttabelle für Gemini CLI nennt zwei Zahlen: maximal 1.500 Anfragen pro Nutzer und Tag mit einer Gemini Code Assist Standard-Lizenz und 2.000 mit Enterprise. Auf dieser Seite gibt es keine Zeile für Einzelpersonen mehr, und das Wort „individual“ erscheint dort nicht (docs.cloud.google.com/gemini/docs/quotas, zuletzt aktualisiert am 18.09.2026, geprüft am 21. September 2026). Die anderen aktuellen Wege sind ein Gemini API-Schlüssel oder ein Gemini Enterprise Agent Platform-Schlüssel; sie werden pro Token und Projekt abgerechnet und nicht anhand einer veröffentlichten täglichen Anfragezahl für das CLI. Wer 1.000 Anfragen pro Tag für ein persönliches Google-Konto angibt, zitiert das Repository-README, das dieses Kontingent weiterhin für einen Anmeldeweg bewirbt, der seit dem 18. Juni 2026 keine Privatkonten mehr bedient.
Hat Gemini CLI weiterhin eine kostenlose Stufe?
Nicht mit einem persönlichen Google-Konto. Googles Hinweis zur Einstellung besagt, dass ab dem 18. Juni 2026 Gemini Code Assist für Einzelpersonen sowie die Stufen Google AI Pro und Google AI Ultra nicht mehr bedient wurden, dass dies auch für Gemini CLI gilt und dass „Sie die Option ‚Login with Google‘ nicht mehr verwenden können, um auf die IDE-Erweiterungen oder Gemini CLI zuzugreifen“ (developers.google.com, zuletzt aktualisiert am 02.09.2026). Ob ein unbezahlter Gemini API-Schlüssel im CLI weiterhin funktioniert, wird auf keiner Seite aus erster Hand beantwortet: Googles Ankündigung vom 19. Mai 2026 sagt, dass das CLI „über kostenpflichtige API-Schlüssel für Gemini und Gemini Enterprise Agent Platform weiterhin zugänglich bleiben wird“, und der Abschaltungsbeitrag der Maintainer vom 18. Juni (github.com/google-gemini/gemini-cli Diskussion 28017) sagt lediglich, dass „Enterprise-Nutzer mit Gemini Code Assist-Lizenzen und API-Schlüssel-Authentifizierung vollständig unberührt bleiben“ — ein Satz, dessen Subjekt Enterprise-Nutzer sind und der keine Aussage über einen unbezahlten Schlüssel trifft. Für diese Seite wurde kein Test durchgeführt, der dies klären würde; planen Sie daher nicht damit, dass ein unbezahlter Schlüssel funktioniert.
Wie prüfe ich mein Gemini CLI-Kontingent?
Gemini CLI dokumentiert dafür zwei Slash-Befehle. „/stats model“ zeigt modellspezifische Nutzungsstatistiken einschließlich Tokenzahlen und Kontingentinformationen; die Kontingentdokumentation ergänzt, dass am Ende einer Sitzung beim Beenden ebenfalls eine Zusammenfassung der Modellnutzung angezeigt wird. „/auth“ öffnet einen Dialog, in dem Sie die Authentifizierungsmethode ändern können; damit bestätigen Sie, welcher Abrechnungsbeziehung Sie tatsächlich unterliegen — einer Lizenz, einem API-Schlüssel oder einer Anmeldung, die Ihr Konto nicht mehr bedient. Beides ist dokumentiertes Verhalten auf geminicli.com, wie am 21. September 2026 gelesen, und wurde hier nicht zur Laufzeit getestet.
Wie erhöhe ich mein Gemini CLI-Kontingent?
Es gibt drei kostenpflichtige Optionen, die jeweils Unterschiedliches bieten. Eine Gemini Code Assist Standard-Lizenz kostet laut Liste 22,80 US-Dollar pro Lizenz und Monat bei monatlicher Bindung oder 19,00 US-Dollar bei einer Bindung von 12 Monaten und umfasst das Kontingent von 1.500 Anfragen pro Nutzer und Tag. Enterprise kostet unter denselben Bedingungen 54,00 bzw. 45,00 US-Dollar, und Googles eigener Funktionspunkt dazu lautet: „Erweiterte Agent-Nutzung: Erledigen Sie mehr mit dem Agent-Modus von Gemini Code Assist und Gemini CLI dank höherer täglicher Nutzungslimits“ (cloud.google.com/products/gemini/pricing, geprüft am 21. September 2026). Ein verbrauchsabhängiger Gemini API-Schlüssel ersetzt die tägliche Anfrageobergrenze durch eine Abrechnung pro Token und ausgabenbasierte Limits. Was ein Gemini CLI-Kontingent nicht erhöht, ist ein Google AI Plus- oder Google AI Pro-Verbraucherabonnement: Seit dem 18. Juni 2026 gelten diese für die Gemini-App und Antigravity, nicht für Gemini CLI.
Warum funktioniert Gemini CLI nicht mehr, nachdem ich mich mit Google angemeldet habe?
Weil die Berechtigung auf Googles Seite entschieden wird, nicht anhand Ihrer Clientversion. Die veröffentlichten Quellkommentare von v0.60.0 besagen für die kostenlose Stufe: „Eligibility is determined by the Code Assist server response“, und dass das CLI „Surfaces ineligibility reasons for the FREE tier from the server“. Daher bietet selbst eine aktuelle Binärdatei im Authentifizierungsdialog weiterhin „Sign in with Google“ an, auch für ein Konto, das der Server ablehnen wird; deshalb wirkt der Fehler wie ein Clientfehler und nicht wie eine Richtlinienänderung. Der genaue Ablehnungstext, den ein Privatkonto heute sieht, wurde für diese Seite nicht erfasst.
Kann ich Gemini CLI auf einen anderen API-Endpunkt oder ein Gateway verweisen?
Nur auf einen Gemini-nativen Endpunkt und nur über den API-Schlüssel-Weg. Gemini CLI dokumentiert GOOGLE_GEMINI_BASE_URL als Überschreibung der Basis-URL für Gemini-API-Anfragen bei Verwendung der Authentifizierung gemini-api-key, ausschließlich über HTTPS, sofern die URL nicht auf localhost verweist; Vertex, inzwischen Gemini Enterprise Agent Platform, besitzt ein separates GOOGLE_VERTEX_BASE_URL. Im veröffentlichten Quellcode von v0.60.0 wird diese URL als httpOptions.baseUrl an das GoogleGenAI SDK übergeben. Jede Anfrage verwendet daher weiterhin das native Protokoll von Google und wird standardmäßig mit einem x-goog-api-key-Header authentifiziert; das Auth-Enum enthält keinen OpenAI-kompatiblen oder Anthropic-Anbieter. Kunavos API ist OpenAI-kompatibel und unterstützt zusätzlich Anthropic Messages, verfügt jedoch über keine Gemini-native generateContent-Route und ist daher kein direkt einsetzbares Ziel für diese Variable — der ehrliche Weg besteht darin, den Client statt des Endpunkts zu ändern. Beachten Sie außerdem, dass die Überschreibung nur über den API-Schlüssel-Weg existiert; sie erhöht, verlängert oder setzt daher niemals ein tägliches Kontingent auf Googles Seite zurück.
Geprüft am 21. September 2026: Googles Einstellungsmitteilung, die Kontingentseite von Code Assist, die Google-Cloud-Preistabelle, die Seiten zu Gemini-API-Preisen, Abrechnung und Ratenlimits, die Dokumentationssammlung von geminicli.com und deren Kontingentseite, die Tarifseite von Antigravity, die README des Repositorys, die API des GitHub-Repositorys und die npm-Registry (stabil 0.60.0, veröffentlicht am 15.09.2026). Nicht geprüft: Es wurde keine Gemini-CLI- oder Antigravity-CLI-Binärdatei installiert, kein Google-Konto angemeldet und kein Proxy auf die CLI gerichtet – die Protokollgrenze wurde aus dem veröffentlichten Quelltext von v0.60.0 und aus Kunavos eigenem Routenbestand abgelesen. Kunavos Tokentarife stammen aus dem aktuellen Katalog, und jeder Dollarbetrag hier ist anschauliche Tokenarithmetik.