Zurück zu den Leitfäden
Vergleichen·21. September 2026·Aktualisiert am 24. September 2026·10 Min. Lesezeit

Gemini CLI vs. Qwen Code: Protokolle, Tarife und Gesamtkosten

Dasselbe Programm, als Fork: Das eine spricht vier API-Protokolle und lässt einen Modelleinstiegspunkt auf eine eigene Basis-URL zeigen, das andere spricht nur Googles natives Protokoll — und bei beiden wurden die beworbenen kostenlosen Tarife im Jahr 2026 eingestellt.

Zuletzt überprüft am .

Gemini CLI und Qwen Code sind Ursprung und Fork desselben Programms, und die Wahl zwischen ihnen hängt nun von einer Asymmetrie ab: Qwen Code spricht vier API-Protokolle und lässt einen Modelleinstieg auf eine eigene Basis-URL zeigen, während Gemini CLI ausschließlich Googles natives Protokoll spricht. Die README von Qwen Code erklärt, dass es „ursprünglich auf Google Gemini CLI v0.8.2 basierte“ und die Synchronisierung mit dem Upstream bei seiner eigenen Version v0.1 einstellte. Beide Clients stehen unter Apache-2.0 und kosten nichts; beide verloren 2026 ihre beworbene kostenlose Stufe. Die eigentliche Entscheidung ist daher, in welcher Abrechnungsbeziehung Sie sich befinden möchten.

Zwei Namen müssen zuerst auseinandergehalten werden. QwenLM/Qwen3-Coder ist die Modell-Familie mit offenen Gewichten — ihre Benchmark-Ergebnisse und Parameteranzahlen gehören zum Modell, nicht zum Client unter QwenLM/qwen-code. Und eliben/gemini-cli ist ein anderes, archiviertes Go-Programm eines Drittanbieters; Googles Projekt ist google-gemini/gemini-cli, das die GitHub-API mit archived: false und einem Push am 21. September 2026 meldete.

Was Sie am 21. September 2026 tatsächlich vergleichen

Gemini CLIQwen Code
BetreuerGoogleQwen-Team, Alibaba
LizenzApache-2.0 (GitHub-API)Apache-2.0 laut Repository; der npm-Eintrag enthält kein Lizenzfeld
Letztes Releasev0.60.0, veröffentlicht am 15. September 2026npm 0.24.3, veröffentlicht am 21. September 2026
Sterne107,11228,046
Kostenloser TarifDie Anmeldung für Verbraucher bedient seit dem 18. Juni 2026 keine Anfragen mehrKostenlose Qwen-OAuth-Stufe am 15. April 2026 eingestellt
Aktiver kostenpflichtiger ZugangGemini-Code-Assist-Standard-/Enterprise-Lizenz, Gemini-API-Schlüssel, Schlüssel der Gemini Enterprise Agent PlatformAlibaba-ModelStudio-Pläne und -Schlüssel, neun benannte Drittanbieter oder ein beliebiger OpenAI-kompatibler Endpunkt

Repository- und Paketfakten aus den GitHub- und npm-APIs für beide Projekte — @google/gemini-cli und @qwen-code/qwen-code — geprüft am 21. September 2026. Beide werden schnell veröffentlicht — Gemini CLI publiziert außerdem preview- und nightly-npm-Kanäle —, prüfen Sie daher die Version in Ihrer eigenen Umgebung, statt einer auf einer Seite angegebenen Zahl zu vertrauen.

Drei Stolpersteine in offiziellen Quellen verdienen eine ausdrückliche Erwähnung. Die README von Gemini CLI auf main bewirbt weiterhin eine „kostenlose Stufe: 60 Anfragen/Minute und 1.000 Anfragen/Tag mit persönlichem Google-Konto“, vier Monate nachdem Googles Ankündigung vom 19. Mai erklärte, dass dieser Pfad am 18. Juni 2026 eingestellt würde. Die offizielle Kontingenttabelle auf geminicli.com widerspricht dem Banner auf derselben Seite. Und Antigravity, der von Google genannte Nachfolger, ist ein anderes Produkt: Seine Preisseite zeigt eine kostenlose Individual-Stufe mit 0 $ und nennt für Pro oder Ultra überhaupt keinen Preis, daher stammen Zahlen zu diesen Stufen in Drittanbieter-Blogs nicht aus den hier verwendeten Quellen. Gemini-CLI-Kontingent zeigt, über welchen Pfad weiterhin ein Kontingent verfügbar ist.

Wer sollte was auswählen

Wählen Sie Qwen Code, wenn der Endpunkt entscheidend ist. Seine Referenz zu den Modellanbietern definiert vier Protokolle — openai, anthropic, gemini und vertex-ai —, und seine Authentifizierungsdokumentation nennt DeepSeek, Grok, MiniMax, Z.AI, Kimi, Idealab, ModelScope, OpenRouter und Requesty als unterstützte Drittanbieter-Routen sowie „jeden OpenAI-kompatiblen Endpunkt“. Einen eigenen Endpunkt zu verwenden ist dort ein vorgesehener Pfad, kein Workaround — mit der Einschränkung, die dieselbe Seite nennt: Ein baseUrl muss mit dem API-Format des von seinem Eintrag deklarierten Transports kompatibel sein. Wenn Sie im nächsten Jahr mit einem Wechsel der Modellfamilien rechnen, ist das die gesamte Begründung.

Wählen Sie Gemini CLI, wenn Sie bereits innerhalb von Googles Abrechnung arbeiten. Wenn Ihre Organisation Lizenzen für Gemini Code Assist besitzt, ist das CLI laut Googles Cloud-Preisseite eine enthaltene Funktion beider kostenpflichtiger Editionen, und der Enterprise-Punkt verspricht „erhöhte tägliche Nutzungslimits“ für CLI- und Agent-Mode-Arbeit. Ein Gemini-API-Schlüssel funktioniert ebenfalls. Was Sie aufgeben, ist die Auswahl: Nichts im Auth-Enum von v0.60.0 spricht ein Nicht-Google-Protokoll.

Wählen Sie nach der Planstruktur, wenn das Budget feststeht. Die Pauschalpreisroute von Qwen Code ist ein monatlicher Alibaba Coding Plan für 50 $ mit Anfrageobergrenzen; bei Gemini CLI handelt es sich um eine Lizenz, deren Gebühr Google pro Stunde ausweist und über die Gemini-Administratorkonsole oder sein Vertriebsteam verkauft. Ob eine Einzelperson — im Gegensatz zu einer Organisation — eine Gemini-Code-Assist-Standardlizenz im Self-Service erwerben kann, wird von keiner hier geprüften Seite bestätigt oder verneint; behandeln Sie dies daher als ungeprüft, bevor Sie Ihre Planung darauf stützen.

Wählen Sie Qwen Code, wenn Sie mehr Oberflächen als ein Terminal benötigen. Seine README bewirbt eine Desktop-App, VS Code, Zed- und JetBrains-Plugins, Telegram-, DingTalk-, WeChat- und Feishu-Kanäle, TypeScript-, Python- und Java-SDKs sowie einen experimentellen qwen serve-Daemon mit HTTP- und SSE-Unterstützung. Dies sind Angaben des Anbieters zu seinem eigenen Produkt; nichts davon wurde hier ausgeführt, und der Anbieter kennzeichnet Web-UI und Daemon als experimentell.

Was die Entscheidung nicht bestimmen sollte: Subagenten, Hooks und Skills. Eine Codesuche in den docs/-Verzeichnissen beider Repositorys am 21. September 2026 fand alle drei auf beiden Seiten dokumentiert; sie sind daher Grundausstattung und kein Unterscheidungsmerkmal.

Arbeitsablauf: Was der Fork beibehalten hat und wo sich die Wege trennten

DimensionGemini CLIQwen Code
OberflächenTerminal plus die in der README dokumentierte VS-Code-BegleitanwendungTerminal, Desktop, experimentelle Web-UI, Editor-Plugins, Chat-Kanäle, ACP-Daemon
Headlessgemini -p "...", mit --output-format json oder stream-jsonqwen -p "...", plus drei SDKs
Sandboxgemini -s; dieselben vier Vorteilspunkte in der DokumentationDasselbe vom Fork übernommene Konzept; macOS-Seatbelt-Standardprofil permissive-open
UmgebungspräfixGEMINI_*QWEN_*, wobei die Dokumentation einräumt, dass einige Sandbox-Variablen historisch GEMINI_* verwendeten
EndpunktkonfigurationNur Umgebungsvariablen: GOOGLE_GEMINI_BASE_URL, GOOGLE_VERTEX_BASE_URLStrukturiertes modelProviders in settings.json, ohne Neustart hot-reloaded
Integrierte SucheGoogle-Such-Grundierung, separat abgerechnetHost-gesteuert; die Steuerung wurde in diesem Durchlauf nicht erneut geprüft

Dokumentation, die am main für beide Projekte gelesen wurde, sowie der Gemini-CLI-Quellcode am veröffentlichten Tag v0.60.0 vom 21. September 2026. Die Sandbox-Zeile beschreibt die Dokumentationsähnlichkeit, nicht eine getestete Verhaltensgleichheit.

Modelle und Endpunkte: die Asymmetrie, die den Ausschlag gibt

Die Konfigurationsreferenz der Gemini CLI dokumentiert GOOGLE_GEMINI_BASE_URL als Überschreibung von „der standardmäßigen Basis-URL für Gemini-API-Anfragen (bei Verwendung der gemini-api-key-Authentifizierung)“, wobei HTTPS erforderlich ist, sofern nicht auf localhost verwiesen wird. Daraus folgen zwei Einschränkungen. Die Einstellung ist über den Google-Anmeldepfad nicht erreichbar und erhöht, erweitert oder setzt daher niemals ein Google-seitiges Kontingent zurück — sie wechselt zu einer anderen Abrechnungsbeziehung. Im Quellcode von v0.60.0 wählt allein ihre Einstellung außerdem einen AuthType.GATEWAY, der auf keiner hier gefundenen veröffentlichten Dokumentationsseite erscheint; die Anfrage bleibt ein nativer Google-Aufruf mit einem x-goog-api-key-Header. Behandle das als Quellcodeverhalten, nicht als Funktionsvertrag.

Qwen Code kehrt all das um. Sein Befehl /auth listet drei Optionen der obersten Ebene auf — Alibaba ModelStudio, Drittanbieter und Benutzerdefinierter Anbieter — während Anthropic- und Gemini-Routen in modelProviders statt im Dialog definiert werden. Zugangsdaten werden niemals in den Einstellungen gespeichert; die Laufzeit liest sie aus process.env[envKey]. Vor einer Festlegung sind drei dokumentierte Fallen wichtig: Eine Anbieter-ID, die weder integriert noch über die Einstellung providerProtocol aufgelöst ist, wird vollständig „mit einer Warnung übersprungen“; providerProtocol wird einmal beim Start gelesen und benötigt einen Neustart, während modelProviders dynamisch neu geladen wird; und jeder API-Schlüsselwert, der einen Vertex-Eintrag erreicht, „schaltet das Google SDK in den Vertex-Express-Modus, der das Projekt, den Standort und Ihre ADC-Anmeldedaten ignoriert“.

Ein Hinweis zu den Standardwerten in beide Richtungen. Die Konstante DEFAULT_GEMINI_MODEL der Gemini CLI v0.60.0 ist gemini-2.5-pro und DEFAULT_QWEN_MODEL von Qwen Code ist coder-model, doch keine der beiden Konstanten beantwortet Ihre Frage: Die Gemini-Seite leitet eine angeforderte ID durch einen Resolver, der sie anhand des Kontexts wie Release-Kanal und Preview-Zugriff umschreibt, und auf der Qwen-Seite ist dieselbe Zeichenfolge coder-model auch der Wert von DEFAULT_QWEN_FLASH_MODEL und bezeichnet daher ebenfalls keine bestimmte Modellversion. Benenne das Modell explizit, wenn die Rate entscheidend ist.

Kunavo stellt kein Embedding-Modell bereit. Daher kann keiner der beiden Embedding-Standardwerte — gemini-embedding-001 auf der Gemini-Seite, text-embedding-v4 auf der Qwen-Seite — hierauf verwiesen werden, und jeder Indexierungsschritt benötigt einen eigenen Anbieter.

Pläne und Tokenraten auf einer gemeinsamen Skala

WegVeröffentlichter PreisWas es bietet
Beide Clients$0, Apache-2.0Nur die Software; sämtliche Kosten entfallen auf die Inferenz
Alibaba Coding Plan Pro (international)50 $ pro MonatBis zu 6.000 Anfragen pro 5 Stunden, 45.000 pro Woche, 90.000 pro Monat
Gemini Code Assist Standard0,031232877 $ pro Stunde bei monatlicher Bindung; 0,026027397 $ pro Stunde bei einer Bindung über 12 MonateLizenz einschließlich Gemini CLI, erworben über die Gemini Admin-Konsole oder den Vertrieb
Gemini Code Assist Enterprise0,073972603 $ pro Stunde bei monatlicher Bindung; 0,061643836 $ pro Stunde bei einer Bindung über 12 MonateDasselbe plus „erhöhte tägliche Nutzungslimits“
Gemini API, gemini-3.1-pro-preview2,00 $ Eingabe / 12,00 $ Ausgabe pro 1 Mio. bei Prompts mit höchstens 200.000 Tokens; 4,00 $ / 18,00 $ darüberAbgerechneter Schlüssel; in der Spalte „Kostenlose Stufe“ steht „Nicht verfügbar“
Gemini API, gemini-3.8-flash0,75 $ / 3,75 $ pro 1 Mio. bis zum 31. Dezember 2026, danach 1,50 $ / 7,50 $Abgerechneter Schlüssel; die Preiserhöhung für 2027 ist bereits heute auf der Seite angegeben
Alibaba, qwen3-coder-plus (Singapur)1 $ / 5 $ bis 32K; 1,8 $ / 9 $ bis 128K; 3 $ / 15 $ bis 256K; 6 $ / 60 $ bis 1MNutzungsabhängige Abrechnung, nach Eingabelänge der Anfrage bepreist
Alibaba, qwen3-coder-next (Singapur)0,3 $ / 1,5 $ bis 32K; 0,5 $ / 2,5 $ bis 128K; 0,8 $ / 4 $ bis 256KKeine Stufe für 256K und mehr aufgeführt

Preise am 21. September 2026 aus Google Cloud, der Gemini-API-Preisseite, der Coding-Plan-Seite von Alibaba und der Modellpreistabelle abgelesen. Vier Hinweise haben konkrete finanzielle Bedeutung. Google gibt die Lizenzgebühr stündlich hinter einem Monatsschalter an, der im hier gelesenen Seitencode nicht gerendert wurde; eine Multiplikation mit 730 Stunden ergibt daher ungefähr 22,80 $ und 19,00 $ für Standard sowie 54,00 $ und 45,00 $ für Enterprise — das ist eine Berechnung aus Googles Stundenwerten, kein wörtlich abgelesener Monatspreis. Die China-Spalte von Alibaba ist ein separates kommerzielles Angebot gegenüber der Singapur-Spalte, keine Währungsumrechnung; eine Vermischung führt zu einem falschen Ergebnis. Die günstige Stufe Coding Plan Lite, die in sozialen Beiträgen noch zitiert wird, wurde am 20. März 2026 für neue Abonnements und am 13. April 2026 für Verlängerungen und Upgrades geschlossen. Und ein Coding Plan ist nicht „der Preis von Qwen Code“: Alibaba führt Claude Code, Cline und Cursor unter den unterstützten Tools auf, sodass Kontingent, das ein anderer Client verbraucht, Qwen Code nicht mehr zur Verfügung steht.

Ein weiterer aktueller Kostenpunkt auf der Gemini-Seite: Google Search Grounding, das die Gemini CLI als integriertes Tool bereitstellt, umfasst 5.000 kostenlose Suchanfragen pro Monat, die von Gemini-3.x-Modellen gemeinsam genutzt werden, und kostet danach 14 $ pro 1.000 Anfragen.

Eine Beispielrechnung für eine Sitzung

Dies ist eine beispielhafte Tokenrechnung, keine gemessene Aufgabenkostenrechnung und keine Abrechnungsobergrenze. Nehmen wir eine Sitzung an, die 200.000 nicht zwischengespeicherte Eingabetokens sendet und 12.000 Ausgabetokens empfängt, wobei jede einzelne Anfrage klein genug ist, um in der niedrigsten Längenstufe jedes Anbieters zu bleiben. Caching, Tool-Aufrufe und Wiederholungen sind ausgeschlossen.

WegRate pro 1 Mio., Eingabe / AusgabeSchätzung für die angenommene Sitzung
Gemini API, gemini-3.1-pro-preview$2.00 / $12.00$0.544
Gemini API, gemini-3.8-flash$0.75 / $3.75$0.195
Alibaba, qwen3-coder-plus$1.00 / $5.00$0.260
Alibaba, qwen3-coder-next$0.30 / $1.50$0.078
Gemini 3.8 Flash, bei Kunavo innerhalb von Qwen Code$0.525 / $2.625$0.137
Gemini 3.1 Pro, bei Kunavo innerhalb von Qwen Code$0.70 / $4.20$0.190
Claude Haiku 4.5, bei Kunavo innerhalb von Qwen Code$0.70 / $3.50$0.182
Claude Sonnet 4.6, bei Kunavo innerhalb von Qwen Code$2.10 / $10.50$0.546

Zwei Betrachtungsweisen. Erstens verschiebt die Stufengrenze mehr Geld als die Wahl des Anbieters: Dieselbe Sitzung mit qwen3-coder-plus steigt von $0.260 auf $0.468, sobald Anfragen 32K Eingabe überschreiten — etwas, das ein Agent beim Laden mehrerer Dateien regelmäßig tut. Zweitens ist ein Ratenvergleich kein Ergebnisvergleich — es gibt keinen Benchmark, der diese beiden Clients vergleicht, und ein Modell, das drei Versuche benötigt, kann mehr kosten als ein teureres Modell, das einen einzigen Durchlauf braucht.

Die Kunavo-Zeilen sind Live-Katalog-Raten für Modelle, die Sie über das openai-Protokoll von Qwen Code ausführen würden; Kunavo verkauft kein Qwen-Textmodell und ist daher kein günstigerer Weg zur Qwen-Inferenz. Der Katalogbetrag ist eine Abrechnungsuntergrenze, keine Obergrenze: Wenn der Upstream seine Kosten meldet, entspricht die Rechnung dem höheren Wert aus den Katalogkosten und den Upstream-Kosten multipliziert mit dem anwendbaren Aufschlag. Die minimale Aufladung beträgt $10 als vorausbezahltes Guthaben; das ist ein Mindestbetrag zur Finanzierung, kein Abonnement — siehe Abrechnungsdetails.

Migrationskosten in beide Richtungen

Der Wechsel von Gemini CLI zu Qwen Code ist der günstigere Schritt, und der Fork erklärt warum: Befehlsoberfläche, Sandbox-Konzept und die allgemeine Form einer Sitzung wurden übernommen, sodass das mentale Modell weitgehend übertragbar ist. Was nicht automatisch übertragen wird, ist die Konfiguration. Gemini CLI verwaltet seinen Endpunkt in Umgebungsvariablen; Qwen Code verwendet dafür einen strukturierten settings.json-Block, und die Dokumentation warnt, dass eine frühere Preview-Struktur, die Modelle in { protocol, models } einschließt, „zurückgenommen wurde“ und in einer $version: 4-Datei stillschweigend übersprungen wird. Das Kopieren einer Konfiguration aus einem alten Tutorial ist der wahrscheinlichste Weg, einen Nachmittag zu verlieren.

Der Wechsel in die andere Richtung kostet mehr, weil Sie jeden Nicht-Google-Endpunkt auf einmal aufgeben. Wenn der Grund ein Code-Assist-Abonnement ist, das Sie bereits bezahlen, kann sich das lohnen. Wenn der Grund ein kostenloses Kontingent ist, von dem Sie gelesen haben, prüfen Sie zuerst das Datum der Seite, auf der Sie es gelesen haben.

Ein Hinweis, der für beide Richtungen gilt und sich anhand veröffentlichter Seiten nicht auflösen lässt: ob ein unbezahlter Gemini-API-Schlüssel nach dem 18. Juni 2026 weiterhin innerhalb der Gemini CLI funktioniert. Googles Beitrag vom 19. Mai sagt, dass die CLI über bezahlte Schlüssel erreichbar bleibt; keine hier gefundene Erstanbieter-Seite klärt den unbezahlten Fall, daher sollten Sie ihn nicht in Ihre Budgetplanung einbeziehen.

Einrichten der Drittanbieterroute

Wenn Qwen Code plus Gateway die richtige Lösung ist, veröffentlicht Kunavo dafür eine Konfigurationsreferenz: Deklariere den Endpunkt unter modelProviders mit der integrierten Anbieter-ID openai — daher ist keine Zuordnung über providerProtocol erforderlich — richte baseUrl auf die /v1-Wurzel statt auf den vollständigen Chat-Completions-Pfad und lies den Schlüssel aus einer Umgebungsvariablen. Das ist eine veröffentlichte Einrichtungsanleitung, kein Kompatibilitätstest: Qwen Code wurde hier nicht zur Laufzeit mit Kunavos Endpunkt getestet, und die eigene Dokumentation von Qwen Code weist darauf hin, dass die responses-Draht-API keine Endpunkterkennung und keinen automatischen Fallback besitzt; beginne daher mit Chat Completions. Halte eine funktionierende Route verfügbar, führe eine begrenzte Aufgabe aus und prüfe anschließend, was dein Konto tatsächlich aufgezeichnet hat. Beginne mit dem Integrationsleitfaden für Qwen Code, vergleiche die Planrouten unter Qwen-Code-Preise und erstelle ein Kunavo-Konto, wenn du bereit bist, einen Schlüssel zu finanzieren.

Stattdessen gegen einen dritten Client entscheiden? Qwen Code vs. Claude Code und OpenAI-kompatible API behandeln die angrenzenden Entscheidungen.

Häufig gestellte Fragen

Ist Qwen Code nur ein umbenanntes Gemini CLI?

Es begann als Fork und ist keine Kopie mehr. Die eigene README von Qwen Code erklärt, dass das Projekt „ursprünglich auf Google Gemini CLI v0.8.2 basierte“ und dass „wir ab Qwen Code v0.1 die Synchronisierung mit dem Upstream eingestellt und eine unabhängige Entwicklung als Multi-Protokoll-, Multi-Plattform-Agent-Framework begonnen haben“ (gelesen am 21. September 2026). Die aktuelle stabile Version von Gemini CLI ist v0.60.0, also Dutzende Minor-Versionen vom Fork-Punkt entfernt; die beiden Codebasen entwickeln sich daher schon seit langer Zeit auseinander. Die Abstammung ist dennoch an einigen Stellen sichtbar: Die Sandbox-Dokumentation von Qwen Code weist darauf hin, dass einige Sandbox-Umgebungsvariablen historisch das Präfix GEMINI_ verwendeten und alle neuen Variablen QWEN_ nutzen.

Kann Gemini CLI Qwen-Modelle ausführen oder Qwen Code Gemini-Modelle?

Dokumentiert funktioniert nur eine Richtung. Die Referenz zu den Modellanbietern von Qwen Code definiert vier Protokolle — openai, anthropic, gemini und vertex-ai —, sodass Google-Modelle dort einen integrierten Pfad darstellen, obwohl die Anthropic- und Gemini-Pfade Funktionen der Einstellungsdatei und keine Einträge im /auth-Dialog sind. Gemini CLI verfügt über kein Äquivalent: In seinem Quellcode von v0.60.0 enthält das Auth-Enum oauth-personal, gemini-api-key, vertex-ai, cloud-shell, compute-default-credentials und gateway, aber weder einen OpenAI-kompatiblen noch einen Anthropic-Eintrag; außerdem liefert eine GitHub-Codesuche nach OPENAI_BASE_URL im gesamten Repository null Treffer. Beide Aussagen beruhen auf Dokumentation und Quellcode, gelesen am 21. September 2026, nicht auf Laufzeittests.

Hat eines von beiden noch eine kostenlose Stufe?

Beide beworbenen kostenlosen Stufen wurden 2026 eingestellt. Die Authentifizierungsdokumentation von Qwen Code erklärt, dass „die kostenlose Qwen-OAuth-Stufe am 2026-04-15 eingestellt wurde“ und dass zwischengespeicherte Tokens kurzzeitig funktionieren können, bevor neue Anfragen abgelehnt werden. Google kündigte am 19. Mai 2026 an, dass Gemini CLI am 18. Juni 2026 „keine Anfragen mehr für Google AI Pro und Ultra sowie für diejenigen bedienen wird, die es kostenlos mit Gemini Code Assist für Einzelpersonen nutzen“. Tutorials, die 2.000 kostenlose Qwen-Anfragen pro Tag oder 1.000 kostenlose Gemini-Anfragen pro Tag nennen, beschreiben Routen, die nicht mehr bedient werden. Die einzige am 21. September 2026 verifizierbare kostenlose Nutzungsmöglichkeit war das kostenlose Kontingent in Alibabas Modellpreistabelle — 1 Million Token pro Modell, nur in Singapur angeboten und für 90 Tage ab Aktivierung von Model Studio, Veröffentlichung des Modells oder Genehmigung des Antrags gültig, je nachdem, welches Ereignis zuletzt eintritt. Das ist eine Testphase, keine wiederkehrende Stufe.

Was ist im Betrieb günstiger: Gemini CLI oder Qwen Code?

Keiner der beiden Clients erhebt Gebühren; beide sind laut ihren Repositorys Open Source unter Apache-2.0, daher besteht der gesamte Vergleich aus den dahinterliegenden Inferenzkosten. Bei den am 21. September 2026 geprüften veröffentlichten Listenpreisen war Alibabas qwen3-coder-next in Singapur mit 0,30 $ pro Million Eingabe- und 1,50 $ pro Million Ausgabetoken für Anfragen bis 32K die günstigste veröffentlichte Rate der hier verglichenen Routen, gegenüber 2,00 $ und 12,00 $ für gemini-3.1-pro-preview bei Prompts mit höchstens 200.000 Token. Der günstigste Listenpreis und die niedrigsten Kosten zum Abschluss einer Aufgabe sind jedoch unterschiedliche Aussagen, und es gibt keinen Benchmark, der diese beiden Clients vergleicht. Zwei strukturelle Stolpersteine sind wichtiger als die Schlagzeile: Alibaba berechnet nach der Eingabelänge der Anfrage, sodass qwen3-coder-plus von 1 $/5 $ auf 1,8 $/9 $ steigt, sobald eine Anfrage 32K überschreitet; außerdem sind Alibabas Spalten für China und Singapur separate kommerzielle Angebote mit deutlich unterschiedlichen Zahlen.

Wurde Gemini CLI eingestellt?

Nein, aber sein Zugang für Verbraucher wurde eingestellt. Das Repository ist aktiv und nicht archiviert und veröffentlicht wöchentlich: GitHub meldete archived false mit einem Push am 21. September 2026, und die stabile Version v0.60.0 wurde am 15. September 2026 veröffentlicht. Geschlossen wurde der Anmeldepfad — Googles eigener Hinweis zur Einstellung erklärt, dass Google AI Pro, Google AI Ultra und das kostenlose Gemini Code Assist für Einzelpersonen am 18. Juni 2026 nicht mehr bedient wurden; geminicli.com trägt ein Banner, wonach das CLI an diesem Datum für Nutzer ohne Bezahlung und Google-One-Nutzer durch Antigravity CLI ersetzt wurde. Googles Cloud-Preisseite führt Gemini CLI weiterhin als enthaltene Funktion beider kostenpflichtiger Gemini-Code-Assist-Editionen auf, sodass das Produkt über kostenpflichtige Pfade unterstützt wird. Behandeln Sie den README-Text des Repositorys „60 requests/min and 1,000 requests/day with personal Google account“ als nicht korrigierten Text, nicht als aktives Kontingent.

Kann ich einen der beiden Clients auf ein Drittanbieter-Gateway wie Kunavo ausrichten?

Qwen Code ja, wie dokumentiert; Gemini CLI nein. Das openai-Protokoll von Qwen Code nimmt eine von Ihnen angegebene Basis-URL entgegen, sofern sie das von dieser Route erwartete API-Format spricht, und Kunavo veröffentlicht dafür eine Einrichtungsreferenz; dies ist ein Konfigurationsleitfaden, kein Kompatibilitätstest, und Qwen Code wurde nicht zur Laufzeit gegen den Kunavo-Endpunkt getestet. GOOGLE_GEMINI_BASE_URL von Gemini CLI ist für den gemini-api-key-Pfad dokumentiert, und im Quellcode von v0.60.0 wählt das Setzen dieser Variable einen Gateway-Authentifizierungstyp; bei beiden Lesarten verlässt die Anfrage das System weiterhin als nativer Google-Aufruf mit einem x-goog-api-key-Header, sodass ein OpenAI-kompatibler oder Anthropic-Messages-Endpunkt kein Drop-in-Ziel dafür ist — dies ist eine Schlussfolgerung aus Protokollform und Routenbestand, keine beobachtete Ablehnung. Beachten Sie außerdem, dass die Dokumentation zu den Plänen für Google Antigravity, dem Nachfolger, auf den Google Gemini-CLI-Nutzer verweist, als derzeit nicht unterstützt aufführt: „Bring-your-own-key or bring-your-own-endpoint for additional rate limits“.

Repositories, npm-Einträge, offizielle Preisseiten und die Dokumentation beider Projekte wurden am 21. September 2026 geprüft; das Verhalten der Gemini CLI wurde am veröffentlichten Tag v0.60.0 gelesen und die Qwen-Code-Dokumentation auf dem Branch main. Keiner der beiden Clients wurde installiert oder ausgeführt, es gibt keinen Benchmark zum Vergleich der beiden, und jeder oben genannte Dollarbetrag ist entweder eine veröffentlichte Drittanbieterrate oder eine beispielhafte Tokenrechnung auf Kunavos Live-Katalog.