Zurück zu den Leitfäden
Preise·18. September 2026·Aktualisiert am 1. Oktober 2026·9 Min. Lesezeit

Qwen-Code-Preise: Pläne, API-Kosten und Anbieteroptionen

Der Client ist kostenlos. Das kostenlose OAuth-Kontingent ist weggefallen. Alles andere ist Inferenz, die Sie kaufen.

Zuletzt überprüft am .

Qwen Code selbst ist kostenlos: Der Client ist Open Source unter der Apache-2.0-Lizenz und hat keine kostenpflichtige Stufe; jeder Dollar in einem Budget für Qwen Code entfällt daher auf separat erworbene Modellinferenz. Die kostenlose Qwen-OAuth-Stufe, die in den meisten Tutorials noch beschrieben wird, wurde am 15. April 2026 eingestellt. Ein Budget für 2026 beginnt daher mit einem erworbenen Endpunkt: einem Alibaba Cloud Model Studio Coding Plan, einem Paket mit Token Plan Credits, einer Token-Abrechnung nach tatsächlichem Verbrauch oder einem Drittanbieter-Endpunkt, den Sie selbst für den Client konfigurieren.

Diese vier Wege werden in vier unterschiedlichen Einheiten abgerechnet — Anfragen, Credits, Token und dem Betrag, den Ihr eigener Provider berechnet. Deshalb führt ein Vergleich allein anhand des beworbenen Preises zum falschen Ergebnis. Diese Seite trennt Softwarekosten von Inferenzkosten, zeigt eine nachvollziehbare Tokenschätzung und kennzeichnet die Zahlen, die nicht verifiziert werden konnten.

Was die Software kostet und was die Modelle kosten

Das QwenLM/qwen-code-Repository steht unter der Apache-2.0-Lizenz und wird aktiv entwickelt; die GitHub-API meldete es am 21. September 2026 als nicht archiviert. Veröffentlichungen erscheinen wöchentlich oder häufiger: v0.24.0 wurde am 16. September 2026 auf npm als @qwen-code/qwen-code veröffentlicht, und am 20. September folgte v0.24.2. Prüfen Sie daher die Registry, statt einer auf einer Seite angegebenen Version zu vertrauen. Die Installation erfolgt über npm (Node.js 22 oder höher), Homebrew oder ein eigenständiges Installationsprogramm.

Ihn heute als Terminal-CLI zu bezeichnen, greift zu kurz. Die Überschrift der README beschreibt ihn als Open-Source-KI-Coding-Agent für Terminal, Editor, Desktop, Browser und Chat. Das Projekt liefert eine Desktop-App, eine mit qwen serve --open gestartete Weboberfläche, Plugins für VS Code, Zed und JetBrains, TypeScript-, Python- und Java-SDKs sowie Chat-Kanäle. Das GitHub-Beschreibungsfeld des Repositorys bezeichnet ihn weiterhin als Agent, der in Ihrem Terminal lebt; die beiden Angaben widersprechen sich also. Die README ist diejenige, die die zusätzlichen Oberflächen aufführt. Keine dieser Oberflächen ist ein kostenpflichtiges Upgrade — sie befinden sich alle im selben kostenlosen Repository, und keine umfasst Inferenz.

Eine mögliche Vererbung sollte ausgeschlossen werden: Qwen Code basierte ursprünglich auf Google Gemini CLI v0.8.2, doch das Projekt gibt an, die Synchronisierung mit dem Upstream bei v0.1 eingestellt zu haben und unabhängig entwickelt zu werden. Kontingente und Preise von Gemini CLI werden nicht übernommen.

Kostenloses Qwen-Code-Limit: Was endete wann?

Die Authentifizierungsdokumentation besagt, dass die kostenlose Qwen-OAuth-Stufe am 2026-04-15 eingestellt wurde und vorhandene zwischengespeicherte Token möglicherweise noch kurz funktionieren, während neue Anfragen abgelehnt werden. OAuth ist im Dialog /auth nicht mehr als auswählbarer Eintrag verfügbar; es bleibt nur als eingestellter Provider dokumentiert. Dies ist die mit Abstand veraltetste Tatsache in den Suchergebnissen zu diesem Thema.

ZeitraumKostenloses OAuth-KontingentNachweis
Bis v0.9.0 (npm, 3. Februar 2026)2.000 Anfragen/Tag, 60 Anfragen/MinuteDie Authentifizierungsdokumentation wurde im v0.9.0-Tag veröffentlicht
Ab v0.10.0 (npm, 9. Februar 2026)1.000 Anfragen/Tag, 60 Anfragen/MinuteDieselbe Datei in den Tags v0.10.0 bis v0.14.0
Ab 15. April 2026Keines — eingestelltAktuelle Authentifizierungsdokumentation; Issue #3316, am 16. April eröffnet und geschlossen

Zwei Hinweise zu dieser Tabelle. Das genaue Kalenderdatum, an dem das tägliche Kontingent von 2.000 auf 1.000 sank, wurde nirgends angekündigt, wo wir gesucht haben; die oben angegebene Spanne wurde anhand des Release-Tags abgeleitet, in dem sich die veröffentlichte Dokumentation änderte, nicht anhand einer Ankündigung von Qwen. Außerdem findet sich die häufig wiederholte Behauptung, das Kontingent sei vor der Einstellung auf 100 pro Tag gesunken, in keinem der von uns geprüften Release-Tags: v0.9.0 bis v0.14.0 sind die Versionen, die überhaupt ein Kontingent nennen; sie nennen zunächst 2.000 und dann 1.000, und ab v0.15.0 nennt die Datei kein Kontingent mehr, weil die Stufe bereits eingestellt war. Betrachten Sie die Zahl 100 pro Tag als unbelegt. Auch ein offizieller Blogbeitrag oder eine Pressemitteilung zur Einstellung wurde nicht gefunden; sie wurde daher dokumentiert und nicht angekündigt.

Zwei weitere Einschränkungen sind für alle relevant, die den kostenlosen Weg wiederbeleben möchten. Qwen-OAuth-Modelle sind fest codiert und können über modelProviders nicht überschrieben werden; der eingestellte Weg kann daher nicht einfach auf einen anderen Endpunkt umgeleitet werden. OAuth war außerdem nie headless nutzbar: Die Dokumentation weist darauf hin, dass der Browser-Anmeldevorgang in CI-, SSH- oder Containerumgebungen typischerweise überhaupt nicht abgeschlossen werden kann.

Drei offizielle Endpunkte, drei Abrechnungseinheiten

In /auth öffnet Alibaba ModelStudio ein Untermenü mit Coding Plan, Token Plan und Standard API Key. Dies sind nicht drei Möglichkeiten, dieselbe Rechnung zu bezahlen: Die Dokumentation gibt jedem einen eigenen Endpunkt-Host und einen eigenen Schlüssel und weist Sie an, den baseUrl an den Plan anzupassen, zu dem der Schlüssel gehört. Coding-Plan-Schlüssel beginnen mit sk-sp-; für Token-Plan-Schlüssel gibt es keine Präfixanforderung.

WegAbgerechnet inVeröffentlichter PreisEndpunkt-Host
Coding Plan Pro (international)Anfragen50 $/Monatcoding-intl.dashscope.aliyuncs.com
Coding Plan Pro (China-Website)Anfragen¥200/Monat, im ersten Monat ¥39,90 für Neukundencoding.dashscope.aliyuncs.com
Token Plan, PersonalGuthabenLite 8 $ (Werbepreis 6 $), Essential 16 $ (10 $), Standard 25 $ (18 $), Pro 80 $ (68 $) pro Monattoken-plan.ap-southeast-1.maas.aliyuncs.com
Token Plan, TeamGuthabenStandard 30 $ (20 $), Pro 100 $ (75 $), Max 200 $ pro Sitzplatz und MonatDerselbe Host in Singapur
Standard-API-SchlüsselTokenPro Modell, nach Eingabelänge gestaffeltdashscope.aliyuncs.com

Auf der Coding-Plan-Seite wird Pro mit 50 $ pro Monat und drei gleichzeitigen Obergrenzen bepreist: bis zu 6.000 Anfragen pro 5 Stunden, 45.000 pro Woche und 90.000 pro Monat. Sobald ein Limit erreicht ist, werden Aufrufe pausiert. Das Wochenkontingent wird montags um 00:00:00 UTC+08:00 und das Monatskontingent an Ihrem Verlängerungsdatum zurückgesetzt. Alibaba weist darauf hin, dass diese Kontingente nicht kumulativ sind und keine gleichmäßig über die Zeit verteilte Kapazität darstellen. Am 1. Oktober 2026 kennzeichnete die Seite Pro außerdem als nur begrenzt verfügbar: Die Plätze werden nach dem Prinzip „Wer zuerst kommt, mahlt zuerst“ vergeben und täglich um 00:00 UTC+08:00 aufgefüllt. Daher ist ein Abonnement an dem Tag, an dem Sie es versuchen, möglicherweise nicht kaufbar.

Was eine Anfrage tatsächlich kostet: Auf derselben Seite steht, dass jede Abfrage das Kontingent entsprechend der Anzahl der Modellaufrufe verbraucht und einfache Aufgaben typischerweise 5–10 Aufrufe benötigen, komplexe Aufgaben 10–30 oder mehr. Eine Anweisung entspricht daher vielen Anfragen. Wörtlich genommen entsprechen 90.000 Anfragen pro Monat ungefähr 3.000 bis 18.000 Aufgaben. Alibaba stellt diese Aufrufzahlen jedoch als typische, nicht als garantierte Werte dar und erklärt, dass der tatsächliche Verbrauch von Aufgabenkomplexität, Kontext und Tool-Nutzung abhängt. Messen Sie dies in Ihrem eigenen Konto, bevor Sie einen Plan dimensionieren.

Zwei veraltete Angaben sollten verworfen werden. Die Lite-Stufe des Coding Plans ist nicht mehr verfügbar — auf der China-Seite steht, dass neue Abonnements am 20. März 2026 und Verlängerungen sowie Upgrades am 13. April 2026 eingestellt wurden. Jede Vergleichsseite, die eine günstigere Lite-Stufe weiterhin als aktive Option anbietet, ist daher veraltet. Außerdem ist der China-Preis von ¥200 nicht der umgerechnete internationale Preis von 50 $: ¥200 liegt bei jedem aktuellen Wechselkurs deutlich unter 50 $. Behandeln Sie die beiden Storefronts daher als getrennte kommerzielle Angebote und bestätigen Sie Preis, Währung und Berechtigung in Ihrer eigenen Konsole, statt anzunehmen, dass eines in das andere umgerechnet wird.

Für den Token Plan sind zwei Hinweise erforderlich. Erstens besteht ein Widerspruch: Die Übersicht zum Token Plan verkauft feste monatliche Credit-Kontingente — am 1. Oktober 2026 lief jede Personal-Stufe mit einem 30-tägigen Abonnementmonat (bei der ersten Erstellung dieser Seite galt ein 7-Tage-Fenster), Team in einem monatlichen Zyklus — pausiert den Dienst bei Erreichen des Kontingents, verkauft Extra Bundles für 15 $ mit 20.000 Credits und erklärt, dass ungenutztes Kontingent nicht übertragen wird. Die Authentifizierungsdokumentation von Qwen Code beschreibt den Token Plan dagegen als nutzungsabhängige Abrechnung für Teams und Unternehmen. Diese Beschreibungen widersprechen sich; die Alibaba-Seite ist diejenige, die ihn verkauft, und sie liest sich wie ein Abonnement. Zweitens erklärt Alibaba, dass der Token Plan derzeit nur in der Region Singapur verfügbar ist, während die Client-Dokumentation auch einen Token-Plan-Host in Peking aufführt. Bestätigen Sie die regionale Verfügbarkeit beim Bezahlvorgang.

Schließlich werden Credits auf der Seite, die sie verkauft, nicht in Token umgerechnet. Die Übersicht zum Token Plan veröffentlicht eine Credit-Anzahl pro Stufe — am 1. Oktober 2026 monatlich 11.500, 25.500, 45.000 und 180.000 Credits für Personal Lite, Essential, Standard und Pro — jedoch keinen Credit-zu-Token-Kurs und keinen Multiplikator pro Modell. Daher lässt sich auf dieser Seite nicht angeben, wie viele Token 18 $ pro Monat kaufen. Falls in Ihrer Konsole an anderer Stelle ein Kurs vorhanden ist, lesen Sie ihn dort ab, statt der Umrechnung eines Drittanbieters zu vertrauen.

Pay-as-you-go-Preise und eine offizielle Seite, deren Gültigkeit abgelaufen ist

Die Model-Studio-Preisseite führt Preise in USD pro Million Token auf, gestaffelt nach der Eingabelänge jeder Anfrage. Die folgende Tabelle zeigt die Spalte für Singapur; dieselbe Seite nennt separate, deutlich niedrigere Preise für China (Peking). Prüfen Sie daher vor der Verwendung dieser Zahlen, in welcher Region Ihr Konto abgerechnet wird.

Modell0–32K Eingabe32K–128K128K–256K256K–1M
qwen3-coder-plus1 $ rein / 5 $ raus$1.8 / $9$3 / $15$6 / $60
qwen3-coder-next0,3 $ Eingabe / 1,5 $ Ausgabe$0.5 / $2.5$0.8 / $4Nicht aufgeführt

Lesen Sie vor der Budgetplanung einer langen Agent-Sitzung die höchste Stufe: Die Ausgabe von qwen3-coder-plus steigt von 5 $ auf 60 $ pro Million Token, sobald die Eingabe einer Anfrage 256K überschreitet. Eine Agent-Unterhaltung mit langem Kontext wird nicht wie eine kurze bepreist. Neue Konten in der Region Singapur erhalten außerdem ein kostenloses Guthaben von 1 Million Token pro Modell, gültig 90 Tage ab Aktivierung, Modellveröffentlichung oder Genehmigung, je nachdem, was später eintritt — ein Testguthaben und keine kostenlose Stufe.

Eine Falle verdient Erwähnung, weil sie sich auf der offiziellen Domain befindet und weiterhin gut platziert ist: Die Seite zur Preissenkung von qwen3-coder-plus kündigt einen Rabatt für den Kontext-Cache an, dessen Aktionszeitraum vom 24. Juli bis zum 23. August 2025 lief. Sie ist offiziell und gleichzeitig abgelaufen. Preise für die anderen Qwen-Modelle haben wir hier nicht abgedruckt, weil die Tabelle für qwen3.7-plus Denk- und Nicht-Denk-Ausgaben in separate Spalten aufteilt und unsere Auswertung nicht zuverlässig genug war, um sie zu veröffentlichen.

Beste API für Qwen Code: den Client auf einen anderen Ort verweisen

Qwen Code unterstützt vier Protokolle — OpenAI Chat Completions, OpenAI Responses, Anthropic und Gemini/Vertex — und jedes kann auf eine benutzerdefinierte Basis-URL verweisen. Die eigene Dokumentation nennt OpenRouter und Fireworks AI nach der Einstellung von OAuth als Alternativen, zu denen gewechselt werden kann. Ein Drittanbieter-Endpunkt ist daher ein unterstützter Weg und kein Workaround. Kunavo stellt /v1/chat/completions, /v1/responses und /v1/messages unter https://api.kunavo.com/v1 bereit; dies sind drei dieser vier Wire-Formate.

Seien Sie sich darüber im Klaren, was Sie dadurch erhalten. Der Kunavo-Katalog enthält kein Qwen-Textmodell; dies ist daher kein günstigerer Weg, Qwen auszuführen. Es ist ein Weg, Claude- oder GPT-Modelle innerhalb von Qwen Code über ein einziges vorausbezahltes Guthaben auszuführen. Kunavo hat Qwen Code außerdem nicht zur Laufzeit gegen diese Endpunkte getestet. Es gibt nun jedoch eine Einrichtungsseite für Qwen Code, die auf Grundlage der eigenen Dokumentation von Qwen Code verfasst wurde, ebenso wie die Seiten zu Cline und OpenCode. Betrachten Sie die folgende Konfiguration als dokumentierten Ausgangspunkt und halten Sie Ihre funktionierende Route während des Tests verfügbar.

OpenAI-kompatibler Pfad, ausschließlich Umgebungsvariablen
export OPENAI_API_KEY="your-kunavo-key"
export OPENAI_BASE_URL="https://api.kunavo.com/v1"
export OPENAI_MODEL="claude-sonnet-5"

Die Basis-URL behält ihr Suffix /v1 bei — jedes OPENAI_BASE_URL-Beispiel in der Dokumentation endet dort, und Qwen Code fügt die Route selbst hinzu. QWEN_MODEL ist ein akzeptierter Alias für OPENAI_MODEL. Die entsprechende Konfiguration in einer einzigen Datei befindet sich in ~/.qwen/settings.json.

Führen Sie diese Felder in ~/.qwen/settings.json zusammen
{
  "modelProviders": {
    "openai": [
      {
        "id": "claude-sonnet-5",
        "name": "Claude Sonnet 5",
        "baseUrl": "https://api.kunavo.com/v1",
        "envKey": "OPENAI_API_KEY"
      }
    ]
  },
  "env": {
    "OPENAI_API_KEY": "your-kunavo-key"
  },
  "security": {
    "auth": {
      "selectedType": "openai"
    }
  },
  "model": {
    "name": "claude-sonnet-5"
  }
}

Vier Konfigurationsdetails aus der Referenz zu Modellanbietern und der oben verlinkten Authentifizierungsdokumentation sparen bei der Fehlersuche viel Zeit. Nur für OpenAI-kompatible Zugangsdaten gibt es CLI-Flags — --openai-api-key und --openai-base-url sind vorhanden, Entsprechungen für Anthropic oder Gemini gibt es nicht. Anbieterspezifische Umgebungsvariablen legen für sich genommen nicht den Authentifizierungstyp fest. Exportieren Sie daher OPENAI_API_KEY statt einer nach dem Anbieter benannten Variablen, wenn Sie die Konfiguration ausschließlich über Umgebungsvariablen vornehmen. Bei der Priorität der Zugangsdaten steht der ausgewählte modelProviders-Eintrag über den CLI-Flags — seine Werte für baseUrl und envKey haben Vorrang vor --openai-base-url und --openai-api-key, was die meisten fälschlicherweise in umgekehrter Reihenfolge erwarten —, danach folgen die CLI-Flags, dann die Umgebungsvariablen und schließlich settings.json. Nur Werte, die während der laufenden Sitzung über /auth eingegeben werden, haben Vorrang vor modelProviders. Zu den Umgebungsvariablen gehören auch die Werte aus der ersten gefundenen .env-Datei. Diese Datei ergänzt jedoch nur Variablen, die noch nicht gesetzt sind — Variablen aus mehreren Dateien werden nicht zusammengeführt. Änderungen an modelProviders werden während einer laufenden Sitzung automatisch neu geladen, während providerProtocol nur einmal beim Start gelesen wird und einen Neustart erfordert.

Zwei Einschränkungen sollten eingeplant werden. Das integrierte web_search-Tool wird von der serverseitigen Suche von DashScope bereitgestellt. Was es aktiviert, ist daher der Host, nicht der Plan: Es ist für ModelStudio Standard API Key und Token Plan aktiviert sowie für einen benutzerdefinierten oder modelProviders-Eintrag, der auf einen erkannten DashScope-Responses-Host mit einem direkten Schlüssel verweist. Für Drittanbieter-Provider und benutzerdefinierte Endpunkte auf jedem anderen Host ist es deaktiviert — ebenso für den kostenpflichtigen Coding Plan, weil dieser Endpunkt für diese API nicht verifiziert ist. Diese letzte Zeile zeigt es: Es handelt sich um eine Host-Sperre, nicht um eine Benachteiligung eigener Schlüssel. Die dokumentierten Alternativen sind ein MCP-Suchserver oder die Weiterleitung von tools.webSearch.model an einen separaten unterstützten DashScope-Schlüssel, während Ihr Hauptmodell anderswo ausgeführt wird. Unabhängig davon erfordert wireApi: "responses" einen tatsächlich Responses-kompatiblen Endpunkt; die Dokumentation besagt, dass es weder eine Endpunkterkennung noch einen automatischen Fallback bei einem fehlgeschlagenen Aufruf gibt. Wir haben Kunavos Responses-Route nicht gegen die Anforderungen von Qwen Code getestet. Beginnen Sie daher mit Chat Completions.

Eine monatliche Schätzung zum Nachrechnen

Nehmen wir einen Monat mit 20 Millionen nicht zwischengespeicherten Eingabe-Token und 1 Million Ausgabe-Token an. Zu den aktuellen Kunavo-Katalogpreisen ergibt diese Rechnung:

ModellEingabe / Ausgabe pro 1 Mio.Geschätzter MonatVorgesehene Rolle
Claude Haiku 4.5$0.70 / $3.50$17.50Begrenzte Bearbeitungen mit hohem Volumen und routinemäßige Programmierarbeit
GPT-5.6 Terra$0.70 / $4.20$18.20Gemischtes Reasoning und Tool-Nutzung
Claude Sonnet 5$1.40 / $7.00$35.00Schwierige Änderungen am Repository

Dies ist eine Tokenberechnung auf Grundlage einer angenommenen Arbeitslast, keine gemessene Qwen-Code-Aufgabe und keine Obergrenze für die Rechnung. Cache-Gebühren, externe Tools und Steuern sind nicht enthalten; außerdem wird angenommen, dass das günstigere Modell die Arbeit ohne zusätzliche Versuche abschließt — genau diese Bedingung entscheidet tatsächlich darüber, ob ein niedrigerer Preis zu einer niedrigeren Rechnung führt. Der Katalogbetrag von Kunavo ist eine Abrechnungsuntergrenze und keine Obergrenze: Wenn der Upstream seine Kosten meldet, entspricht die Rechnung dem höheren Wert aus den Katalogkosten und den Upstream-Kosten multipliziert mit dem anwendbaren Aufschlag. Siehe Abrechnungsdetails.

Beachten Sie, was diese Tabelle nicht leisten kann. Sie kann nicht dem 50-$-Coding-Plan gegenübergestellt werden, da dieser Plan Modellaufrufe misst, während diese Schätzung Tokens misst, und eine Anzahl von Aufrufen keine Tokenanzahl enthält. Auch dem Token Plan kann sie nicht gegenübergestellt werden, da für Credits keine veröffentlichte Token-Umrechnung existiert. Für den Vergleich eines Abonnements mit nutzungsbasierter Abrechnung benötigen Sie Ihre eigene gemessene Nutzung bei beiden Optionen.

Kunavo beginnt mit einer $10 Prepaid-Aufladung ohne Abonnement. Das ist das Guthaben, mit dem Sie ein finanziertes Konto eröffnen, nicht die Kosten einer Aufgabe.

Günstigste API für Qwen Code: Welche Route gewinnt, wenn

AuswählenWann es passtWorauf Sie verzichten
Coding-Plan-AbonnementKonstante tägliche Qwen-Nutzung, die innerhalb der Anfragegrenzen bleibtAufrufe werden bei jeder Grenze pausiert; keine integrierte Websuche; Kontingent wird mit jedem anderen Tool geteilt, das den Schlüssel verwendet
Standardmäßige Pay-as-you-go-TokensUnregelmäßige oder gelegentliche Nutzung sowie Sitzungen mit langem Kontext, deren Preis Sie genau bestimmen möchtenEingabelängenstufen, die den Tarif bei großen Anfragen stark erhöhen
Token-Plan-CreditsSie haben den Credit-Tarif für Ihre Modelle in Ihrer eigenen Konsole bestätigtKeine öffentliche Umrechnung, ein monatliches Kontingent, bei dessen Verbrauch der Dienst pausiert, Verfügbarkeit in Singapur
Ein Gateway wie KunavoSie möchten Claude- oder GPT-Modelle in Qwen Code über ein gemeinsames Prepaid-Guthaben nutzenKeine Qwen-Modelle; Einrichtung eines benutzerdefinierten Anbieters; keine integrierte Websuche
Lokale InferenzSie verfügen über geeignete Hardware und das Modell bewältigt Ihren Tool-WorkflowHardware, Wartung und Zuverlässigkeit bei Tool-Aufrufen liegen in Ihrer Verantwortung

Halten Sie die beiden Fragen auseinander. Der günstigste aufgeführte Preis pro Million Tokens ist eine Tatsache, die Sie einer Seite entnehmen können; die niedrigsten Kosten für den Abschluss Ihrer Aufgabe sind eine Messgröße, die niemand für diesen Client veröffentlicht hat, auch wir nicht. Führen Sie dieselben drei Aufgaben — eine kleine Änderung, eine Fehlerbehebung und eine Untersuchung über mehrere Dateien — über zwei Routen aus und vergleichen Sie die aufgezeichneten Kosten, bevor Sie sich festlegen.

Wenn Sie die Gateway-Route ausprobieren möchten, erstellen Sie ein Kunavo-Konto und folgen Sie anschließend dem Quickstart sowie der Chat-Completions-Referenz für den Endpunkt und die Modell-IDs. Informationen zur gleichen Entscheidung bei anderen Clients finden Sie unter OpenCode-Preise, Cline-Preise und im Leitfaden zur OpenAI-kompatiblen API.

Häufig gestellte Fragen

Wie viel kostet Qwen Code?

Der Client von Qwen Code kostet nichts. Er ist auf GitHub unter QwenLM/qwen-code als Open-Source-Software unter der Apache-2.0-Lizenz verfügbar, ohne kostenpflichtige Stufe, ohne Nutzerlizenzen und ohne Abonnement; auch Desktop-App, Weboberfläche, Editor-Plugins und SDKs werden im selben kostenlosen Repository bereitgestellt. Bezahlt wird die Modellinferenz, die separat beim jeweils konfigurierten Endpunkt erworben wird.

Ist Qwen Code weiterhin kostenlos? Wie hoch ist das kostenlose Qwen-Code-Limit?

Die Software ist weiterhin kostenlos. Die kostenlose gehostete Inferenz ist es nicht: Die Authentifizierungsdokumentation von Qwen Code besagt, dass die kostenlose Qwen-OAuth-Stufe am 2026-04-15 eingestellt wurde und OAuth im Dialog /auth nicht mehr als auswählbarer Eintrag verfügbar ist. Tutorials, die 2.000 Anfragen pro Tag nennen, beschreiben das Kontingent, das bis v0.9.0 im Februar 2026 ausgeliefert wurde. Das verbleibende kostenlose Kontingent auf der Alibaba-Plattform ist ein Neukunden-Guthaben von 1 Million Token pro Modell in der Region Singapur, gültig 90 Tage; es handelt sich um ein Testguthaben und nicht um eine kostenlose Stufe.

Welche API ist die beste für Qwen Code?

Das hängt davon ab, welches Modell Sie verwenden möchten. Für Qwen-Modelle ist Alibaba Cloud Model Studio die offizielle Quelle: ein Coding-Plan-Abonnement bei gleichmäßiger, anfragebasierter Nutzung oder eine Token-Abrechnung nach tatsächlichem Verbrauch bei schwankender Nutzung. Die eigene Dokumentation von Qwen Code nennt OpenRouter und Fireworks AI nach der Einstellung von OAuth ebenfalls als Alternativen. Wenn Sie stattdessen Claude-, GPT- oder Gemini-Modelle innerhalb von Qwen Code ausführen möchten, kann jeder OpenAI-kompatible, Anthropic- oder Gemini-Endpunkt als benutzerdefinierter Provider festgelegt werden.

Welche API ist die günstigste für Qwen Code?

Der niedrigste angegebene Preis pro Million Token und die niedrigsten Kosten zum Abschließen einer Aufgabe sind unterschiedliche Fragen; nur die erste lässt sich anhand einer Preisseite beantworten. Unter den veröffentlichten Preisen von Alibaba für Singapur ist qwen3-coder-next mit 0,30 $ für Eingabe- und 1,50 $ für Ausgabe-Token pro Million Token (Eingabestufe 0–32K) günstiger als qwen3-coder-plus mit 1 $ bzw. 5 $. Ob ein günstigeres Modell für Ihr Repository tatsächlich günstiger ist, hängt davon ab, wie viele Versuche es benötigt; keine veröffentlichte Preistabelle misst dies.

Funktioniert ein Coding-Plan-Abonnement nur mit Qwen Code?

Nein. Auf der Coding-Plan-Seite von Alibaba Cloud werden Claude Code, Cline, Cursor, Codex, OpenCode, OpenClaw, Qoder, Lingma, Cherry Studio, Chatbox und weitere unterstützte Tools aufgeführt; die Modellliste enthält auch Nicht-Qwen-Modelle wie glm-5, kimi-k2.5 und MiniMax-M2.5. Ein Abonnement ist nicht an einen einzelnen Client gebunden. Das bedeutet auch, dass ein anderes Tool Kontingent verbrauchen kann, das Qwen Code dann nicht mehr zur Verfügung steht.

Kann ich Kunavo-Guthaben verwenden, um Qwen-Modelle in Qwen Code zu bezahlen?

Nein. Der Kunavo-Katalog enthält kein Qwen-Textmodell, daher kann Kunavo kein günstigerer Weg zur Qwen-Inferenz sein. Kunavo kann Claude- und GPT-Modelle jedoch über OpenAI-kompatible, Responses- und Anthropic-Messages-Endpunkte bereitstellen; dies sind die von Qwen Code dokumentierten Wire-Formate. Kunavo hat Qwen Code zur Laufzeit nicht gegen diese Endpunkte getestet. Betrachten Sie diese Konfiguration daher als dokumentierten Weg zum Ausprobieren, nicht als verifizierte Integration.

Qwen-Code-Repository, Release-Daten und Dokumentation wurden am 21. September 2026 anhand von github.com/QwenLM/qwen-code, der npm-Registry und der ausgelieferten Dokumentation im Hauptbranch sowie in den Release-Tags v0.9.0 bis v0.15.0 geprüft. Die Seiten zu Alibaba Cloud Coding Plan, Token Plan und Modellpreisen wurden am selben Tag geprüft und am 1. Oktober 2026 erneut geprüft, als die Bedingungen für das Token-Plan-Kontingent und der Hinweis zur Verfügbarkeit des Coding Plans hier aktualisiert wurden. Die Token-Tarife von Kunavo stammen aus dem Live-Katalog; die monatlichen Summen sind illustrative Tokenberechnungen, keine gemessenen Aufgabenkosten.