Zurück zu den Leitfäden
Preise·1. Oktober 2026·Aktualisiert am 3. Oktober 2026·9 Min. Lesezeit

Qwen-Code-Preise: Coding Plan, Token Plan und API nach Verbrauch

Der Client ist kostenlos. Das kostenlose OAuth-Angebot gibt es nicht mehr. Alles andere ist gekaufte Inferenz in vier unterschiedlichen Einheiten.

Qwen Code selbst ist kostenlos: Der Client ist unter Apache-2.0 als Open Source verfügbar, ohne kostenpflichtige Stufe; daher fließt jeder Euro eines Qwen-Code-Budgets in die separat erworbene Modellinferenz. Das kostenlose Qwen-OAuth-Angebot, das die meisten Tutorials noch beschreiben, wurde am 15. April 2026 eingestellt. Im Jahr 2026 beginnt ein Budget daher bei einem kostenpflichtigen Endpunkt: einem Coding Plan von Alibaba Cloud Model Studio, einem Credits-Token-Plan-Abonnement, einer nutzungsabhängigen Abrechnung pro Token oder einem von Ihnen selbst konfigurierten Drittanbieter-Endpunkt.

Diese vier Wege werden in vier verschiedenen Einheiten gemessen — Anfragen, Credits, Token und das, was Ihr eigener Anbieter berechnet —, weshalb ein Vergleich anhand des Einstiegspreises die falsche Antwort liefert. Diese Seite trennt die Softwarekosten von den Inferenzkosten, liefert eine nachrechenbare Schätzung und weist darauf hin, was nicht verifiziert werden konnte. Die ausführliche englische Version ist Qwen Code pricing.

Die Software ist kostenlos, die Modelle nicht

Das Repository QwenLM/qwen-code steht unter Apache-2.0 und wird aktiv entwickelt; die GitHub-API führte es am 1. Oktober 2026 als nicht archiviert, mit einem Push am selben Tag. Versionen erscheinen mindestens wöchentlich: v0.24.7 wurde am 29. September 2026 auf npm (@qwen-code/qwen-code) veröffentlicht. Die Installation erfolgt über ein eigenständiges Skript, npm (Node.js 22 oder höher) oder Homebrew. Dasselbe kostenlose Repository liefert eine Desktop-App, eine Weboberfläche (qwen serve --open), Erweiterungen für VS Code, Zed und JetBrains sowie TypeScript-, Python- und Java-SDKs; keine dieser Oberflächen ist kostenpflichtig und keine beinhaltet Inferenz.

Eine Verwandtschaft, die man abgrenzen sollte: Qwen Code basierte anfangs auf Google Gemini CLI v0.8.2, synchronisiert sich aber seit v0.1 nicht mehr damit. Die Kontingente und Preise von Gemini CLI gelten nicht.

Das kostenlose Limit: Was eingestellt wurde und wann

Die Authentifizierungsdokumentation weist darauf hin, dass das kostenlose Qwen-OAuth-Angebot am 2026-04-15 eingestellt wurde und bereits zwischengespeicherte Token kurzzeitig funktionieren können, neue Anfragen jedoch abgelehnt werden. In der Benutzeroberfläche zeigt die Auswahl von Qwen OAuth nun „Discontinued — switch to Coding Plan or API Key“ an.

ZeitraumKostenloses OAuth-KontingentQuelle
Bis v0.9.0 (npm, 3. Februar 2026)2.000 Anfragen/Tag, 60 Anfragen/MinuteAuthentifizierungsdokumentation im Tag v0.9.0
Ab v0.10.0 (npm, 9. Februar 2026)1.000 Anfragen/Tag, 60 Anfragen/MinuteDieselbe Datei in den Tags v0.10.0 bis v0.14.0
Ab dem 15. April 2026Keine — eingestelltAktuelle Dokumentation; Issue #3316

Das genaue Datum des Wechsels von 2.000 auf 1.000 Anfragen wurde nirgends angekündigt: Die obige Zeitspanne stammt aus dem Versions-Tag, in dem sich die Dokumentation änderte. Die kursierende Zahl von 100 Anfragen pro Tag erscheint in keinem der überprüften Tags; betrachten Sie sie als unbelegt. Qwen-OAuth-Modelle sind außerdem fest codiert und können nicht über modelProviders umgeleitet werden.

Drei offizielle Endpunkte, drei Abrechnungseinheiten

Unter /auth öffnet Alibaba ModelStudio ein Untermenü mit Coding Plan, Token Plan und Standard API Key. Dies sind nicht drei Möglichkeiten, dieselbe Rechnung zu bezahlen: Die Dokumentation nennt für jeden den eigenen Host und Schlüssel und verlangt, den baseUrl für das Schlüsselpaar zu gewähren. Coding-Plan-Schlüssel beginnen mit sk-sp-.

WegAbgerechnet inVeröffentlichter Preis (1. Oktober 2026)Host
Coding Plan Pro (international)Anfragen50 $/Monatcoding-intl.dashscope.aliyuncs.com
Coding Plan Pro (chinesische Website)Anfragen200 ¥/Monat; 39,90 ¥ im ersten Monat für Neukundencoding.dashscope.aliyuncs.com
Token Plan, PersonalGuthabenLite 8 $ (Promo 6 $), Essential 16 $ (10 $), Standard 25 $ (18 $), Pro 80 $ (68 $) pro Monattoken-plan.ap-southeast-1.maas.aliyuncs.com
Token Plan, TeamGuthabenStandard 30 $ (20 $), Pro 100 $ (75 $), Max 200 $ pro Sitzplatz und MonatDerselbe Host in Singapur
Standard API KeyTokenPro Modell, nach Eingabelängestufedashscope.aliyuncs.com

Die Coding-Plan-Seite wendet auf Pro drei gleichzeitige Obergrenzen an: bis zu 6.000 Anfragen pro 5 Stunden, 45.000 pro Woche und 90.000 pro Monat; sobald eine davon erreicht ist, werden die Aufrufe ausgesetzt. Das 5-Stunden-Kontingent wird fortlaufend wieder freigegeben, das Wochenkontingent wird montags um 0 Uhr (UTC+8) zurückgesetzt und das Monatskontingent am Verlängerungsdatum. Am 1. Oktober 2026 wies die Seite außerdem auf eine begrenzte Verfügbarkeit hin: begrenzte Plätze, nach dem Prinzip „Wer zuerst kommt, mahlt zuerst“, täglich aufgefüllt (international um 0 Uhr UTC+8, auf der chinesischen Website um 9:30 Uhr UTC+8). Das Angebot Lite existiert nicht mehr: Neue Abonnements wurden am 20. März 2026 eingestellt, Verlängerungen und Upgrades am 13. April 2026. Und 200 ¥ sind nicht die Umrechnung von 50 $: Behandeln Sie die beiden Schaufenster als separate Angebote.

Was eine Anfrage wirklich kostet: Jede Frage verbraucht Kontingent entsprechend der Anzahl der Modellaufrufe, und Alibaba gibt 5 bis 10 Aufrufe für eine einfache Aufgabe sowie 10 bis 30 oder mehr für eine komplexe Aufgabe an. Eine Anweisung entspricht also mehreren Anfragen; bei diesem Verhältnis entsprechen 90.000 Anfragen pro Monat grob zwischen 3.000 und 18.000 Aufgaben — Alibaba stellt diese Zahlen jedoch als typische Werte dar, nicht als Garantie. Messen Sie in Ihrem Konto, bevor Sie dimensionieren.

Zum Token Plan sind zwei Anmerkungen wichtig. Erstens hat er sich geändert: Am 1. Oktober 2026 wies die Token-Plan-Seite den Personal-Abonnements ein monatliches Kontingent (30-Tage-Zyklus ab dem Abonnementbeginn) von 11.500, 25.500, 45.000 und 180.000 Credits für Lite, Essential, Standard und Pro zu, setzte den Dienst nach Erreichen des Kontingents aus, verkaufte Zusatzpakete für 15 $ je 20.000 Credits und stellte klar, dass nicht verbrauchtes Kontingent nicht übertragen wird. Zweitens wird dort weder eine Umrechnung von Credits in Token noch ein Multiplikator pro Modell veröffentlicht: Nichts erlaubt die Aussage, wie viele Token 18 $ pro Monat kaufen. Das Angebot wird nur in der Region Singapur verkauft.

Nutzungsabhängige Abrechnung pro Token

Die Model-Studio-Preisseite nennt Dollarpreise pro Million Token, gestaffelt nach der Eingabelänge jeder Anfrage. Unten steht die Spalte für Singapur; die Preise für China (Peking) sind davon getrennt und deutlich niedriger, prüfen Sie daher Ihre Abrechnungsregion.

ModellEingabe 0–32K32K–128K128K–256K256K–1M
qwen3-coder-plus1 $ Eingabe / 5 $ Ausgabe$1,8 / $9$3 / $15$6 / $60
qwen3-coder-next0,3 $ Eingabe / 1,5 $ Ausgabe$0,5 / $2,5$0,8 / $4Nicht aufgeführt

Lesen Sie vor der Budgetplanung für eine lange Agentensitzung die letzte Stufe: Die Ausgabe von qwen3-coder-plus steigt von 5 $ auf 60 $ pro Million, sobald die Eingabe einer Anfrage 256K überschreitet. Neue Konten in Singapur erhalten 1 Million kostenlose Token pro Modell, 90 Tage gültig — ein Test, kein kostenloses Angebot. Achten Sie außerdem auf die offizielle Seite zur Preissenkung von qwen3-coder-plus: Der dort angekündigte Cache-Rabatt lief vom 24. Juli bis zum 23. August 2025.

Qwen Code mit einem anderen Endpunkt verbinden

Qwen Code unterstützt vier Protokolle — OpenAI Chat Completions, OpenAI Responses, Anthropic und Gemini/Vertex — und jedes akzeptiert eine benutzerdefinierte Basis-URL; die eigene Dokumentation nennt OpenRouter und Fireworks AI nach der Einstellung von OAuth als Alternativen. Kunavo stellt /v1/chat/completions, /v1/responses und /v1/messages unter https://api.kunavo.com/v1 bereit.

Seien wir klar, was das bringt. Der Kunavo-Katalog enthält keine Qwen-Textmodelle: Dies ist keine günstigere Möglichkeit, Qwen auszuführen, sondern Claude oder GPT in Qwen Code mit einem einzigen vorausbezahlten Guthaben auszuführen. Kunavo hat Qwen Code außerdem nicht gegen diese Endpunkte ausgeführt; die folgende Konfiguration stammt aus der Qwen-Code-Dokumentation, ebenso wie die englische Qwen-Code-Konfigurationsseite.

In ~/.qwen/settings.json zusammenführen
{
  "modelProviders": {
    "openai": [
      {
        "id": "claude-sonnet-5",
        "name": "Claude Sonnet 5",
        "baseUrl": "https://api.kunavo.com/v1",
        "envKey": "KUNAVO_API_KEY"
      }
    ]
  },
  "security": {
    "auth": {
      "selectedType": "openai"
    }
  },
  "model": {
    "name": "claude-sonnet-5"
  }
}

Vier Fakten aus der Referenz zu Modellanbietern, die stundenlanges Debugging vermeiden: Der baseUrl endet bei /v1 (das SDK fügt den Pfad hinzu; mit /v1/chat/completions ergibt sich ein 404); der Schlüssel wird aus der von envKey benannten Variable gelesen, vorzugsweise über .qwen/.env statt im Klartext in settings.json; der ausgewählte Eintrag modelProviders hat Vorrang vor den CLI-Optionen --openai-base-url und --openai-api-key, weshalb es so wirkt, als würden sie ignoriert; und wireApi: "responses" verfügt weder über eine Endpunkterkennung noch über einen automatischen Fallback — beginnen Sie mit Chat Completions.

Zwei Einschränkungen sollten Sie einplanen. Das integrierte Tool web_search nutzt die serverseitige Suche von DashScope: aktiv mit einem Standard API Key oder einem Token Plan, inaktiv mit dem Coding Plan (für diesen Endpunkt nicht verifiziert) sowie inaktiv mit einem Drittanbieter oder einem Endpunkt auf einem anderen Host. Die dokumentierte Alternative ist ein MCP-Suchserver. Und ein Kunavo-Weg unterstützt nur Chat: keine Embeddings, keine Zusammenfassung und keine Spracherkennung.

Eine nachrechenbare monatliche Schätzung

Nehmen wir einen Monat mit 20 Millionen nicht zwischengespeicherten Eingabetoken und 1 Million Ausgabetoken an. Zu den aktuellen Tarifen des Kunavo-Katalogs:

ModellEingabe / Ausgabe pro MillionGeschätzter MonatMögliche Rolle
Claude Haiku 4.5$0,70 / $3,50$17,50Begrenzte Änderungen und hohes Volumen
GPT-5.6 Terra$0,70 / $4,20$18,20Vermischtes Reasoning und Tools
Claude Sonnet 5$1,40 / $7,00$35,00Schwierige Änderungen im Repository

Das ist Arithmetik auf Basis einer angenommenen Auslastung, keine gemessene Qwen-Code-Aufgabe und keine Obergrenze für die Rechnung; Cache, externe Tools und Steuern sind ausgeschlossen, und es wird angenommen, dass das günstigere Modell die Arbeit ohne einen weiteren Versuch abschließt. Der Betrag im Kunavo-Katalog ist eine Abrechnungsuntergrenze, keine Obergrenze: Wenn der vorgelagerte Anbieter seine Kosten meldet, entspricht die Rechnung dem höheren Wert aus den Katalogkosten und den vorgelagerten Kosten multipliziert mit dem geltenden Aufschlag. Diese Tabelle ist nicht mit dem Coding Plan für 50 $ vergleichbar (der Aufrufe und keine Token zählt), ebenso wenig mit dem Token Plan (Credits ohne veröffentlichte Umrechnung): Um ein Abonnement und einen Zähler zu vergleichen, benötigen Sie Ihren eigenen gemessenen Verbrauch auf beiden Seiten.

Kunavo beginnt mit einer vorausbezahlten Aufladung von $10 ohne Abonnement – dem Betrag, der zur Eröffnung eines aufgeladenen Kontos erforderlich ist, nicht dem Preis einer Aufgabe. Der Stripe-Checkout akzeptiert Karten (Visa, Mastercard, American Express), Apple Pay, Google Pay und Link; SEPA-Lastschrift wird derzeit nicht angeboten.

Welchen Weg Sie wann wählen sollten

AuswählenWann es passtWas Sie dafür aufgeben
Coding PlanTägliche und regelmäßige Qwen-Nutzung, die unter den Anfrageobergrenzen bleibtAufrufe werden bei jeder Obergrenze ausgesetzt; keine integrierte Websuche; Kontingent wird mit jedem anderen Tool geteilt, das den Schlüssel verwendet; begrenzte Plätze
Nutzungsabhängige Zahlung pro TokenUnregelmäßige oder gelegentliche Nutzung, lange Sitzungen, die präzise kalkuliert werden sollenEingabelängenstufen, die den Tarif bei großen Anfragen erhöhen
Credits Token PlanSie haben den Credits-Satz Ihrer Modelle in Ihrer Konsole bestätigtKeine öffentliche Umrechnung, monatliches Kontingent setzt den Dienst nach Ausschöpfung aus, nur Singapur
Ein Gateway wie KunavoSie möchten Claude oder GPT in Qwen Code mit einem einzigen vorausbezahlten Guthaben verwendenKeine Qwen-Modelle; manuelle Konfiguration; keine integrierte Websuche
Lokale InferenzSie verfügen über die passende Hardware und das Modell unterstützt Ihre ToolsHardware, Wartung und Zuverlässigkeit der Tool-Aufrufe werden zu Ihrer Verantwortung

Halten Sie die beiden Fragen getrennt: Der Preis pro Million Token lässt sich auf einer Seite ablesen; die niedrigsten Kosten zum Abschließen Ihrer Aufgabe sind eine Messgröße, die niemand für diesen Client veröffentlicht hat, auch wir nicht. Führen Sie dieselben drei Aufgaben — eine kleine Änderung, eine Fehlerbehebung, eine Untersuchung über mehrere Dateien — über zwei Wege aus und vergleichen Sie die aufgezeichneten Beträge. Um den Gateway-Weg auszuprobieren, erstellen Sie ein Kunavo-Konto und folgen Sie anschließend dem Quickstart.

Häufig gestellte Fragen

Wie viel kostet Qwen Code?

Der Qwen-Code-Client kostet nichts: Er ist auf GitHub (QwenLM/qwen-code) unter Apache-2.0 als Open Source verfügbar, ohne kostenpflichtige Stufe, Sitzplatz- oder Abonnementgebühren, und Desktop-App, Weboberfläche, Editor-Erweiterungen und SDKs befinden sich im selben kostenlosen Repository. Bezahlt wird die Modellinferenz, die separat über den von Ihnen konfigurierten Endpunkt erworben wird.

Ist Qwen Code weiterhin kostenlos? Wie hoch ist das kostenlose Kontingent?

Die Software bleibt kostenlos, die kostenlose gehostete Inferenz nicht. Die Authentifizierungsdokumentation von Qwen Code weist darauf hin, dass das kostenlose Qwen-OAuth-Angebot am 15. April 2026 eingestellt wurde und OAuth im Menü /auth nicht mehr auswählbar ist. Tutorials, die 2.000 Anfragen pro Tag ankündigen, beschreiben das bis v0.9.0 im Februar 2026 bereitgestellte Kontingent. Seitens Alibaba bleibt für neue Konten ein Testguthaben: 1 Million Token pro Modell in der Region Singapur, 90 Tage gültig — ein Test, kein kostenloses Angebot.

Wie viel kostet der Alibaba Coding Plan für Qwen Code?

Auf der internationalen Website kostet der Coding Plan Pro 50 $ pro Monat, mit drei gleichzeitigen Obergrenzen: 6.000 Anfragen pro 5-Stunden-Zeitraum, 45.000 pro Woche, 90.000 pro Monat; sobald eine Obergrenze erreicht ist, werden die Aufrufe ausgesetzt. Eine Anfrage entspricht einem Modellaufruf, und Alibaba gibt an, dass eine einfache Aufgabe typischerweise 5 bis 10, eine komplexe Aufgabe 10 bis 30 oder mehr verbraucht. Auf der chinesischen Website kostet derselbe Pro 200 ¥ pro Monat (39,90 ¥ im ersten Monat für Neukunden). Am 1. Oktober 2026 war das Angebot nur begrenzt verfügbar; Plätze wurden täglich aufgefüllt. Das frühere Lite-Angebot wird nicht mehr verkauft.

Welche API ist für Qwen Code am günstigsten?

Der niedrigste Preis pro Million Token und die niedrigsten Kosten zum Abschließen einer Aufgabe sind zwei verschiedene Fragen, und nur die erste lässt sich aus einer Preistabelle ablesen. Unter den von Alibaba für Singapur veröffentlichten Preisen ist qwen3-coder-next mit 0,30 $ Eingabe- und 1,50 $ Ausgabepreis pro Million (Stufe 0–32K) günstiger als qwen3-coder-plus mit 1 $ und 5 $. Ob ein günstigeres Modell in Ihrem Repository tatsächlich günstiger ist, hängt von der Anzahl der Versuche ab, die es benötigt — etwas, das keine Preistabelle misst.

Kann ich Qwen-Modelle mit Kunavo-Guthaben bezahlen?

Nein. Der Kunavo-Katalog enthält keine Qwen-Textmodelle; Kunavo ist daher kein günstigerer Weg zu Qwen. Kunavo kann Claude- und GPT-Modelle über OpenAI-kompatible Endpunkte (Chat Completions und Responses) sowie Anthropic Messages bereitstellen — Formate, die Qwen Code verwenden kann. Kunavo hat Qwen Code nicht gegen diese Endpunkte ausgeführt: Es handelt sich um eine dokumentierte Konfiguration zum Ausprobieren, nicht um eine verifizierte Integration.

Überprüft am 1. Oktober 2026: Repository, Versionen und Dokumentation von Qwen Code (main-Branch und Tags v0.9.0 bis v0.15.0 für die Historie des kostenlosen Kontingents), npm-Registry, Coding-Plan-Seiten (international und chinesische Website), Token Plan und Preise von Model Studio. Die Kunavo-Preise stammen aus dem Live-Katalog; die monatlichen Gesamtsummen sind eine beispielhafte Token-Arithmetik, keine gemessenen Aufgabenkosten.