Qwen Code ist der quelloffene KI-Coding-Agent (Apache-2.0) von Alibabas Qwen-Team. Eingerichtet ist er in vier Schritten: installieren, im Projekt qwen starten, mit /auth den Anbieter wählen, eine Aufgabe stellen. Wichtig vorab: Das kostenlose Qwen-OAuth-Kontingent endete am 15. April 2026 — wer einer älteren Anleitung folgt, kommt damit nicht mehr gratis weiter. Diese Seite folgt dem aktuellen /auth-Menü, zeigt die Umstellung auf Deutsch, die Einrichtung eines eigenen Endpunkts für Claude oder GPT und die wichtigsten Befehle. Die neueste Version ist v0.24.7, am 29. September 2026 auf npm erschienen; Releases kommen mindestens wöchentlich, prüfen Sie Ihre Version mit qwen --version.
Installation
Die Befehle stammen aus dem offiziellen README. Mit dem Standalone-Installer müssen Sie Node.js nicht selbst bereitstellen; nur für npm ist Node.js 22 oder neuer Pflicht.
# macOS / Linux (offizieller Standalone-Installer)
curl -fsSL https://qwen-code-assets.oss-cn-hangzhou.aliyuncs.com/installation/install-qwen-standalone.sh | bash
# Windows (PowerShell)
irm https://qwen-code-assets.oss-cn-hangzhou.aliyuncs.com/installation/install-qwen-standalone.ps1 | iex
# npm (benötigt Node.js 22 oder neuer)
npm install -g @qwen-code/qwen-code@latest
# Homebrew (macOS / Linux)
brew install qwen-codeÖffnen Sie das Terminal danach neu, damit die Umgebungsvariablen greifen. Qwen Code basierte ursprünglich auf Google Gemini CLI v0.8.2, wird aber seit v0.1 unabhängig entwickelt und nicht mehr mit dem Original abgeglichen. Einstellungen und Kontingente von Gemini CLI gelten hier nicht.
Erster Start und deutsche Oberfläche
cd /pfad/zu/ihrem-projekt
qwen
# in der Sitzung:
/language ui de-DE # Oberfläche auf Deutsch
/language output German # Antworten des Modells auf Deutsch
/auth # Anbieter und API-Key einrichtenNach /language ui de-DE zeigt Qwen Code seine eigenen deutschen Bezeichnungen, etwa „Authentifizierungsmethode auswählen“ oder „Werkzeug-Genehmigungsmodus“; diese Seite verwendet dieselben Begriffe. Die Antwortsprache ist davon getrennt und wird mit /language output German gesetzt.
Neben dem Terminal gibt es eine Desktop-App, eine Web-Oberfläche im Browser (qwen serve --open, experimentell), Integrationen für VS Code, Zed und JetBrains sowie den Headless-Modus für Skripte und CI (qwen -p "..."). Alles liegt im selben kostenlosen Repository; die Inferenz zahlen Sie separat.
Den Anbieter mit /auth wählen
/auth (alias /login) öffnet „Authentifizierungsmethode auswählen“ mit drei Optionen auf oberster Ebene. Wer noch Qwen OAuth wählen will, sieht: „Eingestellt — wechseln Sie zu Coding Plan oder API Key“.
| Option | Was dahintersteckt | Abrechnungseinheit |
|---|---|---|
| Alibaba ModelStudio → Coding Plan | Abo für einzelne Entwickler; Keys beginnen mit sk-sp- | Anfragen (Pro $50 pro Monat; gleichzeitig bis zu 6.000 pro 5 Stunden, 45.000 pro Woche, 90.000 pro Monat) |
| Alibaba ModelStudio → Token Plan | Credit-basierter Tarif, derzeit nur in der Region Singapur | Monatliche Credits (Personal Lite $8 bis Pro $80, zeitweise rabattiert) |
| Alibaba ModelStudio → Standard API Key | Vorhandener ModelStudio-API-Key | Tokens, gestaffelt nach Eingabelänge |
| Third-party Providers | Browser-Anmeldung bei externen Anbietern wie OpenRouter oder ModelScope | Tarif des jeweiligen Anbieters |
| Custom Provider | Lokaler Server, Proxy oder nicht unterstützter Anbieter („Eigenen API Key verwenden“) | Tarif des Endpunkts |
Die drei ModelStudio-Wege sind nicht drei Zahlarten derselben Rechnung: Die Dokumentation gibt jedem einen eigenen Endpunkt und einen eigenen Key, und Key-Typ und baseUrl müssen zusammenpassen. Der Coding Plan war am 1. Oktober 2026 als „begrenzt verfügbar, wer zuerst kommt, täglich um 0 Uhr (UTC+8) aufgefüllt“ ausgewiesen — es kann also sein, dass er an einem Tag nicht buchbar ist. Eine Aufgabe verbraucht im Coding Plan mehrere Modellaufrufe; Alibaba nennt typischerweise 5–10 für einfache und 10–30 oder mehr für komplexe Aufgaben. Den Kostenvergleich behandelt die englische Seite Qwen Code pricing ausführlich.
Claude oder GPT nutzen: Custom Provider in settings.json
Die Authentifizierungsdokumentation empfiehlt für Drittanbieter wie OpenAI, Anthropic, Google, OpenRouter oder einen eigenen Endpunkt den Block modelProviders in ~/.qwen/settings.json. Für Kunavo sieht das so aus:
{
"modelProviders": {
"openai": [
{
"id": "claude-sonnet-5",
"name": "Claude Sonnet 5 (Kunavo)",
"baseUrl": "https://api.kunavo.com/v1",
"description": "Kunavo, OpenAI-kompatibel",
"envKey": "KUNAVO_API_KEY"
}
]
},
"security": {
"auth": {
"selectedType": "openai"
}
},
"model": {
"name": "claude-sonnet-5"
}
}# Den Key nicht in settings.json schreiben, sondern in .qwen/.env oder die Umgebung
echo 'KUNAVO_API_KEY=sk-kn-...' >> ~/.qwen/.envVier Punkte, die Fehlersuche sparen:
baseUrlendet bei/v1. Die Referenz zu Model Providers sagt ausdrücklich: auf die/v1-Wurzel der API setzen, nicht auf/v1/chat/completions— den Pfad hängt das SDK selbst an. Mit Pfad gibt es einen 404, keinen Authentifizierungsfehler.- Wo der Key liegt. Qwen Code liest ihn aus der Umgebungsvariable, die
envKeynennt. Rangfolge: Shell-export, dann eine.env-Datei (empfohlen.qwen/.env; nur die erste gefundene Datei zählt), zuletztenvinsettings.json— dort steht der Key im Klartext. - Die Datei schlägt die CLI-Option. Reihenfolge: Werte aus
/auth→ gewähltermodelProviders-Eintrag → CLI-Argumente → Umgebungsvariablen →settings.json. Deshalb wirkt--openai-base-urlmanchmal wirkungslos.security.auth.apiKeyundsecurity.auth.baseUrlaus älteren Anleitungen sind veraltet. - Mit Chat Completions anfangen. Ohne
wireApigilt Chat Completions. Mit"responses"gibt es weder Endpunkterkennung noch automatischen Rückfall. Änderungen anmodelProvidersgreifen auch in einer laufenden Sitzung (/modelneu öffnen).
Im Kunavo-Katalog gibt es kein Qwen-Textmodell. Das ist also kein günstigerer Weg zu Qwen, sondern ein Weg, Claude oder GPT in Qwen Code über ein Prepaid-Guthaben zu nutzen. Kunavo hat Qwen Code auch nicht selbst gegen seinen Endpunkt laufen lassen; die Konfiguration stammt wie die englische Qwen-Code-Einrichtungsseite aus der offiziellen Dokumentation. Behalten Sie eine funktionierende Route, während Sie es ausprobieren.
Erste Aufgabe und wichtige Befehle
Das README schlägt als ersten Auftrag sinngemäß vor: „Erkläre dieses Repository und zeig mir, wo ich anfangen soll.“ Das prüft Dateizugriff und Werkzeugaufrufe auf einmal — ein bloßes „Hallo“ deckt Verbindungsprobleme nicht auf.
| Befehl | Wofür |
|---|---|
/init | Aktuelles Verzeichnis analysieren und eine erste Kontextdatei anlegen |
/model | Modell wechseln; die Einträge aus modelProviders erscheinen nach Protokoll gruppiert |
/approval-mode | Werkzeug-Genehmigungsmodus: default fragt bei Änderungen, auto-edit genehmigt Änderungen automatisch, yolo genehmigt alles inklusive Shell und Netzwerk |
/compress | Verlauf durch eine Zusammenfassung ersetzen, um Tokens zu sparen |
/stats (/usage) | Nutzungsstatistik; /stats model zeigt Tokens und geschätzte Kosten pro Modell |
/restore | Dateien auf den Stand vor einem Werkzeugaufruf zurücksetzen |
/resume | Eine frühere Sitzung fortsetzen |
/clear | Verlauf löschen und Kontext freimachen |
/help | Befehlsübersicht |
Für yolo und die anderen automatischen Modi warnt die Dokumentation selbst: nur in vertrauenswürdigen, isolierten oder Wegwerf-Umgebungen. Die geschätzten Kosten in /stats model rechnet Qwen Code selbst aus; der tatsächliche Betrag steht im Nutzungsprotokoll Ihres Anbieters.
Grenzen, die Sie kennen sollten
- Die eingebaute Websuche hängt am Host. Sie nutzt DashScopes serverseitige Suche: an für ModelStudio Standard API Key und Token Plan sowie Einträge auf einem erkannten DashScope-Host, aus für den Coding Plan (dort nicht verifiziert) und aus für Drittanbieter und eigene Endpunkte auf anderen Hosts (Dokumentation zu web_search). Alternative: ein MCP-Suchserver.
- Über Kunavo läuft nur Chat. Kunavo bietet keine Embedding-, Sprachausgabe- oder Spracherkennungsmodelle. Qwen Codes Live Voice verlangt ohnehin einen DashScope-Endpunkt und bleibt bei seinem eigenen Key, egal wohin das Chatmodell zeigt.
Bezahlen, wenn Sie Kunavo ausprobieren
Kunavo arbeitet mit Prepaid-Guthaben ohne Abo und rechnet pro Token ab. Die Mindestaufladung beträgt $10; im Stripe-Checkout stehen Karten (Visa, Mastercard, American Express), Apple Pay und Link zur Verfügung — eine SEPA-Lastschrift wird derzeit nicht angeboten. Details unter Abrechnung; mit einem Konto erstellen Sie den Key. Nach der ersten Aufgabe zeigt das Nutzungsprotokoll den tatsächlichen Betrag.
FAQ
Ist Qwen Code kostenlos?
Die Software ja (Apache-2.0), die kostenlose Inferenz nicht mehr. Laut Qwen-Code-Dokumentation wurde das kostenlose Kontingent von Qwen OAuth am 15. April 2026 eingestellt, und Qwen OAuth ist im /auth-Dialog nicht mehr auswählbar. Anleitungen mit „2.000 Anfragen pro Tag gratis“ beschreiben den Stand bis v0.9.0 im Februar 2026. Heute bezahlen Sie die Inferenz: über Alibaba Clouds Coding Plan, Token Plan oder einen API-Key mit Token-Abrechnung, über Drittanbieter wie OpenRouter oder über einen eigenen Endpunkt.
Was brauche ich, um Qwen Code zu installieren?
Mit dem offiziellen Standalone-Installer (curl unter macOS/Linux, irm in der PowerShell unter Windows) brauchen Sie kein eigenes Node.js. Für die npm-Installation ist Node.js 22 oder neuer nötig: npm install -g @qwen-code/qwen-code@latest. Mit Homebrew: brew install qwen-code. Danach das Terminal neu öffnen und im Projektverzeichnis qwen starten.
Kann ich die Oberfläche von Qwen Code auf Deutsch umstellen?
Ja. In der Sitzung stellt /language ui de-DE die Oberfläche auf Deutsch um, /language output German legt die Antwortsprache des Modells fest. Eingebaut sind laut Befehlsdokumentation (geprüft am 1. Oktober 2026) vereinfachtes Chinesisch, Englisch, Russisch, Deutsch, Japanisch, brasilianisches Portugiesisch, Französisch und Katalanisch.
Kann Qwen Code Claude- oder GPT-Modelle nutzen?
Ja. Ein OpenAI-kompatibler Endpunkt unter modelProviders in ~/.qwen/settings.json reicht die Modell-ID unverändert an den Endpunkt weiter; bietet dieser Claude oder GPT an, funktioniert es. baseUrl endet bei /v1 — mit /v1/chat/completions gibt es einen 404. Kunavo hat diese Konfiguration aus der Qwen-Code-Dokumentation erstellt, Qwen Code aber nicht selbst gegen seinen Endpunkt ausgeführt.
Warum ignoriert Qwen Code --openai-base-url?
Weil ein modelProviders-Eintrag Vorrang hat. Die dokumentierte Reihenfolge ist: Werte aus /auth in der laufenden Sitzung, dann baseUrl und envKey des gewählten modelProviders-Eintrags, dann CLI-Argumente, dann Umgebungsvariablen, dann settings.json. Solange ein Eintrag gewählt ist, gewinnt dessen baseUrl. Bearbeiten Sie den Eintrag oder entfernen Sie ihn, wenn die Option greifen soll.
Geprüft am 1. Oktober 2026: README von Qwen Code, die Dokumentation zu Authentifizierung, Model Providers, Befehlen und web_search (Branch main), die deutschen UI-Texte (packages/cli/src/i18n/locales/de.js), @qwen-code/qwen-code 0.24.7 auf npm sowie Alibaba Clouds Seiten zu Coding Plan und Token Plan. Kunavo hat Qwen Code nicht gegen seinen Endpunkt ausgeführt.