Qwen Code lui-même est gratuit : le client est open source sous licence Apache-2.0, sans formule payante ; chaque dollar d’un budget Qwen Code correspond donc à de l’inférence de modèle achetée séparément. La formule gratuite Qwen OAuth que décrivent encore la plupart des tutoriels a été supprimée le 15 avril 2026, ce qui signifie qu’un budget 2026 commence par un point de terminaison payant : un Alibaba Cloud Model Studio Coding Plan, un forfait Token Plan Credit, une facturation des tokens à l’usage ou un point de terminaison tiers que vous configurez vous-même dans le client.
Ces quatre voies sont mesurées selon quatre unités différentes — requêtes, Credits, tokens et le montant facturé par votre propre fournisseur — ; c’est pourquoi les comparer uniquement à leur prix affiché mène à une mauvaise conclusion. Cette page sépare le coût du logiciel de celui de l’inférence, présente une estimation des tokens recalculable et signale les chiffres qui n’ont pas pu être vérifiés.
Coût du logiciel et coût des modèles
Le répertoire QwenLM/qwen-code est sous licence Apache-2.0 et activement développé ; l’API GitHub l’indiquait comme non archivé le 21 septembre 2026. Les versions sortent chaque semaine ou plus souvent : v0.24.0 a été publié sur npm sous le nom @qwen-code/qwen-code le 16 septembre 2026, puis v0.24.2 le 20 septembre ; consultez donc le registre au lieu de vous fier à une version affichée sur une page. L’installation se fait via npm (Node.js 22 ou version ultérieure), Homebrew ou un programme d’installation autonome.
Le qualifier désormais de CLI de terminal est réducteur. Le titre du README le décrit comme un agent de programmation IA open source pour le terminal, l’éditeur, le bureau, le navigateur et le chat ; le projet fournit une application de bureau, une interface web lancée avec qwen serve --open, des plugins pour VS Code, Zed et JetBrains, des SDK TypeScript, Python et Java, ainsi que des canaux de discussion. Le champ de description GitHub du dépôt le décrit toujours comme un agent présent dans votre terminal ; les deux descriptions divergent donc, et c’est le README qui répertorie les surfaces supplémentaires. Aucune de ces surfaces ne constitue une mise à niveau payante : elles appartiennent toutes au même dépôt gratuit et aucune n’inclut l’inférence.
Une filiation à écarter : Qwen Code était à l’origine basé sur Google Gemini CLI v0.8.2, mais le projet indique avoir cessé de se synchroniser avec l’amont à partir de v0.1 et se développer indépendamment. Les quotas et tarifs de Gemini CLI ne se transfèrent pas.
Limite gratuite de Qwen Code : ce qui a pris fin et quand
La documentation d’authentification indique que la formule gratuite Qwen OAuth a été supprimée le 2026-04-15 et que les tokens mis en cache existants peuvent continuer à fonctionner brièvement tandis que les nouvelles requêtes sont rejetées. OAuth n’est plus une option sélectionnable dans la boîte de dialogue /auth ; il reste documenté uniquement comme fournisseur supprimé. C’est le fait le plus obsolète dans les résultats de recherche consacrés à ce sujet.
| Période | Allocation OAuth gratuite | Preuve |
|---|---|---|
| Jusqu’à v0.9.0 (npm, 3 février 2026) | 2 000 requêtes/jour, 60 requêtes/minute | La documentation d’authentification était incluse dans la balise v0.9.0 |
| À partir de v0.10.0 (npm, 9 février 2026) | 1 000 requêtes/jour, 60 requêtes/minute | Même fichier dans les balises v0.10.0 à v0.14.0 |
| À partir du 15 avril 2026 | Aucune — supprimée | Documentation d’authentification actuelle ; problème n°3316, ouvert le 16 avril et fermé |
Deux précautions concernant ce tableau. La date calendaire exacte à laquelle le quota quotidien est passé de 2 000 à 1 000 n’a été annoncée nulle part de ce que nous avons pu trouver ; l’intervalle ci-dessus est déduit de la balise de version dans laquelle la documentation fournie a changé, et non d’une annonce de Qwen. De même, l’affirmation largement répétée selon laquelle le quota serait passé à 100 par jour avant l’arrêt n’apparaît dans aucune des balises de version que nous avons vérifiées : v0.9.0 à v0.14.0 sont les versions qui indiquent un quota, d’abord 2 000 puis 1 000, et à partir de v0.15.0 le fichier n’indique plus aucun quota, car la formule avait déjà été supprimée. Considérez le chiffre de 100 par jour comme non étayé. Aucun article de blog ni communiqué de presse officiel sur l’arrêt n’a non plus été trouvé ; il a donc été documenté plutôt qu’annoncé.
Deux autres contraintes comptent pour quiconque espère rétablir la voie gratuite. Les modèles Qwen OAuth sont codés en dur et ne peuvent pas être remplacés via modelProviders ; la voie supprimée ne peut donc pas être simplement redirigée vers un autre point de terminaison. De plus, OAuth n’a jamais été utilisable sans interface : la documentation indique que dans les environnements CI, SSH ou conteneurisés, il est généralement impossible de terminer le flux de connexion dans le navigateur.
Trois points de terminaison officiels, trois unités de facturation
Dans /auth, Alibaba ModelStudio ouvre un sous-menu proposant Coding Plan, Token Plan et Standard API Key. Il ne s’agit pas de trois façons de payer la même facture : la documentation attribue à chacun son propre hôte de point de terminaison et sa propre clé, et vous demande d’associer le baseUrl au forfait auquel la clé appartient. Les clés Coding Plan commencent par sk-sp- ; les clés Token Plan n’imposent aucun préfixe.
| Formule | Facturé en | Prix publié | Hôte du point de terminaison |
|---|---|---|---|
| Coding Plan Pro (international) | Requêtes | $50/mois | coding-intl.dashscope.aliyuncs.com |
| Coding Plan Pro (site chinois) | Requêtes | ¥200/mois, premier mois à ¥39.90 pour les nouveaux clients | coding.dashscope.aliyuncs.com |
| Token Plan, Personal | Crédits | Lite $8 (promotionnel $6), Essential $16 ($10), Standard $25 ($18), Pro $80 ($68) par mois | token-plan.ap-southeast-1.maas.aliyuncs.com |
| Token Plan, Team | Crédits | Standard $30 ($20), Pro $100 ($75), Max $200 par siège et par mois | Même hôte de Singapour |
| Clé API standard | Tokens | Par modèle, par paliers selon la longueur d’entrée | dashscope.aliyuncs.com |
La page Coding Plan affiche Pro à $50 par mois avec trois plafonds simultanés : jusqu’à 6 000 requêtes par 5 heures, 45 000 par semaine et 90 000 par mois. Lorsqu’une limite est atteinte, les appels sont suspendus. Le quota hebdomadaire est réinitialisé le lundi à 00:00:00 UTC+08:00 et le quota mensuel à la date de renouvellement. Alibaba précise qu’ils ne sont pas cumulatifs et ne représentent pas une capacité répartie uniformément dans le temps. Le 1er octobre 2026, la page indiquait également que Pro était à disponibilité limitée : les places sont attribuées selon le principe du premier arrivé, premier servi et réapprovisionnées chaque jour à 00:00 UTC+08:00 ; un abonnement peut donc être impossible à acheter le jour où vous essayez.
Ce qu’une requête vous coûte réellement : la même page indique que chaque requête consomme du quota selon le nombre d’appels de modèle, et que les tâches simples utilisent généralement 5 à 10 appels, tandis que les tâches complexes en utilisent 10 à 30 ou davantage. Une instruction correspond donc à plusieurs requêtes. Si l’on prend ces chiffres au pied de la lettre, 90 000 requêtes par mois représentent entre environ 3 000 et 18 000 tâches — mais Alibaba présente ces nombres d’appels comme typiques et non garantis, et précise que la consommation réelle varie selon la complexité de la tâche, le contexte et l’utilisation des outils. Mesurez-la sur votre propre compte avant de dimensionner un forfait.
Deux chiffres obsolètes à écarter. Le palier Lite du Coding Plan a disparu — la page chinoise indique que les nouveaux abonnements ont cessé le 20 mars 2026, et les renouvellements et mises à niveau le 13 avril 2026 — ; tout site comparatif qui propose encore un palier Lite moins cher comme option disponible est donc obsolète. De plus, le prix chinois de ¥200 n’est pas le prix international de $50 converti : ¥200 est nettement inférieur à $50 à tout taux de change récent ; considérez donc les deux vitrines comme des offres commerciales distinctes et confirmez le prix, la devise et l’éligibilité dans votre propre console au lieu de supposer que l’une se convertit dans l’autre.
Token Plan nécessite deux précisions. Premièrement, il existe une contradiction : la présentation de Token Plan vend des quotas mensuels fixes de Credits — au 1er octobre 2026, chaque palier Personal fonctionnait sur un mois d’abonnement de 30 jours (il utilisait une fenêtre de 7 jours lors de la première rédaction de cette page), et Team sur un cycle mensuel —, suspend le service lorsque le quota est atteint, vend des Extra Bundles à $15 pour 20 000 Credits et indique que le quota inutilisé n’est pas reporté ; tandis que la documentation d’authentification de Qwen Code décrit Token Plan comme une facturation à l’usage pour les équipes et les entreprises. Ces descriptions divergent ; la page Alibaba est celle qui le commercialise et elle se présente comme un abonnement. Deuxièmement, Alibaba indique que Token Plan est actuellement disponible uniquement dans la région de Singapour, alors que la documentation du client répertorie également un hôte Token Plan de Pékin. Confirmez la disponibilité régionale au moment du paiement.
Enfin, la page qui vend les Credits ne les convertit pas en tokens. La présentation de Token Plan publie un nombre de Credits par palier — 11 500, 25 500, 45 000 et 180 000 Credits par mois pour Personal Lite, Essential, Standard et Pro au 1er octobre 2026 — mais aucun taux de conversion Credits-tokens ni multiplicateur par modèle ; rien sur cette page ne permet donc d’indiquer ce que $18 par mois achètent en tokens. Si un taux existe ailleurs dans votre console, lisez-le à cet endroit plutôt que de vous fier à la conversion d’un tiers.
Tarifs à l’usage et page officielle expirée
La page tarifaire de Model Studio indique les tarifs en USD par million de tokens, par paliers selon la longueur d’entrée de chaque requête. Le tableau ci-dessous correspond à la colonne Singapour ; la même page indique des tarifs distincts et sensiblement inférieurs pour la Chine (Pékin), vérifiez donc la région dans laquelle votre compte est facturé avant d’utiliser ces chiffres.
| Modèle | Entrée 0-32K | 32K-128K | 128K-256K | 256K-1M |
|---|---|---|---|---|
| qwen3-coder-plus | $1 en entrée / $5 en sortie | $1.8 / $9 | $3 / $15 | $6 / $60 |
| qwen3-coder-next | $0.3 en entrée / $1.5 en sortie | $0.5 / $2.5 | $0.8 / $4 | Non indiqué |
Consultez le palier supérieur avant de budgétiser une longue session d’agent : la sortie de qwen3-coder-plus passe de $5 à $60 par million de tokens dès que l’entrée d’une requête dépasse 256K. Une conversation d’agent avec un long contexte n’est pas tarifée comme une conversation courte. Les nouveaux comptes de la région de Singapour reçoivent également une attribution gratuite de 1 million de tokens par modèle, valable 90 jours à compter de l’activation, de la sortie du modèle ou de l’approbation, selon la date la plus tardive ; il s’agit d’une attribution d’essai, pas d’une formule gratuite.
Un piège mérite d’être signalé, car il se trouve sur le domaine officiel et reste bien classé : la page de baisse de prix de qwen3-coder-plus annonce une remise sur le cache de contexte dont la période promotionnelle allait du 24 juillet au 23 août 2025. Elle est officielle et expirée en même temps. Nous n’avons pas imprimé ici les tarifs des autres modèles Qwen, car le tableau de qwen3.7-plus sépare la sortie avec réflexion et sans réflexion en colonnes distinctes, et notre lecture n’était pas suffisamment fiable pour être publiée.
Meilleure API pour Qwen Code : rediriger le client ailleurs
Qwen Code utilise quatre protocoles — OpenAI Chat Completions, OpenAI Responses, Anthropic et Gemini/Vertex — et chacun peut être dirigé vers une URL de base personnalisée. Sa documentation cite OpenRouter et Fireworks AI comme alternatives vers lesquelles basculer après l’arrêt d’OAuth ; un point de terminaison tiers constitue donc une voie autorisée, et non un contournement. Kunavo fournit /v1/chat/completions, /v1/responses et /v1/messages sous https://api.kunavo.com/v1, soit trois de ces quatre formats de protocole.
Il faut bien comprendre ce que cela permet d’acheter. Le catalogue Kunavo ne contient aucun modèle de texte Qwen ; il ne s’agit donc pas d’une façon moins chère d’exécuter Qwen. Il s’agit d’une façon d’exécuter des modèles Claude ou GPT dans Qwen Code avec un seul solde prépayé. Kunavo n’a pas non plus testé Qwen Code en conditions réelles avec ces points de terminaison, bien qu’il existe désormais une page de configuration de Qwen Code, rédigée à partir de la documentation de Qwen Code elle-même, comme les pages Cline et OpenCode. Considérez la configuration ci-dessous comme un point de départ documenté et conservez votre voie opérationnelle pendant vos essais.
export OPENAI_API_KEY="your-kunavo-key"
export OPENAI_BASE_URL="https://api.kunavo.com/v1"
export OPENAI_MODEL="claude-sonnet-5"L’URL de base conserve son suffixe /v1 — chaque exemple OPENAI_BASE_URL de la documentation se termine ainsi, et Qwen Code ajoute lui-même la route. QWEN_MODEL est un alias accepté de OPENAI_MODEL. La configuration équivalente dans un seul fichier se trouve dans ~/.qwen/settings.json.
{
"modelProviders": {
"openai": [
{
"id": "claude-sonnet-5",
"name": "Claude Sonnet 5",
"baseUrl": "https://api.kunavo.com/v1",
"envKey": "OPENAI_API_KEY"
}
]
},
"env": {
"OPENAI_API_KEY": "your-kunavo-key"
},
"security": {
"auth": {
"selectedType": "openai"
}
},
"model": {
"name": "claude-sonnet-5"
}
}Quatre points de configuration tirés de la référence des fournisseurs de modèles et de la documentation sur l’authentification dont le lien figure ci-dessus permettent de gagner un temps précieux lors du débogage. Seuls les identifiants compatibles avec OpenAI disposent d’options CLI — --openai-api-key et --openai-base-url existent, et il n’y a aucun équivalent pour Anthropic ou Gemini. Les variables d’environnement propres à un fournisseur ne sélectionnent pas à elles seules le type d’authentification ; exportez donc OPENAI_API_KEY plutôt qu’une variable portant le nom d’un fournisseur si vous configurez cela uniquement au moyen de variables d’environnement. L’ordre de priorité des identifiants place l’entrée modelProviders sélectionnée au-dessus des options CLI — ses valeurs baseUrl et envKey ont priorité sur --openai-base-url et --openai-api-key, ce qui est précisément l’ordre que la plupart des gens supposent inversé — viennent ensuite les options CLI, puis les variables d’environnement, puis settings.json. Seules les valeurs saisies via /auth dans la session en cours ont priorité sur modelProviders. Les variables d’environnement comprennent toutes celles fournies par le premier fichier .env trouvé, et ce fichier ne renseigne que les variables qui ne sont pas déjà définies — les variables de plusieurs fichiers ne sont pas fusionnées. Enfin, les modifications de modelProviders sont rechargées à chaud dans une session en cours, tandis que providerProtocol n’est lu qu’une fois au démarrage et nécessite un redémarrage.
Deux limites sont à prendre en compte. L’outil intégré web_search repose sur la recherche côté serveur de DashScope ; ce qui l’active est donc l’hôte, et non le forfait : il est activé pour ModelStudio Standard API Key et Token Plan, ainsi que pour une entrée personnalisée ou modelProviders qui pointe vers un hôte Responses DashScope reconnu avec une clé directe. Il est désactivé pour les fournisseurs tiers et pour les points de terminaison personnalisés sur tout autre hôte — et également pour le Coding Plan payant, car ce point de terminaison n’est pas vérifié pour cette API. Cette dernière ligne le révèle : il s’agit d’une restriction liée à l’hôte, et non d’une pénalité pour l’utilisation de votre propre clé. Les alternatives documentées sont un serveur de recherche MCP ou le fait de diriger tools.webSearch.model vers une clé DashScope prise en charge distincte, tandis que votre modèle principal s’exécute ailleurs. Par ailleurs, wireApi: "responses" nécessite un point de terminaison véritablement compatible avec Responses, et la documentation précise qu’il n’existe ni détection du point de terminaison ni solution de repli automatique en cas d’échec d’un appel. Nous n’avons pas testé la route Responses de Kunavo avec les exigences de Qwen Code ; commencez donc par Chat Completions.
Une estimation mensuelle que vous pouvez recalculer
Supposons un mois comprenant 20 millions de tokens d’entrée non mis en cache et 1 million de tokens de sortie. Aux tarifs actuels du catalogue Kunavo, le calcul donne :
| Modèle | Entrée / sortie par million | Mois estimé | Rôle candidat |
|---|---|---|---|
| Claude Haiku 4.5 | $0.70 / $3.50 | $17.50 | Modifications limitées à fort volume et travaux de programmation courants |
| GPT-5.6 Terra | $0.70 / $4.20 | $18.20 | Raisonnement mixte et utilisation d’outils |
| Claude Sonnet 5 | $1.40 / $7.00 | $35.00 | Modifications difficiles d’un dépôt |
Il s’agit d’un calcul de tokens fondé sur une charge de travail supposée, et non d’une tâche Qwen Code mesurée ni d’un plafond de facture. Il exclut les frais de cache, les outils externes et les taxes, et suppose que le modèle moins cher termine le travail sans tentatives supplémentaires — condition qui détermine réellement si un tarif inférieur produit une facture inférieure. Le montant du catalogue Kunavo constitue un plancher de facturation, et non un plafond : lorsque l’amont communique ses frais, la facture correspond au montant le plus élevé entre le coût du catalogue et le coût amont multiplié par la majoration applicable. Consultez les détails de facturation.
Notez ce que ce tableau ne peut pas faire. Il ne peut pas être comparé au Coding Plan à $50, car ce forfait mesure les appels de modèle tandis que cette estimation mesure les tokens, et un nombre d’appels ne fournit aucun nombre de tokens. Il ne peut pas non plus être comparé au Token Plan, car aucune conversion publiée des Credits en tokens n’existe. Pour comparer un abonnement à une facturation à l’usage, vous devez mesurer vous-même l’utilisation dans les deux cas.
Kunavo commence par un rechargement prépayé de $10 sans abonnement. Il s’agit de la somme nécessaire pour ouvrir un compte approvisionné, et non du coût d’une tâche.
API la moins chère pour Qwen Code : quelle voie l’emporte selon le cas
| Choisir | Quand elle convient | Ce à quoi vous renoncez |
|---|---|---|
| Abonnement Coding Plan | Utilisation quotidienne régulière de Qwen qui reste dans les limites de requêtes | Appels interrompus à toute limite ; aucune recherche web intégrée ; quota partagé avec tout autre outil utilisant la clé |
| Tokens standard à la consommation | Utilisation irrégulière ou occasionnelle, et sessions à long contexte dont vous souhaitez calculer précisément le prix | Paliers selon la longueur d’entrée qui augmentent fortement le tarif pour les grandes requêtes |
| Crédits du forfait de tokens | Vous avez confirmé le tarif des crédits pour vos modèles dans votre propre console | Aucune conversion publique, quota mensuel qui interrompt le service une fois épuisé, disponibilité à Singapour |
| Une passerelle telle que Kunavo | Vous voulez utiliser les modèles Claude ou GPT dans Qwen Code avec un seul solde prépayé | Aucun modèle Qwen ; configuration d’un fournisseur personnalisé ; aucune recherche web intégrée |
| Inférence locale | Vous disposez du matériel adéquat et le modèle gère votre flux de travail avec les outils | Le matériel, la maintenance et la fiabilité des appels d’outils deviennent votre responsabilité |
Gardez les deux questions séparées. Le prix affiché le plus bas par million de tokens est un fait que vous pouvez relever sur une page ; le coût le plus bas pour terminer votre tâche est une mesure que personne n’a publiée pour ce client, y compris nous. Exécutez les mêmes trois tâches — une petite modification, une correction de bug et une investigation sur plusieurs fichiers — avec deux méthodes, puis comparez les frais enregistrés avant de vous engager.
Si vous souhaitez essayer la méthode via une passerelle, créez un compte Kunavo, puis suivez le guide de démarrage rapide et la référence Chat Completions pour connaître le point de terminaison et les identifiants de modèle. Pour la même décision avec d’autres clients, consultez les pages tarifs d’OpenCode, tarifs de Cline et guide de l’API compatible avec OpenAI.
Questions fréquentes
Combien coûte Qwen Code ?
Le client Qwen Code est gratuit. Il est open source sous licence Apache-2.0 sur GitHub, dans QwenLM/qwen-code, sans formule payante, sans siège ni abonnement ; l’application de bureau, l’interface web, les plugins d’éditeur et les SDK sont distribués dans le même dépôt gratuit. Ce que vous payez, c’est l’inférence des modèles, achetée séparément auprès du point de terminaison que vous configurez.
Qwen Code est-il toujours gratuit ? Quelle est la limite gratuite de Qwen Code ?
Le logiciel est toujours gratuit. L’inférence hébergée gratuite ne l’est pas : la documentation d’authentification de Qwen Code indique que la formule gratuite Qwen OAuth a été supprimée le 2026-04-15, et OAuth n’est plus une option sélectionnable dans la boîte de dialogue /auth. Les tutoriels mentionnant 2 000 requêtes par jour décrivent le quota fourni jusqu’à la version v0.9.0 en février 2026. L’allocation gratuite restante sur la plateforme d’Alibaba est une attribution destinée aux nouveaux comptes de 1 million de tokens par modèle dans la région de Singapour, valable 90 jours ; il s’agit d’une attribution d’essai, pas d’une formule gratuite.
Quelle est la meilleure API pour Qwen Code ?
Cela dépend du modèle que vous souhaitez utiliser. Pour les modèles Qwen en particulier, Alibaba Cloud Model Studio est la source officielle : un abonnement Coding Plan si votre utilisation est régulière et structurée par requêtes, ou une facturation des tokens à l’usage si elle est irrégulière. La documentation de Qwen Code cite également OpenRouter et Fireworks AI comme alternatives après l’arrêt d’OAuth. Si vous souhaitez exécuter des modèles Claude, GPT ou Gemini dans Qwen Code, tout point de terminaison compatible avec OpenAI, Anthropic ou Gemini peut être défini comme fournisseur personnalisé.
Quelle est l’API la moins chère pour Qwen Code ?
Le prix affiché le plus bas par million de tokens et le coût le plus bas pour terminer une tâche sont deux questions différentes, et seule la première peut être résolue à partir d’une page tarifaire. Parmi les tarifs publiés par Alibaba pour Singapour, qwen3-coder-next, à $0.30 en entrée et $1.50 en sortie par million de tokens (palier d’entrée 0-32K), est moins cher que qwen3-coder-plus, à $1 et $5. Pour savoir si un modèle moins cher est réellement plus économique pour votre dépôt, il faut connaître le nombre de tentatives nécessaires, ce qu’aucun tableau tarifaire publié ne mesure.
Un abonnement Coding Plan fonctionne-t-il uniquement avec Qwen Code ?
Non. La page Coding Plan d’Alibaba Cloud cite Claude Code, Cline, Cursor, Codex, OpenCode, OpenClaw, Qoder, Lingma, Cherry Studio, Chatbox et d’autres outils parmi ceux pris en charge, et sa liste de modèles inclut des modèles non-Qwen tels que glm-5, kimi-k2.5 et MiniMax-M2.5. Un abonnement n’est pas lié à un seul client, ce qui signifie également que le quota consommé par un autre outil est du quota dont Qwen Code ne dispose plus.
Puis-je utiliser un crédit Kunavo pour payer des modèles Qwen dans Qwen Code ?
Non. Le catalogue de Kunavo ne contient aucun modèle de texte Qwen ; Kunavo ne peut donc pas constituer une voie moins chère vers l’inférence Qwen. En revanche, Kunavo peut servir des modèles Claude et GPT via des points de terminaison compatibles avec OpenAI, Responses et Anthropic Messages, formats de protocole que Qwen Code indique prendre en charge. Kunavo n’a pas testé Qwen Code en conditions réelles avec ces points de terminaison ; considérez donc cette configuration comme une voie documentée à essayer, et non comme une intégration vérifiée.
Dépôt, données de publication et documentation de Qwen Code vérifiés le 21 septembre 2026 par rapport à github.com/QwenLM/qwen-code, au registre npm et à la documentation distribuée sur la branche principale ainsi que sur les balises de publication v0.9.0 à v0.15.0. Pages d’Alibaba Cloud consacrées aux forfaits Coding Plan, Token Plan et aux tarifs des modèles vérifiées le même jour, puis revérifiées le 1er octobre 2026, date à laquelle les conditions de quota du Token Plan et la note de disponibilité du Coding Plan ont été mises à jour ici. Les tarifs des tokens Kunavo sont relevés dans le catalogue en ligne ; les totaux mensuels sont un calcul illustratif de tokens, et non des coûts de tâches mesurés.