Kilo Code est l’un des agents de codage IA open source les plus utilisés pour VS Code et, comme ses homologues de la famille Cline, il vous permet d’utiliser votre propre point de terminaison compatible avec OpenAI. Vous pouvez ainsi exécuter Claude dans votre éditeur avec une seule clé sk-kn-, à environ 30 % sous le tarif catalogue d’Anthropic pour les modèles principaux. Ce guide présente la configuration en trois champs, le modèle Claude à choisir selon la tâche et le coût réel d’une session de codage agentique.
Pourquoi Kilo Code a besoin d’une clé API
Kilo Code n’intègre pas de modèle — chaque action (lire un fichier, proposer une modification, exécuter une commande, vérifier le résultat) est un appel API facturé au token. Un abonnement de chat comme Claude Pro ne couvre pas cet usage ; l’extension a besoin d’un accès API direct. C’est exactement le format proposé par Kunavo : paiement à l’utilisation à partir d’un rechargement de 10 $, une clé pour Claude et GPT, et un solde qui n’expire jamais. Comme les boucles agentiques renvoient le contexte croissant de la tâche à chaque étape, le tarif par token est le principal facteur du coût d’une session — raison pour laquelle la remise d’environ 30 % sur claude-sonnet-5 s’accumule rapidement.
Les trois champs
Kilo Code expose le fournisseur sous la forme de trois champs de réglage :
API Provider OpenAI Compatible
Base URL https://api.kunavo.com/v1
API Key sk-kn-... # create at kunavo.com/app/keys
Model ID claude-sonnet-5 # or claude-opus-5 / claude-haiku-4-5Obtenez la clé depuis le tableau de bord après vous être inscrit et avoir rechargé 10 $ — elle n’est affichée qu’une fois, alors enregistrez-la immédiatement. La gestion complète des clés est décrite dans la documentation de la clé API Claude.
Configuration de Kilo Code
- Installez Kilo Code depuis la marketplace de VS Code et ouvrez-le depuis la barre latérale.
- Ouvrez les paramètres de l’extension (icône en forme d’engrenage) et accédez à la section Providers.
- Définissez API Provider sur OpenAI Compatible.
- Base URL :
https://api.kunavo.com/v1· API key : votre clésk-kn-…· Model :claude-sonnet-5. - Enregistrez, puis demandez-lui quelque chose de simple (« explique ce fichier ») pour confirmer la connexion avant de l’autoriser à modifier le code.
Kilo Code prend en charge les remplacements de modèle par mode (Architect / Code / Debug) — un bon endroit pour orienter la planification vers un modèle plus puissant (claude-opus-5) et l’exécution vers un modèle moins cher (claude-sonnet-5).
Cline et Roo Code
Kilo Code et Roo Code sont tous deux des forks de la famille Cline ; les trois champs ci-dessus sont donc identiques dans les trois outils — fournisseur OpenAI Compatible, URL de base https://api.kunavo.com/v1, clé, identifiant du modèle. Ce qui diffère est la fonction offerte par chacun pour acheminer les modèles, et c’est là que se trouvent les économies ; chacun dispose donc de son propre guide : Cline avec l’API Claude couvre sa séparation Plan/Act, et Roo Code avec l’API Claude couvre ses profils de configuration nommés et l’association des modèles par mode.
Les trois outils proposent également un fournisseur natif Anthropic avec une option d’URL de base personnalisée. En la pointant vers https://api.kunavo.com, vous utilisez plutôt l’API Messages native (/v1/messages) — ce qui est utile, car cache_control est relayé sans traduction et les entrées mises en cache sont facturées à 10 % du tarif d’entrée (voir la documentation sur la mise en cache des prompts). Les deux voies fonctionnent ; celle compatible avec OpenAI est la plus simple pour commencer.
Quel modèle Claude choisir
| Tâche | Modèle | Entrée / sortie Kunavo (par million) |
|---|---|---|
| Codage agentique quotidien (par défaut) | claude-sonnet-5 | $1.40 / $7.00 |
| Sonnet de génération précédente, pour les prompts déjà optimisés pour celui-ci | claude-sonnet-4-6 | $2.10 / $10.50 |
| Refactorisations et débogages les plus difficiles | claude-opus-5 | $3.50 / $17.50 |
| Modifications rapides, messages de commit, Q&R | claude-haiku-4-5 | $0.70 / $3.50 |
claude-opus-5 est le choix privilégié ici pour le raisonnement approfondi : c’est le tout dernier Opus d’Anthropic, facturé au même tarif $3.50 / $17.50 que le claude-opus-4-7 de génération précédente ($3.50 / $17.50), qui reste disponible si vous l’avez épinglé. Comme le champ du modèle n’est qu’un slug sur le même point de terminaison, changer de modèle se résume à modifier un mot — aucune nouvelle clé ni configuration de fournisseur. Les tarifs complets de tous les modèles figurent dans le guide des tarifs de l’API Claude et sur la page de tarification.
Ce qu’une session coûte réellement
Les outils agentiques consomment beaucoup de tokens par conception : à chaque étape, l’invite système, l’historique de la tâche et le nouveau contexte des fichiers sont renvoyés. Chiffres réalistes aux tarifs de Kunavo :
| Unité | Tokens (entrée / sortie) | claude-sonnet-5 | Au tarif catalogue d’Anthropic |
|---|---|---|---|
| Une étape agentique | 25,000 / 1,200 | $0.043 | $0.062 |
| Une tâche de 20 étapes | ~500k / ~24k | ~$0.87 | ~$1.24 |
| Une journée intensive (5 tâches de ce type) | — | ~$4.34 | ~$6.20 |
Le calcul, exécutable :
# Kunavo Claude rates (USD per 1M tokens): (input, output)
RATES = {
"claude-haiku-4-5": (0.70, 3.50),
"claude-sonnet-5": (1.40, 7.00),
}
def step_cost(model, in_tokens, out_tokens):
i, o = RATES[model]
return in_tokens / 1_000_000 * i + out_tokens / 1_000_000 * o
# One agentic step: the tool resends the task context + file reads.
print(step_cost("claude-sonnet-5", 25_000, 1_200)) # -> $0.0434
# A realistic 20-step task (edit, run, fix, repeat):
print(20 * step_cost("claude-sonnet-5", 25_000, 1_200)) # -> ~$0.87Réduire la facture
- Commencez de nouvelles tâches au lieu de prolonger indéfiniment la même. L’outil renvoie l’intégralité de la conversation à chaque étape, donc une tâche de longue durée coûte de manière quadratique. Nouvelle tâche = contexte nouveau et réduit.
- Orientez selon le mode. Kilo Code prend en charge un modèle par mode — Architect sur
claude-opus-5, Code surclaude-sonnet-5, questions rapides surclaude-haiku-4-5. La planification ne représente qu’une petite part des tokens, donc y utiliser le modèle le plus puissant coûte peu. - Utilisez la route Anthropic native pour la mise en cache. Les entrées mises en cache sont facturées à 10 % du tarif d’entrée — dans une boucle qui renvoie un préfixe stable à chaque étape, c’est la plus grande économie disponible (voici comment cela fonctionne).
- Surveillez les dépenses par clé. Donnez à l’éditeur sa propre clé avec une limite de dépenses dans le tableau de bord, puis consultez l’utilisation pour voir ce qu’une semaine de codage agentique vous coûte réellement.
Questions fréquentes
Quelle URL de base dois-je utiliser pour Kilo Code avec l’API Claude ?
Définissez le fournisseur d’API sur 'OpenAI Compatible' et l’URL de base sur https://api.kunavo.com/v1, avec une clé API Kunavo (sk-kn-...) et un slug de modèle Claude tel que claude-sonnet-5. Si vous utilisez plutôt le fournisseur Anthropic natif, définissez l’URL de base sur l’origine uniquement (https://api.kunavo.com) — ce client ajoute lui-même /v1/messages.
Puis-je utiliser mon abonnement Claude Pro ou Max avec Kilo Code ?
Non — les abonnements de chat n’incluent pas l’accès API. Kilo Code appelle directement l’API et facture chaque token. Une clé à l’utilisation est la bonne formule : sur Kunavo, vous rechargez à partir de 10 $, Claude est proposé à un tarif inférieur de 30 % au tarif catalogue d’Anthropic, et le solde n’expire jamais.
Quel modèle Claude est le meilleur pour Kilo Code ?
claude-sonnet-5 ($1.40/$7.00 par million de tokens sur Kunavo) est le modèle par défaut pour le codage agentique quotidien : une qualité de codage proche d’Opus, pour un coût par token inférieur ici à celui de claude-sonnet-4-6 ($2.10/$10.50). Passez à claude-opus-5 ($3.50/$17.50) pour les refactorisations et débogages les plus difficiles — c’est le nouvel Opus au même tarif que claude-opus-4-7, donc cette montée en gamme ne coûte rien de plus. Orientez les demandes rapides et simples vers claude-haiku-4-5 pour réduire davantage les coûts. Les tarifs et spécifications de claude-opus-5 figurent sur sa page de modèle, et le positionnement comparatif se trouve dans Claude contre GPT contre Gemini.
Combien coûte l’utilisation de Claude avec Kilo Code ?
Les outils agentiques renvoient le contexte à chaque étape, donc les tokens s’accumulent : une étape typique représente environ 25k tokens d’entrée / 1,2k de sortie, soit environ 0.043 $ sur claude-sonnet-5 aux tarifs Kunavo — environ 0.87 $ pour une tâche de 20 étapes, contre environ 1.24 $ au tarif catalogue d’Anthropic. Les requêtes échouées ne sont pas facturées.
La même configuration fonctionne-t-elle pour Cline et Roo Code ?
Oui. Kilo Code et Roo Code sont des forks de la famille Cline et partagent le même modèle de fournisseur : choisissez 'OpenAI Compatible', définissez l’URL de base https://api.kunavo.com/v1, collez la clé et définissez l’identifiant du modèle. Ce qui diffère est la manière dont chaque outil achemine les modèles — Cline sépare les modes Plan et Act, tandis que Roo Code associe des profils de configuration nommés aux modes — et c’est là que se trouvent les économies, raison pour laquelle chacun dispose de son propre guide. Tous trois proposent également un fournisseur Anthropic natif avec une option d’URL de base personnalisée ; pointez-la vers l’origine https://api.kunavo.com pour le relais de cache_control.
Est-ce différent de l’utilisation du SDK OpenAI ?
Même mécanisme : tout client compatible avec OpenAI fonctionne en modifiant base_url — les extensions d’éditeur exposent simplement ce paramètre comme un champ de réglage. Le modèle général est présenté dans le guide de l’API compatible avec OpenAI.
Et Claude Code, l’agent dans le terminal ?
Claude Code se configure différemment — il lit ANTHROPIC_BASE_URL et ANTHROPIC_AUTH_TOKEN dans l’environnement au lieu d’utiliser un champ de réglage, et emploie l’API Messages native plutôt que celle compatible avec OpenAI. Consultez le guide de configuration de Claude Code pour les variables, le piège d’identifiants à l’origine de la plupart des erreurs 401 et les changements apportés par une passerelle.