Retour aux guides
Intégration·10 juillet 2026·Mis à jour le 1 octobre 2026·8 min de lecture

Kilo Code avec l’API Claude — configuration de l’URL de base compatible OpenAI et routage par mode

Kilo Code accepte un endpoint personnalisé compatible OpenAI — trois champs de configuration placent Claude dans votre éditeur à 30 % sous le tarif catalogue d’Anthropic. Voici la configuration, le modèle à choisir pour chaque mode et le coût réel d’une session de programmation agentique.

Dernière vérification le .

Kilo Code est l’un des agents de codage IA open source les plus utilisés pour VS Code et, comme ses homologues de la famille Cline, il vous permet d’utiliser votre propre point de terminaison compatible avec OpenAI. Vous pouvez ainsi exécuter Claude dans votre éditeur avec une seule clé sk-kn-, à environ 30 % sous le tarif catalogue d’Anthropic pour les modèles principaux. Ce guide présente la configuration en trois champs, le modèle Claude à choisir selon la tâche et le coût réel d’une session de codage agentique.

Pourquoi Kilo Code a besoin d’une clé API

Kilo Code n’intègre pas de modèle — chaque action (lire un fichier, proposer une modification, exécuter une commande, vérifier le résultat) est un appel API facturé au token. Un abonnement de chat comme Claude Pro ne couvre pas cet usage ; l’extension a besoin d’un accès API direct. C’est exactement le format proposé par Kunavo : paiement à l’utilisation à partir d’un rechargement de 10 $, une clé pour Claude et GPT, et un solde qui n’expire jamais. Comme les boucles agentiques renvoient le contexte croissant de la tâche à chaque étape, le tarif par token est le principal facteur du coût d’une session — raison pour laquelle la remise d’environ 30 % sur claude-sonnet-5 s’accumule rapidement.

Les trois champs

Kilo Code expose le fournisseur sous la forme de trois champs de réglage :

provider-settings
API Provider   OpenAI Compatible
Base URL       https://api.kunavo.com/v1
API Key        sk-kn-...          # create at kunavo.com/app/keys
Model ID       claude-sonnet-5        # or claude-opus-5 / claude-haiku-4-5

Obtenez la clé depuis le tableau de bord après vous être inscrit et avoir rechargé 10 $ — elle n’est affichée qu’une fois, alors enregistrez-la immédiatement. La gestion complète des clés est décrite dans la documentation de la clé API Claude.

Configuration de Kilo Code

  1. Installez Kilo Code depuis la marketplace de VS Code et ouvrez-le depuis la barre latérale.
  2. Ouvrez les paramètres de l’extension (icône en forme d’engrenage) et accédez à la section Providers.
  3. Définissez API Provider sur OpenAI Compatible.
  4. Base URL : https://api.kunavo.com/v1 · API key : votre clé sk-kn-… · Model : claude-sonnet-5.
  5. Enregistrez, puis demandez-lui quelque chose de simple (« explique ce fichier ») pour confirmer la connexion avant de l’autoriser à modifier le code.

Kilo Code prend en charge les remplacements de modèle par mode (Architect / Code / Debug) — un bon endroit pour orienter la planification vers un modèle plus puissant (claude-opus-5) et l’exécution vers un modèle moins cher (claude-sonnet-5).

Cline et Roo Code

Kilo Code et Roo Code sont tous deux des forks de la famille Cline ; les trois champs ci-dessus sont donc identiques dans les trois outils — fournisseur OpenAI Compatible, URL de base https://api.kunavo.com/v1, clé, identifiant du modèle. Ce qui diffère est la fonction offerte par chacun pour acheminer les modèles, et c’est là que se trouvent les économies ; chacun dispose donc de son propre guide : Cline avec l’API Claude couvre sa séparation Plan/Act, et Roo Code avec l’API Claude couvre ses profils de configuration nommés et l’association des modèles par mode.

Les trois outils proposent également un fournisseur natif Anthropic avec une option d’URL de base personnalisée. En la pointant vers https://api.kunavo.com, vous utilisez plutôt l’API Messages native (/v1/messages) — ce qui est utile, car cache_control est relayé sans traduction et les entrées mises en cache sont facturées à 10 % du tarif d’entrée (voir la documentation sur la mise en cache des prompts). Les deux voies fonctionnent ; celle compatible avec OpenAI est la plus simple pour commencer.

Quel modèle Claude choisir

TâcheModèleEntrée / sortie Kunavo (par million)
Codage agentique quotidien (par défaut)claude-sonnet-5$1.40 / $7.00
Sonnet de génération précédente, pour les prompts déjà optimisés pour celui-ciclaude-sonnet-4-6$2.10 / $10.50
Refactorisations et débogages les plus difficilesclaude-opus-5$3.50 / $17.50
Modifications rapides, messages de commit, Q&Rclaude-haiku-4-5$0.70 / $3.50

claude-opus-5 est le choix privilégié ici pour le raisonnement approfondi : c’est le tout dernier Opus d’Anthropic, facturé au même tarif $3.50 / $17.50 que le claude-opus-4-7 de génération précédente ($3.50 / $17.50), qui reste disponible si vous l’avez épinglé. Comme le champ du modèle n’est qu’un slug sur le même point de terminaison, changer de modèle se résume à modifier un mot — aucune nouvelle clé ni configuration de fournisseur. Les tarifs complets de tous les modèles figurent dans le guide des tarifs de l’API Claude et sur la page de tarification.

Ce qu’une session coûte réellement

Les outils agentiques consomment beaucoup de tokens par conception : à chaque étape, l’invite système, l’historique de la tâche et le nouveau contexte des fichiers sont renvoyés. Chiffres réalistes aux tarifs de Kunavo :

UnitéTokens (entrée / sortie)claude-sonnet-5Au tarif catalogue d’Anthropic
Une étape agentique25,000 / 1,200$0.043$0.062
Une tâche de 20 étapes~500k / ~24k~$0.87~$1.24
Une journée intensive (5 tâches de ce type)—~$4.34~$6.20

Le calcul, exécutable :

session_cost.py
# Kunavo Claude rates (USD per 1M tokens): (input, output)
RATES = {
    "claude-haiku-4-5":  (0.70, 3.50),
    "claude-sonnet-5":   (1.40, 7.00),
}

def step_cost(model, in_tokens, out_tokens):
    i, o = RATES[model]
    return in_tokens / 1_000_000 * i + out_tokens / 1_000_000 * o

# One agentic step: the tool resends the task context + file reads.
print(step_cost("claude-sonnet-5", 25_000, 1_200))         # -> $0.0434
# A realistic 20-step task (edit, run, fix, repeat):
print(20 * step_cost("claude-sonnet-5", 25_000, 1_200))    # -> ~$0.87

Réduire la facture

  1. Commencez de nouvelles tâches au lieu de prolonger indéfiniment la même. L’outil renvoie l’intégralité de la conversation à chaque étape, donc une tâche de longue durée coûte de manière quadratique. Nouvelle tâche = contexte nouveau et réduit.
  2. Orientez selon le mode. Kilo Code prend en charge un modèle par mode — Architect sur claude-opus-5, Code sur claude-sonnet-5, questions rapides sur claude-haiku-4-5. La planification ne représente qu’une petite part des tokens, donc y utiliser le modèle le plus puissant coûte peu.
  3. Utilisez la route Anthropic native pour la mise en cache. Les entrées mises en cache sont facturées à 10 % du tarif d’entrée — dans une boucle qui renvoie un préfixe stable à chaque étape, c’est la plus grande économie disponible (voici comment cela fonctionne).
  4. Surveillez les dépenses par clé. Donnez à l’éditeur sa propre clé avec une limite de dépenses dans le tableau de bord, puis consultez l’utilisation pour voir ce qu’une semaine de codage agentique vous coûte réellement.

Questions fréquentes

Quelle URL de base dois-je utiliser pour Kilo Code avec l’API Claude ?

Définissez le fournisseur d’API sur 'OpenAI Compatible' et l’URL de base sur https://api.kunavo.com/v1, avec une clé API Kunavo (sk-kn-...) et un slug de modèle Claude tel que claude-sonnet-5. Si vous utilisez plutôt le fournisseur Anthropic natif, définissez l’URL de base sur l’origine uniquement (https://api.kunavo.com) — ce client ajoute lui-même /v1/messages.

Puis-je utiliser mon abonnement Claude Pro ou Max avec Kilo Code ?

Non — les abonnements de chat n’incluent pas l’accès API. Kilo Code appelle directement l’API et facture chaque token. Une clé à l’utilisation est la bonne formule : sur Kunavo, vous rechargez à partir de 10 $, Claude est proposé à un tarif inférieur de 30 % au tarif catalogue d’Anthropic, et le solde n’expire jamais.

Quel modèle Claude est le meilleur pour Kilo Code ?

claude-sonnet-5 ($1.40/$7.00 par million de tokens sur Kunavo) est le modèle par défaut pour le codage agentique quotidien : une qualité de codage proche d’Opus, pour un coût par token inférieur ici à celui de claude-sonnet-4-6 ($2.10/$10.50). Passez à claude-opus-5 ($3.50/$17.50) pour les refactorisations et débogages les plus difficiles — c’est le nouvel Opus au même tarif que claude-opus-4-7, donc cette montée en gamme ne coûte rien de plus. Orientez les demandes rapides et simples vers claude-haiku-4-5 pour réduire davantage les coûts. Les tarifs et spécifications de claude-opus-5 figurent sur sa page de modèle, et le positionnement comparatif se trouve dans Claude contre GPT contre Gemini.

Combien coûte l’utilisation de Claude avec Kilo Code ?

Les outils agentiques renvoient le contexte à chaque étape, donc les tokens s’accumulent : une étape typique représente environ 25k tokens d’entrée / 1,2k de sortie, soit environ 0.043 $ sur claude-sonnet-5 aux tarifs Kunavo — environ 0.87 $ pour une tâche de 20 étapes, contre environ 1.24 $ au tarif catalogue d’Anthropic. Les requêtes échouées ne sont pas facturées.

La même configuration fonctionne-t-elle pour Cline et Roo Code ?

Oui. Kilo Code et Roo Code sont des forks de la famille Cline et partagent le même modèle de fournisseur : choisissez 'OpenAI Compatible', définissez l’URL de base https://api.kunavo.com/v1, collez la clé et définissez l’identifiant du modèle. Ce qui diffère est la manière dont chaque outil achemine les modèles — Cline sépare les modes Plan et Act, tandis que Roo Code associe des profils de configuration nommés aux modes — et c’est là que se trouvent les économies, raison pour laquelle chacun dispose de son propre guide. Tous trois proposent également un fournisseur Anthropic natif avec une option d’URL de base personnalisée ; pointez-la vers l’origine https://api.kunavo.com pour le relais de cache_control.

Est-ce différent de l’utilisation du SDK OpenAI ?

Même mécanisme : tout client compatible avec OpenAI fonctionne en modifiant base_url — les extensions d’éditeur exposent simplement ce paramètre comme un champ de réglage. Le modèle général est présenté dans le guide de l’API compatible avec OpenAI.

Et Claude Code, l’agent dans le terminal ?

Claude Code se configure différemment — il lit ANTHROPIC_BASE_URL et ANTHROPIC_AUTH_TOKEN dans l’environnement au lieu d’utiliser un champ de réglage, et emploie l’API Messages native plutôt que celle compatible avec OpenAI. Consultez le guide de configuration de Claude Code pour les variables, le piège d’identifiants à l’origine de la plupart des erreurs 401 et les changements apportés par une passerelle.