Retour aux guides
Agents de programmation·21 septembre 2026·Mis à jour le 3 octobre 2026·9 min de lecture

mini-SWE-agent vs Claude Code : workflow, modèles et coût total

L’un est un framework MIT gratuit que vous pouvez connecter à tout modèle atteint par LiteLLM ; l’autre ne parle que les protocoles Anthropic — voici les différences qui déterminent réellement une migration.

Dernière vérification le .

mini-SWE-agent et Claude Code ne sont pas deux versions du même produit : mini est un agent Python gratuit sous licence MIT doté d’un seul outil — bash — qui atteint n’importe quel modèle via LiteLLM, tandis que Claude Code est l’agent propriétaire d’Anthropic qui ne parle que des protocoles de forme Anthropic. Cette seule différence détermine la plupart des migrations, car il s’agit d’une limite de protocole plutôt que d’une préférence. Choisissez mini si vous voulez un harness suffisamment petit pour être lu et un libre choix de fournisseur ; choisissez Claude Code si vous voulez les interfaces d’éditeur, de bureau et de CI, les modes d’autorisation et le parcours d’abonnement, et si vous restez sur des modèles Claude.

mini-SWE-agent est maintenu dans l’organisation GitHub SWE-agent et se décrit comme « Créé par l’équipe de Princeton & Stanford à l’origine de SWE-bench, SWE-agent et d’autres projets ». Avant toute chose, une correction, car le fait le plus souvent cité à son sujet est obsolète. Son guide de migration v2 indique que « v2.0 utilise par défaut l’appel natif d’outils (au lieu de l’analyse de texte fondée sur des expressions régulières) », tandis que la propre FAQ du projet affirme encore qu’« il n’utilise même pas l’interface d’appel d’outils des LM » et que « les actions sont analysées à partir de blocs à triples accents graves ». Les deux pages ont été consultées le 19 septembre 2026. Le guide de migration et la configuration fournie font foi : mini.yaml indique au modèle que « chaque réponse doit utiliser l’outil 'bash' au moins une fois pour exécuter des commandes ». Tout tutoriel fondé sur l’absence d’appel d’outils, ou sur la variable MSWEA_MODEL_API_KEY supprimée, est antérieur à la v2.

Lequel choisir

Choisissez mini-SWE-agent si votre travail se prête aux traitements par lots ou dépend du fournisseur : exécuter le même prompt sur de nombreux problèmes, évaluer des modèles les uns par rapport aux autres, ou travailler dans un bac à sable où un agent suffisamment petit pour être audité vaut mieux qu’un ensemble de fonctionnalités que vous ne pouvez pas inspecter. Son modèle d’exécution est sa caractéristique déterminante : la FAQ de mini décrit l’exécution des actions via subprocess.run, où « chaque action est totalement indépendante (au lieu de conserver une session shell avec état) », de sorte que « l’agent ne peut pas changer de répertoire ni exporter de variables d’environnement ; toutefois, les variables d’environnement peuvent être définies pour chaque action ». Le mini.yaml fourni indique la même chose au modèle — « les changements de répertoire ou de variables d’environnement ne sont pas persistants. Chaque action est exécutée dans un nouveau sous-shell » — et lui demande plutôt d’utiliser une commande préfixée. Cela rend les exécutions reproductibles et faciles à conteneuriser, mais complique les longs travaux shell avec état. Le coût de migration est d’une après-midi : pip install mini-swe-agent, un fichier YAML, une clé.

Choisissez Claude Code si la valeur réside dans les surfaces et les garde-fous. Anthropic le décrit comme disponible « dans votre terminal, votre IDE, votre application de bureau et votre navigateur », et précise que « le CLI de terminal, VS Code et JetBrains prennent également en charge les fournisseurs tiers » — une route via une passerelle n’existe donc que sur certains d’entre eux. Il propose des modes d’autorisation, des sous-agents, des serveurs MCP, des hooks et un mode plan ; avec un abonnement Pro ou Max, votre utilisation est déduite d’une allocation du forfait plutôt que facturée au token. Le coût est une forme de verrouillage spécifique : vous ne pouvez pas l’utiliser avec des modèles autres que ceux de Claude, et la documentation des passerelles d’Anthropic indique qu’elle « ne prend pas en charge le routage de Claude Code vers des modèles non-Claude via une passerelle ».

Passer de Claude Code à mini signifie renoncer au système d’autorisations en échange des trois modes de mini, abandonner entièrement les surfaces IDE et bureau, et prendre en charge votre propre comptabilité des dépenses — le budget par exécution de mini ne fonctionne que lorsque LiteLLM peut tarifer votre identifiant de modèle. Passer de mini à Claude Code signifie renoncer au libre choix du modèle et passer d’un harnais que vous pouvez lire à un binaire distribué : le dépôt claude-code est un point de distribution, et son fichier de licence est un avis d’une ligne — « © Anthropic PBC. Tous droits réservés » — l’utilisation étant soumise aux Conditions commerciales d’utilisation d’Anthropic.

Les deux agents côte à côte

Propriétémini-SWE-agentClaude Code
LicenceMIT, © Kilian A. Lieret et Carlos E. JimenezPropriétaire — « Tous droits réservés », conformément aux Conditions commerciales d’Anthropic
Version actuelle2.4.6, téléversée le 23 juillet 2026 (PyPI)2.1.277 sur le tag latest et 2.1.267 sur stable lorsque les dist-tags npm ont été consultés ; le tag latest évolue la plupart des jours
Environnement d’exécutionPython 3.10 ou version ultérieureNode 22 ou version ultérieure pour le package npm
InterfacesREPL du terminal mini, ainsi que la commande complémentaire mini-extraTerminal, extensions IDE, application de bureau et navigateur
Outils disponibles pour le modèlebash, et rien d’autreModification de fichiers, recherche, exécution de commandes, sous-agents, serveurs MCP, hooks
Modèle d’exécutionUn subprocess.run indépendant par action ; aucun état du shell n’est conservéSession avec état et modes d’autorisation
Flux d’approbationDémarre en confirm ; passez à yolo (/y) ou human (/u) en cours d’exécution ; -y démarre sans confirmationModes d’autorisation, notamment le mode plan avant l’implémentation
Accès aux modèlesTout fournisseur accessible par LiteLLM, y compris les passerelles compatibles avec OpenAIModèles Claude uniquement via les formats Anthropic Messages, Bedrock ou Agent Platform
Plafond de dépenses par exécutioncost_limit: 3. dans la configuration fournie ; -l/--cost-limit, 0 désactive--max-budget-usd, mode d’impression uniquement
Plafond de toursstep_limit: 0 — illimité par défaut--max-turns, mode d’impression uniquement

Sources consultées le 19 septembre 2026 : métadonnées PyPI de mini, document du registre npm de Claude Code, page CLI de mini, mini.yaml fourni avec mini, ainsi que la référence CLI et la vue d’ensemble d’Anthropic.

Pourquoi « mini bat Claude Code » n’est pas un verdict

La page d’accueil de mini affiche une actualité indiquant que « mini-swe-agent bat Claude Code et Codex sur DeepSWE », et il vaut la peine de lire ce que DeepSWE a réellement mesuré. Son article indique : « Chaque exécution utilise mini-swe-agent, le harnais conçu par les auteurs de SWE-bench. Nous le gardons fixe pour chaque modèle afin que le classement reflète les capacités du modèle, et non l’infrastructure qui l’entoure. » Le classement est donc un classement des modèles dans mini, et non un classement de mini par rapport à d’autres agents.

La seule comparaison harnais contre harnais de ce travail est un pilote portant sur « les mêmes 10 tâches de SWE-Bench Pro », dans lequel le harnais standardisé a égalé ou dépassé les harnais natifs à coût de tokens comparable — et dont les auteurs précisent immédiatement que « une partie de cet écart provient probablement de l’optimisation du prompt plutôt que des capacités ». Dix tâches sur une poignée de modèles ne constituent pas un échantillon permettant de classer deux agents, et aucune autre comparaison directe crédible d’une taille exploitable n’a été trouvée lors de la recherche pour cette page. Ce guide ne leur attribue donc pas de score. Il compare ce qui est vérifiable : protocole, autorisations, contrôles des dépenses et coût de migration.

La question clé : vers quels endpoints chacun peut accéder

C’est ici que les deux divergent le plus fortement, et c’est ce qui détermine si une passerelle est même envisageable.

Claude Code est verrouillé par son protocole. Le guide de compatibilité des passerelles d’Anthropic répertorie trois formats : Anthropic Messages sélectionné par ANTHROPIC_BASE_URL et appelant /v1/messages, avec un /v1/messages/count_tokens facultatif ; Amazon Bedrock InvokeModel ; et rawPredict d’Agent Platform de Google Cloud. Il n’existe pas de mode chat-completions. L’URL de base est une origine, car Claude Code ajoute la route — la même règle que la propre page ANTHROPIC_BASE_URL de Kunavo encode.

Claude Code
# Claude Code speaks the Anthropic Messages format and appends the route
# itself, so the variable is the ORIGIN — not the /v1 URL mini wants.
export ANTHROPIC_BASE_URL=https://api.kunavo.com   # origin, no /v1
export ANTHROPIC_AUTH_TOKEN=sk-kn-...              # sent as Authorization: Bearer

# Pin models Kunavo serves. Claude Code's default and its opus alias are the
# newest Opus — pinned here to Opus 5.5, which needs Claude Code v2.1.280 or
# later (run `claude update`). The sonnet alias asks for Sonnet 5.5, which
# Kunavo does not serve: unpinned, /model sonnet, opusplan's execution phase
# and sonnet subagents 404.
export ANTHROPIC_MODEL=claude-sonnet-5
export ANTHROPIC_DEFAULT_OPUS_MODEL=claude-opus-5-5
export ANTHROPIC_DEFAULT_SONNET_MODEL=claude-sonnet-5
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-4-5

claude

Trois conséquences à prendre en compte dans le budget. La variable d’identifiant détermine l’en-tête : la page de connexion d’Anthropic indique que « ANTHROPIC_AUTH_TOKEN dans Authorization: Bearer, ANTHROPIC_API_KEY dans x-api-key, et apiKeyHelper dans les deux », et qu’un identifiant placé dans la mauvaise variable « atteint la passerelle dans un en-tête qu’elle ne lit pas, et la requête échoue avec 401 ». La mise en cache des prompts n’a pas de paire beta et échoue silencieusement : le guide d’Anthropic indique qu’une passerelle qui supprime cache_control produit « aucune erreur : la conversation est facturée comme une entrée non mise en cache à chaque tour ». Enfin, la découverte des modèles est désactivée sauf si vous définissez CLAUDE_CODE_ENABLE_GATEWAY_MODEL_DISCOVERY=1, après quoi Claude Code ne conserve que les identifiants contenant « claude » ou « anthropic ».

mini est libre de protocole, mais exigeant en configuration. Il n’existe aucune variable d’environnement d’URL de base ; sa page sur les modèles locaux explique que model_kwargs est transmis directement à litellm.completion(model=model_name, messages=messages, **model_kwargs). Conservez ici le suffixe /v1 — l’inverse de la règle de Claude Code ci-dessus. L’exemple fourni sur cette même page définit custom_llm_provider: "openai" sur un nom de modèle non préfixé ; le préfixe openai/ ci-dessous est donc une précaution supplémentaire plutôt qu’une exigence. La page insiste en revanche sur le fait que, si vous utilisez l’un ou l’autre, « cela doit également correspondre à litellm_provider dans la configuration ».

kunavo.yaml
# mini has no base-URL environment variable. The endpoint goes in a config
# file, because model_kwargs is splatted straight into litellm.completion().
model:
  model_name: "openai/claude-sonnet-5"        # prefix and provider must agree
  model_kwargs:
    custom_llm_provider: "openai"
    api_base: "https://api.kunavo.com/v1"    # keep /v1 here
    drop_params: true                        # the shipped mini.yaml sets this too
  # set_cache_control is already "default_end" for a name containing "claude"

Fournissez la clé sous la forme OPENAI_API_KEY, soit dans l’environnement, soit via mini-extra config set, qui écrit le .env de mini ; la page de configuration globale de mini précise que « les variables d’environnement ont priorité sur les variables définies dans le fichier .env ». Sélectionnez le fichier avec mini -c kunavo.yaml, ou définissez-le par défaut avec MSWEA_MINI_CONFIG_PATH.

Un mode d’échec discret mérite sa propre correction. Le budget par exécution de mini est appliqué par le suivi des coûts de LiteLLM, qui doit reconnaître l’identifiant du modèle — et la présence des identifiants Kunavo dans le registre tarifaire de LiteLLM n’a pas été vérifiée pour cette page. Supposez que ce ne soit pas le cas et fournissez vous-même les tarifs, plutôt que d’utiliser MSWEA_COST_TRACKING="ignore_errors", qui supprime la protection au lieu de la réparer. Faites pointer LITELLM_MODEL_REGISTRY_PATH vers un fichier au format des prix des modèles de LiteLLM. L’exemple fonctionnel de mini indexe l’entrée sur le nom du modèle sans son préfixe de fournisseur et déclare le fournisseur dans litellm_provider, ce qui correspond à la structure copiée ici :

litellm-registry.json · LITELLM_MODEL_REGISTRY_PATH
{
  "claude-sonnet-5": {
    "input_cost_per_token": 0.0000014000,
    "output_cost_per_token": 0.0000070000,
    "litellm_provider": "openai",
    "mode": "chat"
  }
}

Deux lacunes honnêtes. Kunavo n’a testé en conditions réelles aucun des deux clients avec son endpoint, et publier une référence de configuration ne constitue pas un test de compatibilité. Point précisément non vérifié : la capacité du chemin openai/ de LiteLLM à négocier l’appel natif d’outils — le comportement par défaut de mini v2 — avec l’endpoint chat-completions de Kunavo. Si ce n’est pas le cas, mini fournit encore l’ancien chemin d’analyse de texte sous la forme model_class: litellm_textbased, avec une configuration mini_textbased.yaml à côté de celle par défaut. Conservez une route fonctionnelle ouverte pendant que vous essayez l’un ou l’autre client, et consultez ce que votre compte a réellement enregistré pour une tâche limitée.

Ce que coûte l’exécution de chacun

Les prix des logiciels ne sont pas comparables, car un seul des deux a un prix.

PostePrix publiéSource, vérifiée le 19 septembre 2026
mini-SWE-agent, le logiciel0 $, MITMétadonnées du package PyPI ; aucun forfait ni niveau hébergé n’est proposé sur son site ou sa fiche
Claude Free$0 — Claude Code non inclusclaude.com/pricing
Claude Pro$17/mois avec facturation annuelle ($200 d’avance), $20 facturés mensuellement — Claude Code inclusclaude.com/pricing
Claude MaxLa fiche tarifaire indique « À partir de $100 par mois » ; l’article d’assistance indique Max 5x à $100/mois et Max 20x à $200/moisArticle d’assistance du forfait Max — facturation mensuelle uniquement
L’un ou l’autre agent avec des tokens facturés à l’usageLe tarif par jeton de votre fournisseurVotre propre compte

La fiche tarifaire et l’article d’assistance décrivent différemment les niveaux Max — l’un les regroupe en un seul montant « à partir de », l’autre les détaille tous les deux. Confirmez le niveau et le total lors du paiement avant de l’intégrer à votre budget. Les prix des sièges Team et Enterprise sont volontairement exclus ici : il s’agit d’une décision de sièges pour une organisation, et non du choix d’un développeur individuel dont traite cette page.

Pour l’utilisation facturée à l’usage, Anthropic publie une fourchette plutôt qu’un montant par tâche : « Dans les déploiements d’entreprise, le coût moyen est d’environ $13 par développeur et par jour actif et de $150-250 par développeur et par mois, les coûts restant inférieurs à $30 par jour actif pour 90 % des utilisateurs » (documentation sur la gestion des coûts). Il s’agit d’un agrégat des propres déploiements d’Anthropic, et non d’une mesure comparant les deux agents ; aucun chiffre équivalent n’existe pour mini.

Une estimation concrète en jetons

Il s’agit d’un calcul illustratif de tokens, et non d’un coût de tâche mesuré ni d’un plafond de facturation. Les deux agents renvoient la conversation à chaque tour — la propre documentation d’Anthropic indique que « Claude Code envoie l’intégralité de votre conversation à chaque requête, et chaque fois que Claude utilise des outils, il envoie une autre requête contenant ce lot de résultats d’outils » — l’entrée est donc prépondérante. Supposons une tâche limitée totalisant 600k tokens d’entrée non mis en cache sur l’ensemble de ses tours et 25k tokens de sortie. Les tarifs sont les prix actuels du catalogue Kunavo par million de tokens.

ModèleEntrée / sortie par millionEstimation pour la tâche supposéeAccessible depuis
Claude Haiku 4.5$0.70 / $3.50$0.51Les deux clients
Claude Sonnet 5$1.40 / $7.00$1.01Les deux clients
Claude Opus 5$3.50 / $17.50$2.54Les deux clients
GPT-5.6 Terra$0.70 / $4.20$0.53mini uniquement — Claude Code ne dispose d’aucun mode chat-completions

Lisez-le comme un ratio, et non comme une prévision. Selon ces hypothèses, l’écart entre Claude Haiku 4.5 et Claude Opus 5 est d’environ 5.0×, ce qui constitue un levier plus important que le choix du client. Notez également que le tarif affiché le moins cher et le coût minimal pour terminer la tâche sont deux affirmations différentes : un modèle moins cher qui nécessite trois tentatives peut coûter plus cher qu’un modèle qui réussit du premier coup, et la boucle de sous-processus indépendants de mini renvoie davantage de contexte lorsqu’une étape échoue. La mise en cache modifie encore le tableau, et pas dans le sens supposé par la plupart des articles. Claude Code ajoute lui-même les marqueurs cache_control. mini définit également set_cache_control: "default_end" de son côté, mais uniquement pour certains noms de modèles : son code de sélection des modèles applique cette valeur par défaut lorsque le nom de modèle résolu contient anthropic, claude, sonnet ou opus et que la clé n’a pas déjà été définie dans la configuration. Un identifiant nommé Claude — y compris le openai/claude-sonnet-5 préfixé ci-dessus — reçoit donc les marqueurs sans que vous le demandiez ; un identifiant nommé Gemini ne les reçoit pas. La question de savoir si un endpoint chat-completions agit sur ces marqueurs n’a pas été testée pour cette page. Consultez la section mise en cache des prompts.

Le montant du catalogue Kunavo constitue un seuil de facturation plutôt qu’un plafond : lorsque le fournisseur en amont communique son coût, la facture correspond au montant le plus élevé entre le coût du catalogue et le coût amont multiplié par la majoration applicable. Les frais de cache et les outils externes ne sont pas inclus dans cet exemple. Le rechargement minimal est de $10 de crédit prépayé — un minimum de financement, et non des frais de tâche ou un abonnement. Consultez les détails de facturation et notez que la valeur /usage propre à Claude Code est « calculée localement à partir du nombre de tokens au prix catalogue » et constitue explicitement « une estimation » ; rapprochez donc les montants du registre de votre fournisseur plutôt que de l’affichage du client.

Une autre distinction importante : SWE-agent n’est pas mini-SWE-agent

L’ancien projet frère apparaît encore dans ces recherches et partage une organisation, une famille de README et une lignée de benchmarks — mais sa syntaxe de configuration, sa documentation et sa place dans un tutoriel mini sont différentes. Ses propres mainteneurs sont passés à autre chose : le README de SWE-agent indique que « l’essentiel de notre effort de développement actuel porte sur mini-swe-agent, qui a remplacé SWE-agent » et recommande désormais mini (lecture effectuée le 19 septembre 2026). Il n’est pas archivé et le projet est sous licence MIT ; considérez-le donc comme maintenu mais supplanté plutôt que mort — et commencez tout nouveau travail avec mini.

Configurer l’un ou l’autre

Kunavo publie une référence de configuration pour Claude Code, mais aucune pour mini-SWE-agent ; aucun des deux clients n’a été testé en conditions réelles ici, et une page de configuration publiée n’est pas un test de compatibilité. Si Claude Code est votre client, commencez par le guide d’intégration de Claude Code et créez un compte Kunavo lorsque vous serez prêt à approvisionner une clé. Si vous évaluez d’abord l’abonnement par rapport aux tokens facturés à l’usage, les tarifs de Claude Code et Claude Code sans abonnement couvrent cette décision, et la meilleure API pour Claude Code compare les routes. Pour mini, le modèle est celui, générique, décrit dans l’API compatible avec OpenAI. Vous comparez plutôt d’autres agents de terminal ? OpenCode contre Claude Code et les tarifs d’Aider couvrent deux autres clients reposant sur la même distinction entre un harnais gratuit et une facturation des modèles à l’usage.

Questions fréquentes

mini-SWE-agent est-il meilleur que Claude Code ?

Aucune preuve publiée ne permet de trancher, et le titre que les gens citent ne l’affirme pas. Le propre site de mini renvoie vers un résultat DeepSWE sous les mots « mini-swe-agent beats Claude Code and Codex on DeepSWE », mais DeepSWE indique que « Chaque exécution utilise mini-swe-agent, le harness construit par les auteurs de SWE-bench. Nous le gardons fixe pour chaque modèle afin que le classement reflète la capacité du modèle, et non l’échafaudage qui l’entoure. » La seule comparaison harness contre harness de ce travail est un pilote réalisé sur les mêmes 10 tâches SWE-Bench Pro, et ses auteurs écrivent qu’une partie de l’écart est « probablement due à l’ajustement du prompt plutôt qu’à la capacité ». Dix tâches ne permettent pas de classer deux agents. Décidez plutôt selon le flux de travail, le protocole et le parcours de coût.

mini-SWE-agent peut-il utiliser des modèles Claude via une passerelle comme Kunavo ?

Oui, par configuration plutôt que par variable d’environnement : mini n’a pas de variable d’URL de base, et sa documentation indique que model_kwargs « est directement transmis à litellm.completion ». Placez custom_llm_provider: "openai" et api_base: "https://api.kunavo.com/v1" sous model.model_kwargs dans un fichier YAML, conservez le suffixe /v1, fournissez OPENAI_API_KEY et sélectionnez le fichier avec mini -c. Un préfixe de fournisseur dans le nom du modèle est facultatif — le propre exemple de mini définit custom_llm_provider sur un nom sans préfixe — mais celui que vous utilisez doit correspondre à litellm_provider. Deux points à connaître avant de vous y fier : la configuration par défaut de mini utilise les appels d’outils natifs, et aucun test en conditions réelles de ce parcours avec Kunavo n’a été effectué ici ; et litellm doit reconnaître l’identifiant du modèle pour que le suivi des coûts — le mécanisme qui sous-tend le budget par exécution par défaut de $3 de mini — fonctionne.

Claude Code peut-il communiquer avec un point de terminaison compatible avec OpenAI ?

Non. Le guide de compatibilité des passerelles d’Anthropic répertorie trois formats d’API qu’une passerelle peut exposer à Claude Code : Anthropic Messages via ANTHROPIC_BASE_URL (appelant /v1/messages et éventuellement /v1/messages/count_tokens), Amazon Bedrock InvokeModel via ANTHROPIC_BEDROCK_BASE_URL avec CLAUDE_CODE_USE_BEDROCK=1, et rawPredict d’Agent Platform de Google Cloud via ANTHROPIC_VERTEX_BASE_URL avec CLAUDE_CODE_USE_VERTEX=1. Microsoft Foundry et Claude Platform sur AWS disposent de leurs propres variables sur cette page, mais le guide indique que tous deux implémentent le même format Anthropic Messages. Aucun mode /v1/chat/completions ne figure dans la liste ; un point de terminaison de forme OpenAI est donc inaccessible depuis Claude Code. La page Other LLM gateways d’Anthropic indique également qu’elle « ne prend pas en charge le routage de Claude Code vers des modèles non-Claude via quelque passerelle que ce soit ».

Combien coûte mini-SWE-agent ?

Le logiciel est gratuit. mini-SWE-agent est sous licence MIT, avec les droits d’auteur détenus par Kilian A. Lieret et Carlos E. Jimenez, et ni sa documentation ni sa fiche PyPI ne proposent d’offre hébergée, de formule, de siège ou de compte à acheter — la version actuelle sur PyPI est 2.4.6, téléversée le 23 juillet 2026, et nécessite Python 3.10 ou une version ultérieure. Vous payez la facture du modèle du fournisseur vers lequel vous le pointez. Le seul garde-fou de dépenses fourni dans la configuration par défaut est cost_limit: 3. par exécution, avec MSWEA_GLOBAL_COST_LIMIT et MSWEA_GLOBAL_CALL_LIMIT, qui valent tous deux 0 par défaut, ce qui signifie aucune limite. Considérez-les comme des plafonds configurés, et non comme des coûts observés.

mini-SWE-agent évite-t-il toujours les appels d’outils et analyse-t-il les blocs entre triples accents graves ?

Pas par défaut, et c’est le point que la plupart des articles tiers comprennent mal. Le guide de migration v2 indique que « v2.0 utilise par défaut les appels d’outils natifs (au lieu de l’analyse de texte fondée sur des expressions régulières) », et le mini.yaml fourni adopte la forme des appels d’outils — son modèle d’erreur indique au modèle que « Chaque réponse doit utiliser l’outil 'bash' au moins une fois pour exécuter des commandes. » La FAQ du projet conserve toutefois l’ancienne formulation selon laquelle « il n’utilise même pas l’interface d’appel d’outils des LMs », les deux pages se contredisent donc ; le guide de migration et la configuration fournie décrivent le comportement actuel. L’analyse de texte reste disponible en option via la classe de modèle litellm_textbased et la configuration mini_textbased.yaml fournie à côté de mini.yaml.

Que perd Claude Code lorsqu’il pointe vers un point de terminaison tiers ?

Anthropic documente plusieurs réductions sur sa page Other LLM gateways et dans son guide de compatibilité des passerelles. Lorsqu’une variable d’identifiant de passerelle ou un apiKeyHelper est actif, « l’abonnement claude.ai d’un développeur n’est pas utilisé : l’identifiant remplace la connexion par abonnement pour cette session », et le trafic est facturé par token au détenteur de cet identifiant. La découverte des modèles de la passerelle est désactivée, sauf si CLAUDE_CODE_ENABLE_GATEWAY_MODEL_DISCOVERY=1 est défini, et seuls les identifiants contenant « claude » ou « anthropic » sont conservés. Le streaming d’outils à granularité fine est désactivé par défaut derrière une URL de base personnalisée. Définir uniquement ANTHROPIC_BASE_URL, sans variable d’identifiant, ne remplace pas l’abonnement — la connexion enregistrée reste active et ses limites continuent de s’appliquer.

Vérifié le 19 septembre 2026 en récupérant directement chaque source : les métadonnées PyPI de mini-SWE-agent, sa page d’accueil, son guide de migration v2, sa FAQ, son CLI, ses pages de configuration globale et de modèles locaux, ainsi que mini.yaml, run/mini.py et models/__init__.py fournis sur la branche principale ; le document du registre npm de Claude Code, son fichier de licence du dépôt, ainsi que ses documentations de présentation, de passerelles, de protocole de passerelle, de connexion de passerelle, de coûts et de référence CLI ; claude.com/pricing et l’article d’assistance du forfait Max ; le README de SWE-agent ; et l’article DeepSWE. Aucun test en conditions réelles de l’un ou l’autre client avec Kunavo n’a été effectué, et aucun résultat de benchmark de cette page n’a été reproduit. Les tarifs des tokens Kunavo proviennent du catalogue actuel, et chaque exemple en dollars correspond à un calcul illustratif de tokens.