返回指南
Prix·2026年7月10日·8 min read

Prix de l'API Claude 2026 — tarifs par modèle, paiement et coûts réels

Claude est le standard pour le raisonnement, le code et les agents. Voici les tarifs actuels de l'API Claude par modèle — 30 à 60 % sous les prix Anthropic — avec le paiement depuis la France (CB, SEPA, TVA), des exemples de coût à vérifier soi-même et les leviers qui réduisent le plus la facture.

Claude est le standard pour le raisonnement, le code et les agents, et Kunavo sert tous les modèles Claude 30 à 60 % sous les prix officiels d'Anthropic derrière une seule API compatible OpenAI. Ce guide rassemble ce que les développeurs français cherchent le plus — le prix de l'API Claude, le paiement et les coûts réels : les tarifs actuels par modèle, le paiement par CB ou SEPA, la TVA, des exemples de coût que vous pouvez vérifier vous-même, et les leviers qui réduisent le plus la facture.

Les prix de l'API Claude en un coup d'œil

Les tarifs sont en USD par million de tokens, tels que facturés par Kunavo. La colonne « tarif Anthropic » est le prix publié par Anthropic pour le même modèle, pour comparer directement.

ModèleInput / 1MOutput / 1MTarif Anthropic (input / output)Économie
claude-haiku-4-5$0.40$2.00$1.00 / $5.00~60 %
claude-sonnet-4-6$1.20$6.00$3.00 / $15.00~60 %
claude-opus-4-7$2.00$10.00$5.00 / $25.00~60 %
claude-sonnet-5$2.10$10.50$3.00 / $15.00~30 %
claude-fable-5$7.00$35.00$10.00 / $50.00~30 %

Les tarifs en direct sont toujours sur la page des prix et sur chaque page modèle (claude-sonnet-4-6, claude-haiku-4-5, claude-opus-4-7). Haiku est l'option économique, Sonnet 4.6 le meilleur rapport qualité-prix au quotidien, Sonnet 5 le niveau quasi-Opus pour le code, Opus 4.7 le raisonnement difficile, et Fable 5 le modèle le plus capable d'Anthropic.

Comment payer l'API Claude depuis la France

Le paiement passe par Stripe. Pas d'abonnement, pas de configuration Anthropic Console : vous rechargez un solde, et chaque appel est décompté aux tarifs au token ci-dessus. Moyens de paiement disponibles en France :

  • Cartes : CB, Visa, Mastercard, American Express
  • Prélèvement SEPA (idéal pour l'auto-recharge récurrente)
  • Apple Pay, Google Pay, Link (paiement en un clic)
  • Clients Enterprise : paiement sur facture, conditions Net 30

Les prix sont libellés en USD ; Stripe convertit en EUR au moment du paiement (les frais de change dépendent de votre banque). Recharge minimum $5 USD, pay-as-you-go, et comme c'est un portefeuille prépayé, le solde n'expire jamais. Côté TVA : en B2C, Stripe Tax calcule la TVA locale automatiquement ; en B2B, renseignez votre numéro de TVA intracommunautaire au checkout et la facture est émise en autoliquidation, sans TVA.

Exemples de coût

Des chiffres réels, calculés aux tarifs Kunavo :

TâcheTokens (input / output)ModèleCoût
Réponse à un ticket support800 / 200Haiku 4.5$0.00072
Réponse RAG6 000 / 500Sonnet 4.6$0.0102
Appel d'assistant de code10 000 / 1 500Sonnet 4.6$0.021
Analyse long contexte50 000 / 2 000Opus 4.7$0.12

Traiter 10 000 tickets support par jour sur Haiku coûte environ $7.20/jour. Le calcul, exécutable :

claude_cout.py
# Tarifs Claude sur Kunavo (USD par 1M de tokens) : (input, output)
RATES = {
    "claude-haiku-4-5":  (0.40, 2.00),
    "claude-sonnet-4-6": (1.20, 6.00),
    "claude-opus-4-7":   (2.00, 10.00),
}

def cout(model: str, in_tokens: int, out_tokens: int) -> float:
    i, o = RATES[model]
    return in_tokens / 1_000_000 * i + out_tokens / 1_000_000 * o

print(cout("claude-haiku-4-5", 800, 200))      # un ticket support     -> $0.00072
print(cout("claude-sonnet-4-6", 6_000, 500))   # une réponse RAG       -> $0.0102
print(cout("claude-opus-4-7", 50_000, 2_000))  # analyse long contexte -> $0.12

Le français consomme environ 20 à 40 % de tokens de plus que l'anglais à contenu égal (accents, mots plus longs, sous-découpage du tokenizer) — prévoyez cette marge dans vos budgets.

Prompt caching — la plus grosse économie

Si votre prompt système ou votre contexte récupéré est volumineux et stable, le prompt caching facture l'input en cache à 10 % du tarif d'input. Sur un long prompt système répété, cela réduit le coût d'input de 60 à 90 %. Un seul champ à ajouter à la requête — voir le guide approfondi du prompt caching Anthropic et la référence de l'API Messages.

Une clé pour Claude, Gemini, GPT, image et vidéo

Une seule clé Kunavo (sk-kunavo-…) appelle Claude mais aussi Gemini, GPT, la génération d'images, la vidéo et l'audio — le tout au format compatible OpenAI, décompté d'un seul solde Stripe, sans factures à réconcilier par fournisseur. Claude est servi à la fois par l'endpoint compatible OpenAI /v1/chat/completions et par l'API native Anthropic Messages (/v1/messages), donc vous gardez votre SDK actuel. La marche à suivre est dans la doc d'authentification.

Quel modèle Claude choisir ?

BesoinChoixKunavo input / output (par 1M)
L'option la moins chèregemini-2-5-flash$0.09 / $0.75
Économique + qualité Anthropicclaude-haiku-4-5$0.40 / $2.00
Raisonnement équilibréclaude-sonnet-4-6$1.20 / $6.00
Code exigeant, quasi-Opusclaude-sonnet-5$2.10 / $10.50
Raisonnement le plus difficileclaude-opus-4-7$2.00 / $10.00

Les tarifs côté Gemini sont dans le guide des prix de l'API Gemini ; le pattern de routage par difficulté (les tâches simples vers un modèle moins cher) est dans le guide d'optimisation des coûts IA. Pour une comparaison avec OpenRouter, voir Kunavo vs OpenRouter.

Utiliser Claude dans VS Code — Kilo Code, Cline, Roo Code

Si vous utilisez Claude via un agent de code comme Kilo Code, Cline ou Roo Code, la configuration est la même : provider « OpenAI Compatible », base URL https://api.kunavo.com/v1, votre clé, et un slug de modèle Claude. Le pas-à-pas complet (avec le coût réel d'une session agentique) est dans le guide configurer Kilo Code avec l'API Claude.

Réduire le coût de l'API Claude

  1. Le prompt caching d'abord. L'input en cache est facturé à 10 % du tarif d'input — le meilleur retour sur effort.
  2. Descendez de gamme. Envoyez les tâches simples vers Haiku ou gemini-2-5-flash, gardez Opus pour la minorité difficile.
  3. Plafonnez l'output. Fixez max_tokens — l'output coûte environ 5 fois plus cher que l'input.
  4. Réduisez l'input. Récupérez des chunks RAG moins nombreux et plus précis plutôt que toute la base de connaissances.

FAQ

Quel est le prix de l'API Claude ?

Sonnet 4.6 coûte $1.20 d'input / $6.00 d'output par 1M de tokens, soit environ 60 % sous le tarif Anthropic ($3.00 / $15.00). Une réponse RAG de 6K input / 500 output revient à environ $0.01. Tous les tarifs sont comparables sur la page des prix.

Comment payer depuis la France ?

Par Stripe : CB, Visa, Mastercard, Amex, prélèvement SEPA, Apple Pay, Google Pay. Recharge minimum $5, pay-as-you-go, solde sans expiration. Pour démarrer, créez un compte gratuit puis générez une clé.

Comment réduire la facture Claude ?

Dans l'ordre : prompt caching (10 % du tarif d'input), descente de gamme vers Haiku, plafonnement de l'output. Appliqués ensemble, ces trois leviers divisent généralement la facture Claude par deux ou plus — le détail est dans le guide d'optimisation des coûts.

Kunavo supporte-t-il l'API Anthropic Messages ?

Oui — Claude est servi par l'API native Messages (/v1/messages) et par l'endpoint compatible OpenAI /v1/chat/completions, donc n'importe quel SDK fonctionne tel quel. Le guide terrain (latence depuis Paris, TVA, RGPD) est dans le guide Claude API en France.