Codex a deux prix, et presque toutes les réponses à « combien coûte Codex » n'en donnent qu'un. Avec un abonnement ChatGPT, Codex est compris dans un forfait mensuel fixe, avec des limites d'usage fixées par OpenAI. Avec une clé d'API, vous payez au token — input, input en cache et output — sans abonnement : chez Kunavo, GPT-5.6 Sol, le modèle que nous recommandons par défaut pour Codex, coûte $2,00 par million de tokens d'input, $0,20 d'input en cache et $12,00 d'output, et une vraie tâche de 20 étapes revient à environ $0,62 ($1,29 sans cache). La voie la moins chère se décide par une division : le prix du forfait ÷ le coût d'une tâche. Un usage interactif intensif tous les jours penche vers l'abonnement ; un usage par à-coups ou automatisé, vers l'API.
Cette page ne recopie pas les formules d'OpenAI — elles changent, et une copie est fausse la semaine suivante ; les montants actuels sont sur la page tarifaire de ChatGPT. Elle fait le calcul que les comparatifs de forfaits sautent : le prix au token, une vraie tâche détaillée ligne par ligne et le point d'équilibre, que vous complétez avec le prix de votre forfait. Tarifs vérifiés le 11 septembre 2026 ; les prix Kunavo sont lus en direct depuis le catalogue de modèles.
Abonnement ou clé d'API : les deux voies
| Abonnement ChatGPT | Clé d'API (au token) | |
|---|---|---|
| Facturation | Forfait mensuel fixe | Au token : input, input en cache, output |
| Limites | Fenêtres d'usage fixées par OpenAI | Aucune fenêtre ; la limite, c'est votre solde et le plafond que vous fixez à la clé |
| Un mois sans coder | Facturé intégralement | $0 |
| Un mois chargé | Peut buter sur la limite et attendre | Suit le travail — la facture aussi |
| Automatisation (CI, scripts) | Connexion à votre compte ChatGPT | Une clé par job, avec son propre plafond de dépense |
Les deux voies ne se cumulent pas, mais elles cohabitent : vous pouvez garder l'abonnement et ne passer sur la clé que les jours où la limite est atteinte, en changeant le model_provider dans le config.toml.
Le prix de Codex au token : les modèles adaptés
| Modèle | Pour quoi | Kunavo par 1M (input / en cache / output) | Tarif public OpenAI (input / output) | Tâche de 20 étapes |
|---|---|---|---|---|
| GPT-5.6 Sol | Par défaut : la plupart des tâches de code | $2,00 / $0,20 / $12,00 | $5,00 / $30,00 | $0,62 |
| GPT-6 Astra | Seulement les plus dures — le bug qui résiste, le gros refactoring | $4,00 / $0,40 / $20,00 | $10,00 / $50,00 | $1,14 |
| GPT-5.6 Terra | Étapes routinières et bien cadrées | $0,70 / $0,07 / $4,20 | $2,00 / $12,00 | $0,22 |
| GPT-5.6 Luna | Tâches mécaniques : renommer, formater, résumer un diff | $0,07 / $0,007 / $0,42 | $0,20 / $1,20 | $0,022 |
L'input en cache est facturé 0,10× le tarif d'input ; les écritures de cache coûtent 1,25× l'input sur GPT-5.6 Sol/Terra/Luna et GPT-6 Astra. La colonne OpenAI sort du même catalogue, pour vérifier plutôt que croire — sur GPT-5.6 Sol, Kunavo est environ 60 % sous le tarif public. La fiche complète du modèle : GPT-5.6 Sol chez Kunavo.
Une vraie tâche, ligne par ligne
Codex est agentique : une demande devient de nombreux allers-retours facturés avec le modèle. L'unité qui compte est l'étape — lire le contexte, proposer une modification ou lancer une commande, rendre compte. Comme l'outil renvoie le contexte à chaque étape, une étape typique pèse environ 25 000 tokens d'input et 1 200 d'output. L'essentiel de l'input se répète (instructions, fichiers déjà lus) et vient du cache : on suppose 20 000 tokens en cache et 5 000 nouveaux, et on compte les nouveaux comme une écriture de cache à 1,25× — le cas pessimiste.
| Poste (GPT-5.6 Sol) | Tokens par étape | Tarif par 1M | Coût par étape |
|---|---|---|---|
| Input lu depuis le cache | 20 000 | $0,20 (0,10×) | $0,0040 |
| Input nouveau, écrit en cache | 5 000 | $2,50 (1,25×) | $0,013 |
| Output (raisonnement inclus) | 1 200 | $12,00 | $0,014 |
| Une étape | — | — | $0,031 |
| Tâche de 20 étapes | ×20 | — | $0,62 |
| La même tâche sans cache | ×20 | — | $1,29 |
| La même tâche au tarif public OpenAI, avec cache | ×20 | — | $1,54 |
Pour remplacer l'hypothèse par vos propres chiffres, reprenez l'usage renvoyé par l'API — input total, input en cache, output — et passez-le à cette fonction :
# Ce qu'a coûté une tâche Codex, à partir de l'usage renvoyé par l'API.
IN, OUT = 2.00, 12.00 # USD par 1M de tokens (gpt-5-6-sol chez Kunavo)
LECTURE, ECRITURE = 0.10, 1.25 # coefficients de cache sur le tarif d'input
def cout(input_total, en_cache, output, ecrit=0):
neuf = input_total - en_cache - ecrit
return (neuf * IN
+ en_cache * IN * LECTURE
+ ecrit * IN * ECRITURE
+ output * OUT) / 1_000_000 # output, raisonnement inclus
# 20 étapes : 500 000 d'input (400 000 en cache, 100 000 écrits), 24 000 d'output
print(round(cout(500_000, 400_000, 24_000, 100_000), 2))Le point d'équilibre — une division
Toute la décision tient en une ligne : prix du forfait ÷ coût d'une tâche = nombre de tâches par mois que l'abonnement doit remplacer pour être rentable. Avec la tâche de 20 étapes sur GPT-5.6 Sol :
| Forfait mensuel (exemple) | Équilibre avec cache ($0,62 par tâche) | Équilibre sans cache ($1,29 par tâche) |
|---|---|---|
| $20/mois | ~32 tâches | ~16 tâches |
| $100/mois | ~162 tâches | ~78 tâches |
| $200/mois | ~324 tâches | ~155 tâches |
Les montants sont des valeurs rondes à remplacer, pas la grille d'OpenAI. Le verdict honnête dépend de la forme de votre usage :
- Usage interactif intensif, chaque jour : cinq tâches par jour ouvré, c'est environ 110 par mois — $67,98 en facturation au token sur GPT-5.6 Sol. Un forfait dont le prix est inférieur à ce montant revient moins cher, à condition que ses limites d'usage absorbent ce volume.
- Usage par à-coups : trois jours intenses dans le mois, 15 tâches, font $9,27. C'est sous n'importe quel forfait, et un mois sans coder coûte $0.
- Automatisation (CI, scripts, agents sans surveillance) : la clé est la forme naturelle — une par job, avec un plafond de dépense mensuel par clé (l'API répond 402 une fois le plafond atteint) et une liste d'IP autorisées, dans
/app/keys.
Un détail tire dans le même sens : les jours chargés, ceux pour lesquels on s'abonne, sont justement ceux où l'on bute sur la limite — et une limite atteinte, c'est de la capacité payée et non livrée. En face, un forfait est prévisible et une facture au token ne l'est pas, ce qui compte dans un budget d'équipe.
Faire tourner Codex CLI avec une clé au token
Une contrainte élimine la plupart des passerelles : Codex CLI n'accepte que wire_api = "responses", donc l'endpoint doit servir POST /v1/responses, pas seulement les chat completions. Kunavo sert les deux :
# ~/.codex/config.toml — Codex CLI sur une clé au token, sans abonnement.
model = "gpt-5-6-sol"
model_provider = "kunavo"
[model_providers.kunavo]
name = "Kunavo"
base_url = "https://api.kunavo.com/v1"
env_key = "KUNAVO_API_KEY" # le NOM de la variable, pas la clé
wire_api = "responses" # la seule valeur acceptée (et la valeur par défaut)export KUNAVO_API_KEY=sk-kn-... # à créer dans /app/keys
codex # modèle du config.toml (gpt-5-6-sol)
codex -m gpt-5-6-luna # tâche mécanique : le modèle le moins cher
codex -m gpt-6-astra # seulement si GPT-5.6 Sol n'a pas suffiLa clé n'est jamais dans le fichier : env_key est le nom d'une variable d'environnement que Codex lit au démarrage. Chaque champ est détaillé dans la documentation d'intégration de Codex CLI, et la mise en place complète, avec les erreurs 401 et 404 les plus courantes, dans le guide de la clé d'API pour Codex CLI (tous deux en anglais).
Ce qui fait bouger le chiffre réel
Les tokens de raisonnement. Les modèles GPT réfléchissent avant de répondre, et cette réflexion est facturée comme de l'output sans apparaître dans le diff. Chaque tranche de 1 000 tokens d'output en plus par étape ajoute $0,012 sur GPT-5.6 Sol, soit $0,24 sur une tâche de 20 étapes. Fiez-vous à l'output facturé dans l'usage, pas à la longueur de la réponse.
Le cache. C'est le plus gros levier, plus fort qu'un changement de modèle : la même tâche coûte $1,29 sans cache et $0,62 avec. Les sessions au contexte stable en profitent le plus. Le calculateur de prix de l'API OpenAI a un champ pour ça.
Le contexte long. La famille GPT-5.6 et GPT-6 Astra facturent la requête ENTIÈRE à 2× l'input / 1,5× l'output au-delà de 272 000 tokens de prompt. Repartir d'une nouvelle session coûte moins cher que de pousser une session devenue trop grosse.
Le modèle par étape. La même tâche de 20 étapes coûte $0,022 sur GPT-5.6 Luna, $0,22 sur GPT-5.6 Terra et $1,14 sur GPT-6 Astra. Gardez GPT-6 Astra pour ce que GPT-5.6 Sol n'a pas résolu.
Les échecs. Chez Kunavo, les requêtes en échec ne sont pas facturées. Une nouvelle tentative qui réussit, en revanche, est un appel facturé comme un autre.
Payer depuis la France
Les tarifs au token sont en dollars US, et la recharge passe par le checkout Stripe : cartes (Visa, Mastercard, American Express), Apple Pay et Link. Le prélèvement SEPA n'est pas proposé pour l'instant ; une carte de débit adossée à votre compte fonctionne normalement.
C'est un solde prépayé : recharge minimum $10, sans abonnement, et le solde n'expire jamais. Les grosses recharges reçoivent un bonus — $100 deviennent $110,00 et $1 000 deviennent $1 250,00. D'après le calcul ci-dessus, $10 couvrent environ 16 tâches de 20 étapes sur GPT-5.6 Sol. Détails dans la documentation de facturation.
Honnêtement : quand Kunavo n'est pas le bon choix
La contrepartie, face à un appel direct à OpenAI, c'est une capacité partagée : pas de quota dédié ni de SLA contractuel. Si vous avez besoin d'un quota garanti ou d'un SLA par contrat, passez directement par OpenAI. Et, comme le montre le calcul ci-dessus, un usage interactif intensif de Codex chaque jour peut revenir moins cher avec un abonnement. Ce que la clé apporte, c'est le reste : pas d'abonnement, des tarifs sous le prix public et une seule clé pour GPT, Claude et Gemini.
Codex ou Claude Code
Ce sont deux CLI agentiques facturés à l'étape : le calcul de cette page vaut pour les deux, seul le tarif change. Le côté Claude, avec la même unité de 25 000 / 1 200 tokens, est dans Prix de Claude Code, et la comparaison des outils dans Claude Code vs Codex (en anglais). Une clé Kunavo atteint les deux, et le choix devient un argument -m plutôt qu'un second compte.
Questions fréquentes
Combien coûte Codex ?
Codex a deux prix. Avec un abonnement ChatGPT, il est compris dans un forfait mensuel fixe, avec des limites d'usage fixées par OpenAI (le montant actuel figure sur la page tarifaire de ChatGPT). Avec une clé d'API, vous payez au token, sans abonnement : chez Kunavo, GPT-5.6 Sol, le modèle recommandé par défaut pour Codex, coûte $2,00 par million de tokens d'input, $0,20 d'input en cache et $12,00 d'output, contre $5,00 / $30,00 au tarif public d'OpenAI. Une tâche de 20 étapes (25 000 tokens d'input par étape, dont 80 % en cache, 1 200 d'output) revient à environ $0,62.
Codex est-il gratuit ?
Codex CLI est gratuit et open source, mais le modèle derrière ne l'est jamais : chaque étape est un appel facturé, qu'il soit décompté du quota d'un abonnement ou payé via une clé d'API. Si le forfait gratuit de ChatGPT inclut Codex, et dans quelle mesure, c'est OpenAI qui le décide et le modifie — sa page tarifaire fait foi. La voie sans abonnement est la clé au token : un mois sans coder coûte $0.
Quel est le prix de Codex d'OpenAI via l'API ?
Via l'API, Codex CLI facture les tokens du modèle que vous choisissez. Chez Kunavo, par million de tokens d'input / d'output : GPT-5.6 Sol $2,00 / $12,00, GPT-6 Astra $4,00 / $20,00, GPT-5.6 Terra $0,70 / $4,20 et GPT-5.6 Luna $0,07 / $0,42. L'input en cache est facturé 0,10× l'input, et les écritures de cache 1,25× l'input sur ces quatre modèles.
Abonnement ChatGPT ou API : lequel revient le moins cher pour Codex ?
Divisez le prix du forfait par le coût d'une tâche : vous obtenez le nombre de tâches par mois que l'abonnement doit remplacer pour être rentable. Avec une tâche de 20 étapes à $0,62 sur GPT-5.6 Sol, un forfait de $20 s'équilibre vers 32 tâches et un forfait de $100 vers 162 (montants d'exemple, pas la grille d'OpenAI). Un usage interactif intensif chaque jour dépasse ces seuils et l'abonnement gagne, tant que ses limites tiennent. Un usage par à-coups ou automatisé reste en dessous, et l'API gagne.
Combien coûte une tâche avec Codex ?
Tout dépend du nombre d'étapes, pas des heures. Une étape typique pèse environ 25 000 tokens d'input, parce que Codex renvoie le contexte à chaque appel, et 1 200 tokens d'output. Sur GPT-5.6 Sol via Kunavo, avec 20 000 de ces tokens lus depuis le cache, une étape coûte $0,031 et une tâche de 20 étapes $0,62 ; sans cache, la même tâche revient à $1,29. Les tokens de raisonnement sont facturés comme de l'output sans apparaître dans la réponse : fiez-vous à l'usage réel.
Comment payer depuis la France ? Le prélèvement SEPA est-il accepté ?
Le prélèvement SEPA n'est pas proposé pour l'instant. Le checkout Stripe accepte les cartes (Visa, Mastercard, American Express), Apple Pay et Link ; une carte de débit adossée à votre compte fonctionne normalement. C'est un solde prépayé dès $10, qui n'expire jamais, et les requêtes en échec ne sont pas facturées.
Quel modèle choisir dans Codex pour dépenser moins ?
Adaptez le modèle à l'étape. GPT-5.6 Sol est le choix par défaut pour les tâches de code ; GPT-5.6 Luna ($0,07 / $0,42) règle les tâches mécaniques pour une fraction du coût ; GPT-5.6 Terra se place entre les deux ; GPT-6 Astra ($4,00 / $20,00) ne se rentabilise que là où GPT-5.6 Sol n'a pas suffi. Un modèle faible qui s'y reprend à trois fois coûte plus cher qu'un modèle fort qui réussit du premier coup.
Codex CLI fonctionne-t-il avec la clé d'API d'un autre fournisseur ?
Oui, via un bloc [model_providers] dans ~/.codex/config.toml — mais uniquement sur la Responses API : Codex n'accepte que wire_api = "responses", donc le fournisseur doit servir POST /v1/responses. Une passerelle qui ne propose que /v1/chat/completions ne peut pas faire tourner Codex. Kunavo sert /v1/responses, avec la base_url https://api.kunavo.com/v1.