L’API OpenAI est facturée par token, et non par mois. Les tokens d’entrée et de sortie ont des tarifs distincts, et la sortie est la partie la plus chère. Sur Kunavo, la fourchette va de $0,04 / $0,20 par million de tokens pour GPT-6 Luna à $4,00 / $20,00 pour GPT-6 Astra, le dernier modèle phare d’OpenAI ; entre les deux se trouvent notamment GPT-6 Sol à $0,80 / $4,00 et le modèle polyvalent GPT-5.6 Terra à $0,70 / $4,20 — selon le modèle, 60–65% sous le tarif catalogue d’OpenAI. Un abonnement ChatGPT est distinct : il n’inclut pas l’utilisation de l’API, et l’API ne nécessite aucun abonnement.
État des tarifs : 3 octobre 2026. Cette page lit les tarifs Kunavo en direct du catalogue de modèles — ce qui est indiqué ici correspond à ce que l’API facture. La colonne « Tarif catalogue OpenAI » reprend le prix publié par OpenAI pour le même modèle ; la source est openai.com/api/pricing.
Abonnement ChatGPT et API OpenAI : deux produits, deux factures
Les personnes qui recherchent « coût de l’API ChatGPT » veulent souvent d’abord savoir autre chose : si leur abonnement ChatGPT actuel couvre déjà l’API. La réponse est non.
| Ce que vous utilisez | Mode de facturation | Pour qui |
|---|---|---|
| ChatGPT (Free, Plus, Pro …) | Forfait mensuel, avec les limites d’utilisation du plan | Personnes qui travaillent dans la fenêtre de chat |
| API OpenAI (clé + crédit) | Par token, sans frais mensuels | Logiciels propriétaires, automatisation, agents |
Un abonnement ne comprend ni clé API ni crédit API et ne réduit pas la facture API, même d’un centime ; inversement, le crédit API n’augmente pas les quotas dans ChatGPT. OpenAI indique les tarifs des abonnements sur openai.com/chatgpt/pricing ; ils changent souvent, c’est pourquoi ils ne figurent pas ici. Cette page traite uniquement de l’API — la partie facturée par token.
Tarifs de l’API OpenAI par modèle
Tarifs en USD par million de tokens, tels que facturés par Kunavo. La colonne « Tarif catalogue OpenAI » correspond au prix publié pour le même modèle.
| Modèle | Entrée / 1 M | Sortie / 1 M | Tarifs OpenAI (entrée / sortie) | Économie |
|---|---|---|---|---|
gpt-6-astra | $4,00 | $20,00 | $10,00 / $50,00 | ~60% |
gpt-5-6-sol | $2,00 | $12,00 | $5,00 / $30,00 Tarif promotionnel $4,00 / $20,00 (au moins jusqu’au 21 novembre 2026) | ~60% ~40 % sous le tarif promotionnel |
gpt-5-5 | $2,00 | $12,00 | $5,00 / $30,00 | ~60% |
gpt-5-6-terra | $0,70 | $4,20 | $2,00 / $12,00 | ~65% |
gpt-6-sol | $0,80 | $4,00 | $2,00 / $10,00 | ~60% |
gpt-6-luna | $0,04 | $0,20 | $0,10 / $0,50 | ~60% |
Les tarifs en direct figurent toujours sur la page des tarifs et sur chaque page de modèle, par exemple GPT-6 Astra, GPT-6 Sol ou GPT-6 Luna. Quel modèle pour quel usage :
gpt-6-astra— le dernier modèle phare d’OpenAI (depuis le 3 septembre 2026) : raisonnement de pointe et longues exécutions agentiques de programmation. Pour la minorité de tâches difficiles.gpt-6-sol— depuis le 22 septembre 2026 ; OpenAI le positionne pour la programmation complexe et les workflows agentiques. Sur Kunavo : $0,80 / $4,00, avec un tarif inférieur à celui de GPT-5.6 Terra pour la sortie, légèrement supérieur à l’entrée. Le choix par défaut pertinent pour la programmation et les agents.gpt-6-luna— depuis le 22 septembre 2026 ; selon OpenAI, le modèle le plus efficace pour les tâches ciblées à fort volume, comme la classification et l’extraction. Avec $0,04 / $0,20, c’est le niveau le moins cher sur Kunavo.gpt-5-6-sol— raisonnement de pointe et programmation agentique de la génération 5.6 ; pour les prompts déjà adaptés à ce modèle.gpt-5-6-terra— le modèle polyvalent de la famille 5.6 : RAG, assistants, classification, extraction et la plupart des tâches de production.gpt-5-5— le modèle phare de la génération précédente. GPT-5.6 Sol coûte le même tarif sur Kunavo ($2,00 / $12,00) ; ceux qui utilisent encore gpt-5-5 passent à la génération plus récente en modifiant le nom du modèle, sans coût supplémentaire par token.
GPT-6 Sol et GPT-6 Luna. Le 22 septembre 2026, OpenAI a élargi la famille GPT-6 avec deux modèles qui, selon ses propres termes, s’appuient sur les avancées derrière GPT-6 Astra. OpenAI liste GPT-6 Sol à $2,00 / $10,00 et GPT-6 Luna à $0,10 / $0,50 par million de tokens ; sur Kunavo, ils coûtent $0,80 / $4,00 et $0,04 / $0,20. Tous deux disposent d’une fenêtre de contexte de 1.050.000 tokens et produisent jusqu’à 128.000 tokens de sortie.
Ce que coûte GPT-6 Astra en plus. Par rapport à GPT-6 Sol, GPT-6 Astra coûte 5 fois plus cher, à l’entrée comme à la sortie , et par rapport à GPT-5.6 Sol, 2 fois plus cher à l’entrée et 1,7 fois plus cher à la sortie. La recommandation honnête : GPT-6 Sol comme choix par défaut pour la programmation et les agents, GPT-6 Luna pour les tâches de masse, et Astra uniquement lorsque la comparaison avec les mêmes entrées montre que Sol ne suffit pas — le nom du modèle est un seul mot dans la requête, le test est donc peu coûteux.
Un supplément pour les requêtes très longues. Au-delà de 272 000 tokens de prompt, GPT-5.5, la famille GPT-5.6 et les trois modèles GPT-6 — Astra, Sol et Luna — facturent la totalité de la requête à 2 fois le tarif d’entrée et 1,5 fois celui de sortie. Quiconque place des bases de code entières ou de longs documents dans un seul appel doit connaître ce seuil : il peut avoir plus d’effet que le choix du modèle.
Ce que coûte réellement une requête
Calculé aux tarifs Kunavo, sans mise en cache ni tokens de raisonnement — donc le plancher de ce qui figurera sur la facture :
| Tâche | Tokens (entrée / sortie) | GPT-6 Luna | GPT-5.6 Terra | GPT-6 Sol | GPT-5.6 Sol | GPT-6 Astra |
|---|---|---|---|---|---|---|
| Courte session de chat | 1.000 / 300 | $0,0001 | $0,00196 | $0,002 | $0,0056 | $0,01 |
| RAG-Antwort | 6.000 / 500 | $0,00034 | $0,0063 | $0,0068 | $0,018 | $0,034 |
| Étape de programmation agentique | 25.000 / 1.200 | $0,00124 | $0,0225 | $0,0248 | $0,0644 | $0,124 |
| Tâche de raisonnement complexe | 20.000 / 3.000 | $0,0014 | $0,0266 | $0,028 | $0,076 | $0,14 |
| Traitement par lots : 100 000 classifications | 500 / 20 par appel | $2,40 | $43,40 | $48,00 | $124,00 | $240,00 |
Le rechargement minimal de 10 $ permet environ 1.590 réponses RAG sur GPT-5.6 Terra, et environ 29.400 sur GPT-6 Luna. Entre GPT-6 Luna et GPT-6 Astra, le facteur appliqué à la sortie est d’environ 100 — pour les tâches simples, le choix du modèle est le levier individuel le plus important. Pour recalculer avec vos propres chiffres :
# OpenAI-Tarife auf Kunavo (USD pro 1M Tokens): (Input, Output)
RATES = {
"gpt-6-astra": (4, 20),
"gpt-5-6-sol": (2, 12),
"gpt-5-5": (2, 12),
"gpt-5-6-terra": (0.7, 4.2),
"gpt-6-sol": (0.8, 4),
"gpt-6-luna": (0.04, 0.2),
}
def kosten(model: str, frisch: int, output: int, cache_treffer: int = 0) -> float:
"""frisch = nicht gecachter Input; output schließt Reasoning-Tokens ein."""
i, o = RATES[model]
return (
frisch / 1_000_000 * i
+ output / 1_000_000 * o
+ cache_treffer / 1_000_000 * i * 0.10 # Cache-Treffer: 10 % des Input-Tarifs
)
print(kosten("gpt-5-6-terra", 1_000, 300)) # kurze Chat-Runde
print(kosten("gpt-5-6-terra", 6_000, 500)) # RAG-Antwort
print(kosten("gpt-5-6-sol", 25_000, 1_200)) # agentischer Coding-Schritt
print(kosten("gpt-6-sol", 25_000, 1_200)) # derselbe Schritt auf GPT-6 Sol
print(kosten("gpt-6-astra", 20_000, 3_000)) # schwere Reasoning-Aufgabe
print(kosten("gpt-6-luna", 500, 20)) # eine Klassifizierung
# Ein Monat auf Sol: 3 Mio. frische und 12 Mio. gecachte Input-Tokens,
# 1 Mio. Output-Tokens (Cache-Writes nicht eingerechnet)
print(kosten("gpt-5-6-sol", 3_000_000, 1_000_000, cache_treffer=12_000_000))Deux pièges de coût que toute estimation ignore
Premièrement : les tokens de raisonnement. Les modèles de raisonnement comme GPT-6 Astra ou GPT-5.6 Sol réfléchissent avant de répondre à l’aide de tokens internes. Ils n’apparaissent pas dans le texte de réponse, mais sont facturés au tarif de sortie. Les calculs d’exemple de cette page ne les incluent pas ; pour les tâches complexes, la facture réelle est donc supérieure. Le nombre réel figure dans chaque réponse sous usage (completion_tokens_details.reasoning_tokens).
Deuxièmement : les répétitions. Une réponse revenue correctement mais rejetée par votre code — mauvais format, nouvelle tentative — est payée. Avec les agents, une tâche visible correspond souvent à une douzaine d’exécutions facturées, et c’est là que l’écart entre estimation et facture est le plus important. Les requêtes qui échouent chez Kunavo même ne sont pas facturées.
Mise en cache des prompts
Si votre application envoie le même long prompt système ou les mêmes documents à chaque requête, les accès au cache réussis sont facturés à 10 % du tarif d’entrée — pour GPT-5.6 Sol, cela représente $0,20 au lieu de $2,00 par million de tokens. L’écriture dans le cache coûte sur Kunavo 1,25 fois le tarif d’entrée pour GPT-5.6 Sol, Terra et GPT-6 Astra, et le tarif d’entrée normal pour GPT-5.5. La façon d’obtenir un accès au cache réussi est décrite dans la documentation sur la mise en cache.
Adapter un code OpenAI existant
Kunavo est compatible avec OpenAI : vous modifiez base_url et la clé, rien d’autre. chat.completions et responses conservent leur forme, et la réponse contient comme d’habitude le champ usage, qui permet de reconstituer chaque facture.
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1", # statt api.openai.com
)
resp = client.chat.completions.create(
model="gpt-5-6-terra",
messages=[{"role": "user", "content": "Fasse diese Rechnung in drei Sätzen zusammen."}],
)
print(resp.choices[0].message.content)
print(resp.usage) # Input-, Output- und Reasoning-Tokens: die Grundlage der AbrechnungCréez la clé (sk-kn-…) après votre inscription, dans le tableau de bord. Vous pouvez également y définir une limite mensuelle de dépenses par clé — une fois atteinte, la clé répond 402 — ainsi qu’une liste blanche d’adresses IP. Les étapes sont présentées dans le guide de démarrage rapide.
Payer l’API OpenAI depuis l’Allemagne
Kunavo facture via Stripe, sous forme de solde prépayé : aucun abonnement et aucune création de compte OpenAI Platform. Le paiement permet de choisir entre :
- Cartes : Visa, Mastercard, American Express, JCB et UnionPay — les cartes de débit Visa et Mastercard fonctionnent comme des cartes de crédit
- Apple Pay, Google Pay et Link
Le prélèvement SEPA n'est actuellement pas proposé. Les rechargements sont indiqués en dollars américains ; Stripe affiche le montant dans votre devise au moment du paiement. Le rechargement minimum est de $10 ; les rechargements plus importants donnent droit à un bonus : $100 deviennent $110,00, $1.000 deviennent $1.200,00 et $5.000 deviennent $6.250,00. Le solde n'expire jamais et les requêtes échouées ne sont pas facturées. Les détails figurent dans la documentation de facturation.
En toute franchise : quand l’accès direct à OpenAI est préférable
Kunavo est une passerelle à capacité partagée : aucun quota propre à votre compte et aucun SLA contractuel. Toute personne ayant besoin d’un quota garanti ou d’un SLA, par exemple pour un produit assorti d’une disponibilité promise, devrait acheter directement auprès d’OpenAI. Cette page ne prétend pas couvrir ce cas.
Pour les personnes qui travaillent toute la journée dans la fenêtre de chat, un abonnement ChatGPT est souvent le choix le moins cher. Le calcul est une division : prix de l’abonnement ÷ coût d’un échange de chat = seuil de rentabilité. Un échange avec 2 000 tokens d’entrée et 700 tokens de sortie coûte environ $0,0124 sur GPT-5.6 Sol, et environ $0,00434 sur GPT-5.6 Terra. Si vous effectuez mois après mois plus d’échanges que le résultat de cette division, tout en restant dans les limites du plan, l’abonnement est plus avantageux. L’API l’emporte pour les logiciels, l’automatisation et l’utilisation fluctuante — là où un mois calme ne devrait rien coûter.
Réduire les coûts de l’API OpenAI — dans cet ordre
- Choisir le modèle en fonction de la tâche. Laisser le plus grand modèle comme choix par défaut est la cause la plus fréquente d’une facture surprenante. La classification, l’extraction et les autres tâches de masse vont à
gpt-6-luna, la programmation et les agents àgpt-6-sol, et la minorité de tâches difficiles à Astra. - Plafonner la sortie. La sortie coûte plusieurs fois plus cher que l’entrée, et le raisonnement est inclus — une limite supérieure à
max_tokensagit donc deux fois. - Utiliser la mise en cache des prompts. Un long prompt système stable coûte un dixième du tarif d’entrée lorsqu’il est récupéré depuis le cache.
- Envoyer moins de contexte. Quelques sections RAG précises plutôt que la moitié de la base de connaissances — et rester sous le seuil de 272 000 tokens lorsque c’est possible.
Refaites le calcul avec vos propres chiffres : le calculateur de prix de l’API OpenAI prend en compte l’entrée mise en cache et les tokens de raisonnement, tandis que le calculateur de tokens compare Claude et GPT côte à côte. L’équivalent pour Anthropic : Tarifs de Claude. Si ce ne sont pas les coûts, mais les limites qui vous freinent : limites de débit de l’API OpenAI (en anglais).
Questions fréquentes
Combien coûte l’API OpenAI ?
L’API OpenAI est facturée par token, sans frais mensuels : les tokens d’entrée et de sortie ont des tarifs distincts, et la sortie est la partie la plus chère. Sur Kunavo, GPT-5.6 coûte Terra $0,70 / $4,20 par million de tokens (entrée / sortie), GPT-5.6 coûte Sol $2,00 / $12,00, et le dernier modèle phare d’OpenAI, GPT-6, coûte Astra $4,00 / $20,00. Les tarifs catalogue d’OpenAI pour les mêmes modèles sont de $2,00 / $12,00, $5,00 / $30,00 et $10,00 / $50,00 ; pour GPT-5.6 Sol, OpenAI facture actuellement un tarif promotionnel de $4,00 / $20,00, selon la page des tarifs au moins jusqu’au 21 novembre 2026. État au : 3 octobre 2026.
L’API est-elle incluse dans l’abonnement ChatGPT ?
Non. Un abonnement ChatGPT comme Plus ou Pro paie l’utilisation de ChatGPT lui-même — dans le navigateur, l’application et sur ordinateur. Il ne comprend ni clé API ni crédit API et ne réduit pas la facture API, même d’un centime. Toute personne qui appelle GPT depuis son propre logiciel a besoin d’une clé API et paie par token, séparément de l’abonnement. Inversement, le crédit API n’augmente pas les quotas dans ChatGPT.
Combien coûte une requête à l’API ChatGPT ?
Ce que l’on appelle familièrement « API ChatGPT » est l’API OpenAI utilisant les modèles GPT, et chaque requête est facturée selon le nombre de tokens. Aux tarifs Kunavo, une réponse RAG avec 6 000 tokens d’entrée et 500 tokens de sortie sur GPT-5.6 Terra coûte environ $0,0063, une étape de programmation agentique avec 25 000 / 1 200 tokens sur GPT-5.6 Sol environ $0,0644, et une tâche complexe avec 20 000 / 3 000 tokens sur GPT-6 Astra environ $0,14. Les tokens de raisonnement s’ajoutent au tarif de sortie.
Puis-je tester gratuitement l’API OpenAI ?
Kunavo n’offre pas de crédit de bienvenue, mais ne facture aucun frais mensuel ni durée minimale d’engagement. Le plus petit démarrage consiste en un rechargement minimal de 10 $ — ce qui permet environ 1.590 réponses RAG sur GPT-5.6 Terra. Le solde n’expire jamais, un mois sans appel ne coûte rien et les requêtes ayant échoué ne sont pas facturées.
Comment les tokens de raisonnement sont-ils facturés ?
Concernant le tarif de sortie. Les modèles de raisonnement comme GPT-6 Astra ou GPT-5.6 Sol réfléchissent avant de répondre au moyen de tokens internes ; ceux-ci n’apparaissent pas dans le texte de la réponse, mais figurent dans la facturation. Chaque réponse fournit leur nombre réel dans le champ usage (completion_tokens_details.reasoning_tokens). Pour les tâches difficiles, c’est la raison la plus fréquente pour laquelle la facture réelle dépasse l’estimation ; une limite définie via max_tokens les plafonne.
Combien coûte GPT-6 Astra ?
GPT-6 Astra est le modèle phare le plus récent d’OpenAI depuis le 3 septembre 2026 ; OpenAI le répertorie à $10,00 / $50,00 par million de tokens. Chez Kunavo, il coûte $4,00 / $20,00 — environ 60 % inférieur au tarif catalogue. Par rapport à GPT-5.6 Sol, cela représente 2 fois plus pour l’entrée et 1,7 fois plus pour la sortie ; Astra vaut donc la peine pour la minorité de tâches difficiles pour lesquelles Sol ne suffit manifestement pas. Au-delà de 272 000 tokens d’invite, l’intégralité de la requête est également facturée chez Astra aux tarifs multipliés par 2 pour l’entrée et par 1,5 pour la sortie.
Combien coûtent GPT-6 Sol et GPT-6 Luna ?
OpenAI a publié GPT-6 Sol et GPT-6 Luna le 22 septembre 2026 : Sol pour le codage complexe et les workflows agentiques, et Luna, selon les termes d’OpenAI, comme modèle le plus efficace pour les tâches ciblées à fort volume. OpenAI répertorie Sol à $2,00 / $10,00 et Luna à $0,10 / $0,50 par million de tokens (entrée / sortie) ; chez Kunavo, ils coûtent $0,80 / $4,00 et $0,04 / $0,20, beide rund 60% darunter. GPT-6 Luna est donc le modèle GPT le moins cher chez Kunavo. Comme pour GPT-5.5, la famille GPT-5.6 et GPT-6 Astra, une requête de plus de 272 000 tokens d’invite est entièrement facturée aux tarifs multipliés par 2 pour l’entrée et par 1,5 pour la sortie.
Puis-je payer depuis l’Allemagne par prélèvement SEPA ?
Non, le prélèvement SEPA n'est actuellement pas proposé. Le paiement Stripe propose les cartes (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay, Google Pay et Link ; une carte de débit Visa ou Mastercard fonctionne comme une carte de crédit. Il s'agit d'un solde prépayé avec un rechargement minimum de $10, sans abonnement, et qui n'expire jamais.
Mon code OpenAI existant fonctionne-t-il avec Kunavo ?
Oui. Kunavo est compatible avec OpenAI : définissez base_url sur https://api.kunavo.com/v1 et remplacez la clé par une clé Kunavo (sk-kn-…) ; chat.completions et responses conservent leur format. Les noms des modèles sont gpt-6-astra, gpt-5-6-sol, gpt-5-5, gpt-5-6-terra, gpt-6-sol et gpt-6-luna. La même clé permet également d’appeler Claude ainsi que les modèles d’image et de vidéo.