L’API ChatGPT est en fait l’API OpenAI : facturation au token, sans frais mensuels. Au 5 octobre 2026, le tarif officiel du dernier modèle phare d’OpenAI, GPT-6 Astra, est de $10.00 en entrée / $50.00 en sortie par 1M de tokens ; chez Kunavo, il est de $4.00 / $20.00. Le modèle principal pour un usage quotidien, GPT-5.6 Terra, coûte $0.70 / $4.20 (tarif officiel : $2.00 / $12.00), tandis que GPT-6 Sol et GPT-6 Luna, lancés le 22 septembre, coûtent respectivement $0.80 / $4.00 et $0.04 / $0.20. La sortie est plus chère que l’entrée, et les tokens de raisonnement des modèles de raisonnement sont également facturés comme sortie.
Le point qui bloque le plus souvent : l’abonnement ChatGPT et l’API OpenAI sont deux comptes distincts. Un abonnement ChatGPT Plus ne fournit ni clé API ni quota API ; pour appeler l’API depuis un programme, vous devez demander une clé séparément et payer les tokens séparément. Cette page traite uniquement de ce second cas — l’appel depuis un programme.
Tarifs vérifiés le 5 octobre 2026. Les tarifs officiels de l’API OpenAI sont disponibles sur openai.com/api/pricing, et les tarifs mensuels des forfaits ChatGPT sur chatgpt.com/pricing (les prix des forfaits changent régulièrement et ne sont pas reproduits ici). Les chiffres de Kunavo sont issus du catalogue de modèles de ce site et correspondent aux montants effectivement facturés par l’API.
Abonnement ChatGPT vs API OpenAI — deux comptes distincts
| Abonnement ChatGPT | API OpenAI | |
|---|---|---|
| Ce que vous payez | Frais mensuels du forfait (gratuit, Go, Plus, Pro, etc.) | Par token, sans frais mensuels |
| Utilisation | Conversations sur chatgpt.com et dans l’application | Appels depuis votre programme, produit ou script |
| Clé API | Non inclus | Oui |
| Plafond | Limite d’utilisation du forfait | Limites de débit et budget personnel |
| Mois sans utilisation | Frais mensuels prélevés | $0 |
Quand un abonnement est-il plus avantageux ? Avec $20, vous pouvez effectuer environ 1,600 tours de conversation avec GPT-5.6 Sol et environ 4,600 avec GPT-5.6 Terra (2 000 tokens en entrée / 700 en sortie par tour). Si vous discutez uniquement de manière intensive dans ChatGPT, que vous dépassez ce volume mensuel et que la limite du forfait vous suffit, l’abonnement est plus avantageux. Pour les appels depuis un programme ou une consommation irrégulière, la facturation au token coûte moins cher.
Tarifs de l’API GPT — par 1M de tokens
| Modèle | Officiel OpenAI (entrée / sortie) | Kunavo (entrée / sortie) | Écart de prix | Adapté à |
|---|---|---|---|---|
| GPT-6 Astra | $10.00 / $50.00 | $4.00 / $20.00 | Environ 60 % moins cher | Le raisonnement le plus difficile et le coding agentic longue durée |
| GPT-6 Sol | $2.00 / $10.00 | $0.80 / $4.00 | Environ 60 % moins cher | Programmation complexe et workflows agentic (positionnement d’OpenAI) |
| GPT-6 Luna | $0.10 / $0.50 | $0.04 / $0.20 | Environ 60 % moins cher | L’option la moins chère : tâches ciblées et volumineuses comme la classification, l’extraction et le routage |
| GPT-5.6 Sol | $5.00 / $30.00 tarif promotionnel actuel $4.00 / $20.00 (au moins jusqu’au 21 novembre 2026) | $2.00 / $12.00 | Environ 60 % moins cher environ 40 % moins cher que le tarif promotionnel | Le modèle phare de GPT-5.6, axé sur le raisonnement et la programmation |
| GPT-5.6 Terra | $2.00 / $12.00 | $0.70 / $4.20 | Environ 65 % moins cher | Le modèle polyvalent quotidien de GPT-5.6 : RAG, service client et réécriture |
| GPT-5.5 | $5.00 / $30.00 | $2.00 / $12.00 | Environ 60 % moins cher | Le modèle phare de la génération précédente, pour continuer à utiliser le code existant |
GPT-6 Astra est le dernier modèle phare présenté par OpenAI le 3 septembre 2026. Son tarif de sortie chez Kunavo est environ 1.7 fois celui de GPT-5.6 Sol : réservez-le aux tâches que les modèles moins chers ne réussissent pas et ne le définissez pas par défaut. GPT-5.5 et GPT-5.6 Sol ont le même prix par token (le mode de calcul des écritures en cache diffère, voir ci-dessous). Autre point important : les modèles GPT appelés via Kunavo n’acceptent actuellement que les entrées texte ; pour les tâches impliquant des images, utilisez Claude.
GPT-6 Sol et GPT-6 Luna sont deux modèles lancés par OpenAI le 22 septembre 2026. OpenAI indique qu’ils s’appuient tous deux sur les avancées techniques de GPT-6 Astra ; leur fenêtre de contexte est de 1 050 000 tokens et leur sortie maximale de 128 000 tokens. OpenAI positionne GPT-6 Sol pour la programmation complexe et les flux de travail agentiques ; chez Kunavo, il coûte $0.80 / $4.00. GPT-6 Luna est décrit par OpenAI comme le modèle le plus efficace pour traiter des tâches ciblées en grand nombre ; chez Kunavo, il coûte $0.04 / $0.20 et c’est le GPT le moins cher de ce tableau. Il n’est plus nécessaire de commencer les nouveaux projets avec GPT-5.6 Sol : GPT-6 Sol coûte $0.80 / $4.00 chez Kunavo, avec des tarifs d’entrée et de sortie inférieurs à ceux de GPT-5.6 Sol, qui sont de $2.00 / $12.00.
Coût réel d’une requête
Un tableau de tarifs est moins parlant qu’une requête réelle. Les montants ci-dessous sont tous calculés à partir des tarifs Kunavo du tableau précédent :
| Usage | Tokens (entrée / sortie) | GPT-6 Luna | GPT-5.6 Terra | GPT-6 Sol | GPT-5.6 Sol | GPT-6 Astra |
|---|---|---|---|---|---|---|
| Un tour de conversation court | 1,000 / 300 | $0.0001 | $0.002 | $0.002 | $0.0056 | $0.01 |
| Une réponse RAG | 6,000 / 500 | $0.00034 | $0.0063 | $0.0068 | $0.018 | $0.034 |
| Une question difficile | 20,000 / 3,000 | $0.0014 | $0.027 | $0.028 | $0.076 | $0.140 |
| 100 000 éléments traités par lots | 500 / 20 × 100,000 | $2.40 | $43.40 | $48.00 | $124.00 | $240.00 |
GPT-6 Sol ou GPT-5.6 Terra ? Le tarif de sortie de GPT-6 Sol est inférieur à celui de Terra, mais son tarif d’entrée est supérieur. Pour les requêtes avec beaucoup d’entrée et peu de sortie — comme la réponse RAG et le traitement par lots de 100 000 éléments du tableau — Terra est donc moins cher ; plus la part de sortie est élevée, plus GPT-6 Sol devient avantageux.
Deux éléments peuvent rendre le montant réel supérieur à celui du tableau. Le premier est le reasoning token : avant de répondre, les modèles de raisonnement génèrent des tokens de réflexion qui n’apparaissent pas dans la réponse, mais sont facturés au tarif de sortie ; l’écart augmente avec la difficulté de la question. Le second est la répétition de la demande : les requêtes échouées ne sont pas facturées, mais si vous reposez la question après une réponse réussie parce que le format est incorrect, chaque appel est facturé. Consultez les valeurs réelles dans usage et faites le calcul avec vos propres chiffres :
# OpenAI API 的費用,用實際 token 數算。
# Kunavo 費率,每 1M token USD:(input, output)
RATES = {
"gpt-6-astra": (4.00, 20.00),
"gpt-6-sol": (0.80, 4.00),
"gpt-6-luna": (0.04, 0.20),
"gpt-5-6-sol": (2.00, 12.00),
"gpt-5-6-terra": (0.70, 4.20),
}
def cost(model, inp, out):
i, o = RATES[model]
# reasoning token 不會出現在回覆裡,但按「輸出」費率計費
return inp / 1e6 * i + out / 1e6 * o
print(cost("gpt-5-6-terra", 6_000, 500)) # RAG 回答一次
print(cost("gpt-6-astra", 20_000, 3_000)) # 難題一次
print(cost("gpt-6-luna", 500, 20) * 100_000) # 10 萬筆批次Prompts longs et mise en cache : deux règles qui modifient le tarif unitaire
Requêtes dépassant 272K tokens. Pour GPT-5.5, GPT-5.6 Sol et Terra, ainsi que GPT-6 Astra, Sol et Luna — c’est-à-dire tous les modèles du tableau — lorsque le prompt d’une requête dépasse 272K tokens, toute la requête est facturée à 2 fois le tarif d’entrée / 1,5 fois le tarif de sortie. Il s’agit de la règle d’OpenAI pour les longs contextes, appliquée de la même manière par Kunavo ; le pourcentage de remise par rapport aux tarifs officiels reste donc identique avant et après le seuil. Pour les documents longs pouvant être découpés, essayez de rester sous 272K tokens.
Mise en cache. La lecture du cache est facturée à 10% du tarif d’entrée ; l’écriture dans le cache est facturée à GPT-6 Astra、GPT-6 Sol、GPT-6 Luna、GPT-5.6 Sol 與 GPT-5.6 Terra 收輸入費率的 1.25 倍,GPT-5.5 按一般輸入費率. Lorsque vous envoyez à chaque fois la même structure de prompt système long, c’est le principal levier ; le fonctionnement est décrit dans les documents sur la mise en cache.
Passer d’un programme OpenAI existant
Kunavo est un endpoint compatible avec OpenAI : vous n’avez pas besoin de changer de SDK. Modifiez base_url et la clé ; chat.completions et responses continuent de fonctionner tels quels.
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1", # 只改這一行
)
resp = client.chat.completions.create(
model="gpt-5-6-terra",
messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)Les étapes complètes sont disponibles dans le démarrage rapide et la spécification de l’endpoint dans la documentation Chat Completions (en anglais).
En toute franchise : quand choisir directement OpenAI
La passerelle utilise une capacité partagée : aucun quota dédié et aucun SLA garanti par contrat. Si vous avez besoin d’un quota garanti, de limites de débit définies ou d’un SLA, signez directement avec OpenAI. Les personnes qui discutent uniquement dans ChatGPT sans programmer n’ont pas besoin de l’API : comme indiqué plus haut, un forfait mensuel est généralement plus avantageux pour une utilisation intensive du chat.
Payer depuis Taïwan
Le solde Kunavo passe par Stripe et accepte les cartes, notamment JCB (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay et Google Pay. Le fonctionnement est prépayé, avec un rechargement minimum de $10 et un solde sans date d’expiration ; les requêtes échouées ne sont pas facturées. Plus le rechargement est important, plus le bonus augmente : $100 créditent $110, $1,000 créditent $1,200 et $5,000 créditent $6,250.
Taïwan ne dispose d’aucun moyen de paiement local — StreetVoice et LINE Pay ne figurent pas dans la liste des moyens disponibles. Pour une équipe, chaque clé peut définir dans /app/keys une limite mensuelle de dépenses (réponse 402 une fois la limite atteinte) et une liste blanche d’adresses IP ; les frais peuvent être répartis par personne. Les détails de facturation figurent dans la documentation de facturation.
Réduire le coût de l’API GPT
- Choisissez le modèle selon la taille de la tâche. Pour les tâches volumineuses et simples comme la classification, l’extraction et le routage, essayez d’abord GPT-6 Luna ; utilisez Terra ou GPT-6 Sol pour les tâches générales et ne passez à Astra que pour les tâches que les autres réussissent mal. Pour une même tâche, le montant peut varier jusqu’à 100 fois selon le tableau ci-dessus.
- Limitez la sortie. Utilisez
max_tokenset des contraintes de format de sortie pour limiter la longueur ; réduisez l’intensité du raisonnement lorsque la tâche le permet. - Activez la mise en cache. Placez le prompt système fixe au début et ne modifiez pas son contenu à chaque appel ; la lecture du cache ne coûte que 10% du tarif d’entrée.
- Maintenez le prompt sous 272K tokens. Au-delà, toute la requête est facturée à 2 fois le tarif d’entrée / 1,5 fois le tarif de sortie.
Pour estimer le montant d’un mois complet, utilisez le calculateur de coût de l’API OpenAI (en anglais). Si votre problème concerne le débit plutôt que le coût, consultez les limites de débit de l’API OpenAI (en anglais). Utilisez le même calcul pour comparer d’autres fournisseurs : tarifs et abonnements Claude. Si vous utilisez ces modèles GPT avec Codex, consultez les tarifs de Codex pour savoir comment sont calculés l’abonnement et la clé API.
Questions fréquentes
Combien coûte l’API ChatGPT ?
L’API ChatGPT est l’API OpenAI : elle est facturée au token, sans frais mensuels, et sa facturation est distincte de celle de l’abonnement ChatGPT. Au 5 octobre 2026, le tarif officiel d’OpenAI par 1M de tokens est de $10.00 en entrée / $50.00 en sortie pour GPT-6 Astra, $2.00 / $10.00 pour GPT-6 Sol, $0.10 / $0.50 pour GPT-6 Luna, $5.00 / pour GPT-5.6 Sol $30.00(OpenAI 目前以促銷價 $4.00 / $20.00 提供,官方價格頁寫明至少到 21 novembre 2026), et $2.00 / $12.00 pour GPT-5.6 Terra ; chez Kunavo, les tarifs sont respectivement $4.00 / $20.00, $0.80 / $4.00, $0.04 / $0.20, $2.00 / $12.00, et $0.70 / $4.20.
Comment l’API OpenAI est-elle facturée ?
La facturation se fait au token : le contenu que vous envoyez (prompt système, conversation, fichiers) compte comme entrée, tandis que le contenu généré par le modèle compte comme sortie. Les deux ont un tarif par 1M de tokens, la sortie étant plus chère. Les reasoning tokens générés par les modèles de raisonnement avant la réponse n’apparaissent pas dans celle-ci, mais sont facturés au tarif de sortie. Il n’y a pas de frais mensuels : aucun appel signifie $0 ; les requêtes échouées ne sont pas facturées, mais si vous reposez vous-même la question après une réponse réussie, chaque appel est facturé.
Puis-je utiliser l’API avec un abonnement ChatGPT Plus ?
Non. Les forfaits ChatGPT (gratuit, Go, Plus, Pro, etc.) sont des abonnements mensuels pour chatgpt.com et l’application ; ils ne fournissent ni clé API ni quota API. Pour utiliser l’API OpenAI, vous devez demander une clé séparément et payer les tokens séparément. Inversement, payer l’API n’augmente pas les limites d’utilisation de ChatGPT. Les deux comptes ne se compensent pas.
Quel est le prix de GPT-6 ?
Kunavo propose actuellement GPT-6 Astra, GPT-6 Sol et GPT-6 Luna. Le modèle phare GPT-6 Astra (présenté par OpenAI le 3 septembre 2026) est officiellement tarifé par 1M de tokens à $10.00 en entrée / $50.00 en sortie ; chez Kunavo, il coûte $4.00 / $20.00 (Environ 60 % moins cher). Une question difficile (20 000 tokens en entrée / 3 000 en sortie) coûte environ $0.140. GPT-6 Sol et GPT-6 Luna, lancés le 22 septembre, coûtent chez Kunavo $0.80 / $4.00 et $0.04 / $0.20. Pour ces trois modèles, lorsque le prompt d’une requête dépasse 272K tokens, toute la requête est facturée à 2 fois le tarif d’entrée / 1,5 fois le tarif de sortie.
Combien coûtent les API GPT-6 Sol et GPT-6 Luna ?
OpenAI a lancé ces deux modèles le 22 septembre 2026. Leur fenêtre de contexte est de 1 050 000 tokens et leur sortie maximale de 128 000 tokens. OpenAI positionne GPT-6 Sol pour la programmation complexe et les flux de travail agentiques ; son tarif officiel par 1M de tokens est de $2.00 en entrée / $10.00 en sortie, et chez Kunavo de $0.80 / $4.00 (Environ 60 % moins cher). OpenAI décrit GPT-6 Luna comme le modèle le plus efficace pour traiter des tâches ciblées en grand nombre : son tarif officiel est de $0.10 / $0.50, contre $0.04 / $0.20 chez Kunavo (Environ 60 % moins cher), et une réponse RAG (6 000 tokens en entrée / 500 en sortie) coûte environ $0.00034.
L’API OpenAI offre-t-elle un quota gratuit ?
OpenAI ne propose pas de niveau gratuit pour les API GPT : la facturation au token commence dès le premier appel. Kunavo n’est pas gratuit non plus, mais ne facture pas de frais mensuels : le solde prépayé minimum est de $10, vous payez selon votre consommation, le solde n’expire pas et un mois sans appel coûte $0.
Combien coûte approximativement un appel à l’API GPT ?
Cela dépend du modèle et du nombre de tokens. Chez Kunavo, pour une réponse RAG (6 000 tokens en entrée / 500 en sortie) : GPT-6 Luna environ $0.00034、GPT-5.6 Terra environ $0.0063、GPT-6 Sol environ $0.0068、GPT-5.6 Sol environ $0.018、GPT-6 Astra environ $0.034. Ces montants n’incluent pas les tokens de raisonnement ; le nombre réel de tokens de sortie à retenir est celui indiqué dans usage de la réponse.
Comment payer l’API OpenAI depuis Taïwan ?
Kunavo utilise Stripe pour les rechargements prépayés : Visa, Mastercard, American Express, JCB, UnionPay, Apple Pay et Google Pay sont acceptés. Le rechargement minimum est de $10, le solde n’expire pas et les rechargements d’au moins $100 bénéficient d’un bonus. Aucun moyen de paiement local taïwanais n’est disponible — JKO Pay et LINE Pay ne figurent pas dans la liste ; la carte internationale est la seule solution.
Que faut-il modifier dans un programme utilisant déjà le SDK OpenAI ?
Seulement deux modifications : remplacez base_url par https://api.kunavo.com/v1 et la clé par une clé Kunavo commençant par sk-kn-. Les appels chat.completions et responses continuent de fonctionner tels quels ; il suffit de renseigner model avec un identifiant comme gpt-6-astra ou gpt-5-6-terra. La même clé permet aussi d’appeler Claude.