Retour aux guides
Tarifs·10 septembre 2026·Mis à jour le 4 octobre 2026·9 min de lecture

Tarifs de l'API GPT [édition 2026] — tarifs par modèle et coût réel d'une requête

L'API GPT est facturée à l'usage, par token, et constitue un produit distinct de l'abonnement mensuel ChatGPT. Voici les tarifs par modèle, le coût réel d'une requête et deux pièges chiffrés qui peuvent fausser votre facture.

La tarification de l’API GPT est une facturation à l’usage, par token. Il n’y a pas d’abonnement mensuel : les tokens d’entrée et de sortie ont des tarifs distincts, la sortie étant plus chère. Les tarifs Kunavo à la date du 4 octobre 2026 sont de gpt-5-6-terra par million de tokens : $0.70 en entrée / $4.20 en sortie, et gpt-5-5 à $2.00 / $12.00 — dans les deux cas, moins cher que le tarif public d’OpenAI. Le gpt-6-luna, sorti le 22 septembre 2026, coûte $0.04 / $0.20 et constitue le GPT le moins cher chez Kunavo.

Il faut d’abord distinguer une chose. Les forfaits mensuels ChatGPT et l’API OpenAI sont deux produits différents, avec deux modes de facturation distincts. Payer ChatGPT ne fournit pas de clé API et ne réduit pas la facture de l’API. Cette page traite uniquement du second : le coût des appels effectués depuis du code.

Les tarifs sont vérifiés le 4 octobre 2026. Les chiffres de Kunavo sont rendus depuis le catalogue de ce site, afin de correspondre à la facturation réelle. Le tarif public d’OpenAI provient de la page tarifaire d’OpenAI.

Tableau des tarifs des familles GPT-5 / GPT-6

USD par million de tokens. « Tarif public d’OpenAI » désigne le tarif publié pour le même modèle. Pour les modèles en promotion, nous indiquons également ci-dessous le prix actuellement réellement facturé par OpenAI.

ModèleEntrée / 1MSortie / 1MTarif public d’OpenAI
gpt-6-luna$0.04$0.20$0.10 / $0.50
gpt-6-sol$0.80$4.00$2.00 / $10.00
gpt-5-6-terra$0.70$4.20$2.00 / $12.00
gpt-5-5$2.00$12.00$5.00 / $30.00
gpt-6-astra$4.00$20.00$10.00 / $50.00
gpt-5-6-sol$2.00$12.00$5.00 / $30.00
Prix promotionnel actuel : $4.00 / $20.00 (au moins jusqu’au 21 novembre 2026)

Les tarifs à jour sont toujours affichés sur la page tarifaire et sur la page de chaque modèle. La liste complète des modèles se trouve dans la liste des modèles.

GPT-6 est la nouvelle génération d’OpenAI. GPT-6 Astra a été publié comme modèle haut de gamme d’OpenAI le 3 septembre 2026, puis GPT-6 Sol et GPT-6 Luna ont suivi le 22 septembre 2026. OpenAI présente ces deux modèles comme « construits sur les avancées qui ont alimenté GPT-6 Astra », Sol étant destiné au codage complexe et aux workflows agentiques, et Luna étant « le modèle le plus efficace pour le traitement en volume ciblé ». Tous deux disposent d’un contexte de 1,050,000 tokens et d’une sortie maximale de 128,000 tokens.

Chez Kunavo, GPT-6 Luna est le GPT le moins cher à $0.04 / $0.20. GPT-6 Sol coûte $0.80 / $4.00, avec un tarif de sortie inférieur à celui de GPT-5.6 Terra ($4.20). Toutefois, le tarif d’entrée est inférieur pour GPT-5.6 Terra ($0.70) ; lorsque les tokens d’entrée dépassent 2 fois les tokens de sortie, GPT-5.6 Terra est moins cher (la comparaison figure dans le tableau ci-dessous). Les requêtes dont l’entrée dépasse 272 000 tokens sont facturées, comme les autres GPT-5.x / GPT-6 et conformément aux règles d’OpenAI, sur l’ensemble de la requête à 2 fois le tarif d’entrée et 1,5 fois le tarif de sortie.

Combien coûte réellement une requête ?

UsageTokensgpt-6-lunagpt-6-solgpt-5-6-terragpt-5-5
Un tour court1 000 en entrée / 300 en sortie$0.0001$0.0020$0.0020$0.0056
Une réponse RAG6 000 en entrée / 500 en sortie$0.0003$0.0068$0.0063$0.0180
Problème difficile20 000 en entrée / 3 000 en sortie$0.0014$0.0280$0.0266$0.0760
Batch de 100 000 requêtes500 en entrée / 20 en sortie × 100 000$2.40$48.00$43.40$124.00

Pour calculer avec vos propres chiffres, utilisez directement cette formule.

gpt_cost.py
# Kunavo の GPT 料率(1M トークンあたり USD): (input, output)
RATES = {
    "gpt-5-6-terra": (0.70, 4.20),
    "gpt-5-5":       (2.00, 12.00),
    "gpt-5-6-sol":   (2.00, 12.00),
    "gpt-6-sol":     (0.80, 4.00),
    "gpt-6-luna":    (0.04, 0.20),
}

def cost(model: str, in_tokens: int, out_tokens: int) -> float:
    i, o = RATES[model]
    # 注意: GPT-5 系の推論モデルは reasoning トークンも出力料率で課金される。
    return in_tokens / 1_000_000 * i + out_tokens / 1_000_000 * o

print(cost("gpt-5-6-terra", 1_000, 300))   # 短い 1 ターン
print(cost("gpt-5-6-terra", 6_000, 500))   # RAG の回答 1 件
print(cost("gpt-5-5", 20_000, 3_000))      # 難しい問題
print(cost("gpt-5-6-sol", 20_000, 3_000))  # GPT-5.6 のフラッグシップ
print(cost("gpt-6-sol", 20_000, 3_000))    # GPT-6 Sol
print(cost("gpt-6-luna", 1_000, 300))      # いちばん安い 1 ターン

Deux pièges qui faussent la facture

Le premier concerne les tokens de raisonnement. Les modèles de raisonnement de la famille GPT-5 génèrent des tokens de réflexion en interne avant de répondre. Ils n’apparaissent pas dans le corps de la réponse, mais sont facturés au tarif de sortie. Le tableau ci-dessus exclut le raisonnement : plus le problème est difficile, plus la facture réelle sera supérieure à ces montants. Le nombre de tokens de sortie du champ usage est le chiffre réel.

Le deuxième concerne les nouvelles tentatives. Une requête qui consomme des tokens avant d’échouer en aval reste facturée. Dans les workflows agentiques, une seule tâche vue par l’utilisateur peut correspondre à de nombreux allers-retours facturés, ce qui produit les écarts les plus importants. Les requêtes qui échouent chez Kunavo, c’est-à-dire celles qui n’atteignent pas le fournisseur amont, ne sont pas facturées.

Connecter du code OpenAI existant

Il suffit de modifier la ligne base_url et la clé. chat.completions et responses fonctionnent sans autre changement.

gpt_kunavo.py
from openai import OpenAI

client = OpenAI(
    api_key="sk-kn-...",
    base_url="https://api.kunavo.com/v1",   # 変えるのはこの 1 行だけ
)

resp = client.chat.completions.create(
    model="gpt-5-6-terra",
    messages=[{"role": "user", "content": "こんにちは"}],
)
print(resp.choices[0].message.content)

La même clé permet également d’appeler Claude, les modèles d’image et les modèles vidéo. Consultez le guide de démarrage rapide et la documentation Chat Completions pour la liste des endpoints.

Payer depuis le Japon

Le solde Kunavo est compatible avec les cartes incluant JCB (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay, Google Pay et Link lors du paiement Stripe. Il s’agit d’un portefeuille prépayé, avec une recharge minimale de $10 et un solde sans expiration. Les mois sans utilisation ne sont pas facturés. Le paiement en supérettes et PayPay ne sont pas pris en charge. Les mentions légales applicables aux opérateurs nationaux figurent dans les mentions prévues par la loi sur les transactions commerciales spécifiées ; les détails de facturation sont regroupés dans la documentation de facturation.

4 leviers pour réduire les coûts

  1. Choisissez le niveau selon la taille du problème. Ne définissez pas le modèle le plus haut comme valeur par défaut. Pour les traitements en volume, comme la classification, l’extraction et la mise en forme, commencez par le gpt-6-luna le moins cher qu’OpenAI destine à cet usage, puis montez en gamme si nécessaire. Comme le montre le tableau, même pour une seule réponse RAG, l’écart entre gpt-6-luna et gpt-5-5 est d’environ 53 fois.
  2. Limitez la sortie. La sortie étant plus chère que l’entrée, max_tokens et la définition du format de sortie ont un effet direct. Avec les modèles de raisonnement, cet effet est double.
  3. Activez la mise en cache des prompts. Si vous envoyez le même prompt système à chaque requête, le cache est le levier le plus important. Le fonctionnement est expliqué dans la documentation du cache.
  4. N’accumulez pas d’historique sans rapport dans l’entrée. Lorsque vous passez à une autre tâche, effacez la conversation. Un long historique est facturé intégralement à chaque requête.

Pour comparer avec les modèles d’autres fournisseurs, les tarifs de Claude utilisent le même calcul. Pour consulter uniquement la facturation à l’usage de Codex CLI, voyez les tarifs de Codex.

Questions fréquentes

Combien coûte l’API GPT ?

La facturation est à l’usage, par token, avec des tarifs distincts pour l’entrée et la sortie. Au 4 octobre 2026, les tarifs Kunavo par million de tokens sont de $0.70 en entrée / $4.20 en sortie pour gpt-5-6-terra, $2.00 / $12.00 pour gpt-5-5 et $2.00 / $12.00 pour gpt-5-6-sol. Les tarifs officiels d’OpenAI pour les mêmes modèles sont respectivement de $2.00 / $12.00, $5.00 / $30.00 et $5.00 / $30.00(gpt-5-6-sol est actuellement proposé par OpenAI au tarif promotionnel de $4.00 / $20.00 et, selon la page des tarifs, cette offre se poursuit au moins jusqu’au 21 novembre 2026). Le gpt-6-sol lancé le 22 septembre 2026 coûte $0.80 / $4.00, et le gpt-6-luna $0.04 / $0.20 (les tarifs officiels d’OpenAI sont $2.00 / $10.00 et $0.10 / $0.50) ; gpt-6-luna est le GPT le moins cher. Il n’y a pas d’abonnement mensuel.

Combien coûte l’API GPT-6 ?

Tarifs catalogue d’OpenAI (par 1M de tokens, entrée / sortie) : GPT-6 Sol $2.00 / $10.00, GPT-6 Luna $0.10 / $0.50, GPT-6 Astra $10.00 / $50.00 (Sol et Luna sont sortis le 22 septembre 2026, Astra le 3 septembre 2026). Les tarifs de Kunavo par 1M de tokens en entrée / sortie sont de $0.80 / $4.00 pour gpt-6-sol, $0.04 / $0.20 pour gpt-6-luna et $4.00 / $20.00 pour GPT-6 Astra. Tous sont environ 60% moins chers que les tarifs catalogue. gpt-6-luna est le GPT le moins cher sur Kunavo, et le tarif de sortie de gpt-6-sol est inférieur à celui de gpt-5-6-terra ($4.20) (le tarif d’entrée est inférieur pour gpt-5-6-terra : $0.70). Pour les requêtes dont l’entrée dépasse 272 000 tokens, les tarifs sont multipliés par 2 en entrée et par 1,5 en sortie sur l’ensemble de la requête, comme chez OpenAI.

L’abonnement mensuel ChatGPT et le tarif de l’API OpenAI sont-ils la même chose ?

Non, ce sont deux produits et deux systèmes de facturation distincts. Les forfaits payants ChatGPT correspondent à un abonnement mensuel donnant accès à l’interface chat.openai.com ; ils n’incluent aucun quota API et ne fournissent pas de clé API. L’API est facturée à l’usage, par token : il n’y a pas d’abonnement mensuel, mais chaque appel est facturé. Pour appeler depuis du code, il faut utiliser l’API ; payer ChatGPT ne réduit pas d’un seul yen la facture API.

Combien coûte réellement une requête GPT API ?

Pour une réponse RAG de 6 000 tokens en entrée et 500 en sortie, cela coûte environ $0.0063 avec gpt-5-6-terra, et environ $0.0003 avec le moins cher, gpt-6-luna. Pour un problème difficile de 20 000 tokens en entrée et 3 000 en sortie, comptez environ $0.0760 avec gpt-5-5 et $0.0760 avec gpt-5-6-sol. Ces montants utilisent les tarifs Kunavo et n’incluent pas les tokens de raisonnement.

Comment les tokens de raisonnement sont-ils facturés ?

Ils sont facturés au tarif de sortie. Les modèles de raisonnement de la famille GPT-5 génèrent des tokens de réflexion en interne avant de répondre. Ils n’apparaissent pas dans le corps de la réponse, mais apparaissent sur la facture. C’est la cause la plus fréquente d’un écart entre une estimation inférieure à la facture réelle, et l’écart augmente pour les problèmes difficiles. Consultez le nombre de tokens de sortie dans le champ usage pour connaître le chiffre réel et utilisez-le plutôt qu’une estimation.

Comment utiliser GPT à moindre coût ?

Voici les 4 leviers les plus efficaces, par ordre d’impact. Choisissez le niveau selon la taille du problème et ne définissez pas le modèle le plus haut comme valeur par défaut (au tarif de sortie, l’écart entre le moins cher, gpt-6-luna, et le plus haut de gamme, gpt-6-astra, est de 100 fois). Limitez la sortie avec max_tokens et le format de sortie. Activez la mise en cache des prompts. N’accumulez pas dans l’entrée un historique sans rapport. Ensuite, utiliser un endpoint moins cher que le tarif public d’OpenAI renforce encore l’effet de ces quatre leviers.

Le code de mon SDK OpenAI existant fonctionnera-t-il tel quel ?

Oui. Kunavo est un endpoint compatible avec OpenAI : il suffit de modifier base_url en https://api.kunavo.com/v1 et de changer la clé. chat.completions et responses fonctionnent de la même manière, et les noms de modèles restent inchangés. La même clé permet également d’appeler Claude, les modèles d’image et les modèles vidéo.

Comment payer l’API GPT depuis le Japon ?

Le solde Kunavo est compatible avec les cartes incluant JCB (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay, Google Pay et Link lors du paiement Stripe. Il s’agit d’un portefeuille prépayé ; la recharge minimale est de $10, le solde n’expire pas et les mois sans utilisation ne sont pas facturés. Les requêtes échouées ne sont pas facturées. Le paiement en supérettes et PayPay ne sont pas pris en charge.