L’API GPT est facturée selon un tarif d’entrée et de sortie par million de tokens ; il n’y a ni abonnement mensuel ni niveau gratuit. Cette page présente côte à côte les tarifs actuels des familles GPT-5 et GPT-6 et les tarifs publics d’OpenAI, fournit des exemples de calcul permettant de vérifier directement le coût d’une requête et explique les deux pièges qui influencent la facture (tokens de raisonnement et majoration pour les longs contextes), ainsi que la manière de payer depuis la Corée.
Les tarifs ont été vérifiés le 4 octobre 2026 — les tarifs publics d’OpenAI proviennent de openai.com/api/pricing, tandis que les tarifs Kunavo sont lus en temps réel dans le catalogue des modèles.
Tableau des tarifs des familles GPT-5 et GPT-6
| Modèle | Tarifs publics OpenAI (entrée / sortie) | Kunavo (entrée / sortie) | Différence |
|---|---|---|---|
| GPT-6 Luna | $0.10 / $0.50 | $0.04 / $0.20 | Environ 60 % d’économie |
| GPT-6 Sol | $2.00 / $10.00 | $0.80 / $4.00 | Environ 60 % d’économie |
| GPT-5.6 Terra | $2.00 / $12.00 | $0.70 / $4.20 | Environ 65 % d’économie |
| GPT-5.5 | $5.00 / $30.00 | $2.00 / $12.00 | Environ 60 % d’économie |
| GPT-5.6 Sol | $5.00 / $30.00 Tarif promotionnel actuel $4.00 / $20.00 (au moins jusqu’au 21 novembre 2026) | $2.00 / $12.00 | Environ 60 % d’économie environ 40 % par rapport au tarif promotionnel |
| GPT-6 Astra | $10.00 / $50.00 | $4.00 / $20.00 | Environ 60 % d’économie |
La famille GPT-6 constitue la nouvelle génération d’OpenAI. GPT-6 Astra est sorti le 3 septembre 2026 comme modèle haut de gamme d’OpenAI, suivi de GPT-6 Sol et de GPT-6 Luna le 22 septembre 2026. OpenAI explique que ces deux modèles reposent sur les avancées ayant permis de créer GPT-6 Astra ; Sol est destiné au codage complexe et aux workflows d’agents, tandis que Luna est présenté comme « le modèle le plus efficace pour les tâches massives ciblées ». Les deux modèles disposent d’un contexte de 1,050,000 tokens et peuvent générer au maximum 128,000 tokens.
Le GPT le moins cher chez Kunavo est GPT-6 Luna ($0.04 / $0.20). GPT-6 Sol ($0.80 / $4.00) a un tarif de sortie inférieur à celui de GPT-5.6 Terra ($4.20). Toutefois, le tarif d’entrée est inférieur pour GPT-5.6 Terra ($0.70) ; lorsque les tokens d’entrée représentent plus de 2 fois les tokens de sortie, Terra est moins cher. Pour les tâches qui envoient un long prompt et reçoivent une réponse courte, calculez directement le coût des deux modèles avec les tarifs du tableau ci-dessus.
Combien coûte réellement une requête ?
Les seuls tableaux de tarifs ne donnent pas toujours une idée concrète ; vérifiez donc le calcul vous-même. Le code ci-dessous reprend exactement les chiffres du tableau ; il vous suffit de modifier le nombre de tokens pour obtenir le coût de votre propre charge de travail.
# Kunavo GPT 요율(1M 토큰당 USD): (input, output)
RATES = {
"gpt-5-6-terra": (0.70, 4.20),
"gpt-5-5": (2.00, 12.00),
"gpt-5-6-sol": (2.00, 12.00),
"gpt-6-sol": (0.80, 4.00),
"gpt-6-luna": (0.04, 0.20),
}
def cost(model: str, in_tokens: int, out_tokens: int) -> float:
i, o = RATES[model]
# 주의: GPT-5 계열 추론 모델의 reasoning 토큰은 출력 요율로 과금됩니다.
return in_tokens / 1_000_000 * i + out_tokens / 1_000_000 * o
print(cost("gpt-5-6-terra", 1_000, 300)) # 짧은 턴
print(cost("gpt-5-6-terra", 6_000, 500)) # RAG 답변
print(cost("gpt-5-5", 20_000, 3_000)) # 어려운 문제
print(cost("gpt-5-6-sol", 20_000, 3_000)) # GPT-5.6 플래그십
print(cost("gpt-6-sol", 20_000, 3_000)) # GPT-6 Sol
print(cost("gpt-6-luna", 1_000, 300)) # 가장 저렴한 짧은 턴Les deux pièges qui influencent la facture
1. Les tokens de raisonnement sont facturés comme de la sortie. Les modèles de raisonnement de la famille GPT-5 génèrent des tokens de réflexion invisibles à l’écran, calculés au tarif de sortie. Même si la réponse tient en trois lignes, la facture peut ne pas correspondre au coût de trois lignes. La mesure d’économie la plus directe consiste à limiter max_tokens et à réduire l’intensité du raisonnement dans la mesure permise par la tâche.
2. Majoration pour les longs contextes. OpenAI applique aux requêtes dépassant 272 000 tokens en entrée un multiplicateur de 2× pour l’entrée et de 1,5× pour la sortie, à l’ensemble de la requête (y compris les tokens d’entrée mis en cache). Kunavo applique également cette même tranche à GPT-5.5, GPT-5.6 Sol·Terra et GPT-6 Astra·Sol·Luna. Dans cette tranche, les tarifs du tableau passent à 2× pour l’entrée et 1,5× pour la sortie, tandis que le taux de remise par rapport au tarif public reste identique. Pour les tâches à contexte volumineux, comme l’injection d’un document entier dans un RAG ou l’analyse d’une base de code, dépasser cette tranche peut influencer la facture davantage que le choix du modèle ; dans la mesure du possible, divisez donc les entrées afin de rester sous 272 000 tokens.
Intégrer un code OpenAI existant
Kunavo est compatible avec OpenAI ; il n’est donc pas nécessaire de changer de SDK. Il suffit de remplacer base_url sur une ligne et de changer la clé.
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1", # 이 한 줄만 바꾸면 됩니다
)
resp = client.chat.completions.create(
model="gpt-5-6-terra",
messages=[{"role": "user", "content": "안녕하세요"}],
)
print(resp.choices[0].message.content)La même clé permet d’appeler les modèles Claude, d’image et de vidéo — la liste des modèles se trouve dans le catalogue des modèles et les détails des points de terminaison dans le guide de démarrage rapide.
Paiement depuis la Corée
Le paiement est traité par Stripe et fonctionne par recharge prépayée. Les cartes de crédit et de débit nationales et internationales (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay et Google Pay sont prises en charge ; vous rechargez à partir de $10 minimum, le montant utilisé est déduit et le solde n’expire pas. Aucun compte OpenAI ni contrat distinct n’est nécessaire.
Si la page de paiement s’affiche en wons coréens, Kakao Pay, Naver Pay, PAYCO, Samsung Pay et les cartes nationales apparaissent également comme moyens de recharge Kunavo. Les cartes nationales incluent celles dont les paiements internationaux ne sont pas activés, tandis que Toss n’est pas pris en charge. Ces moyens servent à recharger le solde Kunavo et non à payer directement OpenAI. Les prix sont fixés en USD ; Stripe convertit le montant en wons selon le taux de change au moment du paiement, et ce taux inclut des frais de conversion de 2–4 % à la charge de l’acheteur (ils ne s’appliquent pas en cas de paiement en dollars, mais les moyens nationaux ci-dessus ne sont disponibles que pour les paiements en wons). Consultez la documentation des paiements pour connaître tous les moyens de paiement, et les tarifs et paiements de Claude API pour le récapitulatif concernant Claude.
Quatre leviers pour réduire les coûts
- Réduisez la sortie. Les tokens de raisonnement compris, la sortie est la partie la plus chère. Limiter max_tokens et régler l’intensité du raisonnement sont les moyens les plus rapides d’économiser.
- Abaissez le niveau du modèle en fonction de la taille du problème. Pour les tâches massives de classification, d’extraction ou de résumé, commencez par GPT-6 Luna, le GPT le moins cher, et ne passez à un niveau supérieur que s’il ne suffit pas. Le tarif de sortie de Luna est égal à celui de GPT-6 Astra, le modèle haut de gamme, divisé par 100.
- Utilisez la mise en cache pour les contextes initiaux répétitifs (fonctionnement).
- Regroupez les tâches qui ne nécessitent pas de temps réel. Si l’utilisateur n’a pas besoin d’attendre, l’exécution simultanée peut augmenter le débit.
Si le paiement de l’API OpenAI est bloqué, consultez Comment payer l’API OpenAI.
Questions fréquentes
Quel est le prix de l’API GPT ?
La tarification est calculée par million de tokens. Au 4 octobre 2026, selon les tarifs publics d’OpenAI, GPT-5.6 Terra coûte $2.00 en entrée / $12.00 en sortie, tandis que chez Kunavo, le même modèle coûte $0.70 / $4.20. Les autres tarifs Kunavo sont GPT-6 Luna $0.04 / $0.20, GPT-6 Sol $0.80 / $4.00, GPT-5.5 $2.00 / $12.00, GPT-5.6 Sol $2.00 / $12.00 et GPT-6 Astra $4.00 / $20.00 ; parmi eux, GPT-6 Luna est le GPT le moins cher.
Quel est le prix de l’API GPT-6 ?
Tarifs catalogue de GPT-6 Sol et GPT-6 Luna, publiés par OpenAI le 22 septembre 2026, et de GPT-6 Astra, sorti le 3 septembre 2026 (entrée / sortie par 1M de tokens) : GPT-6 Sol $2.00 / $10.00, GPT-6 Luna $0.10 / $0.50, GPT-6 Astra $10.00 / $50.00. Tarifs de Kunavo par 1M de tokens en entrée / sortie : GPT-6 Sol $0.80 / $4.00, GPT-6 Luna $0.04 / $0.20, GPT-6 Astra $4.00 / $20.00. Les trois modèles sont environ 60% moins chers que les tarifs catalogue. GPT-6 Luna est le GPT le moins cher sur Kunavo, et le tarif de sortie de GPT-6 Sol est inférieur à celui de GPT-5.6 Terra ($4.20) (le tarif d’entrée est inférieur pour Terra : $0.70). Pour les requêtes dont l’entrée dépasse 272 000 tokens, les tarifs sont multipliés par 2 en entrée et par 1,5 en sortie sur l’ensemble de la requête, exactement comme chez OpenAI.
L’API GPT peut-elle être utilisée gratuitement ?
OpenAI ne propose pas de niveau gratuit pour l’API GPT : la facturation par token commence dès le premier appel. Kunavo n’est pas gratuit non plus, mais il ne s’agit pas d’un abonnement : c’est une tarification à l’usage. Vous commencez avec une recharge minimale de 10 $, le montant utilisé est déduit et le solde n’expire pas. Les mois sans utilisation coûtent 0 $.
Les tokens de raisonnement de GPT-5 sont-ils facturés séparément ?
Les modèles de raisonnement de la famille GPT-5 génèrent des tokens de raisonnement invisibles à l’écran, facturés au tarif de sortie. Ainsi, même si la réponse paraît courte, le montant facturé peut être élevé. Dans la mesure permise par la tâche, limitez max_tokens et réduisez l’intensité du raisonnement — dans la tarification, la sortie est toujours la partie la plus chère.
Les requêtes longues sont-elles plus chères ?
Oui. Pour les requêtes dépassant 272 000 tokens en entrée, OpenAI applique à l’ensemble de la requête (y compris les tokens d’entrée mis en cache) un multiplicateur de 2× pour l’entrée et de 1,5× pour la sortie. Kunavo applique la même tranche à GPT-5.5, GPT-5.6 Sol·Terra et GPT-6 Astra·Sol·Luna. Le taux de remise par rapport au tarif public reste identique avant et après cette tranche. Pour les tâches à contexte volumineux, comme l’injection d’un document entier dans un RAG ou l’analyse d’une base de code, le dépassement de cette limite peut davantage influencer la facture que le choix du modèle.
Comment réduire le coût de l’API GPT ?
Voici les quatre mesures les plus efficaces, par ordre d’impact : réduire la sortie (y compris les tokens de raisonnement, car la sortie est la plus chère), choisir un niveau adapté à la taille du problème (pour les tâches massives de classification ou d’extraction, commencez par le GPT-6 Luna le moins cher), utiliser la mise en cache des prompts pour les contextes initiaux répétitifs et regrouper les tâches qui ne nécessitent pas de temps réel. Remplacer base_url par un point de terminaison moins cher multiplie encore ces économies.
Comment payer l’API GPT depuis la Corée ?
Kunavo traite les paiements via Stripe — cartes de crédit et de débit nationales et internationales (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay et Google Pay sont pris en charge. Il s’agit d’un système prépayé à l’usage, rechargeable à partir de $10 minimum, et le solde n’expire pas. Si la page de paiement s’affiche en wons coréens, Kakao Pay, Naver Pay, PAYCO, Samsung Pay et les cartes nationales (y compris celles dont les paiements internationaux ne sont pas activés) apparaissent également. Toss n’est pas pris en charge. Tous ces moyens servent à recharger le solde Kunavo ; il ne s’agit pas de paiements directs à OpenAI. Aucun compte OpenAI ni contrat distinct n’est nécessaire. Pour commencer, créez un compte, puis créez une clé.
Puis-je utiliser tel quel mon code existant avec le SDK OpenAI ?
Oui. Kunavo fournit un point de terminaison compatible avec OpenAI : remplacez base_url par https://api.kunavo.com/v1 et remplacez uniquement la clé. Le reste du code peut rester inchangé, et la même clé permet d’appeler les modèles Claude, d’image et de vidéo.