A API GPT é cobrada por tarifas de entrada e saída por 1M de tokens; não há assinatura mensal nem modalidade gratuita. Esta página coloca lado a lado as tarifas atuais das linhas GPT-5 e GPT-6 e os preços públicos da OpenAI, mostra exemplos de cálculo para verificar quanto custa uma solicitação real e explica duas armadilhas que influenciam a cobrança (tokens de reasoning e sobretaxa por textos longos), além de como pagar na Coreia do Sul.
As tarifas foram verificadas em 4 de outubro de 2026 — os preços públicos da OpenAI vêm de openai.com/api/pricing, e as tarifas da Kunavo são lidas em tempo real no catálogo de modelos.
Tabela de tarifas das linhas GPT-5 e GPT-6
| Modelo | Preço público da OpenAI (entrada / saída) | Kunavo (entrada / saída) | Diferença |
|---|---|---|---|
| GPT-6 Luna | $0.10 / $0.50 | $0.04 / $0.20 | Economia de cerca de 60% |
| GPT-6 Sol | $2.00 / $10.00 | $0.80 / $4.00 | Economia de cerca de 60% |
| GPT-5.6 Terra | $2.00 / $12.00 | $0.70 / $4.20 | Economia de cerca de 65% |
| GPT-5.5 | $5.00 / $30.00 | $2.00 / $12.00 | Economia de cerca de 60% |
| GPT-5.6 Sol | $5.00 / $30.00 Preço promocional atual $4.00 / $20.00 (até o mínimo de 21 de novembro de 2026) | $2.00 / $12.00 | Economia de cerca de 60% cerca de 40% em relação ao preço promocional |
| GPT-6 Astra | $10.00 / $50.00 | $4.00 / $20.00 | Economia de cerca de 60% |
A linha GPT-6 é a nova geração da OpenAI. GPT-6 Astra foi lançado em 3 de setembro de 2026 como o modelo topo de linha da OpenAI, seguido por GPT-6 Sol e GPT-6 Luna em 22 de setembro de 2026. A OpenAI afirma que os dois modelos foram construídos sobre os avanços que deram origem ao GPT-6 Astra; apresenta Sol para programação complexa e fluxos de trabalho de agentes, e Luna como “o modelo mais eficiente para trabalhos concentrados em grande escala”. Ambos têm contexto de 1,050,000 tokens e saída máxima de 128,000 tokens.
O GPT mais barato na Kunavo é o GPT-6 Luna ($0.04 / $0.20). O GPT-6 Sol ($0.80 / $4.00) tem preço de saída inferior ao GPT-5.6 Terra ($4.20). No entanto, a tarifa de entrada é menor no GPT-5.6 Terra ($0.70), portanto, em solicitações nas quais os tokens de entrada excedem 2 vezes os de saída, o Terra é mais barato. Se você envia prompts longos e recebe respostas curtas, calcule diretamente os dois modelos usando as tarifas da tabela acima.
Quanto custa uma solicitação real?
A tabela de tarifas pode não dar uma noção clara, então faça a verificação diretamente. O código abaixo usa exatamente os mesmos números da tabela; basta alterar a quantidade de tokens para obter o custo da sua carga de trabalho.
# Kunavo GPT 요율(1M 토큰당 USD): (input, output)
RATES = {
"gpt-5-6-terra": (0.70, 4.20),
"gpt-5-5": (2.00, 12.00),
"gpt-5-6-sol": (2.00, 12.00),
"gpt-6-sol": (0.80, 4.00),
"gpt-6-luna": (0.04, 0.20),
}
def cost(model: str, in_tokens: int, out_tokens: int) -> float:
i, o = RATES[model]
# 주의: GPT-5 계열 추론 모델의 reasoning 토큰은 출력 요율로 과금됩니다.
return in_tokens / 1_000_000 * i + out_tokens / 1_000_000 * o
print(cost("gpt-5-6-terra", 1_000, 300)) # 짧은 턴
print(cost("gpt-5-6-terra", 6_000, 500)) # RAG 답변
print(cost("gpt-5-5", 20_000, 3_000)) # 어려운 문제
print(cost("gpt-5-6-sol", 20_000, 3_000)) # GPT-5.6 플래그십
print(cost("gpt-6-sol", 20_000, 3_000)) # GPT-6 Sol
print(cost("gpt-6-luna", 1_000, 300)) # 가장 저렴한 짧은 턴Duas armadilhas que influenciam a cobrança
1. Tokens de reasoning são cobrados como saída. Os modelos de raciocínio da linha GPT-5 geram tokens de pensamento que não aparecem na tela, e esses tokens são calculados pela tarifa de saída. Mesmo que a resposta tenha três linhas, a cobrança pode não equivaler a três linhas. Limitar max_tokens e reduzir a intensidade do reasoning dentro do permitido pela tarefa é a forma mais direta de economizar.
2. Sobretaxa por textos longos. Para solicitações com mais de 272.000 tokens de entrada, a OpenAI aplica 2x à entrada e 1,5x à saída sobre toda a solicitação (incluindo entrada em cache). A Kunavo aplica o mesmo intervalo a GPT-5.5, GPT-5.6 Sol·Terra e GPT-6 Astra·Sol·Luna. Nesse intervalo, as tarifas da tabela passam a ser 2x na entrada e 1,5x na saída, mantendo-se o mesmo desconto em relação ao preço público. Em tarefas com contexto grande, como RAG com documentos inteiros ou análise de bases de código, ultrapassar esse limite pode afetar a cobrança mais do que a escolha do modelo; quando possível, divida a entrada para enviá-la abaixo de 272.000 tokens.
Integrar ao código OpenAI existente
A Kunavo oferece um endpoint compatível com a OpenAI, portanto não é necessário trocar o SDK. Basta substituir base_url em uma linha e trocar a chave.
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1", # 이 한 줄만 바꾸면 됩니다
)
resp = client.chat.completions.create(
model="gpt-5-6-terra",
messages=[{"role": "user", "content": "안녕하세요"}],
)
print(resp.choices[0].message.content)A mesma chave também chama modelos Claude, de imagem e de vídeo — consulte o catálogo de modelos para a lista de modelos e o início rápido para os detalhes dos endpoints.
Pagamento na Coreia do Sul
O pagamento é processado pelo Stripe e funciona por recarga pré-paga. São aceitos cartões de crédito e débito nacionais e internacionais (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay e Google Pay; você recarrega a partir de $10 e o valor usado é descontado, enquanto o saldo não expira. Não é necessária uma conta da OpenAI nem um contrato separado.
Quando a tela de pagamento é exibida em wones, KakaoPay, Naver Pay, PAYCO, Samsung Pay e cartões nacionais também aparecem como métodos de recarga da Kunavo. Os cartões nacionais incluem cartões sem pagamentos internacionais habilitados, e Toss não é compatível. Esses métodos recarregam o saldo da Kunavo; não são pagamentos feitos diretamente à OpenAI. Os preços são definidos em USD, e o Stripe converte o valor para wones pela taxa de câmbio do momento do pagamento; essa taxa inclui uma tarifa de conversão de 2–4% paga pelo comprador (ela não é aplicada ao pagar em dólares, mas os métodos nacionais acima só aparecem no pagamento em wones). Consulte todos os métodos em Documentação de pagamentos; o resumo de custos do Claude está em Preços e pagamentos da API do Claude.
Quatro alavancas para reduzir custos
- Reduza a saída. Incluindo os tokens de reasoning, a saída é o componente mais caro. Limitar max_tokens e ajustar a intensidade do reasoning é a economia mais rápida.
- Reduza o nível conforme o tamanho do problema. Para tarefas em massa, como classificação, extração e resumo, comece pelo GPT-6 Luna, o mais barato, e suba de nível apenas quando ele não for suficiente. O preço de saída do Luna corresponde a 1/100 do preço de saída do GPT-6 Astra, o modelo topo de linha.
- Use cache para o contexto inicial repetido (como funciona).
- Agrupe as tarefas que não exigem tempo real. Se o usuário não precisar esperar, a execução simultânea pode aumentar o throughput.
Se o pagamento da API OpenAI estiver bloqueado, consulte Como pagar pela API OpenAI.
Perguntas frequentes
Quanto custa a API GPT?
Os preços são por 1M de tokens. 4 de outubro de 2026 Com base nisso, o preço público da OpenAI é GPT-5.6 Terra de entrada $2.00 / saída $12.00, enquanto na Kunavo o mesmo modelo custa $0.70 / $4.20. As demais tarifas da Kunavo são GPT-6 Luna $0.04 / $0.20, GPT-6 Sol $0.80 / $4.00, GPT-5.5 $2.00 / $12.00, GPT-5.6 Sol $2.00 / $12.00, GPT-6 Astra $4.00 / $20.00; entre elas, GPT-6 Luna é o GPT mais barato.
Quanto custa a API GPT-6?
Preços de tabela do GPT-6 Sol e do GPT-6 Luna, lançados pela OpenAI em 22 de setembro de 2026, e do GPT-6 Astra, lançado em 3 de setembro de 2026 (entrada/saída por 1M tokens): GPT-6 Sol $2.00 / $10.00, GPT-6 Luna $0.10 / $0.50, GPT-6 Astra $10.00 / $50.00. Tarifas do Kunavo por 1M tokens de entrada/saída: GPT-6 Sol $0.80 / $4.00, GPT-6 Luna $0.04 / $0.20, GPT-6 Astra $4.00 / $20.00. Os três modelos custam cerca de 60% menos que o preço de tabela. O GPT-6 Luna é o GPT mais barato no Kunavo, e o GPT-6 Sol tem um preço por token de saída menor que o do GPT-5.6 Terra ($4.20) (a tarifa de entrada é menor no Terra: $0.70). Para requisições com entrada superior a 272.000 tokens, aplicam-se à requisição inteira multiplicadores de 2 para entrada e de 1,5 para saída, exatamente como na OpenAI.
Posso usar a API GPT gratuitamente?
A OpenAI não oferece uma modalidade gratuita para a API GPT — a cobrança por token começa na primeira chamada. A Kunavo também não é gratuita, mas funciona por consumo, sem assinatura: a partir de uma recarga mínima de $10, o valor usado é descontado e o saldo não expira. Nos meses sem uso, o custo é $0.
Os tokens de reasoning do GPT-5 também são cobrados separadamente?
Os modelos de raciocínio da linha GPT-5 geram tokens de reasoning que não aparecem na tela, e esses tokens são cobrados pela tarifa de saída. Assim, mesmo que a resposta pareça curta, o valor cobrado pode ser alto. Limite max_tokens e reduza a intensidade do reasoning na medida permitida pela tarefa — na tabela de preços, a saída é sempre o lado mais caro.
Solicitações com entradas longas custam mais?
Sim. Para solicitações com mais de 272.000 tokens de entrada, a OpenAI aplica 2x à entrada e 1,5x à saída sobre toda a solicitação (incluindo entrada em cache), e a Kunavo aplica o mesmo intervalo a GPT-5.5, GPT-5.6 Sol·Terra e GPT-6 Astra·Sol·Luna. O desconto em relação ao preço público é igual antes e depois desse intervalo. Em tarefas com contexto grande, como RAG com documentos inteiros ou análise de bases de código, ultrapassar esse limite pode afetar o valor cobrado mais do que a escolha do modelo.
Como reduzir o custo da API GPT?
Há quatro medidas, em ordem de eficácia: reduzir a saída (incluindo tokens de reasoning, a saída é o componente mais caro); escolher um nível adequado ao tamanho do problema (para tarefas em massa, como classificação e extração, comece pelo GPT-6 Luna, o mais barato); usar cache de prompt para o contexto inicial repetido; e agrupar tarefas que não exigem tempo real. Trocar o base_url por um endpoint mais barato potencializa ainda mais a economia.
Como pagar pela API GPT na Coreia do Sul?
A Kunavo processa pagamentos pelo Stripe — aceita cartões de crédito e débito sul-coreanos e internacionais (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay e Google Pay. O serviço funciona em um modelo pré-pago de cobrança por uso, com recargas a partir de $10 e desconto do valor correspondente ao consumo; o saldo não expira. Se a tela de pagamento exibir valores em won sul-coreano, também aparecerão Kakao Pay, Naver Pay, PAYCO, Samsung Pay e cartões sul-coreanos (inclusive cartões sem habilitação para pagamentos internacionais). O Toss não é aceito. Todos esses meios servem para recarregar o saldo da Kunavo; não são pagamentos feitos diretamente à OpenAI. Não é necessário ter uma conta da OpenAI nem um contrato separado. Para começar, cadastre-se e depois gere uma chave.
Posso usar meu código existente do SDK da OpenAI sem alterações?
Sim. A Kunavo oferece um endpoint compatível com a OpenAI; basta alterar o base_url para https://api.kunavo.com/v1 e trocar a chave. O restante do código permanece igual, e a mesma chave também chama modelos Claude, de imagem e de vídeo.