A API da OpenAI é cobrada por token, não por mês. Os tokens de input e output têm tarifas separadas, e o output é a parte mais cara. Na Kunavo, a faixa vai de $0,04 / $0,20 por 1M de tokens para GPT-6 Luna a $4,00 / $20,00 para GPT-6 Astra, o mais novo modelo principal da OpenAI; entre eles estão, por exemplo, GPT-6 Sol com $0,80 / $4,00 e o modelo de trabalho GPT-5.6 Terra com $0,70 / $4,20 — dependendo do modelo, 60–65% abaixo do preço de tabela da OpenAI. A assinatura do ChatGPT é separada disso: não inclui uso da API, e a API não exige assinatura.
Tarifas atualizadas em: 3 de outubro de 2026. Esta página lê as tarifas da Kunavo ao vivo no catálogo de modelos — o que aparece aqui é o que a API cobra. A coluna “Preço da OpenAI” reproduz o preço publicado pela OpenAI para o mesmo modelo; a fonte é openai.com/api/pricing.
Assinatura do ChatGPT e API da OpenAI: dois produtos, duas cobranças
Quem pesquisa “custos da API do ChatGPT” muitas vezes quer saber outra coisa primeiro: se a assinatura existente do ChatGPT já cobre a API. A resposta é não.
| O que você usa | Como é cobrado | Para quem |
|---|---|---|
| ChatGPT (Free, Plus, Pro …) | Valor fixo por mês, com os limites de uso do plano | Pessoas que trabalham na janela de chat |
| API da OpenAI (chave + saldo) | Por token, sem tarifa mensal | Software próprio, automação, agentes |
Uma assinatura não inclui nem uma chave de API nem créditos de API e não reduz a fatura da API em nenhum centavo; da mesma forma, créditos de API não ampliam as cotas do ChatGPT. A OpenAI informa os preços das assinaturas em openai.com/chatgpt/pricing; eles mudam com frequência, por isso não aparecem aqui. Esta página trata apenas da API — a parte cobrada por token.
Preços da API da OpenAI por modelo
Tarifas em USD por milhão de tokens, conforme cobradas pela Kunavo. A coluna “Preço da OpenAI” é o preço publicado para o mesmo modelo.
| Modelo | Entrada / 1M | Saída / 1M | Lista da OpenAI (entrada / saída) | Economia |
|---|---|---|---|---|
gpt-6-astra | $4,00 | $20,00 | $10,00 / $50,00 | ~60% |
gpt-5-6-sol | $2,00 | $12,00 | $5,00 / $30,00 Preço promocional $4,00 / $20,00 (pelo menos até 21 de novembro de 2026) | ~60% ~40% abaixo do preço promocional |
gpt-5-5 | $2,00 | $12,00 | $5,00 / $30,00 | ~60% |
gpt-5-6-terra | $0,70 | $4,20 | $2,00 / $12,00 | ~65% |
gpt-6-sol | $0,80 | $4,00 | $2,00 / $10,00 | ~60% |
gpt-6-luna | $0,04 | $0,20 | $0,10 / $0,50 | ~60% |
As tarifas atuais estão sempre na página de preços e em cada página de modelo, como GPT-6 Astra, GPT-6 Sol ou GPT-6 Luna. Qual modelo usar para quê:
gpt-6-astra— o mais recente modelo principal da OpenAI (desde 3 de setembro de 2026): raciocínio de ponta e longas execuções agentic de programação. Para a minoria difícil das tarefas.gpt-6-sol— desde 22 de setembro de 2026; a OpenAI o posiciona para programação complexa e fluxos de trabalho agênticos. Na Kunavo $0,80 / $4,00, no output abaixo de GPT-5.6 Terra, um pouco acima no input. O padrão sensato para programação e agentes.gpt-6-luna— desde 22 de setembro de 2026; segundo a OpenAI, é o modelo mais eficiente para tarefas bem delimitadas em alto volume, como classificação e extração. Com $0,04 / $0,20, é o nível mais barato da Kunavo.gpt-5-6-sol— raciocínio de ponta e programação agentic da geração 5.6; para prompts que já estejam ajustados para isso.gpt-5-6-terra— o cavalo de batalha da família 5.6: RAG, assistentes, classificação, extração e a maioria das tarefas de produção.gpt-5-5— o modelo principal da geração anterior. GPT-5.6 Sol custa na Kunavo a mesma tarifa ($2,00 / $12,00); quem ainda usa gpt-5-5 muda para a geração mais recente alterando o nome do modelo, sem custo adicional por token.
GPT-6 Sol e GPT-6 Luna. Em 22 de setembro de 2026, a OpenAI ampliou a família GPT-6 com dois modelos que, segundo a própria empresa, se baseiam nos avanços por trás de GPT-6 Astra. A OpenAI lista GPT-6 Sol com $2,00 / $10,00 e GPT-6 Luna com $0,10 / $0,50 por 1M de tokens; na Kunavo, eles custam $0,80 / $4,00 e $0,04 / $0,20. Ambos têm uma janela de contexto de 1.050.000 tokens e fornecem até 128.000 tokens de output.
Quanto custa a mais o GPT-6 Astra. Em comparação com GPT-6 Sol, GPT-6 Astra custa 5 vezes, tanto na entrada quanto na saída, e, em comparação com GPT-5.6 Sol, 2 vezes na entrada e 1,7 vezes na saída. A recomendação honesta: GPT-6 Sol como padrão para programação e agentes, GPT-6 Luna para tarefas em massa, e Astra de forma direcionada quando uma comparação com as mesmas entradas mostrar que Sol não é suficiente — o nome do modelo é uma única palavra na requisição, então o teste é barato.
Um adicional para requisições muito longas. Acima de 272.000 tokens de prompt, GPT-5.5, a família GPT-5.6 e os três modelos GPT-6 — Astra, Sol e Luna — cobram a requisição inteira com a tarifa de input multiplicada por 2 e a tarifa de output multiplicada por 1,5. Quem coloca bases de código inteiras ou documentos longos em uma chamada deve conhecer esse limite: ele pode ter mais impacto do que a escolha do modelo.
Quanto uma requisição realmente custa
Calculado com as tarifas da Kunavo, sem cache e sem tokens de raciocínio — portanto, o limite inferior do que aparece na fatura:
| Tarefa | Tokens (entrada / saída) | GPT-6 Luna | GPT-5.6 Terra | GPT-6 Sol | GPT-5.6 Sol | GPT-6 Astra |
|---|---|---|---|---|---|---|
| Conversa curta no chat | 1.000 / 300 | $0,0001 | $0,00196 | $0,002 | $0,0056 | $0,01 |
| RAG-Antwort | 6.000 / 500 | $0,00034 | $0,0063 | $0,0068 | $0,018 | $0,034 |
| Etapa agêntica de programação | 25.000 / 1.200 | $0,00124 | $0,0225 | $0,0248 | $0,0644 | $0,124 |
| Tarefa pesada de raciocínio | 20.000 / 3.000 | $0,0014 | $0,0266 | $0,028 | $0,076 | $0,14 |
| Lote: 100.000 classificações | 500 / 20 por chamada | $2,40 | $43,40 | $48,00 | $124,00 | $240,00 |
Com a recarga mínima de $10, são executadas cerca de 1.590 respostas de RAG em GPT-5.6 Terra e cerca de 29.400 em GPT-6 Luna. Entre GPT-6 Luna e GPT-6 Astra, há um fator de cerca de 100 no output — em tarefas simples, a escolha do modelo é a maior alavanca individual. Para recalcular com seus próprios números:
# OpenAI-Tarife auf Kunavo (USD pro 1M Tokens): (Input, Output)
RATES = {
"gpt-6-astra": (4, 20),
"gpt-5-6-sol": (2, 12),
"gpt-5-5": (2, 12),
"gpt-5-6-terra": (0.7, 4.2),
"gpt-6-sol": (0.8, 4),
"gpt-6-luna": (0.04, 0.2),
}
def kosten(model: str, frisch: int, output: int, cache_treffer: int = 0) -> float:
"""frisch = nicht gecachter Input; output schließt Reasoning-Tokens ein."""
i, o = RATES[model]
return (
frisch / 1_000_000 * i
+ output / 1_000_000 * o
+ cache_treffer / 1_000_000 * i * 0.10 # Cache-Treffer: 10 % des Input-Tarifs
)
print(kosten("gpt-5-6-terra", 1_000, 300)) # kurze Chat-Runde
print(kosten("gpt-5-6-terra", 6_000, 500)) # RAG-Antwort
print(kosten("gpt-5-6-sol", 25_000, 1_200)) # agentischer Coding-Schritt
print(kosten("gpt-6-sol", 25_000, 1_200)) # derselbe Schritt auf GPT-6 Sol
print(kosten("gpt-6-astra", 20_000, 3_000)) # schwere Reasoning-Aufgabe
print(kosten("gpt-6-luna", 500, 20)) # eine Klassifizierung
# Ein Monat auf Sol: 3 Mio. frische und 12 Mio. gecachte Input-Tokens,
# 1 Mio. Output-Tokens (Cache-Writes nicht eingerechnet)
print(kosten("gpt-5-6-sol", 3_000_000, 1_000_000, cache_treffer=12_000_000))Duas armadilhas de custo que fazem qualquer estimativa falhar
Primeiro: tokens de raciocínio. Modelos de raciocínio como GPT-6 Astra ou GPT-5.6 Sol pensam em tokens internos antes da resposta. Eles não aparecem no texto da resposta, mas são cobrados pela tarifa de output. Os cálculos de exemplo desta página não os incluem; por isso, em tarefas difíceis, a fatura real será maior. O número efetivo aparece em cada resposta em usage (completion_tokens_details.reasoning_tokens).
Segundo: repetições. Uma resposta que retorna com sucesso e é descartada pelo seu código — formato incorreto, uma nova tentativa — foi paga. Em agentes, uma tarefa visível costuma representar uma dúzia de execuções cobradas, e é aí que a diferença entre estimativa e fatura é maior. Requisições que falham na própria Kunavo não são cobradas.
Caching de prompts
Se sua aplicação enviar o mesmo prompt de sistema longo ou os mesmos documentos em todas as requisições, os acertos de cache serão cobrados a 10% da tarifa de input — em GPT-5.6 Sol, por exemplo, $0,20 em vez de $2,00 por 1M de tokens. Gravar no cache custa, na Kunavo, 1,25 vez a tarifa de input para GPT-5.6 Sol, Terra e GPT-6 Astra, e a tarifa normal de input para GPT-5.5. Como obter um acerto de cache está descrito na documentação de caching.
Adaptar código existente da OpenAI
A Kunavo é compatível com a OpenAI: você altera a base_url e a chave, e nada mais. chat.completions e responses mantêm seu formato, e a resposta traz, como de costume, o campo usage, que permite rastrear cada cobrança.
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1", # statt api.openai.com
)
resp = client.chat.completions.create(
model="gpt-5-6-terra",
messages=[{"role": "user", "content": "Fasse diese Rechnung in drei Sätzen zusammen."}],
)
print(resp.choices[0].message.content)
print(resp.usage) # Input-, Output- und Reasoning-Tokens: die Grundlage der AbrechnungCrie a chave (sk-kn-…) após a inscrição, no Dashboard. Lá você também define, por chave, um limite mensal de gastos — quando ele é atingido, a chave responde com 402 — e uma lista de permissões de IP. As etapas estão no guia de início rápido.
Pagar pela API da OpenAI a partir da Alemanha
A Kunavo cobra por meio do Stripe, como saldo pré-pago: sem assinatura e sem criar uma conta na OpenAI Platform. No checkout, estão disponíveis:
- Cartões: Visa, Mastercard, American Express, JCB e UnionPay — cartões de débito Visa e Mastercard funcionam como cartões de crédito
- Apple Pay, Google Pay e Link
O débito automático SEPA não é oferecido no momento. As recargas são expressas em dólares americanos; a Stripe mostra o valor na sua moeda no checkout. A recarga mínima é de $10; recargas maiores recebem crédito bônus: $100 se tornam $110,00, $1.000 se tornam $1.200,00 e $5.000 se tornam $6.250,00. O saldo nunca expira e solicitações malsucedidas não são cobradas. Os detalhes estão na documentação de cobrança.
Sendo honesto: quando o caminho direto para a OpenAI é melhor
A Kunavo é um gateway com capacidade compartilhada: não há uma cota exclusiva para sua conta nem um SLA contratual. Quem precisa de cota garantida ou de um SLA, por exemplo para um produto com disponibilidade prometida, deve comprar diretamente da OpenAI. Esta página não afirma atender a esse caso.
E, para quem trabalha o dia todo na janela de chat, uma assinatura do ChatGPT costuma ser a opção mais barata. A conta é uma divisão: preço da assinatura ÷ custo de uma rodada de chat = ponto de equilíbrio. Uma rodada com 2.000 tokens de input e 700 tokens de output custa cerca de $0,0124 em GPT-5.6 Sol e cerca de $0,00434 em GPT-5.6 Terra. Quem fizer mês após mês mais rodadas do que o resultado dessa divisão, permanecendo dentro dos limites do plano, se sairá melhor com a assinatura. A API vence em software, automação e uso variável — onde um mês tranquilo não deve custar nada.
Como reduzir os custos da API da OpenAI — nesta ordem
- Escolha o modelo para a tarefa. Deixar o maior modelo como padrão é a causa mais comum de uma fatura inesperada. Classificação, extração e outras tarefas em massa devem usar
gpt-6-luna, programação e agentes devem usargpt-6-sol, e a minoria difícil deve usar Astra. - Limite o output. O output custa várias vezes mais que o input, e o raciocínio também conta — por isso, um limite acima de
max_tokenstem efeito duplo. - Use caching de prompts. Um prompt de sistema longo e estável custa um décimo da tarifa de input quando é um acerto de cache.
- Envie menos contexto. Poucos trechos precisos de RAG em vez de metade da base de conhecimento — e permaneça abaixo do limite de 272.000 tokens sempre que possível.
Recalcule com seus próprios números: a calculadora de preços da API da OpenAI inclui input em cache e tokens de raciocínio; a calculadora de tokens coloca Claude e GPT lado a lado. A equivalente para a Anthropic: Preços do Claude. Se não forem os custos, mas os limites que estão impedindo você: Limites de taxa da API da OpenAI (em inglês).
Perguntas frequentes
Quanto custa a API da OpenAI?
A API da OpenAI é cobrada por token, sem mensalidade: os tokens de input e output têm tarifas separadas, e o output é a parte mais cara. Na Kunavo, GPT-5.6 custa Terra $0,70 / $4,20 por 1M de tokens (input / output), GPT-5.6 custa Sol $2,00 / $12,00, e o mais novo modelo principal da OpenAI, GPT-6, custa Astra $4,00 / $20,00. Os preços de tabela da OpenAI para os mesmos modelos são $2,00 / $12,00, $5,00 / $30,00 e $10,00 / $50,00; para GPT-5.6 Sol, a OpenAI cobra atualmente o preço promocional de $4,00 / $20,00, segundo a página de preços, pelo menos até 21 de novembro de 2026. Atualizado em: 3 de outubro de 2026.
A API está incluída na assinatura do ChatGPT?
Não. Uma assinatura do ChatGPT, como Plus ou Pro, paga o uso do próprio ChatGPT — no navegador, no aplicativo e no desktop. Ela não inclui uma chave de API nem créditos de API, e não reduz a fatura da API em nenhum centavo. Quem chama o GPT a partir do próprio software precisa de uma chave de API e paga por token, separadamente da assinatura. Da mesma forma, créditos de API não ampliam as cotas do ChatGPT.
Quanto custa uma solicitação à API do ChatGPT?
O que é informalmente chamado de “API do ChatGPT” é a API da OpenAI com os modelos GPT, e cada solicitação é cobrada por tokens. Nas tarifas da Kunavo, uma resposta RAG com 6.000 tokens de input e 500 de output em GPT-5.6 Terra custa aproximadamente $0,0063, uma etapa agêntica de programação com 25.000 / 1.200 tokens em GPT-5.6 Sol custa aproximadamente $0,0644, e uma tarefa pesada com 20.000 / 3.000 tokens em GPT-6 Astra custa aproximadamente $0,14. Os tokens de raciocínio são acrescentados à tarifa de output.
Posso testar a API da OpenAI gratuitamente?
A Kunavo não oferece crédito inicial, mas também não cobra mensalidade nem exige prazo mínimo. A menor entrada é a recarga mínima de $10 — com ela, é possível executar cerca de 1.590 respostas RAG em GPT-5.6 Terra. O saldo nunca expira, um mês sem chamadas não custa nada, e solicitações com falha não são cobradas.
Como os tokens de raciocínio são cobrados?
Sobre a tarifa de saída. Modelos de raciocínio como GPT-6 Astra ou GPT-5.6 Sol pensam em tokens internos antes de responder; eles não aparecem no texto da resposta, mas entram na cobrança. O número real é fornecido por cada resposta no campo usage (completion_tokens_details.reasoning_tokens). Em tarefas complexas, esse é o motivo mais comum para a cobrança real superar uma estimativa; um limite em max_tokens o restringe.
Quanto custa o GPT-6 Astra?
GPT-6 Astra é o mais novo carro-chefe da OpenAI desde 3 de setembro de 2026; a OpenAI o lista a $10,00 / $50,00 por 1 milhão de tokens. Na Kunavo, custa $4,00 / $20,00 — cerca de 60% abaixo do preço público. Em comparação com GPT-5.6 Sol, o preço de input é 2 vezes o desse modelo, e o preço de output é 1,7 vezes o desse modelo; por isso, Astra vale a pena para a minoria de tarefas difíceis em que está comprovado que Sol não é suficiente. Acima de 272.000 tokens de prompt, toda a solicitação do Astra também é cobrada à tarifa de 2 vezes para input e 1,5 vez para output.
Quanto custam o GPT-6 Sol e o GPT-6 Luna?
A OpenAI lançou GPT-6 Sol e GPT-6 Luna em 22 de setembro de 2026: Sol para coding complexo e fluxos de trabalho agênticos, e Luna, segundo a OpenAI, como o modelo mais eficiente para tarefas bem delimitadas em alto volume. A OpenAI lista Sol a $2,00 / $10,00 e Luna a $0,10 / $0,50 por 1 milhão de tokens (input / output); na Kunavo, eles custam $0,80 / $4,00 e $0,04 / $0,20, beide rund 60% darunter. Assim, GPT-6 Luna é o modelo GPT mais barato na Kunavo. Assim como no GPT-5.5, na família GPT-5.6 e no GPT-6 Astra, uma solicitação com mais de 272.000 tokens de prompt é cobrada integralmente à tarifa de 2 vezes para input e 1,5 vez para output.
Posso pagar por débito direto SEPA da Alemanha?
Não, o débito automático SEPA não é oferecido no momento. No checkout da Stripe, você pode escolher cartões (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay, Google Pay e Link; um cartão de débito Visa ou Mastercard funciona como um cartão de crédito. É um saldo pré-pago, com recarga mínima de $10, sem assinatura e sem expiração.
Meu código OpenAI existente funciona com a Kunavo?
Sim. A Kunavo é compatível com a OpenAI: defina base_url como https://api.kunavo.com/v1 e troque a chave por uma chave da Kunavo (sk-kn-…); chat.completions e responses mantêm o mesmo formato. Os nomes dos modelos são gpt-6-astra, gpt-5-6-sol, gpt-5-5, gpt-5-6-terra, gpt-6-sol e gpt-6-luna. A mesma chave também chama modelos Claude, de imagem e de vídeo.