A API do GPT é cobrada conforme o uso, por token. Não há mensalidade; tokens de entrada e de saída têm preços separados, e a saída custa mais. As taxas do Kunavo em 4 de outubro de 2026 são, por 1 milhão de tokens, gpt-5-6-terra: entrada $0.70 / saída $4.20, e gpt-5-5: $2.00 / $12.00 — ambas abaixo do preço de tabela da OpenAI. O gpt-6-luna, lançado em 22 de setembro de 2026, custa $0.04 / $0.20 e é o GPT mais barato do Kunavo.
Há uma distinção importante a fazer primeiro. O plano mensal do ChatGPT e a API da OpenAI são produtos diferentes, com cobranças diferentes. Pagar pelo ChatGPT não fornece uma chave de API nem reduz a cobrança da API. Esta página trata apenas do segundo caso, os custos das chamadas feitas pelo código.
As taxas são verificadas em 4 de outubro de 2026. Os números do Kunavo são renderizados a partir do catálogo deste site, portanto não divergem do valor efetivamente cobrado. Para o preço de tabela da OpenAI, consulte a página de preços da OpenAI.
Tabela de preços dos modelos GPT-5 / GPT-6
USD por 1 milhão de tokens. “Preço de tabela da OpenAI” é o preço publicado para o mesmo modelo. Para os modelos em promoção, também mostramos abaixo o preço que a OpenAI está cobrando atualmente.
| Modelo | Entrada / 1M | Saída / 1M | Preço de tabela da OpenAI |
|---|---|---|---|
gpt-6-luna | $0.04 | $0.20 | $0.10 / $0.50 |
gpt-6-sol | $0.80 | $4.00 | $2.00 / $10.00 |
gpt-5-6-terra | $0.70 | $4.20 | $2.00 / $12.00 |
gpt-5-5 | $2.00 | $12.00 | $5.00 / $30.00 |
gpt-6-astra | $4.00 | $20.00 | $10.00 / $50.00 |
gpt-5-6-sol | $2.00 | $12.00 | $5.00 / $30.00 Preço promocional atual $4.00 / $20.00 (pelo menos até 21 de novembro de 2026) |
As taxas mais recentes estão sempre na página de preços e na página de cada modelo. A lista completa de modelos está em lista de modelos.
GPT-6 é a nova geração da OpenAI. GPT-6 Astra foi lançado em 3 de setembro de 2026 como o modelo topo de linha da OpenAI, seguido por GPT-6 Sol e GPT-6 Luna em 22 de setembro de 2026. A OpenAI descreve os dois como modelos “construídos sobre os avanços que impulsionaram o GPT-6 Astra”, posicionando Sol para codificação complexa e fluxos de trabalho agentivos, e Luna como “o modelo mais eficiente para processamento focado em grande escala”. Ambos têm contexto de 1,050,000 tokens e saída máxima de 128,000 tokens.
No Kunavo, GPT-6 Luna é o GPT mais barato, por $0.04 / $0.20. GPT-6 Sol custa $0.80 / $4.00, e o preço de saída é menor que o de GPT-5.6 Terra ($4.20). No entanto, a tarifa de entrada de GPT-5.6 Terra ($0.70) é menor, e em solicitações nas quais os tokens de entrada excedem 2 vezes os de saída, GPT-5.6 Terra é mais barato (a comparação pode ser feita na tabela abaixo). Para solicitações cuja entrada exceda 272.000 tokens, o total da solicitação é cobrado, conforme definido pela OpenAI, a 2 vezes o preço de entrada e 1,5 vez o preço de saída, como nos demais GPT-5.x / GPT-6.
Quanto custa uma solicitação na prática
| Uso | Tokens | gpt-6-luna | gpt-6-sol | gpt-5-6-terra | gpt-5-5 |
|---|---|---|---|---|---|
| Um turno curto | 1.000 de entrada / 300 de saída | $0.0001 | $0.0020 | $0.0020 | $0.0056 |
| Uma resposta de RAG | 6.000 de entrada / 500 de saída | $0.0003 | $0.0068 | $0.0063 | $0.0180 |
| Um problema difícil | 20.000 de entrada / 3.000 de saída | $0.0014 | $0.0280 | $0.0266 | $0.0760 |
| Lote de 100 mil itens | 500 de entrada / 20 de saída × 100.000 | $2.40 | $48.00 | $43.40 | $124.00 |
Para calcular com os seus próprios números, use isto exatamente como está.
# Kunavo の GPT 料率(1M トークンあたり USD): (input, output)
RATES = {
"gpt-5-6-terra": (0.70, 4.20),
"gpt-5-5": (2.00, 12.00),
"gpt-5-6-sol": (2.00, 12.00),
"gpt-6-sol": (0.80, 4.00),
"gpt-6-luna": (0.04, 0.20),
}
def cost(model: str, in_tokens: int, out_tokens: int) -> float:
i, o = RATES[model]
# 注意: GPT-5 系の推論モデルは reasoning トークンも出力料率で課金される。
return in_tokens / 1_000_000 * i + out_tokens / 1_000_000 * o
print(cost("gpt-5-6-terra", 1_000, 300)) # 短い 1 ターン
print(cost("gpt-5-6-terra", 6_000, 500)) # RAG の回答 1 件
print(cost("gpt-5-5", 20_000, 3_000)) # 難しい問題
print(cost("gpt-5-6-sol", 20_000, 3_000)) # GPT-5.6 のフラッグシップ
print(cost("gpt-6-sol", 20_000, 3_000)) # GPT-6 Sol
print(cost("gpt-6-luna", 1_000, 300)) # いちばん安い 1 ターンDuas armadilhas que distorcem a cobrança
A primeira são os tokens de raciocínio. Os modelos de raciocínio da série GPT-5 geram tokens de pensamento internamente antes de dar a resposta; eles não aparecem no corpo da resposta, mas são cobrados pela tarifa de saída. Os valores da tabela acima não incluem os tokens de raciocínio, portanto, quanto mais difícil o problema, mais a cobrança real supera esses valores. A quantidade de tokens de saída no campo usage é o número real.
A segunda são as novas tentativas. Solicitações que consomem tokens e depois falham em um serviço downstream também são cobradas. Em cargas de trabalho agentivas, uma única tarefa vista pelo usuário pode corresponder a muitas rodadas para fins de cobrança, portanto a divergência aparece com maior intensidade aqui. Solicitações que falham no Kunavo (ou seja, que não chegam ao upstream) não são cobradas.
Conectar ao código existente da OpenAI
Basta alterar uma linha de base_url e a chave. Tanto chat.completions quanto responses continuam funcionando no mesmo formato.
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1", # 変えるのはこの 1 行だけ
)
resp = client.chat.completions.create(
model="gpt-5-6-terra",
messages=[{"role": "user", "content": "こんにちは"}],
)
print(resp.choices[0].message.content)Com a mesma chave, você também pode chamar Claude, modelos de imagem e de vídeo. O procedimento está no início rápido; a lista de endpoints está na documentação de Chat Completions.
Pagar a partir do Japão
O saldo da Kunavo pode ser recarregado no checkout do Stripe com cartões, incluindo JCB (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay, Google Pay e Link. É uma carteira pré-paga, com recarga mínima de $10; o saldo não expira. Não há cobrança nos meses sem uso. Não aceitamos pagamento em lojas de conveniência nem PayPay. As informações obrigatórias para operadores nacionais estão em Informações com base na Lei de Transações Comerciais Especificadas, e os detalhes de cobrança estão reunidos na documentação de cobrança.
Quatro alavancas para reduzir custos
- Escolha o nível pelo tamanho do problema. Não use o modelo topo de linha como padrão. Para processamento em grande escala, como classificação, extração e formatação, comece pelo
gpt-6-lunamais barato que a OpenAI posiciona para esse uso e passe para um nível superior se ele não for suficiente. Como mostra a tabela acima, mesmo para uma única resposta de RAG, os custos degpt-6-lunaegpt-5-5diferem por um fator de aproximadamente 53. - Limite a saída. Como a saída custa mais que a entrada,
max_tokense a especificação do formato de saída têm efeito direto. Em modelos que usam raciocínio, o impacto é duplo. - Ative o cache de prompts. Se a mesma instrução de sistema é enviada a cada chamada, o cache é a maior alavanca. O funcionamento está na documentação de cache.
- Não acumule no input históricos irrelevantes. Ao mudar de tarefa, limpe a conversa. Históricos longos são cobrados integralmente a cada chamada.
Para comparar lado a lado com modelos de outras empresas, preços do Claude usa o mesmo método de cálculo. Se quiser ver apenas a cobrança por uso do Codex CLI, consulte preços do Codex.
Perguntas frequentes
Quanto custa a API do GPT?
A cobrança é baseada no uso, por token, com tarifas separadas para entrada e saída. Em 4 de outubro de 2026, as tarifas da Kunavo por 1M de tokens são: gpt-5-6-terra, entrada $0.70 / saída $4.20; gpt-5-5, $2.00 / $12.00; gpt-5-6-sol, $2.00 / $12.00. Os preços de tabela da OpenAI para os mesmos modelos são $2.00 / $12.00, $5.00 / $30.00 e $5.00 / $30.00, respectivamente (gpt-5-6-sol é atualmente oferecido pela OpenAI pelo preço promocional de $4.00 / $20.00 e, segundo a página de preços, a promoção continua pelo menos até 21 de novembro de 2026). Lançados em 22 de setembro de 2026, o gpt-6-sol custa $0.80 / $4.00 e o gpt-6-luna custa $0.04 / $0.20 (os preços de tabela da OpenAI são $2.00 / $10.00 e $0.10 / $0.50); o gpt-6-luna é o GPT mais barato. Não há mensalidade.
Quanto custa a API do GPT-6?
Preços de tabela da OpenAI (por 1M tokens, entrada / saída): GPT-6 Sol $2.00 / $10.00, GPT-6 Luna $0.10 / $0.50, GPT-6 Astra $10.00 / $50.00 (Sol e Luna foram lançados em 22 de setembro de 2026, e Astra em 3 de setembro de 2026). As tarifas do Kunavo por 1M tokens de entrada / saída são: gpt-6-sol $0.80 / $4.00, gpt-6-luna $0.04 / $0.20, GPT-6 Astra $4.00 / $20.00. Todos podem ser usados por cerca de 60% menos que o preço de tabela. gpt-6-luna é o GPT mais barato no Kunavo, e gpt-6-sol tem um preço por token de saída menor que o de gpt-5-6-terra ($4.20) (a tarifa de entrada é menor no gpt-5-6-terra: $0.70). Para requisições com entrada superior a 272.000 tokens, toda a requisição é cobrada com um multiplicador de 2 para entrada e de 1,5 para saída, assim como na OpenAI.
A mensalidade do ChatGPT e o preço da API da OpenAI são a mesma coisa?
Não, são produtos e cobranças diferentes. Os planos pagos do ChatGPT são mensalidades pelo uso da interface chat.openai.com; eles não incluem cota de API nem fornecem uma chave de API. A API é cobrada por token conforme o uso: não há mensalidade, mas você paga pelo que chamar. Para chamar a partir do código, é necessário usar a API; pagar pelo ChatGPT não reduz nem um centavo da cobrança da API.
Quanto custa, na prática, uma solicitação à API do GPT?
Para uma resposta RAG com 6.000 tokens de entrada e 500 de saída, o gpt-5-6-terra custa aproximadamente $0.0063, enquanto o gpt-6-luna, o mais barato, custa aproximadamente $0.0003. Para um problema difícil com 20.000 tokens de entrada e 3.000 de saída, o gpt-5-5 custa aproximadamente $0.0760 e o gpt-5-6-sol, $0.0760. Todos os valores usam as tarifas da Kunavo e não incluem tokens de raciocínio.
Como os tokens de raciocínio são cobrados?
Você é cobrado pela taxa de saída. Os modelos de raciocínio da série GPT-5 geram tokens de pensamento internamente antes de dar a resposta; eles não aparecem no corpo da resposta, mas aparecem na cobrança. Essa é a causa mais comum de uma estimativa sair mais barata do que a cobrança real, e a divergência aumenta em problemas mais difíceis. Leia a quantidade de tokens de saída no campo usage para saber o número real e use-a em vez da estimativa.
Como usar o GPT mais barato?
Quatro pontos, em ordem de impacto. Escolha o tier pelo tamanho do problema e não use o modelo topo de linha como padrão (considerando o preço de saída, o gpt-6-astra topo de linha custa 100 vezes mais que o gpt-6-luna mais barato). Limite a saída com max_tokens e especificando o formato de saída. Ative o cache de prompts. Não acumule no input históricos irrelevantes. Depois disso, direcionar para um endpoint mais barato que o preço de tabela da OpenAI potencializa os quatro pontos.
O código existente do SDK da OpenAI funciona sem alterações?
Funciona. O Kunavo é um endpoint compatível com a OpenAI, portanto basta alterar uma linha, o base_url para https://api.kunavo.com/v1, e a chave. Tanto chat.completions quanto responses funcionam no mesmo formato, e os nomes dos modelos podem ser usados sem alteração. Com a mesma chave, você também pode chamar Claude, modelos de imagem e de vídeo.
Como pagar pela API do GPT a partir do Japão?
O saldo da Kunavo pode ser recarregado no checkout do Stripe com cartões, incluindo JCB (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay, Google Pay e Link. É uma carteira pré-paga, com recarga mínima de $10; o saldo não expira e não há cobrança nos meses sem uso. Solicitações malsucedidas não são cobradas. Não aceitamos pagamento em lojas de conveniência nem PayPay.