Voltar aos guias
Preço·11 de setembro de 2026·Atualizado em 3 de outubro de 2026·10 min de leitura

Preço do Codex — quanto custa uma tarefa real pela API e quando a assinatura vale a pena

Metade do cálculo é o preço do plano; a outra, que ninguém faz, é o custo por token de uma tarefa real. Aqui estão os dois e a divisão que decide.

O Codex tem dois preços, e quase todas as respostas à pergunta “quanto custa o Codex” apresentam apenas um deles. Com uma assinatura do ChatGPT, o Codex está incluído em um plano mensal fixo, com limites de uso definidos pela OpenAI. Com uma chave de API, você paga por token — input, input em cache e output — sem assinatura: na Kunavo, GPT-5.6 Sol, o modelo que recomendamos por padrão para o Codex, custa $2,00 por milhão de tokens de input, $0,20 de input em cache e $12,00 de output, e uma tarefa real de 20 etapas custa aproximadamente $0,62 ($1,29 sem cache). A opção mais barata é determinada por uma divisão: preço do plano ÷ custo de uma tarefa. O uso interativo intenso todos os dias favorece a assinatura; o uso esporádico ou automatizado favorece a API.

Esta página não copia os planos da OpenAI — eles mudam, e uma cópia fica errada na semana seguinte; os valores atuais estão na página de preços do ChatGPT. Ela faz o cálculo que as comparações de planos deixam de lado: o preço por token, uma tarefa real detalhada linha a linha e o ponto de equilíbrio, que você completa com o preço do seu plano. Tarifas verificadas em 3 de outubro de 2026; os preços da Kunavo são lidos diretamente do catálogo de modelos.

Assinatura ou chave de API: os dois caminhos

Assinatura do ChatGPTChave de API (por token)
CobrançaPlano mensal fixoPor token: input, input em cache, output
LimitesJanelas de uso definidas pela OpenAINenhuma janela; o limite é seu saldo e o teto que você define para a chave
Um mês sem programarCobrado integralmente$0
Um mês intensoPode atingir o limite e esperarAcompanha o trabalho — e a fatura também
Automação (CI, scripts)Conexão com sua conta do ChatGPTUma chave por job, com seu próprio limite de gastos

Os dois caminhos não se acumulam, mas coexistem: você pode manter a assinatura e usar a chave apenas nos dias em que atingir o limite, alterando o model_provider no config.toml.

O preço do Codex por token: modelos adequados

ModeloPara quêKunavo por 1M (input / em cache / output)Preço público da OpenAI (input / output)Tarefa de 20 etapas
GPT-5.6 SolPadrão: a maioria das tarefas de código$2,00 / $0,20 / $12,00$5,00 / $30,00
promoção $4,00 / $20,00 (pelo menos até 21 de novembro de 2026)
$0,62
GPT-6 AstraSomente as mais difíceis — o bug persistente, o grande refatoramento$4,00 / $0,40 / $20,00$10,00 / $50,00$1,14
GPT-5.6 TerraEtapas rotineiras e bem definidas, e tarefas mecânicas: renomear, formatar, resumir um diff$0,70 / $0,07 / $4,20$2,00 / $12,00$0,22

O input em cache custa 0,10× a tarifa de input; as gravações em cache custam 1,25× o input em GPT-5.6 Sol/Terra e GPT-6 Astra. A coluna da OpenAI vem do mesmo catálogo, para conferir em vez de acreditar — em GPT-5.6 Sol, a Kunavo está cerca de 60% abaixo do preço de tabela, e cerca de 40% abaixo do preço promocional atualmente aplicado pela OpenAI. A ficha completa do modelo: GPT-5.6 Sol na Kunavo.

Uma tarefa real, linha a linha

O Codex é agêntico: uma solicitação se transforma em muitas idas e vindas cobradas com o modelo. A unidade que importa é a etapa — ler o contexto, propor uma alteração ou executar um comando, e informar o resultado. Como a ferramenta reenvia o contexto a cada etapa, uma etapa típica pesa aproximadamente 25.000 tokens de input e 1.200 de output. A maior parte do input se repete (instruções, arquivos já lidos) e vem do cache: supomos 20.000 tokens em cache e 5.000 novos, contando os novos como uma gravação em cache a 1,25× — o caso pessimista.

Item (GPT-5.6 Sol)Tokens por etapaTarifa por 1MCusto por etapa
Input lido do cache20 000$0,20 (0,10×)$0,0040
Input novo, gravado em cache5 000$2,50 (1,25×)$0,013
Output (incluindo raciocínio)1 200$12,00$0,014
Uma etapa——$0,031
Tarefa de 20 etapas×20—$0,62
A mesma tarefa sem cache×20—$1,29
A mesma tarefa no preço público da OpenAI, com cache×20—$1,54
A mesma tarefa no preço promocional atual da OpenAI, com cache (pelo menos até 21 de novembro de 2026)×20—$1,14

Para substituir a hipótese pelos seus próprios números, use o usage retornado pela API — input total, input em cache, output — e passe-o para esta função:

cout_codex.py
# Ce qu'a coûté une tâche Codex, à partir de l'usage renvoyé par l'API.
IN, OUT = 2.00, 12.00   # USD par 1M de tokens (gpt-5-6-sol chez Kunavo)
LECTURE, ECRITURE = 0.10, 1.25   # coefficients de cache sur le tarif d'input

def cout(input_total, en_cache, output, ecrit=0):
    neuf = input_total - en_cache - ecrit
    return (neuf * IN
            + en_cache * IN * LECTURE
            + ecrit * IN * ECRITURE
            + output * OUT) / 1_000_000   # output, raisonnement inclus

# 20 étapes : 500 000 d'input (400 000 en cache, 100 000 écrits), 24 000 d'output
print(round(cout(500_000, 400_000, 24_000, 100_000), 2))

O ponto de equilíbrio — uma divisão

Toda a decisão cabe em uma linha: preço do plano ÷ custo de uma tarefa = número de tarefas por mês que a assinatura precisa substituir para valer a pena. Com a tarefa de 20 etapas em GPT-5.6 Sol:

Plano mensal (exemplo)Equilíbrio com cache ($0,62 por tarefa)Equilíbrio sem cache ($1,29 por tarefa)
$20/mês~32 tarefas~16 tarefas
$100/mês~162 tarefas~78 tarefas
$200/mês~324 tarefas~155 tarefas

Os valores são números redondos para substituir, não a tabela da OpenAI. O veredito honesto depende do formato do seu uso:

  • Uso interativo intenso, todos os dias: cinco tarefas por dia útil equivalem a aproximadamente 110 por mês — $67,98 cobradas por token em GPT-5.6 Sol. Um plano cujo preço seja inferior a esse valor sai mais barato, desde que seus limites de uso comportem esse volume.
  • Uso esporádico: três dias intensos no mês, 15 tarefas, custam $9,27. Isso fica abaixo de qualquer plano, e um mês sem programar custa $0.
  • Automação (CI, scripts, agentes sem supervisão): a chave é o formato natural — uma por job, com um limite mensal de gastos por chave (a API responde 402 quando o limite é atingido) e uma lista de IPs autorizados, em /app/keys.

Um detalhe reforça a mesma conclusão: os dias movimentados, aqueles em que as pessoas assinam, são justamente os dias em que se atinge o limite — e um limite atingido significa capacidade paga, mas não entregue. Por outro lado, um plano é previsível, enquanto uma fatura por token não é, o que importa no orçamento de uma equipe.

Executando o Codex CLI com uma chave por token

Uma restrição elimina a maioria dos gateways: o Codex CLI aceita apenas wire_api = "responses", portanto o endpoint precisa disponibilizar POST /v1/responses, não apenas chat completions. A Kunavo disponibiliza ambos:

~/.codex/config.toml
# ~/.codex/config.toml — Codex CLI sur une clé au token, sans abonnement.
model = "gpt-5-6-sol"
model_provider = "kunavo"

[model_providers.kunavo]
name = "Kunavo"
base_url = "https://api.kunavo.com/v1"
env_key = "KUNAVO_API_KEY"     # le NOM de la variable, pas la clé
wire_api = "responses"         # la seule valeur acceptée (et la valeur par défaut)
terminal
export KUNAVO_API_KEY=sk-kn-...   # à créer dans /app/keys

codex                          # modèle du config.toml (gpt-5-6-sol)
codex -m gpt-5-6-terra           # tâche mécanique : le modèle le moins cher
codex -m gpt-6-astra             # seulement si GPT-5.6 Sol n'a pas suffi

A chave nunca fica no arquivo: env_key é o nome de uma variável de ambiente que o Codex lê na inicialização. Cada campo é detalhado na documentação de integração do Codex CLI, e a configuração completa, incluindo os erros 401 e 404 mais comuns, está no guia da chave de API para o Codex CLI (ambos em inglês).

O que altera o valor real

Tokens de raciocínio. Os modelos GPT refletem antes de responder, e essa reflexão é cobrada como output sem aparecer no diff. Cada bloco adicional de 1.000 tokens de output por etapa acrescenta $0,012 em GPT-5.6 Sol, ou $0,24 em uma tarefa de 20 etapas. Consulte o output cobrado no usage, não o tamanho da resposta.

Cache. É a maior alavanca, mais forte que trocar de modelo: a mesma tarefa custa $1,29 sem cache e $0,62 com cache. Sessões com contexto estável são as que mais se beneficiam. A calculadora de preços da API da OpenAI tem um campo para isso.

Contexto longo. A família GPT-5.6 e o GPT-6 Astra cobram a solicitação INTEIRA a 2× o input / 1,5× o output acima de 272.000 tokens de prompt. Recomeçar em uma nova sessão custa menos do que continuar uma sessão que ficou grande demais.

Modelo por etapa. A mesma tarefa de 20 etapas custa $0,22 em GPT-5.6 Terra, $0,62 em GPT-5.6 Sol e $1,14 em GPT-6 Astra. Reserve GPT-6 Astra para aquilo que GPT-5.6 Sol não resolveu.

Falhas. Na Kunavo, solicitações com falha não são cobradas. Uma nova tentativa bem-sucedida, por outro lado, é uma chamada cobrada como qualquer outra.

Pagar a partir da França

As tarifas por token são em dólares americanos, e a recarga passa pelo checkout da Stripe: cartões (Visa, Mastercard, American Express), Apple Pay, Google Pay e Link. O débito SEPA não está disponível no momento; um cartão de débito vinculado à sua conta normalmente funciona. O Pay by Bank também não está disponível na França: o checkout do Kunavo o exibe apenas para compradores do Reino Unido, Irlanda e Finlândia, e a Stripe só o disponibiliza na França em prévia privada (documentação da Stripe sobre Pay by Bank, consultada em 3 de outubro de 2026).

É um saldo pré-pago: recarga mínima de $10, sem assinatura, e o saldo nunca expira. Recargas maiores recebem um bônus — $100 tornam-se $110,00 e $1 000 tornam-se $1 200,00. De acordo com o cálculo acima, $10 cobrem aproximadamente 16 tarefas de 20 etapas no GPT-5.6 Sol. Mais detalhes na documentação de cobrança.

Honestamente: quando a Kunavo não é a escolha certa

A contrapartida, diante de uma chamada direta à OpenAI, é a capacidade compartilhada: não há cota dedicada nem SLA contratual. Se você precisa de uma cota garantida ou de um SLA por contrato, use diretamente a OpenAI. E, como mostra o cálculo acima, o uso interativo intenso do Codex todos os dias pode sair mais barato com uma assinatura. O que a chave oferece é o restante: sem assinatura, tarifas abaixo do preço público e uma única chave para GPT e Claude.

Codex ou Claude Code

São dois CLIs agênticos cobrados por etapa: o cálculo desta página vale para ambos; apenas a tarifa muda. O lado do Claude, com a mesma unidade de 25.000 / 1.200 tokens, está em Preços do Claude Code, e a comparação das ferramentas em Claude Code vs Codex (em inglês). Uma chave da Kunavo dá acesso aos dois, e a escolha se torna um argumento de -m em vez de uma segunda conta.

Perguntas frequentes

Quanto custa o Codex?

O Codex tem dois preços. Com uma assinatura do ChatGPT, ele está incluído em um plano mensal fixo, com limites de uso definidos pela OpenAI (o valor atual está na página de preços do ChatGPT). Com uma chave de API, você paga por token, sem assinatura: na Kunavo, GPT-5.6 Sol, o modelo recomendado por padrão para o Codex, custa $2,00 por milhão de tokens de input, $0,20 de input em cache e $12,00 de output, contra $5,00 / $30,00 no preço público da OpenAI (a OpenAI aplica atualmente um preço promocional de $4,00 / $20,00, pelo menos até 21 de novembro de 2026, segundo sua página de preços). Uma tarefa de 20 etapas (25.000 tokens de input por etapa, dos quais 80% em cache, e 1.200 de output) custa aproximadamente $0,62.

O Codex é gratuito?

O Codex CLI é gratuito e de código aberto, mas o modelo por trás dele nunca é: cada etapa é uma chamada cobrada, seja descontada da cota de uma assinatura, seja paga por meio de uma chave de API. Se o plano gratuito do ChatGPT inclui o Codex, e em que medida, é algo que a OpenAI decide e altera — a página de preços dela é a referência. A opção sem assinatura é a chave com cobrança por token: um mês sem programar custa $0.

Qual é o preço do Codex da OpenAI pela API?

Pela API, o Codex CLI cobra os tokens do modelo escolhido. Na Kunavo, por milhão de tokens de input / output: GPT-5.6 Sol $2,00 / $12,00, GPT-6 Astra $4,00 / $20,00 e GPT-5.6 Terra $0,70 / $4,20. O input em cache custa 0,10× o input, e as gravações em cache custam 1,25× o input nesses quatro modelos.

Assinatura do ChatGPT ou API: qual sai mais barato para o Codex?

Divida o preço do plano pelo custo de uma tarefa: você obtém o número de tarefas mensais que a assinatura precisa substituir para valer a pena. Com uma tarefa de 20 etapas a $0,62 em GPT-5.6 Sol, um plano de $20 se equilibra em cerca de 32 tarefas, e um plano de $100 em 162 (valores de exemplo, não a tabela da OpenAI). O uso interativo intenso todos os dias ultrapassa esses limites, e a assinatura vence, desde que seus limites comportem esse volume. O uso esporádico ou automatizado permanece abaixo deles, e a API vence.

Quanto custa uma tarefa com o Codex?

Tudo depende do número de etapas, não das horas. Uma etapa típica pesa cerca de 25.000 tokens de entrada, porque o Codex reenvia o contexto a cada chamada, e 1.200 tokens de saída. Em GPT-5.6 Sol via Kunavo, com 20.000 desses tokens lidos do cache, uma etapa custa $0,031 e uma tarefa de 20 etapas custa $0,62; sem cache, a mesma tarefa custa $1,29. Tokens de raciocínio são cobrados como saída sem aparecer na resposta: baseie-se no uso real.

Como pagar a partir da França? O débito SEPA é aceito?

O débito SEPA não está disponível no momento. O checkout da Stripe aceita cartões (Visa, Mastercard, American Express), Apple Pay, Google Pay e Link; um cartão de débito vinculado à sua conta normalmente funciona. É um saldo pré-pago a partir de $10, que nunca expira, e solicitações com falha não são cobradas.

Qual modelo escolher no Codex para gastar menos?

Adapte o modelo à etapa. GPT-5.6 Sol é a escolha padrão para tarefas de código; GPT-5.6 Terra ($0,70 / $4,20) resolve etapas rotineiras e tarefas mecânicas por uma fração do custo; GPT-6 Astra ($4,00 / $20,00) só se paga quando GPT-5.6 Sol não foi suficiente. Um modelo fraco que precisa tentar três vezes custa mais do que um modelo forte que acerta de primeira.

O Codex CLI funciona com a chave de API de outro provedor?

Sim, por meio de um bloco [model_providers] em ~/.codex/config.toml — mas somente na Responses API: o Codex aceita apenas wire_api = "responses", portanto o provedor precisa disponibilizar POST /v1/responses. Um gateway que ofereça apenas /v1/chat/completions não consegue executar o Codex. A Kunavo disponibiliza /v1/responses, com a base_url https://api.kunavo.com/v1.