O Codex tem dois preços, e quase toda resposta sobre “quanto custa o Codex” só fala de um. Pelo plano do ChatGPT, o Codex vem dentro de uma mensalidade fixa, com limites de uso definidos pela OpenAI. Pela chave de API, você paga por token — input, input em cache e output — sem mensalidade: na Kunavo, o GPT-5.6 Sol, o modelo que recomendamos como padrão no Codex, custa $2,00 por 1M de tokens de input, $0,20 de input em cache e $12,00 de output, e uma tarefa real de 20 passos sai por cerca de $0,62 ($1,29 sem cache). Qual rota é mais barata é uma divisão: a mensalidade do plano ÷ o custo de uma tarefa. Uso interativo pesado todo dia tende a favorecer o plano; uso em rajadas ou automatizado, a API.
Esta página não reproduz a tabela de planos da OpenAI — ela muda, e quem copia fica errado na semana seguinte; o valor atual está na página de planos do ChatGPT. Ela faz a conta que os comparativos de plano não fazem: o preço por token, uma tarefa real calculada linha a linha e o ponto de equilíbrio que você completa com o valor do seu plano. Tarifas verificadas em 11 de setembro de 2026; os preços da Kunavo são lidos ao vivo do catálogo de modelos.
As duas formas de pagar pelo Codex
| Plano do ChatGPT | Chave de API (por token) | |
|---|---|---|
| Como cobra | Mensalidade fixa | Por token: input, input em cache e output |
| Limites | Janelas de uso definidas pela OpenAI | Sem janela; o teto é o seu saldo e o limite que você põe na chave |
| Um mês parado | Cobrado inteiro | $0 |
| Um mês pesado | Pode bater no limite e esperar a janela | Acompanha o trabalho — e a fatura também |
| Automação (CI, scripts) | Login da sua conta ChatGPT | Uma chave por job, com limite de gasto próprio |
As duas rotas não se somam, mas convivem: dá para manter o plano e usar a chave só nos dias em que o limite fecha, trocando o model_provider no config.toml.
Preço por token: os modelos que fazem sentido no Codex
| Modelo | Quando usar | Kunavo por 1M (input / em cache / output) | Tabela OpenAI (input / output) | Tarefa de 20 passos |
|---|---|---|---|---|
| GPT-5.6 Sol | Padrão: a maioria das tarefas de código | $2,00 / $0,20 / $12,00 | $5,00 / $30,00 | $0,62 |
| GPT-6 Astra | Só as mais difíceis — o bug que resistiu, a refatoração grande | $4,00 / $0,40 / $20,00 | $10,00 / $50,00 | $1,14 |
| GPT-5.6 Terra | Passos rotineiros e bem definidos | $0,70 / $0,07 / $4,20 | $2,00 / $12,00 | $0,22 |
| GPT-5.6 Luna | Tarefas mecânicas: renomear, formatar, resumir um diff | $0,07 / $0,007 / $0,42 | $0,20 / $1,20 | $0,022 |
O input em cache é cobrado a 0,10× o input; gravações de cache custam 1,25× o input no GPT-5.6 Sol/Terra/Luna e no GPT-6 Astra. A coluna da OpenAI sai do mesmo catálogo, para você conferir em vez de confiar — no GPT-5.6 Sol, a Kunavo fica cerca de 60% abaixo da tabela. A ficha completa do modelo está em GPT-5.6 Sol na Kunavo.
Uma tarefa real, linha a linha
O Codex é agentic: um pedido seu vira muitas idas e voltas cobradas ao modelo. A unidade que importa é o passo — ler contexto, propor uma edição ou rodar um comando, relatar. Como a ferramenta reenvia o contexto a cada passo, um passo típico tem uns 25.000 tokens de input e 1.200 de output. A maior parte do input se repete (instruções, arquivos já lidos) e vem do cache: supomos 20.000 tokens em cache e 5.000 novos, e contamos os novos como gravação de cache a 1,25× — o caso pessimista.
| Parcela (GPT-5.6 Sol) | Tokens por passo | Tarifa por 1M | Custo por passo |
|---|---|---|---|
| Input lido do cache | 20.000 | $0,20 (0,10×) | $0,0040 |
| Input novo, gravado em cache | 5.000 | $2,50 (1,25×) | $0,013 |
| Output (inclui reasoning) | 1.200 | $12,00 | $0,014 |
| Um passo | — | — | $0,031 |
| Tarefa de 20 passos | ×20 | — | $0,62 |
| A mesma tarefa sem cache | ×20 | — | $1,29 |
| A mesma tarefa na tabela da OpenAI, com cache | ×20 | — | $1,54 |
Para trocar a suposição pelos seus números, pegue o usage que a API devolve — input total, input em cache e output — e jogue nesta função:
# Quanto custou uma tarefa do Codex, a partir do usage que a API devolve.
IN, OUT = 2.00, 12.00 # USD por 1M de tokens (gpt-5-6-sol na Kunavo)
LEITURA, GRAVACAO = 0.10, 1.25 # multiplicadores de cache sobre o input
def custo(input_total, em_cache, output, gravado=0):
novo = input_total - em_cache - gravado
return (novo * IN
+ em_cache * IN * LEITURA
+ gravado * IN * GRAVACAO
+ output * OUT) / 1_000_000 # output inclui reasoning
# 20 passos: 500 mil de input (400 mil em cache, 100 mil gravados), 24 mil de output
print(round(custo(500_000, 400_000, 24_000, 100_000), 2))Plano ou API: o ponto de equilíbrio
É uma divisão só: mensalidade ÷ custo de uma tarefa = tarefas por mês que o plano precisa substituir para compensar. Com a tarefa de 20 passos do GPT-5.6 Sol:
| Mensalidade (exemplo) | Empata com cache ($0,62 por tarefa) | Empata sem cache ($1,29 por tarefa) |
|---|---|---|
| $20/mês | ~32 tarefas | ~16 tarefas |
| $100/mês | ~162 tarefas | ~78 tarefas |
| $200/mês | ~324 tarefas | ~155 tarefas |
As mensalidades são valores redondos para você substituir, não a tabela da OpenAI. O veredito honesto depende do formato do seu uso:
- Uso interativo pesado, todo dia: cinco tarefas por dia útil são umas 110 por mês — $67,98 na cobrança por token do GPT-5.6 Sol. Um plano com mensalidade abaixo disso sai mais barato, desde que os limites de uso dele comportem esse volume.
- Uso em rajadas: três dias intensos no mês, 15 tarefas, dão $9,27. Fica abaixo de qualquer mensalidade, e o mês em que você não programa custa $0.
- Automação (CI, scripts, agentes sem ninguém olhando): a chave é o formato natural — uma por job, com limite mensal de gasto por chave (a API responde 402 ao atingir o teto) e allowlist de IP, configurados em
/app/keys.
Um detalhe puxa na mesma direção: os dias pesados, que são o motivo de assinar, são justamente os dias em que você bate no limite — e limite atingido é capacidade paga e não entregue. Por outro lado, a mensalidade é previsível e a fatura por token não, o que conta num orçamento de equipe.
Como rodar o Codex CLI com uma chave por token
Uma restrição elimina a maioria dos gateways: o Codex CLI só aceita wire_api = "responses", então o endpoint precisa servir POST /v1/responses, não apenas chat completions. A Kunavo serve os dois:
# ~/.codex/config.toml — o Codex CLI numa chave por token, sem plano.
model = "gpt-5-6-sol"
model_provider = "kunavo"
[model_providers.kunavo]
name = "Kunavo"
base_url = "https://api.kunavo.com/v1"
env_key = "KUNAVO_API_KEY" # o NOME da variável, não a chave
wire_api = "responses" # o único valor aceito (e o padrão)export KUNAVO_API_KEY=sk-kn-... # crie em /app/keys
codex # usa o modelo do config.toml (gpt-5-6-sol)
codex -m gpt-5-6-luna # tarefa mecânica: o modelo mais barato
codex -m gpt-6-astra # só quando o GPT-5.6 Sol não resolveuA chave nunca vai no arquivo: env_key é o nome de uma variável de ambiente que o Codex lê ao iniciar. Cada campo está explicado na documentação de integração do Codex CLI, e o passo a passo em português, com os erros 401 e 404 mais comuns, está no guia do Codex CLI com chave de API (há também uma versão em inglês).
O que mexe no número real
Tokens de reasoning. Os modelos GPT pensam antes de responder, e esse raciocínio é cobrado como output sem aparecer no diff. Cada 1.000 tokens de output a mais por passo somam $0,012 no GPT-5.6 Sol, ou $0,24 numa tarefa de 20 passos. Confira o output cobrado no usage, não o tamanho da resposta.
Cache. É a maior alavanca, maior que trocar de modelo: a mesma tarefa custa $1,29 sem cache e $0,62 com. Sessões que mantêm o contexto estável aproveitam mais. A calculadora de preços da API da OpenAI tem um campo para isso.
Contexto longo. A família GPT-5.6 e o GPT-6 Astra cobram a requisição INTEIRA a 2× o input / 1,5× o output acima de 272 mil tokens de prompt. Numa sessão que cresceu demais, começar uma nova sai mais barato do que empurrar a mesma.
Modelo por passo. A mesma tarefa de 20 passos custa $0,022 no GPT-5.6 Luna, $0,22 no GPT-5.6 Terra e $1,14 no GPT-6 Astra. Reserve o GPT-6 Astra para o que o GPT-5.6 Sol não resolveu.
Falhas. Na Kunavo, requisições com falha não são cobradas. Já uma nova tentativa que dá certo é uma chamada cobrada como qualquer outra.
Pagar do Brasil: Pix no checkout
As tarifas por token são em dólar, e a recarga passa pelo checkout do Stripe. Para quem paga do Brasil, o Pix aparece como forma de pagamento: o Stripe converte e mostra o valor em reais antes de você confirmar, e a compensação é imediata. Cartões (Visa, Mastercard, American Express), Apple Pay e Link também funcionam. O passo a passo, com QR code e copia e cola, está no guia de como pagar a API com Pix.
A carteira é pré-paga: recarga mínima de $10, sem assinatura, e o saldo nunca expira. Recargas maiores rendem bônus — $100 viram $110,00 e $1.000 viram $1.250,00. Pela conta acima, $10 cobrem cerca de 16 tarefas de 20 passos no GPT-5.6 Sol.
Com franqueza: quando a Kunavo não é a escolha certa
A troca em relação a chamar a OpenAI direto é capacidade compartilhada: não há cota dedicada nem SLA contratual. Quem precisa de cota garantida ou de SLA por contrato deve ir direto à OpenAI. E, como mostra a conta acima, quem usa o Codex de forma interativa e pesada todos os dias pode pagar menos num plano. O que a chave oferece é o resto: sem mensalidade, tarifas abaixo da tabela e uma única chave para GPT, Claude e Gemini.
Codex ou Claude Code
Os dois são CLIs agentic cobrados por passo, então a conta desta página vale para os dois — só muda a tarifa. O lado Claude, com a mesma unidade de 25.000 / 1.200 tokens, está em Claude Code preço, e a comparação entre as ferramentas em Claude Code vs Codex (em inglês). Com uma chave na Kunavo você alcança os dois, e a escolha vira um argumento de -m em vez de uma segunda conta.
Perguntas frequentes
Quanto custa o Codex?
O Codex tem dois preços. No plano do ChatGPT, ele vem dentro de uma mensalidade fixa com limites de uso definidos pela OpenAI (o valor atual está na página de planos do ChatGPT). Com chave de API você paga por token, sem mensalidade: na Kunavo o GPT-5.6 Sol, o modelo recomendado como padrão no Codex, custa $2,00 por 1M de tokens de input, $0,20 de input em cache e $12,00 de output, contra $5,00 / $30,00 na tabela da OpenAI. Uma tarefa de 20 passos (25.000 tokens de input por passo, 80% em cache, 1.200 de output) sai por cerca de $0,62.
O Codex é grátis?
O Codex CLI é gratuito e de código aberto, mas rodar o modelo nunca é: cada passo que o Codex dá é uma chamada cobrada, seja descontada do limite de um plano, seja cobrada numa chave de API. Se o plano gratuito do ChatGPT inclui Codex, e quanto, é uma configuração da OpenAI que muda — confira na página de planos. A rota sem mensalidade é a chave por token: um mês em que você não programa custa $0.
Qual é o preço do Codex da OpenAI na API?
Na API o Codex CLI cobra os tokens do modelo que você escolher. Na Kunavo: GPT-5.6 Sol $2,00 / $12,00, GPT-6 Astra $4,00 / $20,00, GPT-5.6 Terra $0,70 / $4,20 e GPT-5.6 Luna $0,07 / $0,42 por 1M de tokens de input / output. O input em cache custa 0,10× o input, e gravações de cache custam 1,25× o input nesses quatro modelos.
Vale mais a pena o plano do ChatGPT ou a API para usar o Codex?
Divida a mensalidade do plano pelo custo de uma tarefa: o resultado é quantas tarefas por mês o plano precisa substituir para compensar. Com uma tarefa de 20 passos a $0,62 no GPT-5.6 Sol, uma mensalidade de $20 empata em cerca de 32 tarefas e uma de $100 em cerca de 162 (valores de exemplo, não a tabela da OpenAI). Uso interativo pesado todo dia passa desses números e o plano tende a ganhar, enquanto os limites dele aguentarem. Uso em rajadas ou automatizado fica abaixo, e aí a API ganha.
Quanto custa uma tarefa no Codex?
Depende de passos, não de horas. Um passo típico tem cerca de 25.000 tokens de input, porque o Codex reenvia o contexto a cada ida ao modelo, e 1.200 de output. No GPT-5.6 Sol pela Kunavo, com 20.000 desses tokens lidos do cache, um passo custa $0,031 e uma tarefa de 20 passos $0,62; sem cache, a mesma tarefa sai por $1,29. Tokens de reasoning são cobrados como output e não aparecem na resposta, então confira o usage real.
Dá para pagar o Codex com Pix?
Pela rota de chave de API, sim. As tarifas são em dólar e a recarga passa pelo checkout do Stripe, onde o Pix aparece para quem paga do Brasil, com o valor convertido e exibido em reais antes de confirmar e compensação imediata. Cartão, Apple Pay e Link também funcionam. A recarga mínima é de $10, o saldo não expira e requisições com falha não são cobradas.
Qual modelo usar no Codex para gastar menos?
Combine o modelo com o passo. O GPT-5.6 Sol é o padrão para tarefas de código; o GPT-5.6 Luna ($0,07 / $0,42) resolve tarefas mecânicas por uma fração do custo; o GPT-5.6 Terra fica no meio; o GPT-6 Astra ($4,00 / $20,00) só se paga quando o GPT-5.6 Sol não resolveu. Um modelo fraco que precisa de três tentativas custa mais do que um forte que acerta de primeira.
O Codex CLI funciona com chave de API de outro provedor?
Funciona, com um bloco [model_providers] no ~/.codex/config.toml — mas só pela Responses API: o Codex aceita apenas wire_api = "responses", então o provedor precisa servir POST /v1/responses. Um gateway que só oferece /v1/chat/completions não roda o Codex. A Kunavo serve /v1/responses, com base_url https://api.kunavo.com/v1.