Ao pesquisar o preço do Codex, a maioria das páginas leva a uma tabela comparativa de planos. Mas os números necessários na prática muitas vezes não estão ali. Existem dois modelos de cobrança, e a tabela explica apenas um deles. Esta página mostra o outro — quanto custa a cobrança por uso baseada em tokens — com valores reais, para que você possa decidir qual é mais barato com uma única divisão.
Em resumo, há duas formas de pagar pelo Codex.
| Forma de pagamento | Unidade de cobrança | Limite |
|---|---|---|
| Incluído em um plano do ChatGPT | Mensalidade fixa | Há uma franquia (a execução para quando ela acaba) |
| Chave de API (cobrança por uso) | Tokens de entrada e saída | Sem mensalidade e sem limite |
Essas duas formas não são combinadas. Você pode manter um plano contratado e usar uma chave, e também pode fazer o inverso.
Preço unitário da cobrança por uso e custo real de uma etapa
As tarifas são carregadas diretamente do catálogo (não são inseridas manualmente; portanto, se houver aumento ou redução de preço, este texto também será atualizado automaticamente). GPT-5.6 Sol custa $2.00 / $12.00 por 1 milhão de tokens.
O preço unitário sozinho não é muito intuitivo, então vamos convertê-lo para uma execução. Considerando uma etapa agentiva com 25.000 tokens de entrada e 1.200 de saída — o tamanho de uma tarefa que lê código e corrige um ponto — uma etapa custa aproximadamente $0.0644. Isso corresponde a aproximadamente 16 etapas por $1. Um trabalho que termina em cerca de 20 etapas custa aproximadamente $1.288 por tarefa.
# 実際にいくらか確かめる最小のリクエスト。
# usage に返るトークン数 × 単価が、そのまま請求額になる。
curl -sS https://api.kunavo.com/v1/responses \
-H "Authorization: Bearer sk-kn-..." \
-H "content-type: application/json" \
-d '{"model":"gpt-5-6-sol",
"input":"このリポジトリのテストを一覧にして"}'A quantidade real de tokens é retornada em usage na resposta, portanto você pode determinar o custo por tarefa do seu uso com precisão. Meça, em vez de estimar.
Ponto de equilíbrio entre plano e cobrança por uso — uma única divisão
Isso é frequentemente debatido, mas a resposta não depende de preferência: depende do cálculo.
Mensalidade ÷ custo por tarefa = número de tarefas do ponto de equilíbrio. Se uma tarefa custa cerca de $1.288, o ponto de equilíbrio de um plano de $20 por mês fica em torno de 16 tarefas mensais. Abaixo disso, a cobrança por uso é mais barata; acima disso, o plano é mais barato. Comparar a tabela de planos repetidamente não substitui esta linha de cálculo.
Observe que a mensalidade e a franquia dos planos são valores sujeitos a alterações. Por isso, esta página não transcreve os preços dos planos: os valores seguem a mesma política da versão em inglês de Codex pricing — não escrever números variáveis, apenas fornecer a fórmula da divisão.
Esgotou a franquia hoje? Termine ainda hoje
Este é o problema mais comum ao usar um plano. Quando você atinge o limite, as opções, segundo a ajuda da OpenAI, são adicionar créditos, aplicar um reset disponível, fazer upgrade ou aguardar o horário do reset. Usuários elegíveis do Plus e do Pro podem comprar créditos sem mudar de plano; o upgrade para um plano superior disponível é aplicado imediatamente, e o ciclo de cobrança também é redefinido (ajuda do plano Pro). Como o upgrade muda o ciclo de cobrança inteiro, se você só precisar de capacidade extra naquele dia, também pode mudar apenas esse trabalho para uma chave. Não é necessário cancelar o plano.
# Codex CLI を従量課金のエンドポイントに向ける。
# Codex が受け付けるのは Responses API だけで、chat completions では動かない。
export OPENAI_BASE_URL=https://api.kunavo.com/v1
export OPENAI_API_KEY=sk-kn-...
codexHá uma restrição importante. A Codex CLI aceita apenas a Responses API como provedor personalizado; endpoints que oferecem somente chat completions não funcionam. Ao escolher uma alternativa, verifique se ela é compatível com POST /v1/responses antes de comparar preços. O procedimento para obter uma chave está em Configuração da chave de API da Codex CLI.
Duas maneiras de reduzir custos
A primeira é usar modelos diferentes para tarefas diferentes. Não é necessário executar até o processamento auxiliar — como resumo, classificação e formatação — no modelo mais avançado. GPT-5.6 Terra custa $0.70 / $4.20 por 1 milhão de tokens, e transferir esse tipo de tarefa quase não altera o resultado.
A segunda é o cache de prompts. Quando as mesmas premissas — descrição do repositório, convenções de código — são enviadas a cada solicitação, o custo de entrada cai bastante. O funcionamento e o impacto estão explicados em explicação sobre prompt caching. Se você estiver em dúvida entre Codex e Claude Code, comparação entre Codex e Claude Code compara os modelos de cobrança (a versão em inglês é Claude Code vs Codex).
Perguntas frequentes
Quanto custa o Codex?
Há duas formas de pagar, que costumam ser confundidas. Uma é por meio de um plano do ChatGPT, que inclui uma franquia de uso em troca de uma mensalidade. A outra é a cobrança por consumo de tokens com uma chave de API, sem mensalidade nem limite máximo. Na cobrança por consumo, GPT-5.6 Sol custa $2.00 / $12.00 por 1M de tokens via Kunavo. Uma etapa agêntica com 25.000 tokens de entrada e 1.200 de saída custa cerca de $0.0644, ou seja, $1 cobre cerca de 16 etapas.
Posso usar o Codex gratuitamente?
O uso é parcialmente gratuito. Os planos grátis e Go do ChatGPT incluem o Codex; segundo a página de preços da OpenAI, é possível usar o GPT-6 Luna no aplicativo para desktop em velocidade padrão (disponibilização gradual). A CLI, a extensão para IDE e a versão Web do Codex estão disponíveis a partir do Plus. As demais formas de uso exigem a franquia de um plano pago ou cobrança por consumo de tokens com uma chave de API.
O que é mais barato: plano ou cobrança por uso?
Basta fazer uma divisão. Mensalidade ÷ preço por tarefa = número de tarefas do ponto de equilíbrio. Considerando uma tarefa como um trabalho de cerca de 20 etapas, cada tarefa custa aproximadamente $1.288; portanto, o ponto de equilíbrio de um plano de $20 por mês fica em torno de 16 tarefas mensais. Abaixo disso, a cobrança por uso é mais barata; acima disso, o plano é mais barato. Calcule com seu número real de tarefas — olhar a tabela de planos não dará a resposta.
O que faço quando esgotar a franquia do Plus?
A ajuda da OpenAI lista quatro opções: adicionar créditos, aplicar um reset disponível, fazer upgrade ou aguardar o horário do reset. Usuários elegíveis do Plus e do Pro podem comprar créditos sem mudar de plano; ao fazer upgrade para um plano superior disponível, o novo plano é aplicado imediatamente (e o ciclo de cobrança também é redefinido). Outra opção é manter o plano e mudar apenas esse trabalho para uma chave de API. Defina OPENAI_BASE_URL e OPENAI_API_KEY para usar a cobrança por uso; remova as variáveis para voltar ao plano original.
A Codex CLI funciona com endpoints de outras empresas?
Funciona com qualquer endpoint que ofereça a Responses API (POST /v1/responses). Esse é o ponto que costuma causar problemas na prática: a Codex CLI não funciona em gateways que oferecem apenas chat completions. Ao considerar uma migração, confirme primeiro se o protocolo compatível é Responses.
Qual é a maneira mais eficaz de reduzir custos?
Delegar o processamento auxiliar a um modelo mais barato. GPT-5.6 Terra custa $0.70 / $4.20 por 1 milhão de tokens, e tarefas como resumo, classificação e formatação podem ser transferidas sem perda de precisão. O próximo recurso mais eficaz é o cache de prompts: quando as mesmas premissas são enviadas repetidamente, o custo de entrada cai bastante.