Voltar aos guias
Agentes de programação·1 de outubro de 2026·9 min de leitura

Preços do Warp AI: créditos, planos e o que sua própria inferência elimina

O terminal do Warp é gratuito e sua IA é medida em créditos distribuídos em três tipos. Sua própria chave ou endpoint elimina os créditos de IA das chamadas que ele processa — mas não o Auto, nem os agentes na nuvem e, no Business, nem a cobrança da plataforma por hora.

Última revisão em .

O terminal do Warp não custa nada; sua IA é medida em créditos, e é essa parte que vale a pena entender. Em 1º de outubro de 2026, a página de preços do Warp oferece 1.500 créditos mensais no Build por $20, 18.000 no Max por $200 e 1.500 por assento no Business por $50, além de vender mais créditos em pacotes Reload, a partir de 400 créditos por $10. Os créditos do plano são redefinidos a cada 30 dias; os créditos comprados duram 12 meses. E uma chamada de modelo roteada pela sua própria chave ou endpoint não usa crédito de IA algum — mas o Auto, os agentes na nuvem e, no Business, uma cobrança de plataforma por hora ainda consomem créditos.

Esta página trata dessa contabilidade: o que cada categoria mede, quanto custa um crédito por canal e exatamente qual uso sua própria inferência elimina. Para Warp como produto em comparação com o Claude Code — licenciamento, protocolos e onde o harness do agente é executado — consulte Warp vs Claude Code. Tudo abaixo foi consultado na página de preços e na documentação da Warp em 1º de outubro de 2026; ninguém aqui tem uma assinatura da Warp, portanto nenhum valor é uma cobrança medida.

Qual Warp é este

Aqui, Warp é o terminal agentivo de warp.dev — o aplicativo para desktop e o Warp Agent CLI. Não é o WARP da Cloudflare, o cliente VPN 1.1.1.1 com seu próprio plano pago, nem o framework web Rust chamado warp. Nenhum dos preços abaixo se aplica a qualquer um deles.

Os planos e o que cada um inclui

PlanoMensalCobrado anualmenteCréditos incluídosSua própria inferência
Gratuita$0$0Nenhum para o Warp AgentSuas próprias chaves de API, SuperGrok ou um endpoint personalizado — para indivíduos e organizações com 10 funcionários ou menos
Build$20US$ 18 por mês1.500 por mês — o cartão diz “US$ 20 de uso de agente incluído às tarifas de API”Igual ao Free
Max$200US$ 180 por mês18.000 por mês — avaliados pela Warp em US$ 240Igual ao Free
BusinessUS$ 50 por assentoUS$ 45 por assento1.500 por assento; até 25 assentosDesbloqueado para organizações com mais de 10 funcionários
EnterprisePersonalizadoPersonalizadoPools compartilhados personalizadosAdiciona BYOLLM (inferência na sua própria nuvem) e chaves e endpoints gerenciados pela equipe

“Pague conforme usar, a partir de” é a própria formulação da Warp em todos os cartões pagos: a assinatura é um piso, e tudo além dos créditos incluídos é comprado como créditos de recarga.

Três categorias, um saldo

A documentação da Warp mede o trabalho do agente em três tipos de crédito que usam o mesmo saldo — primeiro os créditos do plano, depois os créditos de recarga.

CategoriaO que pagaQuando é consumido
Créditos de IAA chamada ao modeloQuando a Warp paga ao provedor — modelos gerenciados pela Warp e sempre para o Auto
Créditos de computaçãoO sandbox em que um agente é executadoAs execuções de agentes na nuvem rodam em workers hospedados pela Warp; as execuções locais usam sua máquina e não consomem nada
Créditos de plataformaCiclo de vida da execução, integrações, painel, APIs e observabilidade — cobrados por hora de agenteToda execução de agente na nuvem em qualquer plano, e execuções locais no Business ou Enterprise que usam sua própria chave, endpoint ou BYOLLM

Dois detalhes determinam as cobranças reais. Os créditos de plataforma acumulam por hora de agente, proporcionalmente às horas parciais, e, para o Warp Agent, somente enquanto ele está gerando — mas, para Claude Code e Codex executados como harnesses na nuvem, a execução inteira conta, incluindo o tempo aguardando o provedor do modelo. E a tarifa por hora não está publicada onde a documentação indica: a página de créditos de plataforma diz para consultar a página de preços quanto às tarifas atuais, e em 1º de outubro de 2026 a página de preços não informava nenhuma.

Quanto custa um crédito, por canal

Como você obtém o créditoCréditosPreçoPor crédito
Plano Build1,500$20$0.0133
Plano Max18,000$200$0.0111
Pacote de recarga, plano pago400$10$0.0250
Pacote de recarga, plano pago1,000$20$0.0200
Pacote de recarga, plano pago3,000$50$0.0167
Pacote de recarga, plano pago6,500$100$0.0154
Pacote de recarga, plano Free40020% acima da tarifa do plano pago, segundo a Warpcerca de US$ 0.030

A coluna por crédito é a divisão dos preços de tabela da Warp, e a linha do plano Free aplica os 20% declarados pela Warp à tarifa paga, em vez de citar um preço publicado. A própria dica da Warp chama o Max de “cerca de 17% mais barato por crédito do que comprar créditos de recarga”; a divisão simples em comparação com o melhor nível de recarga produz uma diferença maior, portanto trate 17% como a forma de apresentação da Warp, não como um valor calculado por esta página. O que nenhuma dessas linhas informa é quantos créditos seu trabalho consome: a Warp diz que dois prompts semelhantes podem usar quantidades diferentes, que modelos maiores, mais chamadas de ferramentas e mais contexto aumentam o consumo e que não existe uma fórmula.

Redefinição, transferência e o pool da equipe

  • Os créditos do plano são redefinidos a cada 30 dias a partir da data da sua assinatura ou renovação — não no mês do calendário — e não são transferidos.
  • Os créditos de recarga são transferidos e permanecem válidos por 12 meses a partir da compra, inclusive após um downgrade para o Free. Eles só são reembolsáveis se nenhum tiver sido usado.
  • Em uma equipe, os créditos de recarga formam um pool compartilhado. Qualquer membro pode comprá-los; cada membro usa primeiro seus próprios créditos do plano e depois o pool compartilhado — portanto, um usuário intenso pode gastar créditos comprados por outra pessoa. Os saldos restantes nos pools pessoais do período de maio a agosto de 2026 só são usados depois que o pool compartilhado se esgota.
  • A recarga automática vem desativada por padrão para novos assinantes; quando ativada, compra o pacote escolhido sempre que o saldo cai abaixo de 100 créditos, sob um limite mensal de gastos que começa em US$ 200 e é redefinido no mês do calendário, não no ciclo de cobrança.
  • Esgotar os créditos em um plano pago sem recarga desativa os modelos premium até a próxima redefinição; a Warp também documenta um limite de tokens separado, informado como QuotaLimit, que pode interromper todos os modelos mesmo quando ainda há créditos.

Quando sua própria inferência substitui créditos — e quando não substitui

A Warp documenta três formas de trazer seu próprio acesso a modelos: uma chave de API para OpenAI, Anthropic ou Google (BYOK), uma assinatura SuperGrok ou X Premium para Grok e um endpoint de inferência personalizado — qualquer serviço que implemente o OpenAI Chat Completions. Para solicitações encaminhadas por qualquer um deles, a Warp não consome créditos de IA e o provedor cobra diretamente de você. As exceções são o que torna um orçamento honesto:

  • O Auto sempre usa créditos da Warp. Para usar seu endpoint, você precisa escolher no seletor o modelo roteado pelo endpoint; os roteadores personalizados também não podem resolver para um modelo desse tipo.
  • Os agentes na nuvem sempre usam créditos da Warp. Um endpoint personalizado de autoatendimento é armazenado no seu dispositivo e nunca chega às execuções na nuvem; no Enterprise, administradores podem configurar endpoints gerenciados pela equipe que chegam a elas.
  • Business e Enterprise pagam créditos de plataforma em execuções locais de agentes que usam sua própria chave ou endpoint. No Free, Build e Max, execuções locais com sua própria inferência não usam nenhum crédito.
  • A linha de 10 funcionários. BYOK e endpoints personalizados de autoatendimento são destinados a indivíduos e organizações com 10 funcionários ou menos, segundo os termos da Warp; acima disso, Business ou Enterprise é obrigatório.
  • O aplicativo, não o CLI. A FAQ de preços da Warp diz que endpoints de inferência personalizados estão disponíveis apenas no aplicativo Warp; o Warp Agent CLI aceita chaves de API e SuperGrok por meio de /api-keys.
  • Uma URL pública, por meio dos servidores da Warp. O harness do agente roda no backend da Warp e chama seu endpoint de lá, portanto localhost e endereços privados são rejeitados, e a Warp afirma que não pode impor Zero Data Retention para esse tráfego.

Três orçamentos, na prática

Estes são ilustrativos, não medidos. O lado dos tokens pressupõe um mês de trabalho de um desenvolvedor com 20M tokens de entrada não armazenados em cache e 0.8M tokens de saída por meio de um endpoint personalizado, às tarifas vigentes do catálogo da Kunavo por milhão de tokens; exclui descontos de cache, novas tentativas e qualquer coisa que ainda rode com créditos da Warp.

Modelo por meio do endpointEntrada / saída por 1MMês de tokens presumido
Claude Haiku 4.5$0.70 / $3.50$16.80
GPT-5.6 Terra$0.70 / $4.20$17.36
Claude Sonnet 5$1.40 / $7.00$33.60
  • Um desenvolvedor solo no Free com um endpoint. A Warp cobra US$ 0; a cobrança do modelo é do endpoint. O Auto e qualquer execução de agente na nuvem precisam de créditos, o que no Free significa recarga à tarifa mais alta.
  • O mesmo desenvolvedor no Build. US$ 20 por mês compram 1.500 créditos para Auto, execuções na nuvem e modelos que você não encaminha pelo endpoint; a cobrança do endpoint não muda. O Build vale a pena pelo que os créditos e o plano acrescentam, não pelo endpoint, que o Free já permite.
  • Uma empresa com 12 pessoas. Acima da linha de 10 funcionários, a própria inferência exige Business: US$ 50 por assento, mais créditos de plataforma para cada hora de agente local que usa o endpoint, a uma tarifa que a Warp não publica na página de preços — pergunte antes de comprometer uma equipe com isso.

Configurando o endpoint, se você escolher esse caminho

A documentação de endpoints personalizados da Warp fornece as etapas: abra Settings, pesquise por inference endpoint, adicione a URL base que expõe /v1/chat/completions e uma chave, liste os identificadores dos modelos e salve. O próprio exemplo de modelo local usa uma URL terminada em /v1.

Endpoint de inferência personalizado do Warp — campos da documentação do Warp, não testados aqui
Warp app  →  Settings  →  search "inference endpoint"

Endpoint URL   https://api.kunavo.com/v1     (the base that exposes /v1/chat/completions)
API key        sk-kn-...                     (stored in your OS keychain, sent per request)
Model IDs      claude-sonnet-5, claude-haiku-4-5  (one per model you want in the picker)

Then pick the endpoint-routed model in the model picker — not Auto.

O endpoint da Kunavo é público e compatível com OpenAI, que é o que a Warp solicita — mas isso é uma correspondência entre dois conjuntos de documentação. Ninguém na Kunavo executou a Warp contra ele, portanto envie uma tarefa limitada, confirme que ela transmite os dados e que uma chamada de ferramenta retorna, e compare o indicador de créditos da Warp (que deve mostrar zero créditos de IA nessa rodada) com a cobrança no seu registro de uso da Kunavo. A Kunavo cobra por token a partir de um saldo pré-pago, com recarga mínima de US$ 10 e sem assinatura — consulte cobrança.

Medindo seus próprios créditos por tarefa

Como a Warp não publica uma proporção entre créditos e tokens, o único número confiável é o seu. No aplicativo, passe o cursor sobre o indicador de créditos abaixo de uma resposta do agente para ver os créditos daquela rodada; no Warp Agent CLI, /cost mostra os créditos por resposta; Settings > Billing and usage contém o total acumulado, com créditos de plataforma, IA e computação exibidos separadamente. Execute a mesma tarefa pequena uma vez em um modelo gerenciado pela Warp e outra vez por meio do seu endpoint, e você terá a única comparação que nenhuma página de preços pode oferecer.

Leitura relacionada: Warp vs Claude Code para a decisão de produto, API compatível com OpenAI para saber o que um endpoint precisa implementar e o diretório de APIs de agentes de IA para outros agentes que aceitam um endpoint personalizado sem bloqueio por plano.

Perguntas frequentes

Quanto custa a IA do Warp?

O terminal do Warp é gratuito, e sua IA é medida em créditos. Em 1º de outubro de 2026, a página de preços do Warp lista o plano Free a $0, sem uso de agentes incluído; Build a $20 por mês, com 1.500 créditos; Max a $200 por mês, com 18.000 créditos; Business a $50 por assento por mês, com 1.500 créditos por assento para até 25 assentos; e Enterprise em condições personalizadas; o pagamento anual tem desconto de 10%. Créditos adicionais vêm em pacotes Reload, de 400 créditos por $10 a 6.500 por $100 nos planos pagos, e o Warp informa que as tarifas de Reload do plano Free são 20% maiores. Usar sua própria chave de API ou um endpoint de inferência personalizado para um modelo significa que as chamadas desse modelo não consomem créditos de IA do Warp.

O que é um crédito do Warp e a quantos tokens ele equivale?

Um crédito é a unidade de trabalho de agentes do Warp, e o Warp não publica uma conversão para tokens. A documentação informa que o uso de créditos aumenta conforme os tokens processados e geralmente acompanha o preço da API do modelo, mas não há uma fórmula exata e dois prompts semelhantes podem usar quantidades diferentes de créditos. Ele também mede três grupos separados a partir de um único saldo: créditos de IA para a chamada do modelo, créditos de computação para sandboxes hospedados pelo Warp em execuções na nuvem e créditos de plataforma cobrados por hora de agente. Para descobrir sua própria proporção, execute uma tarefa e leia o indicador de créditos abaixo da resposta no aplicativo, ou use /cost na CLI do Warp Agent.

Usar minha própria chave de API ou endpoint torna a IA do Warp gratuita?

Isso elimina os créditos de IA das solicitações que você roteia por ele, mas não todas as outras cobranças. Os modelos Auto do Warp sempre usam créditos do Warp, roteadores personalizados não podem resolver para um modelo roteado por endpoint, as execuções de agentes na nuvem sempre consomem créditos e recursos como o Codebase Context dependem da infraestrutura do Warp. Nos planos Business e Enterprise, as execuções locais de agentes que usam sua própria chave ou endpoint ainda consomem créditos de plataforma, cobrados por hora de agente. Os termos do Warp também limitam BYOK e endpoints personalizados de autoatendimento a indivíduos e organizações com 10 ou menos funcionários; organizações maiores precisam do Business ou Enterprise.

Os créditos não utilizados do Warp são acumulados?

Os créditos do plano não; os créditos Reload, sim. A FAQ de preços do Warp informa que os créditos mensais incluídos são redefinidos a cada 30 dias a partir da data de assinatura ou renovação, e a documentação de créditos adicionais informa que os créditos comprados são acumulados entre ciclos de cobrança e permanecem válidos por 12 meses a partir da compra, inclusive após a mudança para o plano Free. Em uma equipe, os créditos comprados entram em um único saldo compartilhado, usado por todos os membros depois que os créditos de seus próprios planos acabam; assim, um usuário intenso pode gastar créditos comprados por outro membro. Os administradores podem definir um limite mensal de gastos para toda a equipe.

O Warp pode usar um endpoint compatível com OpenAI, como o Kunavo?

O Warp documenta um endpoint de inferência personalizado para qualquer serviço que implemente a API Chat Completions da OpenAI, configurado no aplicativo Warp, em Settings, pesquisando por inference endpoint, com a base URL, uma chave de API e os identificadores dos modelos. O endpoint precisa estar acessível em uma URL pública, porque a solicitação é montada nos servidores do Warp, e o Warp declara que não pode impor Zero Data Retention para esse tráfego. Endpoints personalizados estão disponíveis apenas no aplicativo Warp, não na CLI do Warp Agent. O endpoint do Kunavo é público e compatível com OpenAI, mas ninguém no Kunavo executou o Warp contra ele; portanto, trate a primeira solicitação como um teste seu.

Consultado em 1º de outubro de 2026: warp.dev/pricing (cartões de planos e a FAQ nos dados estruturados) e a documentação da Warp sobre planos e cobrança, créditos, créditos adicionais, créditos de plataforma, endpoint de inferência personalizado e Bring Your Own API Key. Não publicado em nenhum lugar consultado: uma tarifa de créditos de plataforma por hora de agente e qualquer conversão de créditos para tokens. Não testado: a Warp não foi instalada nem assinada, e nenhuma solicitação foi da Warp para a Kunavo. As tarifas de tokens da Kunavo vêm do catálogo vigente; todo valor em dólares na tabela de tokens é uma operação aritmética ilustrativa.