Claude é o padrão para raciocínio, código e agentes — e a Kunavo oferece todos os modelos Claude cerca de 60% abaixo da tabela da Anthropic, atrás de uma única API compatível com OpenAI. Este guia reúne o que o desenvolvedor brasileiro mais procura sobre preço e pagamento da API do Claude: as tarifas atuais por modelo, como pagar do Brasil (Pix incluído), exemplos de custo que você pode verificar por conta própria e as alavancas que mais reduzem a fatura.
Preços da API do Claude em um relance
Tarifas em USD por 1M de tokens, exatamente como a Kunavo cobra. A coluna “tabela Anthropic” mostra o preço oficial do mesmo modelo para comparação direta.
| Modelo | Input / 1M | Output / 1M | Tabela Anthropic (in / out) | Economia |
|---|---|---|---|---|
claude-haiku-4-5 | $0.40 | $2.00 | $1.00 / $5.00 | ~60% |
claude-sonnet-4-6 | $1.20 | $6.00 | $3.00 / $15.00 | ~60% |
claude-sonnet-5 | $2.10 | $10.50 | $3.00 / $15.00 | ~30% |
claude-opus-4-7 | $2.00 | $10.00 | $5.00 / $25.00 | ~60% |
claude-fable-5 | $7.00 | $35.00 | $10.00 / $50.00 | ~30% |
As tarifas ao vivo estão sempre na página de preços e em cada página de modelo (claude-sonnet-4-6, claude-haiku-4-5, claude-opus-4-7). Haiku é o cavalo de batalha barato, Sonnet é o padrão equilibrado, Opus e Fable ficam para o raciocínio mais pesado.
Como pagar a API do Claude no Brasil — Pix, cartão, Apple Pay
O pagamento é processado pelo Stripe. Não há assinatura nem configuração no console da Anthropic: você recarrega um saldo e cada chamada desconta pelas tarifas por token acima. Para quem paga do Brasil:
- Pix — instantâneo, com o valor exibido em reais no checkout;
- Cartões internacionais: Visa, Mastercard, American Express;
- Apple Pay, Google Pay e Link (pagamento em um clique);
- Clientes enterprise podem pagar por fatura (Net 30).
As tarifas por token são em USD; no Pix a conversão para BRL aparece na hora, no cartão ela segue a taxa do emissor (verifique IOF e tarifa internacional do seu banco). Recarga mínima de $5, pré-paga, e o saldo nunca expira — sem mensalidade e sem surpresa no fim do mês. Se o cartão for recusado, confira se compras internacionais estão liberadas no app do banco — ou pague por Pix, que não depende disso.
Exemplos de custo
Números reais calculados com as tarifas da Kunavo:
| Tarefa | Tokens (in / out) | Modelo | Custo |
|---|---|---|---|
| Resposta de suporte | 800 / 200 | Haiku 4.5 | $0.00072 |
| Resposta RAG | 6.000 / 500 | Sonnet 4.6 | $0.0102 |
| Chamada de assistente de código | 10.000 / 1.500 | Sonnet 4.6 | $0.021 |
| Análise de contexto longo | 50.000 / 2.000 | Opus 4.7 | $0.12 |
Processar 10 mil tickets de suporte por dia no Haiku custa cerca de $7,20/dia. A conta para você mesmo rodar:
# Tarifas Claude na Kunavo (USD por 1M de tokens): (input, output)
RATES = {
"claude-haiku-4-5": (0.40, 2.00),
"claude-sonnet-4-6": (1.20, 6.00),
"claude-opus-4-7": (2.00, 10.00),
}
def custo(model: str, in_tokens: int, out_tokens: int) -> float:
i, o = RATES[model]
return in_tokens / 1_000_000 * i + out_tokens / 1_000_000 * o
print(custo("claude-haiku-4-5", 800, 200)) # um ticket de suporte -> $0.00072
print(custo("claude-sonnet-4-6", 6_000, 500)) # uma resposta RAG -> $0.0102
print(custo("claude-opus-4-7", 50_000, 2_000)) # análise longa -> $0.12Português consome ~10–20% mais tokens que inglês no mesmo conteúdo — vale considerar na hora de orçar.
Prompt caching — a maior economia isolada
Se o seu system prompt ou contexto recuperado é grande e estável, o prompt caching cobra o input em cache a 10% da tarifa de input. Para prompts longos e repetidos, isso corta 60–90% do custo de input — basta um campo a mais na requisição. Veja o guia profundo de prompt caching e a referência da Messages API.
Uma chave para Claude, Gemini, GPT, imagem e vídeo
Uma única chave Kunavo (sk-kunavo-…) chama Claude, Gemini, GPT e os modelos de imagem, vídeo e áudio — tudo em formato compatível com OpenAI, descontado do mesmo saldo Stripe, sem conciliar fatura por fornecedor. O Claude é servido tanto pelo endpoint compatível /v1/chat/completions quanto pela API nativa Anthropic Messages (/v1/messages), então você mantém o SDK que já usa. O passo a passo de emissão da chave está na documentação de autenticação.
Qual modelo Claude escolher?
| Necessidade | Escolha | Kunavo in / out (por 1M) |
|---|---|---|
| O mais barato possível | gemini-2-5-flash | $0.09 / $0.75 |
| Barato + qualidade Anthropic | claude-haiku-4-5 | $0.40 / $2.00 |
| Raciocínio equilibrado | claude-sonnet-4-6 | $1.20 / $6.00 |
| Código e agentes de ponta | claude-sonnet-5 | $2.10 / $10.50 |
| O raciocínio mais difícil | claude-fable-5 | $7.00 / $35.00 |
Os preços do lado Gemini estão no guia de preços da API Gemini; padrões de código para rotear por dificuldade e cortar custo estão no guia de otimização de custos. Para comparar com o OpenRouter, veja Kunavo vs OpenRouter.
Claude no VS Code — Kilo Code, Cline, Roo Code
Se você usa um agente de código como Kilo Code, Cline ou Roo Code, aponte o provedor “OpenAI Compatible” para https://api.kunavo.com/v1 com a sua chave Kunavo e escolha um modelo Claude — três campos e nada mais. Uma sessão de agente típica usa milhares de tokens por passo, então a economia de ~60% aparece rápido. O passo a passo com capturas está no guia Kilo Code + Claude API.
Como reduzir o custo da API do Claude
- Prompt caching primeiro. Input em cache custa 10% da tarifa — é o maior ROI isolado.
- Desça de tier. Mande o trabalho fácil para o Haiku ou o
gemini-2-5-flashe reserve Opus/Fable para a fração difícil. - Limite o output. Defina
max_tokens— output custa ~5x o input. - Enxugue o input. Recupere menos chunks de RAG, mais precisos, em vez da base inteira.
Perguntas frequentes
Como pagar a API do Claude no Brasil?
Pelo Stripe, com Pix (valor em reais), cartões internacionais, Apple Pay e Google Pay. Recarga mínima de $5, pré-paga, saldo sem validade. Para começar, crie a conta grátis e emita a sua chave. O contexto completo de Brasil (latência, LGPD, nota fiscal) está no guia Claude API no Brasil.
Quanto custa a API do Claude?
Sonnet 4.6 custa $1.20 de input / $6.00 de output por 1M de tokens — ~60% abaixo da tabela Anthropic ($3.00 / $15.00). Uma resposta RAG de 6K input / 500 output sai por ~$0,01. Compare tudo na página de preços.
Como reduzir a fatura do Claude?
Aplique nesta ordem: prompt caching (input a 10%), tier menor (Haiku) para tarefas fáceis e max_tokens no output. Isso costuma cortar a fatura pela metade — o detalhe está no guia de otimização.
A Kunavo suporta a Anthropic Messages API?
Sim — o Claude é servido pela Messages API nativa (/v1/messages) e pelo endpoint compatível com OpenAI /v1/chat/completions, então qualquer SDK funciona sem adaptação. Um caso de uso real com Pix e análise de risco está em Claude para fintech no Brasil.