Novo — Gemini 3, Claude Opus 4.7, Veo 3 já no ar

Modelos de fronteira,
30–70 % abaixo do preço oficial.

Os modelos de fronteira da OpenAI, Anthropic e Google — Claude, Gemini, GPT-Image, Veo — todos com 30–70 % de desconto sobre o preço oficial, atrás de uma única API compatível com OpenAI. Mude uma linha de base_url e está em produção.

Setup em 5 segundos · Sem cartão · Sem mínimo
Cole no seu AI agent
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model.

base_url:  https://api.kunavo.com/v1
auth:      Authorization: Bearer $KUNAVO_API_KEY

To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt

Provedores integrados

OpenAIAnthropicGoogle
30–70 %
Abaixo do preço oficial
3.200+
Devs ativos
240 M+
Chamadas de API/mês
99,95 %
SLA de uptime
<120 ms
Latência P50
39
Modelos disponíveis
Por que Kunavo

O gateway de AI para devs que entregam.

Da camada de routing ao livro contábil de billing, cada camada do Kunavo é desenhada para devs indies e times pequenos que entregam features de AI a usuários reais.

Gateway edge global

Routing Anycast multirregião com terminação TLS na borda. P50 abaixo de 120 ms da América do Norte, UE ou APAC.

Compatível com OpenAI

Substituto drop-in para o SDK da OpenAI. Streaming, function calling, tool use, vision — tudo compatível no nível do protocolo. Sem cliente novo para aprender.

Billing nativo Stripe

Pix, cartões, Apple Pay, Link, ACH, Alipay, WeChat Pay — os métodos que o Stripe oferece em cobranças em USD. Recarga self-service, auto-recharge, faturamento automático.

Modelos de fronteira, 30–70 % mais barato

Cada modelo da OpenAI, Anthropic e Google ao preço de tabela oficial menos 30–70 %. Claude, Gemini, GPT-Image, Veo — texto, imagem, vídeo em uma só fatura.

Preço transparente

Preço por 1 M de tokens publicado para cada modelo. Sem multiplicadores ocultos, sem surpresas, requests que falham não são cobradas.

99,95 % SLA

Failover multi-provedor em menos de 50 ms. Quando um upstream cambaleia, sua request é redirecionada antes de você perceber.

Streaming de primeira classe

Implementação nativa SSE passthrough. Time-to-first-token igual ao upstream — sem buffering, sem batching, sem latência adicionada.

Uso granular

Analytics call-by-call por modelo, chave, IP. Webhooks de eventos de uso. Exporte tudo em CSV quando quiser.

Prompt caching, até 90 % mais barato

Leituras de cache da Anthropic são cobradas a 10 % da taxa de input — passe cache_control no seu system prompt e contextos longos viram re-leituras quase grátis. Hit rate e economia em tempo real no dashboard.

Catálogo de modelos

Modelos de fronteira, 30–70 % abaixo do oficial.

Ver catálogo completo
Anthropic

Claude Fable 5.1

30%+ OFFnew

Anthropic's most capable model — frontier reasoning, long-horizon agents, 1M context.

visionfunctionstreamingthinking
$7.00/$35.00
$10 / $50per 1M tokens
Anthropic

Claude Fable 5

30%+ OFF

Frontier reasoning and long-horizon agents at 1M context — the model Fable 5.1 succeeds.

visionfunctionstreamingthinking
$7.00/$35.00
$10 / $50per 1M tokens
Anthropic

Claude Opus 5

60%+ OFFnew

Near-flagship Opus reasoning at half the price of Fable 5 — vision, agentic coding, 200K context.

visionfunctionstreamingthinking
$2.00/$10.00
$5 / $25per 1M tokens
Anthropic

Claude Opus 5 Fast

30%+ OFFnew

Opus 5 tuned for latency — same frontier reasoning, faster output, 200K context.

visionfunctionstreamingthinking
$7.00/$35.00
$10 / $50per 1M tokens
Anthropic

Claude Opus 4.8

50%+ OFFnew

Anthropic Opus 4.8 — stronger agentic coding and honesty, 1M context.

visionfunctionstreamingthinking
$2.50/$12.50
$5 / $25per 1M tokens
Anthropic

Claude Opus 4.7

60%+ OFF

Anthropic Opus 4.7 — flagship reasoning, vision, 200K context.

visionfunctionstreamingthinking
$2.00/$10.00
$5 / $25per 1M tokens
Anthropic

Claude Opus 4.6

60%+ OFF

Anthropic Opus 4.6 — deep reasoning, exceptional agentic ability.

visionfunctionstreamingthinking
$2.00/$10.00
$5 / $25per 1M tokens
Anthropic

Claude Sonnet 5

new

Near-Opus coding and agentic quality at Sonnet cost — 1M context.

visionfunctionstreamingthinking
$2.00/$10.00
$2 / $10per 1M tokens
Anthropic

Claude Sonnet 4.6

60%+ OFFhot

Balanced speed/quality — the everyday production workhorse, elite coding.

visionfunctionstreamingthinking
$1.20/$6.00
$3 / $15per 1M tokens
Anthropic

Claude Haiku 4.5

60%+ OFF

Anthropic Haiku 4.5 — fast and cost-efficient.

visionfunctionstreaming
$0.40/$2.00
$1 / $5per 1M tokens
Google

Gemini 3.7 Flash

65%+ OFFnew

Google's newest Flash — stronger coding and agentic execution at half the 3.6 official rate, 1M context.

visionfunctionstreamingthinking
$0.525/$2.625
$1.5 / $7.5per 1M tokens
Google

Gemini 3.6 Flash

30%+ OFF

Gemini 3.6 Flash — thinking-by-default at Flash latency, 1M context, native audio input.

visionfunctionstreamingthinking
$1.05/$5.25
$1.5 / $7.5per 1M tokens
Google

Gemini 3.1 Pro

65%+ OFF

Gemini 3.1 Pro — Google's flagship for coding, agents, and cross-modal analysis.

visionfunctionstreamingthinking
$0.70/$4.20
$2 / $12per 1M tokens
Google

Gemini 2.5 Flash

70%+ OFF

Previous-gen Gemini Flash — extreme value.

visionfunctionstreaming
$0.09/$0.75
$0.3 / $2.5per 1M tokens
OpenAI

GPT-5.6 Sol

60%+ OFFnew

OpenAI's newest flagship — top-tier reasoning and agentic coding, 1.05M context.

functionstreamingthinkinglong-context
$2.00/$12.00
$5 / $30per 1M tokens
OpenAI

GPT-5.6 Terra

65%+ OFFnew

GPT-5.6 mid tier — the everyday workhorse of the 5.6 family, 1.05M context.

functionstreamingthinkinglong-context
$0.70/$4.20
$2 / $12per 1M tokens
OpenAI

GPT-5.6 Luna

65%+ OFFnew

GPT-5.6 fast tier — high-volume, low-latency execution at mini-class cost.

functionstreaminglong-context
$0.07/$0.42
$0.2 / $1.2per 1M tokens
OpenAI

GPT-5.4

60%+ OFFnew

OpenAI GPT-5.4 — strong general reasoning, 1M context.

functionstreamingthinkinglong-context
$1.00/$6.00
$2.5 / $15per 1M tokens
OpenAI

GPT-5.5

60%+ OFFnew

OpenAI GPT-5.5 — flagship reasoning, 1M context.

functionstreamingthinkinglong-context
$2.00/$12.00
$5 / $30per 1M tokens
OpenAI

GPT-5.4 Mini

70%+ OFF

OpenAI GPT-5.4 Mini — fast, cost-efficient reasoning.

functionstreamingthinking
$0.225/$1.35
$0.75 / $4.5per 1M tokens
OpenAI

GPT-5.3 Codex

60%+ OFF

OpenAI GPT-5.3 Codex — coding-specialized.

functionstreamingthinkinglong-context
$0.70/$5.60
$1.75 / $14per 1M tokens
OpenAI

GPT-5.5 Pro

60%+ OFFnew

OpenAI GPT-5.5 Pro — deep-horizon enterprise reasoning, 1.1M context.

functionstreamingthinkinglong-context
$12.00/$72.00
$30 / $180per 1M tokens
Para AI agents

Aponte seu agente para llms.txt
e ele se vira sozinho.

Dê ao Claude Code, Cursor, Cline — ou qualquer agente compatível com OpenAI — uma única instrução. Ele carregará o catálogo ao vivo do Kunavo e operará modelos de texto, imagem e vídeo autonomamente. Sem SDK, sem glue code.

  • Compatível com o protocolo OpenAI — agentes não precisam de integração custom
  • GET /v1/models é o catálogo ao vivo — nunca hardcode nomes de modelo
  • Uma chave, todas as modalidades: texto, imagem, vídeo, áudio
Cole no seu AI agent
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model.

base_url:  https://api.kunavo.com/v1
auth:      Authorization: Bearer $KUNAVO_API_KEY

To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt
Recarregue e economize

Quanto mais você recarrega adiantado, mais economiza.

Carteira pré-paga. A partir de $10. Sem assinatura, sem mínimo, saldo nunca expira.

Starter

Primeiros testes

$10
  • Acesso a todos os modelos
  • Analytics call-by-call
  • Suporte por comunidade e e-mail
  • Sem mínimo, sem cartão
Cadastro grátis
Most popular

Builder

Limitado · +$10

Você está construindo um produto

$100
  • $110 de crédito ao recarregar $100
  • 10 chaves de API separadas
  • Auto-recharge · Allowlist de IP
  • Suporte por e-mail prioritário
Recarregar $100

Scale

Limitado · +$250

Tráfego em produção

$1000
  • $1.250 de crédito ao recarregar $1.000
  • Chaves de API ilimitadas
  • Webhooks · Faturas mensais
  • Suporte dedicado Slack/Discord
Recarregar $1000

Enterprise

Limitado · +$2000

Grande escala

$5000
  • $7.000 de crédito ao recarregar $5.000
  • Tudo do Scale + mais
  • Rate limits e SLA customizados
  • Account manager dedicado
Recarregar $5000
Guides

Start with the popular guides.

Browse all guides
FAQ

Tudo que você
se pergunta.

Não encontrou resposta? Escreva para contact@kunavo.com — respondemos em 24 horas.

  • O Kunavo foi feito especificamente para devs indies e times pequenos que entregam features de AI em produção. Três diferenças reais: (1) cobrimos texto, imagem e vídeo em uma única fatura — muitos agregadores são só texto; (2) checkout nativo Stripe, ACH, Alipay, Apple Pay, WeChat Pay tudo incluso — sem faturas fora da plataforma; (3) transparência total no routing — nunca trocamos silenciosamente seu modelo por um mais barato.

  • Cada modelo está cerca de 30–70 % abaixo do preço oficial do provedor — e recargas maiores liberam bônus adicional. Você também economiza operacionalmente: um contrato, uma fatura, um SDK, sem mínimo de compromisso. O preço por 1 M de tokens de cada modelo está publicado em /pricing — comparável com o listing upstream a qualquer momento.

  • Sim. Implementamos o conjunto completo de endpoints da OpenAI: /v1/chat/completions, /v1/embeddings, /v1/images/generations, /v1/models e /v1/video/generations. Streaming, function calling, vision e tool use se comportam identicamente. Projetos que usam o SDK da OpenAI migram trocando base_url — é só isso.

  • Não. O Kunavo é uma carteira pré-paga. Recargas permanecem na sua conta para sempre — sem assinatura, sem mínimo mensal, sem expiração. Fechamento de conta reembolsa o saldo restante no método de pagamento original.

  • Nunca. Respostas 4xx e 5xx não são cobradas. Respostas em streaming que desconectam no meio são cobradas apenas pelos tokens efetivamente entregues. Cada cobrança é visível call-by-call no dashboard de uso e exportável em CSV para contabilidade.

  • Pix (valor exibido em reais, compensação imediata — não exige cartão de crédito internacional), cartões (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay, Link, Cash App Pay, Klarna, Amazon Pay, transferência ACH, Alipay e WeChat Pay. O Stripe converte o preço em USD para reais no checkout, então o Pix aparece com o valor já em BRL. Débito SEPA, BACS e BECS não estão entre os métodos que aceitamos. A auto-recarga é opt-in. Clientes Enterprise podem pagar por fatura com prazos Net 30.

  • Nós edge gateway rodam em América do Norte, Europa e Ásia-Pacífico. Lógica de routing stateless roda na borda, com latência P50 abaixo de 120 ms. Dados de billing, contas e logs de auditoria ficam em uma região primária com replicação multi-região.

Três minutos até sua primeira chamada.

Uma única API compatível com OpenAI para Claude, Gemini, GPT-Image, Veo e Suno — recarga mínima de $10, você paga só pelo que chamar.