Modelos de fronteira,
até 70 % abaixo do preço oficial.
Os modelos de fronteira da OpenAI, da Anthropic e da Google — Claude, GPT, Nano Banana, Veo —, na maioria abaixo do preço oficial do fornecedor e até 70 % mais baratos consoante o modelo, através de uma única API compatível com OpenAI. Mude uma linha de base_url e já está em produção.
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model. base_url: https://api.kunavo.com/v1 auth: Authorization: Bearer $KUNAVO_API_KEY To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt
Três formas de começar
Comprar acesso à API
Claude e GPT com uma única chave e um saldo pré-pago. Pague com MB WAY, cartão, Apple Pay ou Google Pay — a partir de US$ 10, sem subscrição.
USD por 1 milhão de tokens, entrada / saída · escolha um para criar conta já com ele
Migrar de outro fornecedor
O código com um SDK da OpenAI continua a funcionar: basta mudar o base_url e a chave. Quem vem do OpenRouter vê os IDs de modelo perderem o prefixo vendor/ — a comparação mostra o que transita e o que não transita.
# base_url - https://api.openai.com/v1 + https://api.kunavo.com/v1
Ligue a sua aplicação
Páginas de configuração para agentes de programação, aplicações de chat e ferramentas de automação, cada uma verificada com a documentação oficial do cliente e datada.
Fornecedores integrados
O gateway de IA para quem constrói e lança produtos.
Da camada de encaminhamento ao registo de saldos, cada parte do Kunavo foi pensada para programadores independentes e pequenas equipas que lançam funcionalidades de IA para clientes reais.
Edge à frente, alojado em US-East
Uma rede edge anycast termina o TLS perto de si; o gateway propriamente dito corre numa única região US-East (Ashburn, Virgínia).
Compatível com OpenAI
Substituto direto dos SDK da OpenAI. Streaming, function calling, tool use, visão — tudo compatível ao nível do protocolo. Nenhum cliente novo para aprender.
Pagamentos nativos Stripe
Cartões, Apple Pay, Google Pay, Link, Alipay, WeChat Pay — e o método local que a Stripe mostra com a sua moeda, como MB WAY em Portugal ou iDEAL nos Países Baixos. Carregamentos em self-service, carregamento automático opcional, sem subscrição.
Modelos de fronteira, até 70 % mais baratos
Modelos da OpenAI, da Anthropic e da Google, na maioria abaixo do preço de tabela oficial — até 70 % mais baratos consoante o modelo. Claude, GPT, Nano Banana, Veo — texto, imagem e vídeo com um só saldo.
Preços transparentes
O preço por 1 M de tokens de cada modelo está publicado. Sem multiplicadores escondidos, sem surpresas na conta. Os pedidos que falham nunca são cobrados.
Failover automático
Cada pedido pode passar em cascata por até três canais upstream. Um canal que tem estado a falhar é contornado antes de o seu pedido sair — sem retries do lado do cliente.
Streaming de primeira linha
Passagem SSE nativa. O time-to-first-token é igual ao do fornecedor upstream — sem buffering, sem batching, sem atraso acrescentado.
Dados de utilização detalhados
Análise chamada a chamada por modelo, chave e IP. Webhooks quando uma tarefa de imagem, vídeo ou música termina. Exporte tudo em CSV quando precisar.
Prompt caching, até 90 % mais barato
As leituras de cache no Claude e no GPT são cobradas a 10 % do preço de entrada, a 5 % no Claude Opus 5.5 e a 2,5 % no Claude Fable 5.1 — passe cache_control no system prompt e os contextos longos passam a ser releituras quase gratuitas. A taxa de acerto e a poupança aparecem em tempo real no painel.
What to build with Kunavo.
- Customer Support
AI customer support
The fastest-ROI AI deployment in any B2C SaaS — automate ticket triage, draft 80% of responses, and escalate the rest cleanly. Production code, real cost numbers, and the compliance pitfalls that catch teams off-guard.
Explore - Knowledge Base
RAG chatbot API
Most internal knowledge bases are dead documentation — nobody finds anything. A Claude-backed RAG chatbot turns them into a real assistant that cites sources and refuses when it doesn't know. Here's the production pattern.
Explore - Trust & Safety
AI content moderation
Modern moderation isn't just regex — it's nuance: sarcasm, dog whistles, brand-context misuse, image+text combinations. LLMs do this far better than rule-based systems, at a price that scales.
Explore - Developer Tools
AI code assistant
Cursor, Aider, Cline, Continue.dev — they're all powered by the same handful of frontier LLMs. If you're building a coding tool (or a co-pilot inside your own dev product), here's the architecture and the cost reality.
Explore - Data Processing
AI data extraction
The boring, valuable use case. Invoices, receipts, contracts, leads, resumes — anywhere you'd previously have built a parser, an LLM held to a JSON schema does it in 30 lines, more accurately, and you can ship in a day instead of a quarter.
Explore
Modelos de fronteira, até 70 % abaixo do oficial.
Claude Fable 5.1
Anthropic's most capable model — frontier reasoning and long-horizon agentic work.
Claude Fable 5
Frontier reasoning and long-horizon agents — the model Fable 5.1 succeeds.
Claude Opus 5.5
Anthropic's newest Opus — long-running agentic coding and knowledge work, for less than Opus 5.
Claude Opus 5
Near-flagship Opus reasoning at half the price of Fable 5 — vision and agentic coding.
Claude Opus 4.8
Anthropic Opus 4.8 — stronger agentic coding and honesty.
Claude Opus 4.7
Anthropic Opus 4.7 — previous-generation Opus; reasoning and vision.
Claude Opus 4.6
Anthropic Opus 4.6 — deep reasoning, exceptional agentic ability.
Claude Sonnet 5
Near-Opus coding and agentic quality at Sonnet cost.
Claude Sonnet 4.6
Balanced speed/quality — the everyday production workhorse, elite coding.
Claude Haiku 4.5
Anthropic Haiku 4.5 — fast and cost-efficient.
GPT-6 Astra
OpenAI's newest flagship — frontier reasoning and long-horizon agentic coding.
GPT-6 Sol
GPT-6 for complex coding and agentic workflows — at a fifth of GPT-6 Astra's price.
GPT-6 Luna
OpenAI's most efficient GPT-6 — focused, high-volume tasks.
GPT-5.6 Sol
OpenAI's newest flagship — top-tier reasoning and agentic coding.
GPT-5.6 Terra
GPT-5.6 mid tier — the everyday workhorse of the 5.6 family.
GPT-5.5
OpenAI GPT-5.5 — flagship reasoning and agentic tool use.
Aponte o seu agente para llms.txt
e ele trata do resto sozinho.
Dê uma única instrução ao Claude Code, ao Cursor, ao Cline — ou a qualquer agente compatível com OpenAI. Ele lê o catálogo ao vivo do Kunavo e utiliza modelos de texto, imagem e vídeo por conta própria. Sem SDK, sem código de ligação.
- Compatível com o protocolo OpenAI — os agentes não precisam de integração à medida
- GET /v1/models é o catálogo ao vivo — nunca escreva nomes de modelo fixos no código
- Uma chave para todas as modalidades: texto, imagem, vídeo, áudio
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model. base_url: https://api.kunavo.com/v1 auth: Authorization: Bearer $KUNAVO_API_KEY To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt
Quanto mais carrega adiantado, mais poupa.
Carteira pré-paga. Começa com US$ 10. Sem subscrição, sem mínimo, e o saldo nunca expira.
Starter
Primeiros testes
- Acesso a todos os modelos e endpoints
- Análise de utilização chamada a chamada
- Suporte por e-mail
- Sem subscrição, sem validade — carregamentos a partir de US$ 10
Builder
Limitado · +US$ 10Está a construir um produto
- US$ 110 de crédito ao carregar US$ 100
- 10 % de bónus, por tempo limitado
- Suporte prioritário por e-mail
- Tudo o que qualquer conta recebe
Scale
Limitado · +US$ 200Tráfego em produção
- US$ 1200 de crédito ao carregar US$ 1000
- 20 % de bónus, por tempo limitado
- Suporte prioritário por e-mail
- Tudo o que qualquer conta recebe
Enterprise
Limitado · +US$ 1250Grande volume
- US$ 6250 de crédito ao carregar US$ 5000
- 25 % de bónus, por tempo limitado
- Suporte prioritário por e-mail
- Tudo o que qualquer conta recebe
Incluído em todas as contas
- Chaves de API ilimitadas
- Limite de gasto mensal por chave
- Lista de IPs permitidos por chave
- Carregamento automático com cartão guardado — qualquer valor em dólares inteiros a partir de US$ 10, opcional
- Webhooks para tarefas de imagem, vídeo e música
- API de utilização e exportação em CSV
- Endpoints compatíveis com OpenAI e com a Anthropic Messages API
Start with the popular guides.
- Setup
Gemini API key
Get a Gemini key in Google AI Studio and call it with the OpenAI SDK.
Read - Setup
Claude API key
Get a Claude key and call Claude via the OpenAI SDK or the native Messages API.
Read - Pricing
Claude API pricing 2026
Per-model rates ~30% under Anthropic, worked cost examples, and prompt-caching savings.
Read - Pricing
Gemini API pricing 2026
Gemini 3.8 / 3.7 Flash and 2.5 rates per 1M tokens, set against Google's intro pricing, with worked examples.
Read - Pricing
GPT API pricing 2026
GPT-6 Astra, Sol and Luna, GPT-5.6 Sol and Terra, and GPT-5.5: rates ~60–65% under OpenAI's list, with worked examples.
Read - Concept
LLM gateway
One API for every model — routing, fallback, billing, observability and security, explained.
Read - API
OpenAI-compatible API
Point any OpenAI SDK at hosted Claude and GPT by changing only base_url.
Read - Tools
LLM cost calculator
Estimate per-request and monthly API cost for Claude, Gemini and GPT — with savings vs list.
Read - Video
Text-to-video API
Generate video from a prompt on an OpenAI-style endpoint — live today on Google Veo 3.1.
Read - Video
Veo 3.1 API
Google Veo 3.1 text-to-video with native audio, ~50–70% under Google's list.
Read - Audio
Suno API
Generate full songs from a prompt via /v1/audio/music — metered per request, no subscription.
Read - Image
Nano Banana API
Google's image models through an OpenAI-compatible endpoint, ~25–50% under Google's list.
Read - Image
GPT-Image-2 API
OpenAI's image model on the OpenAI-compatible images endpoint at about half of list.
Read - Compare
OpenRouter alternative
Kunavo vs OpenRouter — text breadth vs multimodal, pricing, API keys and payments.
Read - Compare
OpenRouter alternatives 2026
Seven honest alternatives by motivation — cheaper, multimodal, BYO-key or open source.
Read - Models
Gemini 3 API
What Gemini 3.8 and 3.7 Flash cost at Google's introductory rate, and how to call them.
Read - Setup
CC Switch setup
Add Kunavo to CC Switch for Claude Code and Codex — which API format to pick, and why.
Read
Set up Kunavo in the tool you already use
All 51 integrationsRecent deep dives.
- 实战·5 min
在中国调用 Claude / GPT API — 直连、付款与重试写法
从国内调用 Kunavo:网关在美东单一区域,时延由你的国际出口决定,附自测命令。支付宝 / 微信支付 / 双币卡都可用。健壮重试代码 + 什么时候真的需要转发。
- 教學·6 min
用 Veo 3 為台灣品牌做短影片廣告(Sora 同端點待上線)— 5 分鐘完整教學
從文字 prompt 到 9:16 直式 Reels / TikTok / IG 短影片,全流程教學。圖生影片用既有產品照片動起來。5 種台灣品牌實際應用、繁中文字渲染注意事項、商業可用品質的進階技巧。
- 実装ガイド·8 min
日本語 RAG チャットボットを Claude で構築 — 5,000 文書のナレッジベースを 30 行で
社内ドキュメント 5,000 件を Claude Sonnet 4.6 で検索可能にする RAG 完全実装。1 クエリ約 0.9 円(prompt caching 適用後)。埋め込みは Kunavo では提供しておらず、その工程のみ OpenAI に直接課金されます。日本語特有のトークン消費・ハルシネーション対策・本番投入チェックリスト含む。
Tudo o que
quer saber.
Não encontrou resposta? Escreva para contact@kunavo.com — respondemos no prazo de 24 horas.
O Kunavo foi feito especificamente para programadores independentes e pequenas equipas que lançam funcionalidades de IA em produção. Três diferenças reais: (1) texto, imagem, vídeo e música com um único saldo; (2) checkout nativo Stripe com cartão, Apple Pay, Google Pay e Link, e MB WAY em Portugal — sem faturas fora da plataforma; (3) total transparência no encaminhamento — nunca trocamos o seu modelo por um mais barato sem avisar.
A maioria dos modelos está abaixo do preço oficial do fornecedor — até 70 % mais barata consoante o modelo. Carregamentos maiores juntam um bónus adicional. Também poupa a nível operacional: uma conta, um saldo, um SDK, sem compromissos mínimos. O preço por 1 M de tokens de cada modelo está publicado em /pricing — pode compará-lo com a lista do fornecedor upstream a qualquer momento.
Sim. Implementamos o conjunto completo de endpoints da OpenAI: /v1/chat/completions, /v1/embeddings, /v1/images/generations, /v1/models e /v1/video/generations. Streaming, function calling, visão e tool use comportam-se de forma idêntica. Os projetos que usam o SDK da OpenAI migram com uma única alteração no base_url — e é tudo.
Não. O Kunavo é uma carteira pré-paga. Os carregamentos ficam na sua conta para sempre — sem subscrições, sem mínimos mensais, sem prazo de validade. Ao encerrar a conta, o saldo restante é reembolsado para o método de pagamento original.
Nunca. As respostas 4xx e 5xx não são cobradas. As respostas em streaming interrompidas a meio são cobradas apenas pelos tokens efetivamente entregues. Cada cobrança é visível chamada a chamada no painel de utilização e pode ser exportada em CSV para a contabilidade.
Em Portugal, o checkout mostra o valor em euros e aceita MB WAY, cartões (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay, Google Pay e Link. Os nossos preços estão em USD; a Stripe converte-os para euros no checkout, e essa conversão inclui uma taxa de 2–4 % paga por quem compra. As referências Multibanco, o PayPal e o débito direto SEPA não estão entre os métodos que aceitamos; um cartão emitido em Portugal funciona normalmente. O Pay by Bank também não aparece a quem paga a partir de Portugal: no checkout do Kunavo, só está disponível para compradores no Reino Unido, na Irlanda e na Finlândia. Noutros países, os métodos locais seguem o país de quem paga — por exemplo Alipay e WeChat Pay na China continental, iDEAL nos Países Baixos, Bancontact na Bélgica, Satispay em Itália, BLIK na Polónia, UPI na Índia e, nos Estados Unidos, Cash App Pay, Klarna (quando o checkout está em dólares), Afterpay, débito bancário ACH, cripto (stablecoins) e, em carregamentos a partir de US$ 100, Affirm e Zip. O carregamento automático é opcional e só funciona com cartão: guarde um cartão uma vez e o saldo volta a ser carregado sozinho no valor que escolher, a partir de US$ 10.
O Kunavo corre numa única região US-East (Ashburn, Virgínia), atrás de um edge anycast que termina o TLS perto de si. As contas, os pagamentos e os dados de utilização ficam numa única base de dados primária, com snapshots diários e encriptados do volume.
Três minutos até à sua primeira chamada.
Uma única API compatível com OpenAI para Claude, GPT, Nano Banana, Veo e Suno — carregamento mínimo de US$ 10, e paga apenas o que chamar.