Voltar aos guias
Comparar·12 de setembro de 2026·Atualizado em 30 de setembro de 2026·8 min de leitura

Melhor gateway de LLM (2026) — as quatro categorias e como escolher o certo

Toda lista comparativa nesta busca foi escrita por uma empresa que vende um gateway, e cada uma se coloca em primeiro lugar. A correção mais útil é que essas listas comparam produtos que não são substitutos — "gateway de LLM" designa quatro coisas diferentes. Escolha primeiro a categoria; dentro de uma categoria, a escolha geralmente é fácil.

Última revisão em .

Todo resumo encontrado nesta pesquisa é publicado por uma empresa que vende um gateway, e cada uma se coloca no topo ou perto dele — esta página incluída, portanto trate a ordem abaixo pelo que ela é. A correção mais útil é que essas listas comparam produtos que não são substitutos. “Gateway de LLM” designa pelo menos quatro coisas diferentes: gateways que revendem acesso a modelos e mantêm as credenciais do provedor para você, camadas de controle hospedadas que encaminham solicitações por contas que você mesmo mantém, proxies implantados na sua própria infraestrutura e proxies de borda que adicionam cache e limites diante das suas chaves. Uma tabela de recursos que misture essas categorias vai indicar o formato errado. Escolha primeiro a categoria; dentro de uma categoria, a escolha normalmente é fácil.

Viés declarado: o Kunavo é nosso produto, e compete exatamente em uma das quatro categorias abaixo. Para as outras três, não somos uma opção, e a página informa isso quando aplicável.

As quatro categorias

CategoriaQuem mantém a conta do provedorEscolha quandoExemplos
Gateway de acesso revendadoO gatewayVocê quer uma única cobrança e nenhuma conta de provedorKunavo, OpenRouter, AIMLAPI
Camada de controle hospedada (BYO key)VocêVocê tem contas e quer roteamento, governança e observabilidadePortkey, TrueFoundry, Helicone, Braintrust, orq.ai
Proxy hospedado por vocêVocêO texto dos prompts não pode sair da sua infraestruturaLiteLLM, MLflow AI Gateway
Proxy de bordaVocêVocê quer apenas cache, limites de taxa e análisesCloudflare AI Gateway

A questão divisória é quem mantém as credenciais do provedor. Esse único fato determina pelo que você é cobrado, quem é responsável quando uma chave vaza, se você pode usar tarifas negociadas com provedores e quanto do sistema você opera. Todo o restante — políticas de roteamento, cache, painéis — existe em todas as categorias e diferencia muito menos do que o marketing sugere.

1. Gateways de acesso revendado — sem contas de provedores

O gateway mantém as credenciais do upstream e cobra de você pelo uso, portanto não há nada para cadastrar na Anthropic, no Google ou na OpenAI. Esta é a categoria adequada quando o problema que você quer resolver é aquisição e configuração, e não controle: uma chave, um saldo, um SDK.

Kunavo — uma URL base compatível com OpenAI e uma chave sk-kn- para Claude e GPT, além de modelos de imagem, vídeo e música no mesmo saldo, com a maior parte do catálogo listada abaixo das tarifas oficiais dos provedores. Ele não roteia as chaves dos seus próprios provedores; se BYO-key for um requisito, toda esta categoria é inadequada. Preços · Início rápido

OpenRouter — a opção de amplitude: centenas de modelos de um grande conjunto de provedores em uma única carteira, níveis gratuitos e roteamento com sua própria chave, recurso que falta na maior parte desta categoria. Escolha-o em vez do Kunavo quando a variedade do catálogo importar mais do que o preço unitário. Kunavo versus OpenRouter · o resumo completo do OpenRouter

AIMLAPI — agrega modelos de texto e mídia em uma única chave, com o mesmo formato dos dois anteriores. Kunavo versus AIMLAPI

2. Camadas de controle hospedadas — você mantém as contas

Você mantém as credenciais dos provedores; a plataforma acrescenta roteamento, fallbacks, guardrails, governança de gastos e observabilidade, e você não precisa executá-la. Esta é a categoria para equipes com contratos negociados com provedores, porque essas tarifas valem mais do que qualquer preço que um revendedor possa listar. O Kunavo não é uma opção aqui — mantemos as credenciais do upstream por design, o arranjo oposto.

Portkey é o único que avaliamos (Kunavo versus Portkey); Helicone fica na extremidade de observabilidade da mesma faixa (Kunavo versus Helicone). TrueFoundry, Braintrust e orq.ai ocupam a extremidade empresarial — SLAs, trilhas de auditoria e ferramentas de avaliação. Não avaliamos esses três, portanto eles são colocados na categoria e recebem links, em vez de serem classificados, e cada um deles se coloca em primeiro lugar nesta pesquisa.

3. Proxies hospedados por você — você executa o software

Um proxy de código aberto implantado na sua própria infraestrutura, diante das suas próprias chaves de provedor. LiteLLM é a escolha padrão e MLflow AI Gateway é a alternativa mais próxima. Escolha esta categoria quando o texto dos prompts não puder sair da sua infraestrutura — uma restrição que nenhuma opção hospedada das outras três categorias pode satisfazer, a qualquer preço.

O custo é real e vale ser declarado: um proxy hospedado por você é um pacote na sua build, o que coloca seu CI/CD e seu cluster dentro do raio de impacto. Isso não é hipotético para esta categoria específica — o incidente da cadeia de suprimentos do LiteLLM em março de 2026 é o exemplo detalhado, incluindo o que o LiteLLM mudou depois.

4. Proxies de borda — apenas cache e limites

Cloudflare AI Gateway adiciona cache de respostas, limitação de taxa, novas tentativas e análises na frente das contas de provedores que você já possui, e não revende inferência. Ele se combina com qualquer uma das outras três categorias, em vez de substituir uma delas — equipes frequentemente o executam na frente de um gateway de acesso revendido. Kunavo vs Cloudflare AI Gateway

Como escolher de uma só vez

  • O texto do prompt pode sair da sua infraestrutura? Não → categoria 3 e pare de ler. Sim → continue.
  • Você tem tarifas negociadas com provedores ou gastos contratados? Sim → categoria 2, então continue usando-os. Não → continue.
  • Você quer manter contas de provedores? Não → categoria 1. Sim → categoria 2.
  • Você precisa de imagem, vídeo ou música na mesma chave? Esse critério restringe o campo mais rapidamente do que qualquer outro — verifique-o antes de comparar qualquer outra coisa.
  • Adicione a categoria 4 sobre o que quer que você tenha escolhido se cache ou limites de taxa na borda forem um requisito real; ela não é uma alternativa às demais.

O que todas essas listas deixam de fora

Duas coisas, de forma consistente. A primeira é o que acontece quando o provedor upstream falha: todo gateway anuncia failover, mas poucos publicam o que realmente fazem — a cadeia de roteamento, o tempo limite, se uma solicitação com falha é cobrada. O que um gateway deve fazer por você é o conjunto de recursos que vale a pena investigar, e a resposta deve ser específica.

A segunda é o custo de migração. Todo produto das categorias 1, 2 e 4 fala o protocolo de comunicação da OpenAI, então mudar é uma base_url e troca de chave — o que significa que o aprisionamento é baixo e a decisão é muito menos consequente do que uma tabela comparativa de nove itens sugere. O guia da API compatível com OpenAI contém os detalhes no nível do protocolo.

Perguntas frequentes

Qual é o melhor gateway de LLM?

Não existe uma única melhor opção, porque “gateway de LLM” dá nome a quatro produtos que não são substitutos. Se você não quer contas de provedores, um gateway de acesso revendado, como Kunavo ou OpenRouter, é a categoria certa. Se já possui contas de provedores e quer roteamento e governança sobre elas, a categoria é uma camada de controle hospedada, como Portkey ou TrueFoundry. Se quer executar o software por conta própria, use LiteLLM ou MLflow AI Gateway. Se quer apenas cache, limites de taxa e análises diante das suas próprias chaves, use Cloudflare AI Gateway. Escolha a categoria antes de comparar tabelas de recursos.

O que é um gateway de LLM?

Um gateway de LLM é um endpoint único que fica entre sua aplicação e um ou mais provedores de modelos, para que seu código use uma API e uma chave, em vez de uma por provedor. Além dessa definição compartilhada, os produtos divergem bastante: alguns revendem acesso a modelos e mantêm as credenciais do provedor para você, outros encaminham solicitações por contas de provedores que você mesmo mantém, e outros são bibliotecas que você implanta na sua própria infraestrutura.

Qual é a diferença entre um gateway de LLM e um roteador de LLM?

Na prática, os termos são usados de forma intercambiável, e a maioria dos produtos divulgados como roteadores são gateways com recursos de roteamento. Quando se faz uma distinção, “roteador” enfatiza a escolha entre modelos ou provedores por solicitação — por custo, latência ou disponibilidade — enquanto “gateway” enfatiza ser o ponto de entrada único que também cuida de autenticação, limites de gastos, registros e failover. As decisões de compra raramente dependem do rótulo.

Preciso de um gateway de LLM se uso apenas um provedor?

Geralmente não para roteamento, que é o recurso que justifica a maioria dos gateways. Um provedor e uma chave significam que não há nada entre o que rotear. Os motivos que ainda se aplicam com um único provedor são limites de gastos, registros de solicitações, distribuição de chaves para uma equipe e failover para um segundo provedor no dia em que o primeiro sofrer uma interrupção — e o último desses motivos é um argumento para ter mais de um provedor, o que traz o roteamento de volta.

Um gateway de LLM de código aberto é melhor que um hospedado?

Eles respondem a restrições diferentes, em vez de se classificarem entre si. Código aberto e hospedagem própria significam que o texto dos prompts nunca sai da sua infraestrutura e que você pode ler e modificar o código, ao custo de executar e corrigir um serviço — um proxy hospedado por você é um pacote na sua build, o que coloca seu CI/CD e seu cluster no raio de impacto. Um gateway hospedado elimina essa superfície operacional e acrescenta uma exposição diferente: sua chave e o texto dos prompts passam por um terceiro. Dados regulados geralmente levam a decisão para a hospedagem própria.

Qual gateway de LLM é mais barato?

O arranjo mais barato depende de qual metade da conta você está perguntando. Ferramentas BYO-key (LiteLLM, Portkey, Helicone, Cloudflare) acrescentam pouco ou nada ao custo de inferência, porque você continua pagando as tarifas do seu próprio provedor — o gateway cobra pela camada de controle, não pelos tokens. Gateways de acesso revendido definem seus próprios preços unitários: o Kunavo lista a maioria dos modelos abaixo das tarifas oficiais dos provedores — Claude Sonnet 4.6 a $2.10 / $10.50 por 1M de tokens, em comparação com $3.00 / $15.00 da Anthropic. Se você tem contratos negociados com provedores, BYO-key quase sempre vence; se hoje paga preços públicos de tabela, um revendedor que oferece preços abaixo da tabela pode ser mais barato do que sua própria conta.

Quais gateways de LLM oferecem suporte a modelos de imagem, vídeo e áudio?

A cobertura varia por fornecedor e muda com frequência, portanto confira os modelos específicos de que precisa em cada catálogo, em vez de confiar em um rótulo de categoria. O Kunavo oferece modelos de imagem, vídeo e música usando a mesma chave e o mesmo saldo do chat, e a documentação do OpenRouter descreve endpoints de imagem, vídeo e fala além do chat. Se multimodalidade em uma única chave for um requisito, verificá-la primeiro restringe o campo mais rapidamente do que qualquer outro critério.