Todo resumo encontrado nesta pesquisa é publicado por uma empresa que vende um gateway, e cada uma se coloca no topo ou perto dele — esta página incluída, portanto trate a ordem abaixo pelo que ela é. A correção mais útil é que essas listas comparam produtos que não são substitutos. “Gateway de LLM” designa pelo menos quatro coisas diferentes: gateways que revendem acesso a modelos e mantêm as credenciais do provedor para você, camadas de controle hospedadas que encaminham solicitações por contas que você mesmo mantém, proxies implantados na sua própria infraestrutura e proxies de borda que adicionam cache e limites diante das suas chaves. Uma tabela de recursos que misture essas categorias vai indicar o formato errado. Escolha primeiro a categoria; dentro de uma categoria, a escolha normalmente é fácil.
Viés declarado: o Kunavo é nosso produto, e compete exatamente em uma das quatro categorias abaixo. Para as outras três, não somos uma opção, e a página informa isso quando aplicável.
As quatro categorias
| Categoria | Quem mantém a conta do provedor | Escolha quando | Exemplos |
|---|---|---|---|
| Gateway de acesso revendado | O gateway | Você quer uma única cobrança e nenhuma conta de provedor | Kunavo, OpenRouter, AIMLAPI |
| Camada de controle hospedada (BYO key) | Você | Você tem contas e quer roteamento, governança e observabilidade | Portkey, TrueFoundry, Helicone, Braintrust, orq.ai |
| Proxy hospedado por você | Você | O texto dos prompts não pode sair da sua infraestrutura | LiteLLM, MLflow AI Gateway |
| Proxy de borda | Você | Você quer apenas cache, limites de taxa e análises | Cloudflare AI Gateway |
A questão divisória é quem mantém as credenciais do provedor. Esse único fato determina pelo que você é cobrado, quem é responsável quando uma chave vaza, se você pode usar tarifas negociadas com provedores e quanto do sistema você opera. Todo o restante — políticas de roteamento, cache, painéis — existe em todas as categorias e diferencia muito menos do que o marketing sugere.
1. Gateways de acesso revendado — sem contas de provedores
O gateway mantém as credenciais do upstream e cobra de você pelo uso, portanto não há nada para cadastrar na Anthropic, no Google ou na OpenAI. Esta é a categoria adequada quando o problema que você quer resolver é aquisição e configuração, e não controle: uma chave, um saldo, um SDK.
Kunavo — uma URL base compatível com OpenAI e uma chave sk-kn- para Claude e GPT, além de modelos de imagem, vídeo e música no mesmo saldo, com a maior parte do catálogo listada abaixo das tarifas oficiais dos provedores. Ele não roteia as chaves dos seus próprios provedores; se BYO-key for um requisito, toda esta categoria é inadequada. Preços · Início rápido
OpenRouter — a opção de amplitude: centenas de modelos de um grande conjunto de provedores em uma única carteira, níveis gratuitos e roteamento com sua própria chave, recurso que falta na maior parte desta categoria. Escolha-o em vez do Kunavo quando a variedade do catálogo importar mais do que o preço unitário. Kunavo versus OpenRouter · o resumo completo do OpenRouter
AIMLAPI — agrega modelos de texto e mídia em uma única chave, com o mesmo formato dos dois anteriores. Kunavo versus AIMLAPI
2. Camadas de controle hospedadas — você mantém as contas
Você mantém as credenciais dos provedores; a plataforma acrescenta roteamento, fallbacks, guardrails, governança de gastos e observabilidade, e você não precisa executá-la. Esta é a categoria para equipes com contratos negociados com provedores, porque essas tarifas valem mais do que qualquer preço que um revendedor possa listar. O Kunavo não é uma opção aqui — mantemos as credenciais do upstream por design, o arranjo oposto.
Portkey é o único que avaliamos (Kunavo versus Portkey); Helicone fica na extremidade de observabilidade da mesma faixa (Kunavo versus Helicone). TrueFoundry, Braintrust e orq.ai ocupam a extremidade empresarial — SLAs, trilhas de auditoria e ferramentas de avaliação. Não avaliamos esses três, portanto eles são colocados na categoria e recebem links, em vez de serem classificados, e cada um deles se coloca em primeiro lugar nesta pesquisa.
3. Proxies hospedados por você — você executa o software
Um proxy de código aberto implantado na sua própria infraestrutura, diante das suas próprias chaves de provedor. LiteLLM é a escolha padrão e MLflow AI Gateway é a alternativa mais próxima. Escolha esta categoria quando o texto dos prompts não puder sair da sua infraestrutura — uma restrição que nenhuma opção hospedada das outras três categorias pode satisfazer, a qualquer preço.
O custo é real e vale ser declarado: um proxy hospedado por você é um pacote na sua build, o que coloca seu CI/CD e seu cluster dentro do raio de impacto. Isso não é hipotético para esta categoria específica — o incidente da cadeia de suprimentos do LiteLLM em março de 2026 é o exemplo detalhado, incluindo o que o LiteLLM mudou depois.
4. Proxies de borda — apenas cache e limites
Cloudflare AI Gateway adiciona cache de respostas, limitação de taxa, novas tentativas e análises na frente das contas de provedores que você já possui, e não revende inferência. Ele se combina com qualquer uma das outras três categorias, em vez de substituir uma delas — equipes frequentemente o executam na frente de um gateway de acesso revendido. Kunavo vs Cloudflare AI Gateway
Como escolher de uma só vez
- O texto do prompt pode sair da sua infraestrutura? Não → categoria 3 e pare de ler. Sim → continue.
- Você tem tarifas negociadas com provedores ou gastos contratados? Sim → categoria 2, então continue usando-os. Não → continue.
- Você quer manter contas de provedores? Não → categoria 1. Sim → categoria 2.
- Você precisa de imagem, vídeo ou música na mesma chave? Esse critério restringe o campo mais rapidamente do que qualquer outro — verifique-o antes de comparar qualquer outra coisa.
- Adicione a categoria 4 sobre o que quer que você tenha escolhido se cache ou limites de taxa na borda forem um requisito real; ela não é uma alternativa às demais.
O que todas essas listas deixam de fora
Duas coisas, de forma consistente. A primeira é o que acontece quando o provedor upstream falha: todo gateway anuncia failover, mas poucos publicam o que realmente fazem — a cadeia de roteamento, o tempo limite, se uma solicitação com falha é cobrada. O que um gateway deve fazer por você é o conjunto de recursos que vale a pena investigar, e a resposta deve ser específica.
A segunda é o custo de migração. Todo produto das categorias 1, 2 e 4 fala o protocolo de comunicação da OpenAI, então mudar é uma base_url e troca de chave — o que significa que o aprisionamento é baixo e a decisão é muito menos consequente do que uma tabela comparativa de nove itens sugere. O guia da API compatível com OpenAI contém os detalhes no nível do protocolo.
Perguntas frequentes
Qual é o melhor gateway de LLM?
Não existe uma única melhor opção, porque “gateway de LLM” dá nome a quatro produtos que não são substitutos. Se você não quer contas de provedores, um gateway de acesso revendado, como Kunavo ou OpenRouter, é a categoria certa. Se já possui contas de provedores e quer roteamento e governança sobre elas, a categoria é uma camada de controle hospedada, como Portkey ou TrueFoundry. Se quer executar o software por conta própria, use LiteLLM ou MLflow AI Gateway. Se quer apenas cache, limites de taxa e análises diante das suas próprias chaves, use Cloudflare AI Gateway. Escolha a categoria antes de comparar tabelas de recursos.
O que é um gateway de LLM?
Um gateway de LLM é um endpoint único que fica entre sua aplicação e um ou mais provedores de modelos, para que seu código use uma API e uma chave, em vez de uma por provedor. Além dessa definição compartilhada, os produtos divergem bastante: alguns revendem acesso a modelos e mantêm as credenciais do provedor para você, outros encaminham solicitações por contas de provedores que você mesmo mantém, e outros são bibliotecas que você implanta na sua própria infraestrutura.
Qual é a diferença entre um gateway de LLM e um roteador de LLM?
Na prática, os termos são usados de forma intercambiável, e a maioria dos produtos divulgados como roteadores são gateways com recursos de roteamento. Quando se faz uma distinção, “roteador” enfatiza a escolha entre modelos ou provedores por solicitação — por custo, latência ou disponibilidade — enquanto “gateway” enfatiza ser o ponto de entrada único que também cuida de autenticação, limites de gastos, registros e failover. As decisões de compra raramente dependem do rótulo.
Preciso de um gateway de LLM se uso apenas um provedor?
Geralmente não para roteamento, que é o recurso que justifica a maioria dos gateways. Um provedor e uma chave significam que não há nada entre o que rotear. Os motivos que ainda se aplicam com um único provedor são limites de gastos, registros de solicitações, distribuição de chaves para uma equipe e failover para um segundo provedor no dia em que o primeiro sofrer uma interrupção — e o último desses motivos é um argumento para ter mais de um provedor, o que traz o roteamento de volta.
Um gateway de LLM de código aberto é melhor que um hospedado?
Eles respondem a restrições diferentes, em vez de se classificarem entre si. Código aberto e hospedagem própria significam que o texto dos prompts nunca sai da sua infraestrutura e que você pode ler e modificar o código, ao custo de executar e corrigir um serviço — um proxy hospedado por você é um pacote na sua build, o que coloca seu CI/CD e seu cluster no raio de impacto. Um gateway hospedado elimina essa superfície operacional e acrescenta uma exposição diferente: sua chave e o texto dos prompts passam por um terceiro. Dados regulados geralmente levam a decisão para a hospedagem própria.
Qual gateway de LLM é mais barato?
O arranjo mais barato depende de qual metade da conta você está perguntando. Ferramentas BYO-key (LiteLLM, Portkey, Helicone, Cloudflare) acrescentam pouco ou nada ao custo de inferência, porque você continua pagando as tarifas do seu próprio provedor — o gateway cobra pela camada de controle, não pelos tokens. Gateways de acesso revendido definem seus próprios preços unitários: o Kunavo lista a maioria dos modelos abaixo das tarifas oficiais dos provedores — Claude Sonnet 4.6 a $2.10 / $10.50 por 1M de tokens, em comparação com $3.00 / $15.00 da Anthropic. Se você tem contratos negociados com provedores, BYO-key quase sempre vence; se hoje paga preços públicos de tabela, um revendedor que oferece preços abaixo da tabela pode ser mais barato do que sua própria conta.
Quais gateways de LLM oferecem suporte a modelos de imagem, vídeo e áudio?
A cobertura varia por fornecedor e muda com frequência, portanto confira os modelos específicos de que precisa em cada catálogo, em vez de confiar em um rótulo de categoria. O Kunavo oferece modelos de imagem, vídeo e música usando a mesma chave e o mesmo saldo do chat, e a documentação do OpenRouter descreve endpoints de imagem, vídeo e fala além do chat. Se multimodalidade em uma única chave for um requisito, verificá-la primeiro restringe o campo mais rapidamente do que qualquer outro critério.