Chaque comparatif de cette recherche est publié par une entreprise qui vend une passerelle, et chacune se classe elle-même en tête ou presque — cette page comprise ; considérez donc le classement ci-dessous pour ce qu’il est. La correction la plus utile est que ces listes comparent des produits qui ne sont pas interchangeables. « Passerelle LLM » désigne au moins quatre choses différentes : des passerelles qui revendent l’accès aux modèles et détiennent les identifiants des fournisseurs pour vous, des plans de contrôle hébergés qui acheminent les requêtes via les comptes que vous détenez, des proxies que vous déployez dans votre propre infrastructure, et des proxies en périphérie qui ajoutent mise en cache et limites devant vos clés. Un tableau de fonctionnalités qui les mélange vous orientera vers une architecture inadaptée. Choisissez d’abord la catégorie ; le choix à l’intérieur d’une catégorie est généralement simple.
Biais déclaré : Kunavo est notre produit, et il se trouve exactement dans l’une des quatre catégories ci-dessous. Pour les trois autres, nous ne sommes pas une option, et la page le précise lorsque c’est le cas.
Les quatre catégories
| Catégorie | Qui détient le compte fournisseur | Choisissez-le lorsque | Exemples |
|---|---|---|---|
| Passerelle de revente d’accès | La passerelle | Vous voulez une seule facture et aucun compte fournisseur | Kunavo, OpenRouter, AIMLAPI |
| Plan de contrôle hébergé (BYO-key) | Vous | Vous avez des comptes et voulez du routage, de la gouvernance et de l’observabilité | Portkey, TrueFoundry, Helicone, Braintrust, ouq.ai |
| Proxy auto-hébergé | Vous | Le texte des prompts ne peut pas quitter votre infrastructure | LiteLLM, MLflow AI Gateway |
| Proxy en périphérie | Vous | Vous voulez seulement de la mise en cache, des limites de débit et de l’analytique | Cloudflare AI Gateway |
La question déterminante est qui détient les identifiants des fournisseurs. Ce seul fait détermine ce qui vous est facturé, qui est responsable en cas de fuite d’une clé, si vous pouvez utiliser des tarifs fournisseurs négociés et quelle part du système vous exploitez. Tout le reste — politiques de routage, mise en cache, tableaux de bord — existe dans chaque catégorie et différencie bien moins les produits que ne le laisse entendre le marketing.
1. Passerelles de revente d’accès — aucun compte fournisseur
La passerelle détient les identifiants des fournisseurs amont et vous facture l’utilisation ; vous n’avez donc rien à créer chez Anthropic, Google ou OpenAI. C’est la catégorie à privilégier lorsque le problème à résoudre concerne les achats et la configuration plutôt que le contrôle : une clé, un solde, un SDK.
Kunavo — une seule URL de base compatible avec OpenAI et une seule clé sk-kn- pour Claude et GPT, ainsi que pour les modèles d’image, de vidéo et de musique avec le même solde ; la plupart du catalogue est proposée sous les tarifs officiels des fournisseurs. Le service n’achemine pas vos propres clés fournisseurs ; si le BYO-key est indispensable, cette catégorie entière ne convient pas. Tarification · Démarrage rapide
OpenRouter — l’option offrant le plus vaste catalogue : des centaines de modèles provenant d’un grand nombre de fournisseurs sur un seul portefeuille, des niveaux gratuits et le routage avec vos propres clés, fonctionnalité qui manque à la plupart des produits de cette catégorie. Choisissez-le plutôt que Kunavo lorsque l’étendue du catalogue compte davantage que le prix unitaire. Kunavo contre OpenRouter · le comparatif complet d’OpenRouter
AIMLAPI — regroupe des modèles de texte et de médias sous une seule clé, selon le même principe que les deux services précédents. Kunavo contre AIMLAPI
2. Plans de contrôle hébergés — vous conservez les comptes
Vous détenez les identifiants des fournisseurs ; la plateforme ajoute le routage, les solutions de secours, les garde-fous, la gouvernance des dépenses et l’observabilité, sans que vous ayez à l’exploiter. C’est la catégorie destinée aux équipes disposant de contrats fournisseurs négociés, car ces tarifs valent davantage que tout ce qu’un revendeur peut afficher. Kunavo n’est pas une option ici — nous détenons les identifiants des fournisseurs amont par conception, ce qui correspond à l’arrangement opposé.
Portkey est le seul service que nous avons évalué (Kunavo contre Portkey) ; Helicone se situe à l’extrémité orientée observabilité de cette même catégorie (Kunavo contre Helicone). TrueFoundry, Braintrust et orq.ai occupent l’extrémité entreprise — SLA, pistes d’audit et outils d’évaluation. Nous n’avons pas évalué ces trois produits ; ils sont donc placés dans la catégorie et liés plutôt que classés, et chacun se classe lui-même en première position dans cette recherche.
3. Proxies auto-hébergés — vous exploitez le logiciel
Un proxy open source déployé dans votre propre infrastructure, devant vos propres clés fournisseurs. LiteLLM est le choix par défaut et MLflow AI Gateway est l’équivalent le plus proche. Choisissez cette catégorie lorsque le texte des prompts ne peut pas quitter votre infrastructure — contrainte qu’aucune option hébergée des trois autres catégories ne peut satisfaire, quel qu’en soit le prix.
Le coût est réel et mérite d’être explicité : un proxy auto-hébergé est un paquet intégré à votre build, ce qui place votre CI/CD et votre cluster dans son rayon d’impact. Ce n’est pas une hypothèse pour cette catégorie précise — l’incident de chaîne d’approvisionnement de LiteLLM de mars 2026 en est l’exemple détaillé, avec les changements apportés ensuite par LiteLLM.
4. Proxies en périphérie — mise en cache et limites uniquement
Cloudflare AI Gateway ajoute la mise en cache des réponses, la limitation du débit, les nouvelles tentatives et l’analytique devant les comptes fournisseurs que vous possédez déjà, sans revendre d’inférence. Il se combine avec chacune des trois autres catégories au lieu de la remplacer — les équipes l’exécutent souvent devant une passerelle de revente d’accès. Kunavo contre Cloudflare AI Gateway
Comment choisir en une seule passe
- Le texte des prompts peut-il quitter votre infrastructure ? Non → catégorie 3, et arrêtez-vous là. Oui → continuez.
- Avez-vous des tarifs fournisseurs négociés ou des dépenses engagées ? Oui → catégorie 2, que vous continuez donc à utiliser. Non → continuez.
- Voulez-vous détenir des comptes fournisseurs ? Non → catégorie 1. Oui → catégorie 2.
- Avez-vous besoin d’images, de vidéos ou de musique avec la même clé ? Ce critère réduit le champ plus rapidement que tout autre — vérifiez-le avant de comparer quoi que ce soit d’autre.
- Ajoutez la catégorie 4 par-dessus votre choix si la mise en cache ou les limites de débit en périphérie sont une exigence réelle ; elle ne constitue pas une alternative aux autres.
Ce que toutes ces listes omettent
Deux éléments, de manière constante. Le premier est ce qui se passe lorsque le fournisseur amont tombe en panne : toutes les passerelles annoncent un basculement, mais peu expliquent ce qu’elles font réellement — la chaîne de routage, le délai d’expiration et le fait qu’une requête échouée soit facturée ou non. Ce qu’une passerelle devrait gérer pour vous correspond à l’ensemble de fonctionnalités qu’il faut examiner, et la réponse doit être précise.
Le second est le coût de migration. Tous les produits des catégories 1, 2 et 4 utilisent le protocole de communication OpenAI ; changer de produit consiste donc à remplacer base_url et la clé — ce qui signifie que le verrouillage est faible et que la décision est bien moins lourde que ne le laisse entendre un tableau comparatif à neuf éléments. Le guide de l’API compatible avec OpenAI présente les détails au niveau du protocole.
Questions fréquentes
Quelle est la meilleure passerelle LLM ?
Il n’existe pas de meilleur choix unique, car « passerelle LLM » désigne quatre produits qui ne sont pas interchangeables. Si vous ne voulez aucun compte fournisseur, une passerelle de revente d’accès telle que Kunavo ou OpenRouter correspond à cette catégorie. Si vous avez déjà des comptes fournisseurs et voulez les gérer avec du routage et de la gouvernance, il vous faut un plan de contrôle hébergé comme Portkey ou TrueFoundry. Si vous voulez exécuter vous-même le logiciel, choisissez LiteLLM ou MLflow AI Gateway. Si vous voulez seulement de la mise en cache, des limites de débit et de l’analytique devant vos propres clés, choisissez Cloudflare AI Gateway. Choisissez d’abord la catégorie, puis comparez les tableaux de fonctionnalités.
Qu’est-ce qu’une passerelle LLM ?
Une passerelle LLM est un point de terminaison unique placé entre votre application et un ou plusieurs fournisseurs de modèles ; votre code cible ainsi une seule API et une seule clé, au lieu d’une par fournisseur. Au-delà de cette définition commune, les produits divergent fortement : certains revendent l’accès aux modèles et détiennent les identifiants des fournisseurs pour vous, d’autres acheminent les requêtes via les comptes fournisseurs que vous détenez vous-même, et d’autres encore sont des bibliothèques que vous déployez dans votre propre infrastructure.
Quelle est la différence entre une passerelle LLM et un routeur LLM ?
En pratique, les termes sont utilisés indifféremment, et la plupart des produits présentés comme des routeurs sont des passerelles dotées de fonctionnalités de routage. Lorsqu’une distinction est faite, « routeur » met l’accent sur le choix entre des modèles ou des fournisseurs pour chaque requête — selon le coût, la latence ou la disponibilité — tandis que « passerelle » met l’accent sur le fait d’être le point d’entrée unique qui gère également l’authentification, les limites de dépenses, la journalisation et le basculement. Les décisions d’achat dépendent rarement du terme employé.
Ai-je besoin d’une passerelle LLM si je n’utilise qu’un seul fournisseur ?
Généralement non pour le routage, qui est la fonctionnalité justifiant la plupart des passerelles. Un fournisseur et une clé ne laissent rien entre quoi router. Les raisons qui restent valables avec un seul fournisseur sont les plafonds de dépenses, la journalisation des requêtes, la distribution d’une clé à toute une équipe et le basculement vers un second fournisseur le jour où le premier tombe en panne — ce dernier point suppose toutefois d’avoir plus d’un fournisseur, ce qui réintroduit le routage.
Une passerelle LLM open source est-elle meilleure qu’une passerelle hébergée ?
Elles répondent à des contraintes différentes plutôt qu’à un classement commun. L’open source et l’auto-hébergement signifient que le texte des prompts ne quitte jamais votre infrastructure et que vous pouvez lire et corriger le code, au prix de l’exploitation et de la maintenance d’un service — un proxy auto-hébergé est un paquet intégré à votre build, ce qui place votre CI/CD et votre cluster dans son rayon d’impact. Une passerelle hébergée supprime cette surface opérationnelle, mais introduit une autre exposition : votre clé et le texte de vos prompts transitent par un tiers. Les données réglementées orientent généralement le choix vers l’auto-hébergement.
Quelle passerelle LLM est la moins chère ?
L’option la moins chère dépend de la partie de la facture dont vous parlez. Les outils BYO-key (LiteLLM, Portkey, Helicone, Cloudflare) ajoutent peu ou rien au coût d’inférence, car vous continuez à payer les tarifs de votre propre fournisseur — la passerelle facture le plan de contrôle, pas les tokens. Les passerelles de revente d’accès fixent leurs propres prix unitaires : Kunavo affiche la plupart des modèles sous les tarifs officiels des fournisseurs — Claude Sonnet 4.6 à $2.10 / $10.50 par million de tokens, contre $3.00 / $15.00 chez Anthropic. Si vous avez négocié des contrats fournisseurs, le BYO-key est presque toujours gagnant ; si vous payez aujourd’hui les tarifs publics, un revendeur proposant des prix inférieurs au tarif catalogue peut coûter moins cher que votre propre compte.
Quelles passerelles LLM prennent en charge les modèles d’image, de vidéo et d’audio ?
La couverture varie selon le fournisseur et évolue souvent ; vérifiez donc les modèles précis dont vous avez besoin dans chaque catalogue plutôt que de vous fier à une étiquette de catégorie. Kunavo propose des modèles d’image, de vidéo et de musique avec la même clé et le même solde que pour le chat, et la documentation d’OpenRouter décrit des points de terminaison d’image, de vidéo et de parole en plus du chat. Si le multimodal avec une seule clé est une exigence, le vérifier en premier réduit le champ plus rapidement que tout autre critère.