Cas d’usage de LiteLLM
LiteLLM est le meilleur choix lorsque vous voulez une couche unificatrice open source que vous contrôlez entièrement. Si vous avez déjà des contrats fournisseurs, devez accéder à des modèles de niche ou auto-hébergés, souhaitez exécuter la passerelle dans votre propre VPC pour des raisons de conformité et appréciez un SDK natif Python ainsi qu’un proxy indépendant du langage avec budgets et clés virtuelles, LiteLLM est conçu exactement pour cela. Il n’y a aucun verrouillage de l’inférence — LiteLLM standardise simplement la manière dont votre code appelle les fournisseurs que vous configurez.
Les points forts de Kunavo
Kunavo supprime à la fois les comptes fournisseurs et les opérations. Rien à déployer : rechargez un portefeuille unique et appelez Claude, GPT ainsi que des modèles d’image, de vidéo et d’audio, à un prix inférieur au tarif catalogue de chaque fournisseur selon le modèle — pas d’Anthropic Console, pas de projet Google Cloud, pas de proxy à héberger et surveiller, un seul solde. Les points de terminaison de génération sont de première classe, l’API native Anthropic Messages utilise la même clé et le paiement est natif Stripe avec des moyens de paiement locaux. Là où LiteLLM vous donne une passerelle à exécuter, Kunavo vous donne une passerelle à appeler.
Comment choisir (ou utiliser les deux)
Choisissez LiteLLM si vous voulez une passerelle open source et auto-hébergée au-dessus de clés fournisseurs que vous gérez déjà, ou si vous devez accéder à des modèles de niche ou auto-hébergés dans votre propre infrastructure. Choisissez Kunavo si vous voulez une inférence hébergée sans opérations, via un portefeuille prépayé unique à un prix inférieur au tarif catalogue, avec un multimodal de première classe et un seul solde à rapprocher. Ils se combinent : enregistrez Kunavo comme fournisseur compatible avec OpenAI dans LiteLLM (base URL https://api.kunavo.com/v1) pour conserver le routage et les budgets de LiteLLM tout en faisant passer vos tokens par le catalogue à prix réduit de Kunavo.
How you pay: LiteLLM vs Kunavo
LiteLLM est un logiciel, pas un commerçant ; la question du paiement ne disparaît donc pas — elle descend d’un niveau. Le checkout de Kunavo est natif Stripe : la liste suit l'acheteur, pas notre pays de facturation, et chaque moyen recharge le même solde API prépayé. Partout où Stripe est présent : cartes (Visa, Mastercard, Amex, JCB, UnionPay) ; partout sauf en Inde, aussi Link, ainsi qu'Apple Pay et Google Pay sur les appareils où ils sont configurés. Aux États-Unis : Cash App Pay, Klarna, Afterpay, prélèvement bancaire ACH (3 à 5 jours ouvrés avant crédit) et crypto (stablecoins), plus Affirm pour les recharges de 100 $ et plus, et Zip pour celles de 100 $ à 1 500 $. Ailleurs, le moyen local apparaît avec la devise locale : Alipay et WeChat Pay en Chine continentale ; KakaoPay, Naver Pay, PAYCO, Samsung Pay et cartes domestiques coréennes en Corée du Sud ; UPI en Inde ; Pix au Brésil ; iDEAL aux Pays-Bas, Bancontact en Belgique, EPS en Autriche, MB WAY au Portugal, Satispay en Italie ; BLIK en Pologne ; prélèvement Bacs au Royaume-Uni (quelques jours ouvrés avant crédit) ; et Pay by Bank pour les acheteurs au Royaume-Uni, en Irlande et en Finlande. Stripe convertit le montant en dollars dans la devise locale sur la page de paiement : inutile de chercher une carte autorisée à l'international. Son taux inclut toutefois 2 à 4 % de frais de conversion, que l'on évite en payant en dollars. Il n’y a rien à payer à LiteLLM au-delà des serveurs sur lesquels vous l’exécutez ; l’argent revient à chaque fournisseur que vous configurez. « Puis-je payer avec Pix ? » devient donc « Puis-je payer Anthropic avec Pix ? », puis la même question pour OpenAI et pour Google — trois comptes, trois consoles, trois exigences de carte. Kunavo regroupe tout cela dans un paiement unique, ce qui vaut le plus précisément dans les endroits où il est le plus difficile d’obtenir une carte autorisée pour les paiements internationaux.