Le prix de Gemini se répartit en 3 catégories. Niveau gratuit (niveau gratuit de l’API dans Google AI Studio, avec des limites de débit et inadapté à une utilisation en production), abonnement Google (formule payante de l’application Gemini, tarif mensuel fixe, sans clé API) et facturation à l’usage de l’API (par token, sans abonnement mensuel, 0 $ si vous n’effectuez aucun appel). Il s’agit de trois produits distincts : souscrire à l’un ne donne pas accès aux autres.
Les développeurs recherchent généralement la troisième option. Kunavo fournit cette API à environ 70 % de moins que les tarifs Google. Cette page présente les tarifs actuels par modèle, des exemples de calcul que vous pouvez vérifier vous-même et la manière la moins coûteuse d’utiliser Gemini en production.
Distinguer les 3 tarifs
| Voie | Ce que vous payez | Une clé API est-elle incluse ? |
|---|---|---|
| Niveau gratuit (Google AI Studio) | 0 $. Limites de débit | Oui (avec limitations) |
| Abonnement (formule payante de l’application Gemini) | Montant mensuel fixe | Non |
| API à l’usage | Par token. Aucun abonnement mensuel | Oui |
La confusion la plus fréquente concerne la ligne du milieu. Payer la formule payante de l’application Gemini n’augmente pas le quota API. L’abonnement mensuel de l’application et l’API destinée aux développeurs sont facturés séparément ; pour effectuer des appels depuis du code, il faut dans tous les cas une clé et une facturation à l’usage (ou le niveau gratuit). Les limites de débit précises du niveau gratuit changent régulièrement selon Google : vérifiez les chiffres dans la documentation officielle de Google. Nous ne les détaillons pas ici — pour un usage en production, le niveau gratuit est de toute façon exclu.
Aperçu des tarifs Gemini
Les tarifs sont indiqués par million de tokens, en USD, et correspondent au montant facturé par Kunavo. La colonne « tarifs Google » indique les prix publiés par Google pour le même modèle afin de rendre la différence visible.
| Modèle | Entrée / 1M | Sortie / 1M | Tarifs Google (entrée / sortie) | Taux d’économie |
|---|---|---|---|---|
gemini-2-5-flash | $0.09 | $0.75 | $0.30 / $2.50 | Environ 70 % |
gemini-3-1-pro | $0.70 | $4.20 | $2.00 / $12.00 | Environ 65 % |
Flash est le modèle principal pour les traitements en volume ; Pro est destiné aux tâches de raisonnement plus complexe, de compréhension d’images et de contexte long. Les tarifs les plus récents sont toujours affichés sur la page des tarifs et les pages de chaque modèle (gemini-2-5-flash, gemini-3-1-pro).
Fonctionnement de la facturation des tokens Gemini
La facturation porte sur les tokens d’entrée (tout ce que vous envoyez — invite système, contexte récupéré et message utilisateur) et les tokens de sortie (ce que le modèle génère). La sortie étant plus coûteuse, le principal levier de votre facture Gemini est la quantité de contenu que vous demandez au modèle d’écrire. Les images et l’audio sont convertis en tokens et facturés sur le même compteur.
Exemples de calcul
Voici des chiffres réels fondés sur les tarifs Gemini 2.5 Flash de Kunavo. Seule la dernière ligne utilise Gemini 3.1 Pro.
| Charge de travail | Tokens (entrée / sortie) | Modèle | Coût |
|---|---|---|---|
| Un tour de chatbot | 1,000 / 300 | Flash | $0.0003 |
| Réponse RAG | 8,000 / 500 | Flash | $0.0011 |
| Classification par lots (par document) | 500 / 20 | Flash | $0.00006 |
| Analyse de contexte long | 20,000 / 2,000 | Pro | $0.0224 |
À ces tarifs, classer par lots 100 000 documents avec Flash coûte environ 6 $, et 1 million de conversations de chatbot environ 315 $. La formule de calcul peut être exécutée telle quelle.
# Kunavo の Gemini 2.5 Flash 料率(1M トークンあたり、USD)
IN_RATE, OUT_RATE = 0.09, 0.75
def cost(in_tokens: int, out_tokens: int) -> float:
return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE
print(cost(1_000, 300)) # チャットボット 1 ターン -> $0.000315
print(cost(8_000, 500)) # RAG の回答 1 件 -> $0.001095
print(cost(500, 20) * 100_000) # 10 万件のバッチ処理 -> 約 $6.00Tarifs Kunavo et paiements Stripe
Aucun abonnement ni projet Google Cloud n’est nécessaire. Lorsque vous rechargez votre solde (avec Stripe ou un moyen de paiement local), chaque appel déduit du solde le montant correspondant au tarif des tokens ci-dessus. Il s’agit d’une facturation à l’usage commençant par une recharge minimale de 10 $ ; le solde n’expire pas et les recharges importantes bénéficient de crédits bonus. Un seul solde couvre Gemini et tous les autres modèles — Claude, GPT, image, vidéo et audio — afin que vous n’ayez pas à rapprocher des factures distinctes pour chaque fournisseur.
Quel modèle Gemini choisir ?
- gemini-2-5-flash — le choix par défaut pour le chat, l’extraction, la classification, la synthèse et la plupart des usages RAG. Rapide et économique, c’est l’option performante la moins chère.
- gemini-3-1-pro — à utiliser lorsque Flash n’est pas assez précis : raisonnement en plusieurs étapes, code, compréhension d’images ou contexte extrêmement long.
Le routage selon la difficulté est généralement une bonne approche. Traitez les cas courants avec Flash et ne faites remonter vers Pro que les requêtes qui échouent aux vérifications. Pour un modèle de routage avec du code, consultez le guide d’optimisation des coûts de l’IA.
Réduire votre facture Gemini
- Choisissez un niveau inférieur. Envoyez les 80 % de tâches simples à Flash et réservez Pro aux 20 % les plus difficiles.
- Limitez la sortie. Définissez
max_tokenset les séquences d’arrêt — la sortie est la partie la plus coûteuse du compteur. - Réduisez l’entrée. Récupérez quelques blocs RAG pertinents et de qualité au lieu d’insérer toute la base de connaissances dans le contexte.
- Utilisez le traitement par lots. Regroupez les appels indépendants pour réduire la latence et éviter une succession de nouvelles tentatives.
Les modèles d’image et de vidéo de Google peuvent également être appelés avec la même clé. Les tarifs par image et par vidéo figurent dans les tarifs de Nano Banana Pro et les tarifs de Veo 3.
Questions fréquentes
Quel est le prix de Gemini ?
Le prix de Gemini se répartit en 3 catégories : le niveau gratuit de Google AI Studio (0 $, avec des limites de débit), l’abonnement payant de l’application Gemini (tarif mensuel fixe, sans clé API) et la facturation à l’usage de l’API (par token, sans abonnement mensuel). Pour les appels depuis du code, c’est la troisième option ; les tarifs de Kunavo par million de tokens sont, pour Gemini 2.5 Flash, $0.09 en entrée / $0.75 en sortie, et pour gemini-3-1-pro, $0.70 / $4.20 — soit environ 70 % / 65 % de moins que les tarifs Google.
Quel est le prix de Gemini Pro ?
gemini-3-1-pro coûte chez Kunavo $0.70 en entrée / $4.20 en sortie par million de tokens, soit environ 65 % de moins que les tarifs Google $2.00 / $12.00. Une requête contenant 20 000 tokens en entrée et 2 000 en sortie coûte environ 0.0224 $. Pro est destiné aux tâches de raisonnement complexe, de compréhension d’images et de contexte long ; pour les traitements en volume, passer au niveau Flash revient à un coût inférieur de plusieurs ordres de grandeur.
Gemini est-il gratuit ?
Google AI Studio propose un niveau gratuit pour l’API Gemini, qui permet des appels à 0 $ dans les limites de débit. Il convient au prototypage, mais ces limites peuvent changer selon les décisions de Google et sont insuffisantes pour le trafic de production ; si vous prévoyez un usage en production, ce n’est donc pas une option viable. Kunavo ne propose pas de quota gratuit, mais ne facture pas non plus d’abonnement mensuel : seul le montant utilisé est déduit du solde prépayé, et un mois sans appel coûte 0 $.
Un abonnement payant à l’application Gemini donne-t-il accès à l’API ?
Non. L’abonnement payant à l’application Gemini et l’API Gemini destinée aux développeurs sont des produits et des systèmes de facturation distincts. Le tarif mensuel n’inclut aucun quota API et aucune clé API n’est fournie. Pour effectuer des appels depuis du code, il faut disposer séparément d’une clé et d’une facturation à l’usage (ou du niveau gratuit). À l’inverse, posséder une clé API n’ajoute aucune fonctionnalité à l’application.
Quel est le prix de Gemini 2.5 Flash ?
Chez Kunavo, Gemini 2.5 Flash coûte $0.09 par million de tokens en entrée et $0.75 par million en sortie, soit environ 70 % de moins que les tarifs Google $0.30 / $2.50. Un tour de chatbot courant (1K en entrée, 300 en sortie) coûte environ 0,0003 $.
Gemini est-il moins cher que Claude ou GPT ?
Gemini 2.5 Flash fait partie des modèles performants les moins chers, quelle que soit la comparaison — pour les traitements en volume, il coûte moins cher que Claude Haiku et que la plupart des niveaux GPT. Consultez le tableau complet des tarifs.
Comment réduire le coût de l’API Gemini ?
Passez au niveau Flash, limitez la sortie, réduisez le contexte récupéré et utilisez le traitement par lots. Vous trouverez plus de détails dans le guide d’optimisation des coûts. Pour commencer à appeler Gemini, consultez la procédure d’obtention d’une clé API Gemini.