Le coût de l’API Gemini est calculé au token, sans abonnement mensuel. Pour essayer gratuitement, Google AI Studio propose un niveau gratuit avec limitation de débit ; en production, vous payez par million de tokens, avec des tarifs distincts pour l’entrée et la sortie. Au 5 octobre 2026, le Gemini 3.8 Flash de Kunavo coûte $0.525 en entrée / $2.625 en sortie — Google facture actuellement ses modèles Flash 3.x au tarif promotionnel temporaire de $0.75 / $3.75 (jusqu’au 31 décembre 2026 ; à partir de 2027, retour au tarif standard $1.50 / $7.50), et Kunavo est environ 30 % moins cher que ce tarif promotionnel. L’ancienne génération Gemini 2.5 Flash coûte $0.09 / $0.75, et Gemini 3.1 Pro $0.70 / $4.20.
Il faut d’abord signaler une exception : Gemini 3.6 Flash. Sur Kunavo, il coûte $1.05 / $5.25, Environ 40 % plus cher que le tarif promotionnel de Google — pendant la promotion, l’appel direct à Google est moins cher. 3.7 et 3.8 Flash sont tous deux plus récents et moins chers que lui, Par conséquent, ne choisissez pas 3.6 en fonction du prix.
Tarifs vérifiés le 5 octobre 2026. Les prix officiels de Google et les détails du niveau gratuit sont disponibles sur ai.google.dev/gemini-api/docs/pricing ; les chiffres côté Kunavo sont affichés par le catalogue des modèles du site et correspondent aux montants réellement facturés par l’API.
Le « coût de Gemini » recouvre en réalité trois choses
| Option | Ce que vous payez | Clé API disponible | Pour qui |
|---|---|---|---|
| Niveau gratuit (Google AI Studio) | 0 $, avec limitation de débit | Oui (limité) | Essais, apprentissage, petits outils personnels |
| Abonnement Google AI (Pro / Ultra de l’application Gemini) | Abonnement mensuel fixe | Non | Utilisation uniquement dans l’application Gemini, sans programmation |
| API facturée à l’usage | Par token, sans frais mensuels | Oui | Intégration dans un produit, traitement par lots, maîtrise des coûts |
La confusion la plus fréquente concerne la ligne du milieu : un abonnement Google AI Pro n’augmente pas le quota API. L’abonnement mensuel de l’application et l’API destinée aux développeurs sont deux comptes distincts ; pour appeler l’API depuis du code, il faut toujours utiliser le niveau gratuit ou payer au token. À l’inverse, si vous discutez uniquement dans l’application Gemini sans programmer, la version gratuite ou l’abonnement suffit et vous n’avez pas besoin de l’API.
L’API Gemini est-elle gratuite ? Que permet le niveau gratuit ?
Oui, il existe un niveau gratuit réellement à 0 $ : créez une clé dans Google AI Studio et les appels restent gratuits dans les limites de débit. C’est largement suffisant pour essayer les modèles et créer des prototypes. Google ajuste les valeurs précises de ces limites ; cette page ne reproduit pas des chiffres susceptibles d’expirer — consultez la page tarifaire de Google et la documentation des limites de débit.
La limite est claire : les restrictions de débit ne suffisent pas pour le trafic de production et les chiffres peuvent changer à tout moment ; la mise en production nécessite donc un paiement. Kunavo n’offre pas de quota gratuit, mais n’a pas d’abonnement mensuel : solde prépayé minimum de 10 $, paiement selon l’utilisation et 0 $ les mois sans appel.
Prix de l’API Gemini — par million de tokens et par modèle
| Modèle | Entrée Kunavo | Sortie Kunavo | Google officiel (entrée / sortie) | Comparaison avec le prix actuel de Google |
|---|---|---|---|---|
| Gemini 3.8 Flash | $0.525 | $2.625 | Tarif promotionnel $0.75 / $3.75 (à partir de 2027 : $1.50 / $7.50) | Environ 30 % moins cher que le tarif promotionnel de Google |
| Gemini 3.7 Flash | $0.525 | $2.625 | Tarif promotionnel $0.75 / $3.75 (à partir de 2027 : $1.50 / $7.50) | Environ 30 % moins cher que le tarif promotionnel de Google |
| Gemini 3.6 Flash | $1.05 | $5.25 | Tarif promotionnel $0.75 / $3.75 (à partir de 2027 : $1.50 / $7.50) | Environ 40 % plus cher que le tarif promotionnel de Google |
| Gemini 3.1 Pro | $0.70 | $4.20 | $2.00 / $12.00 | Environ 65 % moins cher |
| Gemini 2.5 Flash | $0.09 | $0.75 | $0.30 / $2.50 | Environ 70 % moins cher |
Les trois lignes Flash 3.x comparent le tarif promotionnel effectivement facturé aujourd’hui par Google, et non le tarif standard de 2027. Comparer au tarif standard rendrait les chiffres beaucoup plus flatteurs, mais ce n’est pas le prix que vous payez actuellement à Google. Gemini 3.1 Pro a une règle supplémentaire : si le prompt d’une requête dépasse 200K tokens, l’ensemble de la requête est facturé à 2 fois le prix d’entrée et 1,5 fois le prix de sortie. Les spécifications sont disponibles sur les pages des modèles Gemini 3.8 Flash, Gemini 3.1 Pro et Gemini 2.5 Flash ; tous les tarifs figurent sur la page des prix.
Prix de Gemini 3.8 Flash — coût réel d’une requête
Plutôt qu’un tableau tarifaire, regardons directement une requête. Tous les montants ci-dessous sont calculés à partir des tarifs du tableau précédent :
| Usage | Tokens (entrée / sortie) | 3.8 Flash (Kunavo) | 3.8 Flash (tarif promotionnel Google) | 2.5 Flash | 3.1 Pro |
|---|---|---|---|---|---|
| Un tour de conversation | 1,000 / 300 | $0.0013 | $0.0019 | $0.00031 | $0.002 |
| Une réponse RAG | 8,000 / 500 | $0.0055 | $0.0079 | $0.0011 | $0.0077 |
| Une analyse de document long | 20,000 / 2,000 | $0.016 | $0.022 | $0.0033 | $0.022 |
| Classification de 100 000 documents | 500 / 20 × 100,000 | $31.50 | $45.00 | $6.00 | $43.40 |
Un élément peut faire augmenter la facture : les tokens de réflexion. Gemini 3.x Flash et 3.1 Pro « réfléchissent » avant de répondre. Ces tokens n’apparaissent pas dans la réponse, mais ils sont facturés au tarif de sortie. Le tableau ci-dessus ne les inclut pas ; le coût réel d’un problème difficile sera donc supérieur — utilisez le nombre de tokens de sortie indiqué par usage dans la réponse. Pour calculer avec vos propres chiffres :
# Gemini API 的費用,直接用實際 token 數算。
# 費率為每 1M token USD:(input, output)
RATES = {
"gemini-3-8-flash": (0.525, 2.625),
"gemini-3-1-pro": (0.70, 4.20),
"gemini-2-5-flash": (0.09, 0.75),
}
def cost(model, inp, out):
i, o = RATES[model]
return inp / 1e6 * i + out / 1e6 * o # 思考 token 按輸出費率計
print(cost("gemini-3-8-flash", 8_000, 500)) # RAG 回答一次
print(cost("gemini-2-5-flash", 500, 20) * 100_000) # 10 萬筆分類Appeler Gemini avec le SDK OpenAI existant
Kunavo est un point de terminaison compatible OpenAI : remplacez base_url et la clé, indiquez le modèle Gemini dans model et cela fonctionnera ; aucun projet ni compte de facturation Google Cloud n’est nécessaire. La même clé permet également d’appeler Claude, GPT et les modèles d’images et de vidéos.
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1", # 只改這一行
)
resp = client.chat.completions.create(
model="gemini-3-8-flash",
messages=[{"role": "user", "content": "用三句話說明什麼是 token"}],
)
print(resp.choices[0].message.content)
print(resp.usage) # 這次請求計費用的 token 數Les étapes complètes sont décrites dans le démarrage rapide ; si vous souhaitez obtenir une clé directement auprès de Google, consultez Comment obtenir une clé API Gemini (anglais).
Soyons francs : dans quels cas vaut-il mieux s’adresser directement à Google ?
- Si vous avez besoin d’un quota ou d’un SLA garantis. La passerelle utilise une capacité partagée, sans quota dédié ni SLA contractuel garanti. À l’échelle où ces garanties deviennent nécessaires, adressez-vous directement à Google.
- Si vous devez utiliser Gemini 3.6 Flash. Pendant la promotion, l’appel direct à Google est moins cher que Kunavo.
- Si vous discutez uniquement dans l’application. Sans programmation, la version gratuite ou un abonnement Google AI suffit ; l’API ne vous est pas utile.
À l’inverse, cette solution sert à utiliser une seule clé pour appeler Gemini, Claude et GPT, à éviter d’ouvrir une facturation Google Cloud ou à verrouiller les coûts grâce à un solde prépayé.
Payer depuis Taïwan
Pour payer directement Google, il faut activer la facturation du projet dans Google Cloud et y associer une carte de crédit internationale. Le solde Kunavo utilise Stripe et accepte les cartes, notamment JCB (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay et Google Pay ; il s’agit d’un système prépayé, avec une recharge minimale de $10 et un solde qui n’expire pas. Les recharges uniques d’au moins $100 bénéficient en outre d’un bonus ($100 crédités donnent $110).
À Taïwan, aucun moyen de paiement local n’est disponible — JKO Pay et LINE Pay ne figurent pas parmi les options ; la carte internationale est la seule solution. Les détails de facturation sont disponibles dans la documentation de facturation.
Réduire le coût de Gemini
- Commencez par choisir le bon modèle. Si vous voulez la génération 3.x, utilisez 3.8 ou 3.7 Flash : ils sont plus récents et moins chers que 3.6 ; Pour les tâches simples et volumineuses comme la classification ou l’extraction, utilisez 2.5 Flash.
- Demandez au modèle d’être concis. La sortie coûte plus cher que l’entrée ; spécifiez directement le format et la longueur de sortie dans le prompt.
- Réduisez le contexte. Avec le RAG, récupérez peu de passages mais pertinents ; n’envoyez pas toute la base de connaissances, car elle est facturée en entrée à chaque requête.
- Maintenez le prompt de 3.1 Pro sous 200K tokens. Au-delà, l’ensemble de la requête est facturé à 2 fois le prix d’entrée et 1,5 fois celui de sortie.
La méthode de routage est décrite dans le guide d’optimisation des coûts de l’IA (anglais). Pour comparer d’autres fournisseurs avec le même calcul, consultez Coût de l’API OpenAI et Coût de Claude.
Questions fréquentes
Combien coûte l’API Gemini ?
L’API Gemini est facturée au token, sans abonnement mensuel ; l’entrée et la sortie ont des tarifs distincts. Au 5 octobre 2026, les tarifs Kunavo par million de tokens sont de $0.525 en entrée / $2.625 en sortie pour Gemini 3.8 Flash, $0.70 / $4.20 pour Gemini 3.1 Pro et $0.09 / $0.75 pour Gemini 2.5 Flash. Google facture actuellement ses modèles Flash 3.x au tarif promotionnel temporaire de $0.75 / $3.75 (jusqu’au 31 décembre 2026 ; à partir de 2027, $1.50 / $7.50). Google AI Studio propose également un niveau gratuit avec limitation de débit, pour commencer sans frais.
Peut-on utiliser l’API Gemini gratuitement ?
Pour essayer, oui, mais ce n’est pas adapté à la production. Google AI Studio propose un niveau gratuit avec limitation de débit ; les appels restent gratuits dans cette limite. Google peut modifier les valeurs : consultez la page tarifaire de l’API Gemini de Google. Le trafic de production est payant : directement auprès de Google ou via une passerelle facturée au token. Kunavo n’offre pas de quota gratuit, mais n’a pas non plus d’abonnement mensuel : solde prépayé minimum de 10 $, paiement selon l’utilisation et 0 $ les mois sans appel.
Quel est le prix de Gemini 3.8 Flash ?
Au 5 octobre 2026, Gemini 3.8 Flash sur Kunavo coûte, par million de tokens, $0.525 en entrée / $2.625 en sortie. Google facture actuellement les modèles Flash 3.x au tarif promotionnel temporaire de $0.75 / $3.75 jusqu’au 31 décembre 2026 ; sur Kunavo, Environ 30 % moins cher que le tarif promotionnel de Google ; à partir du 1er janvier 2027, Google reviendra au tarif standard de $1.50 / $7.50. Une réponse RAG (8 000 tokens d’entrée / 500 de sortie) coûte environ $0.0055 sur Kunavo.
Gemini 3.6 Flash vaut-il encore le coup ?
Il n’est pas recommandé de le choisir pour son prix. Le Gemini 3.6 Flash de Kunavo coûte $1.05 / $5.25. Comparaison avec le tarif promotionnel de Google : Environ 40 % plus cher que le tarif promotionnel de Google. Pendant la promotion, appeler directement la version 3.6 auprès de Google revient donc moins cher. Les versions 3.7 Flash et 3.8 Flash sont toutes deux plus récentes que la 3.6 et sont également moins chères chez Kunavo ($0.525 / $2.625). À moins que votre programme n’exige précisément la version 3.6, choisissez simplement un modèle plus récent.
Un abonnement Google AI Pro permet-il d’utiliser l’API Gemini ?
Non. Les abonnements payants de l’application Gemini (Google AI Pro / Ultra) et l’API Gemini destinée aux développeurs sont deux produits et deux systèmes de facturation distincts ; l’abonnement mensuel n’inclut aucun quota API et ne fournit pas de clé API. Pour appeler l’API depuis du code, il faut utiliser le niveau gratuit ou payer au token. Inversement, une clé API n’ajoute aucune fonction à l’application.
Peut-on utiliser l’API Gemini sans compte de facturation Google Cloud ?
Oui, via une passerelle compatible OpenAI. Sur Kunavo, la même clé commençant par sk-kn- permet d’appeler Gemini sans projet ni compte de facturation Google Cloud ; Claude et GPT partagent le même solde. En contrepartie, cette solution utilise une capacité partagée : aucun quota dédié ni SLA contractuel garanti. Pour un volume nécessitant un quota ou un SLA garanti, adressez-vous directement à Google.
Comment payer l’API Gemini depuis Taïwan ?
Pour payer directement Google, il faut activer la facturation du projet dans Google Cloud et y associer une carte de crédit internationale. Kunavo utilise le prépaiement via Stripe : Visa, Mastercard, American Express, JCB, UnionPay, Apple Pay et Google Pay sont pris en charge ; la recharge minimale est de $10, le solde n’expire pas et les requêtes échouées ne sont pas facturées. Taïwan ne dispose pas de moyens de paiement locaux — Jko et LINE Pay ne figurent pas dans la liste des moyens disponibles.