Retour aux guides
Modèles·2 juillet 2026·Mis à jour le 12 septembre 2026·7 min de lecture

API Gemini 3 — tarifs, disponibilité et méthode actuelle pour appeler Gemini

Gemini 3 est la famille actuelle de Google : 3 Pro, 3.1 Pro et une gamme Flash allant jusqu’à Gemini 3.8 Flash. Voici ses tarifs API aux tarifs catalogue et de lancement de Google, les identifiants disponibles sur Kunavo et le code compatible avec OpenAI pour les appeler aujourd’hui.

Dernière vérification le .

Gemini 3 est la famille de modèles actuelle de Google — Gemini 3 Pro et Gemini 3.1 Pro au sommet, et une gamme Flash allant de Gemini 3 Flash à Gemini 3.8 Flash — nativement multimodale, avec un contexte d'un million de tokens et un raisonnement par chaîne de pensée. Vous pouvez appeler l'API Gemini 3 sur Kunavo dès aujourd'hui via un seul endpoint compatible avec OpenAI : Gemini 3.1 Pro à $0.70 / $4.20 par million de tokens, environ 65% sous le tarif officiel de Google de $2.00 / $12.00, et Gemini 3.8 Flash, le Flash le plus récent, à $0.525 / $2.625 — 30% sous le tarif de lancement de $0.75 / $3.75 facturé par Google pour Flash 3.x jusqu'au 31 décembre 2026. Ce guide présente le coût de chaque niveau, les slugs actifs et le code permettant de les appeler.

Note de disponibilité. Le niveau Gemini 3 Pro est actif sur Kunavo : gemini-3-1-pro fonctionne à $0.70 / $4.20 par million, soit environ 65% sous le tarif officiel de Google de $2.00 / $12.00. Côté Flash, gemini-3-8-flash ($0.525 / $2.625) est la version la plus récente, gemini-3-7-flash ($0.525 / $2.625) la version précédente, et gemini-3-6-flash ($1.05 / $5.25) est toujours proposé — bien qu'il coûte désormais plus cher que les deux autres et que le propre tarif de lancement de Google. Deux slugs restent réservés et désactivés — gemini-3-pro et gemini-3-flash d'origine — car les sources amont que nous avons testées n'atteignent pas notre seuil de fiabilité : erreurs 503 persistantes et gestion incorrecte des paramètres (une source ignore entièrement maxOutputTokens). Nous n'activons un slug qu'une fois qu'une source a passé ces tests. Gemini 2.5 Flash reste également actif sur le même endpoint.

Tarification de l'API Gemini 3

Les tarifs officiels de Google pour la famille, à côté du coût de chaque niveau sur Kunavo. Pour les modèles Flash 3.x, Google applique un tarif de lancement jusqu'au 31 décembre 2026, donc le tableau affiche ce tarif — celui que vous paieriez en passant directement par Google aujourd'hui — ainsi que le tarif standard qui lui succède :

ModèleEntrée / 1 MSortie / 1 MStatut sur Kunavo
Gemini 3 Pro (tarif officiel Google, contexte ≤200k)$2.00$12.00Réservé — non activé
Gemini 3.1 Pro sur Kunavo$0.70$4.20Actif (tarif officiel Google $2.00 / $12.00)
Gemini 3 Flash (tarif officiel Google)$0.50$3.00Réservé — non activé
Gemini 3.6 / 3.7 / 3.8 Flash (tarif de lancement Google, jusqu'au 31 décembre 2026)$0.75$3.75Google en direct ; standard $1.50 / $7.50 à partir du 1 janvier 2027
Gemini 3.8 Flash sur Kunavo — le plus récent$0.525$2.625Actif — 30% sous le tarif de lancement de Google
Gemini 3.7 Flash sur Kunavo$0.525$2.625Actif — 30% sous le tarif de lancement de Google
Gemini 3.6 Flash sur Kunavo$1.05$5.25Actif — 40% au-dessus du tarif de lancement de Google ; utilisez 3.7 ou 3.8 Flash
Gemini 2.5 Flash sur Kunavo$0.09$0.75Disponible

Le tarif Kunavo de chaque modèle Gemini actuel à côté de celui de Google, ainsi que des exemples de coûts détaillés, figurent dans le guide de tarification de l'API Gemini.

API Gemini 3.8 Flash : prix et tarif de lancement de Google

Gemini 3.8 Flash est le Flash le plus récent de Google, lancé le 2 septembre 2026 et destiné au génie logiciel à long horizon et à l'exécution agentique, avec une fenêtre de contexte de 1,048,576 tokens et jusqu'à 65,536 tokens de sortie. Sur Kunavo, l'API Gemini 3.8 Flash coûte $0.525 en entrée / $2.625 en sortie par million de tokens, et s'appelle avec gemini-3-8-flash sur le même endpoint que tous les autres modèles.

Google applique un tarif de lancement de $0.75 / $3.75 par million de tokens pour ses modèles Flash 3.x — Flash 3.6, 3.7 et 3.8 — jusqu'au 31 décembre 2026, puis son tarif standard de $1.50 / $7.50 à partir du 1 janvier 2027. Par rapport au tarif actuellement facturé par Google, Gemini 3.8 Flash et Gemini 3.7 Flash de Kunavo ($0.525 / $2.625) sont 30% moins chers. Gemini 3.6 Flash ne l'est pas : à $1.05 / $5.25, il coûte 40% de plus que le tarif de lancement de Google ; ce sont donc Flash 3.7 et 3.8 qu'il faut utiliser — tous deux plus récents et moins chers.

Kunavo apporte une seule clé compatible avec OpenAI et un seul solde prépayé pour Gemini, Claude, GPT ainsi que les modèles d'image et de vidéo, sans projet Google Cloud ni frais pour les requêtes échouées. Ce qu'il n'apporte pas, c'est une capacité dédiée : Kunavo utilise une capacité partagée, sans quota dédié ni SLA contractuel ; si vous avez besoin de l'un ou l'autre, appelez directement Google.

Gemini 3.6 Flash — ce qui a changé

Gemini 3.6 Flash (lancé le 21 juillet 2026) était le premier Flash 3.x que nous pouvions proposer, et le modèle utilisé pour les mesures de tokens de raisonnement dans cette section. Le tarif standard de Google est de $1.50 en entrée / $7.50 en sortie par million de tokens — aux tarifs standard, le même prix d'entrée que Gemini 3.5 Flash, avec un tarif de sortie réduit d'environ 17 % — mais jusqu'au 31 décembre 2026 Google applique un tarif de lancement de $0.75 / $3.75. Google le présente comme adapté au travail agentique à long horizon, pour lequel il affirme réduire considérablement le coût en tokens des tâches d'ingénierie en plusieurs étapes.

Le nombre qui détermine réellement votre facture ne figure pas dans la liste de prix : 3.6 Flash réfléchit par défaut, et le raisonnement domine le compteur de sortie. Lors de nos tests, une réponse factuelle d'une phrase a consommé environ 120–140 tokens de raisonnement pour produire 7 tokens de sortie visibles. Les tokens de raisonnement sont facturés au tarif de sortie ; le coût réel d'une courte réponse de 3.6 Flash est donc plus proche de 150 tokens de sortie que de 7 — environ 20 fois l'estimation naïve. Deux conséquences pratiques :

  • Ne définissez pas une petite valeur pour max_tokens. Toute valeur inférieure à environ 150 est consommée par le raisonnement avant que le modèle n'émette une réponse, et vous recevez un fragment tronqué tout en payant le raisonnement.
  • Prévoyez un budget pour le raisonnement, pas pour la sortie visible. Pour les appels courts et à fort volume, un niveau Flash sans raisonnement est généralement moins cher en pratique, même avec un prix affiché par token plus élevé.

Gemini 3.6 Flash est toujours actif sur Kunavo en tant que gemini-3-6-flash à $1.05 / $5.25 par million, mais cela représente 40% de plus que les $0.75 / $3.75 facturés par Google jusqu'au 31 décembre 2026, et plus que le propre prix de Kunavo pour les modèles plus récents. Pour les nouveaux projets, appelez gemini-3-8-flash ou gemini-3-7-flash à $0.525 / $2.625, soit 30% sous le tarif de lancement de Google. Ce sont également des modèles à raisonnement ; prévoyez donc aussi une valeur généreuse pour max_tokens.

Appelez Gemini sur Kunavo dès aujourd'hui

Kunavo place Gemini derrière l'endpoint /v1/chat/completions compatible avec OpenAI — conservez le SDK OpenAI, modifiez base_url, sans projet Google Cloud. Cet appel utilise l'API Gemini 3.8 Flash ; remplacez la chaîne du modèle par gemini-3-7-flash, gemini-3-1-pro ou gemini-2-5-flash et rien d'autre ne change :

gemini_chat.py
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["KUNAVO_API_KEY"],
    base_url="https://api.kunavo.com/v1",
)

# Gemini 3.8 Flash is Google's newest Flash. Mind the max_tokens: the 3.x Flash
# models think before they answer and reasoning bills as output, so a small
# cap can be spent thinking and return a truncated answer.
resp = client.chat.completions.create(
    model="gemini-3-8-flash",
    max_tokens=1024,
    messages=[{"role": "user", "content": "Summarize this contract in 5 bullets."}],
)
print(resp.choices[0].message.content)

Obtenir une clé ne prend qu'une minute — consultez le guide des clés API Gemini. La même clé sk-kn- permet également d'accéder à Claude, GPT, l'image Nano Banana et la vidéo Veo 3.

Quel niveau Gemini devez-vous appeler ?

  • Charges avec long contexte et raisonnement — gemini-3-1-pro à $0.70 en entrée / $4.20 en sortie. C'est le niveau phare de Google pour le code, les agents et l'analyse intermodale, ainsi que le niveau Pro que nous proposons.
  • Travail agentique avec raisonnement à chaque étape — gemini-3-8-flash à $0.525 / $2.625, 30% sous le tarif de lancement de Google, ou gemini-3-7-flash au même prix si vos prompts sont validés avec ce modèle. Raisonnement avec la latence de Flash ; prévoyez un budget pour les tokens de raisonnement, pas pour la sortie visible.
  • Appels à fort volume sensibles à la latence — gemini-2-5-flash à $0.09 en entrée / $0.75 en sortie reste l'option la plus rentable ; il ne raisonne pas par défaut, ce qui explique précisément son faible coût pour les réponses courtes.
  • Pas Flash 3.6, au vu du prix — gemini-3-6-flash à $1.05 / $5.25 coûte plus cher que Flash 3.7 et 3.8 sur Kunavo et plus cher que le propre tarif de lancement de Google ; conservez-le uniquement pour les prompts déjà validés avec ce modèle.
  • Développement en prévision de la prochaine mise à niveau — codez selon le format compatible avec OpenAI et traitez la chaîne du modèle comme une configuration ; les nouveaux slugs Gemini arrivent derrière le même endpoint.

Questions fréquentes

Qu'est-ce que l'API Gemini 3 ?

Gemini 3 est la famille de modèles actuelle de Google — Gemini 3 Pro et 3.1 Pro, Gemini 3 Flash, ainsi que les nouveaux Gemini 3.6, 3.7 et 3.8 Flash — nativement multimodale, avec un contexte d'un million de tokens et un raisonnement par chaîne de pensée. L'API Gemini 3 permet de l'appeler par programmation : directement via Google AI Studio / Vertex AI, ou par l'intermédiaire d'une passerelle compatible avec OpenAI telle que Kunavo, qui propose aujourd'hui Gemini 3.1 Pro ainsi que les modèles Flash 3.6, 3.7 et 3.8.

Puis-je appeler l'API Gemini 3 sur Kunavo aujourd'hui ?

Oui. Gemini 3.1 Pro est disponible en production sous la forme gemini-3-1-pro, à $0.70 en entrée / $4.20 en sortie par million — environ 65 % de moins que les tarifs catalogue de Google, $2.00 / $12.00 — et c’est le niveau Pro à privilégier. Côté Flash, Gemini 3.8 Flash (gemini-3-8-flash) est le plus récent, à $0.525 / $2.625, soit 30 % de moins que les tarifs de lancement $0.75 / $3.75 facturés par Google pour le Flash 3.x jusqu’au 31 décembre 2026 ; Gemini 3.7 Flash (gemini-3-7-flash) est au même prix, et Gemini 3.6 Flash (gemini-3-6-flash) reste proposé à $1.05 / $5.25, au-dessus du tarif de lancement de Google. Ils utilisent tous l’endpoint compatible avec OpenAI, sans nécessiter de projet Google Cloud. Les slugs gemini-3-pro et gemini-3-flash d’origine restent réservés et désactivés — les sources en amont que nous avons testées n’atteignent pas notre seuil de fiabilité (503 persistants, gestion incorrecte des paramètres).

Combien coûte l'API Gemini 3 ?

La tarification officielle de Google est de $2.00 en entrée / $12.00 en sortie par million de tokens pour Gemini 3 Pro et 3.1 Pro (jusqu'à 200k de contexte), et de $0.50 / $3.00 pour Gemini 3 Flash. Pour Gemini 3.6, 3.7 et 3.8 Flash, Google applique un tarif de lancement de $0.75 / $3.75 jusqu'au 31 décembre 2026, puis son tarif standard de $1.50 / $7.50 à partir du 1 janvier 2027. Sur Kunavo, vous payez $0.70 / $4.20 pour Gemini 3.1 Pro (environ 65% sous le tarif officiel), $0.525 / $2.625 pour Gemini 3.8 Flash et Gemini 3.7 Flash (30% sous le tarif de lancement de Google), et $1.05 / $5.25 pour Gemini 3.6 Flash, ce qui est supérieur au tarif de lancement de Google.

Quel Gemini 3 Flash dois-je utiliser — 3.6, 3.7 ou 3.8 ?

Utilisez Gemini 3.8 Flash (gemini-3-8-flash) pour les nouveaux projets : c'est le Flash le plus récent de Google, lancé le 2 septembre 2026, et sur Kunavo il coûte $0.525 / $2.625 par million de tokens — 30% sous les $0.75 / $3.75 facturés aujourd'hui par Google. Gemini 3.7 Flash (gemini-3-7-flash) coûte le même prix et convient aux prompts déjà validés avec ce modèle. Gemini 3.6 Flash, à $1.05 / $5.25, coûte plus cher que les deux autres et 40% de plus que le tarif de lancement de Google ; ce n'est donc pas celui à choisir pour des raisons de prix.

Combien coûte l'API Gemini 3.6 Flash ?

Le tarif standard de Google pour Gemini 3.6 Flash est de $1.50 par million de jetons d’entrée et de $7.50 par million de jetons de sortie à partir du 1 janvier 2027 ; jusqu’au 31 décembre 2026, Google facture un tarif de lancement de $0.75 / $3.75. Sur Kunavo, gemini-3-6-flash coûte $1.05 / $5.25 — soit 40 % de plus que le tarif de lancement de Google — ; Gemini 3.8 ou 3.7 Flash, tous deux plus récents et proposés à $0.525 / $2.625 sur Kunavo, constitue donc un meilleur achat. La liste de prix sous-estime également le coût réel, car 3.6 Flash raisonne par défaut et les jetons de raisonnement sont facturés au tarif de sortie : lors des tests, une réponse d’une phrase a consommé environ 120 à 140 jetons de raisonnement pour produire 7 jetons de sortie visibles. Prévoyez le budget en fonction des jetons de raisonnement plutôt que de la sortie visible, et évitez une valeur max_tokens inférieure à environ 150, sinon le budget de raisonnement consomme la réponse avant l’émission d’un résultat.

Comment obtenir une clé API Gemini 3 ?

Google AI Studio pour obtenir une clé directe, ou une seule clé Kunavo couvrant Gemini 3.1 Pro, les modèles Flash 3.x et 2.5 Flash aujourd'hui — ainsi que Claude et GPT — consultez le guide des clés.

Quels identifiants de modèles Gemini 3 sont actifs sur Kunavo ?

gemini-3-8-flash (le Flash le plus récent, $0.525 / $2.625 par million), gemini-3-7-flash, gemini-3-6-flash et gemini-3-1-pro ($0.70 / $4.20) sont actifs sur Kunavo. Seuls les slugs d'origine gemini-3-pro et gemini-3-flash restent réservés, jusqu'à ce qu'une source atteigne notre seuil de fiabilité.