Gemini 3.6 FlashAPI
Google's newest Flash — thinking-by-default at Flash latency, 1M context, native audio input.
Tarif input
$1.05
per 1M tokens
Tarif output
$5.25
per 1M tokens
Prompt caching
Passez cache_control sur les préfixes stables — les hits de cache sont facturés à une fraction du tarif d'input. Les écritures restent au tarif d'input normal.
Calculé automatiquement comme input × 0.2
Spécifications
- ID du modèle
gemini-3-6-flash- Endpoint
POST /v1/chat/completions- Catégorie
- Text
- Fournisseur
- Capacités
- visionfunctionstreamingthinkinglong-context
Compatibilité OpenAI drop-in
Pointez votre SDK OpenAI existant sur api.kunavo.com/v1 et changez l'ID du modèle. Pas de changement de streaming, pas de nouveau SDK.
Voir la docGemini API pricing guideEssayez vous-même
Récupérez KUNAVO_API_KEY depuis /app/keys puis exécutez le snippet ci-dessous.
curl https://api.kunavo.com/v1/chat/completions \
-H "Authorization: Bearer $KUNAVO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3-6-flash",
"messages": [
{"role": "user", "content": "Hello, Gemini 3.6 Flash"}
],
"stream": false
}'Kunavo vs appel direct à Google
Le même Gemini 3.6 Flash, les mêmes réponses. Une passerelle change le compte, le SDK et la facture — voici la comparaison honnête.
| Kunavo | Google en direct | |
|---|---|---|
| Prix (per 1M tokens) | $1.05 / $5.25 (−30%) | $1.50 / $7.50 |
| Compte | Un compte Kunavo, clé en 2 minutes, recharge minimale de $5 | Un compte Google et sa propre configuration de facturation |
| SDK | Gardez le SDK OpenAI — changez base_url, mettez model sur "gemini-3-6-flash" | Le SDK de Google, ou sa couche compatible OpenAI si elle existe |
| La même clé donne aussi accès à | Claude, Gemini, GPT ainsi que les modèles image, vidéo et audio | Uniquement le catalogue de Google |
| Facturation | Un seul solde Stripe, paiement à l'usage, sans expiration ; les requêtes échouées ne sont pas facturées | Une facture distincte par fournisseur |
| Limites de débit | Capacité de passerelle partagée, sans limite contractuelle par compte | Les limites de palier de Google, relevées selon l'historique ou le contrat |
Passez en direct chez Google s'il vous faut une limite de débit contractuelle, un SLA entreprise ou une fonctionnalité exclusive dès le premier jour. Kunavo convient si vous voulez une seule clé, une seule facture et un tarif au token plus bas chez tous les fournisseurs.
FAQ
How much does Gemini 3.6 Flash cost?
On Kunavo, Gemini 3.6 Flash is $1.05 per 1M input tokens and $5.25 per 1M output tokens — about 30% under Google's official price. Failed requests are never billed, and it's pay-as-you-go — you only pay for successful calls.
Can I call Gemini 3.6 Flash with the OpenAI SDK?
Yes. Set base_url to https://api.kunavo.com/v1, pass your Kunavo key, and set model to "gemini-3-6-flash". Requests and responses are OpenAI-compatible.
What endpoint does Gemini 3.6 Flash use?
Gemini 3.6 Flash is called via POST /v1/chat/completions on Kunavo's OpenAI-compatible API.
What is Gemini 3.6 Flash good for?
Gemini 3.6 Flash is a text model from Google, with support for vision, function, streaming, thinking, long-context.
What is different from calling Google directly?
The model is the same, at about 30% under Google's list price. What changes is around it: one key and one Stripe balance instead of a Google account with its own billing, the OpenAI SDK with base_url swapped instead of a provider-specific SDK, and the same key also reaching Claude, Gemini, GPT, image, video and audio models. The tradeoff is that gateway capacity is shared — if you need a contractual rate limit or an enterprise SLA on Gemini 3.6 Flash specifically, go direct to Google.
Is Gemini 3.6 Flash cheaper on Kunavo?
Yes — Gemini 3.6 Flash is about 30% under Google's official list price on Kunavo, with no subscription and no minimum monthly spend. You pay per token from a $5 top-up, failed requests are never billed, and the balance never expires.