Retour au catalogue
Google·Textnew30 %+ sous l'officiel

Gemini 3.6 FlashAPI

Google's newest Flash — thinking-by-default at Flash latency, 1M context, native audio input.

Tarif input

$1.05

per 1M tokens

Tarif output

$5.25

per 1M tokens

Prompt caching

Passez cache_control sur les préfixes stables — les hits de cache sont facturés à une fraction du tarif d'input. Les écritures restent au tarif d'input normal.

Lecture cache
$0.21

Calculé automatiquement comme input × 0.2

Spécifications

ID du modèle
gemini-3-6-flash
Endpoint
POST /v1/chat/completions
Catégorie
Text
Fournisseur
Google
Capacités
visionfunctionstreamingthinkinglong-context

Compatibilité OpenAI drop-in

Pointez votre SDK OpenAI existant sur api.kunavo.com/v1 et changez l'ID du modèle. Pas de changement de streaming, pas de nouveau SDK.

Voir la docGemini API pricing guide

Essayez vous-même

Récupérez KUNAVO_API_KEY depuis /app/keys puis exécutez le snippet ci-dessous.

curl
curl https://api.kunavo.com/v1/chat/completions \
  -H "Authorization: Bearer $KUNAVO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3-6-flash",
    "messages": [
      {"role": "user", "content": "Hello, Gemini 3.6 Flash"}
    ],
    "stream": false
  }'

Kunavo vs appel direct à Google

Le même Gemini 3.6 Flash, les mêmes réponses. Une passerelle change le compte, le SDK et la facture — voici la comparaison honnête.

KunavoGoogle en direct
Prix (per 1M tokens)$1.05 / $5.25 (−30%)$1.50 / $7.50
CompteUn compte Kunavo, clé en 2 minutes, recharge minimale de $5Un compte Google et sa propre configuration de facturation
SDKGardez le SDK OpenAI — changez base_url, mettez model sur "gemini-3-6-flash"Le SDK de Google, ou sa couche compatible OpenAI si elle existe
La même clé donne aussi accès àClaude, Gemini, GPT ainsi que les modèles image, vidéo et audioUniquement le catalogue de Google
FacturationUn seul solde Stripe, paiement à l'usage, sans expiration ; les requêtes échouées ne sont pas facturéesUne facture distincte par fournisseur
Limites de débitCapacité de passerelle partagée, sans limite contractuelle par compteLes limites de palier de Google, relevées selon l'historique ou le contrat

Passez en direct chez Google s'il vous faut une limite de débit contractuelle, un SLA entreprise ou une fonctionnalité exclusive dès le premier jour. Kunavo convient si vous voulez une seule clé, une seule facture et un tarif au token plus bas chez tous les fournisseurs.

FAQ

How much does Gemini 3.6 Flash cost?

On Kunavo, Gemini 3.6 Flash is $1.05 per 1M input tokens and $5.25 per 1M output tokens — about 30% under Google's official price. Failed requests are never billed, and it's pay-as-you-go — you only pay for successful calls.

Can I call Gemini 3.6 Flash with the OpenAI SDK?

Yes. Set base_url to https://api.kunavo.com/v1, pass your Kunavo key, and set model to "gemini-3-6-flash". Requests and responses are OpenAI-compatible.

What endpoint does Gemini 3.6 Flash use?

Gemini 3.6 Flash is called via POST /v1/chat/completions on Kunavo's OpenAI-compatible API.

What is Gemini 3.6 Flash good for?

Gemini 3.6 Flash is a text model from Google, with support for vision, function, streaming, thinking, long-context.

What is different from calling Google directly?

The model is the same, at about 30% under Google's list price. What changes is around it: one key and one Stripe balance instead of a Google account with its own billing, the OpenAI SDK with base_url swapped instead of a provider-specific SDK, and the same key also reaching Claude, Gemini, GPT, image, video and audio models. The tradeoff is that gateway capacity is shared — if you need a contractual rate limit or an enterprise SLA on Gemini 3.6 Flash specifically, go direct to Google.

Is Gemini 3.6 Flash cheaper on Kunavo?

Yes — Gemini 3.6 Flash is about 30% under Google's official list price on Kunavo, with no subscription and no minimum monthly spend. You pay per token from a $5 top-up, failed requests are never billed, and the balance never expires.