Torna al catalogo
Google·Textnew30 %+ sotto l'ufficiale

Gemini 3.6 FlashAPI

Google's newest Flash — thinking-by-default at Flash latency, 1M context, native audio input.

Prezzo input

$1.05

per 1M tokens

Prezzo output

$5.25

per 1M tokens

Prompt caching

Passa cache_control sui prefix stabili — gli hit di cache vengono fatturati a una frazione del prezzo di input. Le scritture di cache restano alla tariffa di input normale.

Lettura cache
$0.21

Calcolato automaticamente come input × 0.2

Specifiche

ID modello
gemini-3-6-flash
Endpoint
POST /v1/chat/completions
Categoria
Text
Provider
Google
Capability
visionfunctionstreamingthinkinglong-context

Compatibilità OpenAI drop-in

Punta il tuo SDK OpenAI esistente a api.kunavo.com/v1 e sostituisci l'ID del modello. Niente cambi di streaming, nessun nuovo SDK.

Vedi la docGemini API pricing guide

Provalo tu stesso

Imposta KUNAVO_API_KEY da /app/keys ed esegui lo snippet sotto.

curl
curl https://api.kunavo.com/v1/chat/completions \
  -H "Authorization: Bearer $KUNAVO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3-6-flash",
    "messages": [
      {"role": "user", "content": "Hello, Gemini 3.6 Flash"}
    ],
    "stream": false
  }'

Kunavo rispetto a chiamare Google direttamente

Stesso Gemini 3.6 Flash, stesse risposte. Un gateway cambia l'account, l'SDK e la fattura — ecco il confronto onesto.

KunavoGoogle diretto
Prezzo (per 1M tokens)$1.05 / $5.25 (−30%)$1.50 / $7.50
AccountUn account Kunavo, chiave in 2 minuti, ricarica minima di $5Un account Google con la sua configurazione di fatturazione
SDKTieni l'SDK OpenAI — cambia base_url e imposta model su "gemini-3-6-flash"L'SDK di Google, o il suo livello compatibile con OpenAI se disponibile
La stessa chiave raggiunge ancheClaude, Gemini, GPT più modelli di immagine, video e audioSolo il catalogo di Google
FatturazioneUn unico saldo Stripe, a consumo, che non scade; le richieste fallite non sono addebitateUna fattura separata per ogni provider
Limiti di frequenzaCapacità del gateway condivisa, nessun limite contrattuale per accountI limiti di livello di Google, alzabili con lo storico d'uso o un contratto

Vai direttamente su Google se ti serve un limite di frequenza contrattuale, uno SLA enterprise o una funzione esclusiva del provider dal primo giorno. Kunavo conviene se vuoi una chiave, una fattura e un prezzo per token più basso su tutti i provider.

FAQ

How much does Gemini 3.6 Flash cost?

On Kunavo, Gemini 3.6 Flash is $1.05 per 1M input tokens and $5.25 per 1M output tokens — about 30% under Google's official price. Failed requests are never billed, and it's pay-as-you-go — you only pay for successful calls.

Can I call Gemini 3.6 Flash with the OpenAI SDK?

Yes. Set base_url to https://api.kunavo.com/v1, pass your Kunavo key, and set model to "gemini-3-6-flash". Requests and responses are OpenAI-compatible.

What endpoint does Gemini 3.6 Flash use?

Gemini 3.6 Flash is called via POST /v1/chat/completions on Kunavo's OpenAI-compatible API.

What is Gemini 3.6 Flash good for?

Gemini 3.6 Flash is a text model from Google, with support for vision, function, streaming, thinking, long-context.

What is different from calling Google directly?

The model is the same, at about 30% under Google's list price. What changes is around it: one key and one Stripe balance instead of a Google account with its own billing, the OpenAI SDK with base_url swapped instead of a provider-specific SDK, and the same key also reaching Claude, Gemini, GPT, image, video and audio models. The tradeoff is that gateway capacity is shared — if you need a contractual rate limit or an enterprise SLA on Gemini 3.6 Flash specifically, go direct to Google.

Is Gemini 3.6 Flash cheaper on Kunavo?

Yes — Gemini 3.6 Flash is about 30% under Google's official list price on Kunavo, with no subscription and no minimum monthly spend. You pay per token from a $5 top-up, failed requests are never billed, and the balance never expires.