Gemini 3.6 FlashAPI
Google's newest Flash — thinking-by-default at Flash latency, 1M context, native audio input.
Prezzo input
$1.05
per 1M tokens
Prezzo output
$5.25
per 1M tokens
Prompt caching
Passa cache_control sui prefix stabili — gli hit di cache vengono fatturati a una frazione del prezzo di input. Le scritture di cache restano alla tariffa di input normale.
Calcolato automaticamente come input × 0.2
Specifiche
- ID modello
gemini-3-6-flash- Endpoint
POST /v1/chat/completions- Categoria
- Text
- Provider
- Capability
- visionfunctionstreamingthinkinglong-context
Compatibilità OpenAI drop-in
Punta il tuo SDK OpenAI esistente a api.kunavo.com/v1 e sostituisci l'ID del modello. Niente cambi di streaming, nessun nuovo SDK.
Vedi la docGemini API pricing guideProvalo tu stesso
Imposta KUNAVO_API_KEY da /app/keys ed esegui lo snippet sotto.
curl https://api.kunavo.com/v1/chat/completions \
-H "Authorization: Bearer $KUNAVO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3-6-flash",
"messages": [
{"role": "user", "content": "Hello, Gemini 3.6 Flash"}
],
"stream": false
}'Kunavo rispetto a chiamare Google direttamente
Stesso Gemini 3.6 Flash, stesse risposte. Un gateway cambia l'account, l'SDK e la fattura — ecco il confronto onesto.
| Kunavo | Google diretto | |
|---|---|---|
| Prezzo (per 1M tokens) | $1.05 / $5.25 (−30%) | $1.50 / $7.50 |
| Account | Un account Kunavo, chiave in 2 minuti, ricarica minima di $5 | Un account Google con la sua configurazione di fatturazione |
| SDK | Tieni l'SDK OpenAI — cambia base_url e imposta model su "gemini-3-6-flash" | L'SDK di Google, o il suo livello compatibile con OpenAI se disponibile |
| La stessa chiave raggiunge anche | Claude, Gemini, GPT più modelli di immagine, video e audio | Solo il catalogo di Google |
| Fatturazione | Un unico saldo Stripe, a consumo, che non scade; le richieste fallite non sono addebitate | Una fattura separata per ogni provider |
| Limiti di frequenza | Capacità del gateway condivisa, nessun limite contrattuale per account | I limiti di livello di Google, alzabili con lo storico d'uso o un contratto |
Vai direttamente su Google se ti serve un limite di frequenza contrattuale, uno SLA enterprise o una funzione esclusiva del provider dal primo giorno. Kunavo conviene se vuoi una chiave, una fattura e un prezzo per token più basso su tutti i provider.
FAQ
How much does Gemini 3.6 Flash cost?
On Kunavo, Gemini 3.6 Flash is $1.05 per 1M input tokens and $5.25 per 1M output tokens — about 30% under Google's official price. Failed requests are never billed, and it's pay-as-you-go — you only pay for successful calls.
Can I call Gemini 3.6 Flash with the OpenAI SDK?
Yes. Set base_url to https://api.kunavo.com/v1, pass your Kunavo key, and set model to "gemini-3-6-flash". Requests and responses are OpenAI-compatible.
What endpoint does Gemini 3.6 Flash use?
Gemini 3.6 Flash is called via POST /v1/chat/completions on Kunavo's OpenAI-compatible API.
What is Gemini 3.6 Flash good for?
Gemini 3.6 Flash is a text model from Google, with support for vision, function, streaming, thinking, long-context.
What is different from calling Google directly?
The model is the same, at about 30% under Google's list price. What changes is around it: one key and one Stripe balance instead of a Google account with its own billing, the OpenAI SDK with base_url swapped instead of a provider-specific SDK, and the same key also reaching Claude, Gemini, GPT, image, video and audio models. The tradeoff is that gateway capacity is shared — if you need a contractual rate limit or an enterprise SLA on Gemini 3.6 Flash specifically, go direct to Google.
Is Gemini 3.6 Flash cheaper on Kunavo?
Yes — Gemini 3.6 Flash is about 30% under Google's official list price on Kunavo, with no subscription and no minimum monthly spend. You pay per token from a $5 top-up, failed requests are never billed, and the balance never expires.