Gemini 3.6 FlashAPI
Google's newest Flash — thinking-by-default at Flash latency, 1M context, native audio input.
Preço input
$1.05
per 1M tokens
Preço output
$5.25
per 1M tokens
Prompt caching
Passe cache_control em prefixos estáveis — hits de cache são cobrados a uma fração do preço de input. Escritas de cache sempre na taxa normal de input.
Calculado automaticamente como input × 0.2
Especificações
- Modelo ID
gemini-3-6-flash- Endpoint
POST /v1/chat/completions- Categoria
- Text
- Provedor
- Capabilities
- visionfunctionstreamingthinkinglong-context
Compatibilidade drop-in com OpenAI
Aponte seu SDK OpenAI existente para api.kunavo.com/v1 e troque o ID do modelo. Sem mudança de streaming, sem SDK novo.
Ver docGemini API pricing guideTeste você mesmo
Configure KUNAVO_API_KEY em /app/keys e rode o snippet abaixo.
curl https://api.kunavo.com/v1/chat/completions \
-H "Authorization: Bearer $KUNAVO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3-6-flash",
"messages": [
{"role": "user", "content": "Hello, Gemini 3.6 Flash"}
],
"stream": false
}'Kunavo vs chamar a Google diretamente
O mesmo Gemini 3.6 Flash, as mesmas respostas. O que um gateway muda é a conta, o SDK e a fatura — esta é a comparação honesta.
| Kunavo | Google direto | |
|---|---|---|
| Preço (per 1M tokens) | $1.05 / $5.25 (−30%) | $1.50 / $7.50 |
| Conta | Uma conta Kunavo, chave em 2 minutos, recarga mínima de $5 | Uma conta na Google com a configuração de cobrança dela |
| SDK | Mantenha o SDK da OpenAI — troque a base_url e defina model como "gemini-3-6-flash" | O SDK da própria Google, ou a camada compatível com OpenAI quando houver |
| A mesma chave também alcança | Claude, Gemini, GPT e modelos de imagem, vídeo e áudio | Apenas o catálogo da Google |
| Cobrança | Um saldo Stripe, pré-pago por uso, que nunca expira; requisições com falha não são cobradas | Uma fatura separada por provedor |
| Limites de taxa | Capacidade de gateway compartilhada, sem limite contratual por conta | Os limites de tier da Google, elevados por histórico de uso ou contrato |
Vá direto à Google se você precisa de limite de taxa contratual, SLA empresarial ou de um recurso exclusivo do provedor logo no primeiro dia. A Kunavo faz sentido se você quer uma chave, uma fatura e um preço por token menor em todos os provedores.
FAQ
How much does Gemini 3.6 Flash cost?
On Kunavo, Gemini 3.6 Flash is $1.05 per 1M input tokens and $5.25 per 1M output tokens — about 30% under Google's official price. Failed requests are never billed, and it's pay-as-you-go — you only pay for successful calls.
Can I call Gemini 3.6 Flash with the OpenAI SDK?
Yes. Set base_url to https://api.kunavo.com/v1, pass your Kunavo key, and set model to "gemini-3-6-flash". Requests and responses are OpenAI-compatible.
What endpoint does Gemini 3.6 Flash use?
Gemini 3.6 Flash is called via POST /v1/chat/completions on Kunavo's OpenAI-compatible API.
What is Gemini 3.6 Flash good for?
Gemini 3.6 Flash is a text model from Google, with support for vision, function, streaming, thinking, long-context.
What is different from calling Google directly?
The model is the same, at about 30% under Google's list price. What changes is around it: one key and one Stripe balance instead of a Google account with its own billing, the OpenAI SDK with base_url swapped instead of a provider-specific SDK, and the same key also reaching Claude, Gemini, GPT, image, video and audio models. The tradeoff is that gateway capacity is shared — if you need a contractual rate limit or an enterprise SLA on Gemini 3.6 Flash specifically, go direct to Google.
Is Gemini 3.6 Flash cheaper on Kunavo?
Yes — Gemini 3.6 Flash is about 30% under Google's official list price on Kunavo, with no subscription and no minimum monthly spend. You pay per token from a $5 top-up, failed requests are never billed, and the balance never expires.