Voltar ao catálogo
Google·Textnew30 %+ abaixo do oficial

Gemini 3.6 FlashAPI

Google's newest Flash — thinking-by-default at Flash latency, 1M context, native audio input.

Preço input

$1.05

per 1M tokens

Preço output

$5.25

per 1M tokens

Prompt caching

Passe cache_control em prefixos estáveis — hits de cache são cobrados a uma fração do preço de input. Escritas de cache sempre na taxa normal de input.

Leitura cache
$0.21

Calculado automaticamente como input × 0.2

Especificações

Modelo ID
gemini-3-6-flash
Endpoint
POST /v1/chat/completions
Categoria
Text
Provedor
Google
Capabilities
visionfunctionstreamingthinkinglong-context

Compatibilidade drop-in com OpenAI

Aponte seu SDK OpenAI existente para api.kunavo.com/v1 e troque o ID do modelo. Sem mudança de streaming, sem SDK novo.

Ver docGemini API pricing guide

Teste você mesmo

Configure KUNAVO_API_KEY em /app/keys e rode o snippet abaixo.

curl
curl https://api.kunavo.com/v1/chat/completions \
  -H "Authorization: Bearer $KUNAVO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3-6-flash",
    "messages": [
      {"role": "user", "content": "Hello, Gemini 3.6 Flash"}
    ],
    "stream": false
  }'

Kunavo vs chamar a Google diretamente

O mesmo Gemini 3.6 Flash, as mesmas respostas. O que um gateway muda é a conta, o SDK e a fatura — esta é a comparação honesta.

KunavoGoogle direto
Preço (per 1M tokens)$1.05 / $5.25 (−30%)$1.50 / $7.50
ContaUma conta Kunavo, chave em 2 minutos, recarga mínima de $5Uma conta na Google com a configuração de cobrança dela
SDKMantenha o SDK da OpenAI — troque a base_url e defina model como "gemini-3-6-flash"O SDK da própria Google, ou a camada compatível com OpenAI quando houver
A mesma chave também alcançaClaude, Gemini, GPT e modelos de imagem, vídeo e áudioApenas o catálogo da Google
CobrançaUm saldo Stripe, pré-pago por uso, que nunca expira; requisições com falha não são cobradasUma fatura separada por provedor
Limites de taxaCapacidade de gateway compartilhada, sem limite contratual por contaOs limites de tier da Google, elevados por histórico de uso ou contrato

Vá direto à Google se você precisa de limite de taxa contratual, SLA empresarial ou de um recurso exclusivo do provedor logo no primeiro dia. A Kunavo faz sentido se você quer uma chave, uma fatura e um preço por token menor em todos os provedores.

FAQ

How much does Gemini 3.6 Flash cost?

On Kunavo, Gemini 3.6 Flash is $1.05 per 1M input tokens and $5.25 per 1M output tokens — about 30% under Google's official price. Failed requests are never billed, and it's pay-as-you-go — you only pay for successful calls.

Can I call Gemini 3.6 Flash with the OpenAI SDK?

Yes. Set base_url to https://api.kunavo.com/v1, pass your Kunavo key, and set model to "gemini-3-6-flash". Requests and responses are OpenAI-compatible.

What endpoint does Gemini 3.6 Flash use?

Gemini 3.6 Flash is called via POST /v1/chat/completions on Kunavo's OpenAI-compatible API.

What is Gemini 3.6 Flash good for?

Gemini 3.6 Flash is a text model from Google, with support for vision, function, streaming, thinking, long-context.

What is different from calling Google directly?

The model is the same, at about 30% under Google's list price. What changes is around it: one key and one Stripe balance instead of a Google account with its own billing, the OpenAI SDK with base_url swapped instead of a provider-specific SDK, and the same key also reaching Claude, Gemini, GPT, image, video and audio models. The tradeoff is that gateway capacity is shared — if you need a contractual rate limit or an enterprise SLA on Gemini 3.6 Flash specifically, go direct to Google.

Is Gemini 3.6 Flash cheaper on Kunavo?

Yes — Gemini 3.6 Flash is about 30% under Google's official list price on Kunavo, with no subscription and no minimum monthly spend. You pay per token from a $5 top-up, failed requests are never billed, and the balance never expires.