Volver al catálogo
Google·Textnew30 %+ bajo oficial

Gemini 3.6 FlashAPI

Google's newest Flash — thinking-by-default at Flash latency, 1M context, native audio input.

Precio input

$1.05

per 1M tokens

Precio output

$5.25

per 1M tokens

Prompt caching

Pasa cache_control en prefijos estables — los hits de caché se facturan a una fracción del precio de input. Las escrituras de caché siempre al precio de input normal.

Lectura caché
$0.21

Calculado automáticamente como input × 0.2

Especificaciones

ID del modelo
gemini-3-6-flash
Endpoint
POST /v1/chat/completions
Categoría
Text
Proveedor
Google
Capacidades
visionfunctionstreamingthinkinglong-context

Compatibilidad OpenAI drop-in

Apunta tu SDK de OpenAI a api.kunavo.com/v1 y cambia el ID del modelo. Sin cambios de streaming, sin SDK nuevo.

Ver docGemini API pricing guide

Pruébalo tú mismo

Configura KUNAVO_API_KEY desde /app/keys y ejecuta el snippet de abajo.

curl
curl https://api.kunavo.com/v1/chat/completions \
  -H "Authorization: Bearer $KUNAVO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3-6-flash",
    "messages": [
      {"role": "user", "content": "Hello, Gemini 3.6 Flash"}
    ],
    "stream": false
  }'

Kunavo frente a llamar a Google directamente

El mismo Gemini 3.6 Flash, las mismas respuestas. Lo que cambia una pasarela es la cuenta, el SDK y la factura — esta es la comparación honesta.

KunavoGoogle directo
Precio (per 1M tokens)$1.05 / $5.25 (−30%)$1.50 / $7.50
CuentaUna cuenta de Kunavo, clave en 2 minutos, recarga mínima de $5Una cuenta de Google con su propia configuración de facturación
SDKConserva el SDK de OpenAI — cambia base_url y pon model en "gemini-3-6-flash"El SDK propio de Google, o su capa compatible con OpenAI si la ofrece
La misma clave también llega aClaude, Gemini, GPT y modelos de imagen, vídeo y audioSolo el catálogo de Google
FacturaciónUn solo saldo de Stripe, pago por uso, sin caducidad; las peticiones fallidas no se cobranUna factura independiente por proveedor
Límites de tasaCapacidad de pasarela compartida, sin límite contractual por cuentaLos límites por nivel de Google, ampliables por historial o contrato

Ve directo a Google si necesitas un límite de tasa contractual, un SLA empresarial o una función exclusiva del proveedor desde el primer día. Kunavo encaja si quieres una clave, una factura y un precio por token más bajo en todos los proveedores.

FAQ

How much does Gemini 3.6 Flash cost?

On Kunavo, Gemini 3.6 Flash is $1.05 per 1M input tokens and $5.25 per 1M output tokens — about 30% under Google's official price. Failed requests are never billed, and it's pay-as-you-go — you only pay for successful calls.

Can I call Gemini 3.6 Flash with the OpenAI SDK?

Yes. Set base_url to https://api.kunavo.com/v1, pass your Kunavo key, and set model to "gemini-3-6-flash". Requests and responses are OpenAI-compatible.

What endpoint does Gemini 3.6 Flash use?

Gemini 3.6 Flash is called via POST /v1/chat/completions on Kunavo's OpenAI-compatible API.

What is Gemini 3.6 Flash good for?

Gemini 3.6 Flash is a text model from Google, with support for vision, function, streaming, thinking, long-context.

What is different from calling Google directly?

The model is the same, at about 30% under Google's list price. What changes is around it: one key and one Stripe balance instead of a Google account with its own billing, the OpenAI SDK with base_url swapped instead of a provider-specific SDK, and the same key also reaching Claude, Gemini, GPT, image, video and audio models. The tradeoff is that gateway capacity is shared — if you need a contractual rate limit or an enterprise SLA on Gemini 3.6 Flash specifically, go direct to Google.

Is Gemini 3.6 Flash cheaper on Kunavo?

Yes — Gemini 3.6 Flash is about 30% under Google's official list price on Kunavo, with no subscription and no minimum monthly spend. You pay per token from a $5 top-up, failed requests are never billed, and the balance never expires.