Volver a las guías
Modelos·2 de julio de 2026·Actualizado el 12 de septiembre de 2026·7 min de lectura

API de Gemini 3: precios, disponibilidad y cómo llamar a Gemini hoy

Gemini 3 es la familia actual de Google: 3 Pro, 3.1 Pro y una línea Flash que llega hasta Gemini 3.8 Flash. Estos son sus precios de API con las tarifas de lista y de introducción de Google, qué identificadores están activos en Kunavo y el código compatible con OpenAI para llamarlos hoy.

Última revisión: .

Gemini 3 es la familia de modelos actual de Google: Gemini 3 Pro y Gemini 3.1 Pro en la cima, y una línea Flash que va de Gemini 3 Flash a Gemini 3.8 Flash; es multimodal de forma nativa, con un contexto de 1M de tokens y razonamiento de cadena de pensamiento. Hoy puedes llamar a la API de Gemini 3 en Kunavo mediante un único endpoint compatible con OpenAI: Gemini 3.1 Pro a $0.70 / $4.20 por 1M de tokens, aproximadamente un 65% por debajo de la lista de Google de $2.00 / $12.00, y Gemini 3.8 Flash, el Flash más reciente, a $0.525 / $2.625; un 30% por debajo de los $0.75 / $3.75 introductorios que Google cobra por Flash 3.x mediante December 31, 2026. Esta guía explica cuánto cuesta cada nivel, qué slugs están activos y el código para llamarlos.

Nota de disponibilidad. El nivel Gemini 3 Pro está activo en Kunavo: gemini-3-1-pro funciona a $0.70 / $4.20 por 1M, aproximadamente un 65% por debajo de la lista de Google de $2.00 / $12.00. En el lado Flash, gemini-3-8-flash ($0.525 / $2.625) es el más reciente, gemini-3-7-flash ($0.525 / $2.625) es la versión anterior y gemini-3-6-flash ($1.05 / $5.25) aún se ofrece, aunque ahora cuesta más que ambos y más que la tarifa introductoria de Google. Dos slugs permanecen reservados y desactivados: el gemini-3-pro original y gemini-3-flash, porque las fuentes upstream que probamos no cumplen nuestro estándar de fiabilidad: 503 persistentes y gestión incorrecta de parámetros (una fuente ignora por completo maxOutputTokens). Activamos un slug solo cuando una fuente supera esas pruebas. Gemini 2.5 Flash también sigue activo en el mismo endpoint.

Precios de la API de Gemini 3

Las tarifas oficiales de Google para la familia, junto al coste de cada nivel en Kunavo. Para los modelos Flash 3.x, Google cobra una tarifa introductoria hasta December 31, 2026, así que la tabla muestra esa tarifa —la que pagarías contratando directamente hoy— junto a la tarifa estándar que la sustituye:

ModeloEntrada / 1MSalida / 1MEstado en Kunavo
Gemini 3 Pro (lista de Google, contexto ≤200k)$2.00$12.00Reservado — no habilitado
Gemini 3.1 Pro en Kunavo$0.70$4.20Activo (lista de Google $2.00 / $12.00)
Gemini 3 Flash (lista de Google)$0.50$3.00Reservado — no habilitado
Gemini 3.6 / 3.7 / 3.8 Flash (tarifa introductoria de Google, hasta December 31, 2026)$0.75$3.75Google directamente; estándar $1.50 / $7.50 desde January 1, 2027
Gemini 3.8 Flash en Kunavo — el más reciente$0.525$2.625Activo — 30% por debajo de la tarifa introductoria de Google
Gemini 3.7 Flash en Kunavo$0.525$2.625Activo — 30% por debajo de la tarifa introductoria de Google
Gemini 3.6 Flash en Kunavo$1.05$5.25Activo — 40% por encima de la tarifa introductoria de Google; usa 3.7 o 3.8 Flash
Gemini 2.5 Flash en Kunavo$0.09$0.75Activo

La tarifa de Kunavo de cada modelo Gemini actual junto a la de Google, además de ejemplos de costes calculados, está en la guía de precios de la API de Gemini.

API de Gemini 3.8 Flash: precio y tarifa introductoria de Google

Gemini 3.8 Flash es el Flash más reciente de Google, lanzado el 2 de septiembre de 2026 y orientado a la ingeniería de software de horizonte largo y a la ejecución agéntica, con una ventana de contexto de 1.048.576 tokens y hasta 65.536 tokens de salida. En Kunavo, la API de Gemini 3.8 Flash cuesta $0.525 de entrada / $2.625 de salida por 1M de tokens, y se llama como gemini-3-8-flash en el mismo endpoint que cualquier otro modelo.

Google cobra una tarifa introductoria de $0.75 / $3.75 por 1M de tokens para sus modelos Flash 3.x —Flash 3.6, 3.7 y 3.8— hasta December 31, 2026, y su tarifa estándar de $1.50 / $7.50 desde January 1, 2027. Frente a la tarifa que Google cobra hoy, Gemini 3.8 Flash y Gemini 3.7 Flash de Kunavo ($0.525 / $2.625) son 30% más baratos. Gemini 3.6 Flash no lo es: a $1.05 / $5.25, cuesta un 40% más que la tarifa introductoria de Google, así que los Flash 3.7 y 3.8 son los que debes usar: ambos son más recientes y más baratos.

Kunavo aporta una única clave compatible con OpenAI y un único saldo prepago para Gemini, Claude, GPT y los modelos de imagen y vídeo, sin proyecto de Google Cloud ni cargos por solicitudes fallidas. Lo que no aporta es capacidad dedicada: Kunavo utiliza capacidad compartida, sin cuota dedicada ni SLA contractual; si necesitas cualquiera de las dos cosas, llama directamente a Google.

Gemini 3.6 Flash: qué cambió

Gemini 3.6 Flash (lanzado el 21 de julio de 2026) fue el primer Flash 3.x que pudimos ofrecer y el modelo utilizado para las mediciones de tokens de razonamiento de esta sección. La tarifa estándar de Google es $1.50 de entrada / $7.50 de salida por 1M de tokens; con tarifas estándar, el mismo precio de entrada que Gemini 3.5 Flash, con la salida reducida aproximadamente un 17%; pero mediante December 31, 2026 Google cobra $0.75 / $3.75 como tarifa introductoria. Google lo presenta para trabajo agéntico de horizonte largo, donde afirma que reduce sustancialmente el coste de tokens en tareas de ingeniería de varios pasos.

El número que realmente determina tu factura no aparece en la lista de precios: Flash 3.6 razona de forma predeterminada y el razonamiento domina el contador de salida. En nuestras pruebas, una respuesta factual de una frase consumió aproximadamente 120–140 tokens de razonamiento para producir 7 tokens de salida visibles. Los tokens de razonamiento se facturan a la tarifa de salida, así que el coste real de una respuesta corta de Flash 3.6 se acerca más a 150 tokens de salida que a 7: aproximadamente 20 veces la estimación ingenua. Dos consecuencias prácticas:

  • No establezcas un max_tokens pequeño. Cualquier valor inferior a ~150 se consume en razonamiento antes de que el modelo emita una respuesta, y recibes un fragmento truncado mientras sigues pagando por el razonamiento.
  • Presupuesta el razonamiento, no la salida visible. Para llamadas cortas y de gran volumen, un nivel Flash sin razonamiento suele ser más barato en la práctica, incluso con un precio anunciado por token más alto.

Gemini 3.6 Flash sigue activo en Kunavo como gemini-3-6-flash a $1.05 / $5.25 por 1M, pero eso supone un 40% más que los $0.75 / $3.75 que Google cobra hasta December 31, 2026, y más que el precio de Kunavo para los modelos más recientes. Para trabajos nuevos, llama a gemini-3-8-flash o gemini-3-7-flash a $0.525 / $2.625, un 30% por debajo de la tarifa introductoria de Google. También son modelos de razonamiento, así que mantén max_tokens generoso en ellos.

Llama a Gemini en Kunavo hoy

Kunavo ofrece Gemini mediante el endpoint /v1/chat/completions compatible con OpenAI: conserva el SDK de OpenAI, cambia base_url y no necesitas un proyecto de Google Cloud. Esto llama a la API de Gemini 3.8 Flash; cambia la cadena del modelo por gemini-3-7-flash, gemini-3-1-pro o gemini-2-5-flash y nada más cambia:

gemini_chat.py
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["KUNAVO_API_KEY"],
    base_url="https://api.kunavo.com/v1",
)

# Gemini 3.8 Flash is Google's newest Flash. Mind the max_tokens: the 3.x Flash
# models think before they answer and reasoning bills as output, so a small
# cap can be spent thinking and return a truncated answer.
resp = client.chat.completions.create(
    model="gemini-3-8-flash",
    max_tokens=1024,
    messages=[{"role": "user", "content": "Summarize this contract in 5 bullets."}],
)
print(resp.choices[0].message.content)

Obtener una clave lleva un minuto; consulta la guía de claves de la API de Gemini. La misma clave sk-kn- también permite acceder a Claude, GPT, la imagen Nano Banana y el vídeo Veo 3.

¿Qué nivel de Gemini deberías usar?

  • Cargas de trabajo con contexto largo y razonamiento: gemini-3-1-pro a $0.70 de entrada / $4.20 de salida. Es el nivel insignia de Google para programación, agentes y análisis entre modalidades, y el nivel Pro que ofrecemos.
  • Trabajo agéntico que razona en cada paso: gemini-3-8-flash a $0.525 / $2.625, un 30% por debajo de la tarifa introductoria de Google, o gemini-3-7-flash al mismo precio si tus prompts están validados allí. Razonamiento con latencia Flash; presupuesta los tokens de razonamiento, no la salida visible.
  • Llamadas de gran volumen y sensibles a la latencia: gemini-2-5-flash a $0.09 de entrada / $0.75 de salida sigue siendo la opción más eficiente en costes; no razona de forma predeterminada, precisamente por eso sigue siendo barato en respuestas cortas.
  • No Flash 3.6, por precio: gemini-3-6-flash a $1.05 / $5.25 cuesta más que Flash 3.7 y 3.8 en Kunavo y más que la propia tarifa introductoria de Google; consérvalo solo para prompts ya validados con él.
  • Desarrollo para la próxima actualización: programa contra la estructura compatible con OpenAI y trata la cadena del modelo como configuración; los nuevos slugs de Gemini llegan detrás del mismo endpoint.

Preguntas frecuentes

¿Qué es la API de Gemini 3?

Gemini 3 es la familia de modelos actual de Google: Gemini 3 Pro y 3.1 Pro, Gemini 3 Flash y los nuevos Gemini 3.6, 3.7 y 3.8 Flash; todos son multimodales de forma nativa, con contexto de 1 millón de tokens y razonamiento chain-of-thought. La API de Gemini 3 permite llamarlos mediante programación: directamente a través de Google AI Studio / Vertex AI o mediante un gateway compatible con OpenAI, como Kunavo, que actualmente ofrece Gemini 3.1 Pro y los modelos Flash 3.6, 3.7 y 3.8.

¿Puedo llamar hoy a la API de Gemini 3 en Kunavo?

Sí. Gemini 3.1 Pro está disponible como gemini-3-1-pro a $0.70 de entrada / $4.20 de salida por 1M, aproximadamente un 65% por debajo de los precios de lista de Google de $2.00 / $12.00, y es la opción Pro que debes elegir. En la gama Flash, Gemini 3.8 Flash (gemini-3-8-flash) es el más reciente, con $0.525 / $2.625, un 30% por debajo de los precios introductorios de $0.75 / $3.75 que Google cobra por Flash 3.x hasta 31 de diciembre de 2026; Gemini 3.7 Flash (gemini-3-7-flash) tiene el mismo precio, y Gemini 3.6 Flash (gemini-3-6-flash) todavía se ofrece a $1.05 / $5.25, por encima de la tarifa introductoria de Google. Todos funcionan en el endpoint compatible con OpenAI, sin necesidad de un proyecto de Google Cloud. Los slugs originales gemini-3-pro y gemini-3-flash siguen reservados y no están habilitados: las fuentes ascendentes que probamos para ellos no alcanzan nuestro umbral de fiabilidad (errores 503 persistentes y gestión incorrecta de parámetros).

¿Cuánto cuesta la API de Gemini 3?

El precio oficial de lista de Google es $2.00 de entrada / $12.00 de salida por 1 millón de tokens para Gemini 3 Pro y 3.1 Pro (hasta 200.000 tokens de contexto), y $0.50 / $3.00 para Gemini 3 Flash. Para Gemini 3.6, 3.7 y 3.8 Flash, Google aplica una tarifa introductoria de $0.75 / $3.75 hasta 31 de diciembre de 2026, y después su tarifa estándar de $1.50 / $7.50 desde 1 de enero de 2027. En Kunavo pagas $0.70 / $4.20 por Gemini 3.1 Pro (aproximadamente un 65% menos que el precio de lista), $0.525 / $2.625 por Gemini 3.8 Flash y Gemini 3.7 Flash (un 30% menos que la tarifa introductoria de Google), y $1.05 / $5.25 por Gemini 3.6 Flash, que está por encima de la tarifa introductoria de Google.

¿Qué Gemini 3 Flash debería usar: 3.6, 3.7 o 3.8?

Usa Gemini 3.8 Flash (gemini-3-8-flash) para trabajos nuevos: es el Flash más reciente de Google, lanzado el 2 de septiembre de 2026, y en Kunavo cuesta $0.525 / $2.625 por 1 millón de tokens, un 30% menos que los $0.75 / $3.75 que Google cobra actualmente. Gemini 3.7 Flash (gemini-3-7-flash) tiene el mismo precio y es adecuado para prompts ya validados con él. Gemini 3.6 Flash, a $1.05 / $5.25, cuesta más que ambos y un 40% más que la tarifa introductoria de Google, por lo que no es la opción más barata.

¿Cuánto cuesta la API de Gemini 3.6 Flash?

La tarifa estándar de Google para Gemini 3.6 Flash es $1.50 por 1M de tokens de entrada y $7.50 por 1M de tokens de salida, según 1 de enero de 2027; mediante 31 de diciembre de 2026, Google cobra de forma introductoria $0.75 / $3.75. En Kunavo, gemini-3-6-flash cuesta $1.05 / $5.25 — un 40% por encima de la tarifa introductoria de Google —, por lo que Gemini 3.8 o 3.7 Flash, ambos más recientes y con un precio de $0.525 / $2.625 en Kunavo, son una mejor compra. La lista de precios también subestima el coste real, porque 3.6 Flash razona de forma predeterminada y los tokens de razonamiento se cobran a la tarifa de salida: en las pruebas, una respuesta de una sola frase consumió aproximadamente entre 120 y 140 tokens de razonamiento para emitir 7 tokens de salida visibles. Presupuesta los tokens de razonamiento en lugar de la salida visible y evita un max_tokens inferior a aproximadamente 150, o el presupuesto de razonamiento consumirá la respuesta antes de emitirla.

¿Cómo obtengo una clave de API de Gemini 3?

Google AI Studio para obtener una clave directa, o una clave de Kunavo que actualmente cubre Gemini 3.1 Pro, los modelos Flash 3.x y 2.5 Flash — además de Claude y GPT—; consulta la guía de claves.

¿Qué ID de modelos Gemini 3 están activos en Kunavo?

gemini-3-8-flash (el Flash más reciente, $0.525 / $2.625 por 1 millón de tokens), gemini-3-7-flash, gemini-3-6-flash y gemini-3-1-pro ($0.70 / $4.20) están activos en Kunavo. Solo los slugs originales gemini-3-pro y gemini-3-flash siguen reservados, hasta que una fuente supere nuestro umbral de fiabilidad.