Volver a las guías
Precios·18 de junio de 2026·Actualizado el 24 de septiembre de 2026·9 min de lectura

Precios de Gemini【edición 2026】— cuota gratuita, suscripción y tarifas de API por modelo

Los precios de Gemini se dividen en cuota gratuita, suscripción y facturación de la API por uso, y la suscripción no incluye una clave de API. Mostramos con cifras reales las diferencias entre las tres opciones y las tarifas de API por modelo.

El precio de Gemini se divide en 3 partes. Nivel gratuito (nivel gratuito de la API de Google AI Studio; con límites de velocidad, no recomendado para producción), suscripción de Google (plan de pago de la aplicación Gemini; cuota mensual fija, sin clave de API) y facturación de la API según uso (por token, sin cuota mensual, $0 si no realizas llamadas). Son tres productos independientes: contratar uno no permite usar los otros.

Lo que suelen buscar los desarrolladores es la tercera opción. Kunavo ofrece esa API aproximadamente un 70% por debajo del precio oficial de Google. Esta página explica las tarifas actuales por modelo, ejemplos calculables por tu cuenta y la forma más económica de llamar a Gemini en producción.

Cómo distinguir los 3 modelos de precios

RutaQué pagas¿Incluye una clave de API?
Nivel gratuito (Google AI Studio)$0, con límites de velocidadSí (con limitaciones)
Suscripción (plan de pago de la aplicación Gemini)Cuota mensual fijaNo
Facturación de la API según usoPor token, sin cuota mensualSí

El malentendido más común es la fila central. Pagar la suscripción de pago de la aplicación Gemini no aumenta la cuota de uso de la API. La cuota mensual de la aplicación y la API para desarrolladores se facturan por separado; para llamar desde código necesitas una clave y facturación según uso (o el nivel gratuito) en cualquier caso. Los límites de velocidad concretos del nivel gratuito cambian con frecuencia según Google, así que comprueba las cifras en la documentación oficial de Google. No las cubrimos aquí: si el objetivo es producción, el nivel gratuito deja de ser una opción de todos modos.

Tabla rápida de precios de Gemini

Las tarifas son por cada 1 millón de tokens, en USD, y corresponden al importe cobrado por Kunavo. La columna “precio oficial de Google” muestra el precio publicado por Google para el mismo modelo, para que puedas ver la diferencia.

ModelosEntrada / 1MSalida / 1MPrecio oficial de Google (entrada / salida)Ahorro
gemini-2-5-flash$0.09$0.75$0.30 / $2.50Aproximadamente 70%
gemini-3-1-pro$0.70$4.20$2.00 / $12.00Aproximadamente 65%

Flash es la opción principal para procesamiento masivo; Pro está pensado para trabajos de razonamiento más complejo, visión y contexto largo. Las tarifas más recientes aparecen siempre en la página de precios y en las páginas de cada modelo (gemini-2-5-flash, gemini-3-1-pro).

Cómo funciona la facturación por tokens de Gemini

Se facturan los tokens de entrada (todo lo que envías: el prompt del sistema, el contexto recuperado y el mensaje del usuario) y los tokens de salida (lo que genera el modelo). La salida cuesta más, por lo que la palanca que más influye en la factura de Gemini es cuánto haces escribir al modelo. Las imágenes y el audio se convierten a tokens y se facturan con el mismo contador.

Ejemplo de cálculo

Son cifras reales usando las tarifas de Gemini 2.5 Flash de Kunavo. Solo la última fila usa Gemini 3.1 Pro.

Carga de trabajoTokens (entrada / salida)ModelosCoste
Un turno de chatbot1,000 / 300Flash$0.0003
Respuesta de RAG8,000 / 500Flash$0.0011
Clasificación por lotes (por documento)500 / 20Flash$0.00006
Análisis de contexto largo20,000 / 2,000Pro$0.0224

Con estas tarifas, un lote de clasificación de 100.000 documentos con Flash cuesta aproximadamente $6, y 1 millón de conversaciones de chatbot cuesta aproximadamente $315. Puedes ejecutar directamente la fórmula.

gemini_cost.py
# Kunavo の Gemini 2.5 Flash 料率(1M トークンあたり、USD)
IN_RATE, OUT_RATE = 0.09, 0.75

def cost(in_tokens: int, out_tokens: int) -> float:
    return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE

print(cost(1_000, 300))            # チャットボット 1 ターン -> $0.000315
print(cost(8_000, 500))            # RAG の回答 1 件        -> $0.001095
print(cost(500, 20) * 100_000)     # 10 万件のバッチ処理     -> 約 $6.00

Precios de Kunavo y pagos con Stripe

No necesitas una suscripción ni un proyecto de Google Cloud. Al recargar el saldo (con Stripe o un método de pago local), cada llamada descuenta del saldo el importe calculado según las tarifas por token indicadas arriba. Es facturación según uso, con una recarga mínima de $10; el saldo no caduca y las recargas grandes reciben créditos adicionales. Un solo saldo cubre Gemini y todos los demás modelos —Claude, GPT, imágenes, vídeo y audio—, por lo que no tienes que conciliar facturas separadas de cada proveedor.

¿Qué modelo de Gemini debería elegir?

  • gemini-2-5-flash: opción predeterminada para chat, extracción, clasificación, resúmenes y la mayoría de los casos de RAG. Es rápido y la opción de alto rendimiento más económica.
  • gemini-3-1-pro: úsalo cuando Flash no sea suficientemente preciso: razonamiento de varios pasos, código, visión y contextos muy largos.

Enrutar según la dificultad es un buen patrón. Atiende los casos habituales con Flash y escala a Pro solo cuando falle la comprobación. Consulta la guía de optimización de costes de IA para ver el patrón de enrutamiento con código.

Cómo reducir la factura de Gemini

  1. Baja de nivel. Envía el 80% de las tareas sencillas a Flash y reserva Pro para el 20% más difícil.
  2. Limita la salida. Configura max_tokens y secuencias de parada: la salida es la parte más cara del contador.
  3. Reduce la entrada. Recupera pocos fragmentos RAG de alta calidad en lugar de introducir toda la base de conocimientos en el contexto.
  4. Usa lotes. Agrupa llamadas independientes para reducir la latencia y evitar una avalancha de reintentos.

Los modelos de imágenes y vídeo de Google también pueden invocarse con la misma clave. El precio por imagen o vídeo está en el precio de Nano Banana Pro y el precio de Veo 3.

Preguntas frecuentes

¿Cuánto cuesta Gemini?

El precio de Gemini se divide en 3 partes. El nivel gratuito de Google AI Studio ($0, con límites de velocidad), la suscripción de pago de la aplicación Gemini (cuota mensual fija, sin clave de API) y la facturación de la API según uso (por token, sin cuota mensual). Si llamas desde código, necesitas la tercera opción: en Kunavo, por cada 1 millón de tokens, Gemini 2.5 Flash cuesta $0.09 de entrada / $0.75 de salida, y gemini-3-1-pro cuesta $0.70 / $4.20; son aproximadamente un 70% / 65% menos que el precio oficial de Google.

¿Cuánto cuesta Gemini Pro?

gemini-3-1-pro cuesta en Kunavo $0.70 de entrada / $4.20 de salida por cada 1 millón de tokens, aproximadamente un 65% menos que el precio oficial de Google de $2.00 / $12.00. Una solicitud con 20.000 tokens de entrada y 2.000 de salida cuesta aproximadamente $0.0224. Pro está pensado para trabajos de razonamiento complejo, reconocimiento de imágenes y contexto largo; para procesamiento masivo, bajar al nivel Flash reduce el coste en órdenes de magnitud.

¿Se puede usar Gemini gratis?

Google AI Studio ofrece un nivel gratuito de la API de Gemini, que permite llamadas a $0 dentro de sus límites de velocidad. Es suficiente para prototipos, pero esos límites pueden cambiar según Google y no bastan para tráfico de producción, por lo que deja de ser una opción si el objetivo es producción. Kunavo no ofrece un nivel gratuito, pero tampoco cobra una cuota mensual: el saldo prepago se descuenta según el uso y los meses sin llamadas cuestan $0.

¿La suscripción de pago de la aplicación Gemini también permite usar la API?

No. La suscripción de pago de la aplicación Gemini y la API de Gemini para desarrolladores son productos y facturaciones distintas; la cuota mensual no incluye uso de la API ni una clave de API. Para llamar desde código necesitas una clave y facturación según uso aparte (o el nivel gratuito). A la inversa, tener una clave de API no añade funciones a la aplicación.

¿Cuánto cuesta Gemini 2.5 Flash?

En Kunavo, Gemini 2.5 Flash cuesta $0.09 por cada 1 millón de tokens de entrada y $0.75 por cada 1 millón de tokens de salida, aproximadamente un 70% menos que el precio oficial de Google de $0.30 / $2.50. Un turno típico de un chatbot (1K de entrada y 300 de salida) cuesta aproximadamente $0.0003.

¿Gemini es más barato que Claude o GPT?

Gemini 2.5 Flash es uno de los modelos de alto rendimiento más económicos frente a cualquier alternativa: para procesamiento masivo, cuesta menos que Claude Haiku y que casi todos los niveles de GPT. Consulta la página de precios para ver la tabla comparativa completa.

¿Cómo puedo reducir el coste de la API de Gemini?

Baja al nivel Flash, limita la salida, reduce el contexto que recuperas y usa procesamiento por lotes. Consulta la guía de optimización de costes para obtener más detalles. Para empezar a llamar a Gemini, consulta cómo obtener una clave de la API de Gemini.