Volver a las guías
Costes·11 de septiembre de 2026·Actualizado el 5 de octubre de 2026·9 min de lectura

Coste de la API de Gemini 2026 — nivel gratuito, precios de cada modelo y Gemini 3.8 Flash

El «coste de Gemini» son en realidad tres cosas: nivel gratuito, suscripción a la aplicación y facturación de la API por tokens. Esta página las separa, muestra los precios actuales de cada modelo e indica claramente qué modelo resulta más barato al comprarlo directamente a Google.

El coste de Gemini API se calcula por token, sin cuota mensual.Si quieres probarla gratis primero, Google AI Studio ofrece un nivel gratuito con límites de tasa; para pasar a producción, se paga por cada 1M tokens, con tarifas distintas para la entrada y la salida. 5 de octubre de 2026, las tarifas de Gemini 3.8 Flash en Kunavo son $0.525 para la entrada / $2.625 para la salida; Google cobra actualmente por su propio 3.x Flash un precio promocional por tiempo limitado de $0.75 / $3.75 (hasta el 31 de diciembre de 2026; a partir de 2027, volverá al precio estándar de $1.50 / $7.50), y el precio de Kunavo es aproximadamente un 30% inferior incluso a ese precio promocional. Las tarifas de Gemini 2.5 Flash, de la generación anterior, son $0.09 / $0.75, y las de Gemini 3.1 Pro son $0.70 / $4.20.

Primero, una excepción: Gemini 3.6 Flash. En Kunavo es $1.05 / $5.25, Aproximadamente un 40% por encima del precio promocional de Google — durante la promoción, llamar directamente a Google sale más barato. Tanto 3.7 como 3.8 Flash son más recientes y más baratos, Por eso, no elijas 3.6 por el precio.

Las tarifas se verificaron en 5 de octubre de 2026. Consulta los precios oficiales de Google y la información sobre el nivel gratuito en ai.google.dev/gemini-api/docs/pricing; las cifras de Kunavo se muestran desde el catálogo de modelos de este sitio y coinciden con los importes reales de facturación de la API.

En realidad, «coste de Gemini» son tres cosas

Ruta¿Qué se paga?Si tienes una clave de APIPara quién es
Nivel gratuito (Google AI Studio)$0, con límites de velocidadSí (limitado)Pruebas, aprendizaje y pequeñas herramientas personales
Suscripción de Google AI (Pro / Ultra de la aplicación Gemini)Cuota mensual fijaNoSolo usarlo en la aplicación Gemini, sin programar
Facturación de la API según el usoPor token, sin cuota mensualSíIntegración en productos, procesamiento por lotes y control de costes

El malentendido más común está en la fila intermedia: suscribirte a Google AI Pro no aumenta tu cuota de la API. La cuota mensual de la aplicación y la API para desarrolladores son dos cuentas distintas; para llamar desde código, necesitas usar el nivel gratuito o pagar por token. A la inversa, si solo chateas en la aplicación Gemini y no programas, la versión gratuita o una suscripción son suficientes y no necesitas la API.

¿La API de Gemini es gratuita? ¿Qué se puede hacer con el nivel gratuito?

Sí, hay un nivel gratuito y realmente cuesta $0: crea una clave en Google AI Studio y realiza llamadas sin coste dentro de los límites de velocidad; es más que suficiente para probar modelos y crear prototipos. Las cifras concretas de los límites las ajusta Google según su situación, por lo que esta página no repite números que podrían quedar obsoletos; consulta la página de precios de Google y la información sobre los límites de velocidad.

Su límite también está claro: los límites de velocidad no soportan tráfico de producción y las cifras pueden cambiar en cualquier momento, por lo que para ponerlo en producción tendrás que pagar. Kunavo no tiene cuota gratuita, pero tampoco tiene cuota mensual: el saldo prepago mínimo es de $10, se descuenta según el uso y los meses sin llamadas cuestan $0.

Precios de la API de Gemini — por cada 1M de tokens de cada modelo

ModeloEntrada de KunavoSalida de KunavoGoogle oficial (entrada / salida)Comparación con los precios actuales de Google
Gemini 3.8 Flash$0.525$2.625Precio promocional $0.75 / $3.75 (a partir de 2027: $1.50 / $7.50)Aproximadamente un 30% por debajo del precio promocional de Google
Gemini 3.7 Flash$0.525$2.625Precio promocional $0.75 / $3.75 (a partir de 2027: $1.50 / $7.50)Aproximadamente un 30% por debajo del precio promocional de Google
Gemini 3.6 Flash$1.05$5.25Precio promocional $0.75 / $3.75 (a partir de 2027: $1.50 / $7.50)Aproximadamente un 40% por encima del precio promocional de Google
Gemini 3.1 Pro$0.70$4.20$2.00 / $12.00Aproximadamente un 65% menos
Gemini 2.5 Flash$0.09$0.75$0.30 / $2.50Aproximadamente un 70% menos

Las tres filas de Flash 3.x comparan el precio promocional que Google cobra realmente hoy, no el precio estándar de 2027. Compararlo con el precio estándar haría que las cifras parecieran mucho mejores, pero no es el precio que pagas ahora a Google. Gemini 3.1 Pro tiene además una regla: si el prompt de una solicitud supera los 200K tokens, toda la solicitud se factura a 2× para la entrada y 1,5× para la salida. Las especificaciones de cada modelo están en las páginas de Gemini 3.8 Flash, Gemini 3.1 Pro y Gemini 2.5 Flash; todas las tarifas están en la página de precios.

Precio de Gemini 3.8 Flash — cuánto cuesta realmente una solicitud

Es más útil ver una solicitud real que una tabla de tarifas. Todo lo siguiente se calcula a partir de las tarifas de la tabla anterior:

Usotokens (entrada / salida)3.8 Flash (Kunavo)3.8 Flash (precio promocional de Google)2.5 Flash3.1 Pro
Una ronda de chat1,000 / 300$0.0013$0.0019$0.00031$0.002
Una respuesta RAG8,000 / 500$0.0055$0.0079$0.0011$0.0077
Un análisis de documento largo20,000 / 2,000$0.016$0.022$0.0033$0.022
Clasificación de 100.000 documentos500 / 20 × 100,000$31.50$45.00$6.00$43.40

Un elemento que puede disparar la factura: los tokens de razonamiento. Gemini 3.x Flash y 3.1 Pro «piensan» antes de responder. Los tokens de razonamiento no aparecen en el contenido de la respuesta, pero se facturan con la tarifa de salida. La tabla anterior no los incluye, por lo que el importe real de una tarea difícil será mayor; toma como referencia el número de tokens de salida de usage en la respuesta. Calcula el coste con tus propias cifras:

gemini_cost.py
# Gemini API 的費用,直接用實際 token 數算。
# 費率為每 1M token USD:(input, output)
RATES = {
    "gemini-3-8-flash": (0.525, 2.625),
    "gemini-3-1-pro":   (0.70, 4.20),
    "gemini-2-5-flash": (0.09, 0.75),
}

def cost(model, inp, out):
    i, o = RATES[model]
    return inp / 1e6 * i + out / 1e6 * o  # 思考 token 按輸出費率計

print(cost("gemini-3-8-flash", 8_000, 500))         # RAG 回答一次
print(cost("gemini-2-5-flash", 500, 20) * 100_000)  # 10 萬筆分類

Llamar a Gemini con el SDK de OpenAI existente

Kunavo es un endpoint compatible con OpenAI: cambia base_url y la clave, indica el modelo de Gemini en model y funcionará; no necesitas un proyecto ni una cuenta de facturación de Google Cloud. La misma clave también permite llamar a modelos de Claude, GPT, imágenes y vídeo.

gemini_kunavo.py
from openai import OpenAI

client = OpenAI(
    api_key="sk-kn-...",
    base_url="https://api.kunavo.com/v1",  # 只改這一行
)

resp = client.chat.completions.create(
    model="gemini-3-8-flash",
    messages=[{"role": "user", "content": "用三句話說明什麼是 token"}],
)
print(resp.choices[0].message.content)
print(resp.usage)  # 這次請求計費用的 token 數

Los pasos completos están en Inicio rápido; si quieres solicitar una clave directamente a Google, consulta Cómo obtener una clave de la API de Gemini (en inglés).

Hablando claro: cuándo es mejor acudir directamente a Google

  • Necesitas una cuota garantizada o un SLA. La puerta de enlace utiliza capacidad compartida: no hay cuota dedicada ni un SLA garantizado por contrato. Cuando llegues a una escala que necesite ambas cosas, solicita el servicio directamente a Google.
  • Solo puedes usar Gemini 3.6 Flash. Durante la promoción, Google cobra directamente menos que Kunavo.
  • Solo chateas en la aplicación. Si no programas, la versión gratuita o una suscripción de Google AI son suficientes; no necesitas la API.

A la inversa, esta opción sirve si quieres una sola clave para llamar a Gemini, Claude y GPT, no quieres abrir una cuenta de facturación de Google Cloud o quieres fijar los costes mediante un saldo prepago.

Pagar desde Taiwán

Para pagar directamente a Google, debes activar la facturación del proyecto en Google Cloud y vincular una tarjeta de crédito internacional. El saldo de Kunavo se gestiona mediante Stripe y admite tarjetas que incluyen JCB (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay y Google Pay. Es prepago, con una recarga mínima de $10 y sin caducidad del saldo; las solicitudes fallidas no generan cargos. Las recargas de $100 o más incluyen crédito adicional ($100 se convierten en $110 de saldo).

En Taiwán no hay métodos de pago locales: JkoPay y LINE Pay no aparecen en la lista de métodos disponibles, por lo que la única opción es usar una tarjeta internacional. Los detalles de facturación están en la documentación de facturación.

Cómo reducir el coste de Gemini

  1. Elige primero el modelo adecuado. Si necesitas la generación 3.x, usa 3.8 o 3.7 Flash: son más nuevos que 3.6 y también más baratos; Deja las tareas sencillas y masivas, como clasificar y extraer datos, en manos de 2.5 Flash.
  2. Pide al modelo que escriba menos. La salida es más cara que la entrada; especificar el formato y la longitud de salida en el prompt es la medida más directa.
  3. Introduce menos contexto. En RAG, recupera fragmentos pocos y precisos; no envíes toda la base de conocimiento: cada vez se factura como entrada completa.
  4. Mantén el prompt de 3.1 Pro en un máximo de 200K tokens. Si supera ese límite, toda la solicitud se factura a 2× para la entrada y 1,5× para la salida.

La forma de implementar el enrutamiento está en la guía de optimización de costes de IA (en inglés). Si quieres comparar otros proveedores con el mismo algoritmo, consulta el coste de la API de OpenAI y el coste de Claude.

Preguntas frecuentes

¿Cuánto cuesta la API de Gemini?

La API de Gemini se factura por token, sin cuota mensual; la entrada y la salida tienen tarifas distintas. 5 de octubre de 2026, las tarifas de Kunavo por cada 1M de tokens son: Gemini 3.8 Flash, entrada $0.525 / salida $2.625; Gemini 3.1 Pro, $0.70 / $4.20; Gemini 2.5 Flash, $0.09 / $0.75. Google cobra actualmente un precio promocional temporal para su Flash 3.x de $0.75 / $3.75 (hasta el 31 de diciembre de 2026; desde 2027 será $1.50 / $7.50). Google AI Studio también ofrece un nivel gratuito con límites de velocidad para hacer pruebas iniciales sin coste.

¿La API de Gemini se puede usar gratis?

Se puede probar, pero no es adecuada para producción. Google AI Studio ofrece un nivel gratuito con límites de velocidad; las llamadas dentro de esos límites cuestan $0. Google ajusta los límites, así que consulta la página de precios de la API de Gemini de Google. El tráfico de producción requiere pago: directamente a Google o mediante un gateway que facture por token. Kunavo no ofrece cuota gratuita, pero tampoco tiene cuota mensual: el saldo prepago mínimo es de $10, pagas según el uso y los meses sin llamadas cuestan $0.

¿Cuánto cuesta Gemini 3.8 Flash?

5 de octubre de 2026, Gemini 3.8 Flash de Kunavo cuesta por cada 1M de tokens $0.525 de entrada / $2.625 de salida. Google cobra actualmente para 3.x Flash el precio promocional temporal $0.75 / $3.75 hasta el 31 de diciembre de 2026; la comparación de Kunavo con esa promoción es: Aproximadamente un 30% por debajo del precio promocional de Google. Desde el 1 de enero de 2027, Google volverá al precio estándar de $1.50 / $7.50. Una respuesta RAG (8.000 tokens de entrada / 500 de salida) cuesta aproximadamente $0.0055 en Kunavo.

¿Sigue valiendo la pena Gemini 3.6 Flash?

No se recomienda elegirlo por el precio. Gemini 3.6 Flash de Kunavo cuesta $1.05 / $5.25. Comparación con el precio promocional de Google: Aproximadamente un 40% por encima del precio promocional de Google. Por eso, durante la promoción resulta más barato llamar directamente a 3.6 a través de Google. 3.7 Flash y 3.8 Flash son más recientes que 3.6 y también son más baratos que 3.6 en Kunavo ($0.525 / $2.625). A menos que su programa requiera específicamente 3.6, basta con cambiar a un modelo más reciente.

¿Puedo usar la API de Gemini si estoy suscrito a Google AI Pro?

No. La suscripción de pago de la aplicación Gemini (Google AI Pro / Ultra) y la API de Gemini para desarrolladores son dos productos con dos sistemas de facturación distintos. La cuota mensual no incluye cuota de API ni proporciona una clave de API. Para llamar desde un programa, debes usar el nivel gratuito o pagar por token; a la inversa, tener una clave de API no añade funciones a la aplicación.

¿Puedo usar la API de Gemini sin abrir una cuenta de facturación de Google Cloud?

Puedes llamar a través de un gateway compatible con OpenAI. En Kunavo, una misma clave con prefijo sk-kn- permite llamar a Gemini sin proyecto ni cuenta de facturación de Google Cloud; Claude y GPT también usan el mismo saldo. La contrapartida es que esta ruta utiliza capacidad compartida: no hay cuota dedicada ni SLA garantizado por contrato. Los despliegues que necesiten cuota o SLA garantizados deberían solicitarlo directamente a Google.

¿Cómo se paga la API de Gemini desde Taiwán?

Para pagar directamente a Google, debes activar la facturación del proyecto en Google Cloud y vincular una tarjeta de crédito internacional. Kunavo utiliza el prepago mediante Stripe: admite Visa, Mastercard, American Express, JCB, UnionPay, Apple Pay y Google Pay; la recarga mínima es de $10, el saldo no caduca y las solicitudes fallidas no generan cargos. Taiwán no dispone de canales de pago locales; JKO Pay y LINE Pay no están disponibles.