El precio de la API de GPT se factura según el uso por tokens. No hay cuota mensual; la entrada y la salida tienen precios distintos y la salida es más cara. En las tarifas de Kunavo a fecha de 4 de octubre de 2026, gpt-5-6-terra cuesta $0.70 de entrada / $4.20 de salida por cada 1M de tokens, y gpt-5-5 cuesta $2.00 / $12.00; ambos precios son inferiores a los oficiales de OpenAI. El gpt-6-luna lanzado en 22 de septiembre de 2026 cuesta $0.04 / $0.20 y es el GPT más barato de Kunavo.
Hay una distinción que conviene hacer desde el principio. El plan mensual de ChatGPT y la API de OpenAI son productos y sistemas de facturación distintos. Pagar ChatGPT no proporciona una clave de API ni reduce la factura de la API. Esta página trata únicamente del segundo caso: los precios del uso desde código.
Las tarifas se verificaron en 4 de octubre de 2026. Las cifras de Kunavo se muestran desde el catálogo de este sitio, por lo que no difieren del importe real facturado. Para los precios oficiales de OpenAI, consulta la página de precios de OpenAI.
Tabla de tarifas de las series GPT-5 / GPT-6
USD por cada 1M de tokens. «Precio oficial de OpenAI» es el precio publicado para el mismo modelo. Para los modelos en promoción, también mostramos debajo el precio que OpenAI cobra realmente ahora.
| Modelos | Entrada / 1M | Salida / 1M | Precio oficial de OpenAI |
|---|---|---|---|
gpt-6-luna | $0.04 | $0.20 | $0.10 / $0.50 |
gpt-6-sol | $0.80 | $4.00 | $2.00 / $10.00 |
gpt-5-6-terra | $0.70 | $4.20 | $2.00 / $12.00 |
gpt-5-5 | $2.00 | $12.00 | $5.00 / $30.00 |
gpt-6-astra | $4.00 | $20.00 | $10.00 / $50.00 |
gpt-5-6-sol | $2.00 | $12.00 | $5.00 / $30.00 Actualmente, precio promocional $4.00 / $20.00 (al menos hasta 21 de noviembre de 2026) |
Las tarifas más recientes siempre aparecen en la página de precios y en la página de cada modelo. Consulta la lista completa en Lista de modelos.
GPT-6 es la nueva generación de OpenAI. GPT-6 Astra se publicó como el modelo de gama más alta de OpenAI en 3 de septiembre de 2026, seguido por GPT-6 Sol y GPT-6 Luna en 22 de septiembre de 2026. OpenAI describe ambos como modelos «construidos sobre los avances que impulsaron GPT-6 Astra»; posiciona Sol para la programación compleja y los flujos de trabajo agénticos, y Luna como «el modelo más eficiente para el procesamiento masivo y enfocado». Ambos tienen un contexto de 1,050,000 tokens y una salida máxima de 128,000 tokens.
En Kunavo, GPT-6 Luna es el GPT más barato, con $0.04 / $0.20. GPT-6 Sol cuesta $0.80 / $4.00, y su precio de salida es inferior al de GPT-5.6 Terra ($4.20). Sin embargo, la tarifa de entrada es menor para GPT-5.6 Terra ($0.70), y en las solicitudes donde el número de tokens de entrada es mayor que el número de tokens de salida multiplicado por 2, GPT-5.6 Terra resulta más barato (puede compararlos en la tabla siguiente). Las solicitudes cuya entrada supera los 272.000 tokens se facturan, igual que los demás modelos GPT-5.x / GPT-6 y conforme a las reglas de OpenAI, aplicando 2× a la entrada y 1,5× a la salida de toda la solicitud.
Cuánto cuesta realmente una solicitud
| Uso | Tokens | gpt-6-luna | gpt-6-sol | gpt-5-6-terra | gpt-5-5 |
|---|---|---|---|---|---|
| Un turno corto | Entrada 1.000 / salida 300 | $0.0001 | $0.0020 | $0.0020 | $0.0056 |
| Una respuesta RAG | Entrada 6.000 / salida 500 | $0.0003 | $0.0068 | $0.0063 | $0.0180 |
| Problema difícil | Entrada 20.000 / salida 3.000 | $0.0014 | $0.0280 | $0.0266 | $0.0760 |
| Lote de 100.000 elementos | Entrada 500 / salida 20 × 100.000 | $2.40 | $48.00 | $43.40 | $124.00 |
Puedes usar directamente lo siguiente para calcularlo con tus propias cifras.
# Kunavo の GPT 料率(1M トークンあたり USD): (input, output)
RATES = {
"gpt-5-6-terra": (0.70, 4.20),
"gpt-5-5": (2.00, 12.00),
"gpt-5-6-sol": (2.00, 12.00),
"gpt-6-sol": (0.80, 4.00),
"gpt-6-luna": (0.04, 0.20),
}
def cost(model: str, in_tokens: int, out_tokens: int) -> float:
i, o = RATES[model]
# 注意: GPT-5 系の推論モデルは reasoning トークンも出力料率で課金される。
return in_tokens / 1_000_000 * i + out_tokens / 1_000_000 * o
print(cost("gpt-5-6-terra", 1_000, 300)) # 短い 1 ターン
print(cost("gpt-5-6-terra", 6_000, 500)) # RAG の回答 1 件
print(cost("gpt-5-5", 20_000, 3_000)) # 難しい問題
print(cost("gpt-5-6-sol", 20_000, 3_000)) # GPT-5.6 のフラッグシップ
print(cost("gpt-6-sol", 20_000, 3_000)) # GPT-6 Sol
print(cost("gpt-6-luna", 1_000, 300)) # いちばん安い 1 ターンDos trampas que distorsionan la factura
La primera son los tokens de razonamiento. Los modelos de razonamiento de la serie GPT-5 generan internamente tokens de pensamiento antes de responder; no aparecen en el cuerpo de la respuesta, pero se facturan con la tarifa de salida. Los importes de la tabla anterior no incluyen tokens de razonamiento, por lo que cuanto más difícil sea el problema, más superará la factura real esos importes. El número de tokens de salida del campo usage es el valor real.
La segunda son los reintentos. Las solicitudes que consumen tokens y luego fallan aguas abajo también se cobran. En los flujos de trabajo agénticos, una sola tarea vista por el usuario puede convertirse, a efectos de facturación, en varias idas y vueltas; aquí es donde suele aparecer la mayor diferencia. Kunavo no cobra las solicitudes que fallan en Kunavo, es decir, las que no llegan al proveedor ascendente.
Conectar con el código existente de OpenAI
Solo tienes que cambiar una línea de base_url y la clave. Tanto chat.completions como responses funcionan con el mismo formato.
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1", # 変えるのはこの 1 行だけ
)
resp = client.chat.completions.create(
model="gpt-5-6-terra",
messages=[{"role": "user", "content": "こんにちは"}],
)
print(resp.choices[0].message.content)Con la misma clave también puedes llamar a Claude, imágenes y vídeo. Consulta el procedimiento en Inicio rápido y la lista de endpoints en la documentación de Chat Completions.
Pagar desde Japón
El saldo de Kunavo funciona mediante el checkout de Stripe y admite tarjetas que incluyen JCB (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay, Google Pay y Link. Es una cartera prepaga, con una recarga mínima de $10, y el saldo no caduca. No se generan cargos durante los meses en que no hagas llamadas. No se admiten pagos en tiendas de conveniencia ni PayPay. La información legal para operadores nacionales se recoge en la información conforme a la Ley de Transacciones Comerciales Especificadas, y los detalles de facturación en la documentación de facturación.
4 palancas para reducir costes
- Elige el nivel según el tamaño del problema. No establezcas el modelo de gama más alta como predeterminado. Para procesamiento masivo, como clasificación, extracción y estructuración, empieza con el
gpt-6-lunamás barato que OpenAI recomienda para ese uso y sube de nivel si no es suficiente. Como muestra la tabla, incluso para una respuesta RAG idéntica hay una diferencia de aproximadamente 53 veces entregpt-6-lunaygpt-5-5. - Limita la salida. La salida es más cara que la entrada, así que
max_tokensy especificar el formato de salida tienen un efecto directo. En los modelos con razonamiento, esto tiene un efecto doble. - Activa la caché de prompts. Si envías el mismo prompt del sistema en cada llamada, la caché es la palanca más importante. El mecanismo se explica en la documentación de caché.
- No acumules en la entrada historiales irrelevantes. Cuando pases a otra tarea, borra la conversación. Los historiales largos se cobran completos en cada llamada.
Para comparar con modelos de otros proveedores, los precios de Claude usan el mismo método de cálculo. Si solo quieres consultar la facturación según el uso de Codex CLI, ve a los precios de Codex.
Preguntas frecuentes
¿Cuánto cuesta la API de GPT?
Se factura según el uso por tokens, con precios distintos para la entrada y la salida. En las tarifas de Kunavo a fecha de 4 de octubre de 2026, por cada 1M de tokens, gpt-5-6-terra cuesta $0.70 de entrada / $4.20 de salida, gpt-5-5 cuesta $2.00 / $12.00, y gpt-5-6-sol cuesta $2.00 / $12.00. Los precios oficiales de OpenAI para los mismos modelos son $2.00 / $12.00, $5.00 / $30.00 y $5.00 / $30.00, respectivamente(gpt-5-6-sol se ofrece actualmente a un precio promocional de $4.00 / $20.00 por parte de OpenAI y, según la página de precios, la promoción continúa al menos hasta 21 de noviembre de 2026). El gpt-6-sol, lanzado en 22 de septiembre de 2026, cuesta $0.80 / $4.00, y el gpt-6-luna cuesta $0.04 / $0.20 (los precios oficiales de OpenAI son $2.00 / $10.00 y $0.10 / $0.50); gpt-6-luna es el GPT más barato. No hay cuota mensual.
¿Cuánto cuesta la API de GPT-6?
Tarifas de lista de OpenAI (por 1M de tokens, entrada / salida): GPT-6 Sol $2.00 / $10.00, GPT-6 Luna $0.10 / $0.50, GPT-6 Astra $10.00 / $50.00 (Sol y Luna se publicaron el 22 de septiembre de 2026 y Astra el 3 de septiembre de 2026). Las tarifas de entrada / salida de Kunavo por 1M de tokens son: gpt-6-sol $0.80 / $4.00, gpt-6-luna $0.04 / $0.20, GPT-6 Astra $4.00 / $20.00. Todos se pueden utilizar por aproximadamente un 60% menos que la tarifa de lista. gpt-6-luna es el GPT más barato de Kunavo, y gpt-6-sol tiene una tarifa de salida inferior a la de gpt-5-6-terra ($4.20) (la tarifa de entrada es menor para gpt-5-6-terra: $0.70). En las solicitudes cuya entrada supera los 272 000 tokens, se cobra toda la solicitud al doble de la tarifa de entrada y a 1,5 veces la tarifa de salida, igual que en OpenAI.
¿Son lo mismo la cuota mensual de ChatGPT y el precio de la API de OpenAI?
No, son productos y sistemas de facturación distintos. Los planes de pago de ChatGPT son cuotas mensuales por usar la interfaz de chat.openai.com; no incluyen cuota de API ni proporcionan una clave de API. La API se factura por tokens según el uso: no tiene cuota mensual, pero pagas por lo que llamas. Si llamas desde código, necesitas la API; pagar ChatGPT no reduce ni un céntimo la factura de la API.
¿Cuánto cuesta realmente una solicitud de la API de GPT?
Para una respuesta RAG con 6.000 tokens de entrada y 500 de salida, cuesta aproximadamente $0.0063 con gpt-5-6-terra y aproximadamente $0.0003 con el gpt-6-luna, el más barato. Para un problema difícil con 20.000 tokens de entrada y 3.000 de salida, cuesta aproximadamente $0.0760 con gpt-5-5 y $0.0760 con gpt-5-6-sol. Todos los importes usan las tarifas de Kunavo y no incluyen tokens de razonamiento.
¿Cómo se facturan los tokens de razonamiento?
Se facturan con la tarifa de salida. Los modelos de razonamiento de la serie GPT-5 generan internamente tokens de pensamiento antes de producir la respuesta; no aparecen en el cuerpo de la respuesta, pero sí en la factura. Es la causa más habitual de que una estimación sea inferior a la factura real, y la diferencia aumenta con los problemas difíciles. El número real se obtiene leyendo los tokens de salida del campo usage; úsalo para las estimaciones en lugar de una aproximación.
¿Cómo usar GPT de forma más barata?
Hay cuatro medidas, en orden de impacto. Elige el nivel según el tamaño del problema y no establezcas el modelo de gama más alta como predeterminado (por precio de salida, el gpt-6-luna más barato y el gpt-6-astra de gama más alta difieren 100 veces). Limita la salida con max_tokens y especificando el formato. Activa la caché de prompts. No acumules en la entrada historiales irrelevantes. Después, dirigir las llamadas a un endpoint más barato que el precio oficial de OpenAI se suma al efecto de las cuatro medidas.
¿El código existente del SDK de OpenAI funcionará tal cual?
Sí. Kunavo es un endpoint compatible con OpenAI, así que solo tienes que cambiar una línea, base_url a https://api.kunavo.com/v1, y la clave. Tanto chat.completions como responses funcionan con el mismo formato y puedes usar los nombres de modelo sin cambios. Con la misma clave también puedes llamar a Claude, imágenes y vídeo.
¿Cómo pagar el precio de la API de GPT desde Japón?
El saldo de Kunavo funciona mediante el checkout de Stripe y admite tarjetas que incluyen JCB (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay, Google Pay y Link. Es una cartera prepaga, con una recarga mínima de $10; el saldo no caduca y no se factura durante los meses en que no hagas llamadas. Las solicitudes fallidas no generan cargos. No se admiten pagos en tiendas de conveniencia ni PayPay.