Volver a las guías
Precios·3 de septiembre de 2026·Actualizado el 4 de octubre de 2026·8 min de lectura

Precios de la API de GPT 2026: tarifas por token de GPT-6, GPT-5.6 y GPT-5.5 y costes reales

La API de GPT cobra por tokens desde la primera llamada, sin nivel gratuito. Comparamos las tarifas actuales de la familia GPT-5 con los precios oficiales de OpenAI y resumimos las dos trampas que realmente determinan la factura y cómo pagar desde Corea del Sur.

La API de GPT se cobra mediante tarifas de entrada y salida por cada 1 M de tokens, sin cuota mensual ni nivel gratuito. Esta página presenta las tarifas actuales de las familias GPT-5 y GPT-6 junto al precio oficial de OpenAI, incluye ejemplos de cálculo para comprobar cuánto cuesta una solicitud concreta, explica dos trampas que influyen en el importe de la factura (los tokens de razonamiento y el recargo por textos largos) y detalla cómo pagar desde Corea del Sur.

Las tarifas se verificaron el 4 de octubre de 2026: el precio oficial de OpenAI se basa en openai.com/api/pricing, y las tarifas de Kunavo se leen en tiempo real del catálogo de modelos.

Tabla de tarifas de las familias GPT-5 y GPT-6

ModeloPrecio oficial de OpenAI (entrada / salida)Kunavo (entrada / salida)Diferencia
GPT-6 Luna$0.10 / $0.50$0.04 / $0.20Ahorro de aproximadamente 60%
GPT-6 Sol$2.00 / $10.00$0.80 / $4.00Ahorro de aproximadamente 60%
GPT-5.6 Terra$2.00 / $12.00$0.70 / $4.20Ahorro de aproximadamente 65%
GPT-5.5$5.00 / $30.00$2.00 / $12.00Ahorro de aproximadamente 60%
GPT-5.6 Sol$5.00 / $30.00
Precio promocional actual $4.00 / $20.00(hasta un mínimo de 21 de noviembre de 2026)
$2.00 / $12.00Ahorro de aproximadamente 60%
aproximadamente un 40% frente al precio promocional
GPT-6 Astra$10.00 / $50.00$4.00 / $20.00Ahorro de aproximadamente 60%

La familia GPT-6 es la nueva generación de OpenAI. GPT-6 Astra se lanzó el 3 de septiembre de 2026 como el modelo insignia de OpenAI, seguido por GPT-6 Sol y GPT-6 Luna el 22 de septiembre de 2026. OpenAI explica que ambos modelos se basan en los avances que dieron lugar a GPT-6 Astra; presenta Sol para programación compleja y flujos de trabajo de agentes, y Luna como “el modelo más eficiente para tareas masivas y focalizadas”. Ambos modelos tienen un contexto de 1,050,000 tokens y una salida máxima de 128,000 tokens.

El GPT más barato en Kunavo es GPT-6 Luna ($0.04 / $0.20). GPT-6 Sol ($0.80 / $4.00) tiene un precio de salida inferior al de GPT-5.6 Terra ($4.20). Sin embargo, la tarifa de entrada es menor para GPT-5.6 Terra ($0.70), por lo que en las solicitudes donde el número de tokens de entrada supera el número de tokens de salida multiplicado por 2, Terra resulta más barato. Si envía prompts largos y recibe respuestas cortas, calcule directamente ambos modelos con las tarifas de la tabla anterior.

¿Cuánto cuesta realmente una solicitud?

Como la tabla de tarifas por sí sola no permite hacerse una idea clara, compruébelo usted mismo. El código siguiente utiliza exactamente las mismas cifras que la tabla anterior; cambie únicamente el número de tokens para obtener el importe de su propia carga de trabajo.

gpt_cost.py
# Kunavo GPT 요율(1M 토큰당 USD): (input, output)
RATES = {
    "gpt-5-6-terra": (0.70, 4.20),
    "gpt-5-5":       (2.00, 12.00),
    "gpt-5-6-sol":   (2.00, 12.00),
    "gpt-6-sol":     (0.80, 4.00),
    "gpt-6-luna":    (0.04, 0.20),
}

def cost(model: str, in_tokens: int, out_tokens: int) -> float:
    i, o = RATES[model]
    # 주의: GPT-5 계열 추론 모델의 reasoning 토큰은 출력 요율로 과금됩니다.
    return in_tokens / 1_000_000 * i + out_tokens / 1_000_000 * o

print(cost("gpt-5-6-terra", 1_000, 300))  # 짧은 턴
print(cost("gpt-5-6-terra", 6_000, 500))  # RAG 답변
print(cost("gpt-5-5", 20_000, 3_000))     # 어려운 문제
print(cost("gpt-5-6-sol", 20_000, 3_000)) # GPT-5.6 플래그십
print(cost("gpt-6-sol", 20_000, 3_000))   # GPT-6 Sol
print(cost("gpt-6-luna", 1_000, 300))     # 가장 저렴한 짧은 턴

Dos trampas que determinan el importe facturado

1. Los tokens de razonamiento se cobran como salida. Los modelos de razonamiento de la serie GPT-5 generan tokens de pensamiento que no aparecen en pantalla, y estos se calculan con la tarifa de salida. Aunque la respuesta tenga tres líneas, el importe no tiene por qué corresponder a solo tres líneas. Limitar max_tokens y reducir la intensidad del razonamiento dentro de lo que permita la tarea son las medidas de ahorro más directas.

2. Recargo por contexto largo. OpenAI aplica el doble de la tarifa de entrada y 1,5 veces la de salida a toda la solicitud (incluida la entrada en caché) cuando la entrada supera los 272.000 tokens. Kunavo aplica el mismo tramo a GPT-5.5, GPT-5.6 Sol·Terra y GPT-6 Astra·Sol·Luna. En ese tramo, las tarifas de la tabla anterior pasan a ser el doble para la entrada y 1,5 veces para la salida, mientras que el porcentaje de descuento sobre el precio de lista se mantiene. En tareas con mucho contexto, como RAG con documentos completos o análisis de bases de código, superar o no este tramo puede influir más en el importe que elegir un modelo u otro; por eso, cuando sea posible, divida la entrada para mantenerla por debajo de 272.000 tokens.

Integración con código existente de OpenAI

Kunavo ofrece un endpoint compatible con OpenAI, por lo que no necesita cambiar de SDK. base_url Basta con sustituir una línea y la clave.

gpt_kunavo.py
from openai import OpenAI

client = OpenAI(
    api_key="sk-kn-...",
    base_url="https://api.kunavo.com/v1",   # 이 한 줄만 바꾸면 됩니다
)

resp = client.chat.completions.create(
    model="gpt-5-6-terra",
    messages=[{"role": "user", "content": "안녕하세요"}],
)
print(resp.choices[0].message.content)

Con la misma clave puede llamar también a modelos de Claude, imagen y vídeo — consulte el catálogo de modelos para ver la lista y el inicio rápido para los detalles de los endpoints.

Pagos desde Corea del Sur

Los pagos se procesan mediante Stripe y funcionan como recargas prepagas. Se admiten tarjetas de crédito y débito nacionales e internacionales (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay y Google Pay; puedes recargar desde $10 como mínimo, se descuenta lo utilizado y el saldo no caduca. No necesitas una cuenta de OpenAI ni un contrato independiente.

Si la pantalla de pago se muestra en wones, KakaoPay, Naver Pay, PAYCO, Samsung Pay y las tarjetas nacionales también aparecerán como métodos para recargar Kunavo. Las tarjetas nacionales incluyen las que no tienen habilitadas las compras internacionales, y Toss no es compatible. Estos métodos sirven para recargar el saldo de Kunavo, no para pagar directamente a OpenAI. Los precios se fijan en USD y Stripe los convierte a wones según el tipo de cambio vigente en el momento del pago; dicho tipo incluye una comisión de conversión del 2–4 % pagada por el comprador. Esta comisión no se aplica al pagar en dólares, pero los métodos nacionales anteriores solo aparecen al pagar en wones. Consulta todos los métodos de pago en la documentación de pagos y el resumen de costes de Claude en Precios y pagos de la API de Claude.

Cuatro palancas para reducir costes

  1. Reduzca la salida. La salida, incluidos los tokens de razonamiento, es la parte más cara. Limitar max_tokens y ajustar la intensidad del razonamiento son las formas más rápidas de ahorrar.
  2. Baje de nivel según el tamaño del problema. Para tareas masivas como clasificación, extracción y resumen, pruebe primero GPT-6 Luna, el GPT más económico, y suba de nivel solo si resulta insuficiente. El precio de salida de Luna es igual al de GPT-6 Astra, el modelo de gama más alta, dividido entre 100.
  3. Use la caché para los contextos iniciales que se repiten (cómo funciona).
  4. Agrupe las tareas que no necesiten tiempo real. Si no es necesario hacer esperar al usuario, puede aumentar el rendimiento ejecutándolas simultáneamente.

Si el pago de la API de OpenAI está bloqueado, consulte cómo pagar la API de OpenAI.

Preguntas frecuentes

¿Cuánto cuesta la API de GPT?

Los precios se calculan por 1M de tokens. A fecha de 4 de octubre de 2026, el precio de lista de OpenAI para GPT-5.6 Terra es de $2.00 para la entrada / $12.00 para la salida, y en Kunavo el mismo modelo cuesta $0.70 / $4.20. Las demás tarifas de Kunavo son: GPT-6 Luna $0.04 / $0.20, GPT-6 Sol $0.80 / $4.00, GPT-5.5 $2.00 / $12.00, GPT-5.6 Sol $2.00 / $12.00 y GPT-6 Astra $4.00 / $20.00. Entre estos modelos, GPT-6 Luna es el GPT más económico.

¿Cuánto cuesta la API de GPT-6?

Tarifas de lista de GPT-6 Sol y GPT-6 Luna, publicados por OpenAI el 22 de septiembre de 2026, y de GPT-6 Astra, publicado el 3 de septiembre de 2026 (entrada/salida por 1M de tokens): GPT-6 Sol $2.00 / $10.00, GPT-6 Luna $0.10 / $0.50, GPT-6 Astra $10.00 / $50.00. Tarifas de entrada/salida de Kunavo por 1M de tokens: GPT-6 Sol $0.80 / $4.00, GPT-6 Luna $0.04 / $0.20, GPT-6 Astra $4.00 / $20.00. Los tres modelos son aproximadamente un 60% más baratos que la tarifa de lista. GPT-6 Luna es el GPT más barato de Kunavo, y GPT-6 Sol tiene una tarifa de salida inferior a la de GPT-5.6 Terra ($4.20) (la tarifa de entrada es menor para Terra: $0.70). En las solicitudes cuya entrada supera los 272.000 tokens, se aplica a toda la solicitud el doble de la tarifa de entrada y 1,5 veces la tarifa de salida, exactamente igual que en OpenAI.

¿Se puede usar la API de GPT gratis?

OpenAI no ofrece un nivel gratuito para la API de GPT: se cobra por tokens desde la primera llamada. Kunavo tampoco es gratuito, pero no requiere suscripción: es de pago por uso, se empieza con una recarga mínima de $10, se descuenta solo lo utilizado y el saldo no caduca. En los meses en que no uses nada, el coste es de $0.

¿Los tokens de razonamiento de GPT-5 se cobran aparte?

Los modelos de razonamiento de la familia GPT-5 generan tokens de razonamiento que no aparecen en pantalla, y esos tokens se cobran según la tarifa de salida. Por eso, aunque la respuesta parezca corta, el importe puede ser elevado. Cuando la tarea lo permita, limita max_tokens y reduce la intensidad del razonamiento: en la tabla de precios, lo caro siempre es la salida.

¿Las solicitudes con entradas largas cuestan más?

Sí. OpenAI aplica el doble de la tarifa de entrada y 1,5 veces la tarifa de salida a toda la solicitud (incluida la entrada en caché) cuando la entrada supera los 272.000 tokens, y Kunavo aplica el mismo umbral a GPT-5.5, GPT-5.6 Sol y Terra, y GPT-6 Astra, Sol y Luna. El porcentaje de descuento frente al precio oficial es el mismo antes y después del umbral. En tareas con mucho contexto, como introducir un documento largo completo en un RAG o analizar una base de código, superar este umbral puede influir más en el importe que la elección del modelo.

¿Cómo se puede reducir el coste de la API de GPT?

Hay cuatro medidas, en orden de eficacia: reducir la salida (incluidos los tokens de razonamiento, porque la salida es lo más caro), bajar de nivel según el tamaño del problema (para tareas masivas como clasificación y extracción, empieza por el GPT-6 Luna más barato), usar prompt caching para el contexto inicial que se repite y agrupar las tareas que no necesitan tiempo real. Además, cambiar base_url a un endpoint más barato multiplica el ahorro.

¿Cómo se paga la API de GPT desde Corea del Sur?

Kunavo procesa los pagos mediante Stripe: admite tarjetas de crédito y débito nacionales e internacionales (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay y Google Pay. Es un servicio prepago de pago por uso: recarga desde $10 como mínimo y se descuenta lo utilizado; el saldo no caduca. Si la pantalla de pago se muestra en wones, también aparecerán KakaoPay, Naver Pay, PAYCO, Samsung Pay y tarjetas nacionales (incluidas las que no tienen habilitadas las compras internacionales). Tos no es compatible. Todos son métodos para recargar el saldo de Kunavo, no pagos directos a OpenAI. No necesitas una cuenta de OpenAI ni un contrato independiente. Para empezar, regístrate y después genera una clave.

¿Puedo usar sin cambios mi código existente del SDK de OpenAI?

Sí. Kunavo ofrece un endpoint compatible con OpenAI: cambia base_url a https://api.kunavo.com/v1 y sustituye la clave. El resto del código puede permanecer igual, y con la misma clave puedes llamar a modelos de Claude, imágenes y vídeo.