Volver a las guías
Precios·11 de septiembre de 2026·Actualizado el 3 de octubre de 2026·10 min de lectura

Costes de la API de OpenAI en 2026: cuánto cuesta realmente GPT por solicitud

La API de OpenAI factura por token; una suscripción de ChatGPT es independiente. Tarifas actuales por modelo, cuánto cuesta realmente una solicitud y las dos trampas que hacen fallar cualquier estimación.

La API de OpenAI se factura por token, no por mes. Los tokens de input y output tienen tarifas separadas, y el output es la parte más cara. En Kunavo, el intervalo va de $0,04 / $0,20 por 1M de tokens para GPT-6 Luna a $4,00 / $20,00 para GPT-6 Astra, el buque insignia más reciente de OpenAI; entre ambos se encuentran, por ejemplo, GPT-6 Sol con $0,80 / $4,00 y el modelo de trabajo GPT-5.6 Terra con $0,70 / $4,20 — según el modelo, 60–65% por debajo del precio de lista de OpenAI. Una suscripción de ChatGPT es independiente: no incluye uso de la API, y la API no requiere una suscripción.

Tarifas vigentes: 3 de octubre de 2026. Esta página lee en directo las tarifas de Kunavo del catálogo de modelos; lo que aparece aquí es lo que factura la API. La columna «Lista de OpenAI» reproduce el precio publicado por OpenAI para el mismo modelo; la fuente es openai.com/api/pricing.

Suscripción de ChatGPT y API de OpenAI: dos productos, dos facturas

Quien busca «coste de la API de ChatGPT» a menudo quiere saber primero otra cosa: si la suscripción existente de ChatGPT ya cubre la API. La respuesta es no.

Qué utilizaCómo se facturaPara quién
ChatGPT (Free, Plus, Pro …)Importe fijo mensual, con los límites de uso del planPersonas que trabajan en la ventana de chat
API de OpenAI (clave + crédito)Por token, sin cuota mensualSoftware propio, automatización y agentes

Una suscripción no incluye ni una clave de API ni crédito de API y no reduce la factura de la API ni un centavo; a la inversa, el crédito de API no amplía las cuotas de ChatGPT. OpenAI indica los precios de las suscripciones en openai.com/chatgpt/pricing; cambian con frecuencia, por eso no aparecen aquí. Esta página trata únicamente de la API, la parte que cuesta por token.

Precios de la API de OpenAI por modelo

Tarifas en USD por millón de tokens, tal como las factura Kunavo. La columna «Lista de OpenAI» es el precio publicado para el mismo modelo.

ModeloEntrada / 1MSalida / 1MLista de OpenAI (entrada / salida)Ahorro
gpt-6-astra$4,00$20,00$10,00 / $50,00~60%
gpt-5-6-sol$2,00$12,00$5,00 / $30,00
Precio promocional $4,00 / $20,00 (como mínimo hasta 21 de noviembre de 2026)
~60%
~40% por debajo del precio promocional
gpt-5-5$2,00$12,00$5,00 / $30,00~60%
gpt-5-6-terra$0,70$4,20$2,00 / $12,00~65%
gpt-6-sol$0,80$4,00$2,00 / $10,00~60%
gpt-6-luna$0,04$0,20$0,10 / $0,50~60%

Las tarifas en directo aparecen siempre en la página de precios y en cada página de modelo, como GPT-6 Astra, GPT-6 Sol o GPT-6 Luna. Qué modelo usar y para qué:

  • gpt-6-astra: el buque insignia más reciente de OpenAI (desde el 3 de septiembre de 2026): razonamiento de primer nivel y largas ejecuciones de programación agéntica. Para la minoría de tareas difíciles.
  • gpt-6-sol: desde el 22 de septiembre de 2026; OpenAI lo posiciona para programación compleja y flujos de trabajo agénticos. En Kunavo $0,80 / $4,00, con el output por debajo de GPT-5.6 Terra, ligeramente por encima en input. La opción estándar sensata para programación y agentes.
  • gpt-6-luna: desde el 22 de septiembre de 2026; según OpenAI, es el modelo más eficiente para tareas acotadas de gran volumen, como clasificar y extraer. Con $0,04 / $0,20, es el nivel más económico de Kunavo.
  • gpt-5-6-sol: razonamiento de primer nivel y programación agéntica de la generación 5.6; para prompts ya adaptados a ella.
  • gpt-5-6-terra: el modelo de trabajo de la familia 5.6: RAG, asistentes, clasificación, extracción y la mayoría de las tareas de producción.
  • gpt-5-5: el buque insignia de la generación anterior. GPT-5.6 Sol cuesta en Kunavo la misma tarifa ($2,00 / $12,00); quien todavía use gpt-5-5 puede cambiar a la generación más reciente modificando el nombre del modelo, sin coste adicional por token.

GPT-6 Sol y GPT-6 Luna. El 22 de septiembre de 2026, OpenAI amplió la familia GPT-6 con dos modelos que, según afirma, se basan en los avances de GPT-6 Astra. OpenAI lista GPT-6 Sol a $2,00 / $10,00 y GPT-6 Luna a $0,10 / $0,50 por 1M de tokens; en Kunavo cuestan $0,80 / $4,00 y $0,04 / $0,20. Ambos tienen una ventana de contexto de 1.050.000 tokens y ofrecen hasta 128.000 tokens de output.

Lo que cuesta de más GPT-6 Astra. Frente a GPT-6 Sol, GPT-6 Astra cuesta 5 veces, tanto para entrada como para salida, y frente a GPT-5.6 Sol, 2 veces para la entrada y 1,7 veces para la salida. La recomendación honesta: GPT-6 Sol como estándar para programación y agentes, GPT-6 Luna para tareas masivas, y Astra de forma selectiva allí donde una comparación con las mismas entradas demuestre que Sol no basta; el nombre del modelo es una sola palabra en la solicitud, por lo que la prueba es barata.

Un recargo para solicitudes muy largas. Por encima de 272.000 tokens de prompt, GPT-5.5, la familia GPT-5.6 y los tres modelos GPT-6 —Astra, Sol y Luna— facturan la solicitud completa con una tarifa de input multiplicada por 2 y una tarifa de output multiplicada por 1,5. Quien incluya bases de código completas o documentos largos en una llamada debe conocer este umbral: puede influir más que la elección del modelo.

Lo que realmente cuesta una solicitud

Calculado con las tarifas de Kunavo, sin almacenamiento en caché ni tokens de razonamiento; es decir, el límite inferior de lo que aparece en la factura:

TareaTokens (entrada / salida)GPT-6 LunaGPT-5.6 TerraGPT-6 SolGPT-5.6 SolGPT-6 Astra
Ronda de chat breve1.000 / 300$0,0001$0,00196$0,002$0,0056$0,01
RAG-Antwort6.000 / 500$0,00034$0,0063$0,0068$0,018$0,034
Paso de programación agéntico25.000 / 1.200$0,00124$0,0225$0,0248$0,0644$0,124
Tarea de razonamiento compleja20.000 / 3.000$0,0014$0,0266$0,028$0,076$0,14
Lote: 100.000 clasificaciones500 / 20 por llamada$2,40$43,40$48,00$124,00$240,00

Con la recarga mínima de $10 se ejecutan aproximadamente 1.590 respuestas RAG en GPT-5.6 Terra y, en GPT-6 Luna, aproximadamente 29.400. Entre GPT-6 Luna y GPT-6 Astra hay un factor aproximado de 100 en el output; en tareas sencillas, la elección del modelo es el mayor factor individual. Para recalcularlo con sus propios datos:

openai_kosten.py
# OpenAI-Tarife auf Kunavo (USD pro 1M Tokens): (Input, Output)
RATES = {
    "gpt-6-astra":   (4, 20),
    "gpt-5-6-sol":   (2, 12),
    "gpt-5-5":       (2, 12),
    "gpt-5-6-terra": (0.7, 4.2),
    "gpt-6-sol":     (0.8, 4),
    "gpt-6-luna":    (0.04, 0.2),
}

def kosten(model: str, frisch: int, output: int, cache_treffer: int = 0) -> float:
    """frisch = nicht gecachter Input; output schließt Reasoning-Tokens ein."""
    i, o = RATES[model]
    return (
        frisch / 1_000_000 * i
        + output / 1_000_000 * o
        + cache_treffer / 1_000_000 * i * 0.10  # Cache-Treffer: 10 % des Input-Tarifs
    )

print(kosten("gpt-5-6-terra", 1_000, 300))    # kurze Chat-Runde
print(kosten("gpt-5-6-terra", 6_000, 500))    # RAG-Antwort
print(kosten("gpt-5-6-sol", 25_000, 1_200))   # agentischer Coding-Schritt
print(kosten("gpt-6-sol", 25_000, 1_200))     # derselbe Schritt auf GPT-6 Sol
print(kosten("gpt-6-astra", 20_000, 3_000))   # schwere Reasoning-Aufgabe
print(kosten("gpt-6-luna", 500, 20))          # eine Klassifizierung

# Ein Monat auf Sol: 3 Mio. frische und 12 Mio. gecachte Input-Tokens,
# 1 Mio. Output-Tokens (Cache-Writes nicht eingerechnet)
print(kosten("gpt-5-6-sol", 3_000_000, 1_000_000, cache_treffer=12_000_000))

Dos trampas de costes que toda estimación pasa por alto

Primero: los tokens de razonamiento. Los modelos de razonamiento, como GPT-6 Astra o GPT-5.6 Sol, piensan antes de responder mediante tokens internos. No aparecen en el texto de respuesta, pero se facturan a la tarifa de output. Los cálculos de ejemplo de esta página no los incluyen; por eso, en tareas complejas, la factura real será mayor. La cifra real aparece en cada respuesta bajo usage (completion_tokens_details.reasoning_tokens).

Segundo: las repeticiones. Una respuesta que llega correctamente y que su código descarta —por formato incorrecto o por un nuevo intento— está pagada. En los agentes, una tarea visible suele implicar una docena de ejecuciones facturadas, y ahí es donde mayor resulta la distancia entre la estimación y la factura. Las solicitudes que fallan en la propia Kunavo no se facturan.

Almacenamiento en caché de prompts

Si su aplicación envía el mismo prompt de sistema largo o los mismos documentos en cada solicitud, los aciertos de caché se facturan al 10% de la tarifa de input; en GPT-5.6 Sol, eso equivale a $0,20 en lugar de $2,00 por 1M de tokens. Escribir en la caché cuesta en Kunavo 1,25 veces la tarifa de input en GPT-5.6 Sol, Terra y GPT-6 Astra, y la tarifa normal de input en GPT-5.5. Cómo conseguir un acierto de caché se explica en la documentación de almacenamiento en caché.

Adaptar código existente de OpenAI

Kunavo es compatible con OpenAI: cambie base_url y la clave, y nada más. chat.completions y responses conservan su formato, y la respuesta incluye, como de costumbre, el campo usage, que permite reconstruir cada factura.

openai_kunavo.py
from openai import OpenAI

client = OpenAI(
    api_key="sk-kn-...",
    base_url="https://api.kunavo.com/v1",  # statt api.openai.com
)

resp = client.chat.completions.create(
    model="gpt-5-6-terra",
    messages=[{"role": "user", "content": "Fasse diese Rechnung in drei Sätzen zusammen."}],
)
print(resp.choices[0].message.content)
print(resp.usage)  # Input-, Output- und Reasoning-Tokens: die Grundlage der Abrechnung

Cree la clave (sk-kn-…) después de la registración, en el panel de control. Allí también puede establecer por clave un límite mensual de gasto; cuando se alcanza, la clave responde con 402; y una lista de IP permitidas. Los pasos se muestran en el inicio rápido.

Pagar la API de OpenAI desde Alemania

Kunavo factura mediante Stripe, como saldo prepago: sin suscripción ni necesidad de configurar una cuenta de OpenAI Platform. En el checkout puede elegir:

  • Tarjetas: Visa, Mastercard, American Express, JCB y UnionPay; las tarjetas de débito Visa y Mastercard funcionan como tarjetas de crédito
  • Apple Pay, Google Pay y Link

Actualmente no se ofrece el débito directo SEPA. Las recargas se expresan en dólares estadounidenses; Stripe muestra el importe en su moneda en el checkout. La recarga mínima es de $10; las recargas mayores incluyen saldo de bonificación: $100 se convierten en $110,00, $1.000 en $1.200,00 y $5.000 en $6.250,00. El saldo no caduca y las solicitudes fallidas no generan cargos. Los detalles están en la documentación de facturación.

Con honestidad: cuándo es mejor ir directamente a OpenAI

Kunavo es una pasarela con capacidad compartida: no hay una cuota propia para su cuenta ni un SLA contractual. Quien necesite una cuota garantizada o un SLA, por ejemplo para un producto con disponibilidad comprometida, debería comprar directamente a OpenAI. Esta página no afirma cubrir ese caso.

Y para quienes trabajan todo el día en la ventana de chat, una suscripción de ChatGPT suele ser la opción más barata. El cálculo es una división: precio de la suscripción ÷ coste de una ronda de chat = punto de equilibrio. Una ronda con 2.000 tokens de input y 700 de output cuesta aproximadamente $0,0124 en GPT-5.6 Sol, y aproximadamente $0,00434 en GPT-5.6 Terra. Quien mes tras mes realice más rondas que las que indique esta división, manteniéndose dentro de los límites del plan, estará mejor con la suscripción. La API gana en software, automatización y uso variable: allí donde un mes tranquilo no debería costar nada.

Reducir los costes de la API de OpenAI, en este orden

  1. Elegir el modelo adecuado para la tarea. Dejar el modelo más grande como opción predeterminada es la causa más frecuente de una factura inesperada. La clasificación, la extracción y otras tareas masivas deben usar gpt-6-luna; la programación y los agentes, gpt-6-sol; y la minoría difícil, Astra.
  2. Limitar el output. El output cuesta varias veces más que el input, y el razonamiento cuenta también; por eso, un límite superior a max_tokens tiene un efecto doble.
  3. Usar el almacenamiento en caché de prompts. Un prompt de sistema largo y estable cuesta una décima parte de la tarifa de input cuando es un acierto de caché.
  4. Enviar menos contexto. Unos pocos fragmentos RAG precisos en lugar de la mitad de la base de conocimientos, y mantenerse por debajo del umbral de 272.000 tokens siempre que sea posible.

Recalcule con sus propios datos: el calculador de precios de la API de OpenAI incluye el input almacenado en caché y los tokens de razonamiento; el calculador de tokens muestra Claude y GPT uno al lado del otro. La alternativa para Anthropic: Precios de Claude. Si no son los costes, sino los límites, lo que le frena: Límites de velocidad de la API de OpenAI (en inglés).

Preguntas frecuentes

¿Cuánto cuesta la API de OpenAI?

La API de OpenAI se factura por token, sin cuota mensual: los tokens de input y output tienen tarifas separadas, y el output es la parte más cara. En Kunavo, GPT-5.6 cuesta Terra $0,70 / $4,20 por 1M de tokens (input / output), GPT-5.6 cuesta Sol $2,00 / $12,00 y el buque insignia más reciente de OpenAI, GPT-6, cuesta Astra $4,00 / $20,00. Los precios de lista de OpenAI para los mismos modelos son $2,00 / $12,00, $5,00 / $30,00 y $10,00 / $50,00; para GPT-5.6 Sol, OpenAI cobra actualmente un precio promocional de $4,00 / $20,00, según la página de precios al menos hasta 21 de noviembre de 2026. Fecha: 3 de octubre de 2026.

¿La API está incluida en la suscripción de ChatGPT?

No. Una suscripción de ChatGPT, como Plus o Pro, paga el uso de ChatGPT propiamente dicho: en el navegador, la aplicación y el escritorio. No incluye una clave de API ni crédito de API, y no reduce la factura de la API ni un centavo. Quien llama a GPT desde su propio software necesita una clave de API y paga por token, por separado de la suscripción. A la inversa, el crédito de API no amplía las cuotas de ChatGPT.

¿Cuánto cuesta una solicitud a la API de ChatGPT?

Lo que coloquialmente se llama «API de ChatGPT» es la API de OpenAI con los modelos GPT, y factura cada solicitud según los tokens. Con las tarifas de Kunavo, una respuesta RAG con 6.000 tokens de input y 500 de output en GPT-5.6 Terra cuesta aproximadamente $0,0063, un paso de programación agéntico con 25.000 / 1.200 tokens en GPT-5.6 Sol cuesta aproximadamente $0,0644, y una tarea compleja con 20.000 / 3.000 tokens en GPT-6 Astra cuesta aproximadamente $0,14. Los tokens de razonamiento se suman a la tarifa de output.

¿Puedo probar la API de OpenAI gratis?

Kunavo no ofrece crédito inicial, pero tampoco cobra cuota mensual ni exige permanencia mínima. La entrada más pequeña es la recarga mínima de $10; con ella se ejecutan aproximadamente 1.590 respuestas RAG en GPT-5.6 Terra. El crédito nunca caduca, un mes sin llamadas no cuesta nada y las solicitudes fallidas no se facturan.

¿Cómo se facturan los tokens de razonamiento?

Sobre la tarifa de salida. Los modelos de razonamiento, como GPT-6 Astra o GPT-5.6 Sol, piensan antes de responder utilizando tokens internos; estos no aparecen en el texto de respuesta, pero sí en la facturación. El número real lo proporciona cada respuesta en el campo usage (completion_tokens_details.reasoning_tokens). En tareas exigentes, este es el motivo más frecuente por el que la factura real supera una estimación; un límite mediante max_tokens lo acota.

¿Cuánto cuesta GPT-6 Astra?

GPT-6 Astra es el modelo insignia más reciente de OpenAI desde el 3 de septiembre de 2026; OpenAI lo lista a $10,00 / $50,00 por 1M de tokens. En Kunavo cuesta $4,00 / $20,00: aproximadamente un 60% por debajo del precio de lista. Frente a GPT-5.6 Sol, la tarifa de entrada se multiplica por 2 y la de salida por 1,7; por eso Astra merece la pena para la minoría de tareas difíciles en las que se ha demostrado que Sol no resulta suficiente. Por encima de 272.000 tokens de prompt, también en Astra se cobra la solicitud completa con una tarifa de entrada multiplicada por 2 y una tarifa de salida multiplicada por 1,5.

¿Cuánto cuestan GPT-6 Sol y GPT-6 Luna?

OpenAI publicó GPT-6 Sol y GPT-6 Luna el 22 de septiembre de 2026: Sol para programación compleja y flujos de trabajo agénticos, y Luna, según OpenAI, como el modelo más eficiente para tareas claramente delimitadas y de gran volumen. OpenAI lista Sol a $2,00 / $10,00 y Luna a $0,10 / $0,50 por 1M de tokens (entrada / salida); en Kunavo cuestan $0,80 / $4,00 y $0,04 / $0,20, beide rund 60% darunter. Por tanto, GPT-6 Luna es el modelo GPT más barato de Kunavo. Al igual que con GPT-5.5, la familia GPT-5.6 y GPT-6 Astra, una solicitud con más de 272.000 tokens de solicitud se cobra íntegramente con una tarifa de entrada multiplicada por 2 y una tarifa de salida multiplicada por 1,5.

¿Puedo pagar desde Alemania mediante domiciliación SEPA?

No, actualmente no se ofrece el débito directo SEPA. En el checkout de Stripe puede elegir tarjetas (Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay, Google Pay y Link; una tarjeta de débito Visa o Mastercard funciona como una tarjeta de crédito. Es un saldo prepago con una recarga mínima de $10, sin suscripción y sin caducidad.

¿Mi código existente de OpenAI funciona con Kunavo?

Sí. Kunavo es compatible con OpenAI: establece base_url en https://api.kunavo.com/v1 y sustituye la clave por una clave de Kunavo (sk-kn-…); chat.completions y responses mantienen su formato. Los nombres de los modelos son gpt-6-astra, gpt-5-6-sol, gpt-5-5, gpt-5-6-terra, gpt-6-sol y gpt-6-luna. La misma clave también permite llamar a Claude y a modelos de imagen y vídeo.