«Alternativa a la API de OpenAI» puede referirse a dos cambios distintos, y la mayoría de las recopilaciones que aparecen en esta búsqueda responden solo a uno. Cambiar el modelo —a Claude, Gemini o modelos de pesos abiertos— cambia los proveedores, las cuentas, los SDK y la facturación. Cambiar el endpoint cambia un base_url y una clave de API, y deja tu código intacto, porque lo que se copia es el formato de comunicación de OpenAI. Decide primero qué cambio vas a hacer; una lista de modelos no puede decirte cuánto costará la migración.
La pregunta que omiten las listas es la que realmente lo decide: qué superficies de OpenAI sobreviven al cambio. Esta página responde a esa pregunta específicamente para Kunavo, incluidas las tres filas cuya respuesta es no. Sesgo declarado: Kunavo es nuestro producto: una puerta de enlace independiente compatible con OpenAI, no OpenAI ni Anthropic. Tarifas y disponibilidad verificadas por última vez 1 de octubre de 2026.
Las tres rutas y lo que cada una te cuesta en código
| Ruta | Qué cambia en tu código | Elígela cuando |
|---|---|---|
| La API propia de otro proveedor | SDK nuevo, autenticación nueva y estructuras de solicitud nuevas | Quieres toda la superficie de un proveedor, incluidas las partes que solo este ofrece |
| Una puerta de enlace compatible con OpenAI | base_url y la clave | Quieres modelos de varios proveedores sin varias cuentas |
| Un servidor compatible con OpenAI autoalojado | base_url y la clave, además de ejecutar el servidor | El texto de los prompts no puede salir de tu infraestructura |
El endpoint de compatibilidad propio de un proveedor es una cuarta opción más limitada: Google publica una capa de compatibilidad con OpenAI para la API de Gemini, que consiste en el mismo cambio de base_url, limitado a los modelos de un solo proveedor.
Cambiar el endpoint, en detalle
# The whole migration, when you swap the endpoint rather than the model.
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...", # was sk-proj-...
base_url="https://api.kunavo.com/v1", # the only other line that moves
)
# Same SDK, same call shape, same streaming, same tool-call format.
resp = client.chat.completions.create(
model="claude-sonnet-5", # now reachable on the same key
messages=[{"role": "user", "content": "Summarise this changelog."}],
stream=True,
)Qué superficies de OpenAI sobreviven al cambio
Lee la columna central antes de migrar. «Solo ruta» significa que el formato de comunicación está implementado y que no hay ningún modelo habilitado detrás, por lo que la llamada falla; es una sorpresa peor que una ruta no implementada, y por eso aparece la fila en lugar de omitirse discretamente.
| Superficie de OpenAI | En Kunavo | Qué es / nota |
|---|---|---|
/v1/chat/completions | sí | Chat, streaming, tool calls — The one almost every migration is about. |
/v1/responses | sí | The Responses API — Implemented — this is what Codex CLI speaks. |
/v1/models | sí | List what you can call — Always the authority on availability. |
/v1/images/generations | sí | Texto a imagen |
/v1/images/edits | sí | Image editing — Prompt-directed; no mask inpainting. |
/v1/embeddings | solo la ruta | Embeddings — Route exists, no model enabled — embed against OpenAI, Voyage or Cohere directly. |
/v1/audio/speech | solo la ruta | Text to speech — Route exists, no model enabled. |
/v1/audio/transcriptions | solo la ruta | Speech to text — Route exists, no model enabled. |
/v1/files | sí | Upload a source image — For image edits and image-to-video. |
Assistants, Threads, Vector Stores | no | OpenAI's hosted agent state — Not implemented. Keep that state in your own app. |
Realtime | no | Realtime voice sessions — Not implemented. |
Batch, Fine-tuning, Moderations | no | No implementado. |
Las filas «solo ruta» de 3 son las que debes tener en cuenta al planificar. Una canalización RAG es el caso habitual: genera los embeddings directamente con un proveedor de embeddings y genera el texto mediante la puerta de enlace. En cualquier caso, son dos llamadas HTTP independientes, por lo que el coste es una segunda clave, no una segunda arquitectura. GET /v1/models es siempre la autoridad sobre lo que se puede invocar hoy.
Cuánto cuesta el cambio por token
Comparación equivalente en Kunavo a septiembre de 2026: Claude Sonnet 4.6 a $2.10 de entrada / $10.50 de salida por 1M de tokens frente a $3.00 / $15.00 de Anthropic, y GPT-5.6 Sol a $2.00 / $12.00 frente al precio promocional de $4.00 / $20.00 que OpenAI cobra ahora (tarifa de lista: $5.00 / $30.00; la promoción dura al menos hasta 21 de noviembre de 2026). Comprueba los datos de OpenAI en su página de precios en lugar de confiar solo en los nuestros. El factor que normalmente mueve más una factura que la elección del proveedor es el almacenamiento en caché de prompts: un agente vuelve a enviar un prompt de sistema grande en cada turno, por lo que la entrada sin caché domina el coste.
Lo que Kunavo no es
No es OpenAI ni una forma de obtener más barato en otro lugar la infraestructura de agentes alojada de OpenAI: Assistants, Threads, Vector Stores, Realtime, Batch, el ajuste fino y las moderaciones no están implementados, y una aplicación basada en ellos no puede trasladarse simplemente cambiando el base_url. Tampoco es alojamiento de modelos de pesos abiertos: si lo que quieres es ejecutar Llama o Qwen en tu propio hardware, la ruta es un servidor compatible con OpenAI autoalojado, y esto no lo es. Y tampoco es un proveedor de embeddings, como indica la tabla anterior.
Para las comparaciones relacionadas: alternativas a OpenRouter, los cuatro tipos de puertas de enlace para LLM y la referencia del endpoint de chat para consultar las estructuras exactas de las solicitudes y respuestas.
Preguntas frecuentes
¿Cuáles son las mejores alternativas a la API de OpenAI?
Depende del cambio que quieras hacer, y la mayoría de las recopilaciones de esta búsqueda responden principalmente a una de dos necesidades. Si quieres un modelo diferente, la lista corta incluye Claude de Anthropic, Gemini de Google y las familias de pesos abiertos ofrecidas por proveedores de inferencia. Si quieres conservar tu código de OpenAI y cambiar el destino al que apunta, la lista corta es distinta: una puerta de enlace compatible con OpenAI, como Kunavo u OpenRouter; un endpoint de compatibilidad propio de un proveedor, como el de Google; o un servidor compatible con OpenAI autohospedado, como Ollama o vLLM. El segundo tipo de cambio requiere modificar base_url y la clave; el primero puede requerir migrar el SDK.
¿Existe una alternativa gratuita a la API de OpenAI?
No para tráfico de producción de un proveedor alojado: la inferencia consume tiempo real de GPU y nadie la ofrece de forma gratuita y sin límites. Las rutas realmente gratuitas son autohospedar modelos de pesos abiertos en hardware que ya pagas (Ollama y vLLM exponen un endpoint compatible con OpenAI, por lo que el cambio de código consiste en sustituir base_url) y los niveles gratuitos que algunos proveedores ofrecen con límites diarios estrictos. Si una API compatible con OpenAI anuncia acceso gratuito ilimitado, pregunta qué está sirviendo realmente como proxy y qué hace con tus prompts.
¿Qué API es más barata, OpenAI o Anthropic?
Ninguna es uniformemente más barata: depende del nivel que utilices y de cuánto se repita tu entrada. Comparando equivalentes en Kunavo a fecha de septiembre de 2026: Claude Sonnet 4.6 cuesta $2.10 de entrada / $10.50 de salida por 1M de tokens y GPT-5.6 Sol cuesta $2.00 / $12.00. El factor que normalmente mueve más una factura que la elección del proveedor es el almacenamiento en caché de prompts, porque un agente reenvía un prompt de sistema grande en cada turno, y la entrada almacenada en caché se factura a una fracción de la entrada nueva en ambas familias.
¿Puedo desactivar la API de OpenAI sin cambiar mi código?
En su mayor parte, y las excepciones son precisamente para lo que sirve la tabla de compatibilidad de esta página. Si tu aplicación usa completions de chat, streaming, llamadas a herramientas y la API de Responses, una puerta de enlace compatible con OpenAI consiste en un base_url y una clave de API; el SDK, las estructuras de las solicitudes y las estructuras de las respuestas se mantienen. Lo que no se traslada es el estado alojado de los agentes de OpenAI (Assistants, Threads, Vector Stores), la API de Realtime, Batch, el ajuste fino y las moderaciones, ninguno de los cuales implementa Kunavo. Comprueba las superficies específicas que utiliza tu código antes de asumir que el cambio será directo.
¿Una puerta de enlace compatible con OpenAI admite embeddings?
No automáticamente, y es la superficie con más probabilidades de faltar; compruébalo antes de migrar, no después. En Kunavo específicamente, /v1/embeddings es un formato de comunicación implementado sin ningún modelo habilitado detrás, por lo que la llamada falla y el paso de embeddings de una canalización RAG debe dirigirse directamente a OpenAI, Voyage o Cohere. Eso requiere una segunda clave de API y nada más, porque la llamada de embeddings y la llamada de generación son solicitudes independientes en cualquier caso. GET /v1/models es siempre la autoridad sobre lo que realmente se puede invocar.
¿Una API compatible con OpenAI es lo mismo que OpenAI?
No. Una API compatible con OpenAI copia el formato de comunicación —las estructuras de las URL, los cuerpos de las solicitudes y los cuerpos de las respuestas— para que tu cliente existente pueda comunicarse con ella. No la ejecuta OpenAI, no necesariamente ofrece los modelos de OpenAI y toma sus propias decisiones sobre la retención de datos, los límites de velocidad y las superficies que implementa. Kunavo es una puerta de enlace independiente, no OpenAI ni Anthropic, y por eso la tabla anterior indica tanto lo que funciona como lo que no.