Volver a las guías
Vídeo·18 de junio de 2026·Actualizado el 1 de octubre de 2026·7 min de lectura

API de Sora — texto a vídeo en un flujo compatible con OpenAI

Sora es el modelo de texto a vídeo de OpenAI. En Kunavo, el modelo disponible actualmente es Google Veo 3.1, en el mismo endpoint de vídeo al estilo de OpenAI. Este es el flujo de trabajo; el acceso a Sora está en la hoja de ruta.

Sora es el modelo de texto a vídeo de OpenAI, y «la API de Sora» es la forma en que los equipos generan vídeo programáticamente en lugar de mediante la aplicación de consumo. Actualmente, en Kunavo, la generación de texto a vídeo funciona con Google Veo 3 mediante un único endpoint de vídeo con estilo OpenAI. El acceso a Sora está en la hoja de ruta y, como el endpoint es independiente del modelo, migrar a Sora más adelante será un cambio de una sola palabra. Esta guía muestra el flujo de trabajo con Veo 3 para que todos los ejemplos funcionen ahora.

¿Qué es la API de Sora?

Sora (Sora 2 y Sora 2 Pro) transforma una instrucción de texto —o una imagen estática— en un videoclip corto, con audio sincronizado en Sora 2. El formato de API permite programar la generación dentro de un pipeline: tomas de marketing, animaciones de productos, material de apoyo y vistas previas de storyboards. El formato es el mismo en los modelos de vídeo modernos: envías una instrucción y parámetros, y recibes la URL de un vídeo alojado.

Vídeo en Kunavo hoy: Veo 3

Kunavo ofrece generación de vídeo mediante un único endpoint con estilo OpenAI, /v1/video/generations. Sora aún no está habilitado en el catálogo; el modelo activo de texto a vídeo es Google Veo 3, que produce clips cinematográficos con audio nativo. Los ejemplos siguientes usan veo-3; cuando llegue Sora, el único cambio será el campo model.

Inicio rápido de texto a vídeo

Un POST con tu clave de Kunavo. La generación puede tardar unos minutos, por lo que la llamada síncrona mantiene abierta la conexión hasta que el clip está listo:

texto_para_video.py
import requests

resp = requests.post(
    "https://api.kunavo.com/v1/video/generations",
    headers={"Authorization": f"Bearer {API_KEY}"},
    json={
        "model": "veo-3",
        "prompt": "um dolly-in cinematográfico em um origami de garça vermelha se abrindo, luz suave",
        "aspect_ratio": "16:9",
    },
    timeout=600,  # a geração pode levar minutos
)
print(resp.json()["data"][0]["url"])

duration (en segundos) define la duración del clip en los modelos con facturación por segundo: los modelos Seedance y el modelo Wan 2.7. Los modelos Veo lo ignoran; cada clip de Veo dura 8 segundos y se factura por vídeo.

De imagen a vídeo

Para animar una imagen estática, pasa image_url (una URL https o un archivo subido a /v1/files) junto con la instrucción. Para controlar el movimiento, puedes pasar un primer y un último fotograma con image_urls y image_mode: "frame". Encontrarás ejemplos completos en la documentación de vídeo.

Ciclo de vida de una tarea asíncrona

En producción, no mantengas una conexión abierta durante 10 minutos. Envía una tarea a /v1/videos, recibe inmediatamente un id de tarea y luego consulta GET /v1/videos/{id} periódicamente hasta que termine. Las URL de resultados son permanentes.

envio_assincrono.py
# Produção: envie uma tarefa e faça polling — sem conexão de longa duração.
task = requests.post(
    "https://api.kunavo.com/v1/videos",
    headers={
        "Authorization": f"Bearer {API_KEY}",
        "Idempotency-Key": "meu-uuid-de-tarefa",   # seguro para retry em ~24h
    },
    json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
    timeout=60,
).json()
# depois faça polling em GET /v1/videos/{task["id"]} até concluir

La documentación de vídeo cubre el ciclo completo de consultas periódicas, las claves de idempotencia y la entrega mediante webhook.

Precios

Veo 3 se factura por vídeo (por un clip de 8 segundos en 720p, como se muestra aquí), aproximadamente un 50–70% por debajo del precio de lista de Google. Las resoluciones superiores cuestan más; consulta la página de precios para ver la tabla completa de rangos.

ModeloDesde (720p / 8 s)Precio de lista de GoogleAhorro
veo-3-lite$0.18$0.45~60%
veo-3 (Fast)$0.36$1.20~70%
veo-3-quality$1.60$3.20~50%

Consejos para crear instrucciones de vídeo

  • Describe la toma, no solo el sujeto. El movimiento de cámara (dolly, paneo, acercamiento), la sensación de la lente, la iluminación y el ritmo importan más que los adjetivos.
  • Define explícitamente la relación de aspecto: 16:9 para horizontal, 9:16 para vertical/redes sociales.
  • Cada clip de Veo dura 8 segundos. Planifica cada toma para esa duración y une varias generaciones para crear secuencias más largas.
  • Usa un fotograma de referencia (imagen a vídeo) cuando necesites mantener la coherencia de un personaje o producto específico.

Preguntas frecuentes

¿Se puede usar hoy la API de Sora en Kunavo?

Sora todavía no está habilitado en el catálogo de Kunavo. La generación de texto a vídeo funciona actualmente con Google Veo 3 mediante el mismo endpoint /v1/video/generations con estilo OpenAI. Como el endpoint es independiente del modelo, migrar a Sora más adelante será un cambio de una sola palabra en el campo model. El acceso a Sora está en la hoja de ruta.

¿Qué es la API de Sora?

Sora es el modelo de texto a vídeo de OpenAI (Sora 2 y Sora 2 Pro). La API de Sora genera clips de vídeo cortos — con audio sincronizado en Sora 2 — a partir de un prompt de texto o de una imagen estática, de forma programática en lugar de mediante la aplicación de consumo.

¿Cuánto cuesta generar vídeo en Kunavo?

Veo 3 se factura por vídeo, aproximadamente un 50–70% por debajo del precio de lista de Google: Veo 3 Lite desde $0.18, Veo 3 Fast desde $0.36 y Veo 3 Quality desde $1.60 por clip de 8 segundos en 720p. Las resoluciones superiores cuestan más.

¿Kunavo admite imagen a vídeo?

Sí. Pasa image_url (una URL https o un archivo subido) a /v1/video/generations para animar una imagen estática. También puedes pasar un primer y un último fotograma para controlar las transiciones.

¿Cuánto tarda la generación?

Minutos. En producción, usa la API de tareas asíncronas /v1/videos y consulta el estado mediante polling; consulta la documentación de vídeo. Para conocer los precios de Gemini y los modelos de texto, consulta la guía de precios de la API de Gemini.