Sora es el modelo de texto a video de OpenAI, y “la API de Sora” es la forma en que los equipos generan video mediante programación en lugar de usar la aplicación para consumidores. Hoy, en Kunavo, el texto a video funciona con Google Veo 3 mediante un único endpoint de video de estilo OpenAI; el acceso a Sora está en la hoja de ruta y, como el endpoint es independiente del modelo, migrar a Sora más adelante requiere cambiar una sola palabra. Esta guía muestra el flujo de trabajo con Veo 3 para que todos los ejemplos funcionen ahora mismo.
¿Qué es la API de Sora?
Sora (Sora 2 y Sora 2 Pro) convierte un prompt de texto — o una imagen fija — en un clip de video corto, con audio sincronizado en Sora 2. El formulario de la API permite integrar la generación en un flujo: tomas de marketing, animaciones de productos, material de apoyo y previsualizaciones de storyboards. La estructura es la misma en los modelos de video modernos: envía un prompt y parámetros y recibe una URL de video alojada.
Video en Kunavo hoy: Veo 3
Kunavo ofrece generación de video mediante un único endpoint de estilo OpenAI, /v1/video/generations. Sora todavía no está habilitado en el catálogo; el modelo activo de texto a video es Google Veo 3, que produce clips cinematográficos con audio nativo. Los ejemplos siguientes usan veo-3; cuando Sora esté disponible, el único cambio será el campo model.
Inicio rápido de texto a video
Un POST con tu clave de Kunavo. La generación puede tardar un par de minutos, por lo que la llamada síncrona mantiene la conexión abierta hasta que el clip está listo:
import requests
resp = requests.post(
"https://api.kunavo.com/v1/video/generations",
headers={"Authorization": f"Bearer {API_KEY}"},
json={
"model": "veo-3",
"prompt": "a cinematic dolly-in on a red origami crane unfolding, soft light",
"aspect_ratio": "16:9",
},
timeout=600, # generation can take minutes
)
print(resp.json()["data"][0]["url"])duration (en segundos) define la duración del clip en los modelos con facturación por segundo: los modelos Seedance y el modelo Wan 2.7. Los modelos Veo lo ignoran; cada clip de Veo dura 8 segundos y se factura por vídeo.
Imagen a vídeo
Para animar una imagen fija, pasa image_url (una URL https o un archivo que hayas subido a /v1/files) junto con el prompt. Para controlar el movimiento, puedes pasar un primer y un último fotograma con image_urls y image_mode: "frame". Los ejemplos completos están en la documentación de video.
Ciclo de vida de tareas asíncronas
En producción, no mantengas una conexión abierta durante 10 minutos. Envía una tarea a /v1/videos, recibe inmediatamente un ID de tarea y luego consulta GET /v1/videos/{id} hasta que se complete. Las URL de resultados son permanentes.
# Production: submit a task, then poll — no long-lived connection.
task = requests.post(
"https://api.kunavo.com/v1/videos",
headers={
"Authorization": f"Bearer {API_KEY}",
"Idempotency-Key": "my-task-uuid", # retry-safe within ~24h
},
json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
timeout=60,
).json()
# then poll GET /v1/videos/{task["id"]} until it completesLa documentación de video cubre el ciclo completo de consultas, las claves de idempotencia y la entrega mediante webhooks.
Precios
Veo 3 se factura por video (por clip de 8 segundos a 720p, como se muestra aquí), aproximadamente un 50–70% por debajo del precio oficial de Google. Las resoluciones superiores cuestan más; consulta la página de precios para ver la tabla completa de niveles.
| Modelo | Desde (720p / 8 s) | Precio oficial de Google | Ahorro |
|---|---|---|---|
veo-3-lite | $0.18 | $0.45 | ~60% |
veo-3 (Fast) | $0.36 | $1.20 | ~70% |
veo-3-quality | $1.60 | $3.20 | ~50% |
Consejos para crear prompts de video
- Describe la toma, no solo el sujeto. El movimiento de cámara (travelling, paneo, acercamiento), la sensación de la lente, la iluminación y el ritmo importan más que los adjetivos.
- Establece explícitamente la relación de aspecto:
16:9para formato horizontal,9:16para formato vertical/social. - Cada clip de Veo dura 8 segundos. Planifica cada toma para esa duración y une varias generaciones para crear secuencias más largas.
- Usa un fotograma de referencia (imagen a video) cuando necesites mantener coherentes un personaje o producto específicos.
Preguntas frecuentes
¿Puedo usar hoy la API de Sora en Kunavo?
Sora todavía no está habilitado en el catálogo de Kunavo. El texto a video funciona hoy con Google Veo 3 mediante el mismo endpoint /v1/video/generations de estilo OpenAI. Como el endpoint es independiente del modelo, cambiar a Sora más adelante requiere modificar una sola palabra en el campo del modelo. El acceso a Sora está en la hoja de ruta.
¿Qué es la API de Sora?
Sora es el modelo de texto a video de OpenAI (Sora 2 y Sora 2 Pro). La API de Sora genera clips de video cortos — con audio sincronizado en Sora 2 — a partir de un prompt de texto o una imagen fija, mediante programación y no a través de la aplicación para consumidores.
¿Cuánto cuesta la generación de video en Kunavo?
Veo 3 se factura por video, aproximadamente un 50–70% por debajo del precio oficial de Google: Veo 3 Lite desde $0.18, Veo 3 Fast desde $0.36, Veo 3 Quality desde $1.60 por clip de 8 segundos a 720p. Las resoluciones superiores cuestan más.
¿Kunavo admite imagen a video?
Sí. Pasa image_url (una URL https o un archivo subido) a /v1/video/generations para animar una imagen fija. También puedes pasar un primer y un último fotograma para controlar las transiciones.
¿Cuánto tarda la generación?
Minutos. Usa la API de tareas asíncronas /v1/videos y consulta su estado periódicamente en producción; consulta la documentación de video.