Sora es el modelo de OpenAI para generar vídeo a partir de texto, y la «API de Sora» es una forma de generar vídeos mediante programación, no mediante una aplicación para consumidores. En Kunavo, la generación de texto a vídeo funciona actualmente con Google Veo 3 a través de un único endpoint de vídeo de estilo OpenAI; la compatibilidad con Sora está en la hoja de ruta y, como el endpoint no depende del modelo, pasar a Sora más adelante solo requiere cambiar una palabra. En esta guía mostramos el flujo de trabajo con Veo 3 para que todos los ejemplos funcionen ahora mismo.
¿Qué es la API de Sora?
Sora (Sora 2 y Sora 2 Pro) convierte un prompt de texto —o una imagen fija— en clips de vídeo cortos, con audio sincronizado en Sora 2. Al usarla mediante una API, puedes integrar las generaciones en un pipeline: vídeos de marketing, animaciones de productos, b-roll y previsualizaciones de storyboards. El formato es común a los modelos de vídeo modernos: envías un prompt y parámetros, y recibes una URL de vídeo alojada.
Vídeo disponible ahora en Kunavo: Veo 3
Kunavo ofrece la generación de vídeo mediante un único endpoint de estilo OpenAI /v1/video/generations. Sora todavía no está activado en el catálogo; el modelo de texto a vídeo disponible actualmente es Google Veo 3, que genera clips cinematográficos con audio nativo. Los ejemplos siguientes usan veo-3; cuando llegue Sora, solo tendrás que cambiar el campo model.
Inicio rápido de texto a vídeo
Solo necesitas un POST con tu clave de Kunavo. La generación puede tardar varios minutos, por lo que la llamada síncrona mantiene la conexión abierta hasta que el clip está listo.
import requests
resp = requests.post(
"https://api.kunavo.com/v1/video/generations",
headers={"Authorization": f"Bearer {API_KEY}"},
json={
"model": "veo-3",
"prompt": "a cinematic dolly-in on a red origami crane unfolding, soft light",
"aspect_ratio": "16:9",
},
timeout=600, # 生成には数分かかることがあります
)
print(resp.json()["data"][0]["url"])duration (en segundos) define la duración del clip en los modelos con facturación por segundo: los modelos Seedance y el modelo Wan 2.7. Los modelos Veo lo ignoran; cada clip de Veo dura 8 segundos y se factura por vídeo.
De imagen a vídeo
Para animar una imagen fija, pasa image_url junto con el prompt (una URL https o un archivo subido a /v1/files). Si quieres controlar el movimiento, puedes pasar el primer y el último fotograma con image_urls y image_mode: "frame". Encontrarás ejemplos detallados en la documentación de vídeo.
Ciclo de vida de una tarea asíncrona
En producción, no mantengas una conexión abierta durante 10 minutos. Al enviar una tarea a /v1/videos recibes inmediatamente un ID de tarea; sondea GET /v1/videos/{id} hasta que se complete. La URL del resultado es permanente.
# 本番: タスクを投入してからポーリング——長時間の接続を保持しません。
task = requests.post(
"https://api.kunavo.com/v1/videos",
headers={
"Authorization": f"Bearer {API_KEY}",
"Idempotency-Key": "my-task-uuid", # 約 24 時間はリトライしても安全
},
json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
timeout=60,
).json()
# その後 GET /v1/videos/{task["id"]} を完了までポーリングしますLa documentación de vídeo explica el bucle de sondeo completo, las claves de idempotencia y la entrega mediante webhook.
Precios
Veo 3 se factura por vídeo (aquí, por un clip de 8 segundos a 720p) y cuesta aproximadamente 50〜70% menos que el precio de lista de Google. Las resoluciones más altas cuestan más; consulta la página de precios para ver la tabla completa de planes.
| Modelos | Precio más bajo (720p / 8 segundos) | Precio de lista de Google | Ahorro |
|---|---|---|---|
veo-3-lite | $0.18 | $0.45 | Aproximadamente 60% |
veo-3 (Fast) | $0.36 | $1.20 | Aproximadamente 70% |
veo-3-quality | $1.60 | $3.20 | Aproximadamente 50% |
Consejos para prompts de vídeo
- Describe el plano, no solo el sujeto. El movimiento de cámara (dolly, panorámica, push-in), la sensación del objetivo, la iluminación y el ritmo son más eficaces que los adjetivos.
- Especifica la relación de aspecto:
16:9para horizontal y9:16para vertical/redes sociales. - Cada clip de Veo dura 8 segundos. Planifica cada toma para esa duración y une varias generaciones para crear secuencias más largas.
- Usa fotogramas de referencia (imagen a vídeo): resulta útil para mantener constantes personajes o productos específicos.
Preguntas frecuentes
¿Puedo usar la API de Sora en Kunavo ahora mismo?
Sora todavía no está activado en el catálogo de Kunavo. La generación de texto a vídeo funciona actualmente con Google Veo 3 a través del mismo endpoint /v1/video/generations de estilo OpenAI. El endpoint no depende del modelo, por lo que cambiar a Sora más adelante solo requiere cambiar una palabra en el campo model. La compatibilidad con Sora está en la hoja de ruta.
¿Qué es la API de Sora?
Sora es el modelo de OpenAI para generar vídeo a partir de texto (Sora 2 y Sora 2 Pro). La API de Sora genera mediante programación clips de vídeo cortos a partir de prompts de texto o una imagen fija —con audio sincronizado en Sora 2—, en lugar de hacerlo mediante una aplicación para consumidores.
¿Cuánto cuesta generar vídeos en Kunavo?
Veo 3 se factura por vídeo y cuesta aproximadamente 50〜70% menos que el precio de lista de Google. Para un clip de 8 segundos a 720p, Veo 3 Lite cuesta desde $0.18, Veo 3 Fast desde $0.36 y Veo 3 Quality desde $1.60. Las resoluciones más altas cuestan más.
¿Kunavo admite la generación de imagen a vídeo?
Sí. Puedes animar una imagen fija pasando image_url (una URL https o un archivo subido) a /v1/video/generations. También puedes pasar el primer y el último fotograma para crear una transición controlada.