Sora es el modelo de OpenAI de texto a vídeo, y la «API de Sora» es una forma de generar vídeos mediante programación, no una aplicación para consumidores. Actualmente, en Kunavo el texto a vídeo se ejecuta con Google Veo 3 mediante un único endpoint de vídeo de estilo OpenAI. La compatibilidad con Sora está en la hoja de ruta y, como el endpoint no depende del modelo, pasar a Sora más adelante solo requiere cambiar una palabra. Esta guía muestra el flujo de trabajo con Veo 3 para que todos los ejemplos funcionen de inmediato.
¿Qué es la API de Sora?
Sora (Sora 2 y Sora 2 Pro) convierte prompts de texto o imágenes fijas en clips de vídeo cortos y, en Sora 2, también proporciona audio sincronizado. En forma de API, puedes programar las generaciones dentro de un pipeline: piezas de marketing, animaciones de productos, b-roll y previsualizaciones de storyboards. Los modelos de vídeo modernos tienen todos el mismo formato: envías prompts y parámetros y recibes una URL de vídeo alojada.
Vídeo disponible actualmente en Kunavo: Veo 3
Kunavo ofrece la generación de vídeo mediante un único endpoint de estilo OpenAI /v1/video/generations. Sora todavía no está activado en el catálogo y el modelo de texto a vídeo disponible actualmente es Google Veo 3, que crea clips cinematográficos con audio nativo. Los ejemplos siguientes usan veo-3; cuando se añada Sora, solo tendrás que cambiar el campo model.
Inicio rápido de texto a vídeo
Solo necesitas un POST con tu clave de Kunavo. La generación puede tardar varios minutos, por lo que la llamada síncrona mantiene la conexión abierta hasta que el clip está listo:
import requests
resp = requests.post(
"https://api.kunavo.com/v1/video/generations",
headers={"Authorization": f"Bearer {API_KEY}"},
json={
"model": "veo-3",
"prompt": "빨간 종이학이 펼쳐지는 영화적인 돌리인, 부드러운 조명",
"aspect_ratio": "16:9",
},
timeout=600, # 생성에 몇 분이 걸릴 수 있습니다
)
print(resp.json()["data"][0]["url"])duration (en segundos) define la duración del clip en los modelos con facturación por segundo: los modelos Seedance y el modelo Wan 2.7. Los modelos Veo lo ignoran; cada clip de Veo dura 8 segundos y se factura por vídeo.
Imagen a vídeo
Para añadir movimiento a una imagen fija, pasa image_url junto con el prompt (una URL https o un archivo subido a /v1/files). Para controlar el movimiento, puedes pasar el primer y el último fotograma mediante image_urls y image_mode: "frame". Encontrarás el ejemplo completo en la documentación de vídeo.
Ciclo de vida de una tarea asíncrona
En producción, no mantengas una conexión abierta durante 10 minutos. Envía la tarea a /v1/videos, recibe inmediatamente el ID de tarea y sondea GET /v1/videos/{id} hasta que se complete. La URL del resultado es permanente.
# 프로덕션: 작업을 제출한 뒤 폴링 — 장시간 연결을 유지하지 않습니다.
task = requests.post(
"https://api.kunavo.com/v1/videos",
headers={
"Authorization": f"Bearer {API_KEY}",
"Idempotency-Key": "my-task-uuid", # 약 24시간 내 재시도 안전
},
json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
timeout=60,
).json()
# 이후 완료될 때까지 GET /v1/videos/{task["id"]} 폴링La documentación de vídeo cubre el bucle de sondeo completo, las claves de idempotencia y la entrega mediante webhook.
Precios
Veo 3 se factura por vídeo (aquí, por un clip de 8 segundos a 720p) y cuesta aproximadamente 50~70% menos que el precio de lista de Google. Las resoluciones más altas cuestan más; consulta la página de precios para ver la tabla completa de niveles.
| Modelo | Precio inicial (720p / 8 segundos) | Precio de lista de Google | Ahorro |
|---|---|---|---|
veo-3-lite | $0.18 | $0.45 | ~60% |
veo-3 (Fast) | $0.36 | $1.20 | ~70% |
veo-3-quality | $1.60 | $3.20 | ~50% |
Consejos para prompts de vídeo
- Describe el plano, no solo el sujeto. El movimiento de cámara (dolly, panorámica, push-in), la sensación del objetivo, la iluminación y el ritmo son más importantes que los adjetivos.
- Especifica la relación de aspecto: horizontal es
16:9y vertical/para redes sociales es9:16. - Cada clip de Veo dura 8 segundos. Planifica cada toma para esa duración y une varias generaciones para crear secuencias más largas.
- Usa un marco de referencia(image-to-video). Es útil cuando necesitas mantener de forma coherente un personaje o producto específico.
Preguntas frecuentes
¿Puedo usar ahora la API de Sora en Kunavo?
Sora todavía no está activado en el catálogo de Kunavo. Actualmente, el texto a vídeo se ejecuta con Google Veo 3 a través del mismo endpoint /v1/video/generations de estilo OpenAI. Como el endpoint no depende del modelo, cambiar a Sora más adelante consiste en cambiar una palabra del campo model. La compatibilidad con Sora está en la hoja de ruta.
¿Qué es la API de Sora?
Sora es el modelo de OpenAI de texto a vídeo (Sora 2 y Sora 2 Pro). La API de Sora genera mediante programación clips de vídeo cortos a partir de prompts de texto o imágenes fijas —con audio sincronizado en Sora 2—, no mediante una aplicación para consumidores.
¿Cuánto cuesta generar vídeos en Kunavo?
Veo 3 se factura por vídeo y cuesta aproximadamente 50~70% menos que el precio de lista de Google: Veo 3 Lite desde $0.18, Veo 3 Fast desde $0.36 y Veo 3 Quality desde $1.60 por un clip de 8 segundos a 720p. Las resoluciones más altas cuestan más.
¿Kunavo admite imagen a vídeo?
Sí. Al pasar image_url (una URL https o un archivo subido) a /v1/video/generations, puedes animar una imagen fija. También puedes pasar el primer y el último fotograma para crear una transición controlada.