Sora est le modèle texte-vers-vidéo d’OpenAI, et « l’API Sora » désigne la manière dont les équipes génèrent des vidéos automatiquement plutôt que via l’application grand public. Aujourd’hui, sur Kunavo, le texte-vers-vidéo fonctionne avec Google Veo 3 via un seul point de terminaison vidéo de type OpenAI — l’accès à Sora est prévu dans la feuille de route et, comme le point de terminaison est indépendant du modèle, passer à Sora plus tard ne nécessitera qu’un changement d’un mot. Ce guide présente le workflow avec Veo 3 afin que chaque exemple fonctionne dès maintenant.
Qu’est-ce que l’API Sora ?
Sora (Sora 2 et Sora 2 Pro) transforme un prompt textuel — ou une image fixe — en un court clip vidéo, avec un audio synchronisé dans Sora 2. Le format de l’API permet d’intégrer la génération dans un pipeline : plans marketing, animations de produits, plans de coupe, aperçus de storyboard. La structure est la même pour les modèles vidéo modernes : envoyez un prompt et des paramètres, puis recevez une URL vidéo hébergée.
La vidéo sur Kunavo aujourd’hui : Veo 3
Kunavo expose la génération vidéo via un point de terminaison unique de type OpenAI, /v1/video/generations. Sora n’est pas encore activé dans le catalogue ; le modèle texte-vers-vidéo disponible est Google Veo 3, qui produit des clips cinématographiques avec audio natif. Les exemples ci-dessous utilisent veo-3 — lorsque Sora sera disponible, le seul changement concernera le champ model.
Démarrage rapide du texte-vers-vidéo
Un seul POST avec votre clé Kunavo. La génération peut prendre quelques minutes ; l’appel synchrone maintient donc la connexion ouverte jusqu’à ce que le clip soit prêt :
import requests
resp = requests.post(
"https://api.kunavo.com/v1/video/generations",
headers={"Authorization": f"Bearer {API_KEY}"},
json={
"model": "veo-3",
"prompt": "a cinematic dolly-in on a red origami crane unfolding, soft light",
"aspect_ratio": "16:9",
},
timeout=600, # generation can take minutes
)
print(resp.json()["data"][0]["url"])duration (en secondes) définit la durée du clip pour les modèles facturés à la seconde : les modèles Seedance et le modèle Wan 2.7. Les modèles Veo l’ignorent ; chaque clip Veo dure 8 secondes et est facturé par vidéo.
Génération de vidéo à partir d’images
Pour animer une image fixe, transmettez image_url (une URL https ou un fichier importé vers /v1/files) avec le prompt. Pour contrôler le mouvement, vous pouvez transmettre une première et une dernière image avec image_urls et image_mode: "frame". Des exemples complets figurent dans la documentation vidéo.
Cycle de vie des tâches asynchrones
En production, ne maintenez pas une connexion ouverte pendant 10 minutes. Soumettez une tâche à /v1/videos, récupérez immédiatement un identifiant de tâche, puis interrogez GET /v1/videos/{id} jusqu’à son achèvement. Les URL de résultats sont permanentes.
# Production: submit a task, then poll — no long-lived connection.
task = requests.post(
"https://api.kunavo.com/v1/videos",
headers={
"Authorization": f"Bearer {API_KEY}",
"Idempotency-Key": "my-task-uuid", # retry-safe within ~24h
},
json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
timeout=60,
).json()
# then poll GET /v1/videos/{task["id"]} until it completesLa documentation vidéo couvre la boucle complète d’interrogation, les clés d’idempotence et la livraison par webhook.
Tarification
Veo 3 est facturé par vidéo (par clip de 8 secondes en 720p, comme indiqué ici), environ 50–70% sous le tarif affiché par Google. Les résolutions supérieures coûtent plus cher — consultez la page de tarification pour le tableau complet des niveaux.
| Modèle | À partir de (720p / 8 s) | Tarif Google | Votre économie |
|---|---|---|---|
veo-3-lite | $0.18 | $0.45 | ~60% |
veo-3 (Fast) | $0.36 | $1.20 | ~70% |
veo-3-quality | $1.60 | $3.20 | ~50% |
Conseils de prompting vidéo
- Décrivez le plan, pas seulement le sujet. Le mouvement de caméra (travelling, panoramique, rapprochement), le rendu de l’objectif, l’éclairage et le rythme comptent davantage que les adjectifs.
- Définissez explicitement le format —
16:9pour le paysage,9:16pour le vertical/social. - Chaque clip Veo dure 8 secondes. Prévoyez chaque plan pour cette durée et assemblez plusieurs générations pour les séquences plus longues.
- Utilisez une image de référence (image-vers-vidéo) lorsque vous devez conserver la cohérence d’un personnage ou d’un produit spécifique.
Questions fréquentes
Puis-je utiliser l’API Sora sur Kunavo aujourd’hui ?
Sora n’est pas encore activé dans le catalogue de Kunavo. Aujourd’hui, le texte-vers-vidéo fonctionne avec Google Veo 3 via le même point de terminaison de type OpenAI /v1/video/generations. Comme ce point de terminaison est indépendant du modèle, passer à Sora plus tard ne nécessitera qu’un changement d’un mot dans le champ du modèle. L’accès à Sora est prévu dans la feuille de route.
Qu’est-ce que l’API Sora ?
Sora est le modèle texte-vers-vidéo d’OpenAI (Sora 2 et Sora 2 Pro). L’API Sora génère automatiquement de courts clips vidéo — avec un audio synchronisé dans Sora 2 — à partir d’un prompt textuel ou d’une image fixe, plutôt que via l’application grand public.
Combien coûte la génération vidéo sur Kunavo ?
Veo 3 est facturé par vidéo, environ 50–70% sous le tarif affiché par Google : Veo 3 Lite à partir de $0.18, Veo 3 Fast à partir de $0.36, Veo 3 Quality à partir de $1.60 par clip 720p de 8 secondes. Les résolutions supérieures coûtent plus cher.
Kunavo prend-il en charge l’image-vers-vidéo ?
Oui. Transmettez image_url (une URL https ou un fichier importé) à /v1/video/generations pour animer une image fixe. Vous pouvez également transmettre une première et une dernière image pour contrôler les transitions.
Combien de temps prend la génération ?
Quelques minutes. Utilisez l’API de tâches asynchrones /v1/videos et interrogez-la en production ; consultez la documentation vidéo.