Sora est le modèle texte-vidéo d’OpenAI, et l’« API Sora » est la voie par laquelle les équipes génèrent des vidéos programmatiquement plutôt que via une application grand public. Sur Kunavo, la conversion texte-vidéo fonctionne aujourd’hui avec Google Veo 3 via un endpoint vidéo unique de style OpenAI — l’accès à Sora est prévu dans la feuille de route et, puisque l’endpoint est indépendant du modèle, le passage futur à Sora se fera en modifiant un seul mot. Ce guide présente le flux avec Veo 3 afin que chaque exemple fonctionne dès maintenant.
Qu’est-ce que l’API Sora ?
Sora (Sora 2 et Sora 2 Pro) transforme un prompt textuel — ou une image fixe — en un court clip vidéo, avec un son synchronisé dans Sora 2. Le format de l’API permet d’intégrer la génération dans un pipeline : séquences marketing, animations de produits, plans de coupe, aperçus de brouillons. Le format est le même pour les modèles vidéo modernes : envoyez un prompt et des paramètres, puis recevez une URL vidéo hébergée.
Vidéo sur Kunavo aujourd’hui : Veo 3
Kunavo propose la génération vidéo via un endpoint unique de style OpenAI : /v1/video/generations. Sora n’est pas encore activé dans le catalogue ; le modèle texte-vidéo actuellement disponible est Google Veo 3, qui produit des clips cinématographiques avec audio natif. Les exemples ci-dessous utilisent veo-3 — lorsque Sora sera disponible, seul le champ model changera.
Démarrage rapide texte-vidéo
Un seul POST avec votre clé Kunavo. La génération peut prendre quelques minutes ; l’appel synchrone maintient donc la connexion ouverte jusqu’à ce que le clip soit prêt :
import requests
resp = requests.post(
"https://api.kunavo.com/v1/video/generations",
headers={"Authorization": f"Bearer {API_KEY}"},
json={
"model": "veo-3",
"prompt": "kırmızı bir origami turnanın açılışına yumuşak ışıkta sinematik dolly-in",
"aspect_ratio": "16:9",
},
timeout=600, # üretim dakikalar sürebilir
)
print(resp.json()["data"][0]["url"])duration (en secondes) définit la durée du clip pour les modèles facturés à la seconde : les modèles Seedance et le modèle Wan 2.7. Les modèles Veo l’ignorent ; chaque clip Veo dure 8 secondes et est facturé par vidéo.
Image-vidéo
Pour animer une image fixe, transmettez image_url avec le prompt (une URL https ou un fichier téléversé à /v1/files). Pour contrôler le mouvement, vous pouvez transmettre les première et dernière images avec image_urls et image_mode: "frame". Des exemples complets sont disponibles dans la documentation vidéo.
Cycle de vie d’une tâche asynchrone
En production, ne maintenez pas une connexion ouverte pendant 10 minutes. Envoyez une tâche à /v1/videos, recevez immédiatement un identifiant de tâche, puis interrogez GET /v1/videos/{id} jusqu’à son achèvement. Les URL de résultat sont permanentes.
# Üretim: bir görev gönderin, sonra yoklayın — uzun ömürlü bağlantı yok.
task = requests.post(
"https://api.kunavo.com/v1/videos",
headers={
"Authorization": f"Bearer {API_KEY}",
"Idempotency-Key": "my-task-uuid", # ~24s içinde yeniden denemeye güvenli
},
json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
timeout=60,
).json()
# ardından tamamlanana kadar GET /v1/videos/{task["id"]} adresini yoklayınLa documentation vidéo couvre le cycle complet d’interrogation, les clés d’idempotence et la livraison par webhook.
Tarification
Veo 3 est facturé par vidéo (ici présenté pour un clip de 8 secondes en 720p) et coûte environ 50-70 % de moins que le prix catalogue de Google. Les résolutions supérieures sont plus coûteuses — consultez la page de tarification pour le tableau complet des niveaux.
| Modèle | À partir de (720p / 8 s) | Prix catalogue Google | Économie |
|---|---|---|---|
veo-3-lite | $0.18 | $0.45 | ~%60 |
veo-3 (Fast) | $0.36 | $1.20 | ~%70 |
veo-3-quality | $1.60 | $3.20 | ~%50 |
Conseils de prompt vidéo
- Décrivez le plan, pas seulement le sujet. Le mouvement de caméra (travelling, panoramique, push-in), le rendu de l’objectif, la lumière et le rythme comptent davantage que les adjectifs.
- Indiquez explicitement le format d’image —
16:9pour le paysage,9:16pour le portrait et les réseaux sociaux. - Chaque clip Veo dure 8 secondes. Prévoyez chaque plan pour cette durée et assemblez plusieurs générations pour les séquences plus longues.
- Utilisez une image de référence (image-vidéo) — lorsque la cohérence d’un personnage ou d’un produit précis est nécessaire.
FAQ
Puis-je utiliser l’API Sora sur Kunavo aujourd’hui ?
Sora n’est pas encore activé dans le catalogue Kunavo. Aujourd’hui, la conversion texte-vidéo fonctionne avec Google Veo 3 via le même endpoint /v1/video/generations de style OpenAI. Comme l’endpoint est indépendant du modèle, le passage futur à Sora se fera en modifiant un seul mot dans le champ model. L’accès à Sora est prévu dans la feuille de route.
Qu’est-ce que l’API Sora ?
Sora est le modèle texte-vidéo d’OpenAI (Sora 2 et Sora 2 Pro). L’API Sora produit programmatiquement de courts clips vidéo à partir d’un prompt textuel ou d’une image fixe — avec un son synchronisé dans Sora 2 — plutôt que via une application grand public.
Combien coûte la génération vidéo sur Kunavo ?
Veo 3 est facturé par vidéo et coûte environ 50-70 % de moins que le prix catalogue de Google. Tarifs de départ pour un clip de 8 secondes en 720p : $0.18 pour Veo 3 Lite, $0.36 pour Veo 3 Fast et $1.60 pour Veo 3 Quality. Les résolutions supérieures sont plus coûteuses.
Kunavo prend-il en charge la conversion image-vidéo ?
Oui. Pour animer une image fixe, transmettez image_url (une URL https ou un fichier téléversé) à l’endpoint /v1/video/generations. Vous pouvez également transmettre les première et dernière images pour des transitions contrôlées.
Combien de temps prend la génération ?
Quelques minutes. En production, utilisez l’API de tâches asynchrones /v1/videos et interrogez-la ; voir la documentation vidéo.