Sora est le modèle d’OpenAI qui génère des vidéos à partir de texte, et l’« API Sora » désigne la méthode de génération vidéo par programmation plutôt que depuis une application grand public. Chez Kunavo, la génération texte-vidéo fonctionne actuellement avec Google Veo 3 via un seul point de terminaison vidéo de style OpenAI — Sora figure sur la feuille de route et, le point de terminaison étant indépendant du modèle, son adoption ultérieure ne nécessitera qu’un changement d’un mot. Ce guide utilise Veo 3 afin que tous les exemples fonctionnent dès maintenant.
Qu’est-ce que l’API Sora ?
Sora (Sora 2 et Sora 2 Pro) transforme un prompt textuel — ou une image fixe — en un court clip vidéo, avec un son synchronisé dans Sora 2. Sous forme d’API, la génération peut être intégrée à un pipeline : vidéos marketing, animations de produits, b-roll, aperçus de storyboards, etc. Le format est commun aux modèles vidéo récents : envoyez un prompt et des paramètres, puis recevez une URL vidéo hébergée.
Vidéo actuellement disponible avec Kunavo : Veo 3
Kunavo expose la génération vidéo via un seul point de terminaison de style OpenAI /v1/video/generations. Sora n’est pas encore activé dans le catalogue ; le modèle texte-vidéo actuellement disponible est Google Veo 3, qui génère des clips cinématographiques avec audio natif. Les exemples ci-dessous utilisent veo-3 — lorsque Sora sera disponible, seul le champ model devra être modifié.
Démarrage rapide texte-vidéo
Un seul POST avec votre clé Kunavo suffit. La génération pouvant prendre plusieurs minutes, l’appel synchrone maintient la connexion jusqu’à ce que le clip soit prêt.
import requests
resp = requests.post(
"https://api.kunavo.com/v1/video/generations",
headers={"Authorization": f"Bearer {API_KEY}"},
json={
"model": "veo-3",
"prompt": "a cinematic dolly-in on a red origami crane unfolding, soft light",
"aspect_ratio": "16:9",
},
timeout=600, # 生成には数分かかることがあります
)
print(resp.json()["data"][0]["url"])duration (en secondes) définit la durée du clip pour les modèles facturés à la seconde : les modèles Seedance et le modèle Wan 2.7. Les modèles Veo l’ignorent ; chaque clip Veo dure 8 secondes et est facturé par vidéo.
Image vers vidéo
Pour animer une image fixe, transmettez image_url avec le prompt (une URL https ou un fichier téléversé sur /v1/files). Pour contrôler le mouvement, fournissez la première et la dernière image via image_urls et image_mode: "frame". Des exemples détaillés sont disponibles dans la documentation vidéo.
Cycle de vie d’une tâche asynchrone
En production, ne maintenez pas une connexion ouverte pendant 10 minutes. Soumettez la tâche à /v1/videos : un identifiant de tâche est renvoyé immédiatement, puis interrogez GET /v1/videos/{id} jusqu’à son achèvement. L’URL du résultat est permanente.
# 本番: タスクを投入してからポーリング——長時間の接続を保持しません。
task = requests.post(
"https://api.kunavo.com/v1/videos",
headers={
"Authorization": f"Bearer {API_KEY}",
"Idempotency-Key": "my-task-uuid", # 約 24 時間はリトライしても安全
},
json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
timeout=60,
).json()
# その後 GET /v1/videos/{task["id"]} を完了までポーリングしますLa documentation vidéo explique la boucle complète d’interrogation, les clés d’idempotence et la livraison par webhook.
Tarifs
Veo 3 est facturé par vidéo (ici, par clip de 8 secondes en 720p) et coûte environ 50〜70 % de moins que le tarif catalogue de Google. Le coût augmente avec la résolution — consultez la page des tarifs pour le tableau complet des niveaux.
| Modèle | Le moins cher (720p / 8 secondes) | Tarif catalogue Google | Taux d’économie |
|---|---|---|---|
veo-3-lite | $0.18 | $0.45 | Environ 60 % |
veo-3 (Fast) | $0.36 | $1.20 | Environ 70 % |
veo-3-quality | $1.60 | $3.20 | Environ 50 % |
Conseils pour les prompts vidéo
- Décrivez le plan, pas seulement le sujet. Les mouvements de caméra (travelling, panoramique, zoom avant), le rendu de l’objectif, l’éclairage et le rythme sont plus efficaces que les adjectifs.
- Indiquez explicitement le format —
16:9en paysage,9:16en portrait/pour les réseaux sociaux. - Chaque clip Veo dure 8 secondes. Prévoyez chaque plan pour cette durée et assemblez plusieurs générations pour les séquences plus longues.
- Utilisez des images de référence (image vers vidéo) pour maintenir la cohérence d’un personnage ou d’un produit précis.
Questions fréquentes
Puis-je utiliser l’API Sora immédiatement avec Kunavo ?
Sora n’est pas encore activé dans le catalogue Kunavo. La génération vidéo à partir de texte fonctionne actuellement avec Google Veo 3 via le même point de terminaison de style OpenAI /v1/video/generations. Le point de terminaison étant indépendant du modèle, le passage ultérieur à Sora ne nécessitera que la modification d’un mot dans le champ model. La prise en charge de Sora figure sur la feuille de route.
Qu’est-ce que l’API Sora ?
Sora est le modèle d’OpenAI qui génère des vidéos à partir de texte (Sora 2 et Sora 2 Pro). L’API Sora permet de générer par programmation de courts clips vidéo à partir de prompts textuels ou d’une image fixe — avec un son synchronisé dans Sora 2 — plutôt que via une application grand public.
Combien coûte la génération vidéo avec Kunavo ?
Veo 3 est facturé par vidéo et coûte environ 50〜70 % de moins que le tarif catalogue de Google. Pour un clip de 8 secondes en 720p, Veo 3 Lite commence à $0.18, Veo 3 Fast à $0.36 et Veo 3 Quality à $1.60. Le coût augmente avec la résolution.
Kunavo prend-il en charge la génération vidéo à partir d’images ?
Oui. Transmettez image_url (une URL https ou un fichier téléversé) à /v1/video/generations pour animer une image fixe. Vous pouvez également fournir les première et dernière images afin de créer une transition contrôlée.