Retour aux guides
Vidéo·18 juin 2026·Mis à jour le 1 octobre 2026·7 min de lecture

API Sora — génération vidéo par IA (avec Veo 3.1 aujourd’hui)

La méthode pratique pour générer des vidéos par IA : format de l’API Sora, flux texte-vers-vidéo et image-vers-vidéo, et tarification. Chaque exemple fonctionne aujourd’hui avec Google Veo 3.1 ; lorsque Sora sera disponible, seul le champ model changera.

Sora est le modèle texte-vidéo d’OpenAI, et l’« API Sora » est la voie par laquelle les équipes génèrent des vidéos programmatiquement plutôt que via une application grand public. Sur Kunavo, la conversion texte-vidéo fonctionne aujourd’hui avec Google Veo 3 via un endpoint vidéo unique de style OpenAI — l’accès à Sora est prévu dans la feuille de route et, puisque l’endpoint est indépendant du modèle, le passage futur à Sora se fera en modifiant un seul mot. Ce guide présente le flux avec Veo 3 afin que chaque exemple fonctionne dès maintenant.

Qu’est-ce que l’API Sora ?

Sora (Sora 2 et Sora 2 Pro) transforme un prompt textuel — ou une image fixe — en un court clip vidéo, avec un son synchronisé dans Sora 2. Le format de l’API permet d’intégrer la génération dans un pipeline : séquences marketing, animations de produits, plans de coupe, aperçus de brouillons. Le format est le même pour les modèles vidéo modernes : envoyez un prompt et des paramètres, puis recevez une URL vidéo hébergée.

Vidéo sur Kunavo aujourd’hui : Veo 3

Kunavo propose la génération vidéo via un endpoint unique de style OpenAI : /v1/video/generations. Sora n’est pas encore activé dans le catalogue ; le modèle texte-vidéo actuellement disponible est Google Veo 3, qui produit des clips cinématographiques avec audio natif. Les exemples ci-dessous utilisent veo-3 — lorsque Sora sera disponible, seul le champ model changera.

Démarrage rapide texte-vidéo

Un seul POST avec votre clé Kunavo. La génération peut prendre quelques minutes ; l’appel synchrone maintient donc la connexion ouverte jusqu’à ce que le clip soit prêt :

text_to_video.py
import requests

resp = requests.post(
    "https://api.kunavo.com/v1/video/generations",
    headers={"Authorization": f"Bearer {API_KEY}"},
    json={
        "model": "veo-3",
        "prompt": "kırmızı bir origami turnanın açılışına yumuşak ışıkta sinematik dolly-in",
        "aspect_ratio": "16:9",
    },
    timeout=600,  # üretim dakikalar sürebilir
)
print(resp.json()["data"][0]["url"])

duration (en secondes) définit la durée du clip pour les modèles facturés à la seconde : les modèles Seedance et le modèle Wan 2.7. Les modèles Veo l’ignorent ; chaque clip Veo dure 8 secondes et est facturé par vidéo.

Image-vidéo

Pour animer une image fixe, transmettez image_url avec le prompt (une URL https ou un fichier téléversé à /v1/files). Pour contrôler le mouvement, vous pouvez transmettre les première et dernière images avec image_urls et image_mode: "frame". Des exemples complets sont disponibles dans la documentation vidéo.

Cycle de vie d’une tâche asynchrone

En production, ne maintenez pas une connexion ouverte pendant 10 minutes. Envoyez une tâche à /v1/videos, recevez immédiatement un identifiant de tâche, puis interrogez GET /v1/videos/{id} jusqu’à son achèvement. Les URL de résultat sont permanentes.

async_submit.py
# Üretim: bir görev gönderin, sonra yoklayın — uzun ömürlü bağlantı yok.
task = requests.post(
    "https://api.kunavo.com/v1/videos",
    headers={
        "Authorization": f"Bearer {API_KEY}",
        "Idempotency-Key": "my-task-uuid",   # ~24s içinde yeniden denemeye güvenli
    },
    json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
    timeout=60,
).json()
# ardından tamamlanana kadar GET /v1/videos/{task["id"]} adresini yoklayın

La documentation vidéo couvre le cycle complet d’interrogation, les clés d’idempotence et la livraison par webhook.

Tarification

Veo 3 est facturé par vidéo (ici présenté pour un clip de 8 secondes en 720p) et coûte environ 50-70 % de moins que le prix catalogue de Google. Les résolutions supérieures sont plus coûteuses — consultez la page de tarification pour le tableau complet des niveaux.

ModèleÀ partir de (720p / 8 s)Prix catalogue GoogleÉconomie
veo-3-lite$0.18$0.45~%60
veo-3 (Fast)$0.36$1.20~%70
veo-3-quality$1.60$3.20~%50

Conseils de prompt vidéo

  • Décrivez le plan, pas seulement le sujet. Le mouvement de caméra (travelling, panoramique, push-in), le rendu de l’objectif, la lumière et le rythme comptent davantage que les adjectifs.
  • Indiquez explicitement le format d’image — 16:9 pour le paysage, 9:16 pour le portrait et les réseaux sociaux.
  • Chaque clip Veo dure 8 secondes. Prévoyez chaque plan pour cette durée et assemblez plusieurs générations pour les séquences plus longues.
  • Utilisez une image de référence (image-vidéo) — lorsque la cohérence d’un personnage ou d’un produit précis est nécessaire.

FAQ

Puis-je utiliser l’API Sora sur Kunavo aujourd’hui ?

Sora n’est pas encore activé dans le catalogue Kunavo. Aujourd’hui, la conversion texte-vidéo fonctionne avec Google Veo 3 via le même endpoint /v1/video/generations de style OpenAI. Comme l’endpoint est indépendant du modèle, le passage futur à Sora se fera en modifiant un seul mot dans le champ model. L’accès à Sora est prévu dans la feuille de route.

Qu’est-ce que l’API Sora ?

Sora est le modèle texte-vidéo d’OpenAI (Sora 2 et Sora 2 Pro). L’API Sora produit programmatiquement de courts clips vidéo à partir d’un prompt textuel ou d’une image fixe — avec un son synchronisé dans Sora 2 — plutôt que via une application grand public.

Combien coûte la génération vidéo sur Kunavo ?

Veo 3 est facturé par vidéo et coûte environ 50-70 % de moins que le prix catalogue de Google. Tarifs de départ pour un clip de 8 secondes en 720p : $0.18 pour Veo 3 Lite, $0.36 pour Veo 3 Fast et $1.60 pour Veo 3 Quality. Les résolutions supérieures sont plus coûteuses.

Kunavo prend-il en charge la conversion image-vidéo ?

Oui. Pour animer une image fixe, transmettez image_url (une URL https ou un fichier téléversé) à l’endpoint /v1/video/generations. Vous pouvez également transmettre les première et dernière images pour des transitions contrôlées.

Combien de temps prend la génération ?

Quelques minutes. En production, utilisez l’API de tâches asynchrones /v1/videos et interrogez-la ; voir la documentation vidéo.