Retour aux guides
Vidéo·18 juin 2026·Mis à jour le 1 octobre 2026·7 min de lecture

API Sora — générer des vidéos IA sur un endpoint de type OpenAI (aujourd’hui avec Veo 3.1)

Vidéo IA via l’API Sora : Sora n’est pas encore activé — le modèle texte-vidéo actif est Google Veo 3.1 sur le même endpoint de type OpenAI. Avec des exemples fonctionnels et des prix à partir de 0,18 $ par clip.

Sora est le modèle de génération de texte en vidéo d’OpenAI, et « l’API Sora » désigne le moyen pour les équipes de générer des vidéos par programmation plutôt que via l’application grand public. Chez Kunavo, la génération de texte en vidéo passe aujourd’hui par Google Veo 3 sur un endpoint vidéo compatible avec OpenAI — l’accès à Sora est prévu sur la feuille de route et, puisque l’endpoint est indépendant du modèle, le passage ultérieur à Sora se fera en modifiant un seul mot. Ce guide présente le workflow avec Veo 3 afin que chaque exemple fonctionne immédiatement.

Qu’est-ce que l’API Sora ?

Sora (Sora 2 et Sora 2 Pro) transforme un prompt textuel — ou une image fixe — en un court clip vidéo, avec du son synchronisé dans Sora 2. Le format de l’API vous permet d’intégrer la génération dans un pipeline : plans marketing, animations de produits, plans de coupe, aperçus de storyboards. Le format reste le même avec les modèles vidéo modernes : envoyer le prompt et les paramètres, puis recevoir une URL vidéo hébergée.

La vidéo chez Kunavo aujourd’hui : Veo 3

Kunavo fournit la génération vidéo via un seul endpoint compatible avec OpenAI, /v1/video/generations. Sora n’est pas encore activé dans le catalogue ; le modèle actif de génération de texte en vidéo est Google Veo 3, qui produit des clips cinématiques avec du son natif. Les exemples ci-dessous utilisent veo-3 — lorsque Sora sera disponible, la seule modification concernera le champ model.

Démarrage rapide de la génération de texte en vidéo

Un POST avec votre clé Kunavo. La génération peut prendre quelques minutes ; c’est pourquoi l’appel synchrone maintient la connexion ouverte jusqu’à ce que le clip soit terminé :

text_to_video.py
import requests

resp = requests.post(
    "https://api.kunavo.com/v1/video/generations",
    headers={"Authorization": f"Bearer {API_KEY}"},
    json={
        "model": "veo-3",
        "prompt": "a cinematic dolly-in on a red origami crane unfolding, soft light",
        "aspect_ratio": "16:9",
    },
    timeout=600,  # die Generierung kann Minuten dauern
)
print(resp.json()["data"][0]["url"])

duration (en secondes) définit la durée du clip pour les modèles facturés à la seconde : les modèles Seedance et le modèle Wan 2.7. Les modèles Veo l’ignorent ; chaque clip Veo dure 8 secondes et est facturé par vidéo.

Image vers la vidéo

Pour animer une image fixe, transmettez image_url (une URL https ou un fichier que vous avez téléversé vers /v1/files) avec le prompt. Pour contrôler le mouvement, vous pouvez transmettre une première et une dernière image avec image_urls et image_mode: "frame". Des exemples complets sont disponibles dans la documentation vidéo.

Cycle de vie d’une tâche asynchrone

En production, vous ne devriez pas maintenir une connexion ouverte pendant 10 minutes. Soumettez une tâche à /v1/videos, recevez immédiatement un identifiant de tâche, puis interrogez GET /v1/videos/{id} jusqu’à ce qu’elle soit terminée. Les URL de résultats sont permanentes.

async_submit.py
# Produktion: Task einreichen, dann pollen — keine langlebige Verbindung.
task = requests.post(
    "https://api.kunavo.com/v1/videos",
    headers={
        "Authorization": f"Bearer {API_KEY}",
        "Idempotency-Key": "my-task-uuid",   # innerhalb von ~24h retry-sicher
    },
    json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
    timeout=60,
).json()
# dann GET /v1/videos/{task["id"]} pollen, bis er fertig ist

La documentation vidéo couvre l’ensemble de la boucle d’interrogation, les clés d’idempotence et la livraison des webhooks.

Tarifs

Veo 3 est facturé par vidéo (ici, par clip de 8 secondes en 720p), environ 50–70 % en dessous du tarif catalogue de Google. Les résolutions supérieures coûtent davantage — le tableau complet des niveaux figure sur la page des tarifs.

ModèleÀ partir de (720p / 8 s)Tarif GoogleVous économisez
veo-3-lite$0.18$0.45~60%
veo-3 (Fast)$0.36$1.20~70%
veo-3-quality$1.60$3.20~50%

Conseils de prompting vidéo

  • Décrivez la mise en scène, pas seulement le sujet. Le mouvement de caméra (travelling, panoramique, zoom avant), le rendu de l’objectif, l’éclairage et le rythme comptent davantage que les adjectifs.
  • Définissez explicitement le format d’image — 16:9 pour le paysage, 9:16 pour le portrait et les réseaux sociaux.
  • Chaque clip Veo dure 8 secondes. Prévoyez chaque plan pour cette durée et assemblez plusieurs générations pour les séquences plus longues.
  • Utilisez une image de référence (image vers vidéo) lorsqu’un personnage ou un produit précis doit rester cohérent.

Questions fréquentes

Puis-je utiliser l’API Sora chez Kunavo aujourd’hui ?

Sora n’est pas encore activé dans le catalogue Kunavo. La génération de texte en vidéo passe aujourd’hui par Google Veo 3 sur le même endpoint OpenAI-compatible /v1/video/generations. Comme l’endpoint est indépendant du modèle, le passage ultérieur à Sora se fera en modifiant un seul mot dans le champ model. L’accès à Sora est prévu sur la feuille de route.

Qu’est-ce que l’API Sora ?

Sora est le modèle de génération de texte en vidéo d’OpenAI (Sora 2 et Sora 2 Pro). L’API Sora génère de courts clips vidéo — avec du son synchronisé dans Sora 2 — à partir d’un prompt textuel ou d’une image fixe, de manière programmatique plutôt que via l’application grand public.

Combien coûte la génération vidéo chez Kunavo ?

Veo 3 est facturé par vidéo, environ 50–70 % en dessous du tarif catalogue de Google : Veo 3 Lite à partir de $0.18, Veo 3 Fast à partir de $0.36, et Veo 3 Quality à partir de $1.60 par clip de 8 secondes en 720p. Les résolutions supérieures coûtent davantage.

Kunavo prend-il en charge l’image vers la vidéo ?

Oui. Transmettez image_url (une URL https ou un fichier téléversé) à /v1/video/generations pour animer une image fixe. Pour des transitions contrôlées, vous pouvez également transmettre une première et une dernière image.

Combien de temps dure la génération ?

Quelques minutes. En production, utilisez l’API de tâches asynchrones /v1/videos et interrogez-la régulièrement ; consultez la documentation vidéo. Les tarifs par modèle figurent également dans le guide des tarifs de l’API Gemini.

Ai-je besoin d’une clé distincte ?

Non — la même clé Kunavo couvre la vidéo, le texte et les images. La procédure de création est décrite dans le guide Créer une clé API Google Gemini ; la clé qui y est créée fonctionne telle quelle avec /v1/video/generations.