Sora ist das Text-zu-Video-Modell von OpenAI, und „die Sora-API“ bezeichnet die programmgesteuerte Videogenerierung statt der Nutzung über die Consumer-App. Bei Kunavo läuft die Text-zu-Video-Generierung heute mit Google Veo 3 über einen einzigen OpenAI-kompatiblen Video-Endpunkt – der Zugriff auf Sora ist in der Roadmap, und da der Endpunkt modellunabhängig ist, besteht die spätere Migration zu Sora aus einer Änderung an nur einem Wort. Dieser Leitfaden zeigt den Workflow mit Veo 3, damit jedes Beispiel sofort funktioniert.
Was ist die Sora-API?
Sora (Sora 2 und Sora 2 Pro) verwandelt einen Text-Prompt – oder ein statisches Bild – in einen kurzen Videoclip, mit synchronisiertem Audio in Sora 2. Die API-Form ermöglicht es, die Generierung in eine Pipeline einzubetten: Marketingaufnahmen, Produktanimationen, B-Roll, Storyboard-Vorschauen. Das Format ist bei modernen Videomodellen identisch: Sie senden einen Prompt und Parameter und erhalten die URL eines gehosteten Videos zurück.
Video bei Kunavo heute: Veo 3
Kunavo stellt die Videogenerierung über einen einzigen OpenAI-kompatiblen Endpunkt, /v1/video/generations, bereit. Sora ist im Katalog noch nicht aktiviert; das aktuell verfügbare Text-zu-Video-Modell ist Google Veo 3, das filmische Clips mit nativem Audio erzeugt. Die folgenden Beispiele verwenden veo-3 – sobald Sora verfügbar ist, muss nur das Feld model geändert werden.
Text-zu-Video-Schnellstart
Ein POST mit Ihrem Kunavo-Schlüssel. Die Generierung kann einige Minuten dauern, daher hält der synchrone Aufruf die Verbindung offen, bis der Clip fertig ist:
import requests
resp = requests.post(
"https://api.kunavo.com/v1/video/generations",
headers={"Authorization": f"Bearer {API_KEY}"},
json={
"model": "veo-3",
"prompt": "um dolly-in cinematográfico em um origami de garça vermelha se abrindo, luz suave",
"aspect_ratio": "16:9",
},
timeout=600, # a geração pode levar minutos
)
print(resp.json()["data"][0]["url"])duration (in Sekunden) legt die Cliplänge bei den Modellen mit sekundengenauer Abrechnung fest: den Seedance-Modellen und Wan 2.7. Die Veo-Modelle ignorieren den Wert; jeder Veo-Clip ist 8 Sekunden lang und wird pro Video abgerechnet.
Bild-zu-Video
Um ein statisches Bild zu animieren, übergeben Sie image_url (eine https-URL oder eine Datei, die an /v1/files hochgeladen wurde) zusammen mit dem Prompt. Für kontrollierte Bewegungen können Sie mit image_urls und image_mode: "frame" ein erstes und ein letztes Bild übergeben. Vollständige Beispiele finden Sie in der Videodokumentation.
Lebenszyklus einer asynchronen Aufgabe
Halten Sie in der Produktion keine Verbindung 10 Minuten lang offen. Senden Sie eine Aufgabe an /v1/videos, erhalten Sie sofort eine Aufgaben-ID und führen Sie anschließend Polling unter GET /v1/videos/{id} durch, bis die Aufgabe abgeschlossen ist. Die Ergebnis-URLs sind dauerhaft gültig.
# Produção: envie uma tarefa e faça polling — sem conexão de longa duração.
task = requests.post(
"https://api.kunavo.com/v1/videos",
headers={
"Authorization": f"Bearer {API_KEY}",
"Idempotency-Key": "meu-uuid-de-tarefa", # seguro para retry em ~24h
},
json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
timeout=60,
).json()
# depois faça polling em GET /v1/videos/{task["id"]} até concluirDie Videodokumentation behandelt den vollständigen Polling-Zyklus, Idempotenzschlüssel und die Zustellung per Webhook.
Preise
Veo 3 wird pro Video berechnet (hier gezeigt: pro 8-Sekunden-Clip in 720p), etwa 50–70% unter dem Listenpreis von Google. Höhere Auflösungen kosten mehr – die vollständige Staffelung finden Sie auf der Preisseite.
| Modell | Ab (720p / 8 s) | Google-Listenpreis | Ihre Ersparnis |
|---|---|---|---|
veo-3-lite | $0.18 | $0.45 | ~60% |
veo-3 (Fast) | $0.36 | $1.20 | ~70% |
veo-3-quality | $1.60 | $3.20 | ~50% |
Prompt-Tipps für Videos
- Beschreiben Sie die Aufnahme, nicht nur das Motiv. Kamerabewegung (Dolly, Schwenk, Push-in), Objektivwirkung, Beleuchtung und Tempo sind wichtiger als Adjektive.
- Legen Sie das Seitenverhältnis ausdrücklich fest –
16:9für Querformat,9:16für Hochformat/soziale Netzwerke. - Jeder Veo-Clip ist 8 Sekunden lang. Planen Sie jede Aufnahme für diese Länge und fügen Sie für längere Sequenzen mehrere Generierungen zusammen.
- Verwenden Sie ein Referenzbild (Bild-zu-Video), wenn eine bestimmte Figur oder ein bestimmtes Produkt konsistent bleiben soll.
Häufig gestellte Fragen
Kann ich die Sora-API heute über Kunavo nutzen?
Sora ist im Kunavo-Katalog noch nicht aktiviert. Die Text-zu-Video-Generierung läuft heute mit Google Veo 3 über denselben OpenAI-kompatiblen Endpunkt /v1/video/generations. Da der Endpunkt modellunabhängig ist, besteht die spätere Migration zu Sora aus einer Änderung an nur einem Wort im Feld model. Der Zugriff auf Sora ist in der Roadmap.
Was ist die Sora-API?
Sora ist das Text-zu-Video-Modell von OpenAI (Sora 2 und Sora 2 Pro). Die Sora-API erzeugt kurze Videoclips – mit synchronisiertem Audio in Sora 2 – aus einem Text-Prompt oder einem statischen Bild, programmgesteuert statt über die Consumer-App.
Wie viel kostet die Videogenerierung bei Kunavo?
Veo 3 wird pro Video berechnet, etwa 50–70% unter dem Listenpreis von Google: Veo 3 Lite ab $0.18, Veo 3 Fast ab $0.36, Veo 3 Quality ab $1.60 pro 8-Sekunden-Clip in 720p. Höhere Auflösungen kosten mehr.
Unterstützt Kunavo Bild-zu-Video?
Ja. Übergeben Sie image_url (eine https-URL oder eine hochgeladene Datei) an /v1/video/generations, um ein statisches Bild zu animieren. Sie können auch ein erstes und ein letztes Bild für kontrollierte Übergänge übergeben.
Wie lange dauert die Generierung?
Minuten. Verwenden Sie in der Produktion die asynchrone Aufgaben-API /v1/videos und führen Sie Polling durch; siehe die Videodokumentation. Preise für Gemini und Textmodelle finden Sie im Preisleitfaden für die Gemini-API.