Zurück zu den Leitfäden
Video·18. Juni 2026·Aktualisiert am 1. Oktober 2026·7 Min. Lesezeit

Sora API — Videogenerierung mit künstlicher Intelligenz (heute mit Veo 3.1)

Der praktische Weg zur KI-Videogenerierung: Format der Sora API, Arbeitsabläufe von Text und Bild zu Video sowie Preise. Jedes Beispiel funktioniert heute mit Google Veo 3.1; sobald Sora verfügbar ist, ändert sich nur das Feld model.

Sora ist OpenAIs Text-zu-Video-Modell, und die „Sora API“ ist der Weg, über den Teams Videos programmatisch statt über eine Verbraucher-App erzeugen. Bei Kunavo läuft Text-zu-Video heute mit Google Veo 3 über einen einzigen OpenAI-artigen Video-Endpunkt – Sora-Zugriff steht auf der Roadmap, und da der Endpunkt modellunabhängig ist, besteht der spätere Wechsel zu Sora aus einer Änderung in einem einzigen Wort. Dieser Leitfaden zeigt den Workflow mit Veo 3, damit jedes Beispiel sofort funktioniert.

Was ist die Sora API?

Sora (Sora 2 und Sora 2 Pro) wandelt eine Textaufforderung – oder ein statisches Bild – in einen kurzen Videoclip um, bei Sora 2 einschließlich synchronisiertem Audio. Das API-Format ermöglicht es, Generierungen in eine Pipeline zu schreiben: Marketingaufnahmen, Produktanimationen, B-Roll und Entwurfsvorschauen. Das Format ist bei modernen Videomodellen gleich: Sie senden eine Aufforderung und Parameter und erhalten eine gehostete Video-URL.

Video heute bei Kunavo: Veo 3

Kunavo stellt Videogenerierung über einen einzigen OpenAI-artigen Endpunkt bereit: /v1/video/generations. Sora ist im Katalog noch nicht aktiviert; das aktuelle Text-zu-Video-Modell ist Google Veo 3, das mit nativem Audio filmische Clips erzeugt. Die folgenden Beispiele verwenden veo-3 – wenn Sora verfügbar wird, ändert sich nur das Feld model.

Schnellstart für Text-zu-Video

Ein einzelner POST mit Ihrem Kunavo-Schlüssel. Die Generierung kann einige Minuten dauern; deshalb hält ein synchroner Aufruf die Verbindung offen, bis der Clip fertig ist:

text_to_video.py
import requests

resp = requests.post(
    "https://api.kunavo.com/v1/video/generations",
    headers={"Authorization": f"Bearer {API_KEY}"},
    json={
        "model": "veo-3",
        "prompt": "kırmızı bir origami turnanın açılışına yumuşak ışıkta sinematik dolly-in",
        "aspect_ratio": "16:9",
    },
    timeout=600,  # üretim dakikalar sürebilir
)
print(resp.json()["data"][0]["url"])

duration (in Sekunden) legt die Cliplänge bei den Modellen mit sekundengenauer Abrechnung fest: den Seedance-Modellen und Wan 2.7. Die Veo-Modelle ignorieren den Wert; jeder Veo-Clip ist 8 Sekunden lang und wird pro Video abgerechnet.

Bild-zu-Video

Übergeben Sie zusammen mit der Aufforderung image_url (eine https-URL oder eine Datei, die Sie unter /v1/files hochgeladen haben), um ein statisches Bild zu animieren. Für kontrollierte Bewegungen können Sie mit image_urls und image_mode: "frame" einen Start- und Endframe übergeben. Vollständige Beispiele finden Sie in der Videodokumentation.

Lebenszyklus asynchroner Aufgaben

Halten Sie in der Produktion keine Verbindung 10 Minuten lang offen. Senden Sie eine Aufgabe an /v1/videos, erhalten Sie sofort eine Aufgaben-ID und fragen Sie anschließend GET /v1/videos/{id} ab, bis die Aufgabe abgeschlossen ist. Ergebnis-URLs sind dauerhaft.

async_submit.py
# Üretim: bir görev gönderin, sonra yoklayın — uzun ömürlü bağlantı yok.
task = requests.post(
    "https://api.kunavo.com/v1/videos",
    headers={
        "Authorization": f"Bearer {API_KEY}",
        "Idempotency-Key": "my-task-uuid",   # ~24s içinde yeniden denemeye güvenli
    },
    json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
    timeout=60,
).json()
# ardından tamamlanana kadar GET /v1/videos/{task["id"]} adresini yoklayın

Die Videodokumentation behandelt den vollständigen Abfragezyklus, Idempotenzschlüssel und die Zustellung per Webhook.

Preise

Veo 3 wird pro Video abgerechnet (hier dargestellt als 8-sekündiger Clip bei 720p) und liegt etwa 50-70 % unter Googles Listenpreis. Höhere Auflösungen sind teurer – die vollständige Stufentabelle finden Sie auf der Preisseite.

ModellEinstieg (720p / 8 s)Google-ListenpreisErsparnis
veo-3-lite$0.18$0.45~%60
veo-3 (Fast)$0.36$1.20~%70
veo-3-quality$1.60$3.20~%50

Tipps für Video-Prompts

  • Beschreiben Sie die Aufnahme, nicht nur das Motiv. Kamerabewegung (Dolly, Schwenk, Push-in), Objektivwirkung, Licht und Tempo sind wichtiger als Adjektive.
  • Geben Sie das Seitenverhältnis ausdrücklich an – 16:9 für Querformat, 9:16 für Hochformat/Social.
  • Jeder Veo-Clip ist 8 Sekunden lang. Planen Sie jede Aufnahme für diese Länge und fügen Sie für längere Sequenzen mehrere Generierungen zusammen.
  • Verwenden Sie ein Referenzbild (Bild-zu-Video), wenn eine bestimmte Figur oder ein bestimmtes Produkt konsistent bleiben muss.

FAQ

Kann ich die Sora API heute mit Kunavo verwenden?

Sora ist im Kunavo-Katalog noch nicht aktiviert. Text-zu-Video läuft heute über denselben OpenAI-artigen /v1/video/generations-Endpunkt mit Google Veo 3. Da der Endpunkt modellunabhängig ist, besteht der spätere Wechsel zu Sora aus einer einzigen Änderung im Modellfeld. Sora-Zugriff steht auf der Roadmap.

Was ist die Sora API?

Sora ist OpenAIs Text-zu-Video-Modell (Sora 2 und Sora 2 Pro). Die Sora API erzeugt kurze Videoclips aus einer Textaufforderung oder einem statischen Bild – bei Sora 2 einschließlich synchronisiertem Audio – programmatisch statt über eine Verbraucher-App.

Wie viel kostet Videogenerierung bei Kunavo?

Veo 3 wird pro Video abgerechnet und liegt etwa 50-70 % unter Googles Listenpreis. Einstiegspreise pro 8-sekündigem 720p-Clip: $0.18 für Veo 3 Lite, $0.36 für Veo 3 Fast und $1.60 für Veo 3 Quality. Höhere Auflösungen sind teurer.

Unterstützt Kunavo Bild-zu-Video?

Ja. Übergeben Sie dem Endpunkt /v1/video/generations image_url (eine https-URL oder eine hochgeladene Datei), um ein statisches Bild zu animieren. Für kontrollierte Übergänge können Sie auch einen Start- und Endframe übergeben.

Wie lange dauert eine Generierung?

Minuten. Verwenden Sie in der Produktion die asynchrone /v1/videos-Aufgaben-API und fragen Sie sie ab; siehe Videodokumentation.