Zurück zu den Leitfäden
Video·8. Juni 2026·Aktualisiert am 1. Oktober 2026·7 Min. Lesezeit

Sora API — Text-zu-Video in einem OpenAI-kompatiblen Workflow

Sora ist OpenAIs Text-zu-Video-Modell. Auf Kunavo ist das aktive Text-zu-Video-Modell Google Veo 3.1 am selben OpenAI-ähnlichen Video-Endpunkt — hier ist der Workflow; Sora-Zugriff steht auf der Roadmap.

Zuletzt überprüft am .

Sora ist OpenAIs Text-zu-Video-Modell, und „die Sora API“ bezeichnet die programmatische Videogenerierung durch Teams statt über die Verbraucher-App. Auf Kunavo läuft Text-zu-Video heute über Google Veo 3 an einem einzigen OpenAI-artigen Videoendpunkt — Sora-Zugriff steht auf der Roadmap, und da der Endpunkt modellunabhängig ist, erfordert der spätere Wechsel zu Sora nur eine Änderung an einem Wort. Dieser Leitfaden zeigt den Workflow mit Veo 3, damit jedes Beispiel sofort ausgeführt werden kann.

Was ist die Sora API?

Sora (Sora 2 und Sora 2 Pro) verwandelt einen Text-Prompt — oder ein Standbild — in einen kurzen Videoclip, mit synchronisiertem Audio in Sora 2. Die API-Form ermöglicht es, die Generierung in eine Pipeline einzubinden: Marketingaufnahmen, Produktanimationen, B-Roll, Storyboard-Vorschauen. Die Form ist bei modernen Videomodellen gleich: Sie senden einen Prompt und Parameter und erhalten eine gehostete Video-URL zurück.

Video heute auf Kunavo: Veo 3

Kunavo stellt die Videogenerierung über einen einzigen OpenAI-artigen Endpunkt bereit, /v1/video/generations. Sora ist im Katalog noch nicht aktiviert; das verfügbare Text-zu-Video-Modell ist Google Veo 3, das kinematografische Clips mit nativem Audio erzeugt. Die folgenden Beispiele verwenden veo-3 — sobald Sora verfügbar ist, ändert sich nur das Feld model.

Schnellstart für Text-zu-Video

Ein POST mit Ihrem Kunavo-Schlüssel. Die Generierung kann einige Minuten dauern, daher hält der synchrone Aufruf die Verbindung offen, bis der Clip bereit ist:

text_to_video.py
import requests

resp = requests.post(
    "https://api.kunavo.com/v1/video/generations",
    headers={"Authorization": f"Bearer {API_KEY}"},
    json={
        "model": "veo-3",
        "prompt": "a cinematic dolly-in on a red origami crane unfolding, soft light",
        "aspect_ratio": "16:9",
    },
    timeout=600,  # generation can take minutes
)
print(resp.json()["data"][0]["url"])

duration (in Sekunden) legt die Cliplänge bei den Modellen mit sekundengenauer Abrechnung fest: den Seedance-Modellen und Wan 2.7. Die Veo-Modelle ignorieren den Wert; jeder Veo-Clip ist 8 Sekunden lang und wird pro Video abgerechnet.

Bild-zu-Video

Um ein Standbild zu animieren, übergeben Sie image_url (eine HTTPS-URL oder eine Datei, die Sie auf /v1/files hochgeladen haben) zusammen mit dem Prompt. Für kontrollierte Bewegung können Sie mit image_urls und image_mode: "frame" ein erstes und ein letztes Bild übergeben. Vollständige Beispiele finden Sie in der Videodokumentation.

Lebenszyklus asynchroner Aufgaben

Halten Sie in der Produktion keine 10-Minuten-Verbindung offen. Übermitteln Sie eine Aufgabe an /v1/videos, erhalten Sie sofort eine Aufgaben-ID zurück und fragen Sie anschließend GET /v1/videos/{id} ab, bis die Aufgabe abgeschlossen ist. Ergebnis-URLs sind dauerhaft.

async_submit.py
# Production: submit a task, then poll — no long-lived connection.
task = requests.post(
    "https://api.kunavo.com/v1/videos",
    headers={
        "Authorization": f"Bearer {API_KEY}",
        "Idempotency-Key": "my-task-uuid",   # retry-safe within ~24h
    },
    json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
    timeout=60,
).json()
# then poll GET /v1/videos/{task["id"]} until it completes

Die Videodokumentation behandelt die vollständige Abfrageschleife, Idempotenzschlüssel und die Zustellung über Webhooks.

Preise

Veo 3 wird pro Video abgerechnet (hier pro 8-Sekunden-Clip bei 720p dargestellt), etwa 50–70% unter Googles Listenpreis. Höhere Auflösungen kosten mehr — die vollständige Staffel finden Sie auf der Preisseite.

ModellAb (720p / 8 s)Google-ListenpreisIhre Ersparnis
veo-3-lite$0.18$0.45~60%
veo-3 (Fast)$0.36$1.20~70%
veo-3-quality$1.60$3.20~50%

Prompting-Tipps für Videos

  • Beschreiben Sie die Aufnahme, nicht nur das Motiv. Kamerabewegung (Dolly, Schwenk, Push-in), Objektivwirkung, Beleuchtung und Tempo sind wichtiger als Adjektive.
  • Seitenverhältnis ausdrücklich festlegen — 16:9 für Querformat, 9:16 für Hochformat/Social Media.
  • Jeder Veo-Clip ist 8 Sekunden lang. Planen Sie jede Aufnahme für diese Länge und fügen Sie für längere Sequenzen mehrere Generierungen zusammen.
  • Ein Referenzbild verwenden (Bild-zu-Video), wenn eine bestimmte Figur oder ein bestimmtes Produkt konsistent bleiben soll.

Häufig gestellte Fragen

Kann ich die Sora API heute auf Kunavo verwenden?

Sora ist im Kunavo-Katalog noch nicht aktiviert. Text-zu-Video läuft heute mit Google Veo 3 über denselben OpenAI-artigen Endpunkt /v1/video/generations. Da der Endpunkt modellunabhängig ist, erfordert der spätere Wechsel zu Sora nur eine Änderung am Modellfeld. Sora-Zugriff steht auf der Roadmap.

Was ist die Sora API?

Sora ist OpenAIs Text-zu-Video-Modell (Sora 2 und Sora 2 Pro). Die Sora API generiert programmatisch kurze Videoclips — mit synchronisiertem Audio in Sora 2 — aus einem Text-Prompt oder einem Standbild, anstatt über die Verbraucher-App.

Was kostet die Videogenerierung auf Kunavo?

Veo 3 wird pro Video abgerechnet, etwa 50–70% unter Googles Listenpreis: Veo 3 Lite ab $0.18, Veo 3 Fast ab $0.36, Veo 3 Quality ab $1.60 pro 8-Sekunden-720p-Clip. Höhere Auflösungen kosten mehr.

Unterstützt Kunavo Bild-zu-Video?

Ja. Übergeben Sie image_url (eine HTTPS-URL oder eine hochgeladene Datei) an /v1/video/generations, um ein Standbild zu animieren. Sie können auch ein erstes und ein letztes Bild für kontrollierte Übergänge übergeben.

Wie lange dauert die Generierung?

Minuten. Verwenden Sie die asynchrone /v1/videos-Aufgaben-API und fragen Sie sie in der Produktion regelmäßig ab; siehe die Videodokumentation.