Sora ist OpenAIs Modell zur Generierung von Videos aus Text, und die „Sora API“ ist eine Möglichkeit, Videos programmatisch statt über eine Consumer-App zu erzeugen. Bei Kunavo läuft die Text-zu-Video-Generierung derzeit mit Google Veo 3 über einen einzigen OpenAI-artigen Video-Endpunkt. Die Unterstützung für Sora steht auf der Roadmap; da der Endpunkt modellunabhängig ist, erfolgt der spätere Wechsel zu Sora durch eine Änderung eines Wortes. Dieser Leitfaden zeigt den Workflow mit Veo 3, damit alle Beispiele sofort funktionieren.
Was ist die Sora API?
Sora (Sora 2 und Sora 2 Pro) verwandelt Text-Prompts – oder ein einziges Standbild – in kurze Videoclips und fügt bei Sora 2 synchronisiertes Audio hinzu. Über die API lässt sich die Generierung in Pipelines integrieren, etwa für Marketingvideos, Produktanimationen, B-Roll oder Vorschauen von Storyboards. Das Format ist bei modernen Videomodellen allgemein ähnlich: Sie senden Prompt und Parameter und erhalten eine gehostete Video-URL.
Jetzt verfügbare Videos bei Kunavo: Veo 3
Kunavo stellt Videogenerierung über einen einzigen OpenAI-artigen Endpunkt /v1/video/generations bereit. Sora ist im Katalog noch nicht aktiviert. Das derzeit verfügbare Text-zu-Video-Modell ist Google Veo 3, das filmische Clips mit nativem Audio erzeugt. Die folgenden Beispiele verwenden veo-3 – sobald Sora verfügbar ist, müssen Sie nur das Feld model ändern.
Schnellstart für Text-zu-Video
Sie benötigen nur einen einzigen POST mit Ihrem Kunavo-Schlüssel. Da die Generierung mehrere Minuten dauern kann, hält ein synchroner Aufruf die Verbindung offen, bis der Clip bereit ist.
import requests
resp = requests.post(
"https://api.kunavo.com/v1/video/generations",
headers={"Authorization": f"Bearer {API_KEY}"},
json={
"model": "veo-3",
"prompt": "a cinematic dolly-in on a red origami crane unfolding, soft light",
"aspect_ratio": "16:9",
},
timeout=600, # 生成には数分かかることがあります
)
print(resp.json()["data"][0]["url"])duration (in Sekunden) legt die Cliplänge bei den Modellen mit sekundengenauer Abrechnung fest: den Seedance-Modellen und Wan 2.7. Die Veo-Modelle ignorieren den Wert; jeder Veo-Clip ist 8 Sekunden lang und wird pro Video abgerechnet.
Von Bild zu Video
Um ein Standbild zu animieren, übergeben Sie zusammen mit dem Prompt image_url (eine https-URL oder eine Datei, die Sie unter /v1/files hochgeladen haben). Wenn Sie die Bewegung steuern möchten, können Sie mit image_urls und image_mode: "frame" den ersten und letzten Frame übergeben. Weitere Beispiele finden Sie in der Videodokumentation.
Lebenszyklus asynchroner Aufgaben
Halten Sie in der Produktion keine Verbindung zehn Minuten lang offen. Wenn Sie die Aufgabe an /v1/videos übergeben, erhalten Sie sofort eine Aufgaben-ID. Fragen Sie anschließend GET /v1/videos/{id} wiederholt ab, bis die Aufgabe abgeschlossen ist. Die Ergebnis-URL ist dauerhaft.
# 本番: タスクを投入してからポーリング——長時間の接続を保持しません。
task = requests.post(
"https://api.kunavo.com/v1/videos",
headers={
"Authorization": f"Bearer {API_KEY}",
"Idempotency-Key": "my-task-uuid", # 約 24 時間はリトライしても安全
},
json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
timeout=60,
).json()
# その後 GET /v1/videos/{task["id"]} を完了までポーリングしますDie Videodokumentation erklärt die vollständige Polling-Schleife, Idempotenzschlüssel und Webhook-Zustellung.
Preise
Veo 3 wird pro Video berechnet (hier pro 8-Sekunden-Clip in 720p) und ist etwa 50〜70% günstiger als Googles Listenpreise. Höhere Auflösungen erhöhen die Kosten – die vollständige Tarifübersicht finden Sie auf der Preisseite.
| Modelle | Am günstigsten (720p / 8 Sekunden) | Googles Listenpreis | Ersparnis |
|---|---|---|---|
veo-3-lite | $0.18 | $0.45 | Etwa 60% |
veo-3 (Fast) | $0.36 | $1.20 | Etwa 70% |
veo-3-quality | $1.60 | $3.20 | Etwa 50% |
Tipps für Video-Prompts
- Beschreiben Sie nicht nur das Motiv, sondern auch die Aufnahme. Kamerabewegungen (Dolly, Schwenk, Push-in), Objektivwirkung, Beleuchtung und Tempo sind wirkungsvoller als Adjektive.
- Seitenverhältnis ausdrücklich angeben — Querformat:
16:9, Hochformat/Social Media:9:16. - Jeder Veo-Clip ist 8 Sekunden lang. Planen Sie jede Aufnahme für diese Länge und fügen Sie für längere Sequenzen mehrere Generierungen zusammen.
- Referenzbilder verwenden (Bild-zu-Video) — nützlich, wenn eine bestimmte Figur oder ein bestimmtes Produkt konsistent bleiben soll.
Häufig gestellte Fragen
Kann ich die Sora API jetzt mit Kunavo verwenden?
Sora ist im Kunavo-Katalog noch nicht aktiviert. Die Text-zu-Video-Generierung läuft derzeit mit Google Veo 3 über denselben OpenAI-artigen /v1/video/generations-Endpunkt. Der Endpunkt ist modellunabhängig, daher ist der spätere Wechsel zu Sora nur eine Änderung eines Wortes im Feld model. Die Unterstützung für Sora steht auf der Roadmap.
Was ist die Sora API?
Sora ist OpenAIs Modell zur Generierung von Videos aus Text (Sora 2 und Sora 2 Pro). Die Sora API generiert kurze Videoclips aus Text-Prompts oder einem einzigen Standbild – bei Sora 2 mit synchronisiertem Audio – programmatisch statt über eine Consumer-App.
Wie viel kostet Videogenerierung mit Kunavo?
Veo 3 wird pro Video berechnet und ist etwa 50〜70% günstiger als Googles Listenpreise. Bei einem 8 Sekunden langen Clip in 720p kostet Veo 3 Lite ab $0.18, Veo 3 Fast ab $0.36 und Veo 3 Quality ab $1.60. Eine höhere Auflösung erhöht die Kosten.
Unterstützt Kunavo die Generierung von Videos aus Bildern?
Ja. Übergeben Sie image_url (eine https-URL oder eine hochgeladene Datei) an /v1/video/generations, um ein Standbild zu animieren. Sie können auch den ersten und letzten Frame übergeben, um kontrollierte Übergänge zu erstellen.