Sora é o modelo de texto para vídeo da OpenAI, e a “API Sora” é a forma de as equipes gerarem vídeos programaticamente em vez de usar um aplicativo para consumidores. Hoje, na Kunavo, a conversão de texto em vídeo funciona com o Google Veo 3 por meio de um único endpoint de vídeo no estilo da OpenAI — o acesso ao Sora está no roadmap e, como o endpoint é independente do modelo, a futura transição para o Sora será uma mudança de uma única palavra. Este guia mostra o fluxo com o Veo 3 para que todos os exemplos funcionem imediatamente.
O que é a API Sora?
Sora (Sora 2 e Sora 2 Pro) transforma um prompt de texto — ou uma imagem estática — em um clipe curto de vídeo, com áudio sincronizado no Sora 2. O formato da API permite colocar a geração em um pipeline: vídeos de marketing, animações de produtos, b-roll e prévias de rascunhos. O formato é o mesmo dos modelos de vídeo modernos: envie um prompt e parâmetros e receba uma URL de vídeo hospedada.
Vídeo na Kunavo hoje: Veo 3
A Kunavo oferece geração de vídeo por meio de um único endpoint no estilo da OpenAI: /v1/video/generations. O Sora ainda não está ativado no catálogo; o modelo ativo de texto para vídeo é o Google Veo 3, que produz clipes cinematográficos com áudio nativo. Os exemplos abaixo usam veo-3 — quando o Sora chegar, a única mudança será o campo model.
Início rápido: texto para vídeo
Um único POST com sua chave da Kunavo. A geração pode levar alguns minutos; por isso, uma chamada síncrona mantém a conexão aberta até o clipe ficar pronto:
import requests
resp = requests.post(
"https://api.kunavo.com/v1/video/generations",
headers={"Authorization": f"Bearer {API_KEY}"},
json={
"model": "veo-3",
"prompt": "kırmızı bir origami turnanın açılışına yumuşak ışıkta sinematik dolly-in",
"aspect_ratio": "16:9",
},
timeout=600, # üretim dakikalar sürebilir
)
print(resp.json()["data"][0]["url"])duration (em segundos) define a duração do clipe nos modelos cobrados por segundo: os modelos Seedance e o Wan 2.7. Os modelos Veo ignoram esse valor; cada clipe do Veo tem 8 segundos e é cobrado por vídeo.
Imagem para vídeo
Para animar uma imagem estática, envie image_url junto com o prompt (uma URL https ou um arquivo carregado em /v1/files). Para movimento controlado, você pode enviar o primeiro e o último quadro com image_urls e image_mode: "frame". Exemplos completos estão na documentação de vídeo.
Ciclo de vida de tarefas assíncronas
Em produção, não mantenha uma conexão aberta por 10 minutos. Envie uma tarefa para /v1/videos, obtenha imediatamente um ID de tarefa e faça polling de GET /v1/videos/{id} até a conclusão. As URLs dos resultados são permanentes.
# Üretim: bir görev gönderin, sonra yoklayın — uzun ömürlü bağlantı yok.
task = requests.post(
"https://api.kunavo.com/v1/videos",
headers={
"Authorization": f"Bearer {API_KEY}",
"Idempotency-Key": "my-task-uuid", # ~24s içinde yeniden denemeye güvenli
},
json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
timeout=60,
).json()
# ardından tamamlanana kadar GET /v1/videos/{task["id"]} adresini yoklayınA documentação de vídeo cobre o ciclo completo de polling, as chaves de idempotência e a entrega por webhook.
Preços
O Veo 3 é cobrado por vídeo (aqui mostrado por clipe de 8 segundos em 720p) e custa aproximadamente %50-70 menos que o preço de tabela do Google. Resoluções mais altas custam mais — consulte a página de preços para ver a tabela completa de níveis.
| Modelo | Inicial (720p / 8s) | Tabela do Google | Economia |
|---|---|---|---|
veo-3-lite | $0.18 | $0.45 | ~%60 |
veo-3 (Fast) | $0.36 | $1.20 | ~%70 |
veo-3-quality | $1.60 | $3.20 | ~%50 |
Dicas de prompts para vídeo
- Descreva a tomada, não apenas o sujeito. Movimento de câmera (dolly, pan, push-in), sensação da lente, iluminação e ritmo importam mais do que adjetivos.
- Especifique explicitamente a proporção —
16:9para horizontal e9:16para vertical/social. - Cada clipe do Veo tem 8 segundos. Planeje cada cena para essa duração e una várias gerações para sequências mais longas.
- Use um quadro de referência (imagem para vídeo) — quando um personagem ou produto específico precisa permanecer consistente.
Perguntas frequentes
Posso usar a API Sora na Kunavo hoje?
O Sora ainda não está ativado no catálogo da Kunavo. Hoje, a conversão de texto em vídeo funciona com o Google Veo 3 pelo mesmo endpoint /v1/video/generations no estilo da OpenAI. Como o endpoint é independente do modelo, a futura transição para o Sora será uma mudança de uma única palavra no campo do modelo. O acesso ao Sora está no roadmap.
O que é a API Sora?
Sora é o modelo de texto para vídeo da OpenAI (Sora 2 e Sora 2 Pro). A API Sora gera programaticamente clipes curtos de vídeo a partir de um prompt de texto ou de uma imagem estática — com áudio sincronizado no Sora 2 — em vez de usar um aplicativo para consumidores.
Quanto custa gerar vídeos na Kunavo?
O Veo 3 é cobrado por vídeo e custa aproximadamente %50-70 menos que o preço de tabela do Google. Preços iniciais por clipe de 8 segundos em 720p: $0.18 para o Veo 3 Lite, $0.36 para o Veo 3 Fast e $1.60 para o Veo 3 Quality. Resoluções mais altas custam mais.
A Kunavo oferece conversão de imagem em vídeo?
Sim. Para animar uma imagem estática, envie image_url (uma URL https ou um arquivo carregado) ao endpoint /v1/video/generations. Você também pode enviar um primeiro e um último quadro para transições controladas.
Quanto tempo a geração leva?
Minutos. Em produção, use a API de tarefas assíncronas /v1/videos e faça polling; consulte a documentação de vídeo.