Voltar aos guias
Vídeo·18 de junho de 2026·Atualizado em 1 de outubro de 2026·7 min de leitura

Sora API — geração de vídeos com IA (hoje com Veo 3.1)

A maneira prática de gerar vídeos com IA: formato da Sora API, fluxos de texto e imagem para vídeo e preços. Todos os exemplos funcionam hoje com o Google Veo 3.1; quando a Sora chegar, apenas o campo model mudará.

Sora é o modelo de texto para vídeo da OpenAI, e a “API Sora” é a forma de as equipes gerarem vídeos programaticamente em vez de usar um aplicativo para consumidores. Hoje, na Kunavo, a conversão de texto em vídeo funciona com o Google Veo 3 por meio de um único endpoint de vídeo no estilo da OpenAI — o acesso ao Sora está no roadmap e, como o endpoint é independente do modelo, a futura transição para o Sora será uma mudança de uma única palavra. Este guia mostra o fluxo com o Veo 3 para que todos os exemplos funcionem imediatamente.

O que é a API Sora?

Sora (Sora 2 e Sora 2 Pro) transforma um prompt de texto — ou uma imagem estática — em um clipe curto de vídeo, com áudio sincronizado no Sora 2. O formato da API permite colocar a geração em um pipeline: vídeos de marketing, animações de produtos, b-roll e prévias de rascunhos. O formato é o mesmo dos modelos de vídeo modernos: envie um prompt e parâmetros e receba uma URL de vídeo hospedada.

Vídeo na Kunavo hoje: Veo 3

A Kunavo oferece geração de vídeo por meio de um único endpoint no estilo da OpenAI: /v1/video/generations. O Sora ainda não está ativado no catálogo; o modelo ativo de texto para vídeo é o Google Veo 3, que produz clipes cinematográficos com áudio nativo. Os exemplos abaixo usam veo-3 — quando o Sora chegar, a única mudança será o campo model.

Início rápido: texto para vídeo

Um único POST com sua chave da Kunavo. A geração pode levar alguns minutos; por isso, uma chamada síncrona mantém a conexão aberta até o clipe ficar pronto:

text_to_video.py
import requests

resp = requests.post(
    "https://api.kunavo.com/v1/video/generations",
    headers={"Authorization": f"Bearer {API_KEY}"},
    json={
        "model": "veo-3",
        "prompt": "kırmızı bir origami turnanın açılışına yumuşak ışıkta sinematik dolly-in",
        "aspect_ratio": "16:9",
    },
    timeout=600,  # üretim dakikalar sürebilir
)
print(resp.json()["data"][0]["url"])

duration (em segundos) define a duração do clipe nos modelos cobrados por segundo: os modelos Seedance e o Wan 2.7. Os modelos Veo ignoram esse valor; cada clipe do Veo tem 8 segundos e é cobrado por vídeo.

Imagem para vídeo

Para animar uma imagem estática, envie image_url junto com o prompt (uma URL https ou um arquivo carregado em /v1/files). Para movimento controlado, você pode enviar o primeiro e o último quadro com image_urls e image_mode: "frame". Exemplos completos estão na documentação de vídeo.

Ciclo de vida de tarefas assíncronas

Em produção, não mantenha uma conexão aberta por 10 minutos. Envie uma tarefa para /v1/videos, obtenha imediatamente um ID de tarefa e faça polling de GET /v1/videos/{id} até a conclusão. As URLs dos resultados são permanentes.

async_submit.py
# Üretim: bir görev gönderin, sonra yoklayın — uzun ömürlü bağlantı yok.
task = requests.post(
    "https://api.kunavo.com/v1/videos",
    headers={
        "Authorization": f"Bearer {API_KEY}",
        "Idempotency-Key": "my-task-uuid",   # ~24s içinde yeniden denemeye güvenli
    },
    json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
    timeout=60,
).json()
# ardından tamamlanana kadar GET /v1/videos/{task["id"]} adresini yoklayın

A documentação de vídeo cobre o ciclo completo de polling, as chaves de idempotência e a entrega por webhook.

Preços

O Veo 3 é cobrado por vídeo (aqui mostrado por clipe de 8 segundos em 720p) e custa aproximadamente %50-70 menos que o preço de tabela do Google. Resoluções mais altas custam mais — consulte a página de preços para ver a tabela completa de níveis.

ModeloInicial (720p / 8s)Tabela do GoogleEconomia
veo-3-lite$0.18$0.45~%60
veo-3 (Fast)$0.36$1.20~%70
veo-3-quality$1.60$3.20~%50

Dicas de prompts para vídeo

  • Descreva a tomada, não apenas o sujeito. Movimento de câmera (dolly, pan, push-in), sensação da lente, iluminação e ritmo importam mais do que adjetivos.
  • Especifique explicitamente a proporção — 16:9 para horizontal e 9:16 para vertical/social.
  • Cada clipe do Veo tem 8 segundos. Planeje cada cena para essa duração e una várias gerações para sequências mais longas.
  • Use um quadro de referência (imagem para vídeo) — quando um personagem ou produto específico precisa permanecer consistente.

Perguntas frequentes

Posso usar a API Sora na Kunavo hoje?

O Sora ainda não está ativado no catálogo da Kunavo. Hoje, a conversão de texto em vídeo funciona com o Google Veo 3 pelo mesmo endpoint /v1/video/generations no estilo da OpenAI. Como o endpoint é independente do modelo, a futura transição para o Sora será uma mudança de uma única palavra no campo do modelo. O acesso ao Sora está no roadmap.

O que é a API Sora?

Sora é o modelo de texto para vídeo da OpenAI (Sora 2 e Sora 2 Pro). A API Sora gera programaticamente clipes curtos de vídeo a partir de um prompt de texto ou de uma imagem estática — com áudio sincronizado no Sora 2 — em vez de usar um aplicativo para consumidores.

Quanto custa gerar vídeos na Kunavo?

O Veo 3 é cobrado por vídeo e custa aproximadamente %50-70 menos que o preço de tabela do Google. Preços iniciais por clipe de 8 segundos em 720p: $0.18 para o Veo 3 Lite, $0.36 para o Veo 3 Fast e $1.60 para o Veo 3 Quality. Resoluções mais altas custam mais.

A Kunavo oferece conversão de imagem em vídeo?

Sim. Para animar uma imagem estática, envie image_url (uma URL https ou um arquivo carregado) ao endpoint /v1/video/generations. Você também pode enviar um primeiro e um último quadro para transições controladas.

Quanto tempo a geração leva?

Minutos. Em produção, use a API de tarefas assíncronas /v1/videos e faça polling; consulte a documentação de vídeo.