ガイド一覧へ戻る
動画·2026年6月18日·最終更新 2026年10月1日·読了7分

Sora API — OpenAI互換ワークフローでのテキストから動画生成

SoraはOpenAIのテキスト動画生成モデルです。Kunavoで現在利用できるモデルはGoogle Veo 3.1で、同じOpenAI形式の動画エンドポイントを使います。ワークフローを説明し、Soraへのアクセスはロードマップ上にあることを示します。

SoraはOpenAIのテキスト動画変換モデルであり、「Sora API」は、チームがコンシューマー向けアプリではなくプログラムから動画を生成する方法を指します。現在Kunavoでは、テキストから動画への生成は、OpenAI形式の単一動画エンドポイントを通じてGoogle Veo 3で実行されます。Soraへのアクセスはロードマップに含まれており、エンドポイントはモデルに依存しないため、後からSoraに移行する際の変更は1語だけです。このガイドでは、すべての例を今すぐ実行できるよう、Veo 3を使ったワークフローを説明します。

Sora APIとは何ですか?

Sora(Sora 2およびSora 2 Pro)は、テキストプロンプトまたは静止画像を、Sora 2では同期音声付きの短い動画クリップに変換します。API形式を使えば、マーケティング用ショット、製品アニメーション、Bロール、ストーリーボードのプレビューなど、生成をパイプライン内で自動化できます。形式は最新の動画モデル間で共通しています。プロンプトとパラメーターを送信すると、ホストされた動画のURLが返されます。

現在Kunavoで利用できる動画:Veo 3

Kunavoは、OpenAI形式の単一エンドポイント/v1/video/generationsで動画生成を提供します。Soraはまだカタログで有効化されていません。現在利用できるテキスト動画変換モデルはGoogle Veo 3で、ネイティブ音声付きの映画的なクリップを生成します。以下の例ではveo-3を使用します。Soraが利用可能になったときの変更は、modelフィールドだけです。

テキストから動画へのクイックスタート

Kunavoキーを使ったPOSTリクエストです。生成には数分かかる場合があるため、同期呼び出しではクリップの準備が完了するまで接続を開いたままにします。

texto_para_video.py
import requests

resp = requests.post(
    "https://api.kunavo.com/v1/video/generations",
    headers={"Authorization": f"Bearer {API_KEY}"},
    json={
        "model": "veo-3",
        "prompt": "um dolly-in cinematográfico em um origami de garça vermelha se abrindo, luz suave",
        "aspect_ratio": "16:9",
    },
    timeout=600,  # a geração pode levar minutos
)
print(resp.json()["data"][0]["url"])

duration(秒数)は、秒単位課金のモデル(Seedanceの各モデルとWan 2.7)でクリップの長さを指定します。Veoモデルでは無視されます。Veoのクリップはすべて8秒で、動画単位で課金されます。

画像から動画への変換

静止画像をアニメーション化するには、プロンプトとともにimage_url(httpsのURLまたは/v1/filesにアップロードしたファイル)を渡します。動きを制御するには、image_urlsとimage_mode: "frame"を使用して最初と最後のフレームを渡せます。完全な例は動画ドキュメントにあります。

非同期タスクのライフサイクル

本番環境で10分間接続を保持しないでください。/v1/videosにタスクを送信し、すぐにタスクIDを受け取り、その後GET /v1/videos/{id}をポーリングして完了を確認します。結果URLは永続的です。

envio_assincrono.py
# Produção: envie uma tarefa e faça polling — sem conexão de longa duração.
task = requests.post(
    "https://api.kunavo.com/v1/videos",
    headers={
        "Authorization": f"Bearer {API_KEY}",
        "Idempotency-Key": "meu-uuid-de-tarefa",   # seguro para retry em ~24h
    },
    json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
    timeout=60,
).json()
# depois faça polling em GET /v1/videos/{task["id"]} até concluir

動画ドキュメントでは、ポーリングの完全なループ、冪等性キー、Webhookによる配信について説明しています。

料金

Veo 3は動画単位(ここでは720p・8秒のクリップ単位)で課金され、Googleの定価より約50–70%低い料金です。高解像度では料金が高くなります。全レンジの料金表は料金ページを参照してください。

モデル開始価格(720p / 8秒)Google定価節約額
veo-3-lite$0.18$0.45~60%
veo-3(Fast)$0.36$1.20~70%
veo-3-quality$1.60$3.20~50%

動画プロンプトのヒント

  • 被写体だけでなくショットを描写する。カメラの動き(ドリー、パン、プッシュイン)、レンズの雰囲気、照明、テンポは、形容詞よりも重要です。
  • アスペクト比を明示する — 16:9は横長、9:16は縦長/ソーシャルメディア向けです。
  • Veoのクリップはすべて8秒です。各ショットはこの長さに合わせて設計し、長いシーケンスでは複数の生成結果をつなぎ合わせてください。
  • 特定のキャラクターや製品の一貫性を保つ必要がある場合は、参照フレーム(画像から動画への変換)を使用します。

よくある質問

現在、KunavoでSora APIを利用できますか?

SoraはまだKunavoのカタログで有効化されていません。現在、テキストから動画への生成は、OpenAI形式の同じエンドポイント /v1/video/generations を通じてGoogle Veo 3で実行されます。エンドポイントはモデルに依存しないため、後からSoraに移行する際の変更はmodelフィールドの1語だけです。Soraへのアクセスはロードマップに含まれています。

Sora APIとは何ですか?

SoraはOpenAIのテキスト動画変換モデルです(Sora 2およびSora 2 Pro)。Sora APIでは、テキストプロンプトまたは静止画像から、Sora 2では同期音声付きの短い動画クリップを、コンシューマー向けアプリではなくプログラムから生成できます。

Kunavoで動画を生成するにはいくらかかりますか?

Veo 3は動画単位で課金され、Googleの定価より約50–70%低い料金です。720p・8秒のクリップ1本あたり、Veo 3 Liteは$0.18、Veo 3 Fastは$0.36、Veo 3 Qualityは$1.60から利用できます。高解像度では料金が高くなります。

Kunavoは画像から動画への変換に対応していますか?

はい。/v1/video/generationsにimage_url(httpsのURLまたはアップロードしたファイル)を渡すと、静止画像をアニメーション化できます。制御されたトランジションのために、最初と最後のフレームを渡すこともできます。

生成にはどのくらい時間がかかりますか?

数分です。本番環境では非同期タスクAPI /v1/videosを使用してポーリングしてください。動画ドキュメントを参照してください。Geminiとテキストモデルの料金については、Gemini API料金ガイドを参照してください。