ガイド一覧へ戻る
動画·2026年6月8日·最終更新 2026年10月1日·読了7分

Sora API — OpenAI互換ワークフローでのtext-to-video

SoraはOpenAIのtext-to-videoモデルです。Kunavoで現在利用できるtext-to-videoモデルはGoogle Veo 3.1で、同じOpenAIスタイルの動画エンドポイントを使います。Sora対応はロードマップにあります。

最終確認日:。

SoraはOpenAIのテキストから動画を生成するモデルで、「Sora API」とは、チームがコンシューマー向けアプリではなくプログラムから動画を生成する方法です。現在Kunavoでは、テキストから動画への生成は、1つのOpenAI形式の動画エンドポイントを通じてGoogle Veo 3で動作します。Soraへのアクセスはロードマップ上にあり、エンドポイントはモデルに依存しないため、後からSoraへ移行する場合は1語の変更で済みます。このガイドでは、すべての例を今すぐ実行できるよう、Veo 3を使ったワークフローを示します。

Sora APIとは?

Sora(Sora 2およびSora 2 Pro)は、テキストプロンプトまたは静止画像を短い動画クリップに変換し、Sora 2では同期音声も付加します。API形式を使えば、マーケティング映像、製品アニメーション、Bロール、絵コンテのプレビューなど、生成処理をパイプラインに組み込めます。最新の動画モデルでは形式は共通しており、プロンプトとパラメーターを送ると、ホストされた動画URLが返されます。

現在Kunavoで利用できる動画:Veo 3

Kunavoは、単一のOpenAI形式エンドポイント/v1/video/generationsを通じて動画生成を提供します。Soraはまだカタログで有効化されていません。現在利用できるテキスト・トゥ・ビデオモデルはGoogle Veo 3で、ネイティブ音声付きの映画的なクリップを生成します。以下の例ではveo-3を使用します。Soraが利用可能になった場合、変更点はmodelフィールドだけです。

テキスト・トゥ・ビデオのクイックスタート

Kunavoキーを使って1回POSTします。生成には数分かかる場合があるため、同期呼び出しではクリップの準備が完了するまで接続が維持されます。

text_to_video.py
import requests

resp = requests.post(
    "https://api.kunavo.com/v1/video/generations",
    headers={"Authorization": f"Bearer {API_KEY}"},
    json={
        "model": "veo-3",
        "prompt": "a cinematic dolly-in on a red origami crane unfolding, soft light",
        "aspect_ratio": "16:9",
    },
    timeout=600,  # generation can take minutes
)
print(resp.json()["data"][0]["url"])

duration(秒数)は、秒単位課金のモデル(Seedanceの各モデルとWan 2.7)でクリップの長さを指定します。Veoモデルでは無視されます。Veoのクリップはすべて8秒で、動画単位で課金されます。

画像から動画

静止画像を動画化するには、プロンプトとともにimage_url(https URLまたは/v1/filesにアップロードしたファイル)を渡します。動きを制御するには、image_urlsとimage_mode: "frame"で最初と最後のフレームを渡せます。完全な例は動画ドキュメントにあります。

非同期タスクのライフサイクル

本番環境では、10分間接続を保持しないでください。/v1/videosにタスクを送信すると、すぐにタスクIDが返されます。その後、完了するまでGET /v1/videos/{id}をポーリングします。結果URLは永続的です。

async_submit.py
# Production: submit a task, then poll — no long-lived connection.
task = requests.post(
    "https://api.kunavo.com/v1/videos",
    headers={
        "Authorization": f"Bearer {API_KEY}",
        "Idempotency-Key": "my-task-uuid",   # retry-safe within ~24h
    },
    json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
    timeout=60,
).json()
# then poll GET /v1/videos/{task["id"]} until it completes

動画ドキュメントでは、ポーリングの全体的なループ、冪等性キー、Webhook配信について説明しています。

料金

Veo 3は動画単位で課金されます(ここでは720pの8秒クリップ)。Googleの公式価格より約50–70%安価です。高解像度では料金が高くなります。完全なティア表は料金ページをご覧ください。

モデル(720p/8秒)からGoogle公式価格節約額
veo-3-lite$0.18$0.45~60%
veo-3(Fast)$0.36$1.20~70%
veo-3-quality$1.60$3.20~50%

動画プロンプトのヒント

  • 被写体だけでなく、ショットを説明してください。カメラの動き(ドリー、パン、プッシュイン)、レンズ感、照明、テンポは形容詞より重要です。
  • アスペクト比を明示する — 16:9は横長、9:16は縦長/ソーシャル向けです。
  • Veoのクリップはすべて8秒です。各ショットはこの長さに合わせて設計し、長いシーケンスでは複数の生成結果をつなぎ合わせてください。
  • 特定のキャラクターや製品の一貫性を保つ必要がある場合は、参照フレーム(画像から動画)を使用してください。

よくある質問

現在、KunavoでSora APIを使えますか?

SoraはまだKunavoのカタログで有効化されていません。現在、テキストから動画への変換は、同じOpenAI形式の/v1/video/generationsエンドポイントを通じてGoogle Veo 3で実行できます。エンドポイントはモデルに依存しないため、後からSoraへ切り替える場合もmodelフィールドを1語変更するだけです。Soraへのアクセスはロードマップ上にあります。

Sora APIとは?

SoraはOpenAIのテキスト・トゥ・ビデオモデル(Sora 2とSora 2 Pro)です。Sora APIは、テキストプロンプトまたは静止画像から、Sora 2では同期音声付きの短い動画クリップを、コンシューマーアプリではなくプログラムで生成します。

Kunavoでの動画生成料金はいくらですか?

Veo 3は動画単位で課金され、Googleの公式価格より約50–70%安価です。8秒720pクリップあたり、Veo 3 Liteは$0.18から、Veo 3 Fastは$0.36から、Veo 3 Qualityは$1.60から利用できます。高解像度では料金が高くなります。

Kunavoは画像から動画への変換に対応していますか?

はい。画像を動画化するには、image_url(https URLまたはアップロードしたファイル)を/v1/video/generationsに渡します。制御されたトランジションのために、最初と最後のフレームを渡すこともできます。

生成にはどのくらいかかりますか?

数分です。非同期の/v1/videosタスクAPIを使用して本番環境でポーリングしてください。動画ドキュメントをご覧ください。