ガイド一覧へ戻る
動画·2026年6月18日·最終更新 2026年10月1日·読了7分

Sora API — OpenAI互換エンドポイントでAI動画を生成(現在はVeo 3.1)

Sora APIでAI動画を生成:Soraはまだ有効化されていません。現在有効なテキストから動画を生成するモデルは、同じOpenAIに似たエンドポイント上のGoogle Veo 3.1です。実行可能な例と、1クリップ$0.18からの料金を紹介します。

SoraはOpenAIのテキスト動画生成モデルで、「Sora API」とは、コンシューマーアプリではなくプログラムからチームが動画を生成するための手段です。Kunavoでは現在、Google Veo 3をOpenAI形式の動画エンドポイントで利用しています — Soraへのアクセスはロードマップに含まれており、エンドポイントはモデルに依存しないため、将来Soraに切り替える場合は1語を変更するだけです。このガイドではVeo 3を使ったワークフローを示すため、各例をすぐに実行できます。

Sora APIとは何ですか?

Sora(Sora 2およびSora 2 Pro)は、テキストプロンプトまたは静止画から短い動画クリップを生成し、Sora 2では同期音声にも対応します。API形式を使えば、生成をパイプラインに組み込めます:マーケティング用ショット、製品アニメーション、Bロール、ストーリーボードのプレビューなどです。形式は最新の動画モデル間で共通しています:プロンプトとパラメーターを送信し、ホストされた動画URLを受け取ります。

現在のKunavoの動画:Veo 3

Kunavoは、単一のOpenAI形式エンドポイント/v1/video/generationsを通じて動画生成を提供します。Soraはまだカタログで有効化されておらず、現在有効なテキスト動画生成モデルは、ネイティブ音声付きのシネマティックなクリップを生成するGoogle Veo 3です。以下の例ではveo-3を使用します — Soraが提供開始された場合、変更するのはmodelフィールドだけです。

テキストから動画へのクイックスタート

Kunavoキーを使ってPOSTします。生成には数分かかる場合があるため、同期呼び出しではクリップが完成するまで接続を維持します:

text_to_video.py
import requests

resp = requests.post(
    "https://api.kunavo.com/v1/video/generations",
    headers={"Authorization": f"Bearer {API_KEY}"},
    json={
        "model": "veo-3",
        "prompt": "a cinematic dolly-in on a red origami crane unfolding, soft light",
        "aspect_ratio": "16:9",
    },
    timeout=600,  # die Generierung kann Minuten dauern
)
print(resp.json()["data"][0]["url"])

duration(秒数)は、秒単位課金のモデル(Seedanceの各モデルとWan 2.7)でクリップの長さを指定します。Veoモデルでは無視されます。Veoのクリップはすべて8秒で、動画単位で課金されます。

画像から動画へ

静止画をアニメーション化するには、プロンプトとともにimage_url(https-URLまたは/v1/filesにアップロードしたファイル)を渡します。動きを制御するには、image_urlsとimage_mode: "frame"を使って最初と最後のフレームを指定できます。完全な例は動画ドキュメントにあります。

非同期タスクのライフサイクル

本番環境では10分間の接続を開いたままにしないでください。/v1/videosにタスクを送信すると、すぐにタスクIDが返されるので、その後GET /v1/videos/{id}をポーリングして完了を待ちます。結果URLは永続的です。

async_submit.py
# Produktion: Task einreichen, dann pollen — keine langlebige Verbindung.
task = requests.post(
    "https://api.kunavo.com/v1/videos",
    headers={
        "Authorization": f"Bearer {API_KEY}",
        "Idempotency-Key": "my-task-uuid",   # innerhalb von ~24h retry-sicher
    },
    json={"model": "veo-3", "prompt": "...", "aspect_ratio": "16:9"},
    timeout=60,
).json()
# dann GET /v1/videos/{task["id"]} pollen, bis er fertig ist

動画ドキュメントでは、ポーリングの完全なループ、Idempotency-Key、Webhook配信について説明しています。

料金

Veo 3は動画単位で課金されます(ここでは720pの8秒クリップ単位)。Googleの表示価格より約50–70%安価です。高解像度では料金が高くなります — 完全な段階別料金表は料金ページにあります。

モデル開始価格(720p / 8秒)Googleの表示価格節約額
veo-3-lite$0.18$0.45~60%
veo-3(Fast)$0.36$1.20~70%
veo-3-quality$1.60$3.20~50%

動画プロンプトのヒント

  • 被写体だけでなく、シーンを説明する。カメラワーク(ドリー、パン、プッシュイン)、レンズの印象、照明、テンポは形容詞よりも重要です。
  • アスペクト比を明示する — 横長は16:9、縦長/ソーシャルは9:16。
  • Veoのクリップはすべて8秒です。各ショットはこの長さに合わせて設計し、長いシーケンスでは複数の生成結果をつなぎ合わせてください。
  • リファレンスフレームを使う(画像から動画へ)。特定のキャラクターや製品の一貫性を保ちたい場合に有効です。

よくある質問

今日、KunavoでSora APIを利用できますか?

SoraはまだKunavoのカタログで有効化されていません。現在、テキストから動画への生成は、同じOpenAI形式の /v1/video/generations エンドポイントでGoogle Veo 3を通じて行います。エンドポイントはモデルに依存しないため、将来Soraに切り替える場合はmodelフィールドを1語変更するだけです。Soraへのアクセスはロードマップに含まれています。

Sora APIとは何ですか?

SoraはOpenAIのテキスト動画生成モデル(Sora 2およびSora 2 Pro)です。Sora APIは、テキストプロンプトまたは静止画から、Sora 2では同期音声付きの短い動画クリップを、コンシューマーアプリではなくプログラムから生成します。

Kunavoでの動画生成料金はいくらですか?

Veo 3は動画単位で課金され、Googleの表示価格より約50–70%安価です。720pの8秒クリップあたり、Veo 3 Liteは$0.18から、Veo 3 Fastは$0.36から、Veo 3 Qualityは$1.60からです。高解像度では料金が高くなります。

Kunavoは画像から動画への変換に対応していますか?

はい。静止画をアニメーション化するには、image_url(https-URLまたはアップロードしたファイル)を /v1/video/generations に渡します。制御されたトランジションのために、最初と最後のフレームを渡すこともできます。

生成にはどのくらい時間がかかりますか?

数分です。本番環境では非同期の/v1/videos-task APIを使用してポーリングしてください。動画ドキュメントをご覧ください。モデルごとの料金はGemini API料金ガイドにも掲載されています。

専用のキーが必要ですか?

いいえ。同じKunavoキーで動画、テキスト、画像を利用できます。キーの作成方法はGoogle Gemini APIキーの作成ガイドに記載されています。そこで作成したキーは/v1/video/generationsでそのまま使用できます。