ガイド一覧へ戻る
比較·2026年9月14日·最終更新 2026年10月1日·読了8分

OpenAI APIの代替(2026年)— 2種類の切り替えと、維持されるサーフェス

この検索に出てくるまとめ記事はすべて「代わりにどのモデルを使うか」に答えています。しかし移行を決める問いは別です。コードの接続先を変えた後も、どのOpenAIサーフェスが使えるのか。Chat、ストリーミング、ツール呼び出しはbase_urlで移行できます。Assistants、Realtime、embeddingsは移行できません。

最終確認日:。

「OpenAI API の代替」は2種類の異なる差し替えであり、この検索結果のまとめ記事の多くはその一方にしか答えていません。 モデルを Claude、Gemini、オープンウェイトへ差し替えると、プロバイダー、アカウント、SDK、課金が変わります。エンドポイントを差し替える場合は、base_url と API キーを変更するだけでコードはそのままです。コピーされるのは OpenAI の通信形式だからです。まずどちらを差し替えるのかを決めてください。モデル一覧からは移行コストは分かりません。

一覧記事が省略している、移行を左右する質問は、どの OpenAI 機能が実際に移行後も使えるのかです。このページでは、答えが「いいえ」となる3つの行も含め、Kunavo について具体的に回答します。立場を明示すると、Kunavo は当社の製品です — OpenAI でも Anthropic でもない、独立した OpenAI 互換ゲートウェイです。料金と利用可能性の最終確認日:2026年10月1日。

3つのルートと、それぞれで必要になるコード変更

ルートコードで変わること次の場合に選択
別ベンダー独自の API新しい SDK、新しい認証、新しいリクエスト形式そのベンダーだけが提供する機能を含め、完全な機能範囲を使いたい場合
OpenAI 互換ゲートウェイbase_url とキー複数のアカウントを作らずに複数ベンダーのモデルを使いたい場合
セルフホスト型 OpenAI 互換サーバーbase_url とキーに加え、サーバーの運用が必要プロンプト本文を自分のインフラの外に出せない場合

プロバイダー独自の互換エンドポイントは、より限定された4つ目の選択肢です。Google は Gemini API 用の OpenAI 互換レイヤーを公開しています。これは1つのベンダーのモデルに限定された、同じ base_url の差し替えです。

エンドポイントの完全な差し替え

swap.py
# The whole migration, when you swap the endpoint rather than the model.
from openai import OpenAI

client = OpenAI(
    api_key="sk-kn-...",                      # was sk-proj-...
    base_url="https://api.kunavo.com/v1",     # the only other line that moves
)

# Same SDK, same call shape, same streaming, same tool-call format.
resp = client.chat.completions.create(
    model="claude-sonnet-5",                  # now reachable on the same key
    messages=[{"role": "user", "content": "Summarise this changelog."}],
    stream=True,
)

どの OpenAI 機能が差し替え後も使えるか

移行前に中央の列を読んでください。「ルートのみ」は通信形式が実装されているものの、その背後でモデルが有効化されていないことを意味します。そのため呼び出しは失敗します。これは未実装のルートよりも予想外の問題になりやすく、この行が省略されずに存在する理由でもあります。

OpenAI の機能Kunavoでの状況内容 / 注記
/v1/chat/completionsはいChat, streaming, tool calls — The one almost every migration is about.
/v1/responsesはいThe Responses API — Implemented — this is what Codex CLI speaks.
/v1/modelsはいList what you can call — Always the authority on availability.
/v1/images/generationsはいテキストから画像へ
/v1/images/editsはいImage editing — Prompt-directed; no mask inpainting.
/v1/embeddingsルートのみEmbeddings — Route exists, no model enabled — embed against OpenAI, Voyage or Cohere directly.
/v1/audio/speechルートのみText to speech — Route exists, no model enabled.
/v1/audio/transcriptionsルートのみSpeech to text — Route exists, no model enabled.
/v1/filesはいUpload a source image — For image edits and image-to-video.
Assistants, Threads, Vector StoresいいえOpenAI's hosted agent state — Not implemented. Keep that state in your own app.
RealtimeいいえRealtime voice sessions — Not implemented.
Batch, Fine-tuning, Moderationsいいえ未実装です。

3 行ある「ルートのみ」の行を前提に計画してください。RAG パイプラインが典型例です。埋め込みは埋め込みプロバイダーに直接送り、生成はゲートウェイに送ります。どちらにせよ2つは別の HTTP 呼び出しなので、必要なのは2つ目のアーキテクチャではなく2つ目のキーです。現在何を呼び出せるかについては、常に GET /v1/models を確かな情報源として確認してください。

トークン単位で見た差し替えコスト

2026年9月時点で Kunavo 上の同条件を比較すると、 Anthropicの$3.00 / $15.00に対してClaude Sonnet 4.6 は100万トークンあたり入力 $2.10 / 出力 $10.50、 OpenAIが現在請求しているプロモーション価格 $4.00 / $20.00 に対して(リスト価格 $5.00 / $30.00;プロモーションは少なくとも2026年11月21日まで)GPT-5.6 Sol は $2.00 / $12.00 です。OpenAI 側については、当社の情報をそのまま信じるのではなく、OpenAI の料金ページで確認してください。通常、請求額をプロバイダーの選択以上に左右するのはプロンプトキャッシュです。エージェントは毎ターン大きなシステムプロンプトを再送するため、キャッシュされていない入力が支配的になります。

Kunavo ではないもの

OpenAI ではなく、OpenAI のホスト型エージェント基盤を安価な場所で利用する方法でもありません — Assistants、Threads、Vector Stores、Realtime、Batch、fine-tuning、moderations は実装されていません。これらを基盤にしたアプリは、base_url を変更するだけでは移行できません。また、オープンウェイトのホスティングでもありません。Llama や Qwen を自分のハードウェアで使いたい場合は、セルフホスト型 OpenAI 互換サーバーが適したルートであり、これは該当しません。さらに、上の表にあるとおり、embeddings プロバイダーでもありません。

周辺の比較については、OpenRouter の代替、4種類の LLM ゲートウェイ、正確なリクエスト形式とレスポンス形式についてはチャットエンドポイントのリファレンスをご覧ください。

よくある質問

OpenAI API に代わる最適な選択肢は何ですか?

どの部分を置き換えるかによって異なります。この検索結果のまとめ記事は、主に2種類のどちらかに答えています。別のモデルが欲しい場合、候補は Anthropic の Claude、Google の Gemini、そして推論プロバイダーが提供するオープンウェイトのモデルファミリーです。既存の OpenAI コードを維持して接続先だけ変えたい場合、候補は異なります。Kunavo や OpenRouter のような OpenAI 互換ゲートウェイ、Google のようなプロバイダー独自の互換エンドポイント、または Ollama や vLLM のようなセルフホスト型 OpenAI 互換サーバーです。後者の変更に必要なのは base_url とキーですが、前者では SDK の移行が必要になる場合があります。

OpenAI API に無料の代替手段はありますか?

ホスト型プロバイダーからの本番トラフィック向けにはありません。推論には実際の GPU 時間が必要で、無制限に無料で提供する事業者はありません。本当に無料の方法は、すでに料金を支払っているハードウェア上でオープンウェイトをセルフホストすることです(Ollama と vLLM はどちらも OpenAI 互換エンドポイントを公開するため、コード変更は同じ base_url の差し替えです)。また、一部のプロバイダーが厳しい日次上限付きで提供する無料枠もあります。「無制限無料」と宣伝される OpenAI 互換 API については、実際に何をプロキシし、プロンプトをどう扱うのかを確認してください。

OpenAI と Anthropic では、どちらの API が安いですか?

どちらが一律に安いわけでもありません。利用するティアと、入力のどれだけが繰り返されるかによって異なります。2026年9月時点で Kunavo 上の同条件を比較すると、Claude Sonnet 4.6 は100万トークンあたり入力 $2.10 / 出力 $10.50、GPT-5.6 Sol は $2.00 / $12.00 です。通常、請求額をプロバイダーの選択以上に左右するのはプロンプトキャッシュです。エージェントは毎ターン大きなシステムプロンプトを再送し、両方のモデルファミリーでキャッシュ済み入力は新規入力の一部の料金で課金されるためです。

コードを変更せずに OpenAI API を切り替えられますか?

ほとんどの場合可能ですが、例外についてはこのページの互換性表を確認してください。アプリがチャット補完、ストリーミング、ツール呼び出し、Responses API を使用している場合、OpenAI 互換ゲートウェイでは base_url と API キーを変更するだけで、SDK、リクエスト形式、レスポンス形式は維持されます。移行できないのは、OpenAI のホスト型エージェント状態(Assistants、Threads、Vector Stores)、Realtime API、Batch、fine-tuning、moderations で、Kunavo はこれらを実装していません。差し替えだけで移行できると考える前に、コードが呼び出す具体的な機能を確認してください。

OpenAI 互換ゲートウェイは embeddings に対応していますか?

自動的に対応するわけではありません。最も欠落しやすい機能なので、移行後ではなく移行前に確認してください。Kunavo では、/v1/embeddings の通信形式は実装されていますが、その背後で有効化されたモデルはありません。そのため呼び出しは失敗し、RAG パイプラインの埋め込み処理は OpenAI、Voyage、または Cohere に直接送る必要があります。埋め込み呼び出しと生成呼び出しはどちらにせよ別のリクエストなので、追加で必要なのは2つ目の API キーだけです。実際に何を呼び出せるかについては、常に GET /v1/models を確かな情報源として確認してください。

OpenAI 互換 API は OpenAI と同じものですか?

いいえ。OpenAI 互換 API は通信形式、つまり URL の形式、リクエスト本文、レスポンス本文をコピーするため、既存のクライアントから接続できます。しかし OpenAI が運営しているわけではなく、必ずしも OpenAI のモデルを提供するわけでもありません。データ保持、レート制限、実装する機能についても独自に決定します。Kunavo は独立したゲートウェイであり、OpenAI でも Anthropic でもありません。そのため、上の表では動作するものだけでなく、動作しないものも示しています。