OpenAI APIは月額ではなく、トークン単位で課金されます。 入力トークンと出力トークンには別々の料金が設定されており、出力のほうが高額です。Kunavoでは、1Mトークンあたりの料金は、GPT-6 Lunaの$0,04 / $0,20から、OpenAIの最新フラッグシップであるGPT-6 Astraの$4,00 / $20,00までです。その間に、GPT-6 Sol($0,80 / $4,00)や、主力モデルのGPT-5.6 Terra($0,70 / $4,20)があります — モデルに応じてOpenAIのリスト価格より60–65%安い。ChatGPTのサブスクリプションは別物です。API利用は含まれず、APIの利用にサブスクリプションも必要ありません。
料金の基準日:2026年10月3日。 Kunavoの料金はモデルカタログからリアルタイムで読み込まれます。ここに表示されている内容が、APIで請求される料金です。「OpenAI公式料金」列には、同じモデルについてOpenAIが公開している価格を表示しています。出典はopenai.com/api/pricingです。
ChatGPTサブスクリプションとOpenAI API:2つの製品、2つの請求
「ChatGPT APIの料金」で検索する人が最初に知りたいのは、既存のChatGPTサブスクリプションでAPIも利用できるのか、ということがよくあります。答えは、いいえです。
| 利用するもの | 課金方法 | 対象者 |
|---|---|---|
| ChatGPT(Free、Plus、Proなど) | プランの利用上限に基づく月額定額 | チャット画面で作業する人 |
| OpenAI API(キー+残高) | トークン単位、月額料金なし | 独自ソフトウェア、自動化、エージェント |
サブスクリプションにはAPIキーもAPI残高も含まれず、APIの請求額が1セントも安くなることはありません。逆に、API残高によってChatGPTの利用枠が増えることもありません。サブスクリプションの価格はOpenAIがopenai.com/chatgpt/pricingで案内しています。価格は頻繁に変わるため、ここには記載していません。このページではAPI、つまりトークン単位で課金される部分だけを扱います。
モデル別OpenAI API料金
Kunavoが請求する、100万トークンあたりの米ドル料金。「OpenAI公式料金」列は、同じモデルの公開価格です。
| モデル | 入力 / 100万 | 出力 / 100万 | OpenAI の一覧(入力 / 出力) | 節約額 |
|---|---|---|---|---|
gpt-6-astra | $4,00 | $20,00 | $10,00 / $50,00 | ~60% |
gpt-5-6-sol | $2,00 | $12,00 | $5,00 / $30,00 特別価格 $4,00 / $20,00(少なくとも2026年11月21日まで) | ~60% プロモーション価格より約40%安い |
gpt-5-5 | $2,00 | $12,00 | $5,00 / $30,00 | ~60% |
gpt-5-6-terra | $0,70 | $4,20 | $2,00 / $12,00 | ~65% |
gpt-6-sol | $0,80 | $4,00 | $2,00 / $10,00 | ~60% |
gpt-6-luna | $0,04 | $0,20 | $0,10 / $0,50 | ~60% |
現在の料金は常に料金ページと各モデルページ、たとえばGPT-6 Astra、GPT-6 Sol、GPT-6 Lunaに掲載されています。用途別のモデル:
gpt-6-astra— OpenAIの最新フラッグシップ(2026年9月3日以降)。最高水準の推論と、長時間のエージェント型コーディングに対応します。難しい少数のタスク向けです。gpt-6-sol— 2026年9月22日以降。OpenAIは複雑なコーディングとエージェント型ワークフロー向けに位置付けています。Kunavoでは$0,80 / $4,00で、出力料金はGPT-5.6 Terraより安いですが、入力料金は同モデルの入力料金をやや上回ります。コーディングとエージェントの標準モデルとして適しています。gpt-6-luna— 2026年9月22日以降。OpenAIによれば、分類や抽出など、範囲が明確で大量に処理するタスクに最も効率的なモデルです。$0,04 / $0,20で、Kunavoでは最も低価格な層です。gpt-5-6-sol— 第5.6世代の最上位推論とエージェント型コーディング。すでにこのモデル向けに調整されたプロンプトに適しています。gpt-5-6-terra— 5.6ファミリーの主力モデル。RAG、アシスタント、分類、抽出、その他ほとんどの本番タスクに対応します。gpt-5-5— 前世代のフラッグシップ。GPT-5.6 SolはKunavoで同じ料金($2,00 / $12,00)です。現在もgpt-5-5を使用している場合は、モデル名を変更するだけで、トークンあたりの追加料金なしに新しい世代へ移行できます。
GPT-6 SolとGPT-6 Luna。 2026年9月22日、OpenAIはGPT-6ファミリーに2つのモデルを追加しました。これらは、GPT-6 Astraの背後にある進歩を基盤にしているとOpenAI自身が説明しています。OpenAIの掲載価格は、GPT-6 Solが$2,00 / $10,00、GPT-6 Lunaが$0,10 / $0,50(いずれも1Mトークンあたり)です。Kunavoではそれぞれ$0,80 / $4,00、$0,04 / $0,20です。どちらも1.050.000トークンのコンテキストウィンドウを備え、最大128.000出力トークンを生成できます。
GPT-6 Astraにかかる追加費用。 GPT-6 Astraの料金は、GPT-6 Solと比べて入力も出力も5倍、GPT-5.6 Solと比べて入力は2倍、出力は1,7倍です。率直な推奨は、コーディングとエージェントの標準にGPT-6 Sol、大量処理にGPT-6 Lunaを使い、同じ入力での比較によりSolでは不十分だと分かった場合にだけAstraを使うことです。リクエスト内で変更するのはモデル名という1語だけなので、テストは安価です。
非常に長いリクエストには追加料金。 プロンプトトークンが272,000を超えると、GPT-5.5、GPT-5.6ファミリー、および3つのGPT-6モデル(Astra、Sol、Luna)は、リクエスト全体に対して入力料金の2倍、出力料金の1.5倍で課金します。コードベース全体や長い文書を1回の呼び出しに含める場合は、このしきい値に注意してください。モデル選択より大きな影響が出る可能性があります。
リクエストの実際の料金
Kunavoの料金で計算しています。キャッシュと推論トークンを含まないため、請求額の下限です。
| タスク | トークン(入力 / 出力) | GPT-6 Luna | GPT-5.6 Terra | GPT-6 Sol | GPT-5.6 Sol | GPT-6 Astra |
|---|---|---|---|---|---|---|
| 短いチャットラウンド | 1.000 / 300 | $0,0001 | $0,00196 | $0,002 | $0,0056 | $0,01 |
| RAG-Antwort | 6.000 / 500 | $0,00034 | $0,0063 | $0,0068 | $0,018 | $0,034 |
| エージェント型コーディングステップ | 25.000 / 1.200 | $0,00124 | $0,0225 | $0,0248 | $0,0644 | $0,124 |
| 高度な推論タスク | 20.000 / 3.000 | $0,0014 | $0,0266 | $0,028 | $0,076 | $0,14 |
| バッチ:100,000件の分類 | 1回あたり500 / 20 | $2,40 | $43,40 | $48,00 | $124,00 | $240,00 |
$10の最低チャージ額で、1.590では約GPT-5.6 Terra回のRAG回答、GPT-6 Lunaでは約29.400回実行できます。 GPT-6 LunaとGPT-6 Astraでは、出力料金に約100倍の差があります。単純なタスクでは、モデル選択が最も大きな単一のレバーです。自分の数値で再計算するには:
# OpenAI-Tarife auf Kunavo (USD pro 1M Tokens): (Input, Output)
RATES = {
"gpt-6-astra": (4, 20),
"gpt-5-6-sol": (2, 12),
"gpt-5-5": (2, 12),
"gpt-5-6-terra": (0.7, 4.2),
"gpt-6-sol": (0.8, 4),
"gpt-6-luna": (0.04, 0.2),
}
def kosten(model: str, frisch: int, output: int, cache_treffer: int = 0) -> float:
"""frisch = nicht gecachter Input; output schließt Reasoning-Tokens ein."""
i, o = RATES[model]
return (
frisch / 1_000_000 * i
+ output / 1_000_000 * o
+ cache_treffer / 1_000_000 * i * 0.10 # Cache-Treffer: 10 % des Input-Tarifs
)
print(kosten("gpt-5-6-terra", 1_000, 300)) # kurze Chat-Runde
print(kosten("gpt-5-6-terra", 6_000, 500)) # RAG-Antwort
print(kosten("gpt-5-6-sol", 25_000, 1_200)) # agentischer Coding-Schritt
print(kosten("gpt-6-sol", 25_000, 1_200)) # derselbe Schritt auf GPT-6 Sol
print(kosten("gpt-6-astra", 20_000, 3_000)) # schwere Reasoning-Aufgabe
print(kosten("gpt-6-luna", 500, 20)) # eine Klassifizierung
# Ein Monat auf Sol: 3 Mio. frische und 12 Mio. gecachte Input-Tokens,
# 1 Mio. Output-Tokens (Cache-Writes nicht eingerechnet)
print(kosten("gpt-5-6-sol", 3_000_000, 1_000_000, cache_treffer=12_000_000))どの見積もりでも見落とされる2つのコストの落とし穴
1つ目:推論トークン。 GPT-6 AstraやGPT-5.6 Solなどの推論モデルは、回答前に内部トークンで思考します。回答本文には表示されませんが、出力料金で課金されます。このページの計算例には含めていないため、難しいタスクでは実際の請求額はそれより高くなります。実際の数は各回答のusage(completion_tokens_details.reasoning_tokens)に記載されています。
2つ目:繰り返し。 正常に返ってきた回答をコード側で破棄した場合(形式が誤っていた、再試行したなど)も、料金は発生しています。エージェントでは、目に見える1つのタスクが、課金対象となる12回の実行になることがよくあります。ここで見積もりと請求額の差が最も大きくなります。Kunavo側で失敗したリクエストには課金されません。
プロンプトキャッシュ
アプリケーションが毎回同じ長いシステムプロンプトや同じ文書を送信する場合、キャッシュヒットは入力料金の10%で課金されます。GPT-5.6 Solでは、1Mトークンあたり$0,20で、$2,00ではありません。Kunavoでは、GPT-5.6 Sol、Terra、GPT-6 Astraへのキャッシュ書き込みは入力料金の1.25倍、GPT-5.5では通常の入力料金です。キャッシュを利用する方法はキャッシュドキュメントに記載されています。
既存のOpenAIコードを移行する
KunavoはOpenAI互換です。変更するのはbase_urlとキーだけで、それ以外は何も変更する必要がありません。chat.completionsとresponsesはそのまま使用でき、レスポンスには通常どおりusageフィールドが含まれるため、すべての請求を確認できます。
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1", # statt api.openai.com
)
resp = client.chat.completions.create(
model="gpt-5-6-terra",
messages=[{"role": "user", "content": "Fasse diese Rechnung in drei Sätzen zusammen."}],
)
print(resp.choices[0].message.content)
print(resp.usage) # Input-, Output- und Reasoning-Tokens: die Grundlage der Abrechnungキー(sk-kn-…)は、登録後にダッシュボードで作成します。そこではキーごとに月間支出上限とIP許可リストも設定できます。上限に達すると、そのキーは402を返します。手順はクイックスタートに記載されています。
ドイツからOpenAI APIの料金を支払う
KunavoはStripeを通じて、プリペイド残高として請求します。サブスクリプションやOpenAI Platformアカウントの設定は必要ありません。チェックアウトでは次を選べます。
- カード:Visa、Mastercard、American Express、JCB、UnionPay。VisaとMastercardのデビットカードはクレジットカードと同様に利用できます。
- Apple Pay、Google Pay、Link
SEPAダイレクトデビットは現在ご利用いただけません。 チャージ額は米ドルで表示されますが、Stripeのチェックアウトではお客様の通貨で表示されます。最低チャージ額は$10です。チャージ額が大きいほどボーナス残高が付与され、$100は$110.00、$1,000は$1,200.00、$5,000は$6,250.00になります。残高に有効期限はなく、失敗したリクエストには課金されません。詳細は請求に関するドキュメントをご覧ください。
率直に言うと:OpenAIを直接利用したほうがよい場合
Kunavoは共有キャパシティを使用するゲートウェイです。アカウント専用の割り当ても、契約上のSLAもありません。製品の可用性を保証する必要があるなど、確実な割り当てやSLAが必要な場合は、OpenAIを直接利用してください。このページは、そのケースを対象とするものではありません。
また、チャット画面で一日中作業する人にとっては、ChatGPTサブスクリプションのほうが安価な選択になることが多いです。計算は単純です。サブスクリプション価格 ÷ チャット1回の料金 = 損益分岐点。入力2,000トークンと出力700トークンの1回のチャットは、GPT-5.6 Solで約$0,0124、GPT-5.6 Terraで約$0,00434です。この計算結果を上回る回数を毎月利用し、なおかつプランの上限内に収まるなら、サブスクリプションのほうが有利です。APIは、ソフトウェア、自動化、利用量が変動するケースで有利です。利用の少ない月に料金が発生しないことが重要な場合です。
OpenAI APIの料金を下げる方法 — この順番で
- タスクに合ったモデルを選ぶ。 最大モデルを標準設定のままにすることが、予想外の請求の最も一般的な原因です。分類、抽出、その他の大量処理には
gpt-6-luna、コーディングとエージェントにはgpt-6-sol、難しい少数のタスクにはAstraを使います。 - 出力を制限する。 出力は入力の何倍もの料金がかかり、推論も出力に含まれます。そのため、
max_tokensに上限を設定すると二重の効果があります。 - プロンプトキャッシュを使う。 長く安定したシステムプロンプトは、キャッシュヒット時には入力料金の10分の1です。
- 送信するコンテキストを減らす。 知識ベースの半分を送るのではなく、少数の正確なRAGセクションを使い、可能な限り272,000トークンのしきい値未満に抑えます。
自分の数値で再計算するには、OpenAI API料金計算ツールがキャッシュ済み入力と推論トークンを含めて計算します。トークン計算ツールではClaudeとGPTを並べて比較できます。Anthropic向けの対応ページはClaude料金です。コストではなく上限が問題なら、OpenAI APIレート制限(英語)をご覧ください。
よくある質問
OpenAI APIの料金はいくらですか?
OpenAI APIは月額料金なしでトークンごとに課金されます。入力トークンと出力トークンには別々の料金が設定され、出力の方が高額です。Kunavoでは、GPT-5.6は1Mトークンあたり(入力 / 出力)Terra $0,70 / $4,20、GPT-5.6はSol $2,00 / $12,00、OpenAIの最新フラッグシップGPT-6はAstra $4,00 / $20,00です。同じモデルのOpenAI公開料金:$2,00 / $12,00、$5,00 / $30,00、$10,00 / $50,00;GPT-5.6 Solについて、OpenAIは現在プロモーション価格 $4,00 / $20,00 を請求しており、料金ページによると少なくとも2026年11月21日までです。基準日:2026年10月3日。
APIはChatGPTのサブスクリプションに含まれますか?
いいえ。PlusやProなどのChatGPTサブスクリプションは、ブラウザー、アプリ、デスクトップでのChatGPT利用そのものに対する料金です。APIキーもAPI残高も含まれず、API請求額が1セントも安くなることはありません。自分のソフトウェアからGPTを呼び出すにはAPIキーが必要で、サブスクリプションとは別にトークンごとに支払います。逆に、API残高がChatGPTの利用上限を増やすこともありません。
ChatGPT APIへのリクエストはいくらですか?
一般に「ChatGPT API」と呼ばれているものはGPTモデルを使うOpenAI APIであり、各リクエストはトークン単位で課金されます。Kunavoの料金では、入力6,000トークンと出力500トークンのRAG回答はGPT-5.6 Terraで約$0,0063、入力25,000 / 出力1,200トークンのエージェント型コーディングステップはGPT-5.6 Solで約$0,0644、入力20,000 / 出力3,000トークンの高度なタスクはGPT-6 Astraで約$0,14です。推論トークンは出力料金に加算されます。
OpenAI APIを無料で試せますか?
Kunavoは開始時の無料クレジットを提供していませんが、月額料金も最低契約期間もありません。最小の開始額は最低チャージ額の$10で、GPT-5.6 Terraを使ったRAG回答を約1.590件実行できます。残高は失効せず、呼び出しをしない月は費用がかからず、失敗したリクエストにも課金されません。
推論トークンはどのように課金されますか?
出力料金です。GPT-6 AstraやGPT-5.6 Solのような推論モデルは、回答前に内部トークンで思考します。これらは回答本文には表示されませんが、請求には含まれます。実際の数は、各回答のusageフィールド(completion_tokens_details.reasoning_tokens)で確認できます。難しいタスクでは、実際の請求額が見積もりを上回る最も一般的な理由がこれです。max_tokensの上限が推論トークン数も制限します。
GPT-6 Astraの料金はいくらですか?
GPT-6 Astraは2026年9月3日以来、OpenAIの最新フラッグシップモデルです。OpenAIの公開料金は100万トークンあたり$10,00 / $50,00です。Kunavoでは$4,00 / $20,00です。公開料金との比較では、公開料金より約60%低い水準。GPT-5.6 Solと比べると、入力では2倍、出力では1,7倍です。そのためAstraは、Solでは不十分だと実証された少数の難しいタスクに適しています。プロンプトトークンが272,000を超える場合、Astraでもリクエスト全体に入力2倍、出力1.5倍の料金が適用されます。
GPT-6 SolとGPT-6 Lunaの料金はいくらですか?
OpenAIは2026年9月22日にGPT-6 SolとGPT-6 Lunaを公開しました。Solは複雑なコーディングとエージェントワークフロー向け、LunaはOpenAIの言葉によれば、対象が明確なタスクを大量に処理するための最も効率的なモデルです。OpenAIは1Mトークンあたり、Solを$2,00 / $10,00、Lunaを$0,10 / $0,50(入力 / 出力)で掲載しています。Kunavoではそれぞれ$0,80 / $4,00、$0,04 / です$0,20, beide rund 60% darunter。したがってGPT-6 LunaがKunavoで最も安いGPTモデルです。GPT-5.5、GPT-5.6ファミリー、GPT-6 Astraと同様、プロンプトトークンが272,000を超えるリクエスト全体には、入力2倍、出力1.5倍の料金が適用されます。
ドイツからSEPAダイレクトデビットで支払えますか?
いいえ。SEPA 口座振替は現在提供されていません。Stripe のチェックアウトでは、カード(Visa、Mastercard、American Express、JCB、UnionPay)、Apple Pay、Google Pay、Link を選択できます。Visa または Mastercard のデビットカードはクレジットカードと同じように機能します。サブスクリプションなしのプリペイド残高で、最低チャージ額は $10 です。有効期限はありません。
既存のOpenAIコードはKunavoで動きますか?
はい。KunavoはOpenAI互換です。base_urlをhttps://api.kunavo.com/v1に設定し、キーをKunavoキー(sk-kn-…)に置き換えるだけで、chat.completionsとresponsesの形式は変わりません。モデル名はgpt-6-astra, gpt-5-6-sol, gpt-5-5, gpt-5-6-terra, gpt-6-solとgpt-6-lunaです。同じキーでClaude、画像モデル、動画モデルも呼び出せます。