Gemini 3はGoogleの現行モデルファミリーです。最上位にGemini 3 ProとGemini 3.1 Proがあり、Flash系列はGemini 3 FlashからGemini 3.8 Flashまで展開されています。ネイティブなマルチモーダル対応、1Mトークンのコンテキスト、思考の連鎖による推論を備えています。Kunavoでは現在、1つのOpenAI互換エンドポイントからGemini 3 APIを呼び出せます。Gemini 3.1 Proは1Mトークンあたり$0.70 / $4.20で、Googleの$2.00 / $12.00の定価より約65%低く、最新のFlashであるGemini 3.8 Flashは$0.525 / $2.625です。これは、GoogleがDecember 31, 2026まで3.x Flashに適用する導入価格$0.75 / $3.75より30%低い価格です。このガイドでは、各ティアの料金、稼働中のスラッグ、呼び出しコードを説明します。
gemini-3-1-proは1Mトークンあたり$0.70 / $4.20で、Googleの$2.00 / $12.00の定価よりおよそ65%低い料金です。Flashでは、gemini-3-8-flash($0.525 / $2.625)が最新、gemini-3-7-flash($0.525 / $2.625)が前のリリース、gemini-3-6-flash($1.05 / $5.25)も引き続き提供中です。ただし現在は両方より高く、Googleの自社導入価格よりも高くなっています。元のgemini-3-proとgemini-3-flashの2つのスラッグは予約済みで無効です。テストした上流ソースが、継続的な503エラーや壊れたパラメータ処理(あるソースはmaxOutputTokensを完全に無視)という理由で当社の信頼性基準を満たさなかったためです。スラッグを有効にするのは、ソースがこのテストに合格してからです。Gemini 2.5 Flashも同じエンドポイントで引き続き稼働しています。Gemini 3 APIの料金
Googleが設定するこのファミリーの公式料金と、Kunavoで各ティアにかかる料金を比較します。3.x FlashモデルについてGoogleはDecember 31, 2026まで導入価格を適用するため、表にはその料金(本日Googleから直接利用した場合に支払う料金)と、その後に適用される標準料金を併記しています。
| モデル | 入力 / 100万 | 出力 / 100万 | Kunavoでのステータス |
|---|---|---|---|
| Gemini 3 Pro(Googleリスト価格、≤200kコンテキスト) | $2.00 | $12.00 | 予約済み — 有効化されていません |
| KunavoでGemini 3.1 Pro | $0.70 | $4.20 | 稼働中(Googleリスト価格 $2.00 / $12.00) |
| Gemini 3 Flash(Googleリスト価格) | $0.50 | $3.00 | 予約済み — 有効化されていません |
| Gemini 3.6 / 3.7 / 3.8 Flash(Google導入価格、December 31, 2026まで) | $0.75 | $3.75 | Googleから直接利用;January 1, 2027以降の標準価格は$1.50 / $7.50 |
| KunavoでGemini 3.8 Flash — 最新 | $0.525 | $2.625 | 稼働中 — Googleの導入価格より30%低い |
| KunavoでGemini 3.7 Flash | $0.525 | $2.625 | 稼働中 — Googleの導入価格より30%低い |
| KunavoでGemini 3.6 Flash | $1.05 | $5.25 | 稼働中 — Googleの導入価格より40%高い;3.7または3.8 Flashを使用してください |
| KunavoでGemini 2.5 Flash | $0.09 | $0.75 | 利用可能 |
現在のすべてのGeminiモデルについて、Kunavoの料金とGoogleの料金、および計算例をGemini API料金ガイドで確認できます。
Gemini 3.8 Flash API:料金とGoogleの導入価格
Gemini 3.8 FlashはGoogleの最新Flashで、2026年9月2日にリリースされ、長期的なソフトウェアエンジニアリングとエージェント実行を対象としています。1,048,576トークンのコンテキストウィンドウと最大65,536出力トークンに対応します。KunavoではGemini 3.8 Flash APIは、1Mトークンあたり$0.525入力 / $2.625出力で、他のすべてのモデルと同じエンドポイントでgemini-3-8-flashとして呼び出します。
Googleは3.x Flashモデル(3.6、3.7、3.8 Flash)に対して、December 31, 2026まで1Mトークンあたり$0.75 / $3.75の導入価格を課し、January 1, 2027以降は標準価格$1.50 / $7.50を適用します。現在Googleが課している料金と比べ、KunavoのGemini 3.8 FlashとGemini 3.7 Flash($0.525 / $2.625)は30%安価です。Gemini 3.6 Flashはそうではありません。$1.05 / $5.25で、Googleの導入価格より40%高いため、使用すべきなのは3.7と3.8 Flashです。どちらもより新しく、より安価です。
Kunavoが追加するのは、Gemini、Claude、GPT、画像・動画モデルで共通利用できる1つのOpenAI互換キーと1つの前払い残高です。Google Cloudプロジェクトは不要で、失敗したリクエストには料金がかかりません。一方、専用キャパシティは提供しません。Kunavoは共有キャパシティであり、専用クォータも契約上のSLAもないため、どちらかが必要ならGoogleを直接利用してください。
Gemini 3.6 Flash — 変更点
Gemini 3.6 Flash(2026年7月21日リリース)は、当社が提供できた最初の3.x Flashで、このセクションの推論トークン測定の対象モデルです。Googleの標準料金は1Mトークンあたり$1.50入力 / $7.50出力です。標準料金ではGemini 3.5 Flashと入力価格が同じで、出力価格は約17%低くなっていますが、December 31, 2026まではGoogleが導入価格$0.75 / $3.75を適用します。Googleは長期的なエージェント作業向けとして訴求しており、複数ステップのエンジニアリングタスクでトークンコストを大幅に削減できると主張しています。
請求額を実際に決める数字は価格表にはありません。3.6 Flashはデフォルトで思考し、思考が出力メーターを大きく占めます。当社のテストでは、1文の事実回答を生成するために、およそ120~140推論トークンを消費し、目に見える出力は7トークンでした。推論トークンは出力料金で課金されるため、短い3.6 Flash回答の実コストは7ではなく150出力トークンに近く、単純な見積もりの約20倍です。実務上の影響は2つあります。
- 小さな
max_tokensを設定しないでください。 約150未満はモデルが回答を出す前に推論で消費され、思考分を支払ったまま切り truncated された断片を受け取ります。 - 目に見える出力ではなく、推論に予算を割り当ててください。短く大量に呼び出す場合、トークン単価が高くても、思考しないFlashティアの方が実際には安いことが通常です。
Gemini 3.6 FlashはKunavoで引き続き稼働中で、gemini-3-6-flashとして1Mトークンあたり$1.05 / $5.25です。ただしこれは、December 31, 2026までGoogleが課す$0.75 / $3.75より40%高く、Kunavoの新しいモデルの料金よりも高い価格です。新しい作業には、Googleの導入価格より30%低いgemini-3-8-flashまたはgemini-3-7-flashを$0.525 / $2.625で呼び出してください。これらも思考モデルなので、max_tokensにも十分な余裕を持たせてください。
今すぐKunavoでGeminiを呼び出す
KunavoはOpenAI互換の/v1/chat/completionsエンドポイントの背後でGeminiを提供します。OpenAI SDKをそのまま使い、base_urlを変更するだけで、Google Cloudプロジェクトは不要です。これはGemini 3.8 Flash APIを呼び出します。モデル文字列をgemini-3-7-flash、gemini-3-1-pro、またはgemini-2-5-flashに置き換えるだけで、他は何も変わりません。
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["KUNAVO_API_KEY"],
base_url="https://api.kunavo.com/v1",
)
# Gemini 3.8 Flash is Google's newest Flash. Mind the max_tokens: the 3.x Flash
# models think before they answer and reasoning bills as output, so a small
# cap can be spent thinking and return a truncated answer.
resp = client.chat.completions.create(
model="gemini-3-8-flash",
max_tokens=1024,
messages=[{"role": "user", "content": "Summarize this contract in 5 bullets."}],
)
print(resp.choices[0].message.content)キーの取得には1分ほどかかります。Gemini APIキーガイドを参照してください。同じsk-kn-キーでClaude、GPT、Nano Banana画像、Veo 3動画にもアクセスできます。
どのGeminiティアを呼び出すべきですか?
- 長いコンテキストと推論のワークロード —
gemini-3-1-proは入力$0.70 / 出力$4.20です。コーディング、エージェント、クロスモーダル分析向けのGoogleのフラッグシップティアであり、当社が提供するProティアです。 - ステップごとに推論するエージェント作業 —
gemini-3-8-flashは$0.525 / $2.625で、Googleの導入価格より30%低くなっています。プロンプトがそこで検証済みなら、同価格のgemini-3-7-flashも利用できます。Flashのレイテンシで推論します。予算は目に見える出力ではなく推論トークンに割り当ててください。 - 大量かつレイテンシに敏感な呼び出し —
gemini-2-5-flashは入力$0.09 / 出力$0.75で、依然としてコスト効率に優れています。デフォルトでは推論しないため、短い回答を安価に保てます。 - 価格面では3.6 Flashを選ばない —
gemini-3-6-flashは$1.05 / $5.25で、Kunavoの3.7および3.8 Flashよりも、またGoogle自身の導入価格よりも高くなっています。すでに検証済みのプロンプトに限って使用してください。 - 次のアップグレードに備える — OpenAI互換の形式に対してコードを書き、モデル文字列を設定として扱ってください。新しいGeminiスラッグも同じエンドポイントの背後に追加されます。
よくある質問
Gemini 3 APIとは何ですか?
Gemini 3はGoogleの現行モデルファミリーです。Gemini 3 Proと3.1 Pro、Gemini 3 Flash、新しいGemini 3.6、3.7、3.8 Flashが含まれ、100万トークンのコンテキストとChain-of-Thought推論を備えたネイティブマルチモーダルモデルです。Gemini 3 APIは、Google AI Studio / Vertex AIから直接、またはKunavoのようなOpenAI互換ゲートウェイを通じて、プログラムから呼び出す方法です。Kunavoでは現在、Gemini 3.1 Proと3.6、3.7、3.8 Flashモデルを提供しています。
現在、KunavoでGemini 3 APIを呼び出せますか?
はい。Gemini 3.1 Pro は gemini-3-1-pro として提供中で、100万トークンあたりの料金は入力 $0.70 / 出力 $4.20 です。Google の定価である入力 $2.00 / 出力 $12.00 より約 65% 安く、Pro ティアを利用するならこのモデルが推奨です。Flash では、Gemini 3.8 Flash(gemini-3-8-flash)が最新で、料金は入力 $0.525 / 出力 $2.625 です。Google が 2026年12月31日 まで 3.x Flash に適用する導入料金の入力 $0.75 / 出力 $3.75 より 30% 安くなっています。Gemini 3.7 Flash(gemini-3-7-flash)も同じ料金で、Gemini 3.6 Flash(gemini-3-6-flash)は引き続き入力 $1.05 / 出力 $5.25 で提供されており、Google の導入料金を上回っています。いずれも OpenAI 互換エンドポイントで利用でき、Google Cloud プロジェクトは不要です。元の gemini-3-pro と gemini-3-flash のスラッグは引き続き予約済みで、有効化されていません。これらについてテストした上流の提供元は、503 エラーの継続的な発生やパラメータ処理の不具合により、当社の信頼性基準を満たしていないためです。
Gemini 3 APIの料金はいくらですか?
Googleの公式定価は、Gemini 3 Proおよび3.1 Pro(コンテキスト最大200k)で入力100万トークンあたり$2.00、出力100万トークンあたり$12.00、Gemini 3 Flashでは$0.50 / $3.00です。Gemini 3.6、3.7、3.8 Flashについて、Googleは2026年12月31日まで導入価格$0.75 / $3.75を適用し、その後2027年1月1日から標準価格$1.50 / $7.50になります。Kunavoでは、Gemini 3.1 Proに対して$0.70 / $4.20(定価より約65%低い)、Gemini 3.8 FlashおよびGemini 3.7 Flashに対して$0.525 / $2.625(Googleの導入価格より30%低い)、Gemini 3.6 Flashに対して$1.05 / $5.25を支払います。これはGoogleの導入価格を上回ります。
Gemini 3 Flashはどれを使うべきですか?3.6、3.7、3.8のどれですか?
新しい作業にはGemini 3.8 Flash(gemini-3-8-flash)を使用してください。Googleの最新Flashモデルで、2026年9月2日にリリースされました。Kunavoでは100万トークンあたり$0.525 / $2.625で、Googleが現在請求する$0.75 / $3.75より30%低い価格です。Gemini 3.7 Flash(gemini-3-7-flash)は同じ価格で、このモデルですでに検証済みのプロンプトに適しています。Gemini 3.6 Flashは$1.05 / $5.25で、両方より高く、Google独自の導入価格より40%高いため、価格重視なら選ぶべきモデルではありません。
Gemini 3.6 Flash APIの料金はいくらですか?
Gemini 3.6 FlashのGoogle標準料金は、2027年1月1日以降、1M入力トークンあたり$1.50、1M出力トークンあたり$7.50です。2026年12月31日までは、Googleは導入価格として$0.75 / $3.75を請求します。Kunavoではgemini-3-6-flashが$1.05 / $5.25で、Googleの導入価格より40%高いため、どちらもより新しく、Kunavoで$0.525 / $2.625のGemini 3.8または3.7 Flashを選ぶ方が得です。料金表は実際のコストも過小評価しています。3.6 Flashはデフォルトで推論を行い、推論トークンには出力料金が適用されるためです。テストでは、1文の回答を生成するために、表示される出力トークン7個に対して約120~140個の推論トークンを消費しました。表示される出力ではなく推論トークンを基準に予算を設定し、回答が生成される前に推論予算が応答を使い切らないよう、max_tokensを約150未満にしないでください。
Gemini 3 APIキーはどう取得できますか?
直接キーを取得するならGoogle AI Studio、またはGemini 3.1 Pro、3.x Flashモデル、2.5 Flashを現在カバーするKunavoのキーを1つ使えます。さらにClaudeとGPTにも対応します。詳しくはキーガイドを参照してください。
Kunavoで稼働中のGemini 3モデルIDはどれですか?
gemini-3-8-flash(最新のFlash、1Mトークンあたり$0.525 / $2.625)、gemini-3-7-flash、gemini-3-6-flash、gemini-3-1-pro($0.70 / $4.20)がKunavoで稼働しています。元のgemini-3-proとgemini-3-flashのスラッグのみ、ソースが当社の信頼性基準を満たすまで予約状態のままです。