これは、2026年9月時点のGoogle Gemini API料金です。単位は100万トークンあたりで、Googleの公式料金と、同じモデルをKunavoで利用した場合の料金を並べています。Gemini 3.8 Flash(Googleの最新Flash)は、Kunavoでは入力$0.525 / 出力$2.625で、GoogleがDecember 31, 2026まで3.x Flashモデルに適用する導入価格$0.75 / $3.75より30%安くなっています。標準価格$1.50 / $7.50はJanuary 1, 2027から適用されます。Gemini 3.1 Proは、Googleの$2.00 / $12.00の定価に対して$0.70 / $4.20、Gemini 2.5 Flashは$0.30 / $2.50に対して$0.09 / $0.75です。約65%および70%安く、すべて1つのOpenAI互換APIで利用できます。
最終確認日:2026年9月12日。以下のKunavoのトークン単価はモデルカタログからリアルタイムで取得されます。「Google定価」列にはGoogleが公開している料金が反映されます。公式情報源はai.google.dev/gemini-api/docs/pricingです。
Google公式料金表とKunavoの比較 — 2026年9月
ここに記載するGemini API料金はすべて、Kunavoで請求される米ドル建ての100万トークンあたりの料金です。「Google定価」列は同じモデルに対するGoogleの公式公開料金で、上記の確認日にai.google.devから取得したものです。つまり、この表では公式料金と割引料金を1つの画面で確認できます。Gemini 3.x Flashモデルについては、同列にGoogleが現在適用している導入価格を示し、「節約額」はその価格を基準に算出しています。
| モデル | 入力 / 100万 | 出力 / 100万 | Google定価(入力 / 出力) | 節約額 |
|---|---|---|---|---|
gemini-3-8-flash | $0.525 | $2.625 | $0.75 / $3.75(導入価格*) | 導入価格*比30% |
gemini-3-7-flash | $0.525 | $2.625 | $0.75 / $3.75(導入価格*) | 導入価格*比30% |
gemini-3-1-pro | $0.70 | $4.20 | $2.00 / $12.00 | ~65% |
gemini-2-5-flash | $0.09 | $0.75 | $0.30 / $2.50 | ~70% |
gemini-3-6-flash | $1.05 | $5.25 | $0.75 / $3.75(導入価格*) | なし — 導入価格*より40%高い |
*GoogleがDecember 31, 2026経由で3.x Flashモデルに適用する導入価格。標準価格$1.50 / $7.50はJanuary 1, 2027から適用されます。
Gemini 3.8 Flashは新規開発に利用すべきFlash、Gemini 2.5 Flashは大量処理で最も安価な選択肢、Proはより難しい推論、画像処理、長いコンテキストを扱うジョブ向けです。最新料金は常に料金ページと各モデルページ(gemini-3-8-flash、gemini-3-7-flash、gemini-3-1-pro、gemini-2-5-flash、gemini-3-6-flash)に掲載されています。
Gemini 3.8 Flashの料金とGoogleの導入価格
GoogleはGemini 3.x Flashモデル(3.6、3.7、3.8 Flash)に対し、December 31, 2026まで、導入価格として100万トークンあたり入力$0.75 / 出力$3.75を適用し、January 1, 2027から標準価格$1.50 / $7.50を適用します。Kunavoでは、100万トークンあたりGemini 3.8 Flashを$0.525 / $2.625、Gemini 3.7 Flashを$0.525 / $2.625で提供しており、現在Googleの導入価格より30%安くなっています。Gemini 3.6 Flashだけは例外で、$1.05 / $5.25のため、Googleの現在の料金より40%高くなります。したがって、利用すべきなのは3.7 Flashと3.8 Flashです。どちらも新しく、より安価です。
| モデル | Kunavo(入力 / 出力) | 現在のGoogle — December 31, 2026まで導入価格 | January 1, 2027以降のGoogle | 現在のKunavoとGoogleの比較 |
|---|---|---|---|---|
| Gemini 3.8 Flash | $0.525 / $2.625 | $0.75 / $3.75 | $1.50 / $7.50 | 30%安い |
| Gemini 3.7 Flash | $0.525 / $2.625 | $0.75 / $3.75 | $1.50 / $7.50 | 30%安い |
| Gemini 3.6 Flash | $1.05 / $5.25 | $0.75 / $3.75 | $1.50 / $7.50 | 40%高い |
30%の差は実際に存在しますが、Google自身が2027年まで3.x Flashを割引しているため、Gemini 3.1 ProやGemini 2.5 Flashの場合より小さな差です。思い込みで判断せず、比較してください。Kunavoでは、Gemini、Claude、GPT、画像・動画モデルを、1つのOpenAI互換キーと1つの前払いStripe残高で利用でき、Google Cloudプロジェクトは必要ありません。一方、専用キャパシティは提供されません。Kunavoは共有キャパシティであり、専用クォータも契約上のSLAもありません。保証されたクォータやSLAが必要な場合は、Googleから直接購入してください。
Gemini Flash APIの料金では、出力に注意してください。3.x Flashモデルは思考モデルであり、回答前に行う推論も出力トークンとして請求されます。max_tokensには余裕を持たせ、推論を含む出力を基準に予算を組んでください。Gemini 3 APIガイドには3.6 Flashの測定済み推論トークン数と、gemini-3-8-flashを呼び出すコードが掲載されています。
Gemini APIのトークン単位の料金の仕組み
料金は入力トークン(送信するすべての内容。システムプロンプト、取得したコンテキスト、ユーザーメッセージ)と、出力トークン(モデルが生成する内容)に対して発生します。出力の方が高価なので、Geminiの請求額に最も大きく影響するのは、モデルにどれだけ文章を書かせるかです。画像と音声はトークン相当量に変換され、同じメーターで請求されます。
コスト計算例
KunavoのGemini 2.5 Flash料金を使用した実際の数値です。ただし最後の2行はGemini 3.8 FlashとGemini 3.1 Proを使用しています。
| ワークロード | トークン(入力 / 出力) | モデル | コスト |
|---|---|---|---|
| チャットボットの1ターン | 1,000 / 300 | 2.5 Flash | $0.0003 |
| RAG回答 | 8,000 / 500 | 2.5 Flash | $0.0011 |
| バッチ分類(文書あたり) | 500 / 20 | 2.5 Flash | $0.00006 |
| エージェントのステップ(推論を含む出力) | 10,000 / 1,500 | 3.8 Flash | $0.0092(Google導入価格:$0.0131) |
| 長いコンテキストの分析 | 20,000 / 2,000 | Pro | $0.0224 |
この料金では、2.5 Flashによる10万文書の分類バッチは約$6、チャットボットの100万ターンは約$315です。計算式は実行可能な形で次のとおりです。
# Kunavo Gemini 2.5 Flash rates (USD per 1M tokens)
IN_RATE, OUT_RATE = 0.09, 0.75
def cost(in_tokens: int, out_tokens: int) -> float:
return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE
print(cost(1_000, 300)) # one chatbot turn -> $0.000315
print(cost(8_000, 500)) # one RAG answer -> $0.001095
print(cost(500, 20) * 100_000) # 100k-doc batch -> ~$6.00Kunavoの料金とStripe請求
サブスクリプションはなく、Google Cloudプロジェクトも必要ありません。残高をチャージし(Stripeまたは現地の決済方法)、呼び出し時に上記のトークン単価で残高から差し引かれます。$10の最低チャージ額から従量課金で利用でき、残高に有効期限はなく、高額のチャージにはボーナスクレジットが付与されます。失敗したリクエストには一切請求されません。1つの残高でGeminiのほか、Claude、GPT、画像、動画、音声などすべてのモデルを利用できるため、プロバイダーごとに別の請求書を照合する必要はありません。
どのGeminiモデルを選ぶべきですか?
- gemini-3-8-flash — Googleの最新Flash。2026年9月2日にリリースされ、Flashのレイテンシでエージェント処理、コーディング、その他の推論負荷の高い作業に対応します。100万トークンあたり$0.525 / $2.625で、Googleの導入価格より30%安価です。
- gemini-3-7-flash — 以前のFlashリリース(2026年8月13日)で、$0.525 / $2.625です。プロンプトの検証がすでに済んでいる場合は、そのまま使用してください。
- gemini-2-5-flash — チャット、抽出、分類、要約、ほとんどのRAG処理のデフォルトです。高速で、十分な性能を備えた選択肢の中で最も安価で、料金は$0.09 / $0.75です。
- gemini-3-1-pro — Flashでは精度が不十分な場合に使用します。多段階推論、コード、画像処理、非常に長いコンテキストに適しています。
- 価格重視ならgemini-3-6-flashではありません — $1.05 / $5.25で、Kunavoでは3.7および3.8 Flashより高く、Google自身の導入価格よりも高価です。すでにこのモデルで検証済みのプロンプトにのみ使用してください。
難易度に応じて振り分けるのが効果的です。通常のケースにはFlashを使い、チェックに失敗した場合だけProへエスカレーションします。コードによる振り分けパターンはAIコスト最適化ガイド、プロバイダー比較についてはClaudeとGPTの料金ガイドをご覧ください。
Geminiの請求額を減らす方法
- 下位ティアに移行する。簡単な80%はFlashに送り、難しい20%のためにProを確保します。
- 3.6 Flashから移行する。KunavoではGemini 3.8 FlashがGemini 3.6 Flashよりトークンあたり50%安く、OpenAI互換のリクエスト形式も同じです。モデル名を1語変更するだけです。
- 出力を制限する。
max_tokensと停止シーケンスを設定してください。メーター上、出力の方が高価です。 - 入力を減らす。ナレッジベース全体をコンテキストに詰め込むのではなく、より少数で質の高いRAGチャンクを取得します。
- バッチ処理する。独立した呼び出しをまとめ、レイテンシを抑え、リトライの集中を避けます。
よくある質問
Googleの公式Gemini API料金は2026年9月でいくらですか?
2026年9月12日時点で、Googleの公式な100万トークンあたりの料金は、Gemini 2.5 Flashが入力$0.30/出力$2.50、Gemini 3.1 Proが入力$2.00/出力$12.00です。料金はai.google.dev/gemini-api/docs/pricingに掲載されています。3.x Flashモデル(Gemini 3.6、3.7、3.8 Flash)については、Googleは2026年12月31日まで導入料金として入力$0.75/出力$3.75を請求し、2027年1月1日に標準料金の入力$1.50/出力$7.50へ引き上げます。Kunavoでは同じモデルがGemini 2.5 Flashについて入力$0.09/出力$0.75(Googleの表示価格より約70%安い)、Gemini 3.1 Proについて入力$0.70/出力$4.20(Googleの表示価格より約65%安い)、Gemini 3.8および3.7 Flashについて入力$0.525/出力$2.625(Googleの導入料金より30%安い)です。
Gemini 3.8 Flash APIの料金はいくらですか?
Kunavoでは、Gemini 3.8 Flash APIは100万入力トークンあたり$0.525、100万出力トークンあたり$2.625で、推論トークンは出力として請求されます。GoogleのGemini 3.8 Flash料金は、2026年12月31日まで導入料金として入力$0.75/出力$3.75、2027年1月1日から入力$1.50/出力$7.50です。そのためKunavoは、Googleが現在請求する料金より30%安くなります。2026年9月2日にリリースされたGemini 3.8 FlashはGoogleの最新Flashモデルで、KunavoのOpenAI互換エンドポイントではgemini-3-8-flashとして呼び出します。
Gemini 3.8 FlashはKunavo経由のほうが安いですか?
はい。Kunavo 経由では Gemini 3.8 Flash は 1M トークンあたり $0.525 / $2.625 で、Google が 2026年12月31日 まで直接請求する $0.75 / $3.75 の導入料金より 30% 安価です。Gemini 3.7 Flash も同じ価格です。Google 自身が 3.x Flash モデルを 2027 年まで割引しているため、Gemini 3.1 Pro や 2.5 Flash ほど価格差は大きくありません。低価格の代わりに容量面での違いがあります。Kunavo は共有容量で、専用クォータも契約上の SLA もありません。そのため、保証されたクォータや SLA が必要なチームは Google から直接購入してください。
これはGoogle公式の料金一覧ですか?
いいえ — Google独自のai.google.dev/gemini-api/docs/pricingが公式ソースで、このガイドの先頭にリンクしています。このページでは公式の表示価格を再掲し、確認日を明記したうえで、同じモデルについてKunavoの料金を隣に示しています。Kunavoはこれらのモデルを再販する独立したゲートウェイであり、Googleではありません。
Gemini APIは無料ですか?
Google AI Studioには、プロトタイピング向けのレート制限付き無料ティアがあります。本番環境ではトークン単位で支払います。Kunavoは最低$10のチャージから始まる従量課金で、以下の料金でトークン単位に支払い、残高は失効せず、Google Cloudの請求アカウントも必要ありません。
Gemini 2.5 Flashの料金はいくらですか?
Kunavoでは、Gemini 2.5 Flashは100万入力トークンあたり$0.09、100万出力トークンあたり$0.75で、Googleの表示価格$0.30/$2.50より約70%安くなっています。一般的なチャットボットの1ターン(入力1K、出力300)は約$0.0003です。
Gemini 3.1 Pro APIの料金はいくらですか?
Kunavoでは、Gemini 3.1 Pro APIの料金は100万入力トークンあたり$0.70、100万出力トークンあたり$4.20で、Googleの$2.00/$12.00という表示価格より約65%安くなっています。複数ステップの推論、ビジョン、長いコンテキストにはFlashよりProを使用してください。
Gemini 3.6 Flash APIの料金はいくらですか?
Kunavoでは、Gemini 3.6 Flashは入力100万トークンあたり$1.05、出力100万トークンあたり$5.25です。これは、Googleが2026年12月31日までこのモデルに適用する導入価格$0.75 / $3.75より40%高いため、このモデルについては現時点ではGoogleから直接購入する方が安価です。Gemini 3.8 Flashと3.7 Flashの方がよりお得です。どちらも新しく、Kunavoでは$0.525 / $2.625で、Googleの導入価格より30%安くなっています。2027年1月1日から適用されるGoogleのGemini 3.6 Flash標準価格は、$1.50 / $7.50です。
GeminiはClaudeやGPTより安いですか?
Gemini 2.5 Flashは、十分な性能を備えたモデルの中でも特に安価なモデルの1つです。大量処理ではClaude Haikuや多くのGPTティアより低価格です。料金ページで完全な比較表をご覧ください。
Gemini APIのコストを下げるにはどうすればよいですか?
Flashにダウングレードし、Gemini 3.6 Flashのトラフィックを3.8 Flashに移行し、出力を制限し、取得するコンテキストを減らして、バッチ処理を行ってください。詳しくはコスト最適化ガイドをご覧ください。Geminiの呼び出しを始めるには、Gemini APIキーの取得方法をご覧ください。