ガイド一覧へ戻る
料金·2026年6月18日·最終更新 2026年9月12日·読了8分

Gemini API の料金 2026 — モデル別コスト、例、より安価な OpenAI 互換アクセス

Gemini は最高クラスの AI の中でも特にコストパフォーマンスに優れています。ここではモデル別の最新料金(Google の定価より約 70% 安い)を、料金例と本番環境で Gemini を最も安く呼び出す方法とともに紹介します。

Geminiは主要AIモデルの中でも特にコストパフォーマンスに優れており、KunavoではOpenAI互換の単一APIを通じてGoogle公式の定価より約70%低い料金で利用できます。このガイドでは、モデルごとの最新料金、自分で確認できるコスト例、本番環境でGeminiを最も安く呼び出す方法を説明します。

Gemini API料金の概要

料金はKunavoで請求される米ドル建ての100万トークン単位です。「Google定価」列には、同じモデルについてGoogleが公開している公式料金を表示し、差額を確認できるようにしています。

モデル入力 / 100万トークン出力 / 100万トークンGoogle定価(入力 / 出力)節約額
gemini-2-5-flash$0.09$0.75$0.30 / $2.50~70%
gemini-3-1-pro$0.70$4.20$2.00 / $12.00~65%

Flashは大量処理向けの主力モデルです。Proは、より高度な推論、ビジョン、長いコンテキストを要するタスク向けです。最新の料金は常に料金ページと各モデルのページ(gemini-2-5-flash、gemini-3-1-pro)に表示されます。

Geminiのトークン単価の仕組み

支払うのは入力トークン(送信するすべての内容、つまりシステムプロンプト、検索結果のコンテキスト、ユーザーメッセージ)と、出力トークン(モデルが生成する内容)です。出力の方が高価なので、Geminiの請求額に最も大きく影響するのは、モデルにどれだけのテキストを書かせるかです。画像と音声はトークン相当量に変換され、同じメーターで課金されます。

コスト計算例

KunavoのGemini 2.5 Flash料金に基づく実際の数値です。ただし、最後の行ではGemini 3.1 Proを使用します。

ワークロードトークン(入力 / 出力)モデルコスト
チャットボットの1往復1.000 / 300Flash$0.0003
RAGの回答8.000 / 500Flash$0.0011
バッチ分類(1文書あたり)500 / 20Flash$0.00006
長いコンテキストの分析20.000 / 2.000Pro$0.0224

この料金で、Flashによる100,000件の文書分類バッチは約$6、チャットボット100万往復は約$315です。計算式はそのまま実行できます。

gemini_biaya.py
# Tarif Kunavo untuk Gemini 2.5 Flash (USD per 1J token)
IN_RATE, OUT_RATE = 0.09, 0.75

def biaya(token_masuk: int, token_keluar: int) -> float:
    return token_masuk / 1_000_000 * IN_RATE + token_keluar / 1_000_000 * OUT_RATE

print(biaya(1_000, 300))            # satu putaran chatbot      -> $0.000315
print(biaya(8_000, 500))            # satu jawaban RAG          -> $0.001095
print(biaya(500, 20) * 100_000)     # batch 100rb dokumen       -> ~$6.00

Kunavoの料金とStripe経由の請求

サブスクリプションもGoogle Cloudプロジェクトも必要ありません。ウォレットに残高を追加すると(Stripeまたは現地の支払い方法)、各呼び出しで上記のトークン単価に基づいて残高から差し引かれます。従量課金は最低$10のトップアップから利用でき、残高が失効することはありません。大きなトップアップにはボーナスクレジットが付与されます。1つのウォレットでGeminiとその他すべてのモデル(Claude、GPT、画像、動画、音声)を利用できるため、プロバイダーごとに別々の請求を照合する必要はありません。

どのGeminiモデルを選ぶべきですか?

  • gemini-2-5-flash — チャット、抽出、分類、要約、そして大部分のRAGにおけるデフォルトです。高速で、高性能モデルの中でも特に安価です。
  • gemini-3-1-pro — Flashでは精度が不足する場合に使用します。多段階推論、コード、ビジョン、非常に長いコンテキストに適しています。

難易度に応じてルーティングするのが良いパターンです。一般的なケースにはFlashを使い、検証に失敗した場合だけProに切り替えます。コードでのルーティングパターンについては、AIコスト最適化ガイドをご覧ください。

Geminiの請求額を削減する方法

  1. ティアを下げる。簡単な処理の80%をFlashに送り、難しい20%だけにProを使用します。
  2. 出力を制限する。max_tokensと停止シーケンスを設定します。出力はメーター上で高コストな側です。
  3. 入力を整理する。ナレッジベース全体をコンテキストに詰め込むのではなく、より少数で質の高いRAGチャンクを取得します。
  4. バッチ処理する。独立した呼び出しをまとめ、レイテンシーを低く保ちながらリトライの集中を避けます。

よくある質問

Gemini APIは無料ですか?

Google AI Studioにはレート制限付きの無料ティアがあり、プロトタイプに適しています。本番環境ではトークン単位で課金されます。Kunavoは最低$10のトップアップから従量課金を適用します。以下の料金でトークン単位に支払い、残高が失効することはなく、Google Cloudの請求アカウントも必要ありません。

Gemini 2.5 Flashの価格はいくらですか?

Kunavoでは、Gemini 2.5 Flashは入力100万トークンあたり$0.09、出力100万トークンあたり$0.75です。Google公式の定価$0.30 / $2.50より約70%低い料金です。一般的なチャットボットの1往復(入力1,000、出力300)の料金は約$0.0003です。

GeminiはClaudeやGPTより安いですか?

Gemini 2.5 Flashは、現在利用できる高性能モデルの中でも特に安価なモデルの1つです。大量処理のワークロードではClaude HaikuやGPTの大部分のティアより低価格です。完全な比較表は料金ページをご覧ください。

Gemini APIのコストを抑えるにはどうすればよいですか?

Flashを使用し、出力を制限し、検索結果のコンテキストを整理して、バッチ処理を行います。詳細はコスト最適化ガイドをご覧ください。Geminiの呼び出しを始めるには、Gemini APIキーの取得方法を参照してください。