ガイド一覧へ戻る
料金·2026年6月18日·最終更新 2026年9月12日·読了8分

Gemini API料金 2026 — モデル別料金、Googleの定価より約70%安価

モデル別の最新Gemini API料金、自分で検算できるコスト例、本番でGeminiを呼び出す最安の方法 — OpenAI互換API経由でGoogleの定価より約70%安価。

Geminiは最先端AIの中でも最高水準のコストパフォーマンスを備えており、Kunavoでは単一のOpenAI互換APIを通じてGoogleのリスト価格より約70%安く利用できます。このGemini API料金ガイドでは、モデルごとの最新料金、再計算可能なコスト例、本番環境でGeminiを呼び出す最安の方法を説明します。

Gemini料金の概要

料金はKunavoで請求される米ドル建ての100万トークン単位です。「Googleリスト」列には同じモデルに対するGoogleの公開料金を示し、差額を確認できるようにしています。

モデル入力 / 100万出力 / 100万Googleリスト(入力 / 出力)節約額
gemini-2-5-flash$0.09$0.75$0.30 / $2.50~70%
gemini-3-1-pro$0.70$4.20$2.00 / $12.00~65%

Flashは大量処理向けの主力モデル、Proはより難しい推論、Vision、長いコンテキストを使うタスク向けです。最新料金は常に料金ページと各モデルページ(gemini-2-5-flash、gemini-3-1-pro)に掲載されています。

Geminiのトークン料金の仕組み

入力トークン(送信するすべての内容 — システムプロンプト、取得したコンテキスト、ユーザーメッセージ)と、出力トークン(モデルが生成する内容)に対して課金されます。出力のほうが高額なため、Geminiの請求額に最も大きく影響するのは、モデルにどれだけのテキストを書かせるかです。画像と音声はトークン相当量に変換され、同じカウンターで課金されます。

コスト計算例

KunavoのGemini 2.5 Flash料金に基づく実際の数値です。ただし、最後の行はGemini 3.1 Proを使用しています:

ワークロードトークン(入力 / 出力)モデル費用
チャットボットの1ターン1.000 / 300Flash$0.0003
RAG回答8.000 / 500Flash$0.0011
バッチ分類(文書あたり)500 / 20Flash$0.00006
長いコンテキストの分析20.000 / 2.000Pro$0.0224

この料金では、Flashで10万件の文書を分類するバッチは約$6、チャットボットの100万ターンは約$315です。実行可能な計算式は次のとおりです。

gemini_kosten.py
# Kunavo-Tarife für Gemini 2.5 Flash (USD pro 1M Tokens)
IN_RATE, OUT_RATE = 0.09, 0.75

def kosten(in_tokens: int, out_tokens: int) -> float:
    return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE

print(kosten(1_000, 300))            # ein Chatbot-Turn      -> $0.000315
print(kosten(8_000, 500))            # eine RAG-Antwort       -> $0.001095
print(kosten(500, 20) * 100_000)     # Batch mit 100k Docs    -> ~$6.00

Kunavoの料金とStripeによる請求

サブスクリプションもGoogle Cloudプロジェクトも必要ありません。残高をチャージし(Stripeまたは現地の決済手段)、呼び出しごとに上記のトークン料金が残高から差し引かれます。最低$10のチャージから利用できる従量課金制で、残高は失効せず、大きなチャージにはボーナス残高が付与されます。1つの残高でGeminiやその他すべてのモデル(Claude、GPT、画像、動画、音声)を利用できるため、プロバイダーごとに別々の請求を照合する必要がありません。

どのGeminiモデルを選ぶべきですか?

  • gemini-2-5-flash — チャット、抽出、分類、要約、RAGの大半に適した標準モデル。高速で、性能の高い選択肢の中で最も低価格です。
  • gemini-3-1-pro — Flashでは精度が足りない場合に使用します。多段階推論、コード、Vision、非常に長いコンテキストに適しています。

難易度に応じてルーティングするのが効果的です。通常はFlashを使い、チェックに失敗した場合のみProに引き上げます。コードでのルーティング方法はAIコスト最適化ガイドをご覧ください。

Geminiの請求額を下げる方法

  1. ダウングレードする。簡単な80%をFlashに送り、難しい20%だけProに回します。
  2. 出力を制限する。max_tokensと停止シーケンスを設定します。カウンターでは出力のほうが高額です。
  3. 入力を絞る。ナレッジベース全体をコンテキストに詰め込むのではなく、より少数の質の高いRAGチャンクを取得します。
  4. バッチ処理する。独立した呼び出しをまとめて、レイテンシーを抑え、リトライの集中を避けます。

同じキーでGoogleの動画モデルも呼び出せます。クリップあたりの料金はVeo 3の料金、OpenAIとの比較はOpenAI APIの料金をご覧ください。

よくある質問

Gemini APIは無料ですか?

Google AI Studioには、プロトタイピング向けのレート制限付き無料ティアがあります。本番環境ではトークン単位で課金されます。Kunavoは最低$10のチャージから利用できる従量課金制です。以下の料金でトークンごとに課金され、残高は失効せず、Google Cloudの請求先アカウントも必要ありません。

Gemini 2.5 Flashの料金はいくらですか?

Kunavoでは、Gemini 2.5 Flashは100万入力トークンあたり$0.09、100万出力トークンあたり$0.75です。Googleの$0.30 / $2.50というリスト価格より約70%安くなっています。一般的なチャットボットの1ターン(入力1K、出力300)は約$0.0003です。

GeminiはClaudeやGPTより安いですか?

Gemini 2.5 Flashは、性能の高いモデルの中でも特に低価格です。大規模利用ではClaude Haikuや多くのGPTティアより安価です。完全な表は料金ページで比較してください。

Gemini APIのコストを下げるにはどうすればよいですか?

Flashにダウングレードし、出力を制限し、取得するコンテキストを絞り、バッチ処理します。詳細はAIコスト最適化ガイドをご覧ください。Geminiの呼び出しを始めるには、Gemini APIキーの作成方法をお読みください。