ガイド一覧へ戻る
料金·2026年6月18日·最終更新 2026年9月12日·読了8分

Gemini 料金 2026 — Gemini API 料金の完全ガイド

Gemini は最先端 AI の中でも最高水準のコストパフォーマンスを誇り、Kunavo ではモデルに応じて Google の定価より 30〜70% 安く提供しています。モデル別の現在の料金、直接検証できるコスト例、本番環境で最も安く呼び出す方法を1か所にまとめました。

GeminiはフロンティアAIの中でも特に費用対効果が高く、Kunavoは1つのOpenAI互換APIの背後で、これをGoogleの定価より約70%安く提供します。このガイドでは、現在のモデル別料金、直接検証できるコスト計算例、本番環境でGeminiを最も安く呼び出す方法を説明します。

Gemini料金の概要

料金はKunavoで請求される基準で、100万トークンあたりのUSDです。「Googleの定価」列には同じモデルに対するGoogleの公表料金を併記し、差を一目で確認できるようにしています。

モデル入力 / 100万出力 / 100万Googleの定価(入力 / 出力)削減率
gemini-2-5-flash$0.09$0.75$0.30 / $2.50~70%
gemini-3-1-pro$0.70$4.20$2.00 / $12.00~65%

Flashは大量処理向けの主力モデルで、Proはより難しい推論、ビジョン、長いコンテキストの作業に適しています。最新の料金は常に料金ページと各モデルページ(gemini-2-5-flash、gemini-3-1-pro)で確認できます。

Geminiのトークン料金はどのように機能しますか

入力トークン(送信するすべてのもの — システムプロンプト、検索されたコンテキスト、ユーザーメッセージ)と、出力トークン(モデルが生成する内容)に対して料金を支払います。出力の方が高価なため、Geminiの請求額を左右する最大の要因は、モデルにどれだけ文章を書かせるかです。画像と音声はトークン換算値に変換され、同じメーターで課金されます。

コスト計算例

KunavoのGemini 2.5 Flash料金で計算した実数値です。最後の行だけGemini 3.1 Proを使用します:

タスクトークン(入力 / 出力)モデル料金
チャットボットの1ターン1,000 / 300Flash$0.0003
RAG回答8,000 / 500Flash$0.0011
バッチ分類(文書あたり)500 / 20Flash$0.00006
長いコンテキストの分析20,000 / 2,000Pro$0.0224

この料金なら、Flashで10万件の文書を分類するバッチは約$6、チャットボット100万ターンは約$315です。直接実行できる計算式:

gemini_cost.py
# Kunavo Gemini 2.5 Flash 요율 (1M 토큰당 USD)
IN_RATE, OUT_RATE = 0.09, 0.75

def cost(in_tokens: int, out_tokens: int) -> float:
    return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE

print(cost(1_000, 300))            # 챗봇 한 턴        -> $0.000315
print(cost(8_000, 500))            # RAG 답변 한 건    -> $0.001095
print(cost(500, 20) * 100_000)     # 10만 건 배치      -> ~$6.00

Kunavoの料金とStripe決済

サブスクリプションもGoogle Cloudプロジェクトも必要ありません。残高をチャージすると(Stripeまたは現地の決済手段)、呼び出し時に上記のトークン単価で残高から差し引かれます。最低$10からチャージして使った分だけ支払い、残高は失効せず、チャージ額が大きいほどボーナスクレジットが付与されます。1つの残高でGeminiだけでなく、Claude、GPT、画像、動画、音声などすべてのモデルを利用できるため、プロバイダーごとに別の請求書を照合する必要がありません。

どのGeminiモデルを選ぶべきですか?

  • gemini-2-5-flash — チャット、抽出、分類、要約、ほとんどのRAGでデフォルトにしてください。高速で、最も安価な高性能オプションです。
  • gemini-3-1-pro — Flashでは精度が不足するときに選択してください。多段階推論、コード、ビジョン、非常に長いコンテキストに適しています。

良いパターンは、難易度に応じてルーティングすることです。通常はFlashで処理し、検証に失敗した場合のみProへ昇格させます。コードで実装したルーティングパターンはAIコスト最適化ガイドをご覧ください。

Geminiの請求額を削減する

  1. モデルを下げる。 簡単な80%はFlashに送り、難しい20%のためにProを温存してください。
  2. 出力を制限する。 max_tokensと停止シーケンスを設定してください — 出力はメーターの高価な側です。
  3. 入力を減らす。 ナレッジベース全体をコンテキストに詰め込まず、より少なく、より良いRAGチャンクを検索してください。
  4. バッチ処理する。 独立した呼び出しをまとめて遅延を下げ、リトライの集中を避けてください。

よくある質問

Gemini APIは無料ですか?

Google AI Studioは、プロトタイピング向けの無料枠(リクエスト制限あり)を提供しています。本番環境ではトークン単位で課金されます。Kunavoは最低$10のチャージから使った分だけ支払う方式で、以下の料金でトークン単位に課金され、残高は失効せず、Google Cloudの請求先アカウントも必要ありません。

Gemini 2.5 Flashの料金はいくらですか?

KunavoではGemini 2.5 Flashは入力100万トークンあたり$0.09、出力100万トークンあたり$0.75で、Googleの定価$0.30 / $2.50より約70%安価です。一般的なチャットボットの1ターン(入力1K、出力300)は約$0.0003です。

GeminiはClaudeやGPTより安いですか?

Gemini 2.5 Flashは、どこで使っても最も安価な高性能モデルの1つで、大量処理ではClaude HaikuやほとんどのGPTクラスより低価格です。Claude側の料金と支払い方法はClaude APIの料金・支払いまとめを、全体表は料金ページで比較してください。

Gemini APIのコストをどう削減できますか?

Flashにダウングレードし、出力を制限し、検索コンテキストを減らし、バッチ処理してください。詳細はコスト最適化ガイドにあります。Geminiの呼び出しを始めるには、Gemini APIキーの取得方法をご覧ください。