ガイド一覧へ戻る
料金·2026年6月18日·最終更新 2026年9月12日·読了8分

Gemini API の料金 2026 — モデル別コスト、例、より安価な OpenAI 互換アクセス

Gemini は最高クラスの AI の中でも特にコストパフォーマンスに優れています。ここではモデル別の最新料金(Google の表示価格より約 70% 安い)を、料金例と本番環境で Gemini を最も安く呼び出す方法とともに紹介します。

Geminiは最先端AIの中でも特に費用対効果に優れており、Kunavoでは単一のOpenAI互換APIを通じて、Googleの公式定価より約70%安く提供しています。このガイドでは、モデル別の最新料金、ご自身で検証できるコスト計算例、本番環境でGeminiを最も安く呼び出す方法を説明します。

Gemini API料金の概要

料金は100万トークンあたり、米ドルで表示され、Kunavoで実際に計算される金額です。「Google定価」列には同じモデルについてGoogleが公表している料金を表示し、差額が分かるようにしています。

モデル入力 / 100万出力 / 100万Google定価(入力 / 出力)節約額
gemini-2-5-flash$0.09$0.75$0.30 / $2.50~70%
gemini-3-1-pro$0.70$4.20$2.00 / $12.00~65%

Flashは大規模ワークロード向けの主力で、Proはより難しい推論、視覚処理、長いコンテキストのタスク向けです。現在の料金は常に料金ページと各モデルページ(gemini-2-5-flash、gemini-3-1-pro)に表示されます。

Geminiのトークン料金の仕組み

入力トークン(送信するすべてのもの — システムプロンプト、取得したコンテキスト、ユーザーメッセージ)と、出力トークン(モデルが生成するもの)に対して支払います。出力の方が高価なので、Geminiの請求額に最も大きく影響するのは、モデルにどれだけの文章を書かせるかです。画像と音声はトークン相当量に変換され、同じメーターで課金されます。

コスト計算例

最後の行を除き、KunavoのGemini 2.5 Flash料金に基づく実際の数値です。最後の行ではGemini 3.1 Proを使用します。

ワークロードトークン(入力 / 出力)モデルコスト
チャットボットの1ターン1.000 / 300Flash$0.0003
RAG回答8.000 / 500Flash$0.0011
バッチ分類(文書あたり)500 / 20Flash$0.00006
長いコンテキストの分析20.000 / 2.000Pro$0.0224

この料金では、Flashで100,000件の文書を分類するバッチは約$6、チャットボット100万ターンは約$315です。計算式はすぐ実行できます。

gemini_chi_phi.py
# Mức giá Kunavo cho Gemini 2.5 Flash (USD trên mỗi 1 triệu token)
IN_RATE, OUT_RATE = 0.09, 0.75

def chi_phi(token_vao: int, token_ra: int) -> float:
    return token_vao / 1_000_000 * IN_RATE + token_ra / 1_000_000 * OUT_RATE

print(chi_phi(1_000, 300))            # một lượt chatbot        -> $0.000315
print(chi_phi(8_000, 500))            # một câu trả lời RAG     -> $0.001095
print(chi_phi(500, 20) * 100_000)     # lô 100k tài liệu        -> ~$6.00

Kunavoの料金とStripe決済

サブスクリプションもGoogle Cloudプロジェクトも不要です。残高をウォレットにチャージし(Stripeまたは現地の決済方法)、各呼び出しの料金を上記のトークン単価でそこから差し引きます。最低$10のチャージから従量課金で利用でき、残高に有効期限はなく、より多くチャージするとボーナスクレジットが加算されます。1つのウォレットでGeminiと、Claude、GPT、画像、動画、音声を含むすべての他のモデルを利用できるため、プロバイダーごとに別々の請求書を照合する必要はありません。

どのGeminiモデルを選ぶべきですか?

  • gemini-2-5-flash — チャット、抽出、分類、要約、大半のRAGのデフォルト。高速で、十分な性能を持つ最も安価な選択肢です。
  • gemini-3-1-pro — Flashでは十分な精度が得られない場合に使用します。多段階推論、プログラミング、視覚処理、非常に長いコンテキストに適しています。

優れたパターンは、難易度に応じてルーティングすることです。一般的なケースにはFlashを使い、チェックに失敗した場合だけProに引き上げます。コードでのルーティングパターンについては、AIコスト最適化ガイドをご覧ください。

Geminiの請求額を削減する方法

  1. ティアを下げる。簡単な処理の80%をFlashに回し、難しい20%のためにProを残します。
  2. 出力を制限する。max_tokensと停止シーケンスを設定します。メーター上では出力の方が高価です。
  3. 入力を絞り込む。知識ベース全体をコンテキストに詰め込むのではなく、より少数で質の高いRAGチャンクを取得します。
  4. バッチ処理する。独立した呼び出しをまとめ、レイテンシーを低く保ち、リトライの集中を避けます。

よくある質問

Gemini APIは無料ですか?

Google AI Studioには、プロトタイプ作成に適した、レート制限付きの無料枠があります。本番環境ではトークン単位で支払います。Kunavoは最低$10のチャージから従量課金で利用でき、以下の料金でトークン単位に支払います。残高に有効期限はなく、Google Cloudの請求アカウントも必要ありません。

Gemini 2.5 Flashの料金はいくらですか?

Kunavoでは、Gemini 2.5 Flashの料金は入力100万トークンあたり$0.09、出力100万トークンあたり$0.75です。Googleの公式定価である$0.30 / $2.50より約70%安価です。一般的なチャットボットの1ターン(入力1k、出力300)なら、約$0.0003です。

GeminiはClaudeやGPTより安いですか?

Gemini 2.5 Flashは、世界中のモデルの中でも、十分な性能を備えた最も安価なモデルの1つです。大量に利用する場合、Claude Haikuや大半のGPTティアより安価です。完全な比較表は料金ページをご覧ください。

Gemini APIのコストを下げるにはどうすればよいですか?

Flashに下げ、出力を制限し、取得するコンテキストを絞り込み、バッチ処理してください。詳しくはコスト最適化ガイドをご覧ください。Geminiの呼び出しを始めるには、Gemini APIキーの取得方法をご覧ください。