Geminiは最先端AIの中でも最高水準のコストパフォーマンスを備えており、Kunavoでは単一のOpenAI互換APIを通じてGoogleのリスト価格より約70%安く利用できます。このGemini API料金ガイドでは、モデルごとの最新料金、再計算可能なコスト例、本番環境でGeminiを呼び出す最安の方法を説明します。
Gemini料金の概要
料金はKunavoで請求される米ドル建ての100万トークン単位です。「Googleリスト」列には同じモデルに対するGoogleの公開料金を示し、差額を確認できるようにしています。
| モデル | 入力 / 100万 | 出力 / 100万 | Googleリスト(入力 / 出力) | 節約額 |
|---|---|---|---|---|
gemini-2-5-flash | $0.09 | $0.75 | $0.30 / $2.50 | ~70% |
gemini-3-1-pro | $0.70 | $4.20 | $2.00 / $12.00 | ~65% |
Flashは大量処理向けの主力モデル、Proはより難しい推論、Vision、長いコンテキストを使うタスク向けです。最新料金は常に料金ページと各モデルページ(gemini-2-5-flash、gemini-3-1-pro)に掲載されています。
Geminiのトークン料金の仕組み
入力トークン(送信するすべての内容 — システムプロンプト、取得したコンテキスト、ユーザーメッセージ)と、出力トークン(モデルが生成する内容)に対して課金されます。出力のほうが高額なため、Geminiの請求額に最も大きく影響するのは、モデルにどれだけのテキストを書かせるかです。画像と音声はトークン相当量に変換され、同じカウンターで課金されます。
コスト計算例
KunavoのGemini 2.5 Flash料金に基づく実際の数値です。ただし、最後の行はGemini 3.1 Proを使用しています:
| ワークロード | トークン(入力 / 出力) | モデル | 費用 |
|---|---|---|---|
| チャットボットの1ターン | 1.000 / 300 | Flash | $0.0003 |
| RAG回答 | 8.000 / 500 | Flash | $0.0011 |
| バッチ分類(文書あたり) | 500 / 20 | Flash | $0.00006 |
| 長いコンテキストの分析 | 20.000 / 2.000 | Pro | $0.0224 |
この料金では、Flashで10万件の文書を分類するバッチは約$6、チャットボットの100万ターンは約$315です。実行可能な計算式は次のとおりです。
# Kunavo-Tarife für Gemini 2.5 Flash (USD pro 1M Tokens)
IN_RATE, OUT_RATE = 0.09, 0.75
def kosten(in_tokens: int, out_tokens: int) -> float:
return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE
print(kosten(1_000, 300)) # ein Chatbot-Turn -> $0.000315
print(kosten(8_000, 500)) # eine RAG-Antwort -> $0.001095
print(kosten(500, 20) * 100_000) # Batch mit 100k Docs -> ~$6.00Kunavoの料金とStripeによる請求
サブスクリプションもGoogle Cloudプロジェクトも必要ありません。残高をチャージし(Stripeまたは現地の決済手段)、呼び出しごとに上記のトークン料金が残高から差し引かれます。最低$10のチャージから利用できる従量課金制で、残高は失効せず、大きなチャージにはボーナス残高が付与されます。1つの残高でGeminiやその他すべてのモデル(Claude、GPT、画像、動画、音声)を利用できるため、プロバイダーごとに別々の請求を照合する必要がありません。
どのGeminiモデルを選ぶべきですか?
- gemini-2-5-flash — チャット、抽出、分類、要約、RAGの大半に適した標準モデル。高速で、性能の高い選択肢の中で最も低価格です。
- gemini-3-1-pro — Flashでは精度が足りない場合に使用します。多段階推論、コード、Vision、非常に長いコンテキストに適しています。
難易度に応じてルーティングするのが効果的です。通常はFlashを使い、チェックに失敗した場合のみProに引き上げます。コードでのルーティング方法はAIコスト最適化ガイドをご覧ください。
Geminiの請求額を下げる方法
- ダウングレードする。簡単な80%をFlashに送り、難しい20%だけProに回します。
- 出力を制限する。
max_tokensと停止シーケンスを設定します。カウンターでは出力のほうが高額です。 - 入力を絞る。ナレッジベース全体をコンテキストに詰め込むのではなく、より少数の質の高いRAGチャンクを取得します。
- バッチ処理する。独立した呼び出しをまとめて、レイテンシーを抑え、リトライの集中を避けます。
同じキーでGoogleの動画モデルも呼び出せます。クリップあたりの料金はVeo 3の料金、OpenAIとの比較はOpenAI APIの料金をご覧ください。
よくある質問
Gemini APIは無料ですか?
Google AI Studioには、プロトタイピング向けのレート制限付き無料ティアがあります。本番環境ではトークン単位で課金されます。Kunavoは最低$10のチャージから利用できる従量課金制です。以下の料金でトークンごとに課金され、残高は失効せず、Google Cloudの請求先アカウントも必要ありません。
Gemini 2.5 Flashの料金はいくらですか?
Kunavoでは、Gemini 2.5 Flashは100万入力トークンあたり$0.09、100万出力トークンあたり$0.75です。Googleの$0.30 / $2.50というリスト価格より約70%安くなっています。一般的なチャットボットの1ターン(入力1K、出力300)は約$0.0003です。
GeminiはClaudeやGPTより安いですか?
Gemini 2.5 Flashは、性能の高いモデルの中でも特に低価格です。大規模利用ではClaude Haikuや多くのGPTティアより安価です。完全な表は料金ページで比較してください。
Gemini APIのコストを下げるにはどうすればよいですか?
Flashにダウングレードし、出力を制限し、取得するコンテキストを絞り、バッチ処理します。詳細はAIコスト最適化ガイドをご覧ください。Geminiの呼び出しを始めるには、Gemini APIキーの作成方法をお読みください。