返回指南
價格·2026年6月18日·更新於 2026年9月12日·閱讀約 8 分鐘

Gemini API 價格 2026——Gemini API 費用完整整理

Gemini 在前沿 AI 中具備頂級性價比,而 Kunavo 依模型不同,提供比 Google 定價低 30–70% 的價格。本文集中整理各模型目前的費率、可自行驗證的成本範例,以及在生產環境中以最低成本呼叫的方法。

Gemini 在前沿 AI 中屬於性價比最高的選項之一,而 Kunavo 在單一 OpenAI 相容 API 背後提供它,價格比 Google 官方價格便宜約 70%。本指南將說明目前各模型的費率、可自行驗證的成本計算範例,以及在生產環境中以最低成本呼叫 Gemini 的方法。

Gemini 價格一覽

費率以 Kunavo 的收費標準計算,單位為每 1M 個 token 的 USD。「Google 官方價格」欄位列出同一模型的 Google 公開費率,方便一眼比較差異。

模型輸入 / 1M輸出 / 1MGoogle 官方價格(輸入 / 輸出)節省比例
gemini-2-5-flash$0.09$0.75$0.30 / $2.50~70%
gemini-3-1-pro$0.70$4.20$2.00 / $12.00~65%

Flash 是大量處理的主力模型,Pro 適合較困難的推理、視覺與長上下文工作。即時費率請一律在 價格頁面與各模型頁面確認(gemini-2-5-flash、gemini-3-1-pro)。

Gemini token 價格如何運作

您需要為輸入 token(傳送的所有內容——系統提示、檢索到的上下文、使用者訊息)與輸出 token(模型生成的內容)付費。由於輸出較昂貴,因此影響 Gemini 帳單最大的因素,是您允許模型寫出多少內容。影像與音訊會轉換為 token 等值,並在同一計量器中計費。

成本計算範例

以下是依 Kunavo 的 Gemini 2.5 Flash 費率計算的實際數值,只有最後一列使用 Gemini 3.1 Pro:

工作token(輸入 / 輸出)模型成本
聊天機器人單輪1,000 / 300Flash$0.0003
RAG 回答8,000 / 500Flash$0.0011
批次分類(每份文件)500 / 20Flash$0.00006
長上下文分析20,000 / 2,000Pro$0.0224

依此費率,用 Flash 分類 10 萬份文件的批次作業約需 $6,聊天機器人 100 萬輪約需 $315。可自行執行的計算式:

gemini_cost.py
# Kunavo Gemini 2.5 Flash 요율 (1M 토큰당 USD)
IN_RATE, OUT_RATE = 0.09, 0.75

def cost(in_tokens: int, out_tokens: int) -> float:
    return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE

print(cost(1_000, 300))            # 챗봇 한 턴        -> $0.000315
print(cost(8_000, 500))            # RAG 답변 한 건    -> $0.001095
print(cost(500, 20) * 100_000)     # 10만 건 배치      -> ~$6.00

Kunavo 價格與 Stripe 付款

沒有訂閱,也不需要 Google Cloud 專案。儲值餘額後(使用 Stripe 或當地付款方式),每次呼叫都會依上述每 token 費率從餘額扣款。從最低 $10 儲值起按用量付費,餘額永不過期,且儲值金額越高,獲得的獎勵額度越多。Gemini、Claude、GPT、影像、影片、音訊等所有模型都使用同一筆餘額,因此無需逐一核對不同供應商的帳單。

應選擇哪個 Gemini 模型?

  • gemini-2-5-flash——聊天、擷取、分類、摘要與大多數 RAG 工作的預設選擇。速度快,是最便宜的高效能選項。
  • gemini-3-1-pro——當 Flash 的準確度不足時選擇:多階段推理、程式碼、視覺與極長上下文。

良好的模式是依難度進行路由:一般情況使用 Flash,只有驗證失敗時才升級至 Pro。以程式碼實作的路由模式請參閱 AI 成本最佳化指南。

降低 Gemini 帳單

  1. 降低模型等級。將簡單的 80% 工作交給 Flash,保留 Pro 處理困難的 20%。
  2. 限制輸出。設定 max_tokens 與停止序列——輸出是計量器中較昂貴的一側。
  3. 減少輸入。不要將整個知識庫硬塞進上下文,改為檢索更少但品質更高的 RAG 區塊。
  4. 進行批次處理。將獨立呼叫分組,以降低延遲並避免重試暴增。

常見問題

Gemini API 是免費的嗎?

Google AI Studio 提供適合原型製作的免費方案(有請求限制)。在生產環境中,則按 token 計費。Kunavo 從最低 $10 儲值開始按用量付費,依下列費率按 token 支付,餘額永不過期,也不需要 Google Cloud 計費帳戶。

Gemini 2.5 Flash 的費用是多少?

在 Kunavo 中,Gemini 2.5 Flash 的費率為每 1M 個輸入 token $0.09、每 1M 個輸出 token $0.75,比 Google 官方價格 $0.30 / $2.50 便宜約 70%。一般聊天機器人的單輪請求(輸入 1K、輸出 300)約為 $0.0003。

Gemini 比 Claude 或 GPT 便宜嗎?

Gemini 2.5 Flash 是各處最便宜的高效能模型之一,在大量工作中價格低於 Claude Haiku 與大多數 GPT 等級。Claude 方面的單價與付款方式請參閱 Claude API 價格與付款整理;完整表格請在 價格頁面比較。

如何降低 Gemini API 成本?

改用 Flash 等級、限制輸出、縮減搜尋內容並進行批次處理。詳細內容請參閱 成本最佳化指南。若要開始呼叫 Gemini,請參閱 如何取得 Gemini API 金鑰。