返回指南
價格·2026年6月18日·更新於 2026年9月12日·閱讀約 8 分鐘

Gemini API 價格 2026——按模型計費,約比 Google 公開價格低 70%

最新 Gemini API 各模型價格,以及可自行核對的成本範例;透過 OpenAI 相容 API,在生產環境呼叫 Gemini 的最低成本方式——約比 Google 公開價格低 70%。

Gemini 在頂尖 AI 中具有出色的性價比,而 Kunavo 透過單一 OpenAI 相容 API,以約比 Google 公開定價低 70%的價格提供 Gemini。本篇Gemini API 費用指南列出各模型目前的費率,提供可驗算的成本範例,並說明在正式環境中呼叫 Gemini 的最低成本方式。

Gemini 費用一覽

費率以 USD 計算,每 1M token 為單位,依 Kunavo 的實際計費方式列出。「Google 公開定價」欄是 Google 對相同模型公布的費率,用來讓你看出差異。

模型輸入 / 1M輸出 / 1MGoogle 公開定價(輸入 / 輸出)您的節省金額
gemini-2-5-flash$0.09$0.75$0.30 / $2.50~70%
gemini-3-1-pro$0.70$4.20$2.00 / $12.00~65%

Flash 是大量用量的主力;Pro 適合較困難的推理、視覺與長上下文任務。即時費率一律列於費用頁面及各模型頁面(gemini-2-5-flash、gemini-3-1-pro)。

Gemini 的 token 計費方式

你需要為輸入 token(你傳送的所有內容——系統提示、檢索到的上下文、使用者訊息)以及輸出 token(模型生成的內容)付費。輸出是較昂貴的一側,因此 Gemini 帳單中最大的成本槓桿,是控制讓模型產生多少文字。圖片與音訊會轉換為等值 token,並以同一計數器計費。

完整成本範例

以下是 Kunavo Gemini 2.5 Flash 費率的實際數字,最後一列除外,該列使用 Gemini 3.1 Pro:

工作負載Token(輸入 / 輸出)模型成本
聊天機器人回合1.000 / 300Flash$0.0003
RAG 回答8.000 / 500Flash$0.0011
批次分類(每份文件)500 / 20Flash$0.00006
長上下文分析20.000 / 2.000Pro$0.0224

依照這些費率,使用 Flash 對 100,000 份文件執行分類批次約需 $6,一百萬次聊天機器人回合約需 $315。可直接執行的計算如下:

gemini_kosten.py
# Kunavo-Tarife für Gemini 2.5 Flash (USD pro 1M Tokens)
IN_RATE, OUT_RATE = 0.09, 0.75

def kosten(in_tokens: int, out_tokens: int) -> float:
    return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE

print(kosten(1_000, 300))            # ein Chatbot-Turn      -> $0.000315
print(kosten(8_000, 500))            # eine RAG-Antwort       -> $0.001095
print(kosten(500, 20) * 100_000)     # Batch mit 100k Docs    -> ~$6.00

Kunavo 價格與 Stripe 計費

沒有訂閱,也不需要 Google Cloud 專案。你可以儲值(透過 Stripe 或當地付款方式),呼叫費用會依上述 token 費率從餘額中扣除。採隨用隨付,最低儲值 $10;餘額永不過期,較大額的儲值還會獲得額外贈金。一個餘額可用於 Gemini 與其他所有模型——Claude、GPT、圖片、影片與音訊,因此不必逐一核對各提供商的獨立帳單。

應該選擇哪個 Gemini 模型?

  • gemini-2-5-flash——聊天、擷取、分類、摘要與大部分 RAG 的預設選擇。速度快,也是最便宜的高效能選項。
  • gemini-3-1-pro——當 Flash 的準確度不足時使用:多步驟推理、程式碼、視覺與超長上下文。

一個好的模式是依難度進行路由:一般情況使用 Flash,只有在檢查失敗時才升級至 Pro。程式碼中的路由方式請參閱AI 成本最佳化指南。

降低 Gemini 帳單的方法

  1. 降級。將簡單任務的 80% 交給 Flash;把 Pro 保留給較困難的 20%。
  2. 限制輸出。設定 max_tokens 與停止序列——輸出是計費計數器中較昂貴的一側。
  3. 精簡輸入。擷取較少但品質更好的 RAG 區塊,不要將整個知識庫塞進上下文。
  4. 使用批次處理。將彼此獨立的呼叫集中處理,以降低延遲並避免重試風暴。

同一把金鑰也能呼叫 Google 的影片模型——每段影片的費用請參閱Veo 3 費用,與 OpenAI 的比較請參閱OpenAI API 費用。

常見問題

Gemini API 免費嗎?

Google AI Studio 提供有速率限制的免費層,適合原型開發。正式環境則按 token 付費。Kunavo 採用隨用隨付,最低儲值 $10——你會按以下費率逐 token 付費,餘額永不過期,也不需要 Google Cloud 帳單帳戶。

Gemini 2.5 Flash 的費用是多少?

在 Kunavo 上,Gemini 2.5 Flash 的費用為每 1M 輸入 token $0.09,每 1M 輸出 token $0.75——約比 Google 公開定價 $0.30 / $2.50 低 70%。典型的聊天機器人回合(1K 輸入、300 輸出)約為 $0.0003。

Gemini 比 Claude 或 GPT 便宜嗎?

Gemini 2.5 Flash 是整體上最具成本效益的高效能模型之一——在大量用量下,價格低於 Claude Haiku 與大多數 GPT 層級。請在費用頁面查看完整表格進行比較。

如何降低 Gemini API 的費用?

降級使用 Flash、限制輸出、精簡檢索到的上下文,並使用批次處理。詳細資訊請參閱成本最佳化指南。若要開始呼叫 Gemini,請參閱如何建立 Gemini API 金鑰。