返回指南
定價·2026年6月18日·更新於 2026年9月24日·閱讀約 8 分鐘

Gemini 定價 2026 — 依模型價格與降低成本的方法

Gemini 定價的清楚表格:依模型費率、實際成本範例,以及在正式環境中以每 token 最低價格呼叫 Gemini 的方法。所有數字都是 Kunavo 的計費費率。

Gemini 是前沿 AI 中價格/效能最佳的選項之一,而 Kunavo 透過單一 OpenAI 相容 API,以約低於 Google 牌價 70 的價格提供 Gemini。本指南提供最新的模型費率、可自行驗證的成本計算範例,以及在正式環境中以最低成本呼叫 Gemini 的方式。

Gemini 定價一覽

費率依 Kunavo 的計費方式,以每 1M token、美元計算。「Google 牌價」欄位是同一模型由 Google 公布的費率,列出來是為了讓你看出差異。

模型輸入/1M輸出/1MGoogle 牌價(輸入/輸出)節省
gemini-2-5-flash$0.09$0.75$0.30 / $2.50~%70
gemini-3-1-pro$0.70$4.20$2.00 / $12.00~%65

Flash 適合高大量工作;Pro 則用於更困難的推理、視覺與長上下文工作。即時費率一律可在定價頁面及各模型頁面查看(gemini-2-5-flash、gemini-3-1-pro)。

Gemini token 定價如何運作

你需要為輸入 token(你傳送的所有內容——系統提示詞、擷取的上下文、使用者訊息)以及輸出 token(模型生成的內容)付費。輸出位於較昂貴的一側;因此 Gemini 帳單中最大的單一槓桿,就是你允許模型生成多少文字。圖片與音訊會轉換為 token 等值,並以同一計數器計費。

成本計算範例

除最後一列外,均使用 Kunavo 的 Gemini 2.5 Flash 費率計算實際數字;最後一列使用Gemini 3.1 Pro:

工作負載Token(輸入/輸出)模型成本
對話回合1.000 / 300Flash$0.0003
RAG 回答8.000 / 500Flash$0.0011
批次分類(每份文件)500 / 20Flash$0.00006
長上下文分析20.000 / 2.000Pro$0.0224

依這些費率,在 Flash 上分類 100,000 份文件的批次約需$6,一百萬輪對話則約需$315。可執行的計算方式:

gemini_cost.py
# Kunavo Gemini 2.5 Flash oranları (1M token başına USD)
IN_RATE, OUT_RATE = 0.09, 0.75

def cost(in_tokens: int, out_tokens: int) -> float:
    return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE

print(cost(1_000, 300))            # bir sohbet turu     -> $0.000315
print(cost(8_000, 500))            # bir RAG yanıtı       -> $0.001095
print(cost(500, 20) * 100_000)     # 100k belge yığını    -> ~$6.00

Kunavo 定價與 Stripe 計費

沒有訂閱,也不需要 Google Cloud 專案。你儲值餘額(可使用 Stripe 或當地付款方式),呼叫費用會依上述每 token 費率從餘額中扣除。最低儲值 $10,採隨用隨付,餘額永不過期,較大額儲值還會獲得獎勵額度。單一餘額涵蓋 Gemini 與所有其他模型——Claude、GPT、圖片、影片與音訊——因此不需要逐一核對各提供商的帳單。

我該選哪個 Gemini 模型?

  • gemini-2-5-flash——聊天、擷取、分類、摘要及大多數 RAG 工作的預設選擇。快速且最便宜的高能力選項。
  • gemini-3-1-pro——當 Flash 的準確度不足時使用:多步驟推理、程式碼、視覺與超長上下文。

一個好的模式是依難度進行路由:常見情況使用 Flash,檢查失敗時再升級至 Pro。程式碼中的路由模式請參閱AI 成本最佳化指南。

降低 Gemini 帳單

  1. 降低級別。將容易的 80% 工作交給 Flash;把 Pro 留給困難的 20%。
  2. 限制輸出。設定max_tokens與停止序列——輸出是計數器中較昂貴的一側。
  3. 精簡輸入。與其把整個知識庫塞進上下文,不如擷取更少但更優質的 RAG 片段。
  4. 批次處理。將獨立請求分組,以維持低延遲並避免重試風暴。

常見問題

Gemini API 免費嗎?

Google AI Studio 提供受速率限制的免費層,適合原型開發。用於正式環境時,則按 token 計費。Kunavo 採用隨用隨付模式,最低儲值 $10——依下方費率按 token 付費,餘額永不過期,也不需要 Google Cloud 計費帳戶。

Gemini 2.5 Flash 多少錢?

在 Kunavo,Gemini 2.5 Flash 每 1M 輸入 token 為$0.09,每 1M 輸出 token 為$0.75——比 Google 的$0.30 / $2.50牌價約低 70%。典型的一輪對話(1K 輸入、300 輸出)約為 $0.0003。

Gemini 比 Claude 或 GPT 便宜嗎?

Gemini 2.5 Flash 是目前最便宜且具備良好能力的模型之一——在大量工作負載下,價格低於 Claude Haiku 和大多數 GPT 級別。請在定價頁面比較完整表格。

如何降低 Gemini API 成本?

降級使用 Flash、限制輸出、精簡擷取的上下文,並進行批次處理。詳情請見成本最佳化指南。若要開始呼叫 Gemini,請參閱取得 Gemini API 金鑰指南。