返回指南
價格·2026年6月18日·更新於 2026年9月12日·閱讀約 8 分鐘

Gemini API 價格 2026 — 按模型計費、費用範例與更便宜的 OpenAI 相容存取方式

Gemini 是尖端 AI 中性價比最佳的產品之一。查看各模型目前的費率——約比 Google 牌價低 70%——以及費用範例和在正式環境中以最低成本呼叫 Gemini 的方式。

Gemini 是頂尖 AI 中性價比最高的模型之一,而 Kunavo 透過單一相容 OpenAI 的 API,以約低於 Google 牌價 70% 的價格提供 Gemini。本指南包含目前各模型的費率、可自行驗證的費用範例,以及在正式環境中呼叫 Gemini 的最低成本方式。

Gemini API 價格概覽

費率以 USD 計算,每 1M token 為一個單位,依 Kunavo 的實際收費為準。「Google 牌價」欄位是 Google 公布的相同模型費率,用於顯示兩者差異。

模型輸入/1M輸出/1MGoogle 牌價(輸入/輸出)您可節省
gemini-2-5-flash$0.09$0.75$0.30 / $2.50~70%
gemini-3-1-pro$0.70$4.20$2.00 / $12.00~65%

Flash 是高流量工作的主力;Pro 適合更複雜的推理、視覺與長上下文工作。即時費率一律顯示於價格頁面及各模型頁面(gemini-2-5-flash、gemini-3-1-pro)。

Gemini 的 token 計價方式

您需要支付輸入 token(您傳送的所有內容——系統提示、擷取的上下文、使用者訊息)與輸出 token(模型生成的內容)。輸出是較昂貴的一側,因此 Gemini 帳單最主要的影響因素,是您允許模型寫出多少文字。圖片與音訊會轉換為相應的 token,並以相同計量器計費。

費用計算範例

以下是使用 Kunavo Gemini 2.5 Flash 費率的實際數字,最後一列除外,該列使用 Gemini 3.1 Pro:

工作負載Token(輸入/輸出)模型費用
聊天機器人回合1.000 / 300Flash$0.0003
RAG 回應8.000 / 500Flash$0.0011
批次分類(每份文件)500 / 20Flash$0.00006
長上下文分析20.000 / 2.000Pro$0.0224

依照這些費率,在 Flash 上批次分類 100.000 份文件的費用約為 $6,一百萬次聊天機器人回合約為 $315。以下是可直接執行的計算方式:

gemini_custo.py
# Tarifas do Kunavo para o Gemini 2.5 Flash (USD por 1M de tokens)
IN_RATE, OUT_RATE = 0.09, 0.75

def custo(tokens_entrada: int, tokens_saida: int) -> float:
    return tokens_entrada / 1_000_000 * IN_RATE + tokens_saida / 1_000_000 * OUT_RATE

print(custo(1_000, 300))            # uma rodada de chatbot   -> $0.000315
print(custo(8_000, 500))            # uma resposta de RAG     -> $0.001095
print(custo(500, 20) * 100_000)     # lote de 100k documentos -> ~$6.00

Kunavo 價格與 Stripe 計費

沒有訂閱,也不需要 Google Cloud 專案。您可以將餘額加入錢包(Stripe 或當地付款方式),每次呼叫都會按照上述 token 費率從餘額中扣款。隨用隨付最低儲值金額為$10,餘額永不過期,較大額的儲值還可獲得獎勵額度。一個錢包涵蓋 Gemini 及所有其他模型——Claude、GPT、圖片、影片與音訊——因此不必分別核對各供應商的帳單。

我應該選擇哪個 Gemini 模型?

  • gemini-2-5-flash——聊天、擷取、分類、摘要及大多數 RAG 工作的預設選擇。速度快,且是最實惠的高能力選項。
  • gemini-3-1-pro——當 Flash 的準確度不足時使用:多步驟推理、程式碼、視覺與超長上下文。

良好的模式是依難度進行路由:一般案例使用 Flash,只有在檢查失敗時才升級至 Pro。請參閱AI 成本最佳化指南,了解程式碼中的路由模式。

降低 Gemini 帳單的方法

  1. 降低方案等級。將 80% 的簡單工作交給 Flash;將 Pro 保留給 20% 的困難工作。
  2. 限制輸出。設定 max_tokens 與停止序列——輸出是計量器中較昂貴的一側。
  3. 精簡輸入。選取較少但更好的 RAG 片段,而不是將整個知識庫塞入上下文。
  4. 批次處理。合併彼此獨立的呼叫,以維持低延遲並避免重試風暴。

常見問題

Gemini API 免費嗎?

Google AI Studio 提供具速率限制的免費方案,適合原型開發。正式環境則按 token 計費。Kunavo 採用隨用隨付模式,最低儲值金額為 $10——您按以下費率支付 token 費用,餘額永不過期,也不需要 Google Cloud 計費帳戶。

Gemini 2.5 Flash 的價格是多少?

在 Kunavo,Gemini 2.5 Flash 的輸入價格為每 1M token $0.09,輸出價格為每 1M token $0.75——約比 Google 的牌價 $0.30/$2.50 低 70%。一次一般的聊天機器人回合(1K 輸入、300 輸出)費用約為 $0.0003。

Gemini 比 Claude 或 GPT 便宜嗎?

Gemini 2.5 Flash 是目前最實惠的高能力模型之一——在高流量工作負載下,價格低於 Claude Haiku 及大多數 GPT 方案。請在價格頁面比較完整表格。

如何降低 Gemini API 成本?

使用 Flash、限制輸出、精簡擷取的內容,並採用批次處理。詳細資訊請參閱成本最佳化指南。若要開始呼叫 Gemini,請參閱如何取得 Gemini API 金鑰。