返回指南
價格·2026年6月18日·更新於 2026年9月12日·閱讀約 8 分鐘

Gemini API 價格 2026 — 各模型費用、範例與更便宜的相容 OpenAI 存取方式

Gemini 是頂尖 AI 中性價比最高的選擇之一。以下介紹目前各模型的價格——約比 Google 公開價格低 70%——以及費用範例和在正式環境中呼叫 Gemini 的最低成本方式。

Gemini 屬於最具性價比的頂尖 AI 模型,而 Kunavo 透過單一 OpenAI 相容 API,將其定價為比 Google 的官方牌價低約 70%。本指南提供各模型目前的價格、可自行驗證的成本範例,以及在正式環境中呼叫 Gemini 的最低成本方式。

Gemini API 價格快速覽

價格以每 1 百萬個 token 計算,單位為 USD,並依 Kunavo 的實際計費方式呈現。「Google 牌價」欄顯示 Google 為相同模型公布的價格,供你查看差額。

模型輸入/每 1 百萬輸出/每 1 百萬Google 牌價(輸入/輸出)你的節省金額
gemini-2-5-flash$0.09$0.75$0.30 / $2.50~70%
gemini-3-1-pro$0.70$4.20$2.00 / $12.00~65%

Flash 是大量工作負載的「主力」;Pro 則用於更困難的推理、視覺與長上下文工作。即時價格會顯示在價格頁面和每個模型的頁面(gemini-2-5-flash、gemini-3-1-pro)。

Gemini 的 token 計價方式

你需要支付輸入 token(你傳送的所有內容——系統提示、擷取的上下文、使用者訊息)和輸出 token(模型產生的內容)。輸出是較昂貴的部分,因此影響 Gemini 帳單最大的槓桿,就是你讓模型產生多少文字。影像與音訊會轉換為等效 token,並使用同一計量方式計費。

預先計算的成本範例

依 Kunavo 的 Gemini 2.5 Flash 價格計算的實際數字,最後一列使用 Gemini 3.1 Pro:

工作負載Token(輸入/輸出)模型成本
聊天機器人回合1.000 / 300Flash$0.0003
RAG 回答8.000 / 500Flash$0.0011
批次分類(每份文件)500 / 20Flash$0.00006
長上下文分析20.000 / 2.000Pro$0.0224

依照這些價格,在 Flash 上批次分類 100,000 份文件約需 $6,而 100 萬次聊天機器人回合約需 $315。計算方式如下,可直接執行:

gemini_chi_phi.py
# Mức giá Kunavo cho Gemini 2.5 Flash (USD trên mỗi 1 triệu token)
IN_RATE, OUT_RATE = 0.09, 0.75

def chi_phi(token_vao: int, token_ra: int) -> float:
    return token_vao / 1_000_000 * IN_RATE + token_ra / 1_000_000 * OUT_RATE

print(chi_phi(1_000, 300))            # một lượt chatbot        -> $0.000315
print(chi_phi(8_000, 500))            # một câu trả lời RAG     -> $0.001095
print(chi_phi(500, 20) * 100_000)     # lô 100k tài liệu        -> ~$6.00

Kunavo 價格與 Stripe 付款

沒有訂閱方案,也不需要 Google Cloud 專案。你將餘額存入錢包(Stripe 或本地付款方式),每次呼叫都會依上述 token 費率從中扣款。從最低 $10 儲值開始採隨用隨付,餘額永不過期,且較高額的儲值會獲得獎勵額度。一個錢包涵蓋 Gemini 及所有其他模型——Claude、GPT、影像、影片和音訊——因此不必分別核對每個供應商的帳單。

我應該選擇哪個 Gemini 模型?

  • gemini-2-5-flash——聊天、擷取、分類、摘要及大多數 RAG 工作的預設選擇。速度快,而且是最便宜、能力足夠強的選項。
  • gemini-3-1-pro——只有在 Flash 的準確率不足時才使用:多步驟推理、程式設計、視覺與超長上下文。

良好的模式是依難度路由:常見案例使用 Flash,只有在某個檢查失敗時才升級至 Pro。請參閱AI 成本最佳化指南,了解程式碼中的路由模式。

降低 Gemini 帳單的方法

  1. 降級。 將 80% 的簡單工作交給 Flash;把 Pro 留給 20% 的困難工作。
  2. 限制輸出。 設定 max_tokens 和停止序列——輸出是計量中較昂貴的部分。
  3. 精簡輸入。 擷取較少但品質更高的 RAG 片段,而不是把整個知識庫塞進上下文。
  4. 批次處理。 將獨立呼叫分組,以維持低延遲並避免重試風暴。

常見問題

Gemini API 免費嗎?

Google AI Studio 有一個受速率限制的免費方案,適合製作原型。上線正式環境後,則按 token 付費。Kunavo 從最低 $10 儲值開始採隨用隨付——你按下方費率以 token 付費,餘額永不過期,也不需要 Google Cloud 計費帳戶。

Gemini 2.5 Flash 的價格是多少?

在 Kunavo 上,Gemini 2.5 Flash 的價格為每 1 百萬個輸入 token $0.09,以及每 1 百萬個輸出 token $0.75——比 Google 的官方牌價 $0.30/$2.50 低約 70%。一般聊天機器人請求(1k 輸入、300 輸出)的成本約為 $0.0003。

Gemini 比 Claude 或 GPT 便宜嗎?

Gemini 2.5 Flash 是目前任何地方最便宜、且能力足夠強的模型之一——對大量工作負載而言,比 Claude Haiku 和大多數 GPT 方案都便宜。請在價格頁面比較完整表格。

如何降低 Gemini API 成本?

降級至 Flash、限制輸出、精簡擷取的上下文,並進行批次處理。詳細說明請參閱成本最佳化指南。若要開始呼叫 Gemini,請參閱如何取得 Gemini API 金鑰。