Gemini 在頂尖 AI 中具有出色的性價比,而 Kunavo 透過單一 OpenAI 相容 API,以約比 Google 公開定價低 70%的價格提供 Gemini。本篇Gemini API 費用指南列出各模型目前的費率,提供可驗算的成本範例,並說明在正式環境中呼叫 Gemini 的最低成本方式。
Gemini 費用一覽
費率以 USD 計算,每 1M token 為單位,依 Kunavo 的實際計費方式列出。「Google 公開定價」欄是 Google 對相同模型公布的費率,用來讓你看出差異。
| 模型 | 輸入 / 1M | 輸出 / 1M | Google 公開定價(輸入 / 輸出) | 您的節省金額 |
|---|---|---|---|---|
gemini-2-5-flash | $0.09 | $0.75 | $0.30 / $2.50 | ~70% |
gemini-3-1-pro | $0.70 | $4.20 | $2.00 / $12.00 | ~65% |
Flash 是大量用量的主力;Pro 適合較困難的推理、視覺與長上下文任務。即時費率一律列於費用頁面及各模型頁面(gemini-2-5-flash、gemini-3-1-pro)。
Gemini 的 token 計費方式
你需要為輸入 token(你傳送的所有內容——系統提示、檢索到的上下文、使用者訊息)以及輸出 token(模型生成的內容)付費。輸出是較昂貴的一側,因此 Gemini 帳單中最大的成本槓桿,是控制讓模型產生多少文字。圖片與音訊會轉換為等值 token,並以同一計數器計費。
完整成本範例
以下是 Kunavo Gemini 2.5 Flash 費率的實際數字,最後一列除外,該列使用 Gemini 3.1 Pro:
| 工作負載 | Token(輸入 / 輸出) | 模型 | 成本 |
|---|---|---|---|
| 聊天機器人回合 | 1.000 / 300 | Flash | $0.0003 |
| RAG 回答 | 8.000 / 500 | Flash | $0.0011 |
| 批次分類(每份文件) | 500 / 20 | Flash | $0.00006 |
| 長上下文分析 | 20.000 / 2.000 | Pro | $0.0224 |
依照這些費率,使用 Flash 對 100,000 份文件執行分類批次約需 $6,一百萬次聊天機器人回合約需 $315。可直接執行的計算如下:
# Kunavo-Tarife für Gemini 2.5 Flash (USD pro 1M Tokens)
IN_RATE, OUT_RATE = 0.09, 0.75
def kosten(in_tokens: int, out_tokens: int) -> float:
return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE
print(kosten(1_000, 300)) # ein Chatbot-Turn -> $0.000315
print(kosten(8_000, 500)) # eine RAG-Antwort -> $0.001095
print(kosten(500, 20) * 100_000) # Batch mit 100k Docs -> ~$6.00Kunavo 價格與 Stripe 計費
沒有訂閱,也不需要 Google Cloud 專案。你可以儲值(透過 Stripe 或當地付款方式),呼叫費用會依上述 token 費率從餘額中扣除。採隨用隨付,最低儲值 $10;餘額永不過期,較大額的儲值還會獲得額外贈金。一個餘額可用於 Gemini 與其他所有模型——Claude、GPT、圖片、影片與音訊,因此不必逐一核對各提供商的獨立帳單。
應該選擇哪個 Gemini 模型?
- gemini-2-5-flash——聊天、擷取、分類、摘要與大部分 RAG 的預設選擇。速度快,也是最便宜的高效能選項。
- gemini-3-1-pro——當 Flash 的準確度不足時使用:多步驟推理、程式碼、視覺與超長上下文。
一個好的模式是依難度進行路由:一般情況使用 Flash,只有在檢查失敗時才升級至 Pro。程式碼中的路由方式請參閱AI 成本最佳化指南。
降低 Gemini 帳單的方法
- 降級。將簡單任務的 80% 交給 Flash;把 Pro 保留給較困難的 20%。
- 限制輸出。設定
max_tokens與停止序列——輸出是計費計數器中較昂貴的一側。 - 精簡輸入。擷取較少但品質更好的 RAG 區塊,不要將整個知識庫塞進上下文。
- 使用批次處理。將彼此獨立的呼叫集中處理,以降低延遲並避免重試風暴。
同一把金鑰也能呼叫 Google 的影片模型——每段影片的費用請參閱Veo 3 費用,與 OpenAI 的比較請參閱OpenAI API 費用。
常見問題
Gemini API 免費嗎?
Google AI Studio 提供有速率限制的免費層,適合原型開發。正式環境則按 token 付費。Kunavo 採用隨用隨付,最低儲值 $10——你會按以下費率逐 token 付費,餘額永不過期,也不需要 Google Cloud 帳單帳戶。
Gemini 2.5 Flash 的費用是多少?
在 Kunavo 上,Gemini 2.5 Flash 的費用為每 1M 輸入 token $0.09,每 1M 輸出 token $0.75——約比 Google 公開定價 $0.30 / $2.50 低 70%。典型的聊天機器人回合(1K 輸入、300 輸出)約為 $0.0003。
Gemini 比 Claude 或 GPT 便宜嗎?
Gemini 2.5 Flash 是整體上最具成本效益的高效能模型之一——在大量用量下,價格低於 Claude Haiku 與大多數 GPT 層級。請在費用頁面查看完整表格進行比較。
如何降低 Gemini API 的費用?
降級使用 Flash、限制輸出、精簡檢索到的上下文,並使用批次處理。詳細資訊請參閱成本最佳化指南。若要開始呼叫 Gemini,請參閱如何建立 Gemini API 金鑰。