Gemini 是前沿 AI 中價格/效能最佳的選項之一,而 Kunavo 透過單一 OpenAI 相容 API,以約低於 Google 牌價 70 的價格提供 Gemini。本指南提供最新的模型費率、可自行驗證的成本計算範例,以及在正式環境中以最低成本呼叫 Gemini 的方式。
Gemini 定價一覽
費率依 Kunavo 的計費方式,以每 1M token、美元計算。「Google 牌價」欄位是同一模型由 Google 公布的費率,列出來是為了讓你看出差異。
| 模型 | 輸入/1M | 輸出/1M | Google 牌價(輸入/輸出) | 節省 |
|---|---|---|---|---|
gemini-2-5-flash | $0.09 | $0.75 | $0.30 / $2.50 | ~%70 |
gemini-3-1-pro | $0.70 | $4.20 | $2.00 / $12.00 | ~%65 |
Flash 適合高大量工作;Pro 則用於更困難的推理、視覺與長上下文工作。即時費率一律可在定價頁面及各模型頁面查看(gemini-2-5-flash、gemini-3-1-pro)。
Gemini token 定價如何運作
你需要為輸入 token(你傳送的所有內容——系統提示詞、擷取的上下文、使用者訊息)以及輸出 token(模型生成的內容)付費。輸出位於較昂貴的一側;因此 Gemini 帳單中最大的單一槓桿,就是你允許模型生成多少文字。圖片與音訊會轉換為 token 等值,並以同一計數器計費。
成本計算範例
除最後一列外,均使用 Kunavo 的 Gemini 2.5 Flash 費率計算實際數字;最後一列使用Gemini 3.1 Pro:
| 工作負載 | Token(輸入/輸出) | 模型 | 成本 |
|---|---|---|---|
| 對話回合 | 1.000 / 300 | Flash | $0.0003 |
| RAG 回答 | 8.000 / 500 | Flash | $0.0011 |
| 批次分類(每份文件) | 500 / 20 | Flash | $0.00006 |
| 長上下文分析 | 20.000 / 2.000 | Pro | $0.0224 |
依這些費率,在 Flash 上分類 100,000 份文件的批次約需$6,一百萬輪對話則約需$315。可執行的計算方式:
# Kunavo Gemini 2.5 Flash oranları (1M token başına USD)
IN_RATE, OUT_RATE = 0.09, 0.75
def cost(in_tokens: int, out_tokens: int) -> float:
return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE
print(cost(1_000, 300)) # bir sohbet turu -> $0.000315
print(cost(8_000, 500)) # bir RAG yanıtı -> $0.001095
print(cost(500, 20) * 100_000) # 100k belge yığını -> ~$6.00Kunavo 定價與 Stripe 計費
沒有訂閱,也不需要 Google Cloud 專案。你儲值餘額(可使用 Stripe 或當地付款方式),呼叫費用會依上述每 token 費率從餘額中扣除。最低儲值 $10,採隨用隨付,餘額永不過期,較大額儲值還會獲得獎勵額度。單一餘額涵蓋 Gemini 與所有其他模型——Claude、GPT、圖片、影片與音訊——因此不需要逐一核對各提供商的帳單。
我該選哪個 Gemini 模型?
- gemini-2-5-flash——聊天、擷取、分類、摘要及大多數 RAG 工作的預設選擇。快速且最便宜的高能力選項。
- gemini-3-1-pro——當 Flash 的準確度不足時使用:多步驟推理、程式碼、視覺與超長上下文。
一個好的模式是依難度進行路由:常見情況使用 Flash,檢查失敗時再升級至 Pro。程式碼中的路由模式請參閱AI 成本最佳化指南。
降低 Gemini 帳單
- 降低級別。將容易的 80% 工作交給 Flash;把 Pro 留給困難的 20%。
- 限制輸出。設定
max_tokens與停止序列——輸出是計數器中較昂貴的一側。 - 精簡輸入。與其把整個知識庫塞進上下文,不如擷取更少但更優質的 RAG 片段。
- 批次處理。將獨立請求分組,以維持低延遲並避免重試風暴。
常見問題
Gemini API 免費嗎?
Google AI Studio 提供受速率限制的免費層,適合原型開發。用於正式環境時,則按 token 計費。Kunavo 採用隨用隨付模式,最低儲值 $10——依下方費率按 token 付費,餘額永不過期,也不需要 Google Cloud 計費帳戶。
Gemini 2.5 Flash 多少錢?
在 Kunavo,Gemini 2.5 Flash 每 1M 輸入 token 為$0.09,每 1M 輸出 token 為$0.75——比 Google 的$0.30 / $2.50牌價約低 70%。典型的一輪對話(1K 輸入、300 輸出)約為 $0.0003。
Gemini 比 Claude 或 GPT 便宜嗎?
Gemini 2.5 Flash 是目前最便宜且具備良好能力的模型之一——在大量工作負載下,價格低於 Claude Haiku 和大多數 GPT 級別。請在定價頁面比較完整表格。
如何降低 Gemini API 成本?
降級使用 Flash、限制輸出、精簡擷取的上下文,並進行批次處理。詳情請見成本最佳化指南。若要開始呼叫 Gemini,請參閱取得 Gemini API 金鑰指南。