Gemini 是頂尖 AI 中性價比最高的模型之一,而 Kunavo 透過單一相容 OpenAI 的 API,以約低於 Google 牌價 70% 的價格提供 Gemini。本指南包含目前各模型的費率、可自行驗證的費用範例,以及在正式環境中呼叫 Gemini 的最低成本方式。
Gemini API 價格概覽
費率以 USD 計算,每 1M token 為一個單位,依 Kunavo 的實際收費為準。「Google 牌價」欄位是 Google 公布的相同模型費率,用於顯示兩者差異。
| 模型 | 輸入/1M | 輸出/1M | Google 牌價(輸入/輸出) | 您可節省 |
|---|---|---|---|---|
gemini-2-5-flash | $0.09 | $0.75 | $0.30 / $2.50 | ~70% |
gemini-3-1-pro | $0.70 | $4.20 | $2.00 / $12.00 | ~65% |
Flash 是高流量工作的主力;Pro 適合更複雜的推理、視覺與長上下文工作。即時費率一律顯示於價格頁面及各模型頁面(gemini-2-5-flash、gemini-3-1-pro)。
Gemini 的 token 計價方式
您需要支付輸入 token(您傳送的所有內容——系統提示、擷取的上下文、使用者訊息)與輸出 token(模型生成的內容)。輸出是較昂貴的一側,因此 Gemini 帳單最主要的影響因素,是您允許模型寫出多少文字。圖片與音訊會轉換為相應的 token,並以相同計量器計費。
費用計算範例
以下是使用 Kunavo Gemini 2.5 Flash 費率的實際數字,最後一列除外,該列使用 Gemini 3.1 Pro:
| 工作負載 | Token(輸入/輸出) | 模型 | 費用 |
|---|---|---|---|
| 聊天機器人回合 | 1.000 / 300 | Flash | $0.0003 |
| RAG 回應 | 8.000 / 500 | Flash | $0.0011 |
| 批次分類(每份文件) | 500 / 20 | Flash | $0.00006 |
| 長上下文分析 | 20.000 / 2.000 | Pro | $0.0224 |
依照這些費率,在 Flash 上批次分類 100.000 份文件的費用約為 $6,一百萬次聊天機器人回合約為 $315。以下是可直接執行的計算方式:
# Tarifas do Kunavo para o Gemini 2.5 Flash (USD por 1M de tokens)
IN_RATE, OUT_RATE = 0.09, 0.75
def custo(tokens_entrada: int, tokens_saida: int) -> float:
return tokens_entrada / 1_000_000 * IN_RATE + tokens_saida / 1_000_000 * OUT_RATE
print(custo(1_000, 300)) # uma rodada de chatbot -> $0.000315
print(custo(8_000, 500)) # uma resposta de RAG -> $0.001095
print(custo(500, 20) * 100_000) # lote de 100k documentos -> ~$6.00Kunavo 價格與 Stripe 計費
沒有訂閱,也不需要 Google Cloud 專案。您可以將餘額加入錢包(Stripe 或當地付款方式),每次呼叫都會按照上述 token 費率從餘額中扣款。隨用隨付最低儲值金額為$10,餘額永不過期,較大額的儲值還可獲得獎勵額度。一個錢包涵蓋 Gemini 及所有其他模型——Claude、GPT、圖片、影片與音訊——因此不必分別核對各供應商的帳單。
我應該選擇哪個 Gemini 模型?
- gemini-2-5-flash——聊天、擷取、分類、摘要及大多數 RAG 工作的預設選擇。速度快,且是最實惠的高能力選項。
- gemini-3-1-pro——當 Flash 的準確度不足時使用:多步驟推理、程式碼、視覺與超長上下文。
良好的模式是依難度進行路由:一般案例使用 Flash,只有在檢查失敗時才升級至 Pro。請參閱AI 成本最佳化指南,了解程式碼中的路由模式。
降低 Gemini 帳單的方法
- 降低方案等級。將 80% 的簡單工作交給 Flash;將 Pro 保留給 20% 的困難工作。
- 限制輸出。設定
max_tokens與停止序列——輸出是計量器中較昂貴的一側。 - 精簡輸入。選取較少但更好的 RAG 片段,而不是將整個知識庫塞入上下文。
- 批次處理。合併彼此獨立的呼叫,以維持低延遲並避免重試風暴。
常見問題
Gemini API 免費嗎?
Google AI Studio 提供具速率限制的免費方案,適合原型開發。正式環境則按 token 計費。Kunavo 採用隨用隨付模式,最低儲值金額為 $10——您按以下費率支付 token 費用,餘額永不過期,也不需要 Google Cloud 計費帳戶。
Gemini 2.5 Flash 的價格是多少?
在 Kunavo,Gemini 2.5 Flash 的輸入價格為每 1M token $0.09,輸出價格為每 1M token $0.75——約比 Google 的牌價 $0.30/$2.50 低 70%。一次一般的聊天機器人回合(1K 輸入、300 輸出)費用約為 $0.0003。
Gemini 比 Claude 或 GPT 便宜嗎?
Gemini 2.5 Flash 是目前最實惠的高能力模型之一——在高流量工作負載下,價格低於 Claude Haiku 及大多數 GPT 方案。請在價格頁面比較完整表格。
如何降低 Gemini API 成本?
使用 Flash、限制輸出、精簡擷取的內容,並採用批次處理。詳細資訊請參閱成本最佳化指南。若要開始呼叫 Gemini,請參閱如何取得 Gemini API 金鑰。