Gemini 在前沿 AI 中屬於性價比最高的選項之一,而 Kunavo 在單一 OpenAI 相容 API 背後提供它,價格比 Google 官方價格便宜約 70%。本指南將說明目前各模型的費率、可自行驗證的成本計算範例,以及在生產環境中以最低成本呼叫 Gemini 的方法。
Gemini 價格一覽
費率以 Kunavo 的收費標準計算,單位為每 1M 個 token 的 USD。「Google 官方價格」欄位列出同一模型的 Google 公開費率,方便一眼比較差異。
| 模型 | 輸入 / 1M | 輸出 / 1M | Google 官方價格(輸入 / 輸出) | 節省比例 |
|---|---|---|---|---|
gemini-2-5-flash | $0.09 | $0.75 | $0.30 / $2.50 | ~70% |
gemini-3-1-pro | $0.70 | $4.20 | $2.00 / $12.00 | ~65% |
Flash 是大量處理的主力模型,Pro 適合較困難的推理、視覺與長上下文工作。即時費率請一律在 價格頁面與各模型頁面確認(gemini-2-5-flash、gemini-3-1-pro)。
Gemini token 價格如何運作
您需要為輸入 token(傳送的所有內容——系統提示、檢索到的上下文、使用者訊息)與輸出 token(模型生成的內容)付費。由於輸出較昂貴,因此影響 Gemini 帳單最大的因素,是您允許模型寫出多少內容。影像與音訊會轉換為 token 等值,並在同一計量器中計費。
成本計算範例
以下是依 Kunavo 的 Gemini 2.5 Flash 費率計算的實際數值,只有最後一列使用 Gemini 3.1 Pro:
| 工作 | token(輸入 / 輸出) | 模型 | 成本 |
|---|---|---|---|
| 聊天機器人單輪 | 1,000 / 300 | Flash | $0.0003 |
| RAG 回答 | 8,000 / 500 | Flash | $0.0011 |
| 批次分類(每份文件) | 500 / 20 | Flash | $0.00006 |
| 長上下文分析 | 20,000 / 2,000 | Pro | $0.0224 |
依此費率,用 Flash 分類 10 萬份文件的批次作業約需 $6,聊天機器人 100 萬輪約需 $315。可自行執行的計算式:
# Kunavo Gemini 2.5 Flash 요율 (1M 토큰당 USD)
IN_RATE, OUT_RATE = 0.09, 0.75
def cost(in_tokens: int, out_tokens: int) -> float:
return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE
print(cost(1_000, 300)) # 챗봇 한 턴 -> $0.000315
print(cost(8_000, 500)) # RAG 답변 한 건 -> $0.001095
print(cost(500, 20) * 100_000) # 10만 건 배치 -> ~$6.00Kunavo 價格與 Stripe 付款
沒有訂閱,也不需要 Google Cloud 專案。儲值餘額後(使用 Stripe 或當地付款方式),每次呼叫都會依上述每 token 費率從餘額扣款。從最低 $10 儲值起按用量付費,餘額永不過期,且儲值金額越高,獲得的獎勵額度越多。Gemini、Claude、GPT、影像、影片、音訊等所有模型都使用同一筆餘額,因此無需逐一核對不同供應商的帳單。
應選擇哪個 Gemini 模型?
- gemini-2-5-flash——聊天、擷取、分類、摘要與大多數 RAG 工作的預設選擇。速度快,是最便宜的高效能選項。
- gemini-3-1-pro——當 Flash 的準確度不足時選擇:多階段推理、程式碼、視覺與極長上下文。
良好的模式是依難度進行路由:一般情況使用 Flash,只有驗證失敗時才升級至 Pro。以程式碼實作的路由模式請參閱 AI 成本最佳化指南。
降低 Gemini 帳單
- 降低模型等級。將簡單的 80% 工作交給 Flash,保留 Pro 處理困難的 20%。
- 限制輸出。設定
max_tokens與停止序列——輸出是計量器中較昂貴的一側。 - 減少輸入。不要將整個知識庫硬塞進上下文,改為檢索更少但品質更高的 RAG 區塊。
- 進行批次處理。將獨立呼叫分組,以降低延遲並避免重試暴增。
常見問題
Gemini API 是免費的嗎?
Google AI Studio 提供適合原型製作的免費方案(有請求限制)。在生產環境中,則按 token 計費。Kunavo 從最低 $10 儲值開始按用量付費,依下列費率按 token 支付,餘額永不過期,也不需要 Google Cloud 計費帳戶。
Gemini 2.5 Flash 的費用是多少?
在 Kunavo 中,Gemini 2.5 Flash 的費率為每 1M 個輸入 token $0.09、每 1M 個輸出 token $0.75,比 Google 官方價格 $0.30 / $2.50 便宜約 70%。一般聊天機器人的單輪請求(輸入 1K、輸出 300)約為 $0.0003。
Gemini 比 Claude 或 GPT 便宜嗎?
Gemini 2.5 Flash 是各處最便宜的高效能模型之一,在大量工作中價格低於 Claude Haiku 與大多數 GPT 等級。Claude 方面的單價與付款方式請參閱 Claude API 價格與付款整理;完整表格請在 價格頁面比較。
如何降低 Gemini API 成本?
改用 Flash 等級、限制輸出、縮減搜尋內容並進行批次處理。詳細內容請參閱 成本最佳化指南。若要開始呼叫 Gemini,請參閱 如何取得 Gemini API 金鑰。