Gemini 提供頂尖 AI 中最優異的性價比之一,而 Kunavo 透過單一 OpenAI 相容 API,將其以低於 Google 官方價格約 70%的費率提供。本Gemini API 價格指南列出目前各模型的費率、可自行重算的成本範例,以及在生產環境中以最低成本呼叫 Gemini 的方式。
Gemini 價格一覽
費率以 USD/每百萬 token 表示,依 Kunavo 實際收取的價格計算。「Google 價格」欄是 Google 對相同模型公布的費率,方便直接比較。
| 模型 | 輸入 / 1M | 輸出 / 1M | Google 價格(輸入 / 輸出) | 節省金額 |
|---|---|---|---|---|
gemini-2-5-flash | $0.09 | $0.75 | $0.30 / $2.50 | ~70 % |
gemini-3-1-pro | $0.70 | $4.20 | $2.00 / $12.00 | ~65 % |
Flash 適合大量處理;Pro 適合更困難的推理、視覺與長上下文。即時費率一律顯示在價格頁面及各模型頁面(gemini-2-5-flash、gemini-3-1-pro)。
Gemini 的 token 計費方式
你需要支付輸入 token(你傳送的所有內容——系統提示詞、擷取的上下文、使用者訊息)和輸出 token(模型生成的內容)。輸出較昂貴,因此 Gemini 帳單中最大的節省槓桿,就是限制模型生成的文字量。圖片和音訊會轉換為等效 token,並以相同計數器計費。
詳細成本範例
以下數字採用 Kunavo 的 Gemini 2.5 Flash 費率,最後一列除外,該列使用 Gemini 3.1 Pro:
| 工作負載 | Token(輸入 / 輸出) | 模型 | 成本 |
|---|---|---|---|
| 聊天機器人一輪對話 | 1 000 / 300 | Flash | $0.0003 |
| RAG 回答 | 8 000 / 500 | Flash | $0.0011 |
| 批次分類(每份文件) | 500 / 20 | Flash | $0.00006 |
| 長上下文分析 | 20 000 / 2 000 | Pro | $0.0224 |
按此費率,使用 Flash 分類 100,000 份文件約需 $6,一百萬輪聊天機器人對話約需 $315。可執行的計算方式如下:
# Tarifs Kunavo pour Gemini 2.5 Flash (USD par 1M de tokens)
IN_RATE, OUT_RATE = 0.09, 0.75
def cout(in_tokens: int, out_tokens: int) -> float:
return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE
print(cout(1_000, 300)) # un tour de chatbot -> $0.000315
print(cout(8_000, 500)) # une réponse RAG -> $0.001095
print(cout(500, 20) * 100_000) # lot de 100k documents -> ~$6.00Kunavo 計價與 Stripe 計費
沒有訂閱,也不需要 Google Cloud 專案。您可以儲值餘額(卡片、Apple Pay、Google Pay、Link),API 呼叫會依上述 token 費率扣款。按用量付費,最低儲值金額為 $10,餘額永不過期,較大額的儲值還會提供贈送額度。價格以 USD 計價,由 Stripe 在結帳時換算為 EUR(該匯率包含由您負擔的 2% 至 4% 換匯手續費;以 USD 付款可避免該費用);B2B 交易在提供歐盟共同體內交易 VAT 編號的情況下適用反向課稅。單一餘額即可涵蓋 Gemini 及所有其他模型——Claude、GPT、影像、影片與音訊——無需按供應商逐一核對發票。
該選哪個 Gemini 模型?
- gemini-2-5-flash——聊天、擷取、分類、摘要及大多數 RAG 工作的預設選擇。速度快,也是能力足夠的最低價選項。
- gemini-3-1-pro——當 Flash 的精準度不足時使用:多步驟推理、程式碼、視覺及超長上下文。
一個實用的模式是依難度進行路由:預設使用 Flash,只有在驗證失敗時才升級到 Pro。程式碼實作請參閱 AI 成本最佳化指南。
如何降低 Gemini 費用
- 降級使用。 將占全部任務 80% 的簡單任務交給 Flash;把 Pro 保留給占 20% 的困難任務。
- 限制輸出。 設定
max_tokens和停止序列——輸出是計費中較昂貴的一側。 - 精簡輸入。 取得更少但更相關的 RAG 區塊,不要把整個知識庫塞進上下文。
- 批次處理。 將彼此獨立的呼叫分批,保持低延遲並避免重試風暴。
同一組金鑰也能呼叫 Google 的影片模型——每支影片的價格詳見 Veo 3 價格。
常見問題
Gemini API 是免費的嗎?
Google AI Studio 提供受速率限制的免費方案,適合原型開發。在生產環境中,則按 token 付費。Kunavo 採隨用隨付,最低儲值金額為 $10——依下列費率按 token 付費,餘額永不過期,也不需要 Google Cloud 計費帳戶。
Gemini 2.5 Flash 要多少錢?
在 Kunavo,Gemini 2.5 Flash 每 1M input token 收費 $0.09,每 1M output token 收費 $0.75——比 Google 官方價格($0.30 / $2.50)低約 70%。一般聊天機器人一輪對話(1K input、300 output)約為 $0.0003。
Gemini 比 Claude 或 GPT 便宜嗎?
Gemini 2.5 Flash 是市場上能力與價格兼具的低價模型之一——低於 Claude Haiku,也低於大多數高用量 GPT 層級。請在價格頁面比較完整表格,並在Claude API 價格指南查看 Claude 費率。
如何降低 Gemini API 成本?
改用 Flash、限制輸出、減少擷取的上下文,以及批次處理。詳細資訊請參閱成本最佳化指南。若要開始呼叫 Gemini,請參閱如何取得 Gemini API 金鑰。