Gemini 屬於最具性價比的頂尖 AI 模型,而 Kunavo 透過單一 OpenAI 相容 API,將其定價為比 Google 的官方牌價低約 70%。本指南提供各模型目前的價格、可自行驗證的成本範例,以及在正式環境中呼叫 Gemini 的最低成本方式。
Gemini API 價格快速覽
價格以每 1 百萬個 token 計算,單位為 USD,並依 Kunavo 的實際計費方式呈現。「Google 牌價」欄顯示 Google 為相同模型公布的價格,供你查看差額。
| 模型 | 輸入/每 1 百萬 | 輸出/每 1 百萬 | Google 牌價(輸入/輸出) | 你的節省金額 |
|---|---|---|---|---|
gemini-2-5-flash | $0.09 | $0.75 | $0.30 / $2.50 | ~70% |
gemini-3-1-pro | $0.70 | $4.20 | $2.00 / $12.00 | ~65% |
Flash 是大量工作負載的「主力」;Pro 則用於更困難的推理、視覺與長上下文工作。即時價格會顯示在價格頁面和每個模型的頁面(gemini-2-5-flash、gemini-3-1-pro)。
Gemini 的 token 計價方式
你需要支付輸入 token(你傳送的所有內容——系統提示、擷取的上下文、使用者訊息)和輸出 token(模型產生的內容)。輸出是較昂貴的部分,因此影響 Gemini 帳單最大的槓桿,就是你讓模型產生多少文字。影像與音訊會轉換為等效 token,並使用同一計量方式計費。
預先計算的成本範例
依 Kunavo 的 Gemini 2.5 Flash 價格計算的實際數字,最後一列使用 Gemini 3.1 Pro:
| 工作負載 | Token(輸入/輸出) | 模型 | 成本 |
|---|---|---|---|
| 聊天機器人回合 | 1.000 / 300 | Flash | $0.0003 |
| RAG 回答 | 8.000 / 500 | Flash | $0.0011 |
| 批次分類(每份文件) | 500 / 20 | Flash | $0.00006 |
| 長上下文分析 | 20.000 / 2.000 | Pro | $0.0224 |
依照這些價格,在 Flash 上批次分類 100,000 份文件約需 $6,而 100 萬次聊天機器人回合約需 $315。計算方式如下,可直接執行:
# Mức giá Kunavo cho Gemini 2.5 Flash (USD trên mỗi 1 triệu token)
IN_RATE, OUT_RATE = 0.09, 0.75
def chi_phi(token_vao: int, token_ra: int) -> float:
return token_vao / 1_000_000 * IN_RATE + token_ra / 1_000_000 * OUT_RATE
print(chi_phi(1_000, 300)) # một lượt chatbot -> $0.000315
print(chi_phi(8_000, 500)) # một câu trả lời RAG -> $0.001095
print(chi_phi(500, 20) * 100_000) # lô 100k tài liệu -> ~$6.00Kunavo 價格與 Stripe 付款
沒有訂閱方案,也不需要 Google Cloud 專案。你將餘額存入錢包(Stripe 或本地付款方式),每次呼叫都會依上述 token 費率從中扣款。從最低 $10 儲值開始採隨用隨付,餘額永不過期,且較高額的儲值會獲得獎勵額度。一個錢包涵蓋 Gemini 及所有其他模型——Claude、GPT、影像、影片和音訊——因此不必分別核對每個供應商的帳單。
我應該選擇哪個 Gemini 模型?
- gemini-2-5-flash——聊天、擷取、分類、摘要及大多數 RAG 工作的預設選擇。速度快,而且是最便宜、能力足夠強的選項。
- gemini-3-1-pro——只有在 Flash 的準確率不足時才使用:多步驟推理、程式設計、視覺與超長上下文。
良好的模式是依難度路由:常見案例使用 Flash,只有在某個檢查失敗時才升級至 Pro。請參閱AI 成本最佳化指南,了解程式碼中的路由模式。
降低 Gemini 帳單的方法
- 降級。 將 80% 的簡單工作交給 Flash;把 Pro 留給 20% 的困難工作。
- 限制輸出。 設定
max_tokens和停止序列——輸出是計量中較昂貴的部分。 - 精簡輸入。 擷取較少但品質更高的 RAG 片段,而不是把整個知識庫塞進上下文。
- 批次處理。 將獨立呼叫分組,以維持低延遲並避免重試風暴。
常見問題
Gemini API 免費嗎?
Google AI Studio 有一個受速率限制的免費方案,適合製作原型。上線正式環境後,則按 token 付費。Kunavo 從最低 $10 儲值開始採隨用隨付——你按下方費率以 token 付費,餘額永不過期,也不需要 Google Cloud 計費帳戶。
Gemini 2.5 Flash 的價格是多少?
在 Kunavo 上,Gemini 2.5 Flash 的價格為每 1 百萬個輸入 token $0.09,以及每 1 百萬個輸出 token $0.75——比 Google 的官方牌價 $0.30/$2.50 低約 70%。一般聊天機器人請求(1k 輸入、300 輸出)的成本約為 $0.0003。
Gemini 比 Claude 或 GPT 便宜嗎?
Gemini 2.5 Flash 是目前任何地方最便宜、且能力足夠強的模型之一——對大量工作負載而言,比 Claude Haiku 和大多數 GPT 方案都便宜。請在價格頁面比較完整表格。
如何降低 Gemini API 成本?
降級至 Flash、限制輸出、精簡擷取的上下文,並進行批次處理。詳細說明請參閱成本最佳化指南。若要開始呼叫 Gemini,請參閱如何取得 Gemini API 金鑰。