返回指南
價格·2026年7月10日·更新於 2026年10月3日·閱讀約 8 分鐘

Gemini API 價格 2026 — 按模型計費、費用範例與更便宜的存取方式

Gemini 是尖端 AI 中性價比最高的選擇之一。以下介紹各模型目前的價格——依模型而定,比 Google 牌價低 30 至 70%——並提供費用範例,以及在正式環境中呼叫 Gemini 最便宜的方式。

Gemini 提供頂尖 AI 中最優異的性價比之一,而 Kunavo 透過單一 OpenAI 相容 API,將其以低於 Google 官方價格約 70%的費率提供。本Gemini API 價格指南列出目前各模型的費率、可自行重算的成本範例,以及在生產環境中以最低成本呼叫 Gemini 的方式。

Gemini 價格一覽

費率以 USD/每百萬 token 表示,依 Kunavo 實際收取的價格計算。「Google 價格」欄是 Google 對相同模型公布的費率,方便直接比較。

模型輸入 / 1M輸出 / 1MGoogle 價格(輸入 / 輸出)節省金額
gemini-2-5-flash$0.09$0.75$0.30 / $2.50~70 %
gemini-3-1-pro$0.70$4.20$2.00 / $12.00~65 %

Flash 適合大量處理;Pro 適合更困難的推理、視覺與長上下文。即時費率一律顯示在價格頁面及各模型頁面(gemini-2-5-flash、gemini-3-1-pro)。

Gemini 的 token 計費方式

你需要支付輸入 token(你傳送的所有內容——系統提示詞、擷取的上下文、使用者訊息)和輸出 token(模型生成的內容)。輸出較昂貴,因此 Gemini 帳單中最大的節省槓桿,就是限制模型生成的文字量。圖片和音訊會轉換為等效 token,並以相同計數器計費。

詳細成本範例

以下數字採用 Kunavo 的 Gemini 2.5 Flash 費率,最後一列除外,該列使用 Gemini 3.1 Pro:

工作負載Token(輸入 / 輸出)模型成本
聊天機器人一輪對話1 000 / 300Flash$0.0003
RAG 回答8 000 / 500Flash$0.0011
批次分類(每份文件)500 / 20Flash$0.00006
長上下文分析20 000 / 2 000Pro$0.0224

按此費率,使用 Flash 分類 100,000 份文件約需 $6,一百萬輪聊天機器人對話約需 $315。可執行的計算方式如下:

gemini_cout.py
# Tarifs Kunavo pour Gemini 2.5 Flash (USD par 1M de tokens)
IN_RATE, OUT_RATE = 0.09, 0.75

def cout(in_tokens: int, out_tokens: int) -> float:
    return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE

print(cout(1_000, 300))            # un tour de chatbot     -> $0.000315
print(cout(8_000, 500))            # une réponse RAG        -> $0.001095
print(cout(500, 20) * 100_000)     # lot de 100k documents  -> ~$6.00

Kunavo 計價與 Stripe 計費

沒有訂閱,也不需要 Google Cloud 專案。您可以儲值餘額(卡片、Apple Pay、Google Pay、Link),API 呼叫會依上述 token 費率扣款。按用量付費,最低儲值金額為 $10,餘額永不過期,較大額的儲值還會提供贈送額度。價格以 USD 計價,由 Stripe 在結帳時換算為 EUR(該匯率包含由您負擔的 2% 至 4% 換匯手續費;以 USD 付款可避免該費用);B2B 交易在提供歐盟共同體內交易 VAT 編號的情況下適用反向課稅。單一餘額即可涵蓋 Gemini 及所有其他模型——Claude、GPT、影像、影片與音訊——無需按供應商逐一核對發票。

該選哪個 Gemini 模型?

  • gemini-2-5-flash——聊天、擷取、分類、摘要及大多數 RAG 工作的預設選擇。速度快,也是能力足夠的最低價選項。
  • gemini-3-1-pro——當 Flash 的精準度不足時使用:多步驟推理、程式碼、視覺及超長上下文。

一個實用的模式是依難度進行路由:預設使用 Flash,只有在驗證失敗時才升級到 Pro。程式碼實作請參閱 AI 成本最佳化指南。

如何降低 Gemini 費用

  1. 降級使用。 將占全部任務 80% 的簡單任務交給 Flash;把 Pro 保留給占 20% 的困難任務。
  2. 限制輸出。 設定 max_tokens 和停止序列——輸出是計費中較昂貴的一側。
  3. 精簡輸入。 取得更少但更相關的 RAG 區塊,不要把整個知識庫塞進上下文。
  4. 批次處理。 將彼此獨立的呼叫分批,保持低延遲並避免重試風暴。

同一組金鑰也能呼叫 Google 的影片模型——每支影片的價格詳見 Veo 3 價格。

常見問題

Gemini API 是免費的嗎?

Google AI Studio 提供受速率限制的免費方案,適合原型開發。在生產環境中,則按 token 付費。Kunavo 採隨用隨付,最低儲值金額為 $10——依下列費率按 token 付費,餘額永不過期,也不需要 Google Cloud 計費帳戶。

Gemini 2.5 Flash 要多少錢?

在 Kunavo,Gemini 2.5 Flash 每 1M input token 收費 $0.09,每 1M output token 收費 $0.75——比 Google 官方價格($0.30 / $2.50)低約 70%。一般聊天機器人一輪對話(1K input、300 output)約為 $0.0003。

Gemini 比 Claude 或 GPT 便宜嗎?

Gemini 2.5 Flash 是市場上能力與價格兼具的低價模型之一——低於 Claude Haiku,也低於大多數高用量 GPT 層級。請在價格頁面比較完整表格,並在Claude API 價格指南查看 Claude 費率。

如何降低 Gemini API 成本?

改用 Flash、限制輸出、減少擷取的上下文,以及批次處理。詳細資訊請參閱成本最佳化指南。若要開始呼叫 Gemini,請參閱如何取得 Gemini API 金鑰。