返回指南
費用·2026年6月18日·更新於 2026年9月24日·閱讀約 9 分鐘

Gemini 價格【2026 年版】——免費額度、訂閱與 API 的模型費率

Gemini 的價格分為免費額度、訂閱與 API 按用量計費三種,訂閱不附 API 金鑰。以實際數字說明三者差異與各模型的 API 費率。

Gemini 的價格分為 3 種。免費額度(Google AI Studio 的 API 免費層,有速率限制,不適合正式環境)、Google 的訂閱(Gemini 應用程式的付費方案,月費固定,不附帶 API 金鑰),以及API 按量計費(以 token 為單位,沒有月費,不呼叫就是 $0)。這 3 種是彼此獨立的產品,並不是使用其中一種就能使用另一種。

開發者通常尋找的是第 3 種。Kunavo 提供該 API,價格約比 Google 官方價格低 70%。本頁介紹目前按模型區分的費率、可自行驗算的試算範例,以及在正式環境中以最低成本呼叫 Gemini 的方法。

如何區分 3 種價格

路徑支付的項目是否附帶 API 金鑰
免費額度(Google AI Studio)$0。有速率限制有(有限制)
訂閱(Gemini 應用程式的付費方案)月費固定沒有
API 按量計費以 token 為單位。沒有月費有

最常見的誤解是中間那一列。即使支付 Gemini 應用程式的付費方案,也不會增加 API 使用額度。應用程式月費與面向開發者的 API 是分開計費的;要從程式呼叫,無論如何都需要金鑰與按量計費(或免費額度)。免費額度的具體速率限制經常因 Google 方面的因素而變動,因此請在Google 官方文件中確認數字。這裡不詳述——若前提是部署到正式環境,無論如何都不應將免費額度列為選項。

Gemini 價格速查表

費率以每 1M token、USD 表示,代表在 Kunavo 收取的金額。「Google 官方價格」欄列出同一模型的 Google's 公布價格,方便比較差異。

模型輸入 / 1M輸出 / 1MGoogle 官方價格(輸入 / 輸出)節省比例
gemini-2-5-flash$0.09$0.75$0.30 / $2.50約 70%
gemini-3-1-pro$0.70$4.20$2.00 / $12.00約 65%

Flash 是大量處理的主力方案,Pro 則適合更複雜的推理、影像辨識與長上下文工作。最新費率一律顯示於價格頁面及各模型頁面(gemini-2-5-flash、gemini-3-1-pro)。

Gemini token 計費的運作方式

計費對象包括輸入 token(你傳送的所有內容——系統提示、取得的上下文與使用者訊息)以及輸出 token(模型生成的內容)。由於輸出費用較高,影響 Gemini 帳單的最大因素是「讓模型生成多少內容」。圖片與音訊會換算成 token,並以相同的計量方式計費。

試算範例

這些是依 Kunavo 的 Gemini 2.5 Flash 費率計算的實際數字。只有最後一列使用 Gemini 3.1 Pro。

工作負載Token(輸入 / 輸出)模型成本
聊天機器人單回合1,000 / 300Flash$0.0003
RAG 回答8,000 / 500Flash$0.0011
批次分類(每份文件)500 / 20Flash$0.00006
長上下文分析20,000 / 2,000Pro$0.0224

依照此費率,使用 Flash 進行 10 萬份文件的分類批次約為 $6,100 萬次聊天機器人對話約為 $315。計算公式可以直接執行。

gemini_cost.py
# Kunavo の Gemini 2.5 Flash 料率(1M トークンあたり、USD)
IN_RATE, OUT_RATE = 0.09, 0.75

def cost(in_tokens: int, out_tokens: int) -> float:
    return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE

print(cost(1_000, 300))            # チャットボット 1 ターン -> $0.000315
print(cost(8_000, 500))            # RAG の回答 1 件        -> $0.001095
print(cost(500, 20) * 100_000)     # 10 万件のバッチ処理     -> 約 $6.00

Kunavo 的價格與 Stripe 付款

不需要訂閱,也不需要 Google Cloud 專案。儲值(使用 Stripe 或當地付款方式)後,每次呼叫都會按照上方的 token 單價從餘額扣款。這是從最低 $10 的儲值開始的按量計費,餘額不會過期,大額儲值還會附贈獎勵額度。Gemini 以及其他所有模型——Claude、GPT、圖片、影片、音訊——都共用同一個餘額,因此不需要逐一核對各供應商的帳單。

應該選擇哪個 Gemini 模型?

  • gemini-2-5-flash — 聊天、擷取、分類、摘要,以及大多數 RAG 工作的預設選擇。速度快,是最便宜的高效能選項。
  • gemini-3-1-pro — Flash 的準確度不足時使用。適合多階段推理、程式碼、影像辨識與極長上下文等工作。

依難度進行路由是很好的模式。常見案例交給 Flash 處理,只有在檢查失敗時才升級到 Pro。含程式碼的路由模式請參閱AI 成本最佳化指南。

降低 Gemini 帳單金額

  1. 降低方案層級。 將簡單的 80% 工作交給 Flash,保留 Pro 處理較困難的 20%。
  2. 限制輸出。 設定 max_tokens 與停止序列——輸出是計量表中價格較高的一側。
  3. 縮小輸入。 不要把整個知識庫塞進上下文,而是取得少量且品質良好的 RAG 片段。
  4. 進行批次處理。 將獨立的呼叫集中處理,降低延遲並避免重試風暴。

您也可以使用同一組金鑰呼叫 Google 的圖片與影片模型。每張圖片與每支影片的單價,請參閱 Nano Banana Pro 的價格與 Veo 3 的價格。

常見問題

Gemini 的價格是多少?

Gemini 的價格分為 3 種。Google AI Studio 的免費層($0,但有速率限制)、Gemini 應用程式的付費訂閱(月費固定,不包含 API 金鑰),以及 API 的按量計費(以 token 為單位,沒有月費)。如果要從程式呼叫,就是第 3 種;Kunavo 的費率為每 1M token,Gemini 2.5 Flash 輸入 $0.09 / 輸出 $0.75,gemini-3-1-pro 則為 $0.70 / $4.20 — 分別比 Google 的官方價格約便宜 70% / 65。

Gemini Pro 的價格是多少?

gemini-3-1-pro 在 Kunavo 的價格為每 1M token 輸入 $0.70 / 輸出 $4.20,相較於 Google 官方價格 $2.00 / $12.00 約便宜 65%。輸入 20,000、輸出 2,000 token 的單次請求約為 $0.0224。Pro 適合複雜推理、影像辨識與長上下文工作;大量處理時,將方案層級降為 Flash 可以便宜一個數量級。

Gemini 可以免費使用嗎?

Google AI Studio 提供 Gemini API 的免費層,在速率限制範圍內可以以 $0 呼叫。這對原型製作已足夠,但速率限制會因 Google 方面的因素而變動,且不足以應付正式環境流量,因此若前提是部署到 production,就不應將其列為選項。Kunavo 沒有免費額度,但也沒有月費——費用只會從預付餘額中扣除實際使用的部分,未呼叫的月份就是 $0。

訂閱 Gemini 應用程式的付費方案後,也能使用 API 嗎?

不行。Gemini 應用程式的付費訂閱與面向開發者的 Gemini API 是不同產品、不同計費方式;月費不包含 API 使用額度,也不會附帶 API 金鑰。若要從程式呼叫,仍需另外準備金鑰與按量計費(或免費層)。反過來,即使擁有 API 金鑰,也不會增加應用程式端的功能。

Gemini 2.5 Flash 的價格是多少?

在 Kunavo,Gemini 2.5 Flash 的價格為每 1M 輸入 token $0.09、每 1M 輸出 token $0.75,比 Google 的官方價格 $0.30 / $2.50 約便宜 70%。一般聊天機器人的單回合(輸入 1K、輸出 300)約為 $0.0003。

Gemini 比 Claude 或 GPT 便宜嗎?

Gemini 2.5 Flash 無論與哪個模型相比,都屬於最便宜的高效能模型——在大量處理時,價格低於 Claude Haiku 和大多數 GPT 方案層級。完整比較表請參閱價格頁面。

如何降低 Gemini API 的成本?

將方案層級降為 Flash、限制輸出、縮小取得的上下文,並進行批次處理。詳細資訊請參閱成本最佳化指南。若要開始呼叫 Gemini,請參閱如何取得 Gemini API 金鑰。