Gemini 的價格分為 3 種。免費額度(Google AI Studio 的 API 免費層,有速率限制,不適合正式環境)、Google 的訂閱(Gemini 應用程式的付費方案,月費固定,不附帶 API 金鑰),以及API 按量計費(以 token 為單位,沒有月費,不呼叫就是 $0)。這 3 種是彼此獨立的產品,並不是使用其中一種就能使用另一種。
開發者通常尋找的是第 3 種。Kunavo 提供該 API,價格約比 Google 官方價格低 70%。本頁介紹目前按模型區分的費率、可自行驗算的試算範例,以及在正式環境中以最低成本呼叫 Gemini 的方法。
如何區分 3 種價格
| 路徑 | 支付的項目 | 是否附帶 API 金鑰 |
|---|---|---|
| 免費額度(Google AI Studio) | $0。有速率限制 | 有(有限制) |
| 訂閱(Gemini 應用程式的付費方案) | 月費固定 | 沒有 |
| API 按量計費 | 以 token 為單位。沒有月費 | 有 |
最常見的誤解是中間那一列。即使支付 Gemini 應用程式的付費方案,也不會增加 API 使用額度。應用程式月費與面向開發者的 API 是分開計費的;要從程式呼叫,無論如何都需要金鑰與按量計費(或免費額度)。免費額度的具體速率限制經常因 Google 方面的因素而變動,因此請在Google 官方文件中確認數字。這裡不詳述——若前提是部署到正式環境,無論如何都不應將免費額度列為選項。
Gemini 價格速查表
費率以每 1M token、USD 表示,代表在 Kunavo 收取的金額。「Google 官方價格」欄列出同一模型的 Google's 公布價格,方便比較差異。
| 模型 | 輸入 / 1M | 輸出 / 1M | Google 官方價格(輸入 / 輸出) | 節省比例 |
|---|---|---|---|---|
gemini-2-5-flash | $0.09 | $0.75 | $0.30 / $2.50 | 約 70% |
gemini-3-1-pro | $0.70 | $4.20 | $2.00 / $12.00 | 約 65% |
Flash 是大量處理的主力方案,Pro 則適合更複雜的推理、影像辨識與長上下文工作。最新費率一律顯示於價格頁面及各模型頁面(gemini-2-5-flash、gemini-3-1-pro)。
Gemini token 計費的運作方式
計費對象包括輸入 token(你傳送的所有內容——系統提示、取得的上下文與使用者訊息)以及輸出 token(模型生成的內容)。由於輸出費用較高,影響 Gemini 帳單的最大因素是「讓模型生成多少內容」。圖片與音訊會換算成 token,並以相同的計量方式計費。
試算範例
這些是依 Kunavo 的 Gemini 2.5 Flash 費率計算的實際數字。只有最後一列使用 Gemini 3.1 Pro。
| 工作負載 | Token(輸入 / 輸出) | 模型 | 成本 |
|---|---|---|---|
| 聊天機器人單回合 | 1,000 / 300 | Flash | $0.0003 |
| RAG 回答 | 8,000 / 500 | Flash | $0.0011 |
| 批次分類(每份文件) | 500 / 20 | Flash | $0.00006 |
| 長上下文分析 | 20,000 / 2,000 | Pro | $0.0224 |
依照此費率,使用 Flash 進行 10 萬份文件的分類批次約為 $6,100 萬次聊天機器人對話約為 $315。計算公式可以直接執行。
# Kunavo の Gemini 2.5 Flash 料率(1M トークンあたり、USD)
IN_RATE, OUT_RATE = 0.09, 0.75
def cost(in_tokens: int, out_tokens: int) -> float:
return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE
print(cost(1_000, 300)) # チャットボット 1 ターン -> $0.000315
print(cost(8_000, 500)) # RAG の回答 1 件 -> $0.001095
print(cost(500, 20) * 100_000) # 10 万件のバッチ処理 -> 約 $6.00Kunavo 的價格與 Stripe 付款
不需要訂閱,也不需要 Google Cloud 專案。儲值(使用 Stripe 或當地付款方式)後,每次呼叫都會按照上方的 token 單價從餘額扣款。這是從最低 $10 的儲值開始的按量計費,餘額不會過期,大額儲值還會附贈獎勵額度。Gemini 以及其他所有模型——Claude、GPT、圖片、影片、音訊——都共用同一個餘額,因此不需要逐一核對各供應商的帳單。
應該選擇哪個 Gemini 模型?
- gemini-2-5-flash — 聊天、擷取、分類、摘要,以及大多數 RAG 工作的預設選擇。速度快,是最便宜的高效能選項。
- gemini-3-1-pro — Flash 的準確度不足時使用。適合多階段推理、程式碼、影像辨識與極長上下文等工作。
依難度進行路由是很好的模式。常見案例交給 Flash 處理,只有在檢查失敗時才升級到 Pro。含程式碼的路由模式請參閱AI 成本最佳化指南。
降低 Gemini 帳單金額
- 降低方案層級。 將簡單的 80% 工作交給 Flash,保留 Pro 處理較困難的 20%。
- 限制輸出。 設定
max_tokens與停止序列——輸出是計量表中價格較高的一側。 - 縮小輸入。 不要把整個知識庫塞進上下文,而是取得少量且品質良好的 RAG 片段。
- 進行批次處理。 將獨立的呼叫集中處理,降低延遲並避免重試風暴。
您也可以使用同一組金鑰呼叫 Google 的圖片與影片模型。每張圖片與每支影片的單價,請參閱 Nano Banana Pro 的價格與 Veo 3 的價格。
常見問題
Gemini 的價格是多少?
Gemini 的價格分為 3 種。Google AI Studio 的免費層($0,但有速率限制)、Gemini 應用程式的付費訂閱(月費固定,不包含 API 金鑰),以及 API 的按量計費(以 token 為單位,沒有月費)。如果要從程式呼叫,就是第 3 種;Kunavo 的費率為每 1M token,Gemini 2.5 Flash 輸入 $0.09 / 輸出 $0.75,gemini-3-1-pro 則為 $0.70 / $4.20 — 分別比 Google 的官方價格約便宜 70% / 65。
Gemini Pro 的價格是多少?
gemini-3-1-pro 在 Kunavo 的價格為每 1M token 輸入 $0.70 / 輸出 $4.20,相較於 Google 官方價格 $2.00 / $12.00 約便宜 65%。輸入 20,000、輸出 2,000 token 的單次請求約為 $0.0224。Pro 適合複雜推理、影像辨識與長上下文工作;大量處理時,將方案層級降為 Flash 可以便宜一個數量級。
Gemini 可以免費使用嗎?
Google AI Studio 提供 Gemini API 的免費層,在速率限制範圍內可以以 $0 呼叫。這對原型製作已足夠,但速率限制會因 Google 方面的因素而變動,且不足以應付正式環境流量,因此若前提是部署到 production,就不應將其列為選項。Kunavo 沒有免費額度,但也沒有月費——費用只會從預付餘額中扣除實際使用的部分,未呼叫的月份就是 $0。
訂閱 Gemini 應用程式的付費方案後,也能使用 API 嗎?
不行。Gemini 應用程式的付費訂閱與面向開發者的 Gemini API 是不同產品、不同計費方式;月費不包含 API 使用額度,也不會附帶 API 金鑰。若要從程式呼叫,仍需另外準備金鑰與按量計費(或免費層)。反過來,即使擁有 API 金鑰,也不會增加應用程式端的功能。
Gemini 2.5 Flash 的價格是多少?
在 Kunavo,Gemini 2.5 Flash 的價格為每 1M 輸入 token $0.09、每 1M 輸出 token $0.75,比 Google 的官方價格 $0.30 / $2.50 約便宜 70%。一般聊天機器人的單回合(輸入 1K、輸出 300)約為 $0.0003。
Gemini 比 Claude 或 GPT 便宜嗎?
Gemini 2.5 Flash 無論與哪個模型相比,都屬於最便宜的高效能模型——在大量處理時,價格低於 Claude Haiku 和大多數 GPT 方案層級。完整比較表請參閱價格頁面。
如何降低 Gemini API 的成本?
將方案層級降為 Flash、限制輸出、縮小取得的上下文,並進行批次處理。詳細資訊請參閱成本最佳化指南。若要開始呼叫 Gemini,請參閱如何取得 Gemini API 金鑰。