這是截至 2026年9月 的 Google Gemini API 價格,以每百萬 token 計算,並將 Google 官方費率與同一模型在 Kunavo 的價格並列。Gemini 3.8 Flash是 Google 最新的 Flash,在 Kunavo 的價格為 $0.525輸入 / $2.625輸出——比 Google 在 2026年12月31日 前向其 3.x Flash 模型收取的優惠價 $0.75 / $3.75 低 30%,直到 2027年1月1日 開始採用標準 $1.50 / $7.50 費率為止。Gemini 3.1 Pro相對於 Google 的 $2.00 / $12.00 牌價為 $0.70 / $4.20,Gemini 2.5 Flash相對於 $0.30 / $2.50 為 $0.09 / $0.75——分別約低 65% 與 70%,全部透過一個 OpenAI 相容 API 使用。
費率最後驗證於 2026年9月12日。以下 Kunavo 的逐 token 價格即時讀取自模型目錄,「Google 牌價」欄追蹤 Google 公布的費率——官方來源為 ai.google.dev/gemini-api/docs/pricing。
Google 官方價格表與 Kunavo 比較——2026年9月
本頁每個 Gemini API 價格均以每百萬 token、美元計算,並依 Kunavo 帳單計費。「Google 牌價」欄是同一模型的 Google 官方公布費率,取自上述驗證日期的 ai.google.dev——因此此表在同一個檢視畫面中同時呈現官方價格表與折扣價格。對 Gemini 3.x Flash 模型,該欄顯示 Google 目前收取的優惠價,而「你節省」則以此為基準計算。
| 模型 | 輸入 / 1M | 輸出 / 1M | Google 牌價(輸入 / 輸出) | 節省金額 |
|---|---|---|---|---|
gemini-3-8-flash | $0.525 | $2.625 | $0.75 / $3.75 優惠價* | 相對優惠價* 30% |
gemini-3-7-flash | $0.525 | $2.625 | $0.75 / $3.75 優惠價* | 相對優惠價* 30% |
gemini-3-1-pro | $0.70 | $4.20 | $2.00 / $12.00 | ~65% |
gemini-2-5-flash | $0.09 | $0.75 | $0.30 / $2.50 | ~70% |
gemini-3-6-flash | $1.05 | $5.25 | $0.75 / $3.75 優惠價* | 無——高於優惠價* 40% |
*Google 在 2026年12月31日 前收取其 3.x Flash 模型的優惠價;其標準 $1.50 / $7.50 費率自 2027年1月1日 起適用。
Gemini 3.8 Flash是新工作的 Flash 首選,Gemini 2.5 Flash仍是高用量工作最便宜的選項,而 Pro 適合更困難的推理、視覺與長上下文工作。即時費率一律顯示於價格頁面及各模型頁面(gemini-3-8-flash、gemini-3-7-flash、gemini-3-1-pro、gemini-2-5-flash、gemini-3-6-flash)。
Gemini 3.8 Flash 價格與 Google 優惠價
Google 對其 Gemini 3.x Flash 模型——3.6、3.7 與 3.8 Flash——收取每百萬 token $0.75輸入 / $3.75輸出的優惠價,提供至 2026年12月31日,並自 2027年1月1日 起採用標準 $1.50 / $7.50。Kunavo 以每百萬 $0.525 / $2.625 銷售 Gemini 3.8 Flash,並以每百萬 $0.525 / $2.625 銷售 Gemini 3.7 Flash;目前比 Google 優惠價低 30%。Gemini 3.6 Flash是例外:其價格為 $1.05 / $5.25,比 Google 目前費率高 40%,因此應使用 3.7 與 3.8 Flash——兩者都較新且較便宜。
| 模型 | Kunavo(輸入/輸出) | Google 目前——優惠價至 2026年12月31日 | Google 自 2027年1月1日 起 | Kunavo 與 Google 目前價格比較 |
|---|---|---|---|---|
| Gemini 3.8 Flash | $0.525 / $2.625 | $0.75 / $3.75 | $1.50 / $7.50 | 便宜 30% |
| Gemini 3.7 Flash | $0.525 / $2.625 | $0.75 / $3.75 | $1.50 / $7.50 | 便宜 30% |
| Gemini 3.6 Flash | $1.05 / $5.25 | $0.75 / $3.75 | $1.50 / $7.50 | 昂貴 40% |
30% 的差距確實存在,但比 Gemini 3.1 Pro 或 Gemini 2.5 Flash 的差距小,因為 Google 本身會將 3.x Flash 折扣至 2027 年——因此請先比較再下結論。Kunavo 提供的是一個 OpenAI 相容金鑰,以及一個可用於 Gemini、Claude、GPT 和圖像與影片模型的預付 Stripe 餘額,不需要 Google Cloud 專案。但它不提供專用容量:Kunavo 使用共享容量,沒有專用配額,也沒有合約 SLA;如果你需要保證配額或 SLA,請直接向 Google 購買。
若要比較 Gemini Flash API 價格,應注意輸出:3.x Flash 模型具有思考能力,它們在回答前進行的推理會按輸出 token 計費。請讓 max_tokens 保持充足,並根據包含推理在內的輸出進行預算——Gemini 3 API 指南提供 3.6 Flash 的實測推理 token 數字,以及呼叫 gemini-3-8-flash 的程式碼。
Gemini API 如何按 token 計價
你需要支付輸入 token(你傳送的所有內容——系統提示、擷取的上下文、使用者訊息)和輸出 token(模型產生的內容)。輸出部分較昂貴,因此 Gemini 帳單最大的單一影響因素,就是你允許模型寫出多少文字。圖像與音訊會轉換為等效 token,並以相同計量方式計費。
實際成本範例
以 Kunavo 的 Gemini 2.5 Flash 費率計算,最後兩列除外;最後兩列使用 Gemini 3.8 Flash 與 Gemini 3.1 Pro:
| 工作負載 | Token(輸入 / 輸出) | 模型 | 成本 |
|---|---|---|---|
| 聊天機器人回合 | 1,000 / 300 | 2.5 Flash | $0.0003 |
| RAG 回答 | 8,000 / 500 | 2.5 Flash | $0.0011 |
| 批次分類(每份文件) | 500 / 20 | 2.5 Flash | $0.00006 |
| 代理程式步驟(輸出含推理) | 10,000 / 1,500 | 3.8 Flash | $0.0092(Google 優惠價:$0.0131) |
| 長上下文分析 | 20,000 / 2,000 | Pro | $0.0224 |
依這些費率,在 2.5 Flash 上執行一個包含 100,000 份文件的分類批次約需 $6,而一百萬次聊天機器人回合約需 $315。計算方式如下,可直接執行:
# Kunavo Gemini 2.5 Flash rates (USD per 1M tokens)
IN_RATE, OUT_RATE = 0.09, 0.75
def cost(in_tokens: int, out_tokens: int) -> float:
return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE
print(cost(1_000, 300)) # one chatbot turn -> $0.000315
print(cost(8_000, 500)) # one RAG answer -> $0.001095
print(cost(500, 20) * 100_000) # 100k-doc batch -> ~$6.00Kunavo 定價與 Stripe 計費
沒有訂閱,也不需要 Google Cloud 專案。你為餘額加值(Stripe 或當地付款方式),呼叫會依上述逐 token 費率從餘額扣除。隨用隨付最低加值金額為 $10,餘額永不過期,較大的加值金額會附帶紅利額度。失敗的請求永不計費。一個餘額涵蓋 Gemini 及所有其他模型——Claude、GPT、圖像、影片與音訊——因此不需要逐一核對每家供應商的獨立發票。
我應選擇哪個 Gemini 模型?
- gemini-3-8-flash——Google 最新的 Flash,於 2026 年 9 月 2 日發布,適合代理程式、程式設計及其他推理密集型工作,同時具備 Flash 延遲:每百萬 $0.525 / $2.625,比 Google 優惠價低 30%。
- gemini-3-7-flash——上一代 Flash(2026 年 8 月 13 日發布),價格為 $0.525 / $2.625;如果你的提示已在該模型上驗證,便繼續使用它。
- gemini-2-5-flash——聊天、擷取、分類、摘要及大多數 RAG 工作的預設模型。速度快且是能力足夠的最低價選項,價格為 $0.09 / $0.75。
- gemini-3-1-pro——當 Flash 的準確度不足時使用:多步驟推理、程式碼、視覺與極長上下文。
- 就價格而言,不要選 gemini-3-6-flash——價格為 $1.05 / $5.25,在 Kunavo 上高於 3.7 與 3.8 Flash,也高於 Google 自己的優惠價;僅在提示已於該模型上驗證時保留它。
良好的模式是依難度路由:一般情況使用 Flash,只有檢查失敗時才升級至 Pro。請參閱AI 成本最佳化指南以查看程式碼中的路由模式,並參閱Claude與GPT價格指南比較供應商。
降低 Gemini 帳單
- 降級。將容易的 80% 工作交給 Flash;保留 Pro 處理困難的 20%。
- 改用其他模型,取代 3.6 Flash。在 Kunavo,Gemini 3.8 Flash 的每 token 成本比 Gemini 3.6 Flash 低 50%,而且使用相同的 OpenAI 相容請求格式——只需替換模型名稱這一個詞。
- 限制輸出。設定
max_tokens與停止序列——輸出是計費表中昂貴的一側。 - 精簡輸入。擷取更少但更好的 RAG 區塊,不要把整個知識庫塞進上下文。
- 批次處理。將獨立呼叫分組,以降低延遲並避免重試風暴。
常見問題
Google 官方 Gemini API 價格在 2026年9月 是多少?
截至 2026年9月12日,Google 公布於 ai.google.dev/gemini-api/docs/pricing 的官方每 1M 權杖價格,Gemini 2.5 Flash 為輸入 $0.30/輸出 $2.50,Gemini 3.1 Pro 則為輸入 $2.00/輸出 $12.00。Google 的 3.x Flash 模型(Gemini 3.6、3.7 和 3.8 Flash)在 2026年12月31日 之前(含當日)採用輸入 $0.75/輸出 $3.75 的上市優惠價,並於 2027年1月1日 調漲至輸入 $1.50/輸出 $7.50 的標準價格。在 Kunavo,相同模型的價格為:Gemini 2.5 Flash 輸入 $0.09/輸出 $0.75(比 Google 定價低約 70%)、Gemini 3.1 Pro 輸入 $0.70/輸出 $4.20(比 Google 定價低約 65%),以及 Gemini 3.8 和 3.7 Flash 輸入 $0.525/輸出 $2.625(比 Google 上市優惠價低 30%)。
Gemini 3.8 Flash API 的費用是多少?
在 Kunavo,Gemini 3.8 Flash API 每百萬輸入 token 的費用為 $0.525,每百萬輸出 token 為 $2.625;推理 token 按輸出計費。Google 自己的 Gemini 3.8 Flash 價格為截至 2026年12月31日(含當日)的優惠價 $0.75 / $3.75,並自 2027年1月1日 起為 $1.50 / $7.50,因此 Kunavo 比 Google 目前的收費低 30%。Gemini 3.8 Flash 於 2026 年 9 月 2 日發布,是 Google 最新的 Flash 模型,在 Kunavo 的 OpenAI 相容端點上以 gemini-3-8-flash 呼叫。
透過 Kunavo 使用 Gemini 3.8 Flash 比較便宜嗎?
是。透過 Kunavo,Gemini 3.8 Flash 每百萬個 token 的費用為 $0.525 / $2.625,比 Google 截至 2026年12月31日(含當日)直接收取的 $0.75 / $3.75 優惠價低 30%;Gemini 3.7 Flash 的價格相同。由於 Google 自行對其 3.x Flash 模型提供折扣直到 2027 年,這個價差比 Gemini 3.1 Pro 或 2.5 Flash 更小。較低價格的代價是容量:Kunavo 使用共享容量,沒有專用配額,也沒有合約 SLA;因此需要保證配額或 SLA 的團隊應直接向 Google 購買。
這是 Google 官方價格表嗎?
不是——Google 在 ai.google.dev/gemini-api/docs/pricing 的頁面才是官方來源,本指南頂端也有連結。本頁重現那些官方牌價,註明驗證日期,並將 Kunavo 對同一模型的費率列在旁邊。Kunavo 是轉售這些模型的獨立閘道,不是 Google。
Gemini API 免費嗎?
Google AI Studio 提供受速率限制的免費層,適合原型開發。正式環境則按 token 付費。Kunavo 採隨用隨付,最低加值金額為 $10——你按以下費率逐 token 付費,餘額永不過期,也不需要 Google Cloud 計費帳戶。
Gemini 2.5 Flash 的費用是多少?
在 Kunavo,Gemini 2.5 Flash 每百萬輸入 token 為 $0.09,每百萬輸出 token 為 $0.75——約比 Google 的 $0.30 / $2.50 牌價低 70%。典型聊天機器人回合(1K 輸入、300 輸出)成本約為 $0.0003。
Gemini 3.1 Pro API 的費用是多少?
在 Kunavo,Gemini 3.1 Pro API 的價格為每百萬輸入 token $0.70、每百萬輸出 token $4.20——約比 Google 的 $2.00 / $12.00牌價低 65%。多步驟推理、視覺與長上下文請使用 Pro,而非 Flash。
Gemini 3.6 Flash API 的費用是多少?
在 Kunavo,Gemini 3.6 Flash 每百萬輸入 token 為 $1.05,每百萬輸出 token 為 $5.25。這比 Google 在 2026年12月31日 前收取的優惠價 $0.75 / $3.75 高 40%,因此目前直接向 Google 使用此模型較便宜。Gemini 3.8 Flash 與 3.7 Flash 是更划算的選擇:兩者都較新,在 Kunavo 的價格為 $0.525 / $2.625,比 Google 優惠價低 30%。Google 自 2027年1月1日 起的標準 Gemini 3.6 Flash 費率為 $1.50 / $7.50。
Gemini 比 Claude 或 GPT 便宜嗎?
Gemini 2.5 Flash 是目前任何地方最便宜且能力足夠的模型之一——對高用量工作而言,價格低於 Claude Haiku 與多數 GPT 層級。請在價格頁面比較完整表格。
如何降低 Gemini API 成本?
降級至 Flash,將任何 Gemini 3.6 Flash 流量移至 3.8 Flash,限制輸出、精簡擷取的上下文,並使用批次處理。詳情請參閱成本最佳化指南。若要開始呼叫 Gemini,請參閱如何取得 Gemini API 金鑰。