返回指南
費用·2026年9月11日·閱讀約 9 分鐘

Gemini API 費用 2026 — 免費層級、各模型價格與 Gemini 3.8 Flash

「Gemini 費用」其實是三件事:免費層級、app 訂閱、API 按 token 計費。這頁把三件事分開,列出各模型現在的價格,並老實標出哪一個型號在 Google 直接買比較便宜。

Gemini API 的費用按 token 計算,沒有月費。想先免費試,Google AI Studio 有附速率限制的免費層級; 要上線就按每 1M token 付費,輸入、輸出各有費率。2026年9月11日,Kunavo 的 Gemini 3.8 Flash 是輸入 $0.525 / 輸出 $2.625 —— Google 自己的 3.x Flash 目前收限時優惠價 $0.75 / $3.75(到 2026 年 12 月 31 日, 2027 年起恢復 $1.50 / $7.50 標準價),Kunavo 比這個優惠價再低約 30%。上一代的 Gemini 2.5 Flash 是 $0.09 / $0.75,Gemini 3.1 Pro 是 $0.70 / $4.20

有一個例外要先講:Gemini 3.6 Flash。它在 Kunavo 是 $1.05 / $5.25比 Google 優惠價高約 40% —— 優惠期間直接向 Google 呼叫比較便宜。3.7 與 3.8 Flash 都比它新,也都比它便宜,所以不要因為價格選 3.6

費率於2026年9月11日核對。Google 的官方價格與免費層級說明見 ai.google.dev/gemini-api/docs/pricing;Kunavo 這一側的數字由本站模型目錄描繪,和 API 實際計費的金額一致。

「Gemini 費用」其實是三件事

路線付什麼有沒有 API 金鑰適合誰
免費層級(Google AI Studio)$0,有速率限制有(受限)試做、學習、個人小工具
Google AI 訂閱(Gemini app 的 Pro / Ultra)固定月費沒有只在 Gemini app 裡用,不寫程式
API 按量計費按 token,沒有月費接進產品、批次處理、要控管成本

最常見的誤會在中間那一列:訂了 Google AI Pro,API 額度不會變多。app 的月費和開發者用的 API 是兩套帳,要從程式呼叫, 一樣得用免費層級或按 token 付費。反過來說,如果你只是自己在 Gemini app 裡聊天、不寫程式,免費版或訂閱就夠了,不需要 API。

Gemini API 免費嗎?免費層級能做什麼

有免費層級,而且真的是 $0:在 Google AI Studio 建立金鑰,在速率限制內呼叫不收費,拿來試模型、做原型綽綽有餘。 限制的具體數字由 Google 依自己的狀況調整,這頁不轉述會過期的數字 —— 請看 Google 的定價頁 速率限制說明

它的界線也很清楚:速率限制撐不住正式流量,而且數字隨時會變, 所以要上線就得付費。Kunavo 沒有免費額度, 相對地也沒有月費 —— 預付餘額最低 $10,用多少扣多少, 沒呼叫的月份是 $0。

Gemini API 價格 —— 各模型每 1M token

模型Kunavo 輸入Kunavo 輸出Google 官方(輸入 / 輸出)對比 Google 現在的價格
Gemini 3.8 Flash$0.525$2.625優惠價 $0.75 / $3.75(2027 起 $1.50 / $7.50比 Google 優惠價低約 30%
Gemini 3.7 Flash$0.525$2.625優惠價 $0.75 / $3.75(2027 起 $1.50 / $7.50比 Google 優惠價低約 30%
Gemini 3.6 Flash$1.05$5.25優惠價 $0.75 / $3.75(2027 起 $1.50 / $7.50比 Google 優惠價高約 40%
Gemini 3.1 Pro$0.70$4.20$2.00 / $12.00約省 65%
Gemini 2.5 Flash$0.09$0.75$0.30 / $2.50約省 70%

3.x Flash 那三列比的是 Google 今天實際收的優惠價, 不是 2027 年的標準價。拿標準價來比,數字會好看得多, 但那不是你現在付給 Google 的價格。Gemini 3.1 Pro 另有一條規則:單次請求的提示超過 200K token 時,整個請求改按 2 倍輸入 / 1.5 倍輸出計費。各型號的規格在 Gemini 3.8 Flash Gemini 3.1 Pro Gemini 2.5 Flash 的模型頁,全部費率在 價格頁

Gemini 3.8 Flash 價格 —— 一次請求實際多少錢

費率表不如直接看一次請求。以下全部由上表的費率算出:

用途token(輸入 / 輸出)3.8 Flash(Kunavo)3.8 Flash(Google 優惠價)2.5 Flash3.1 Pro
聊天一輪1,000 / 300$0.0013$0.0019$0.00031$0.002
RAG 回答一次8,000 / 500$0.0055$0.0079$0.0011$0.0077
長文件分析一次20,000 / 2,000$0.016$0.022$0.0033$0.022
10 萬筆文件分類500 / 20 × 100,000$31.50$45.00$6.00$43.40

一個會讓帳單往上跑的地方:思考 token。Gemini 3.x Flash 與 3.1 Pro 都會先「思考」再回答, 思考 token 不會出現在回覆內容裡,但按輸出費率計費。 上表沒有把它算進去,所以難題的實際金額會比表格高 —— 以回應裡 usage 的輸出 token 數為準。用你自己的數字算:

gemini_cost.py
# Gemini API 的費用,直接用實際 token 數算。
# 費率為每 1M token USD:(input, output)
RATES = {
    "gemini-3-8-flash": (0.525, 2.625),
    "gemini-3-1-pro":   (0.70, 4.20),
    "gemini-2-5-flash": (0.09, 0.75),
}

def cost(model, inp, out):
    i, o = RATES[model]
    return inp / 1e6 * i + out / 1e6 * o  # 思考 token 按輸出費率計

print(cost("gemini-3-8-flash", 8_000, 500))         # RAG 回答一次
print(cost("gemini-2-5-flash", 500, 20) * 100_000)  # 10 萬筆分類

用現有的 OpenAI SDK 呼叫 Gemini

Kunavo 是 OpenAI 相容的端點:換掉 base_url 和金鑰,model 填 Gemini 的型號就能動,不需要 Google Cloud 專案或帳單帳戶。 同一把金鑰也能呼叫 Claude、GPT 與圖片、影片模型。

gemini_kunavo.py
from openai import OpenAI

client = OpenAI(
    api_key="sk-kn-...",
    base_url="https://api.kunavo.com/v1",  # 只改這一行
)

resp = client.chat.completions.create(
    model="gemini-3-8-flash",
    messages=[{"role": "user", "content": "用三句話說明什麼是 token"}],
)
print(resp.choices[0].message.content)
print(resp.usage)  # 這次請求計費用的 token 數

完整步驟在 快速開始; 想直接向 Google 申請金鑰的話,看 Gemini API 金鑰的取得方式(英文)。

老實說:什麼情況直接找 Google 比較好

  • 需要保證配額或 SLA。閘道使用的是共用容量:沒有專屬配額,也沒有合約保證的 SLA。 到了需要這兩樣的規模,請直接向 Google 申請。
  • 只能用 Gemini 3.6 Flash。優惠期間 Google 直接收的比 Kunavo 便宜。
  • 只在 app 裡聊天。不寫程式的話,免費版或 Google AI 訂閱就夠了,API 用不上。

反過來,要一把金鑰同時呼叫 Gemini、Claude 和 GPT, 不想開 Google Cloud 帳單,或想用預付餘額把成本鎖住, 就是這條路的用途。

在台灣付款

直接向 Google 付費,要在 Google Cloud 為專案開啟帳單並綁定國際信用卡。Kunavo 的餘額走 Stripe,支援含 JCB 的卡(Visa、Mastercard、American Express、JCB、 UnionPay)與 Apple Pay,預付制、最低儲值 $10餘額不會過期,失敗的請求不計費; 一次儲值 $100 以上另有加贈($100 入帳 $110)。

台灣沒有本地支付通道 ——街口、LINE Pay 都不在可用清單上,刷國際卡是唯一的路。 計費細節在 計費文件

把 Gemini 的費用降下來

  1. 先選對型號。要 3.x 世代就用 3.8 或 3.7 Flash,它們比 3.6 新也比 3.6 便宜;分類、抽取這類大量的簡單工作,交給 2.5 Flash。
  2. 叫模型寫短一點。輸出比輸入貴,在提示裡指定輸出格式和長度,效果最直接。
  3. 少塞脈絡。RAG 取少而準的片段,不要把整個知識庫送進去 —— 每次都整份當輸入計費。
  4. 3.1 Pro 的提示壓在 200K token 以下。超過就是整個請求 2 倍輸入 / 1.5 倍輸出。

路由的寫法在 AI 成本最佳化指南(英文)。想用同一個算法比較其他廠商的話,看 OpenAI API 費用 Claude 費用

常見問題

Gemini API 的費用是多少?

Gemini API 按 token 計費、沒有月費,輸入和輸出各有費率。2026年9月11日,Kunavo 每 1M token 的費率是 Gemini 3.8 Flash 輸入 $0.525 / 輸出 $2.625、Gemini 3.1 Pro $0.70 / $4.20、Gemini 2.5 Flash $0.09 / $0.75。Google 自己的 3.x Flash 目前收限時優惠價 $0.75 / $3.75(到 2026 年 12 月 31 日,2027 年起為 $1.50 / $7.50)。另外 Google AI Studio 有附速率限制的免費層級,可以先免費試。

Gemini API 可以免費用嗎?

可以試,但不適合拿來上線。Google AI Studio 提供附速率限制的免費層級,在限制內呼叫是 $0;限制的數字由 Google 調整,請以 Google 的 Gemini API 定價頁為準。正式流量需要付費:直接向 Google 付費,或走按 token 計費的閘道。Kunavo 沒有免費額度,但也沒有月費 —— 預付餘額最低 $10,用多少扣多少,沒呼叫的月份是 $0。

Gemini 3.8 Flash 的價格是多少?

2026年9月11日,Kunavo 的 Gemini 3.8 Flash 是每 1M token 輸入 $0.525 / 輸出 $2.625。Google 目前對 3.x Flash 收限時優惠價 $0.75 / $3.75,到 2026 年 12 月 31 日為止,Kunavo 比 Google 優惠價低約 30%;2027 年 1 月 1 日起 Google 恢復 $1.50 / $7.50 的標準價。一次 RAG 回答(輸入 8,000 / 輸出 500 token)在 Kunavo 約 $0.0055。

Gemini 3.6 Flash 還值得用嗎?

不建議因為價格選它。Kunavo 的 Gemini 3.6 Flash 是 $1.05 / $5.25,比 Google 優惠價高約 40%,所以在優惠期間直接向 Google 呼叫 3.6 反而比較便宜。3.7 Flash 與 3.8 Flash 都比 3.6 新,在 Kunavo 也比 3.6 便宜($0.525 / $2.625),除非你的程式非 3.6 不可,換成較新的型號就好。

訂了 Google AI Pro,可以用 Gemini API 嗎?

不行。Gemini app 的付費訂閱(Google AI Pro / Ultra)和開發者用的 Gemini API 是兩個產品、兩套計費,月費裡沒有 API 額度,也不會附 API 金鑰。要從程式呼叫,一樣得用免費層級或按 token 付費;反過來,有 API 金鑰也不會讓 app 那邊的功能變多。

不開 Google Cloud 帳單帳戶,可以用 Gemini API 嗎?

可以透過 OpenAI 相容的閘道呼叫。在 Kunavo,同一把 sk-kn- 開頭的金鑰就能呼叫 Gemini,不需要 Google Cloud 專案或帳單帳戶,Claude 和 GPT 也在同一個餘額裡。代價是這條路使用共用容量:沒有專屬配額,也沒有合約保證的 SLA。需要保證配額或 SLA 的規模,應該直接向 Google 申請。

在台灣要怎麼付 Gemini API 的費用?

直接向 Google 付費,要在 Google Cloud 為專案開啟帳單並綁定國際信用卡。Kunavo 走 Stripe 預付:支援 Visa、Mastercard、American Express、JCB、UnionPay 與 Apple Pay,最低儲值 $10,餘額不會過期,失敗的請求不計費。台灣沒有本地支付通道 —— 街口、LINE Pay 都不在可用清單上。