Gemini API 的費用按 token 計算,沒有月費。想先免費試,Google AI Studio 有附速率限制的免費層級; 要上線就按每 1M token 付費,輸入、輸出各有費率。2026年9月11日,Kunavo 的 Gemini 3.8 Flash 是輸入 $0.525 / 輸出 $2.625 —— Google 自己的 3.x Flash 目前收限時優惠價 $0.75 / $3.75(到 2026 年 12 月 31 日, 2027 年起恢復 $1.50 / $7.50 標準價),Kunavo 比這個優惠價再低約 30%。上一代的 Gemini 2.5 Flash 是 $0.09 / $0.75,Gemini 3.1 Pro 是 $0.70 / $4.20。
有一個例外要先講:Gemini 3.6 Flash。它在 Kunavo 是 $1.05 / $5.25,比 Google 優惠價高約 40% —— 優惠期間直接向 Google 呼叫比較便宜。3.7 與 3.8 Flash 都比它新,也都比它便宜,所以不要因為價格選 3.6。
費率於2026年9月11日核對。Google 的官方價格與免費層級說明見 ai.google.dev/gemini-api/docs/pricing;Kunavo 這一側的數字由本站模型目錄描繪,和 API 實際計費的金額一致。
「Gemini 費用」其實是三件事
| 路線 | 付什麼 | 有沒有 API 金鑰 | 適合誰 |
|---|---|---|---|
| 免費層級(Google AI Studio) | $0,有速率限制 | 有(受限) | 試做、學習、個人小工具 |
| Google AI 訂閱(Gemini app 的 Pro / Ultra) | 固定月費 | 沒有 | 只在 Gemini app 裡用,不寫程式 |
| API 按量計費 | 按 token,沒有月費 | 有 | 接進產品、批次處理、要控管成本 |
最常見的誤會在中間那一列:訂了 Google AI Pro,API 額度不會變多。app 的月費和開發者用的 API 是兩套帳,要從程式呼叫, 一樣得用免費層級或按 token 付費。反過來說,如果你只是自己在 Gemini app 裡聊天、不寫程式,免費版或訂閱就夠了,不需要 API。
Gemini API 免費嗎?免費層級能做什麼
有免費層級,而且真的是 $0:在 Google AI Studio 建立金鑰,在速率限制內呼叫不收費,拿來試模型、做原型綽綽有餘。 限制的具體數字由 Google 依自己的狀況調整,這頁不轉述會過期的數字 —— 請看 Google 的定價頁 與 速率限制說明。
它的界線也很清楚:速率限制撐不住正式流量,而且數字隨時會變, 所以要上線就得付費。Kunavo 沒有免費額度, 相對地也沒有月費 —— 預付餘額最低 $10,用多少扣多少, 沒呼叫的月份是 $0。
Gemini API 價格 —— 各模型每 1M token
| 模型 | Kunavo 輸入 | Kunavo 輸出 | Google 官方(輸入 / 輸出) | 對比 Google 現在的價格 |
|---|---|---|---|---|
| Gemini 3.8 Flash | $0.525 | $2.625 | 優惠價 $0.75 / $3.75(2027 起 $1.50 / $7.50) | 比 Google 優惠價低約 30% |
| Gemini 3.7 Flash | $0.525 | $2.625 | 優惠價 $0.75 / $3.75(2027 起 $1.50 / $7.50) | 比 Google 優惠價低約 30% |
| Gemini 3.6 Flash | $1.05 | $5.25 | 優惠價 $0.75 / $3.75(2027 起 $1.50 / $7.50) | 比 Google 優惠價高約 40% |
| Gemini 3.1 Pro | $0.70 | $4.20 | $2.00 / $12.00 | 約省 65% |
| Gemini 2.5 Flash | $0.09 | $0.75 | $0.30 / $2.50 | 約省 70% |
3.x Flash 那三列比的是 Google 今天實際收的優惠價, 不是 2027 年的標準價。拿標準價來比,數字會好看得多, 但那不是你現在付給 Google 的價格。Gemini 3.1 Pro 另有一條規則:單次請求的提示超過 200K token 時,整個請求改按 2 倍輸入 / 1.5 倍輸出計費。各型號的規格在 Gemini 3.8 Flash、 Gemini 3.1 Pro、 Gemini 2.5 Flash 的模型頁,全部費率在 價格頁。
Gemini 3.8 Flash 價格 —— 一次請求實際多少錢
費率表不如直接看一次請求。以下全部由上表的費率算出:
| 用途 | token(輸入 / 輸出) | 3.8 Flash(Kunavo) | 3.8 Flash(Google 優惠價) | 2.5 Flash | 3.1 Pro |
|---|---|---|---|---|---|
| 聊天一輪 | 1,000 / 300 | $0.0013 | $0.0019 | $0.00031 | $0.002 |
| RAG 回答一次 | 8,000 / 500 | $0.0055 | $0.0079 | $0.0011 | $0.0077 |
| 長文件分析一次 | 20,000 / 2,000 | $0.016 | $0.022 | $0.0033 | $0.022 |
| 10 萬筆文件分類 | 500 / 20 × 100,000 | $31.50 | $45.00 | $6.00 | $43.40 |
一個會讓帳單往上跑的地方:思考 token。Gemini 3.x Flash 與 3.1 Pro 都會先「思考」再回答, 思考 token 不會出現在回覆內容裡,但按輸出費率計費。 上表沒有把它算進去,所以難題的實際金額會比表格高 —— 以回應裡 usage 的輸出 token 數為準。用你自己的數字算:
# Gemini API 的費用,直接用實際 token 數算。
# 費率為每 1M token USD:(input, output)
RATES = {
"gemini-3-8-flash": (0.525, 2.625),
"gemini-3-1-pro": (0.70, 4.20),
"gemini-2-5-flash": (0.09, 0.75),
}
def cost(model, inp, out):
i, o = RATES[model]
return inp / 1e6 * i + out / 1e6 * o # 思考 token 按輸出費率計
print(cost("gemini-3-8-flash", 8_000, 500)) # RAG 回答一次
print(cost("gemini-2-5-flash", 500, 20) * 100_000) # 10 萬筆分類用現有的 OpenAI SDK 呼叫 Gemini
Kunavo 是 OpenAI 相容的端點:換掉 base_url 和金鑰,model 填 Gemini 的型號就能動,不需要 Google Cloud 專案或帳單帳戶。 同一把金鑰也能呼叫 Claude、GPT 與圖片、影片模型。
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1", # 只改這一行
)
resp = client.chat.completions.create(
model="gemini-3-8-flash",
messages=[{"role": "user", "content": "用三句話說明什麼是 token"}],
)
print(resp.choices[0].message.content)
print(resp.usage) # 這次請求計費用的 token 數完整步驟在 快速開始; 想直接向 Google 申請金鑰的話,看 Gemini API 金鑰的取得方式(英文)。
老實說:什麼情況直接找 Google 比較好
- 需要保證配額或 SLA。閘道使用的是共用容量:沒有專屬配額,也沒有合約保證的 SLA。 到了需要這兩樣的規模,請直接向 Google 申請。
- 只能用 Gemini 3.6 Flash。優惠期間 Google 直接收的比 Kunavo 便宜。
- 只在 app 裡聊天。不寫程式的話,免費版或 Google AI 訂閱就夠了,API 用不上。
反過來,要一把金鑰同時呼叫 Gemini、Claude 和 GPT, 不想開 Google Cloud 帳單,或想用預付餘額把成本鎖住, 就是這條路的用途。
在台灣付款
直接向 Google 付費,要在 Google Cloud 為專案開啟帳單並綁定國際信用卡。Kunavo 的餘額走 Stripe,支援含 JCB 的卡(Visa、Mastercard、American Express、JCB、 UnionPay)與 Apple Pay,預付制、最低儲值 $10、餘額不會過期,失敗的請求不計費; 一次儲值 $100 以上另有加贈($100 入帳 $110)。
台灣沒有本地支付通道 ——街口、LINE Pay 都不在可用清單上,刷國際卡是唯一的路。 計費細節在 計費文件。
把 Gemini 的費用降下來
- 先選對型號。要 3.x 世代就用 3.8 或 3.7 Flash,它們比 3.6 新也比 3.6 便宜;分類、抽取這類大量的簡單工作,交給 2.5 Flash。
- 叫模型寫短一點。輸出比輸入貴,在提示裡指定輸出格式和長度,效果最直接。
- 少塞脈絡。RAG 取少而準的片段,不要把整個知識庫送進去 —— 每次都整份當輸入計費。
- 3.1 Pro 的提示壓在 200K token 以下。超過就是整個請求 2 倍輸入 / 1.5 倍輸出。
路由的寫法在 AI 成本最佳化指南(英文)。想用同一個算法比較其他廠商的話,看 OpenAI API 費用 與 Claude 費用。
常見問題
Gemini API 的費用是多少?
Gemini API 按 token 計費、沒有月費,輸入和輸出各有費率。2026年9月11日,Kunavo 每 1M token 的費率是 Gemini 3.8 Flash 輸入 $0.525 / 輸出 $2.625、Gemini 3.1 Pro $0.70 / $4.20、Gemini 2.5 Flash $0.09 / $0.75。Google 自己的 3.x Flash 目前收限時優惠價 $0.75 / $3.75(到 2026 年 12 月 31 日,2027 年起為 $1.50 / $7.50)。另外 Google AI Studio 有附速率限制的免費層級,可以先免費試。
Gemini API 可以免費用嗎?
可以試,但不適合拿來上線。Google AI Studio 提供附速率限制的免費層級,在限制內呼叫是 $0;限制的數字由 Google 調整,請以 Google 的 Gemini API 定價頁為準。正式流量需要付費:直接向 Google 付費,或走按 token 計費的閘道。Kunavo 沒有免費額度,但也沒有月費 —— 預付餘額最低 $10,用多少扣多少,沒呼叫的月份是 $0。
Gemini 3.8 Flash 的價格是多少?
2026年9月11日,Kunavo 的 Gemini 3.8 Flash 是每 1M token 輸入 $0.525 / 輸出 $2.625。Google 目前對 3.x Flash 收限時優惠價 $0.75 / $3.75,到 2026 年 12 月 31 日為止,Kunavo 比 Google 優惠價低約 30%;2027 年 1 月 1 日起 Google 恢復 $1.50 / $7.50 的標準價。一次 RAG 回答(輸入 8,000 / 輸出 500 token)在 Kunavo 約 $0.0055。
Gemini 3.6 Flash 還值得用嗎?
不建議因為價格選它。Kunavo 的 Gemini 3.6 Flash 是 $1.05 / $5.25,比 Google 優惠價高約 40%,所以在優惠期間直接向 Google 呼叫 3.6 反而比較便宜。3.7 Flash 與 3.8 Flash 都比 3.6 新,在 Kunavo 也比 3.6 便宜($0.525 / $2.625),除非你的程式非 3.6 不可,換成較新的型號就好。
訂了 Google AI Pro,可以用 Gemini API 嗎?
不行。Gemini app 的付費訂閱(Google AI Pro / Ultra)和開發者用的 Gemini API 是兩個產品、兩套計費,月費裡沒有 API 額度,也不會附 API 金鑰。要從程式呼叫,一樣得用免費層級或按 token 付費;反過來,有 API 金鑰也不會讓 app 那邊的功能變多。
不開 Google Cloud 帳單帳戶,可以用 Gemini API 嗎?
可以透過 OpenAI 相容的閘道呼叫。在 Kunavo,同一把 sk-kn- 開頭的金鑰就能呼叫 Gemini,不需要 Google Cloud 專案或帳單帳戶,Claude 和 GPT 也在同一個餘額裡。代價是這條路使用共用容量:沒有專屬配額,也沒有合約保證的 SLA。需要保證配額或 SLA 的規模,應該直接向 Google 申請。
在台灣要怎麼付 Gemini API 的費用?
直接向 Google 付費,要在 Google Cloud 為專案開啟帳單並綁定國際信用卡。Kunavo 走 Stripe 預付:支援 Visa、Mastercard、American Express、JCB、UnionPay 與 Apple Pay,最低儲值 $10,餘額不會過期,失敗的請求不計費。台灣沒有本地支付通道 —— 街口、LINE Pay 都不在可用清單上。