Gemini 3 是 Google 目前的模型系列——頂端有 Gemini 3 Pro 和 Gemini 3.1 Pro,Flash 系列則從 Gemini 3 Flash 延伸到 Gemini 3.8 Flash——原生支援多模態、具備 100 萬 token 上下文與思維鏈推理能力。今天你可以透過 Kunavo 的單一 OpenAI 相容端點呼叫 Gemini 3 API:Gemini 3.1 Pro,每 100 萬 token 的價格為 $0.70 / $4.20,約比 Google 的 $2.00 / $12.00 定價低 65%,而最新的 Flash Gemini 3.8 Flash 則為 $0.525 / $2.625——比 Google 截至 2026年12月31日 對 3.x Flash 收取的導入優惠價 $0.75 / $3.75 低 30%。本指南涵蓋每個層級的價格、目前啟用的 slug,以及呼叫它們的程式碼。
gemini-3-1-pro 每 100 萬 token 的價格為 $0.70 / $4.20,約比 Google 的 $2.00 / $12.00 定價低 65%。在 Flash 方面,gemini-3-8-flash($0.525 / $2.625)是最新版本,gemini-3-7-flash($0.525 / $2.625)是上一個版本,而 gemini-3-6-flash($1.05 / $5.25)仍提供服務——但目前價格已高於前兩者,也高於 Google 自己的入門價。有兩個 slug 仍保留但停用——原始的 gemini-3-pro 和 gemini-3-flash——因為我們測試的上游來源未達可靠性標準:持續出現 503,且參數處理異常(其中一個來源完全忽略 maxOutputTokens)。只有在來源通過測試後,我們才會啟用 slug。Gemini 2.5 Flash 也仍在同一端點上線。Gemini 3 API 定價
Google 對此系列公布的官方價格,以及每個層級在 Kunavo 上的價格。對於 3.x Flash 模型,Google 會在 2026年12月31日 前收取入門價,因此表格會顯示該價格——也就是今天直接向 Google 付費時會支付的價格——以及之後適用的標準價格:
| 模型 | 輸入 / 1M | 輸出 / 1M | Kunavo 上的狀態 |
|---|---|---|---|
| Gemini 3 Pro(Google 定價,≤200k ctx) | $2.00 | $12.00 | 保留——未啟用 |
| Kunavo 上的 Gemini 3.1 Pro | $0.70 | $4.20 | 已上線(Google 定價 $2.00 / $12.00) |
| Gemini 3 Flash(Google 定價) | $0.50 | $3.00 | 保留——未啟用 |
| Gemini 3.6 / 3.7 / 3.8 Flash(Google 入門價,至 2026年12月31日) | $0.75 | $3.75 | 直接向 Google 付費;自 2027年1月1日 起標準價格為 $1.50 / $7.50 |
| Kunavo 上的 Gemini 3.8 Flash——最新版本 | $0.525 | $2.625 | 已上線——比 Google 入門價低 30% |
| Kunavo 上的 Gemini 3.7 Flash | $0.525 | $2.625 | 已上線——比 Google 入門價低 30% |
| Kunavo 上的 Gemini 3.6 Flash | $1.05 | $5.25 | 已上線——比 Google 入門價高 40%;請使用 3.7 或 3.8 Flash |
| Kunavo 上的 Gemini 2.5 Flash | $0.09 | $0.75 | 可用 |
每個目前 Gemini 模型在 Kunavo 與 Google 的價格,以及實際成本範例,請參閱 Gemini API 定價指南。
Gemini 3.8 Flash API:價格與 Google 的入門價
Gemini 3.8 Flash 是 Google 最新的 Flash 模型,於 2026 年 9 月 2 日發布,定位為長期軟體工程與代理式執行,具備 1,048,576 token 上下文視窗,最多可輸出 65,536 個 token。在 Kunavo 上,Gemini 3.8 Flash API 每 100 萬 token 的價格為 $0.525 輸入 / $2.625 輸出,並在與其他模型相同的端點上以 gemini-3-8-flash 呼叫。
截至 2026年12月31日,Google 對其 3.x Flash 模型——3.6、3.7 和 3.8 Flash——收取每 100 萬 token $0.75 / $3.75 的導入優惠價,並自 2027年1月1日 起收取標準價格 $1.50 / $7.50。與 Google 今天收取的價格相比,Kunavo 的 Gemini 3.8 Flash 和 Gemini 3.7 Flash($0.525 / $2.625)便宜 30%。Gemini 3.6 Flash 則不是:其價格為 $1.05 / $5.25,比 Google 的導入優惠價高 40%,因此應使用 3.7 和 3.8 Flash——兩者都更新且更便宜。
Kunavo 提供的是一組 OpenAI 相容金鑰,以及 Gemini、Claude、GPT 和影像與影片模型共用的一個預付餘額;不需要 Google Cloud 專案,失敗的請求也不收費。Kunavo 不提供的是專用容量:Kunavo 使用共用容量,沒有專用配額,也沒有合約式 SLA;如果你需要其中任何一項,請直接呼叫 Google。
Gemini 3.6 Flash——有哪些變化
Gemini 3.6 Flash(2026 年 7 月 21 日發布)是我們第一個能提供服務的 3.x Flash,也是本節推理 token 測量所使用的模型。Google 對它的標準價格為每 100 萬 token $1.50 輸入 / $7.50 輸出——按標準價格計算,輸入價格與 Gemini 3.5 Flash 相同,但輸出價格約低 17%——不過截至 2026年12月31日,Google 收取導入優惠價 $0.75 / $3.75。Google 將其定位於長期代理工作,並宣稱在多步驟工程任務中能大幅降低 token 成本。
真正決定帳單金額的數字不在價目表上:3.6 Flash 預設會思考,而思考內容會主導輸出計量。在我們的測試中,一個單句事實回答大約花費 120–140 個推理 token,才產生 7 個可見輸出 token。推理 token 按輸出價格計費,因此 3.6 Flash 短回答的實際成本更接近 150 個輸出 token,而不是 7 個——約為直覺估算的 20 倍。這會帶來兩個實際後果:
- 不要將
max_tokens設得太小。 任何低於約 150 的值都會在模型輸出回答前被推理消耗掉,而你會收到截斷片段,卻仍須為思考內容付費。 - 應以推理內容而非可見輸出進行預算。 對於簡短且大量的呼叫,不思考的 Flash 層級通常在實務上更便宜,即使每個 token 的標價較高。
Gemini 3.6 Flash 目前仍在 Kunavo 上線,其 slug 為 gemini-3-6-flash,每 100 萬 token 的價格為 $1.05 / $5.25;但這比 Google 在 2026年12月31日 前收取的 $0.75 / $3.75 高 40%,也高於 Kunavo 對較新模型的價格。新工作請使用 gemini-3-8-flash 或 gemini-3-7-flash,價格為 $0.525 / $2.625,比 Google 的入門價低 30%。它們同樣是思考模型,因此也請為 max_tokens 保留充足預算。
立即在 Kunavo 上呼叫 Gemini
Kunavo 透過 OpenAI 相容的 /v1/chat/completions 端點提供 Gemini——保留 OpenAI SDK,只需變更 base_url,不需要 Google Cloud 專案。這段程式碼會呼叫 Gemini 3.8 Flash API;將模型字串替換為 gemini-3-7-flash、gemini-3-1-pro 或 gemini-2-5-flash,其他部分都不必變更:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["KUNAVO_API_KEY"],
base_url="https://api.kunavo.com/v1",
)
# Gemini 3.8 Flash is Google's newest Flash. Mind the max_tokens: the 3.x Flash
# models think before they answer and reasoning bills as output, so a small
# cap can be spent thinking and return a truncated answer.
resp = client.chat.completions.create(
model="gemini-3-8-flash",
max_tokens=1024,
messages=[{"role": "user", "content": "Summarize this contract in 5 bullets."}],
)
print(resp.choices[0].message.content)取得金鑰只需一分鐘——請參閱 Gemini API 金鑰指南。同一組 sk-kn- 金鑰也能存取 Claude、GPT、Nano Banana 影像 和 Veo 3 影片。
應該呼叫哪個 Gemini 層級?
- 長上下文與推理工作負載——
gemini-3-1-pro,輸入價格為 $0.70,輸出價格為 $4.20。這是 Google 面向程式設計、代理與跨模態分析的旗艦層級,也是我們提供的 Pro 層級。 - 每個步驟都需要推理的代理工作——
gemini-3-8-flash,價格為 $0.525 / $2.625,比 Google 的入門價低 30%;如果你的提示已在該模型上驗證,也可以使用同價位的gemini-3-7-flash。具備 Flash 延遲;應以推理 token 而非可見輸出進行預算。 - 大量且對延遲敏感的呼叫——
gemini-2-5-flash,輸入價格為 $0.09,輸出價格為 $0.75,仍是成本效益之選;它預設不進行推理,正因如此,短回答的成本才會維持低廉。 - 就價格而言,不要使用 3.6 Flash——
gemini-3-6-flash,價格為 $1.05 / $5.25,在 Kunavo 上高於 3.7 和 3.8 Flash,也高於 Google 自己的入門價;只有在提示已經於該模型上驗證過時才保留它。 - 為下一次升級做準備——使用 OpenAI 相容的介面進行開發,並將模型字串視為設定值;新的 Gemini slug 會在同一端點後方上線。
常見問題
什麼是 Gemini 3 API?
Gemini 3 是 Google 目前的模型系列——包括 Gemini 3 Pro 與 3.1 Pro、Gemini 3 Flash,以及較新的 Gemini 3.6、3.7 與 3.8 Flash;原生支援多模態、具有 1M 權杖上下文與思維鏈推理能力。Gemini 3 API 是以程式方式呼叫它的介面:可以直接透過 Google AI Studio/Vertex AI 呼叫,也可以透過 Kunavo 等 OpenAI 相容閘道呼叫;Kunavo 目前提供 Gemini 3.1 Pro 以及 3.6、3.7、3.8 Flash 模型。
目前可以在 Kunavo 呼叫 Gemini 3 API 嗎?
是的。Gemini 3.1 Pro 已以 gemini-3-1-pro 上線,每 1M 的輸入價格為 $0.70、輸出價格為 $4.20,比 Google 的 $2.00 / $12.00 牌價低約 65%,是值得優先選用的 Pro 級模型。Flash 系列方面,Gemini 3.8 Flash(gemini-3-8-flash)是最新模型,輸入/輸出價格為 $0.525 / $2.625,比 Google 截至 2026年12月31日 對 3.x Flash 收取的 $0.75 / $3.75 推出初期優惠價低 30%;Gemini 3.7 Flash(gemini-3-7-flash)的價格相同,而 Gemini 3.6 Flash(gemini-3-6-flash)仍以 $1.05 / $5.25 的輸入/輸出價格提供服務,高於 Google 的推出初期優惠價。這些模型全部都可透過 OpenAI 相容端點使用,無須 Google Cloud 專案。原始的 gemini-3-pro 和 gemini-3-flash slug 仍保留但未啟用,因為我們測試過的這些模型上游來源未達到我們的可靠性標準(持續出現 503 錯誤、參數處理異常)。
Gemini 3 API 的費用是多少?
Google 的官方定價為:Gemini 3 Pro 與 3.1 Pro(上下文最多 200k)每 1M 個權杖輸入 $2.00/輸出 $12.00;Gemini 3 Flash 為 $0.50/$3.00。Gemini 3.6、3.7 與 3.8 Flash 的導入優惠價格為 $0.75/$3.75,適用至 2026年12月31日;之後標準價格為 $1.50/$7.50,自 2027年1月1日 起適用。在 Kunavo,Gemini 3.1 Pro 的價格為 $0.70/$4.20(約比定價低 65%),Gemini 3.8 Flash 與 Gemini 3.7 Flash 的價格為 $0.525/$2.625(比 Google 導入優惠價格低 30%),而 Gemini 3.6 Flash 的價格為 $1.05/$5.25,高於 Google 的導入優惠價格。
應該使用哪個 Gemini 3 Flash——3.6、3.7 還是 3.8?
新工作請使用 Gemini 3.8 Flash(gemini-3-8-flash):這是 Google 最新的 Flash 模型,於 2026 年 9 月 2 日發布;在 Kunavo,每 1M 個權杖的價格為 $0.525/$2.625,比 Google 目前收取的 $0.75/$3.75低 30%。Gemini 3.7 Flash(gemini-3-7-flash)價格相同,適合已在其上驗證過的提示。Gemini 3.6 Flash 的價格為 $1.05/$5.25,比前兩者都貴,也比 Google 自己的導入優惠價格高 40%,因此若以價格考量,不應選擇它。
Gemini 3.6 Flash API 的費用是多少?
Google 對 Gemini 3.6 Flash 的標準價格為每 100 萬個輸入 token $1.50、每 100 萬個輸出 token $7.50,自 2027年1月1日 起適用;截至 2026年12月31日,Google 收取 $0.75 / $3.75 的導入優惠價。在 Kunavo 上,gemini-3-6-flash 的價格為 $1.05 / $5.25,比 Google 的導入優惠價高 40%;因此,較新的 Gemini 3.8 或 3.7 Flash 更值得選購,兩者在 Kunavo 上的輸入/輸出價格皆為 $0.525 / $2.625。價目表還低估了實際成本,因為 3.6 Flash 預設會進行推理,而推理 token 按輸出價格計費:測試中,一句回答消耗了約 120–140 個推理 token,才產生 7 個可見輸出 token。請依推理 token 而非可見輸出編列預算,並避免將 max_tokens 設為低於約 150,否則推理會在產生答案前耗盡回應的 token 預算。
如何取得 Gemini 3 API 金鑰?
若要直接取得金鑰,可使用 Google AI Studio;或者使用一把 Kunavo 金鑰,今天即可涵蓋 Gemini 3.1 Pro、3.x Flash 模型與 2.5 Flash,另外也支援 Claude 與 GPT——請見金鑰指南。
Kunavo 目前啟用哪些 Gemini 3 模型 ID?
gemini-3-8-flash(最新的 Flash,每 1M 個權杖 $0.525/$2.625)、gemini-3-7-flash、gemini-3-6-flash 與 gemini-3-1-pro($0.70/$4.20)目前已在 Kunavo 啟用。只有原始的 gemini-3-pro 與 gemini-3-flash slug 仍保留,直到來源通過我們的可靠性標準為止。