返回指南
模型·2026年7月2日·更新於 2026年9月12日·閱讀約 7 分鐘

Gemini 3 API——定價、可用性,以及今日實際呼叫 Gemini 的方式

Gemini 3 是 Google 目前的模型系列——包含 3 Pro、3.1 Pro,以及一路到 Gemini 3.8 Flash 的 Flash 系列。本文介紹 Google 牌價與介紹期價格下的 API 定價、Kunavo 上可用的 slug,以及今日呼叫它們的 OpenAI 相容程式碼。

最後審核於 。

Gemini 3 是 Google 目前的模型系列——頂端有 Gemini 3 Pro 和 Gemini 3.1 Pro,Flash 系列則從 Gemini 3 Flash 延伸到 Gemini 3.8 Flash——原生支援多模態、具備 100 萬 token 上下文與思維鏈推理能力。今天你可以透過 Kunavo 的單一 OpenAI 相容端點呼叫 Gemini 3 API:Gemini 3.1 Pro,每 100 萬 token 的價格為 $0.70 / $4.20,約比 Google 的 $2.00 / $12.00 定價低 65%,而最新的 Flash Gemini 3.8 Flash 則為 $0.525 / $2.625——比 Google 截至 2026年12月31日 對 3.x Flash 收取的導入優惠價 $0.75 / $3.75 低 30%。本指南涵蓋每個層級的價格、目前啟用的 slug,以及呼叫它們的程式碼。

可用性說明。 Gemini 3 Pro 層級已在 Kunavo 上線:gemini-3-1-pro 每 100 萬 token 的價格為 $0.70 / $4.20,約比 Google 的 $2.00 / $12.00 定價低 65%。在 Flash 方面,gemini-3-8-flash($0.525 / $2.625)是最新版本,gemini-3-7-flash($0.525 / $2.625)是上一個版本,而 gemini-3-6-flash($1.05 / $5.25)仍提供服務——但目前價格已高於前兩者,也高於 Google 自己的入門價。有兩個 slug 仍保留但停用——原始的 gemini-3-pro 和 gemini-3-flash——因為我們測試的上游來源未達可靠性標準:持續出現 503,且參數處理異常(其中一個來源完全忽略 maxOutputTokens)。只有在來源通過測試後,我們才會啟用 slug。Gemini 2.5 Flash 也仍在同一端點上線。

Gemini 3 API 定價

Google 對此系列公布的官方價格,以及每個層級在 Kunavo 上的價格。對於 3.x Flash 模型,Google 會在 2026年12月31日 前收取入門價,因此表格會顯示該價格——也就是今天直接向 Google 付費時會支付的價格——以及之後適用的標準價格:

模型輸入 / 1M輸出 / 1MKunavo 上的狀態
Gemini 3 Pro(Google 定價,≤200k ctx)$2.00$12.00保留——未啟用
Kunavo 上的 Gemini 3.1 Pro$0.70$4.20已上線(Google 定價 $2.00 / $12.00)
Gemini 3 Flash(Google 定價)$0.50$3.00保留——未啟用
Gemini 3.6 / 3.7 / 3.8 Flash(Google 入門價,至 2026年12月31日)$0.75$3.75直接向 Google 付費;自 2027年1月1日 起標準價格為 $1.50 / $7.50
Kunavo 上的 Gemini 3.8 Flash——最新版本$0.525$2.625已上線——比 Google 入門價低 30%
Kunavo 上的 Gemini 3.7 Flash$0.525$2.625已上線——比 Google 入門價低 30%
Kunavo 上的 Gemini 3.6 Flash$1.05$5.25已上線——比 Google 入門價高 40%;請使用 3.7 或 3.8 Flash
Kunavo 上的 Gemini 2.5 Flash$0.09$0.75可用

每個目前 Gemini 模型在 Kunavo 與 Google 的價格,以及實際成本範例,請參閱 Gemini API 定價指南。

Gemini 3.8 Flash API:價格與 Google 的入門價

Gemini 3.8 Flash 是 Google 最新的 Flash 模型,於 2026 年 9 月 2 日發布,定位為長期軟體工程與代理式執行,具備 1,048,576 token 上下文視窗,最多可輸出 65,536 個 token。在 Kunavo 上,Gemini 3.8 Flash API 每 100 萬 token 的價格為 $0.525 輸入 / $2.625 輸出,並在與其他模型相同的端點上以 gemini-3-8-flash 呼叫。

截至 2026年12月31日,Google 對其 3.x Flash 模型——3.6、3.7 和 3.8 Flash——收取每 100 萬 token $0.75 / $3.75 的導入優惠價,並自 2027年1月1日 起收取標準價格 $1.50 / $7.50。與 Google 今天收取的價格相比,Kunavo 的 Gemini 3.8 Flash 和 Gemini 3.7 Flash($0.525 / $2.625)便宜 30%。Gemini 3.6 Flash 則不是:其價格為 $1.05 / $5.25,比 Google 的導入優惠價高 40%,因此應使用 3.7 和 3.8 Flash——兩者都更新且更便宜。

Kunavo 提供的是一組 OpenAI 相容金鑰,以及 Gemini、Claude、GPT 和影像與影片模型共用的一個預付餘額;不需要 Google Cloud 專案,失敗的請求也不收費。Kunavo 不提供的是專用容量:Kunavo 使用共用容量,沒有專用配額,也沒有合約式 SLA;如果你需要其中任何一項,請直接呼叫 Google。

Gemini 3.6 Flash——有哪些變化

Gemini 3.6 Flash(2026 年 7 月 21 日發布)是我們第一個能提供服務的 3.x Flash,也是本節推理 token 測量所使用的模型。Google 對它的標準價格為每 100 萬 token $1.50 輸入 / $7.50 輸出——按標準價格計算,輸入價格與 Gemini 3.5 Flash 相同,但輸出價格約低 17%——不過截至 2026年12月31日,Google 收取導入優惠價 $0.75 / $3.75。Google 將其定位於長期代理工作,並宣稱在多步驟工程任務中能大幅降低 token 成本。

真正決定帳單金額的數字不在價目表上:3.6 Flash 預設會思考,而思考內容會主導輸出計量。在我們的測試中,一個單句事實回答大約花費 120–140 個推理 token,才產生 7 個可見輸出 token。推理 token 按輸出價格計費,因此 3.6 Flash 短回答的實際成本更接近 150 個輸出 token,而不是 7 個——約為直覺估算的 20 倍。這會帶來兩個實際後果:

  • 不要將 max_tokens 設得太小。 任何低於約 150 的值都會在模型輸出回答前被推理消耗掉,而你會收到截斷片段,卻仍須為思考內容付費。
  • 應以推理內容而非可見輸出進行預算。 對於簡短且大量的呼叫,不思考的 Flash 層級通常在實務上更便宜,即使每個 token 的標價較高。

Gemini 3.6 Flash 目前仍在 Kunavo 上線,其 slug 為 gemini-3-6-flash,每 100 萬 token 的價格為 $1.05 / $5.25;但這比 Google 在 2026年12月31日 前收取的 $0.75 / $3.75 高 40%,也高於 Kunavo 對較新模型的價格。新工作請使用 gemini-3-8-flash 或 gemini-3-7-flash,價格為 $0.525 / $2.625,比 Google 的入門價低 30%。它們同樣是思考模型,因此也請為 max_tokens 保留充足預算。

立即在 Kunavo 上呼叫 Gemini

Kunavo 透過 OpenAI 相容的 /v1/chat/completions 端點提供 Gemini——保留 OpenAI SDK,只需變更 base_url,不需要 Google Cloud 專案。這段程式碼會呼叫 Gemini 3.8 Flash API;將模型字串替換為 gemini-3-7-flash、gemini-3-1-pro 或 gemini-2-5-flash,其他部分都不必變更:

gemini_chat.py
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["KUNAVO_API_KEY"],
    base_url="https://api.kunavo.com/v1",
)

# Gemini 3.8 Flash is Google's newest Flash. Mind the max_tokens: the 3.x Flash
# models think before they answer and reasoning bills as output, so a small
# cap can be spent thinking and return a truncated answer.
resp = client.chat.completions.create(
    model="gemini-3-8-flash",
    max_tokens=1024,
    messages=[{"role": "user", "content": "Summarize this contract in 5 bullets."}],
)
print(resp.choices[0].message.content)

取得金鑰只需一分鐘——請參閱 Gemini API 金鑰指南。同一組 sk-kn- 金鑰也能存取 Claude、GPT、Nano Banana 影像 和 Veo 3 影片。

應該呼叫哪個 Gemini 層級?

  • 長上下文與推理工作負載——gemini-3-1-pro,輸入價格為 $0.70,輸出價格為 $4.20。這是 Google 面向程式設計、代理與跨模態分析的旗艦層級,也是我們提供的 Pro 層級。
  • 每個步驟都需要推理的代理工作——gemini-3-8-flash,價格為 $0.525 / $2.625,比 Google 的入門價低 30%;如果你的提示已在該模型上驗證,也可以使用同價位的 gemini-3-7-flash。具備 Flash 延遲;應以推理 token 而非可見輸出進行預算。
  • 大量且對延遲敏感的呼叫——gemini-2-5-flash,輸入價格為 $0.09,輸出價格為 $0.75,仍是成本效益之選;它預設不進行推理,正因如此,短回答的成本才會維持低廉。
  • 就價格而言,不要使用 3.6 Flash——gemini-3-6-flash,價格為 $1.05 / $5.25,在 Kunavo 上高於 3.7 和 3.8 Flash,也高於 Google 自己的入門價;只有在提示已經於該模型上驗證過時才保留它。
  • 為下一次升級做準備——使用 OpenAI 相容的介面進行開發,並將模型字串視為設定值;新的 Gemini slug 會在同一端點後方上線。

常見問題

什麼是 Gemini 3 API?

Gemini 3 是 Google 目前的模型系列——包括 Gemini 3 Pro 與 3.1 Pro、Gemini 3 Flash,以及較新的 Gemini 3.6、3.7 與 3.8 Flash;原生支援多模態、具有 1M 權杖上下文與思維鏈推理能力。Gemini 3 API 是以程式方式呼叫它的介面:可以直接透過 Google AI Studio/Vertex AI 呼叫,也可以透過 Kunavo 等 OpenAI 相容閘道呼叫;Kunavo 目前提供 Gemini 3.1 Pro 以及 3.6、3.7、3.8 Flash 模型。

目前可以在 Kunavo 呼叫 Gemini 3 API 嗎?

是的。Gemini 3.1 Pro 已以 gemini-3-1-pro 上線,每 1M 的輸入價格為 $0.70、輸出價格為 $4.20,比 Google 的 $2.00 / $12.00 牌價低約 65%,是值得優先選用的 Pro 級模型。Flash 系列方面,Gemini 3.8 Flash(gemini-3-8-flash)是最新模型,輸入/輸出價格為 $0.525 / $2.625,比 Google 截至 2026年12月31日 對 3.x Flash 收取的 $0.75 / $3.75 推出初期優惠價低 30%;Gemini 3.7 Flash(gemini-3-7-flash)的價格相同,而 Gemini 3.6 Flash(gemini-3-6-flash)仍以 $1.05 / $5.25 的輸入/輸出價格提供服務,高於 Google 的推出初期優惠價。這些模型全部都可透過 OpenAI 相容端點使用,無須 Google Cloud 專案。原始的 gemini-3-pro 和 gemini-3-flash slug 仍保留但未啟用,因為我們測試過的這些模型上游來源未達到我們的可靠性標準(持續出現 503 錯誤、參數處理異常)。

Gemini 3 API 的費用是多少?

Google 的官方定價為:Gemini 3 Pro 與 3.1 Pro(上下文最多 200k)每 1M 個權杖輸入 $2.00/輸出 $12.00;Gemini 3 Flash 為 $0.50/$3.00。Gemini 3.6、3.7 與 3.8 Flash 的導入優惠價格為 $0.75/$3.75,適用至 2026年12月31日;之後標準價格為 $1.50/$7.50,自 2027年1月1日 起適用。在 Kunavo,Gemini 3.1 Pro 的價格為 $0.70/$4.20(約比定價低 65%),Gemini 3.8 Flash 與 Gemini 3.7 Flash 的價格為 $0.525/$2.625(比 Google 導入優惠價格低 30%),而 Gemini 3.6 Flash 的價格為 $1.05/$5.25,高於 Google 的導入優惠價格。

應該使用哪個 Gemini 3 Flash——3.6、3.7 還是 3.8?

新工作請使用 Gemini 3.8 Flash(gemini-3-8-flash):這是 Google 最新的 Flash 模型,於 2026 年 9 月 2 日發布;在 Kunavo,每 1M 個權杖的價格為 $0.525/$2.625,比 Google 目前收取的 $0.75/$3.75低 30%。Gemini 3.7 Flash(gemini-3-7-flash)價格相同,適合已在其上驗證過的提示。Gemini 3.6 Flash 的價格為 $1.05/$5.25,比前兩者都貴,也比 Google 自己的導入優惠價格高 40%,因此若以價格考量,不應選擇它。

Gemini 3.6 Flash API 的費用是多少?

Google 對 Gemini 3.6 Flash 的標準價格為每 100 萬個輸入 token $1.50、每 100 萬個輸出 token $7.50,自 2027年1月1日 起適用;截至 2026年12月31日,Google 收取 $0.75 / $3.75 的導入優惠價。在 Kunavo 上,gemini-3-6-flash 的價格為 $1.05 / $5.25,比 Google 的導入優惠價高 40%;因此,較新的 Gemini 3.8 或 3.7 Flash 更值得選購,兩者在 Kunavo 上的輸入/輸出價格皆為 $0.525 / $2.625。價目表還低估了實際成本,因為 3.6 Flash 預設會進行推理,而推理 token 按輸出價格計費:測試中,一句回答消耗了約 120–140 個推理 token,才產生 7 個可見輸出 token。請依推理 token 而非可見輸出編列預算,並避免將 max_tokens 設為低於約 150,否則推理會在產生答案前耗盡回應的 token 預算。

如何取得 Gemini 3 API 金鑰?

若要直接取得金鑰,可使用 Google AI Studio;或者使用一把 Kunavo 金鑰,今天即可涵蓋 Gemini 3.1 Pro、3.x Flash 模型與 2.5 Flash,另外也支援 Claude 與 GPT——請見金鑰指南。

Kunavo 目前啟用哪些 Gemini 3 模型 ID?

gemini-3-8-flash(最新的 Flash,每 1M 個權杖 $0.525/$2.625)、gemini-3-7-flash、gemini-3-6-flash 與 gemini-3-1-pro($0.70/$4.20)目前已在 Kunavo 啟用。只有原始的 gemini-3-pro 與 gemini-3-flash slug 仍保留,直到來源通過我們的可靠性標準為止。