Gemini 3은 Google의 현재 모델 제품군으로, 최상위에는 Gemini 3 Pro 및 Gemini 3.1 Pro가 있고 Flash 제품군은 Gemini 3 Flash부터 Gemini 3.8 Flash까지 이어집니다. 네이티브 멀티모달, 1M 토큰 컨텍스트, 사고 과정 추론을 지원합니다. 오늘 Kunavo에서는 하나의 OpenAI 호환 엔드포인트를 통해 Gemini 3 API를 호출할 수 있습니다. Gemini 3.1 Pro는 1M 토큰당 $0.70 / $4.20로 Google의 $2.00 / $12.00 목록 가격보다 약 65% 낮고, 최신 Flash인 Gemini 3.8 Flash는 $0.525 / $2.625로 제공됩니다. 이는 December 31, 2026을 통해 Google이 3.x Flash에 부과하는 도입 요금 $0.75 / $3.75보다 30% 낮습니다. 이 가이드에서는 각 등급의 비용, 사용 가능한 슬러그, 호출 코드 전체를 설명합니다.
gemini-3-1-pro는 1M 토큰당 $0.70 / $4.20로 실행되며, Google의 $2.00 / $12.00 목록 가격보다 약 65% 낮습니다. Flash 측에서는 gemini-3-8-flash($0.525 / $2.625)가 최신 버전이고, gemini-3-7-flash($0.525 / $2.625)가 이전 릴리스이며, gemini-3-6-flash($1.05 / $5.25)도 계속 제공됩니다. 다만 현재 이 모델은 두 모델보다, 그리고 Google 자체 도입 요금보다 비쌉니다. 원래의 gemini-3-pro 및 gemini-3-flash 두 슬러그는 예약되고 비활성화된 상태로 유지됩니다. 테스트한 업스트림 소스가 신뢰성 기준을 충족하지 못했기 때문입니다. 지속적인 503 오류와 잘못된 매개변수 처리 문제가 있었고, 한 소스는 maxOutputTokens를 완전히 무시했습니다. 소스가 해당 테스트를 통과한 경우에만 슬러그를 활성화합니다. Gemini 2.5 Flash도 동일한 엔드포인트에서 계속 사용 가능합니다.Gemini 3 API 가격
제품군에 대한 Google의 공식 요금과 Kunavo에서 각 등급에 부과하는 비용을 나란히 비교합니다. Google은 3.x Flash 모델에 대해 December 31, 2026까지 도입 요금을 부과하므로, 표에는 오늘 직접 이용할 때 지불하는 도입 요금과 이후 적용되는 표준 요금을 함께 표시합니다:
| 모델 | 입력 / 1M | 출력 / 1M | Kunavo의 상태 |
|---|---|---|---|
| Gemini 3 Pro(Google 목록, ≤200k 컨텍스트) | $2.00 | $12.00 | 예약됨 — 활성화되지 않음 |
| Kunavo에서 Gemini 3.1 Pro | $0.70 | $4.20 | 사용 가능(Google 목록 $2.00 / $12.00) |
| Gemini 3 Flash(Google 목록) | $0.50 | $3.00 | 예약됨 — 활성화되지 않음 |
| Gemini 3.6 / 3.7 / 3.8 Flash(Google 도입 요금, December 31, 2026까지) | $0.75 | $3.75 | Google 직접 이용; January 1, 2027부터 표준 $1.50 / $7.50 |
| Kunavo에서 Gemini 3.8 Flash — 최신 버전 | $0.525 | $2.625 | 사용 가능 — Google 도입 요금보다 30% 낮음 |
| Kunavo에서 Gemini 3.7 Flash | $0.525 | $2.625 | 사용 가능 — Google 도입 요금보다 30% 낮음 |
| Kunavo에서 Gemini 3.6 Flash | $1.05 | $5.25 | 사용 가능 — Google 도입 요금보다 40% 높음; 3.7 또는 3.8 Flash 사용 |
| Kunavo에서 Gemini 2.5 Flash | $0.09 | $0.75 | 사용 가능 |
현재 모든 Gemini 모델의 Kunavo 요금과 Google 요금, 그리고 실제 비용 예시는 Gemini API 가격 가이드에 정리되어 있습니다.
Gemini 3.8 Flash API: 가격 및 Google의 도입 요금
Gemini 3.8 Flash는 Google의 최신 Flash로, 2026년 9월 2일에 출시되었으며 장기 소프트웨어 엔지니어링과 에이전트 실행을 목표로 합니다. 1,048,576토큰 컨텍스트 창과 최대 65,536 출력 토큰을 지원합니다. Kunavo에서 Gemini 3.8 Flash API 비용은 1M 토큰당 $0.525 입력 / $2.625 출력이며, 다른 모든 모델과 동일한 엔드포인트에서 gemini-3-8-flash로 호출합니다.
Google은 December 31, 2026까지 3.x Flash 모델(3.6, 3.7 및 3.8 Flash)에 1M 토큰당 도입 요금 $0.75 / $3.75을 부과하고, January 1, 2027부터 표준 요금 $1.50 / $7.50를 부과합니다. Google이 현재 부과하는 요금과 비교하면 Kunavo의 Gemini 3.8 Flash 및 Gemini 3.7 Flash($0.525 / $2.625)는 30% 저렴합니다. Gemini 3.6 Flash는 그렇지 않습니다. $1.05 / $5.25로 Google의 도입 요금보다 40% 비싸므로, 사용할 모델은 3.7 및 3.8 Flash입니다. 둘 다 더 최신이며 더 저렴합니다.
Kunavo가 제공하는 것은 Gemini, Claude, GPT, 이미지 및 동영상 모델 전체에서 사용할 수 있는 하나의 OpenAI 호환 키와 하나의 선불 잔액입니다. Google Cloud 프로젝트가 필요하지 않으며 실패한 요청에 대한 비용도 없습니다. 제공하지 않는 것은 전용 용량입니다. Kunavo는 공유 용량이며 전용 할당량이나 계약상 SLA가 없으므로, 둘 중 하나가 필요하면 Google을 직접 호출하세요.
Gemini 3.6 Flash — 변경 사항
Gemini 3.6 Flash(2026년 7월 21일 출시)는 저희가 제공할 수 있었던 최초의 3.x Flash이며, 이 섹션의 추론 토큰 측정에 사용한 모델입니다. Google의 표준 요금은 1M 토큰당 $1.50 입력 / $7.50 출력입니다. 표준 요금 기준으로 Gemini 3.5 Flash와 입력 가격은 같고 출력 가격은 약 17% 낮지만, December 31, 2026까지 Google은 $0.75 / $3.75의 도입 요금을 부과합니다. Google은 다단계 엔지니어링 작업에서 토큰 비용을 크게 줄일 수 있다고 주장하며 장기 에이전트 작업용으로 홍보합니다.
청구서를 실제로 결정하는 수치는 가격표에 없습니다:3.6 Flash는 기본적으로 사고하며, 사고가 출력 미터를 지배합니다. 테스트에서 한 문장의 사실 답변을 생성하는 데 약 120–140개의 추론 토큰을 사용했고, 표시되는 출력 토큰은 7개였습니다. 추론 토큰은 출력 요금으로 청구되므로, 짧은 3.6 Flash 답변의 실제 비용은 7개가 아니라 150개에 가까운 출력 토큰이며, 단순 추정치보다 약 20배 높습니다. 실질적인 결과는 두 가지입니다:
- 작은
max_tokens를 설정하지 마세요. 약 150 미만의 값은 모델이 답변을 출력하기 전에 추론에 소진되며, 사고 비용은 지불하면서 잘린 조각을 받게 됩니다. - 표시되는 출력이 아니라 추론을 기준으로 예산을 잡으세요. 짧고 대량인 호출에서는 토큰당 표시 가격이 더 높더라도 사고하지 않는 Flash 등급이 실제로 더 저렴한 경우가 많습니다.
Gemini 3.6 Flash는 Kunavo에서 여전히 사용 가능하며 gemini-3-6-flash로 1M 토큰당 $1.05 / $5.25입니다. 하지만 이는 December 31, 2026까지 Google이 부과하는 $0.75 / $3.75보다 40% 높고, Kunavo의 최신 모델 자체 가격보다도 높습니다. 새 작업에는 gemini-3-8-flash 또는 gemini-3-7-flash를 $0.525 / $2.625로 호출하세요. Google 도입 요금보다 30% 낮습니다. 이 모델들도 사고 모델이므로 max_tokens 역시 충분히 크게 설정하세요.
오늘 Kunavo에서 Gemini 호출하기
Kunavo는 OpenAI 호환 /v1/chat/completions 엔드포인트 뒤에서 Gemini를 제공합니다. OpenAI SDK를 그대로 유지하고 base_url만 변경하면 되며 Google Cloud 프로젝트는 필요하지 않습니다. 다음 코드는 Gemini 3.8 Flash API를 호출합니다. 모델 문자열을 gemini-3-7-flash, gemini-3-1-pro 또는 gemini-2-5-flash로 바꾸기만 하면 다른 변경은 필요 없습니다:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["KUNAVO_API_KEY"],
base_url="https://api.kunavo.com/v1",
)
# Gemini 3.8 Flash is Google's newest Flash. Mind the max_tokens: the 3.x Flash
# models think before they answer and reasoning bills as output, so a small
# cap can be spent thinking and return a truncated answer.
resp = client.chat.completions.create(
model="gemini-3-8-flash",
max_tokens=1024,
messages=[{"role": "user", "content": "Summarize this contract in 5 bullets."}],
)
print(resp.choices[0].message.content)키를 받는 데는 1분이면 됩니다. Gemini API 키 가이드를 참조하세요. 동일한 sk-kn- 키로 Claude, GPT, Nano Banana 이미지 및 Veo 3 동영상에도 접근할 수 있습니다.
어떤 Gemini 등급을 호출해야 하나요?
- 긴 컨텍스트 및 추론 작업 —
gemini-3-1-pro는 입력 $0.70 / 출력 $4.20입니다. 코딩, 에이전트 및 크로스모달 분석을 위한 Google의 플래그십 등급이며, 저희가 제공하는 Pro 등급입니다. - 단계별 추론이 필요한 에이전트 작업 —
gemini-3-8-flash는 $0.525 / $2.625이며 Google 도입 요금보다 30% 낮습니다. 또는 프롬프트가 해당 모델에서 검증되었다면 동일한 가격의gemini-3-7-flash를 사용하세요. Flash 지연 시간으로 추론하며, 표시되는 출력 토큰이 아니라 추론 토큰을 기준으로 예산을 잡으세요. - 대량의 지연 시간 민감 호출 —
gemini-2-5-flash는 입력 $0.09 / 출력 $0.75로 비용 효율성이 유지됩니다. 기본적으로 추론하지 않기 때문에 짧은 답변에서 저렴하게 유지됩니다. - 가격 기준으로는 3.6 Flash가 아님 —
gemini-3-6-flash는 $1.05 / $5.25로 Kunavo의 3.7 및 3.8 Flash보다 비싸고 Google 자체 도입 요금보다도 비쌉니다. 이미 해당 모델에서 검증된 프롬프트에만 사용하세요. - 다음 업그레이드를 위한 구축 — OpenAI 호환 형태를 기준으로 코딩하고 모델 문자열은 설정으로 취급하세요. 새로운 Gemini 슬러그도 동일한 엔드포인트 뒤에 추가됩니다.
자주 묻는 질문
Gemini 3 API란 무엇인가요?
Gemini 3는 Google의 현재 모델 제품군으로 Gemini 3 Pro와 3.1 Pro, Gemini 3 Flash, 그리고 최신 Gemini 3.6, 3.7, 3.8 Flash를 포함합니다. 모두 기본적으로 멀티모달이며 1M 토큰 컨텍스트와 사고 연쇄 추론을 지원합니다. Gemini 3 API는 이를 프로그래밍 방식으로 호출하는 방법입니다. Google AI Studio / Vertex AI를 통해 직접 호출하거나, 현재 Gemini 3.1 Pro와 3.6, 3.7, 3.8 Flash 모델을 제공하는 Kunavo 같은 OpenAI 호환 게이트웨이를 통해 호출할 수 있습니다.
오늘 Kunavo에서 Gemini 3 API를 호출할 수 있나요?
예. Gemini 3.1 Pro은 현재 gemini-3-1-pro로 제공되며, 100만 토큰당 입력 $0.70 / 출력 $4.20 — Google의 $2.00 / $12.00 목록 가격보다 약 65% 낮은 수준 — 으로, 선택할 만한 Pro 등급입니다. Flash 쪽에서는 Gemini 3.8 Flash (gemini-3-8-flash)가 입력 $0.525 / 출력 $2.625으로 가장 최신이며, Google이 2026년 12월 31일까지 3.x Flash에 부과하는 도입 가격 $0.75 / $3.75보다 30% 낮습니다. Gemini 3.7 Flash (gemini-3-7-flash)는 같은 가격이고, Gemini 3.6 Flash (gemini-3-6-flash)는 여전히 입력 $1.05 / 출력 $5.25으로 제공되며 Google의 도입 가격보다 높습니다. 이 모델들은 모두 OpenAI 호환 엔드포인트에서 제공되며 Google Cloud 프로젝트가 필요하지 않습니다. 원래의 gemini-3-pro 및 gemini-3-flash 슬러그는 예약된 상태로 활성화되지 않습니다. 해당 모델에 대해 테스트한 업스트림 소스가 신뢰성 기준을 충족하지 못했기 때문입니다(지속적인 503 오류, 잘못된 매개변수 처리).
Gemini 3 API의 비용은 얼마인가요?
Google의 공식 정가는 Gemini 3 Pro 및 3.1 Pro(최대 200k 컨텍스트)의 경우 토큰 1M개당 입력 $2.00 / 출력 $12.00이며, Gemini 3 Flash의 경우 입력 $0.50 / 출력 $3.00입니다. Gemini 3.6, 3.7 및 3.8 Flash의 경우 Google은 2026년 12월 31일까지 출시 초기 요금인 입력 $0.75 / 출력 $3.75를 부과하고, 2027년 1월 1일부터는 표준 요금인 입력 $1.50 / 출력 $7.50를 부과합니다. Kunavo에서 지불하는 요금은 Gemini 3.1 Pro의 경우 입력 $0.70 / 출력 $4.20(정가보다 약 65% 저렴), Gemini 3.8 Flash 및 Gemini 3.7 Flash의 경우 입력 $0.525 / 출력 $2.625(Google의 출시 초기 요금보다 30% 저렴), Gemini 3.6 Flash의 경우 입력 $1.05 / 출력 $5.25이며, 이는 Google의 출시 초기 요금보다 높습니다.
어떤 Gemini 3 Flash를 사용해야 하나요 — 3.6, 3.7 또는 3.8?
새 작업에는 Gemini 3.8 Flash(gemini-3-8-flash)를 사용하세요. 2026년 9월 2일에 출시된 Google의 최신 Flash이며, Kunavo에서는 1M 토큰당 $0.525 / $2.625입니다. 이는 현재 Google이 부과하는 $0.75 / $3.75보다 30% 낮습니다. Gemini 3.7 Flash(gemini-3-7-flash)는 동일한 가격이며, 이미 해당 모델에서 검증된 프롬프트에 적합합니다. Gemini 3.6 Flash는 $1.05 / $5.25로 둘보다 비싸고 Google 자체 도입 요금보다 40% 비싸므로, 가격 기준으로 선택할 모델은 아닙니다.
Gemini 3.6 Flash API의 비용은 얼마인가요?
Gemini 3.6 Flash의 Google 표준 요금은 2027년 1월 1일부터 100만 입력 토큰당 $1.50, 100만 출력 토큰당 $7.50입니다. 2026년 12월 31일까지 Google은 도입 가격 $0.75 / $3.75를 부과합니다. Kunavo에서 gemini-3-6-flash는 $1.05 / $5.25이며, Google의 도입 가격보다 40% 높습니다. 따라서 둘 다 더 최신이고 Kunavo에서 $0.525 / $2.625인 Gemini 3.8 또는 3.7 Flash가 더 나은 선택입니다. 또한 가격표는 실제 비용을 과소평가합니다. 3.6 Flash는 기본적으로 추론을 수행하며 추론 토큰에 출력 요금이 부과되기 때문입니다. 테스트에서 한 문장 답변을 생성하는 데 눈에 보이는 출력 토큰 7개를 내보내기 위해 약 120–140개의 추론 토큰이 사용되었습니다. 눈에 보이는 출력이 아니라 추론 토큰을 기준으로 예산을 잡고, 답변이 출력되기 전에 추론 예산이 응답을 소진하지 않도록 max_tokens를 약 150보다 낮게 설정하지 마세요.
Gemini 3 API 키는 어떻게 받나요?
직접 키를 받으려면 Google AI Studio를 이용하세요. 또는 Gemini 3.1 Pro, 3.x Flash 모델과 현재 2.5 Flash를 비롯해 Claude와 GPT까지 하나의 Kunavo 키로 사용할 수 있습니다. 키 가이드를 참조하세요.
Kunavo에서 현재 사용 가능한 Gemini 3 모델 ID는 무엇인가요?
gemini-3-8-flash(최신 Flash, 1M 토큰당 $0.525 / $2.625), gemini-3-7-flash, gemini-3-6-flash 및 gemini-3-1-pro($0.70 / $4.20)가 Kunavo에서 사용 가능합니다. 원래의 gemini-3-pro 및 gemini-3-flash 슬러그만 예약 상태로 유지되며, 이는 소스가 당사의 신뢰성 기준을 통과할 때까지 계속됩니다.