가이드 목록으로
가격·2026년 6월 8일·최종 업데이트 2026년 9월 12일·9분 분량

Google Gemini API 가격 2026년 9월 — 공식 목록 및 토큰당 요금 2026

Gemini는 최첨단 AI 중에서도 가성비가 뛰어난 편입니다. 여기서는 모델별 최신 Gemini API 가격을 소개합니다. 2026년 9월에 확인한 Google 공식 목록과 3.x Flash의 출시 요금, Kunavo의 요금을 함께 제시하고, 실제 비용 예시와 프로덕션에서 Gemini를 호출하는 가장 저렴한 방법도 설명합니다.

마지막 검토일: .

다음은 2026년 9월 기준 Google Gemini API 가격으로, 토큰 100만 개당 기준이며 Google의 공식 요금과 동일 모델의 Kunavo 가격을 나란히 표시합니다. Gemini 3.8 Flash은 Google의 최신 Flash 모델로, Kunavo에서 입력 $0.525 / 출력 $2.625이며, Google이 3.x Flash 모델에 December 31, 2026까지 부과하는 도입기 요금 $0.75 / $3.75보다 30% 저렴합니다. Google의 표준 요금 $1.50 / $7.50은 January 1, 2027부터 적용됩니다. Gemini 3.1 Pro은 Google의 $2.00 / $12.00 정가 대비 $0.70 / $4.20이고, Gemini 2.5 Flash은 $0.30 / $2.50 대비 $0.09 / $0.75입니다. 각각 약 65% 및 70% 저렴하며, 모두 하나의 OpenAI 호환 API에서 이용할 수 있습니다.

마지막 요금 확인일: 2026년 9월 12일. 아래의 Kunavo 토큰당 가격은 모델 카탈로그에서 실시간으로 가져오며, “Google 정가” 열은 Google이 게시한 요금을 반영합니다. 공식 출처는 ai.google.dev/gemini-api/docs/pricing입니다.

Google 공식 가격표와 Kunavo 비교 — 2026년 9월

여기에 표시된 모든 Gemini API 가격은 Kunavo에서 청구되는 USD 기준 토큰 100만 개당 가격입니다. “Google 정가” 열은 위의 확인일에 ai.google.dev에서 가져온 동일 모델의 Google 공식 게시 요금입니다. 따라서 이 표에서는 공식 가격표와 할인 가격을 한눈에 비교할 수 있습니다. Gemini 3.x Flash 모델의 경우 해당 열에 Google이 현재 부과하는 도입기 요금이 표시되며, “절약 금액”은 그 요금을 기준으로 계산됩니다.

모델입력 / 1M출력 / 1MGoogle 정가 (입력 / 출력)절약 금액
gemini-3-8-flash$0.525$2.625$0.75 / $3.75 도입기 요금*도입기 요금* 대비 30%
gemini-3-7-flash$0.525$2.625$0.75 / $3.75 도입기 요금*도입기 요금* 대비 30%
gemini-3-1-pro$0.70$4.20$2.00 / $12.00~65%
gemini-2-5-flash$0.09$0.75$0.30 / $2.50~70%
gemini-3-6-flash$1.05$5.25$0.75 / $3.75 도입기 요금*없음 — 도입기 요금*보다 40% 높음

*Google이 December 31, 2026를 통해 3.x Flash 모델에 부과하는 도입기 요금입니다. 해당 모델에는 January 1, 2027부터 Google의 표준 요금 $1.50 / $7.50가 적용됩니다.

Gemini 3.8 Flash은 새 작업에 사용할 Flash 모델이고, Gemini 2.5 Flash은 가장 저렴한 대량 처리 옵션이며, Pro는 더 어려운 추론, 비전 및 긴 컨텍스트 작업에 적합합니다. 실시간 요금은 항상 가격 페이지와 각 모델 페이지(gemini-3-8-flash, gemini-3-7-flash, gemini-3-1-pro, gemini-2-5-flash, gemini-3-6-flash)에 표시됩니다.

Gemini 3.8 Flash 가격 및 Google 도입기 요금

Google은 Gemini 3.x Flash 모델인 3.6, 3.7 및 3.8 Flash에 대해 December 31, 2026까지 1M 토큰당 입력 $0.75 / 출력 $3.75의 도입 요금을 부과하며, January 1, 2027부터는 표준 요금인 $1.50 / $7.50를 부과합니다. Kunavo는 1M 토큰당 Gemini 3.8 Flash을 $0.525 / $2.625에, Gemini 3.7 Flash을 $0.525 / $2.625에 제공하며, 이는 현재 Google의 도입 요금보다 30% 저렴합니다. Gemini 3.6 Flash은 예외입니다. 요금이 $1.05 / $5.25로 Google의 현재 요금보다 40% 더 비싸므로, 더 최신이면서 더 저렴한 3.7 및 3.8 Flash를 사용하는 것이 좋습니다.

모델Kunavo(입력 / 출력)현재 Google — December 31, 2026까지 도입기 요금January 1, 2027부터 Google 요금현재 Kunavo와 Google 비교
Gemini 3.8 Flash$0.525 / $2.625$0.75 / $3.75$1.50 / $7.5030% 저렴
Gemini 3.7 Flash$0.525 / $2.625$0.75 / $3.75$1.50 / $7.5030% 저렴
Gemini 3.6 Flash$1.05 / $5.25$0.75 / $3.75$1.50 / $7.5040% 비쌈

30%의 차이는 실제로 존재하지만 Gemini 3.1 Pro 또는 Gemini 2.5 Flash보다 좁습니다. Google이 2027년까지 3.x Flash 자체를 할인하고 있으므로, 추측하기 전에 비교하세요. Kunavo의 추가 혜택은 Gemini, Claude, GPT 및 이미지·비디오 모델을 하나의 OpenAI 호환 키와 하나의 선불 Stripe 잔액으로 사용할 수 있고 Google Cloud 프로젝트가 필요 없다는 점입니다. 다만 전용 용량은 제공하지 않습니다. Kunavo는 전용 할당량과 계약상 SLA가 없는 공유 용량이므로, 보장된 할당량이나 SLA가 필요하다면 Google에서 직접 구매하세요.

Gemini Flash API 가격에서는 출력 부분을 주의해서 보세요. 3.x Flash 모델은 사고 모델이며, 응답 전에 수행하는 추론도 출력 토큰으로 청구됩니다. max_tokens을 넉넉하게 설정하고 추론을 포함한 출력 기준으로 예산을 잡으세요. Gemini 3 API 가이드에는 3.6 Flash의 측정된 추론 토큰 수와 gemini-3-8-flash를 호출하는 코드가 있습니다.

Gemini API의 토큰당 가격은 어떻게 계산되나요?

입력 토큰(시스템 프롬프트, 검색된 컨텍스트, 사용자 메시지 등 전송하는 모든 내용)과 출력 토큰(모델이 생성하는 내용)에 대해 비용을 지불합니다. 출력이 더 비싼 부분이므로 Gemini 청구액에 가장 큰 영향을 미치는 요소는 모델이 작성하도록 허용하는 텍스트의 양입니다. 이미지와 오디오는 토큰 등가량으로 변환되어 동일한 기준으로 청구됩니다.

비용 계산 예시

마지막 두 행을 제외하고 Kunavo의 Gemini 2.5 Flash 요금을 적용한 실제 수치입니다. 마지막 두 행에는 Gemini 3.8 Flash 및 Gemini 3.1 Pro를 사용합니다.

워크로드토큰(입력 / 출력)모델비용
챗봇 한 턴1,000 / 3002.5 Flash$0.0003
RAG 답변8,000 / 5002.5 Flash$0.0011
배치 분류 (문서당)500 / 202.5 Flash$0.00006
에이전트 단계 (추론을 포함한 출력)10,000 / 1,5003.8 Flash$0.0092 (Google 도입기 요금: $0.0131)
긴 컨텍스트 분석20,000 / 2,000Pro$0.0224

이 요금 기준으로 2.5 Flash를 사용한 문서 100,000개 분류 배치는 약 $6, 챗봇 100만 턴은 약 $315입니다. 계산식은 다음과 같으며 바로 실행할 수 있습니다.

gemini_cost.py
# Kunavo Gemini 2.5 Flash rates (USD per 1M tokens)
IN_RATE, OUT_RATE = 0.09, 0.75

def cost(in_tokens: int, out_tokens: int) -> float:
    return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE

print(cost(1_000, 300))            # one chatbot turn   -> $0.000315
print(cost(8_000, 500))            # one RAG answer     -> $0.001095
print(cost(500, 20) * 100_000)     # 100k-doc batch     -> ~$6.00

Kunavo 가격 및 Stripe 결제

구독이나 Google Cloud 프로젝트는 필요 없습니다. 잔액을 충전하면(Stripe 또는 현지 결제 수단) 위의 토큰당 요금에 따라 호출 비용이 잔액에서 차감됩니다. $10 최소 충전액으로 종량제 결제가 가능하고, 잔액은 만료되지 않으며, 더 많이 충전하면 보너스 크레딧이 제공됩니다. 실패한 요청에는 절대 요금이 부과되지 않습니다. 하나의 잔액으로 Gemini와 Claude, GPT, 이미지, 비디오 및 오디오를 포함한 모든 모델을 이용할 수 있으므로 제공업체별 별도 청구서를 조정할 필요가 없습니다.

어떤 Gemini 모델을 선택해야 하나요?

  • gemini-3-8-flash — 2026년 9월 2일 출시된 Google의 최신 Flash 모델로, Flash 수준의 지연 시간으로 에이전트 작업, 코딩 및 기타 추론 중심 작업에 적합합니다. 토큰 100만 개당 $0.525 / $2.625이며 Google의 도입기 요금보다 30% 저렴합니다.
  • gemini-3-7-flash — 2026년 8월 13일 출시된 이전 Flash 모델로 $0.525 / $2.625입니다. 프롬프트가 이미 이 모델에서 검증되었다면 계속 사용하세요.
  • gemini-2-5-flash — 채팅, 추출, 분류, 요약 및 대부분의 RAG 작업의 기본 모델입니다. 빠르고 성능 좋은 옵션 중 가장 저렴하며 $0.09 / $0.75입니다.
  • gemini-3-1-pro — Flash의 정확도가 충분하지 않을 때 선택하세요. 다단계 추론, 코드, 비전 및 매우 긴 컨텍스트에 적합합니다.
  • 가격 기준으로는 gemini-3-6-flash이 아닙니다 — $1.05 / $5.25로 Kunavo의 3.7 및 3.8 Flash보다 비싸고 Google 자체의 도입기 요금보다도 비쌉니다. 이미 이 모델에서 검증된 프롬프트에만 유지하세요.

좋은 방식은 난이도에 따라 라우팅하는 것입니다. 일반적인 경우에는 Flash를 사용하고, 검사가 실패할 때만 Pro로 올리세요. 코드로 구현한 라우팅 패턴은 AI 비용 최적화 가이드에서, 제공업체 비교는 Claude 및 GPT 가격 가이드에서 확인하세요.

Gemini 비용 줄이기

  1. 등급을 낮추세요. 쉬운 작업의 80%는 Flash로 보내고, 어려운 20%에만 Pro를 사용하세요.
  2. 3.6 Flash에서 이전하세요. Kunavo에서 Gemini 3.8 Flash은 Gemini 3.6 Flash보다 토큰당 50% 저렴하며, 동일한 OpenAI 호환 요청 형식을 사용하므로 모델명만 한 단어 바꾸면 됩니다.
  3. 출력을 제한하세요. max_tokens 및 중지 시퀀스를 설정하세요. 과금 기준에서 출력이 더 비싼 부분입니다.
  4. 입력을 줄이세요. 전체 지식 기반을 컨텍스트에 넣는 대신 더 적고 품질 좋은 RAG 청크를 검색하세요.
  5. 배치 처리하세요. 독립적인 호출을 묶어 지연 시간을 낮추고 재시도 폭주를 방지하세요.

자주 묻는 질문

2026년 9월에서 Google의 공식 Gemini API 가격은 얼마인가요?

2026년 9월 12일 기준 Google의 공식 100만 토큰당 가격은 Gemini 2.5 Flash의 경우 입력 $0.30 / 출력 $2.50, Gemini 3.1 Pro의 경우 $2.00 / $12.00이며 ai.google.dev/gemini-api/docs/pricing에 게시되어 있습니다. Google은 3.x Flash 모델(Gemini 3.6, 3.7, 3.8 Flash)에 대해 2026년 12월 31일까지 도입 가격 $0.75 / $3.75을 적용하고, 2027년 1월 1일부터 표준 가격 $1.50 / $7.50로 인상합니다. Kunavo에서 동일 모델의 가격은 Gemini 2.5 Flash의 경우 $0.09 / $0.75(Google 정가보다 약 70% 저렴), Gemini 3.1 Pro의 경우 $0.70 / $4.20(Google 정가보다 약 65% 저렴), Gemini 3.8 및 3.7 Flash의 경우 $0.525 / $2.625(Google 도입 가격보다 30% 저렴)입니다.

Gemini 3.8 Flash API 비용은 얼마인가요?

Kunavo에서 Gemini 3.8 Flash API의 비용은 입력 100만 토큰당 $0.525, 출력 100만 토큰당 $2.625이며 추론 토큰은 출력으로 청구됩니다. Google의 Gemini 3.8 Flash 자체 가격은 2026년 12월 31일까지 도입 가격 $0.75 / $3.75이고, 2027년 1월 1일부터는 $1.50 / $7.50입니다. 따라서 Kunavo는 현재 Google 요금보다 30% 저렴합니다. 2026년 9월 2일 출시된 Gemini 3.8 Flash는 Google의 최신 Flash 모델이며 Kunavo의 OpenAI 호환 엔드포인트에서는 gemini-3-8-flash로 호출합니다.

Gemini 3.8 Flash는 Kunavo를 통해 사용하는 것이 더 저렴한가요?

예. Kunavo를 통하면 Gemini 3.8 Flash의 비용은 1M 토큰당 $0.525 / $2.625로, Google이 2026년 12월 31일까지 직접 부과하는 $0.75 / $3.75의 도입 요금보다 30% 저렴합니다. Gemini 3.7 Flash도 가격은 동일합니다. Google이 3.x Flash 모델 자체를 2027년까지 할인하고 있기 때문에 Gemini 3.1 Pro나 2.5 Flash보다 가격 차이는 작습니다. 더 낮은 가격의 대가로 용량에는 차이가 있습니다. Kunavo는 전용 할당량과 계약상 SLA가 없는 공유 용량이므로, 보장된 할당량이나 SLA가 필요한 팀은 Google에서 직접 구매해야 합니다.

이것이 Google의 공식 가격표인가요?

아니요. ai.google.dev/gemini-api/docs/pricing의 Google 공식 페이지가 공식 출처이며 이 가이드 상단에 링크되어 있습니다. 이 페이지는 공식 정가를 재현하고 검증 날짜를 명시하며 동일 모델에 대한 Kunavo 요금을 나란히 표시합니다. Kunavo는 이러한 모델을 재판매하는 독립 게이트웨이이며 Google이 아닙니다.

Gemini API는 무료인가요?

Google AI Studio는 프로토타이핑을 위한 rate-limit 무료 등급을 제공합니다. 프로덕션에서는 토큰별로 비용을 지불합니다. Kunavo는 최소 $10 충전액의 종량제 방식입니다. 아래 요금으로 토큰별 결제가 이루어지고 잔액은 만료되지 않으며 Google Cloud 결제 계정도 필요하지 않습니다.

Gemini 2.5 Flash의 비용은 얼마인가요?

Kunavo에서 Gemini 2.5 Flash의 가격은 입력 100만 토큰당 $0.09, 출력 100만 토큰당 $0.75이며, Google 정가 $0.30 / $2.50보다 약 70% 저렴합니다. 일반적인 챗봇 한 턴(입력 1K, 출력 300)의 비용은 약 $0.0003입니다.

Gemini 3.1 Pro API의 비용은 얼마인가요?

Kunavo에서 Gemini 3.1 Pro API 가격은 입력 토큰 100만 개당 $0.70, 출력 토큰 100만 개당 $4.20이며, Google의 $2.00 / $12.00 정가보다 약 65% 저렴합니다. 다단계 추론, 비전 및 긴 컨텍스트에는 Flash보다 Pro를 사용하세요.

Gemini 3.6 Flash API의 비용은 얼마인가요?

Kunavo에서 Gemini 3.6 Flash는 입력 토큰 100만 개당 $1.05, 출력 토큰 100만 개당 $5.25입니다. 이는 Google이 2026년 12월 31일까지 이 모델에 부과하는 도입기 요금 $0.75 / $3.75보다 40% 높으므로, 현재 이 모델은 Google에서 직접 구매하는 편이 더 저렴합니다. Gemini 3.8 Flash와 3.7 Flash가 더 나은 선택입니다. 두 모델 모두 더 최신이며 Kunavo에서는 $0.525 / $2.625이고, Google의 도입기 요금보다 30% 저렴합니다. 2027년 1월 1일부터 적용되는 Google의 Gemini 3.6 Flash 표준 요금은 $1.50 / $7.50입니다.

Gemini가 Claude나 GPT보다 저렴한가요?

Gemini 2.5 Flash는 어디서나 사용할 수 있는 성능 좋은 모델 중 가장 저렴한 편으로, 대량 작업에서 Claude Haiku와 대부분의 GPT 요금제보다 저렴합니다. 전체 표는 가격 페이지에서 비교하세요.

Gemini API 비용을 줄이려면 어떻게 해야 하나요?

Flash로 등급을 낮추고, Gemini 3.6 Flash 트래픽은 3.8 Flash로 이전하며, 출력을 제한하고, 검색된 컨텍스트를 줄이고, 배치 처리하세요. 자세한 내용은 비용 최적화 가이드를 참조하세요. Gemini 호출을 시작하려면 Gemini API 키를 받는 방법을 확인하세요.