Gemini 요금은 3가지로 나뉩니다.무료 할당량(Google AI Studio API 무료 티어. 속도 제한이 있으며 프로덕션 용도에는 적합하지 않음), Google 구독(Gemini 앱 유료 요금제. 월정액이며 API 키는 포함되지 않음), API 종량제(토큰 단위. 월정액 없음, 호출하지 않으면 $0)입니다. 이 3가지는 서로 별도의 상품이며, 하나에 가입했다고 다른 상품을 사용할 수 있는 관계가 아닙니다.
개발자가 찾는 것은 대개 세 번째입니다. Kunavo는 해당 API를 Google 정가보다 약 70% 저렴하게 제공합니다. 이 페이지에서는 모델별 현재 요율, 직접 검산할 수 있는 계산 예시, 그리고 프로덕션에서 Gemini를 가장 저렴하게 호출하는 방법을 다룹니다.
3가지 요금을 구분하는 방법
| 경로 | 지불하는 항목 | API 키 포함 여부 |
|---|---|---|
| 무료 할당량(Google AI Studio) | $0. 속도 제한 있음 | 포함됨(제한 있음) |
| 구독(Gemini 앱 유료 요금제) | 월 정액 | 포함되지 않음 |
| API 종량제 | 토큰 단위. 월정액 없음 | 포함됨 |
가장 흔한 오해는 가운데 행입니다. Gemini 앱의 유료 요금제에 비용을 지불해도 API 사용량은 늘어나지 않습니다. 앱 월정액과 개발자용 API는 별도 결제이며, 코드에서 호출하려면 어느 경우든 키와 종량제(또는 무료 할당량)가 필요합니다. 무료 할당량의 구체적인 속도 제한은 Google 측 사정에 따라 자주 바뀌므로 숫자는 Google 공식 문서에서 확인하세요. 여기서는 다루지 않습니다. 프로덕션 배포를 전제로 한다면 어차피 무료 할당량은 선택지에서 제외됩니다.
Gemini 요금 한눈에 보기
요율은 100만 토큰당 USD 기준으로, Kunavo에서 청구되는 금액입니다. “Google 정가” 열은 동일한 모델에 대한 Google의 공시 요금으로, 차이를 확인할 수 있도록 함께 표시했습니다.
| 모델 | 입력 / 100만 | 출력 / 100만 | Google 정가(입력 / 출력) | 절약률 |
|---|---|---|---|---|
gemini-2-5-flash | $0.09 | $0.75 | $0.30 / $2.50 | 약 70% |
gemini-3-1-pro | $0.70 | $4.20 | $2.00 / $12.00 | 약 65% |
Flash는 대량 처리용 주력 모델이고, Pro는 더 어려운 추론, 이미지 인식, 긴 컨텍스트 작업에 적합합니다. 최신 요율은 항상 요금 페이지와 각 모델 페이지(gemini-2-5-flash, gemini-3-1-pro)에 표시됩니다.
Gemini 토큰 과금 방식
과금 대상은 입력 토큰(전송하는 모든 것: 시스템 프롬프트, 가져온 컨텍스트, 사용자 메시지)과 출력 토큰(모델이 생성한 것)입니다. 출력 단가가 더 높으므로 Gemini 청구 금액을 좌우하는 가장 큰 요소는 “모델이 얼마나 많이 작성하게 하는가”입니다. 이미지와 오디오는 토큰으로 환산되어 동일한 미터로 과금됩니다.
계산 예시
Kunavo의 Gemini 2.5 Flash 요율을 적용한 실제 수치입니다. 마지막 행만 Gemini 3.1 Pro을 사용합니다.
| 워크로드 | 토큰(입력 / 출력) | 모델 | 비용 |
|---|---|---|---|
| 챗봇 1회 대화 | 1,000 / 300 | Flash | $0.0003 |
| RAG 답변 | 8,000 / 500 | Flash | $0.0011 |
| 배치 분류(문서당) | 500 / 20 | Flash | $0.00006 |
| 긴 컨텍스트 분석 | 20,000 / 2,000 | Pro | $0.0224 |
이 요율을 적용하면 Flash로 10만 개 문서를 분류하는 배치는 약 $6, 챗봇 대화 100만 회는 약 $315입니다. 계산식은 그대로 실행할 수 있습니다.
# Kunavo の Gemini 2.5 Flash 料率(1M トークンあたり、USD)
IN_RATE, OUT_RATE = 0.09, 0.75
def cost(in_tokens: int, out_tokens: int) -> float:
return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE
print(cost(1_000, 300)) # チャットボット 1 ターン -> $0.000315
print(cost(8_000, 500)) # RAG の回答 1 件 -> $0.001095
print(cost(500, 20) * 100_000) # 10 万件のバッチ処理 -> 約 $6.00Kunavo 요금 및 Stripe 결제
구독이나 Google Cloud 프로젝트가 필요하지 않습니다. 잔액을 충전하면(Stripe 또는 현지 결제 수단) 호출할 때마다 위 토큰 단가에 따라 잔액에서 차감됩니다. 최소 $10 충전부터 시작하는 종량제이며, 잔액은 만료되지 않고 대규모 충전에는 보너스 크레딧이 제공됩니다. 하나의 잔액으로 Gemini와 그 밖의 모든 모델(Claude, GPT, 이미지, 동영상, 오디오)을 이용할 수 있으므로 공급자별 청구서를 따로 대조할 필요가 없습니다.
어떤 Gemini 모델을 선택해야 하나요?
- gemini-2-5-flash — 채팅, 추출, 분류, 요약, 대부분의 RAG에 대한 기본 선택입니다. 빠르고 가장 저렴한 고성능 옵션입니다.
- gemini-3-1-pro — Flash의 정확도가 부족할 때 사용합니다. 다단계 추론, 코드, 이미지 인식, 매우 긴 컨텍스트 등에 적합합니다.
난이도에 따라 라우팅하는 것이 좋은 패턴입니다. 일반적인 경우는 Flash로 처리하고, 검사에 실패했을 때만 Pro로 에스컬레이션합니다. 코드가 포함된 라우팅 패턴은 AI 비용 최적화 가이드를 참조하세요.
Gemini 청구 금액 낮추기
- 티어를 낮추세요. 간단한 80%는 Flash로 보내고 Pro는 어려운 20%를 위해 남겨 두세요.
- 출력을 제한하세요.
max_tokens및 중지 시퀀스를 설정하세요. 출력은 미터 단가가 높은 쪽입니다. - 입력을 줄이세요. 전체 지식 베이스를 컨텍스트에 넣는 대신, 적은 수의 고품질 RAG 청크를 가져오세요.
- 배치 처리하세요. 독립적인 호출을 묶어 지연 시간을 줄이고 재시도 폭주를 피하세요.
Google의 이미지 및 동영상 모델도 동일한 키로 호출할 수 있습니다. 이미지 1장 및 동영상 1개당 단가는 Nano Banana Pro 요금과 Veo 3 요금에 있습니다.
자주 묻는 질문
Gemini의 요금은 얼마인가요?
Gemini 요금은 3가지로 나뉩니다. Google AI Studio의 무료 티어($0, 속도 제한 있음), Gemini 앱의 유료 구독(월정액, API 키는 포함되지 않음), 그리고 API 종량제(토큰 단위, 월정액 없음)입니다. 코드에서 호출한다면 세 번째이며, Kunavo 요율은 100만 토큰당 Gemini 2.5 Flash 입력 $0.09 / 출력 $0.75, gemini-3-1-pro 입력 $0.70 / 출력 $4.20입니다. Google 정가보다 각각 약 70% / 65% 저렴합니다.
Gemini Pro의 요금은 얼마인가요?
gemini-3-1-pro는 Kunavo에서 100만 토큰당 입력 $0.70 / 출력 $4.20이며, Google 정가 $2.00 / $12.00보다 약 65% 저렴합니다. 입력 20,000토큰과 출력 2,000토큰을 사용하는 요청 1회는 약 $0.0224입니다. Pro는 어려운 추론, 이미지 인식, 긴 컨텍스트 작업에 적합하며, 대량 처리는 티어를 Flash로 낮추는 편이 몇 자릿수 더 저렴합니다.
Gemini를 무료로 사용할 수 있나요?
Google AI Studio는 Gemini API 무료 티어를 제공하므로 속도 제한 범위 내에서는 $0로 호출할 수 있습니다. 프로토타입에는 충분하지만 속도 제한은 Google 측 사정에 따라 변하고 프로덕션 트래픽에는 부족하므로, production 배포를 전제로 한다면 선택지에서 제외됩니다. Kunavo에는 무료 할당량이 없지만 월정액도 없습니다. 선불 잔액에서 사용한 만큼만 차감되며, 호출하지 않은 달은 $0입니다.
Gemini 앱의 유료 요금제에 가입하면 API도 사용할 수 있나요?
아니요. Gemini 앱의 유료 구독과 개발자용 Gemini API는 서로 다른 상품이며 별도로 과금됩니다. 월정액에는 API 사용량이 포함되지 않고 API 키도 제공되지 않습니다. 코드에서 호출하려면 키와 종량제(또는 무료 티어)가 별도로 필요합니다. 반대로 API 키가 있어도 앱 측 기능이 추가되지는 않습니다.
Gemini 2.5 Flash의 요금은 얼마인가요?
Kunavo에서 Gemini 2.5 Flash는 입력 100만 토큰당 $0.09, 출력 100만 토큰당 $0.75이며, Google 정가 $0.30 / $2.50보다 약 70% 저렴합니다. 일반적인 챗봇 1회 대화(입력 1K, 출력 300)는 약 $0.0003입니다.
Gemini는 Claude나 GPT보다 저렴한가요?
Gemini 2.5 Flash는 비교 대상에 관계없이 가장 저렴한 고성능 모델군에 속합니다. 대량 처리에서는 Claude Haiku나 대부분의 GPT 티어보다 저렴합니다. 전체 비교표는 요금 페이지에서 확인할 수 있습니다.
Gemini API 비용을 낮추려면 어떻게 해야 하나요?
Flash로 티어를 낮추고, 출력을 제한하고, 가져오는 컨텍스트를 줄이고, 배치 처리하세요. 자세한 내용은 비용 최적화 가이드에 있습니다. Gemini 호출을 시작하려면 Gemini API 키를 받는 방법을 참조하세요.