가이드 목록으로
가격·2026년 6월 18일·최종 업데이트 2026년 9월 12일·8분 분량

Gemini API 가격 2026 — 모델별 비용, 예시 및 더 저렴한 OpenAI 호환 액세스

Gemini는 최고급 AI 중에서도 가성비가 뛰어난 편입니다. 여기서는 모델별 현재 가격(Google 정가보다 약 70% 저렴), 비용 예시, 프로덕션에서 Gemini를 호출하는 가장 저렴한 방법을 소개합니다.

Gemini는 최상위 AI 중 가격 대비 성능이 가장 뛰어난 모델군에 속하며, Kunavo는 하나의 OpenAI 호환 API를 통해 Google 공식 정가보다 약 70% 저렴하게 제공합니다. 이 가이드에서는 모델별 최신 요금, 직접 검증할 수 있는 비용 예시, 프로덕션에서 Gemini를 호출하는 가장 저렴한 방법을 설명합니다.

한눈에 보는 Gemini API 가격

Kunavo에서 계산되는 100만 토큰당 USD 기준 요금입니다. “Google 정가” 열은 동일한 모델에 대해 Google이 공개한 요금으로, 차이를 확인할 수 있도록 표시했습니다.

모델입력 / 100만출력 / 100만Google 정가(입력 / 출력)절약 금액
gemini-2-5-flash$0.09$0.75$0.30 / $2.50~70%
gemini-3-1-pro$0.70$4.20$2.00 / $12.00~65%

Flash는 대규모 작업을 위한 “주력 모델”이고, Pro는 더 어려운 추론, 비전, 긴 컨텍스트 작업에 적합합니다. 실시간 요금은 항상 가격 페이지와 각 모델 페이지(gemini-2-5-flash, gemini-3-1-pro)에 표시됩니다.

Gemini 토큰 가격 계산 방법

입력 토큰(보내는 모든 것 — 시스템 프롬프트, 검색된 컨텍스트, 사용자 메시지)과 출력 토큰(모델이 생성하는 내용)에 대해 비용을 지불합니다. 출력이 더 비싸므로 Gemini 청구액에 가장 큰 영향을 미치는 요소는 모델이 얼마나 많은 텍스트를 생성하게 하느냐입니다. 이미지와 오디오는 토큰 등가량으로 변환되어 동일한 기준으로 청구됩니다.

미리 계산한 비용 예시

마지막 행을 제외하고 Gemini 3.1 Pro을 사용하는 Kunavo의 Gemini 2.5 Flash 요금을 기준으로 한 실제 수치입니다:

작업량토큰(입력 / 출력)모델비용
챗봇 대화1.000 / 300Flash$0.0003
RAG 답변8.000 / 500Flash$0.0011
배치 분류(문서당)500 / 20Flash$0.00006
긴 컨텍스트 분석20.000 / 2.000Pro$0.0224

이 요금으로 Flash에서 문서 100,000개를 배치 분류하는 데는 약 $6, 챗봇 대화 100만 회에는 약 $315가 듭니다. 바로 실행할 수 있는 계산은 다음과 같습니다:

gemini_chi_phi.py
# Mức giá Kunavo cho Gemini 2.5 Flash (USD trên mỗi 1 triệu token)
IN_RATE, OUT_RATE = 0.09, 0.75

def chi_phi(token_vao: int, token_ra: int) -> float:
    return token_vao / 1_000_000 * IN_RATE + token_ra / 1_000_000 * OUT_RATE

print(chi_phi(1_000, 300))            # một lượt chatbot        -> $0.000315
print(chi_phi(8_000, 500))            # một câu trả lời RAG     -> $0.001095
print(chi_phi(500, 20) * 100_000)     # lô 100k tài liệu        -> ~$6.00

Kunavo 가격 및 Stripe 결제

구독 요금제나 Google Cloud 프로젝트가 필요하지 않습니다. 지갑에 잔액을 충전하면(Stripe 또는 현지 결제 수단) 각 호출이 위의 토큰별 요금에 따라 잔액에서 차감됩니다. 최소 $10 충전부터 종량제로 이용할 수 있고, 잔액은 만료되지 않으며, 더 많이 충전하면 보너스 크레딧이 추가됩니다. 하나의 지갑으로 Gemini와 Claude, GPT, 이미지, 동영상, 오디오를 비롯한 모든 모델을 사용할 수 있으므로 제공업체별 청구서를 따로 대조할 필요가 없습니다.

어떤 Gemini 모델을 선택해야 하나요?

  • gemini-2-5-flash — 채팅, 추출, 분류, 요약 및 대부분의 RAG 작업에 대한 기본 모델입니다. 빠르고 충분한 성능을 갖춘 가장 저렴한 선택입니다.
  • gemini-3-1-pro — Flash의 정확도가 부족할 때 사용하세요. 다단계 추론, 프로그래밍, 비전, 매우 긴 컨텍스트에 적합합니다.

좋은 패턴은 난이도에 따른 라우팅입니다. 일반적인 경우에는 Flash를 사용하고, 검증 단계가 실패할 때만 Pro로 올리세요. 코드에서 라우팅을 구현하는 방법은 AI 비용 최적화 가이드를 참고하세요.

Gemini 청구액 줄이기

  1. 등급을 낮추세요. 쉬운 작업의 80%는 Flash로 보내고, 어려운 20%만 Pro에 맡기세요.
  2. 출력을 제한하세요. max_tokens 및 stop sequence를 설정하세요 — 출력이 측정 단위에서 더 비싼 부분입니다.
  3. 입력을 간소화하세요. 지식 저장소 전체를 컨텍스트에 넣는 대신 더 적지만 품질 높은 RAG 구간을 검색하세요.
  4. 배치 처리하세요. 독립적인 호출을 묶어 지연 시간을 낮게 유지하고 재시도 폭주를 피하세요.

자주 묻는 질문

Gemini API는 무료인가요?

Google AI Studio는 속도가 제한된 무료 등급을 제공하므로 프로토타입 제작에 적합합니다. 프로덕션에서는 토큰당 요금을 지불합니다. Kunavo는 최소 $10 충전부터 종량제로 이용할 수 있습니다 — 아래 요금에 따라 토큰당 지불하며, 잔액은 만료되지 않고 Google Cloud 결제 계정도 필요하지 않습니다.

Gemini 2.5 Flash의 가격은 얼마인가요?

Kunavo에서 Gemini 2.5 Flash의 가격은 입력 100만 토큰당 $0.09, 출력 100만 토큰당 $0.75입니다 — Google의 공식 정가 $0.30 / $2.50보다 약 70% 저렴합니다. 일반적인 챗봇 한 번의 대화(입력 1k, 출력 300)는 약 $0.0003입니다.

Gemini가 Claude나 GPT보다 저렴한가요?

Gemini 2.5 Flash는 어디서든 가장 저렴하면서 충분한 성능을 제공하는 모델 중 하나입니다 — 대규모 작업에서 Claude Haiku와 대부분의 GPT 등급보다 저렴합니다. 전체 표는 가격 페이지에서 비교하세요.

Gemini API 비용을 줄이려면 어떻게 해야 하나요?

Flash로 낮추고, 출력을 제한하며, 검색된 컨텍스트를 간소화하고, 배치 처리하세요. 자세한 내용은 비용 최적화 가이드를 참고하세요. Gemini 호출을 시작하려면 Gemini API 키 발급 방법을 확인하세요.