가이드 목록으로
가격·2026년 6월 18일·최종 업데이트 2026년 9월 12일·8분 분량

Gemini API 가격 2026 — 모델별 요금, Google 공식 가격보다 약 70% 저렴

모델별 최신 Gemini API 가격, 직접 검증할 수 있는 계산 예시 및 프로덕션에서 Gemini를 호출하는 가장 저렴한 방법을 설명합니다. OpenAI 호환 API를 통해 Google 공식 가격보다 약 70% 저렴합니다.

Gemini는 최상급 AI에서 최고의 가격 대비 성능을 제공하는 제품군 중 하나이며, Kunavo는 하나의 OpenAI 호환 API를 통해 Google 정가보다 약 70% 낮은 가격으로 제공합니다. 이 Gemini API 가격 가이드는 모델별 최신 요금을 제시하고, 재계산 가능한 비용 예시를 제공하며, Gemini를 프로덕션에서 호출하는 가장 저렴한 방법을 보여 줍니다.

Gemini 가격 한눈에 보기

요금은 Kunavo에서 청구되는 방식과 동일하게 USD 기준 1M 토큰당 적용됩니다. “Google 정가” 열은 동일한 모델에 대한 Google의 공개 요금이며 차이를 확인할 수 있도록 표시했습니다.

모델입력 / 1M출력 / 1MGoogle 정가 (입력 / 출력)절약 금액
gemini-2-5-flash$0.09$0.75$0.30 / $2.50~70%
gemini-3-1-pro$0.70$4.20$2.00 / $12.00~65%

Flash는 대규모 처리의 주력 모델이고, Pro는 더 어려운 추론, 비전, 긴 컨텍스트 작업에 적합합니다. 실시간 요금은 항상 가격 페이지와 각 모델 페이지(gemini-2-5-flash, gemini-3-1-pro)에서 확인할 수 있습니다.

Gemini 토큰 가격의 작동 방식

입력 토큰(보내는 모든 것 — 시스템 프롬프트, 검색된 컨텍스트, 사용자 메시지)과 출력 토큰(모델이 생성하는 내용)에 대해 비용을 지불합니다. 출력이 더 비싼 쪽이므로 Gemini 청구서에서 가장 큰 영향을 미치는 요소는 모델이 작성하게 하는 텍스트의 양입니다. 이미지와 오디오는 토큰 등가량으로 변환되어 동일한 카운터로 청구됩니다.

비용 계산 예시

마지막 행에서 Gemini 3.1 Pro를 사용하는 것을 제외하면, Kunavo의 Gemini 2.5 Flash 요금을 기준으로 한 실제 수치입니다.

워크로드토큰 (입력 / 출력)모델비용
챗봇 한 턴1.000 / 300Flash$0.0003
RAG 응답8.000 / 500Flash$0.0011
배치 분류 (문서당)500 / 20Flash$0.00006
긴 컨텍스트 분석20.000 / 2.000Pro$0.0224

이 요금으로 Flash에서 문서 100,000개를 배치 분류하면 약 $6, 챗봇 100만 턴은 약 $315입니다. 실행 가능한 계산은 다음과 같습니다.

gemini_kosten.py
# Kunavo-Tarife für Gemini 2.5 Flash (USD pro 1M Tokens)
IN_RATE, OUT_RATE = 0.09, 0.75

def kosten(in_tokens: int, out_tokens: int) -> float:
    return in_tokens / 1_000_000 * IN_RATE + out_tokens / 1_000_000 * OUT_RATE

print(kosten(1_000, 300))            # ein Chatbot-Turn      -> $0.000315
print(kosten(8_000, 500))            # eine RAG-Antwort       -> $0.001095
print(kosten(500, 20) * 100_000)     # Batch mit 100k Docs    -> ~$6.00

Kunavo 가격 및 Stripe를 통한 결제

구독이나 Google Cloud 프로젝트는 없습니다. 잔액을 충전하면(Stripe 또는 현지 결제 수단), 호출 비용이 위 토큰 요금에 따라 잔액에서 차감됩니다. 최소 $10 충전부터 Pay-as-you-go 방식으로 사용할 수 있으며, 잔액은 만료되지 않고 더 큰 충전에는 보너스 잔액이 제공됩니다. 하나의 잔액으로 Gemini와 Claude, GPT, 이미지, 비디오, 오디오 등 모든 모델을 사용할 수 있으므로 공급업체별 별도 청구서를 대조할 필요가 없습니다.

어떤 Gemini 모델을 선택해야 하나요?

  • gemini-2-5-flash — 채팅, 추출, 분류, 요약 및 대부분의 RAG에 적합한 기본 모델입니다. 빠르고 성능이 뛰어난 옵션 중 가장 저렴합니다.
  • gemini-3-1-pro — Flash가 충분히 정확하지 않을 때 사용하세요. 다단계 추론, 코드, 비전 및 매우 긴 컨텍스트에 적합합니다.

좋은 패턴은 난이도에 따른 라우팅입니다. 일반적인 경우에는 Flash를 사용하고, 검사에 실패한 경우에만 Pro로 승격하세요. 코드에서 라우팅 방식을 구현하는 방법은 AI 비용 최적화 가이드에 나와 있습니다.

Gemini 청구서를 줄이는 방법

  1. 낮은 등급을 사용하세요. 간단한 작업의 80%는 Flash로 보내고, 어려운 20%에만 Pro를 사용하세요.
  2. 출력을 제한하세요. max_tokens와 중지 시퀀스를 설정하세요. 카운터에서 출력이 비싼 쪽입니다.
  3. 입력을 간결하게 하세요. 전체 지식 기반을 컨텍스트에 넣는 대신 더 적고 더 나은 RAG 청크를 검색하세요.
  4. 배치 처리하세요. 독립적인 호출을 묶어 지연 시간을 낮게 유지하고 재시도 폭주를 방지하세요.

동일한 키로 Google의 비디오 모델도 호출할 수 있습니다. 클립당 비용은 Veo 3 비용에, OpenAI와의 비교는 OpenAI API 비용에 나와 있습니다.

자주 묻는 질문

Gemini API는 무료인가요?

Google AI Studio는 프로토타이핑을 위한 요청 제한 Free-Tier를 제공합니다. 프로덕션에서는 토큰당 비용이 청구됩니다. Kunavo는 최소 $10 충전부터 Pay-as-you-go 방식으로 사용하며, 아래 요금에 따라 토큰당 지불합니다. 잔액은 만료되지 않고 Google Cloud 결제 계정도 필요하지 않습니다.

Gemini 2.5 Flash의 비용은 얼마인가요?

Kunavo에서 Gemini 2.5 Flash는 입력 1M 토큰당 $0.09, 출력 1M 토큰당 $0.75입니다. Google 정가 $0.30 / $2.50보다 약 70% 낮습니다. 일반적인 챗봇 한 턴(입력 1K, 출력 300)은 약 $0.0003입니다.

Gemini가 Claude나 GPT보다 저렴한가요?

Gemini 2.5 Flash는 가장 저렴하면서도 성능이 뛰어난 모델 중 하나로, 대규모 사용량에서 Claude Haiku와 대부분의 GPT 등급보다 저렴합니다. 전체 표는 가격 페이지에서 비교하세요.

Gemini API 비용을 어떻게 낮추나요?

Flash로 낮추고, 출력을 제한하고, 검색된 컨텍스트를 간결하게 만들고, 배치 처리하세요. 자세한 내용은 AI 비용 최적화 가이드를 참고하세요. Gemini 호출을 시작하려면 Gemini API 키를 만드는 방법을 읽어 보세요.