가이드 목록으로
가격·2026년 9월 3일·8분 분량

GPT API 가격 2026 — GPT-5.4 / 5.5 / 5.6 Sol 토큰 요율과 실제 비용

GPT API는 무료 등급 없이 첫 호출부터 토큰 단위로 과금됩니다. GPT-5 계열의 현재 요율을 OpenAI 정가와 나란히 놓고, 청구액을 실제로 좌우하는 두 가지 함정과 한국에서 결제하는 방법을 정리했습니다.

GPT API 가격은 1M 토큰당 입력·출력 요율로 매겨지고, 월정액이나 무료 등급은 없습니다. 이 페이지는 GPT-5 계열의 현재 요율을 OpenAI 정가와 나란히 놓고, 실제 요청 하나가 얼마인지 직접 검산할 수 있는 계산 예시, 청구액을 좌우하는 두 가지 함정(reasoning 토큰과 장문 할증), 그리고 한국에서 결제하는 방법까지 정리합니다.

요율은 2026년 9월 3일에 검증했습니다 — OpenAI 정가는 openai.com/api/pricing 기준이고, Kunavo 쪽 단가는 모델 카탈로그에서 실시간으로 읽습니다.

GPT-5 계열 요율표

모델OpenAI 정가(입력 / 출력)Kunavo(입력 / 출력)차이
GPT-5.4 Mini$0.75 / $4.50$0.225 / $1.35약 70% 절감
GPT-5.4$2.50 / $15.00$1.00 / $6.00약 60% 절감
GPT-5.3 Codex$1.75 / $14.00$0.70 / $5.60약 60% 절감
GPT-5.5$5.00 / $30.00$2.00 / $12.00약 60% 절감
GPT-5.6 Sol$5.00 / $30.00$2.00 / $12.00약 60% 절감
GPT-5.5 Pro$30.00 / $180.00$12.00 / $72.00약 60% 절감

실제 요청 하나가 얼마인가

요율표만 봐서는 감이 오지 않으므로 직접 검산해 보십시오. 아래 코드는 위 표와 같은 숫자를 그대로 쓴 것이고, 토큰 수만 바꾸면 본인 워크로드의 금액이 나옵니다.

gpt_cost.py
# Kunavo GPT 요율(1M 토큰당 USD): (input, output)
RATES = {
    "gpt-5-4-mini":  (0.225, 1.35),
    "gpt-5-4":       (1.00, 6.00),
    "gpt-5-3-codex": (0.70, 5.60),
    "gpt-5-5":       (2.00, 12.00),
    "gpt-5-6-sol":   (2.00, 12.00),
}

def cost(model: str, in_tokens: int, out_tokens: int) -> float:
    i, o = RATES[model]
    # 주의: GPT-5 계열 추론 모델의 reasoning 토큰은 출력 요율로 과금됩니다.
    return in_tokens / 1_000_000 * i + out_tokens / 1_000_000 * o

print(cost("gpt-5-4-mini", 1_000, 300))   # 짧은 턴
print(cost("gpt-5-4", 6_000, 500))        # RAG 답변
print(cost("gpt-5-5", 20_000, 3_000))     # 어려운 문제
print(cost("gpt-5-6-sol", 20_000, 3_000)) # 최신 플래그십

청구액을 좌우하는 두 가지 함정

1. reasoning 토큰은 출력으로 과금됩니다. GPT-5 계열 추론 모델은 화면에 보이지 않는 사고 토큰을 만들어내고, 이 토큰은 출력 요율로 계산됩니다. 답변이 세 줄이라도 청구는 세 줄어치가 아닐 수 있습니다. 작업이 허용하는 선에서 max_tokens를 제한하고 reasoning 강도를 낮추는 것이 가장 직접적인 절감입니다.

2. 장문 할증. OpenAI는 입력이 272,000 토큰을 넘는 요청에 입력 2배·출력 1.5배를 적용합니다. Kunavo는 이 할증 없이 단일 요율로 청구합니다. 긴 문서를 통째로 넣는 RAG나 코드베이스 분석처럼 컨텍스트가 큰 작업에서는 이 차이가 어느 모델을 고르느냐보다 청구액에 더 크게 작용할 수 있습니다.

기존 OpenAI 코드에 붙이기

Kunavo는 OpenAI 호환 엔드포인트라 SDK를 바꿀 필요가 없습니다. base_url 한 줄과 키만 교체하면 됩니다.

gpt_kunavo.py
from openai import OpenAI

client = OpenAI(
    api_key="sk-kn-...",
    base_url="https://api.kunavo.com/v1",   # 이 한 줄만 바꾸면 됩니다
)

resp = client.chat.completions.create(
    model="gpt-5-4",
    messages=[{"role": "user", "content": "안녕하세요"}],
)
print(resp.choices[0].message.content)

같은 키로 Claude·Gemini·이미지·비디오 모델까지 호출됩니다 — 모델 목록은 모델 카탈로그, 엔드포인트 세부는 빠른 시작에 있습니다.

한국에서의 결제

결제는 Stripe로 처리되며 선불 충전입니다. 국내외 신용·체크 카드(Visa, Mastercard, Amex, JCB, UnionPay)와 Apple Pay를 지원하고, 최소 $10부터 충전해 쓴 만큼 차감하며 잔액은 만료되지 않습니다. OpenAI 계정이나 별도 계약은 필요 없습니다.

카카오페이·토스·네이버페이는 직접 지원하지 않습니다. 국내 발급 카드는 대부분 등록되며, 해외 결제 차단이 걸려 있다면 카드사 앱에서 해제하면 됩니다. 가격은 USD로 책정되고 Stripe가 결제 시점 환율로 원화를 환산합니다. 전체 결제 수단은 결제 문서, Claude 쪽 비용 정리는 Claude API 가격·결제, Gemini 쪽은 Gemini API 가격에 있습니다.

비용을 줄이는 네 가지 레버

  1. 출력을 줄이십시오. reasoning 토큰까지 포함해 출력이 가장 비쌉니다. max_tokens 제한과 reasoning 강도 조절이 가장 빠른 절감입니다.
  2. 문제 크기에 맞춰 등급을 낮추십시오. 분류·추출·요약 같은 작업 대부분은 GPT-5.4 Mini로 충분하고, 요율 차이는 한 자릿수 배가 아닙니다.
  3. 반복되는 앞부분 컨텍스트에는 캐싱을 쓰십시오(작동 방식).
  4. 실시간이 필요 없는 작업은 모아서 처리하십시오. 사용자를 기다리게 하지 않는 작업이라면 동시 실행으로 처리량을 올릴 수 있습니다.

자주 묻는 질문

GPT API 가격은 얼마인가요?

1M 토큰당으로 매겨집니다. 2026년 9월 3일 기준 OpenAI 정가는 GPT-5.4가 입력 $2.50 / 출력 $15.00이고, Kunavo에서는 같은 모델이 $1.00 / $6.00입니다. 그 외 Kunavo 요율은 GPT-5.4 Mini $0.225 / $1.35, GPT-5.5 $2.00 / $12.00, GPT-5.6 Sol $2.00 / $12.00, GPT-5.5 Pro $12.00 / $72.00입니다.

GPT API 무료로 쓸 수 있나요?

OpenAI는 GPT API에 무료 등급을 제공하지 않습니다 — 첫 호출부터 토큰 단위로 과금됩니다. Kunavo도 무료는 아니지만 구독이 아니라 종량제이며, 최소 $10 충전부터 쓴 만큼 차감되고 잔액은 만료되지 않습니다. 안 쓴 달은 $0입니다.

GPT-5의 reasoning 토큰도 따로 과금되나요?

GPT-5 계열 추론 모델은 화면에 보이지 않는 reasoning 토큰을 만들어내고, 이 토큰은 출력 요율로 과금됩니다. 즉 응답이 짧아 보여도 청구액은 클 수 있습니다. 작업이 허용하는 선에서 max_tokens를 제한하고 reasoning 강도를 낮추십시오 — 요금계에서 비싼 쪽은 언제나 출력입니다.

입력이 긴 요청은 요금이 더 붙나요?

OpenAI는 입력이 272,000 토큰을 넘는 요청에 입력 2배·출력 1.5배를 적용합니다. Kunavo는 이 장문 할증 없이 단일 요율로 청구합니다. 긴 문서를 통째로 넣는 RAG나 코드베이스 분석처럼 컨텍스트가 큰 작업에서는 이 차이가 모델 선택보다 청구액에 크게 작용할 수 있습니다.

GPT API 비용을 줄이는 방법은?

효과 순서로 네 가지입니다. 출력을 줄이기(reasoning 토큰 포함해 출력이 가장 비쌉니다), 문제 크기에 맞춰 등급 낮추기(대부분의 분류·추출 작업은 Mini로 충분합니다), 반복되는 앞부분 컨텍스트에 프롬프트 캐싱 쓰기, 그리고 실시간이 필요 없는 작업은 모아서 처리하기. 여기에 더 싼 엔드포인트로 base_url을 바꾸는 것이 곱해집니다.

한국에서 GPT API 요금은 어떻게 결제하나요?

Kunavo는 Stripe로 결제합니다 — 국내외 신용·체크 카드(Visa, Mastercard, Amex, JCB, UnionPay)와 Apple Pay를 지원하며 최소 $10부터 충전해 쓴 만큼 차감하는 선불 종량제이고 잔액은 만료되지 않습니다. 카카오페이·토스·네이버페이는 직접 지원하지 않지만 국내 발급 카드는 대부분 등록됩니다(해외 결제 차단이 걸려 있으면 카드사 앱에서 해제). OpenAI 계정이나 별도 계약은 필요 없습니다. 시작은 회원가입 키 발급입니다.

기존 OpenAI SDK 코드를 그대로 쓸 수 있나요?

예. Kunavo는 OpenAI 호환 엔드포인트라 base_url을 https://api.kunavo.com/v1 로 바꾸고 키만 교체하면 됩니다. 나머지 코드는 그대로 두면 되고, 같은 키로 Claude·Gemini·이미지·비디오 모델까지 호출됩니다.