GPT API 요금은 토큰 단위 종량제입니다. 월정액은 없으며 입력 토큰과 출력 토큰에 별도 단가가 적용되고, 출력이 더 비쌉니다. 2026년 10월 4일 시점의 Kunavo 요금은 1M 토큰당 gpt-5-6-terra가 입력 $0.70 / 출력 $4.20, gpt-5-5가 $2.00 / $12.00이며 — 모두 OpenAI 정가보다 저렴합니다. 2026년 9월 22일에 출시된 gpt-6-luna는 $0.04 / $0.20이고 Kunavo에서 가장 저렴한 GPT입니다.
먼저 구분해야 할 것이 하나 있습니다. ChatGPT 월정액 플랜과 OpenAI API는 별개의 상품이며 별도로 과금됩니다. ChatGPT에 결제해도 API 키는 제공되지 않고 API 요금도 줄어들지 않습니다. 이 페이지는 후자만, 즉 코드에서 호출하는 쪽의 요금을 다룹니다.
요율은 2026년 10월 4일에 검증되었습니다. Kunavo 측 수치는 이 사이트의 카탈로그에서 렌더링되므로 실제 청구액과 어긋나지 않습니다. OpenAI 정가는 OpenAI 가격 페이지를 참조합니다.
GPT-5 / GPT-6 계열 요율표
1M 토큰당 USD. ‘OpenAI 정가’는 동일 모델의 공개 요금입니다. 프로모션 중인 모델에는 현재 OpenAI가 실제로 청구하는 가격도 아래에 함께 표시합니다.
| 모델 | 입력 / 100만 | 출력 / 100만 | OpenAI 정가 |
|---|---|---|---|
gpt-6-luna | $0.04 | $0.20 | $0.10 / $0.50 |
gpt-6-sol | $0.80 | $4.00 | $2.00 / $10.00 |
gpt-5-6-terra | $0.70 | $4.20 | $2.00 / $12.00 |
gpt-5-5 | $2.00 | $12.00 | $5.00 / $30.00 |
gpt-6-astra | $4.00 | $20.00 | $10.00 / $50.00 |
gpt-5-6-sol | $2.00 | $12.00 | $5.00 / $30.00 현재 프로모션 가격 $4.00 / $20.00(최소 2026년 11월 21일까지) |
최신 요율은 항상 가격 페이지와 각 모델 페이지에 표시됩니다. 전체 모델 목록은 모델 목록에서 확인하세요.
GPT-6는 OpenAI의 새로운 세대입니다.GPT-6 Astra가 2026년 9월 3일에 OpenAI의 최상위 모델로 출시되었고, GPT-6 Sol와 GPT-6 Luna가 2026년 9월 22일에 뒤이어 출시되었습니다. OpenAI는 두 모델을 ‘GPT-6 Astra를 뒷받침한 발전 위에 구축한’ 모델이라고 설명하며, Sol은 복잡한 코딩과 에이전트 워크플로용, Luna는 ‘집중적인 대량 처리를 위한 가장 효율적인 모델’로 포지셔닝합니다. 두 모델 모두 컨텍스트는 1,050,000 토큰, 최대 출력은 128,000 토큰입니다.
Kunavo에서는 GPT-6 Luna가 $0.04 / $0.20로 가장 저렴한 GPT입니다. GPT-6 Sol는 $0.80 / $4.00이며, 출력 단가는 GPT-5.6 Terra($4.20)보다 낮습니다. 다만 입력 단가는 GPT-5.6 Terra($0.70) 쪽이 더 저렴하며, 입력 토큰이 출력의 2배를 초과하는 요청에서는 GPT-5.6 Terra 쪽이 더 저렴해집니다(아래 표에서 비교할 수 있습니다). 입력이 272,000토큰을 초과하는 요청은 다른 GPT-5.x / GPT-6과 마찬가지로 OpenAI가 정한 대로 요청 전체에 입력 2배·출력 1.5배 요금이 적용됩니다.
요청 하나의 실제 비용
| 용도 | 토큰 | gpt-6-luna | gpt-6-sol | gpt-5-6-terra | gpt-5-5 |
|---|---|---|---|---|---|
| 짧은 1턴 | 입력 1,000 / 출력 300 | $0.0001 | $0.0020 | $0.0020 | $0.0056 |
| RAG 답변 1건 | 입력 6,000 / 출력 500 | $0.0003 | $0.0068 | $0.0063 | $0.0180 |
| 어려운 문제 | 입력 20,000 / 출력 3,000 | $0.0014 | $0.0280 | $0.0266 | $0.0760 |
| 10만 건 배치 | 입력 500 / 출력 20 × 100,000 | $2.40 | $48.00 | $43.40 | $124.00 |
자신의 수치로 계산하려면 아래 식을 그대로 사용할 수 있습니다.
# Kunavo の GPT 料率(1M トークンあたり USD): (input, output)
RATES = {
"gpt-5-6-terra": (0.70, 4.20),
"gpt-5-5": (2.00, 12.00),
"gpt-5-6-sol": (2.00, 12.00),
"gpt-6-sol": (0.80, 4.00),
"gpt-6-luna": (0.04, 0.20),
}
def cost(model: str, in_tokens: int, out_tokens: int) -> float:
i, o = RATES[model]
# 注意: GPT-5 系の推論モデルは reasoning トークンも出力料率で課金される。
return in_tokens / 1_000_000 * i + out_tokens / 1_000_000 * o
print(cost("gpt-5-6-terra", 1_000, 300)) # 短い 1 ターン
print(cost("gpt-5-6-terra", 6_000, 500)) # RAG の回答 1 件
print(cost("gpt-5-5", 20_000, 3_000)) # 難しい問題
print(cost("gpt-5-6-sol", 20_000, 3_000)) # GPT-5.6 のフラッグシップ
print(cost("gpt-6-sol", 20_000, 3_000)) # GPT-6 Sol
print(cost("gpt-6-luna", 1_000, 300)) # いちばん安い 1 ターン청구액을 왜곡하는 두 가지 함정
첫 번째는 reasoning 토큰입니다. GPT-5 계열 추론 모델은 답변 전에 내부적으로 사고 토큰을 생성하며, 이는 응답 본문에 나타나지 않지만 출력 요율로 청구됩니다. 위 표는 reasoning을 포함하지 않은 금액이므로 어려운 문제일수록 실제 청구액은 이보다 높습니다. usage 필드의 출력 토큰 수가 실제 수치입니다.
두 번째는 재시도입니다. 토큰을 소비한 뒤 하위 시스템에서 실패한 요청도 과금 대상입니다. 에이전트 워크로드에서는 사용자에게 보이는 하나의 작업이 과금상 여러 왕복으로 나뉘므로 이 차이가 가장 크게 나타납니다. Kunavo 측에서 실패한(즉 상위 시스템에 도달하지 않은) 요청에는 요금이 부과되지 않습니다.
기존 OpenAI 코드에 연결하기
변경할 것은 base_url 한 줄과 키뿐입니다. chat.completions도 responses도 동일한 형식으로 작동합니다.
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1", # 変えるのはこの 1 行だけ
)
resp = client.chat.completions.create(
model="gpt-5-6-terra",
messages=[{"role": "user", "content": "こんにちは"}],
)
print(resp.choices[0].message.content)같은 키로 Claude·이미지·동영상도 호출할 수 있습니다. 절차는 빠른 시작, 엔드포인트 목록은 Chat Completions 문서에서 확인하세요.
일본에서 결제하기
Kunavo 잔액은 Stripe 체크아웃에서 JCB를 포함한 카드(Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay, Google Pay 및 Link를 지원합니다. 선불 지갑 방식이며, 최소 충전액은 $10이고 잔액은 만료되지 않습니다. 사용하지 않은 달에는 청구되지 않습니다. 편의점 결제와 PayPay는 지원하지 않습니다. 국내 사업자로서의 표시 사항은 특정상거래법에 따른 표시에, 청구 관련 자세한 내용은 청구 문서에 정리되어 있습니다.
비용을 낮추는 네 가지 방법
- 문제의 규모에 맞춰 티어를 선택하세요. 기본값을 최상위 모델로 설정하지 마세요. 분류·추출·정리처럼 대량 처리하는 작업은 OpenAI가 해당 용도로 분류한 가장 저렴한
gpt-6-luna부터 시도하고, 부족하면 상위 모델로 올리세요. 위 표처럼 동일한 RAG 답변 하나라도gpt-6-luna와gpt-5-5는 약 53배 차이 납니다. - 출력을 제한하세요. 출력은 입력보다 비싸므로
max_tokens와 출력 형식 지정이 직접적인 효과를 냅니다. reasoning 모델에서는 이 효과가 두 배로 나타납니다. - 프롬프트 캐시를 활용하세요. 동일한 시스템 프롬프트를 매번 보내는 구조라면 캐시가 가장 큰 절감 수단입니다. 작동 방식은 캐시 문서에서 확인하세요.
- 입력과 관계없는 기록을 쌓지 마세요. 다른 작업으로 넘어가면 대화를 지우세요. 긴 기록은 매번 전체가 과금됩니다.
다른 회사 모델과 나란히 비교하려면 Claude 가격 페이지에서 같은 계산 방법으로 비교합니다. Codex CLI 종량제만 확인하려면 Codex 가격을 참고하세요.
자주 묻는 질문
GPT API 요금은 얼마인가요?
토큰 단위 종량제로 과금되며 입력과 출력에 별도 단가가 적용됩니다. 2026년 10월 4일 시점의 Kunavo 요금은 1M 토큰당 gpt-5-6-terra가 입력 $0.70 / 출력 $4.20, gpt-5-5가 $2.00 / $12.00, gpt-5-6-sol이 $2.00 / $12.00입니다. 동일 모델의 OpenAI 정가는 각각 $2.00 / $12.00, $5.00 / $30.00, $5.00 / $30.00입니다(gpt-5-6-sol은 현재 OpenAI가 프로모션 가격 $4.00 / $20.00로 제공하며, 요금 페이지에 따르면 최소 2026년 11월 21일까지 계속됩니다). 2026년 9월 22일에 출시된 gpt-6-sol은 $0.80 / $4.00, gpt-6-luna는 $0.04 / $0.20(OpenAI 정가는 $2.00 / $10.00 및 $0.10 / $0.50)이며, gpt-6-luna가 가장 저렴한 GPT입니다. 월정액은 없습니다.
GPT-6 API 요금은 얼마인가요?
OpenAI 정가(1M 토큰당, 입력 / 출력): GPT-6 Sol $2.00 / $10.00, GPT-6 Luna $0.10 / $0.50, GPT-6 Astra $10.00 / $50.00(Sol과 Luna는 2026년 9월 22일, Astra는 2026년 9월 3일에 공개). Kunavo의 1M 토큰당 입력 / 출력 요금은 gpt-6-sol $0.80 / $4.00, gpt-6-luna $0.04 / $0.20, GPT-6 Astra $4.00 / $20.00입니다. 모두 정가보다 약 60% 저렴하게 이용할 수 있습니다.gpt-6-luna는 Kunavo에서 가장 저렴한 GPT이며, gpt-6-sol은 출력 단가가 gpt-5-6-terra($4.20)보다 낮습니다(입력 단가는 gpt-5-6-terra의 $0.70 쪽이 더 저렴합니다). 입력이 272,000 토큰을 초과하는 요청은 OpenAI와 마찬가지로 요청 전체에 입력 2배·출력 1.5배 요금이 적용됩니다.
ChatGPT 월정액과 OpenAI API 요금은 같은 것인가요?
아니요. 별개의 상품이며 별도로 과금됩니다. ChatGPT 유료 플랜은 chat.openai.com 화면을 사용하기 위한 월정액이며 API 사용량이나 API 키는 포함되지 않습니다. API는 토큰 단위 종량제이므로 월정액은 없지만 호출한 만큼 청구됩니다. 코드에서 호출하려면 API가 필요하며, ChatGPT에 결제해도 API 요금은 1엔도 줄어들지 않습니다.
GPT API의 실제 요청 하나는 얼마인가요?
입력 6,000·출력 500토큰의 RAG 답변 하나는 gpt-5-6-terra에서 약 $0.0063, 가장 저렴한 gpt-6-luna에서는 약 $0.0003입니다. 입력 20,000·출력 3,000토큰의 어려운 문제라면 gpt-5-5에서 약 $0.0760, gpt-5-6-sol에서 약 $0.0760입니다. 모두 Kunavo 요율 기준이며 reasoning 토큰은 포함하지 않은 금액입니다.
reasoning 토큰은 어떻게 과금되나요?
출력 요율로 과금됩니다. GPT-5 계열 추론 모델은 답을 내기 전에 내부에서 사고 토큰을 생성합니다. 이 토큰은 응답 본문에 나타나지 않지만 청구에는 반영됩니다. 예상 금액이 실제 청구액보다 낮아지는 가장 흔한 원인이며, 어려운 문제일수록 차이가 커집니다. usage 필드의 출력 토큰 수를 읽으면 실제 수치를 알 수 있으므로 예상치가 아니라 이를 사용하세요.
GPT를 저렴하게 사용하려면 어떻게 해야 하나요?
효과가 큰 순서로 네 가지입니다. 문제의 규모에 맞춰 티어를 선택하고 기본값을 최상위 모델로 설정하지 마세요(출력 단가 기준으로 가장 저렴한 gpt-6-luna와 최상위 gpt-6-astra는 100배 차이 납니다). max_tokens와 출력 형식 지정으로 출력을 제한하세요. 프롬프트 캐시를 활용하세요. 입력에 관련 없는 대화를 쌓지 마세요. 여기에 OpenAI 정가보다 저렴한 엔드포인트를 사용하면 네 가지 효과가 중첩됩니다.
기존 OpenAI SDK 코드는 그대로 작동하나요?
작동합니다. Kunavo는 OpenAI 호환 엔드포인트이므로 base_url을 https://api.kunavo.com/v1로 바꾸는 한 줄과 키만 변경하면 됩니다. chat.completions와 responses 모두 같은 형식으로 작동하며 모델명도 그대로 사용할 수 있습니다. 같은 키로 Claude·이미지·동영상도 호출할 수 있습니다.
일본에서 GPT API 요금을 결제하는 방법은 무엇인가요?
Kunavo 잔액은 Stripe 체크아웃에서 JCB를 포함한 카드(Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay, Google Pay 및 Link를 지원합니다. 선불 지갑 방식이며 최소 충전액은 $10입니다. 잔액은 만료되지 않고, 사용하지 않은 달에 청구되지 않습니다. 편의점 결제와 PayPay는 지원하지 않습니다.