가이드 목록으로
가격·2026년 9월 11일·최종 업데이트 2026년 10월 3일·10분 분량

OpenAI API 비용 2026 — GPT 요청의 실제 비용

OpenAI API는 토큰별로 청구되며 ChatGPT 구독과는 별개입니다. 모델별 최신 요금, 실제 요청 비용, 그리고 모든 추정을 무너뜨리는 두 가지 함정을 설명합니다.

OpenAI API는 월 단위가 아니라 토큰 단위로 요금이 부과됩니다. 입력 토큰과 출력 토큰에는 별도의 요금이 적용되며, 출력이 더 비쌉니다. Kunavo에서는 100만 토큰당 요금이 GPT-6 Luna의 $0,04 / $0,20부터 OpenAI의 최신 플래그십인 GPT-6 Astra의 $4,00 / $20,00까지입니다. 그 사이에는 예를 들어 $0,80 / $4,00인 GPT-6 Sol와 실무형 모델인 GPT-5.6 Terra의 $0,70 / $4,20 요금이 있습니다 — 모델에 따라 OpenAI 정가보다 60–65% 저렴. ChatGPT 구독은 별개입니다. API 사용이 포함되지 않으며, API 사용에 구독이 필요하지도 않습니다.

요금 기준일: 2026년 10월 3일. Kunavo 요금은 모델 카탈로그에서 실시간으로 읽어 옵니다. 여기에 표시된 금액이 API에 청구되는 금액입니다. ‘OpenAI 공식 가격’ 열은 동일 모델에 대해 OpenAI가 공개한 가격을 보여 주며, 출처는 openai.com/api/pricing입니다.

ChatGPT 구독과 OpenAI API: 두 제품, 두 청구서

‘ChatGPT API 비용’을 검색하는 사람은 흔히 먼저 다른 것을 알고 싶어 합니다. 기존 ChatGPT 구독이 API까지 이미 포함하는지 여부입니다. 답은 아니요입니다.

사용하는 것청구 방식대상
ChatGPT (Free, Plus, Pro …)플랜의 사용 한도에 따른 월 정액채팅 창에서 작업하는 사람
OpenAI API (키 + 잔액)토큰당 과금, 월 요금 없음자체 소프트웨어, 자동화, 에이전트

구독에는 API 키도 API 잔액도 포함되지 않으며 API 청구액을 한 푼도 줄여 주지 않습니다. 반대로 API 잔액이 ChatGPT의 사용 한도를 늘려 주지도 않습니다. 구독 가격은 OpenAI가 openai.com/chatgpt/pricing에 안내하며 자주 바뀌므로 여기에는 표시하지 않습니다. 이 페이지는 토큰 단위로 비용이 발생하는 API만 다룹니다.

모델별 OpenAI API 가격

Kunavo가 청구하는 100만 토큰당 USD 요금입니다. ‘OpenAI 공식 가격’ 열은 동일 모델의 공개 가격입니다.

모델입력 / 1M출력 / 1MOpenAI 목록(입력 / 출력)절약액
gpt-6-astra$4,00$20,00$10,00 / $50,00~60%
gpt-5-6-sol$2,00$12,00$5,00 / $30,00
프로모션 가격 $4,00 / $20,00(최소 2026년 11월 21일까지)
~60%
프로모션 가격보다 약 40% 저렴
gpt-5-5$2,00$12,00$5,00 / $30,00~60%
gpt-5-6-terra$0,70$4,20$2,00 / $12,00~65%
gpt-6-sol$0,80$4,00$2,00 / $10,00~60%
gpt-6-luna$0,04$0,20$0,10 / $0,50~60%

실시간 요금은 항상 가격 페이지와 각 모델 페이지(예: GPT-6 Astra, GPT-6 Sol, GPT-6 Luna)에 표시됩니다. 어떤 모델을 어떤 용도로 사용할지:

  • gpt-6-astra — OpenAI의 최신 플래그십(2026년 9월 3일부터): 최고 수준의 추론과 장시간 에이전트 코딩 실행에 적합합니다. 어려운 소수의 작업을 위한 모델입니다.
  • gpt-6-sol — 2026년 9월 22일부터 제공됩니다. OpenAI는 복잡한 코딩과 에이전트 워크플로를 위해 이 모델을 포지셔닝합니다. Kunavo에서는 $0,80 / $4,00입니다. GPT-5.6 Terra와 비교한 요금: 출력은 더 낮음, 입력은 약간 더 높음. 코딩과 에이전트에 적합한 합리적인 기본값입니다.
  • gpt-6-luna — 2026년 9월 22일부터 제공됩니다. OpenAI에 따르면 분류 및 추출과 같은 범위가 명확한 대규모 작업에 가장 효율적인 모델입니다. $0,04 / $0,20으로 Kunavo에서 가장 저렴한 단계입니다.
  • gpt-5-6-sol — 5.6세대의 최고급 추론 및 에이전트 코딩 모델입니다. 이미 이에 맞게 조정된 프롬프트에 적합합니다.
  • gpt-5-6-terra — 5.6 제품군의 실무형 모델입니다. RAG, 어시스턴트, 분류, 추출 및 대부분의 프로덕션 작업에 적합합니다.
  • gpt-5-5 — 이전 세대의 플래그십입니다. GPT-5.6 Sol은(는) Kunavo에서 동일한 요금($2,00 / $12,00)으로 제공됩니다. 아직 gpt-5-5를 사용 중이라면 모델 이름만 바꿔 더 새로운 세대로 전환할 수 있으며, 토큰당 추가 비용은 없습니다.

GPT-6 Sol과 GPT-6 Luna. 2026년 9월 22일 OpenAI는 GPT-6 제품군에 두 모델을 추가했으며, 자체 설명에 따르면 GPT-6 Astra의 발전을 기반으로 합니다. OpenAI는 GPT-6 Sol를 100만 토큰당 $2,00 / $10,00, GPT-6 Luna를 $0,10 / $0,50로 표시합니다. Kunavo에서는 각각 $0,80 / $4,00 및 $0,04 / $0,20입니다. 두 모델 모두 1.050.000 토큰의 컨텍스트 창을 가지며 최대 128.000 출력 토큰을 제공합니다.

GPT-6 Astra에 추가로 드는 비용. GPT-6 Sol와 비교하면 GPT-6 Astra는 입력과 출력 모두 5배이고, GPT-5.6 Sol와 비교하면 입력은 2배, 출력은 1,7배입니다. 솔직한 권장 사항은 다음과 같습니다. 코딩과 에이전트의 기본값으로 GPT-6 Sol, 대규모 작업에는 GPT-6 Luna, 동일한 입력으로 비교했을 때 Sol로 부족한 경우에만 Astra를 사용하세요. 모델명은 요청에서 한 단어만 바꾸면 되므로 테스트 비용이 저렴합니다.

매우 긴 요청에 대한 추가 요금. 프롬프트 토큰이 272,000개를 초과하면 GPT-5.5, GPT-5.6 제품군 및 GPT-6의 세 모델(Astra, Sol, Luna)은 전체 요청에 입력 요금의 2배와 출력 요금의 1.5배를 적용합니다. 전체 코드베이스나 긴 문서를 한 번의 호출에 넣는 경우 이 기준을 알아 두어야 합니다. 모델 선택보다 더 큰 영향을 줄 수 있습니다.

요청의 실제 비용

캐싱과 추론 토큰을 제외하고 Kunavo 요금으로 계산한 값입니다. 즉 청구서에 표시되는 비용의 하한선입니다:

작업토큰 (입력 / 출력)GPT-6 LunaGPT-5.6 TerraGPT-6 SolGPT-5.6 SolGPT-6 Astra
짧은 채팅 대화1.000 / 300$0,0001$0,00196$0,002$0,0056$0,01
RAG-Antwort6.000 / 500$0,00034$0,0063$0,0068$0,018$0,034
에이전트형 코딩 단계25.000 / 1.200$0,00124$0,0225$0,0248$0,0644$0,124
어려운 추론 작업20.000 / 3.000$0,0014$0,0266$0,028$0,076$0,14
배치: 분류 100,000건호출당 500 / 20$2,40$43,40$48,00$124,00$240,00

$10의 최소 충전액으로 GPT-5.6 Terra에서 약 1.590개의 RAG 응답을, GPT-6 Luna에서 약 29.400개를 실행할 수 있습니다. GPT-6 Luna와 GPT-6 Astra의 출력 비용 차이는 약 100배입니다. 단순한 작업에서는 모델 선택이 가장 큰 단일 비용 절감 수단입니다. 자신의 숫자로 다시 계산하려면:

openai_kosten.py
# OpenAI-Tarife auf Kunavo (USD pro 1M Tokens): (Input, Output)
RATES = {
    "gpt-6-astra":   (4, 20),
    "gpt-5-6-sol":   (2, 12),
    "gpt-5-5":       (2, 12),
    "gpt-5-6-terra": (0.7, 4.2),
    "gpt-6-sol":     (0.8, 4),
    "gpt-6-luna":    (0.04, 0.2),
}

def kosten(model: str, frisch: int, output: int, cache_treffer: int = 0) -> float:
    """frisch = nicht gecachter Input; output schließt Reasoning-Tokens ein."""
    i, o = RATES[model]
    return (
        frisch / 1_000_000 * i
        + output / 1_000_000 * o
        + cache_treffer / 1_000_000 * i * 0.10  # Cache-Treffer: 10 % des Input-Tarifs
    )

print(kosten("gpt-5-6-terra", 1_000, 300))    # kurze Chat-Runde
print(kosten("gpt-5-6-terra", 6_000, 500))    # RAG-Antwort
print(kosten("gpt-5-6-sol", 25_000, 1_200))   # agentischer Coding-Schritt
print(kosten("gpt-6-sol", 25_000, 1_200))     # derselbe Schritt auf GPT-6 Sol
print(kosten("gpt-6-astra", 20_000, 3_000))   # schwere Reasoning-Aufgabe
print(kosten("gpt-6-luna", 500, 20))          # eine Klassifizierung

# Ein Monat auf Sol: 3 Mio. frische und 12 Mio. gecachte Input-Tokens,
# 1 Mio. Output-Tokens (Cache-Writes nicht eingerechnet)
print(kosten("gpt-5-6-sol", 3_000_000, 1_000_000, cache_treffer=12_000_000))

모든 추정이 놓치는 두 가지 비용 함정

첫째: 추론 토큰. GPT-6 Astra 또는 GPT-5.6 Sol와 같은 추론 모델은 답변 전에 내부 토큰으로 생각합니다. 이 토큰은 답변 텍스트에는 나타나지 않지만 출력 요금으로 청구됩니다. 이 페이지의 예시 계산에는 포함되어 있지 않으므로 어려운 작업의 실제 청구액은 더 높습니다. 실제 수치는 모든 응답의 usage (completion_tokens_details.reasoning_tokens) 아래에 표시됩니다.

둘째: 반복 실행. 성공적으로 반환되었지만 코드에서 폐기된 응답(잘못된 형식이나 재시도)은 이미 비용이 청구됩니다. 에이전트에서는 눈에 보이는 작업 하나가 실제로는 수십 번 청구되는 실행일 수 있으며, 이때 추정액과 실제 청구액의 차이가 가장 큽니다. Kunavo 자체에서 실패한 요청에는 요금이 부과되지 않습니다.

프롬프트 캐싱

애플리케이션이 매 요청마다 동일한 긴 시스템 프롬프트나 동일한 문서를 전송한다면 캐시 적중에는 입력 요금의 10%가 부과됩니다. 따라서 GPT-5.6 Sol의 경우 100만 토큰당 $0,20이며 $2,00가 아닙니다. Kunavo에서 GPT-5.6 Sol, Terra 및 GPT-6 Astra의 캐시 작성 비용은 입력 요금의 1.25배이고, GPT-5.5는 일반 입력 요금입니다. 캐시 적중 방법은 캐싱 문서에 설명되어 있습니다.

기존 OpenAI 코드 전환

Kunavo는 OpenAI와 호환됩니다. base_url와 키만 변경하면 나머지는 그대로입니다. chat.completions와 responses의 형식은 유지되며, 응답에는 평소처럼 usage 필드가 포함되어 모든 청구액을 추적할 수 있습니다.

openai_kunavo.py
from openai import OpenAI

client = OpenAI(
    api_key="sk-kn-...",
    base_url="https://api.kunavo.com/v1",  # statt api.openai.com
)

resp = client.chat.completions.create(
    model="gpt-5-6-terra",
    messages=[{"role": "user", "content": "Fasse diese Rechnung in drei Sätzen zusammen."}],
)
print(resp.choices[0].message.content)
print(resp.usage)  # Input-, Output- und Reasoning-Tokens: die Grundlage der Abrechnung

키(sk-kn-…)는 등록 후 대시보드에서 생성합니다. 여기에서 키별 월간 지출 한도와 IP 허용 목록도 설정할 수 있습니다. 한도에 도달하면 키는 402를 반환합니다. 자세한 단계는 빠른 시작에 나와 있습니다.

독일에서 OpenAI API 결제하기

Kunavo는 Stripe를 통해 선불 잔액 방식으로 청구합니다. 구독이 필요하지 않으며 OpenAI Platform 계정을 설정할 필요도 없습니다. 결제 화면에서는 다음을 사용할 수 있습니다:

  • 카드: Visa, Mastercard, American Express, JCB 및 UnionPay — Visa와 Mastercard의 직불카드는 신용카드처럼 작동합니다
  • Apple Pay, Google Pay 및 Link

현재 SEPA 자동이체는 제공되지 않습니다. 충전 금액은 미국 달러로 표시되며, Stripe는 결제 과정에서 금액을 귀하의 통화로 표시합니다. 최소 충전 금액은 $10입니다. 더 큰 충전에는 보너스 잔액이 제공됩니다. $100은 $110.00이 되고, $1,000은 $1,200.00이 되며, $5,000은 $6,250.00이 됩니다. 잔액은 만료되지 않으며 실패한 요청에는 요금이 부과되지 않습니다. 자세한 내용은 청구 문서를 참조하세요.

솔직히 말해: OpenAI로 직접 가는 편이 나은 경우

Kunavo는 공유 용량을 사용하는 게이트웨이입니다. 계정 전용 할당량이 없으며 계약상 SLA도 없습니다. 보장된 할당량이나 SLA가 필요한 경우, 예를 들어 가용성을 약속한 제품을 운영하는 경우에는 OpenAI에서 직접 구매해야 합니다. 이 페이지는 그러한 사례를 지원한다고 주장하지 않습니다.

하루 종일 채팅 창에서 작업하는 사람에게는 ChatGPT 구독이 더 저렴한 경우가 많습니다. 계산은 나눗셈입니다. 구독 가격 ÷ 채팅 한 라운드의 비용 = 손익분기점입니다. 입력 토큰 2,000개와 출력 토큰 700개를 사용하는 한 라운드의 비용은 GPT-5.6 Sol에서 약 $0,0124, GPT-5.6 Terra에서 약 $0,00434입니다. 매달 이 나눗셈으로 나온 횟수보다 더 많은 채팅 라운드를 진행하면서 플랜 한도 안에 머문다면 구독이 더 유리합니다. API는 소프트웨어, 자동화 및 사용량이 변동하는 경우에 유리합니다. 사용이 뜸한 달에는 비용이 들지 않아야 하는 경우에 적합합니다.

OpenAI API 비용 줄이기 — 이 순서대로

  1. 작업에 맞는 모델 선택. 가장 큰 모델을 기본값으로 유지하는 것이 예상보다 높은 청구액의 가장 흔한 원인입니다. 분류, 추출 및 기타 대규모 작업에는 gpt-6-luna, 코딩과 에이전트에는 gpt-6-sol, 어려운 소수의 작업에는 Astra를 사용하세요.
  2. 출력 제한. 출력은 입력보다 몇 배 비싸고 추론도 여기에 포함되므로 max_tokens에 제한을 두면 효과가 두 배입니다.
  3. 프롬프트 캐싱 사용. 길고 안정적인 시스템 프롬프트는 캐시 적중 시 입력 요금의 10분의 1만 비용이 듭니다.
  4. 전송하는 컨텍스트 줄이기. 지식 기반의 절반 대신 정확한 RAG 섹션 몇 개만 보내고, 가능한 경우 272,000 토큰 기준 아래에 머무르세요.

자신의 숫자로 다시 계산하려면 OpenAI API 가격 계산기가 캐시된 입력과 추론 토큰을 포함해 계산하고, 토큰 계산기는 Claude와 GPT를 나란히 비교합니다. Anthropic에 해당하는 페이지는 Claude 가격입니다. 비용이 아니라 한도가 문제라면 OpenAI API 속도 제한(영어)을 참조하세요.

자주 묻는 질문

OpenAI API의 비용은 얼마인가요?

OpenAI API는 월 요금 없이 토큰 단위로 청구됩니다. 입력 토큰과 출력 토큰에는 별도의 요금이 적용되며, 출력이 더 비쌉니다. Kunavo에서 GPT-5.6는 100만 토큰당(입력 / 출력) Terra $0,70 / $4,20, GPT-5.6는 Sol $2,00 / $12,00이며, OpenAI의 최신 플래그십 모델 GPT-6은 Astra $4,00 / $20,00입니다. 동일한 모델에 대한 OpenAI 공개 가격은 $2,00 / $12,00, $5,00 / $30,00, $10,00 / 입니다$50,00; GPT-5.6 Sol에 대해 OpenAI는 현재 프로모션 가격 $4,00 / $20,00를 부과하며, 가격 페이지에 따르면 최소 2026년 11월 21일까지입니다. 기준일: 2026년 10월 3일.

API가 ChatGPT 구독에 포함되나요?

아니요. Plus나 Pro 같은 ChatGPT 구독은 브라우저, 앱, 데스크톱에서 ChatGPT 자체를 사용하는 비용을 지불합니다. API 키나 API 잔액은 포함되지 않으며 API 청구액을 한 푼도 줄여주지 않습니다. 자체 소프트웨어에서 GPT를 호출하려면 API 키가 필요하고, 구독과 별도로 토큰 단위로 결제해야 합니다. 반대로 API 잔액이 ChatGPT의 할당량을 늘려주지도 않습니다.

ChatGPT API에 요청 하나를 보내는 비용은 얼마인가요?

일반적으로 “ChatGPT API”라고 부르는 것은 GPT 모델을 사용하는 OpenAI API이며, 모든 요청을 토큰 기준으로 청구합니다. Kunavo 요금 기준으로 입력 6,000토큰과 출력 500토큰을 사용하는 GPT-5.6 Terra의 RAG 응답은 약 $0,0063, GPT-5.6 Sol에서 입력 / 출력 25,000 / 1,200토큰을 사용하는 에이전트형 코딩 단계는 약 $0,0644, GPT-6 Astra에서 입력 / 출력 20,000 / 3,000토큰을 사용하는 어려운 작업은 약 $0,14입니다. 추론 토큰은 출력 요금으로 추가 청구됩니다.

OpenAI API를 무료로 테스트할 수 있나요?

Kunavo는 시작 크레딧을 제공하지 않지만 월 요금이나 최소 사용 기간도 요구하지 않습니다. 최소 시작 금액은 $10의 최소 충전액이며, 이 금액으로 GPT-5.6 Terra에서 RAG 응답을 약 1.590개 처리할 수 있습니다. 잔액은 만료되지 않고, 호출이 없는 달에는 비용이 들지 않으며, 실패한 요청에는 요금이 부과되지 않습니다.

추론 토큰은 어떻게 청구되나요?

출력 요금에 관한 내용입니다. GPT-6 Astra 또는 GPT-5.6 Sol와 같은 추론 모델은 답변 전에 내부 토큰으로 사고합니다. 이 토큰은 답변 텍스트에는 표시되지 않지만 청구에는 포함됩니다. 실제 토큰 수는 각 응답의 usage 필드(completion_tokens_details.reasoning_tokens)에서 확인할 수 있습니다. 어려운 작업에서는 실제 청구액이 예상보다 높아지는 가장 흔한 원인이며, max_tokens보다 높은 제한이 이를 상한으로 제한합니다.

GPT-6 Astra의 비용은 얼마인가요?

GPT-6 Astra는 2026년 9월 3일부터 OpenAI의 최신 플래그십 모델이며, OpenAI 공개 가격은 100만 토큰당 $10,00 / $50,00입니다. Kunavo 요금은 $4,00 / $20,00 — 공개 가격보다 약 60% 저렴한 수준. GPT-5.6 Sol와 비교하면 입력은 2배, 출력은 1,7배입니다. 따라서 Astra는 Sol로는 충분하지 않다는 것이 입증된 소수의 어려운 작업에 사용할 만합니다. 프롬프트 토큰이 272,000개를 초과하면 Astra에서도 전체 요청에 입력 2배 및 출력 1.5배 요금이 적용됩니다.

GPT-6 Sol과 GPT-6 Luna의 비용은 얼마인가요?

OpenAI는 2026년 9월 22일 GPT-6 Sol 및 GPT-6 Luna를 출시했습니다. Sol은 복잡한 코딩과 에이전트 워크플로를 위한 모델이며, Luna는 OpenAI의 표현에 따르면 범위가 명확한 대량 작업에 가장 효율적인 모델입니다. OpenAI는 100만 토큰당 Sol을 $2,00 / $10,00, Luna를 $0,10 / $0,50로 게시합니다(입력 / 출력). Kunavo에서는 각각 $0,80 / $4,00 및 $0,04 / $0,20, beide rund 60% darunter입니다. 따라서 GPT-6 Luna는 Kunavo에서 가장 저렴한 GPT 모델입니다. GPT-5.5, GPT-5.6 제품군 및 GPT-6 Astra와 마찬가지로 프롬프트 토큰이 272,000개를 초과하는 요청에는 전체 입력에 2배, 출력에 1.5배 요금이 적용됩니다.

독일에서 SEPA 자동이체로 결제할 수 있나요?

아니요. 현재 SEPA 자동이체는 제공되지 않습니다. Stripe 결제에서는 카드(Visa, Mastercard, American Express, JCB, UnionPay), Apple Pay, Google Pay 및 Link를 선택할 수 있습니다. Visa 또는 Mastercard 직불카드는 신용카드처럼 작동합니다. 최소 $10부터 충전하는 선불 잔액이며, 구독이 없고 만료되지 않습니다.

기존 OpenAI 코드는 Kunavo에서 작동하나요?

예. Kunavo는 OpenAI와 호환됩니다. base_url을 https://api.kunavo.com/v1로 설정하고 키를 Kunavo 키(sk-kn-…)로 교체하면 됩니다. chat.completions와 responses의 형식은 그대로 유지됩니다. 모델 이름은 gpt-6-astra, gpt-5-6-sol, gpt-5-5, gpt-5-6-terra, gpt-6-sol 및 gpt-6-luna입니다. 동일한 키로 Claude와 이미지 및 비디오 모델도 호출할 수 있습니다.