Claude는 추론·코딩·에이전트 작업의 표준이고, Kunavo는 Claude 전 모델을 Anthropic 정가보다 약 60% 저렴하게 하나의 OpenAI 호환 API로 제공합니다. 이 가이드는 한국 개발자가 가장 자주 검색하는 클로드 API 결제·비용·가격을 한 번에 정리합니다 — 모델별 현재 요율, 국내 카드 결제 방법, 직접 검증할 수 있는 비용 계산, 그리고 청구액을 가장 많이 줄이는 방법까지.
한눈에 보는 Claude API 가격
요율은 Kunavo에서 청구되는 기준으로 1M 토큰당 USD입니다. “Anthropic 정가” 열은 동일 모델에 대한 Anthropic 공시 요율이라 차이를 바로 비교할 수 있습니다.
| 모델 | 입력 / 1M | 출력 / 1M | Anthropic 정가 (입력 / 출력) | 절감률 |
|---|---|---|---|---|
claude-haiku-4-5 | $0.40 | $2.00 | $1.00 / $5.00 | ~60% |
claude-sonnet-4-6 | $1.20 | $6.00 | $3.00 / $15.00 | ~60% |
claude-opus-4-7 | $2.00 | $10.00 | $5.00 / $25.00 | ~60% |
claude-opus-5 | $2.00 | $10.00 | $5.00 / $25.00 | ~60% |
claude-opus-5-fast | $7.00 | $35.00 | $10.00 / $50.00 | ~30% |
실시간 요율은 항상 가격 페이지와 각 모델 페이지에서 확인할 수 있습니다 (claude-sonnet-4-6, claude-haiku-4-5, claude-opus-4-7). Haiku는 저렴한 주력, Sonnet은 균형 잡힌 기본값, Opus는 가장 무거운 추론용입니다.
Claude Opus 5는 Claude 5 제품군의 가성비 선택입니다. Anthropic 공시가는 1M 토큰당 $5.00 / $25.00로, 거의 플래그십급 추론을 Claude Fable 5 정가의 절반에 제공합니다. Kunavo에서는 $2.00 / $10.00로 정가보다 약 60% 저렴하고, 기존 claude-opus-4-7과 완전히 같은 요율입니다 — 워크로드를 Opus 4.7에서 Opus 5로 옮기는 건 모델 이름 한 단어만 바꾸면 되고 추가 비용이 들지 않습니다.
Claude Opus 5 Fast는 어떤가요? 지연 시간을 줄인 claude-opus-5-fast는 추론 품질이 Opus 5와 같고 출력만 더 빠른 모델로, Anthropic 공시가는 1M 토큰당 $10.00 / $50.00 — 표준 Opus 5의 정확히 2배입니다. Kunavo에서는 $7.00 / $35.00로 정가보다 약 30% 저렴합니다. 응답 시간이 최적화 대상일 때 — 대화형 코딩 세션, 사용자가 화면 앞에서 기다리는 경우 — Fast를 고르세요. 배치·에이전트·긴 컨텍스트 작업이라면 표준 claude-opus-5가 같은 답을 훨씬 적은 비용으로 돌려줍니다.
Claude API 결제 방법 — 국내 카드, 카카오페이?
결제는 Stripe로 처리됩니다. 구독도, Anthropic Console 결제 설정도 없습니다. 잔액을 충전하면 호출 시 위 토큰당 요율로 잔액에서 차감됩니다. 한국 고객이 사용할 수 있는 수단:
- 신용 / 체크 카드: Visa, Mastercard, American Express, JCB
- Apple Pay, Link (원클릭 결제)
- 엔터프라이즈 고객은 Net 30 조건의 인보이스 결제 가능
가격은 미국 달러(USD)로 책정되며 Stripe가 결제 시점에 원화로 자동 환산합니다 (환전 수수료는 카드사 정책을 따름). 최소 충전 $10 USD(약 1만 4천원 내외)부터 사용한 만큼 지불하고, 선불 지갑 방식이라 미사용 잔액은 만료되지 않습니다. 카카오페이·토스는 직접 지원하지 않지만, 국내 발급 카드라면 대부분 등록할 수 있습니다(해외 결제 차단 설정이 있으면 카드사 앱에서 해제 필요).
비용 계산 예시
Kunavo 요율로 계산한 실제 수치입니다:
| 작업 | 토큰 (입력 / 출력) | 모델 | 비용 |
|---|---|---|---|
| 고객 문의 응대 | 800 / 200 | Haiku 4.5 | $0.00072 |
| RAG 답변 | 6,000 / 500 | Sonnet 4.6 | $0.0102 |
| 코딩 어시스턴트 호출 | 10,000 / 1,500 | Sonnet 4.6 | $0.021 |
| 긴 컨텍스트 분석 | 50,000 / 2,000 | Opus 4.7 | $0.12 |
Haiku로 하루 1만 건의 고객 문의를 처리해도 약 $7.20/일입니다. 직접 실행할 수 있는 계산식:
# Kunavo Claude 요율 (1M 토큰당 USD): (입력, 출력)
RATES = {
"claude-haiku-4-5": (0.40, 2.00),
"claude-sonnet-4-6": (1.20, 6.00),
"claude-opus-4-7": (2.00, 10.00),
"claude-opus-5": (2.00, 10.00),
}
def cost(model: str, in_tokens: int, out_tokens: int) -> float:
i, o = RATES[model]
return in_tokens / 1_000_000 * i + out_tokens / 1_000_000 * o
print(cost("claude-haiku-4-5", 800, 200)) # 고객 문의 한 건 -> $0.00072
print(cost("claude-sonnet-4-6", 6_000, 500)) # RAG 답변 한 건 -> $0.0102
print(cost("claude-opus-4-7", 50_000, 2_000)) # 긴 컨텍스트 분석 -> $0.12
print(cost("claude-opus-5", 50_000, 2_000)) # Opus 5 분석 -> $0.12한국어는 영어보다 토큰을 약 1.5~2배 더 소비하므로(글자당 약 0.5~0.7 토큰), 예산을 잡을 때 이 점을 감안하세요.
프롬프트 캐싱 — 가장 큰 단일 절감
시스템 프롬프트나 검색된 컨텍스트가 크고 안정적이라면, 프롬프트 캐싱은 캐시된 입력을 입력 요율의 10%로 청구합니다. 길고 반복되는 시스템 프롬프트라면 입력 비용을 60~90% 줄일 수 있습니다. 요청에 필드 하나만 추가하면 됩니다 — Anthropic 프롬프트 캐싱 심층 가이드와 Messages API 레퍼런스를 참고하세요.
키 하나로 Claude·Gemini·GPT·이미지·비디오
Kunavo 키(sk-kn-…) 하나면 Claude뿐 아니라 Gemini, GPT, 이미지 생성, 비디오 생성, 오디오 모델까지 모두 호출됩니다 — 모두 OpenAI 호환 형식이고, 하나의 Stripe 잔액에서 차감되며, 제공자별로 별도 청구서를 대조할 필요가 없습니다. Claude는 OpenAI 호환 /v1/chat/completions와 네이티브 Anthropic Messages API(/v1/messages) 양쪽으로 호출할 수 있어 기존 SDK를 그대로 유지하면 됩니다. 발급 절차는 인증 문서, 공식 경로와 게이트웨이 경로를 나란히 비교한 정리는 클로드 API 키 발급 방법을 보세요.
어떤 Claude 모델을 선택해야 하나요?
| 필요 | 선택 | Kunavo 입력 / 출력 (1M당) |
|---|---|---|
| 가장 저렴한 옵션 | gemini-2-5-flash | $0.09 / $0.75 |
| 저렴 + Anthropic 품질 | claude-haiku-4-5 | $0.40 / $2.00 |
| 균형 잡힌 추론 | claude-sonnet-4-6 | $1.20 / $6.00 |
| 가장 어려운 추론 | claude-opus-4-7 | $2.00 / $10.00 |
Gemini 쪽 단가는 Gemini API 가격 가이드에서, 난이도별 라우팅으로 비용을 줄이는 코드 패턴은 AI 비용 최적화 가이드에서 확인하세요. OpenRouter와 비교가 필요하면 Kunavo vs OpenRouter를 참고하세요. 호출 중에 401·429·529가 뜬다면 클로드 코드 오류 정리에서 어느 계통인지 먼저 가르는 방법을 다룹니다.
Claude API 비용 줄이기
- 프롬프트 캐싱을 먼저. 캐시된 입력은 입력 요율의 10%로 청구됩니다 — 가장 ROI가 높은 절감입니다.
- 등급을 낮추세요. 쉬운 작업은 Haiku나 gemini-2-5-flash로 보내고, Opus는 어려운 일부에만 쓰세요.
- 출력을 제한하세요.
max_tokens를 설정하세요 — 출력이 입력의 약 5배 비쌉니다. - 입력을 줄이세요. 지식 베이스 전체 대신 더 적고 정확한 RAG 청크를 검색하세요.
자주 묻는 질문
Claude API 결제는 어떻게 하나요?
Kunavo는 Stripe로 결제합니다. 국내외 신용·체크 카드(Visa, Mastercard, American Express, JCB), Apple Pay를 지원하며, 최소 $10부터 잔액을 충전해 사용한 만큼 차감하는 선불 종량제입니다. Anthropic Console 결제 설정이나 별도 계약은 필요 없고, 잔액은 만료되지 않습니다. 카카오페이·토스는 직접 지원하지 않지만 국내 발급 카드는 대부분 등록할 수 있습니다(해외 결제 차단이 걸려 있으면 카드사 앱에서 해제). Kunavo 계정 만들기에서 바로 시작할 수 있습니다.
Claude API 비용은 얼마인가요?
Kunavo에서 Claude Sonnet 4.6은 입력 1M 토큰당 $1.20, 출력 1M 토큰당 $6.00으로 Anthropic 정가 $3.00 / $15.00보다 약 60% 저렴합니다. Haiku 4.5는 $0.40 / $2.00, Opus 4.7은 $2.00 / $10.00입니다. 실패한 요청은 과금되지 않습니다.
Claude Opus 5 API 비용은 얼마인가요?
Anthropic은 Claude Opus 5를 1M 토큰당 입력 $5.00 / 출력 $25.00로 공시합니다 — 거의 플래그십급 추론을 Claude Fable 5 정가의 절반에 제공하는 가격입니다. Kunavo에서는 $2.00 / $10.00으로 Anthropic 정가보다 약 60% 저렴하며, 구독 없이 쓴 만큼만 냅니다. 기존 claude-opus-4-7과 요율이 완전히 같아서 업그레이드는 모델 이름 한 단어만 바꾸면 되고 추가 비용이 없습니다. 지연 시간을 줄인 claude-opus-5-fast는 Anthropic 공시가가 $10.00 / $50.00로 표준 Opus 5의 정확히 2배이며, Kunavo에서도 제공합니다 — $7.00 / $35.00으로 Anthropic 정가보다 약 30% 저렴합니다. 추론 품질은 Opus 5와 같고 출력만 더 빠릅니다. 응답 시간이 최우선인 작업(대화형 코딩, 사용자가 기다리는 화면)에는 Fast를, 배치·에이전트·긴 컨텍스트 작업에는 표준 claude-opus-5를 쓰세요 — 답은 같은데 비용이 훨씬 적습니다.
Claude API는 무료인가요?
Anthropic은 무료 등급을 제공하지 않아 첫 호출부터 토큰당 과금됩니다. Kunavo도 종량제이지만 최소 $10 충전부터 시작할 수 있고, 요율은 Anthropic 정가보다 약 60% 낮으며 잔액은 만료되지 않습니다.
한국에서 Claude API를 쓸 때 결제와 환율은 어떻게 되나요?
프롬프트 캐싱(입력의 10%), Haiku로 등급 낮추기, 출력 제한 순서로 적용하면 보통 Claude 청구액을 절반 이하로 줄입니다. 자세한 내용은 비용 최적화 가이드에 있습니다.
Kunavo는 OpenAI SDK와 호환되나요?
예. base_url을 https://api.kunavo.com/v1로 바꾸고 Kunavo 키를 넣으면 기존 OpenAI SDK 코드가 그대로 동작합니다. Claude는 OpenAI 호환 /v1/chat/completions 엔드포인트와 네이티브 Anthropic Messages API(/v1/messages) 양쪽으로 호출할 수 있습니다. 같은 키 하나로 Gemini, GPT, 이미지, 비디오 모델까지 호출됩니다.
Kunavo는 Anthropic Messages API를 지원하나요?
예 — Claude는 네이티브 Messages API(/v1/messages)와 OpenAI 호환 /v1/chat/completions 양쪽으로 제공되므로 어느 SDK든 그대로 쓸 수 있습니다. 서울에서의 지연·국내 결제 등 현장 가이드는 한국 Claude API 빠른 시작을 참고하세요.