가이드 목록으로
모델·2026년 9월 24일·최종 업데이트 2026년 10월 4일·6분 분량

Claude Opus 5.5 API — 가격, 모델 ID 및 Opus 5와 달라진 점

Anthropic은 2026년 9월 22일 Claude Opus 5.5를 출시했습니다. Opus 5보다 저렴하며 Anthropic의 수치에 따르면 더 뛰어납니다. Anthropic과 Kunavo의 API 가격, 모델 ID, 기존 호환성을 깨는 변경 사항이 Opus 5용으로 작성된 요청에 미치는 영향, OpenAI SDK·Anthropic SDK·Claude Code에서 작동하는 코드를 설명합니다.

마지막 검토일: .

Claude Opus 5.5는 Anthropic의 최신 Opus로 September 22, 2026에 출시되었으며, Anthropic이 현재 ‘대부분의 작업’에 권장하는 모델입니다. Anthropic의 API 가격은 100만 토큰당 $4.00 입력 / $20.00 출력으로 Opus 5의 $5.00 / $25.00보다 낮고, Kunavo에서는 $2.80 / $14.00로 공식 가격보다 30% 낮습니다. 모델 ID는 claude-opus-5-5이며 컨텍스트 윈도우는 1M 토큰, 출력은 최대 128K 토큰이고 모든 요청에서 사고합니다.

Claude Opus 5.5 API 가격

100만 토큰당 Anthropic 공개 요금과 Kunavo 요금 비교. Anthropic은 Opus 5.5의 캐시 읽기를 대부분의 Claude 모델에 적용하는 10% 대신 입력 가격의 5%로 책정하며, Kunavo도 동일한 비율을 적용합니다.

토큰 유형Anthropic 정가Kunavo
입력$4.00$2.80
출력(사고 포함)$20.00$14.00
캐시 쓰기$5.00(5분) · $8.00(1시간)$3.50, 두 TTL 모두
캐시 읽기$0.20$0.14

Kunavo의 다른 Claude 모델과 비교하면 Opus 5.5는 Opus급 추론을 얻는 가장 저렴한 방법이며 Claude Opus 5($3.50 / $17.50)보다 저렴합니다. Claude Sonnet 5는 더 저렴하고($1.40 / $7.00), 최상위 라인은 Claude Fable 5.1의 $7.00 / $35.00, 최저가는 Claude Haiku 4.5의 $0.70 / $3.50입니다. 작업 예시를 포함한 모든 Claude 요금은 Claude API 가격 가이드에 있으며 모델 페이지는 /models/claude-opus-5-5입니다.

Claude Opus 5.5 호출

하나의 Kunavo 키로 OpenAI 호환 엔드포인트와 네이티브 Anthropic Messages API를 통해 Opus 5.5에 접근할 수 있습니다. OpenAI SDK에서는 base_url와 모델 문자열을 변경하세요.

opus55_openai.py
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["KUNAVO_API_KEY"],
    base_url="https://api.kunavo.com/v1",
)

# Opus 5.5 always thinks, and thinking bills as output — leave max_tokens
# generous or the budget is spent before the answer starts.
resp = client.chat.completions.create(
    model="claude-opus-5-5",
    max_tokens=4096,
    messages=[{"role": "user", "content": "Review this migration plan for failure modes."}],
)
print(resp.choices[0].message.content)

Anthropic SDK에서는 출처를 base_url로 전달하면 SDK가 /v1/messages를 자동으로 추가합니다.

opus55_messages.py
from anthropic import Anthropic

# Native Messages API: pass the origin — the SDK appends /v1/messages.
client = Anthropic(base_url="https://api.kunavo.com", auth_token="sk-kn-...")

msg = client.messages.create(
    model="claude-opus-5-5",
    max_tokens=8192,   # thinking plus the answer
    messages=[{"role": "user", "content": "Find the race condition in this diff."}],
)
for block in msg.content:
    if block.type == "text":
        print(block.text)

키는 /app/keys에서 생성합니다. Claude API 키 가이드에서 그 과정을 단계별로 안내합니다.

Opus 5에서 무엇이 바뀌었으며 — 요청에 어떤 영향을 미치는가

Anthropic은 Opus 5에서 실행되던 코드의 호환성을 깨뜨리는 변경 사항 네 가지와 응답 형식 변경 사항 한 가지를 명시합니다. Anthropic의 규칙에 맞게 작성하되, 2026년 9월 24일 테스트에서 그중 두 가지는 Kunavo를 통해 실패하지 않았다는 점을 알아 두세요.

  • 추론은 비활성화할 수 없습니다. Anthropic에서는 thinking: {type: "disabled"} 및 budget_tokens가 모든 effort 수준에서 400을 반환하며, 유일한 제어 항목은 effort(기본값 medium)입니다. Kunavo에서는 비활성화 요청이 200을 반환했고 모델은 어쨌든 추론을 수행했으며, output_config.effort도 측정 가능한 차이를 만들지 않았습니다. Opus 5.5를 제공하는 채널에는 두 설정 모두 적용되지 않습니다. 추론은 출력으로 과금됩니다. 한 단어짜리 응답에서도 출력 토큰 16개 중 15개가 추론에 사용되었습니다. max_tokens는 넉넉하게 설정하세요.
  • 강제 도구 사용은 지원되지 않습니다. Anthropic에서는 tool_choice가 any 또는 tool이면 400을 반환합니다(OpenAI 호환 "required"는 any로 매핑됩니다). Kunavo에서는 강제 도구 요청이 대신 200을 반환했으므로, 강제 동작에 의존해서는 안 됩니다. auto를 사용하고 프롬프트에서 도구 이름을 지정하세요.
  • Thinking 블록은 모델과 대화에 연결됩니다. Opus 5.5에서는 이를 변경하지 않고 재생하세요. 시스템 프롬프트, 도구 또는 이전 턴을 편집하면 무효화됩니다. thinking-signature 오류 가이드를 참조하세요.
  • 이전 computer-use 도구는 사라졌습니다. Claude API에서는 computer_20251124를 허용하지 않습니다.
  • 도구 호출 사이의 텍스트는 thinking 블록으로 전달됩니다. 기본 display 설정에서는 비어 있으므로, 진행 텍스트를 스트리밍하는 앱은 도구 호출 사이에 조용해집니다.

샘플링 매개변수는 Opus 5에서 이미 사라졌습니다. Opus 5.5에서 Kunavo는 다른 Claude 5 제품군과 마찬가지로 요청이 게이트웨이를 떠나기 전에 temperature, top_p 및 top_k를 제거합니다.

Anthropic 수치 기준 Opus 5.5와 Opus 5 비교

Anthropic의 발표에 따르면 Opus 5.5는 “대부분의 작업에서 Claude Fable 5.1 수준의 성능을 내며 Opus 5보다 실행 비용이 40% 저렴”하고, 출력을 30% 넘게 더 빠르게 생성합니다. Opus 5와 비교한 공식 점수(Anthropic 수치이며 Kunavo 수치가 아님)는 다음과 같습니다.

벤치마크Opus 5.5Opus 5
Terminal-Bench 4.066.4%52.3%
CursorBench 4.057.8%46.6%
FrontierCode v1.1 (Main)54.4%48.0%
OSWorld 2.081.8%74.0%
GDPval-AA v2.1 (Elo)18461708

새 작업에서 Opus 5를 계속 사용할 이유는 거의 없습니다. Opus 5.5가 더 빠르고 점수가 높으며 비용도 더 저렴하고, thinking 비활성화 또는 도구 강제에 코드가 의존하지 않는 한 모델 문자열만 바꾸면 됩니다. 두 경로를 다시 작성할 때까지만 claude-opus-5를 사용하세요.

Opus 5.5를 사용하는 Kunavo의 Claude Code

Claude Code v2.1.280부터 기본 모델과 opus 별칭은 Opus 5.5로 확인되며 Kunavo는 이를 제공합니다. Kunavo 설정 가이드는 opus 별칭을 claude-opus-5-5로 고정하므로 /model opus과 opusplan의 계획 단계에는 1M 토큰당 $2.80 / $14.00의 요금이 부과됩니다. 이전 버전의 Claude Code에서는 먼저 claude update을 실행하세요. 또한 가이드는 sonnet 별칭을 claude-sonnet-5로 고정합니다. 이 별칭은 Sonnet 5.5를 요청하지만 Kunavo는 제공하지 않으므로 /model sonnet, opusplan의 실행 단계 및 sonnet로 설정된 하위 에이전트는 그렇지 않으면 404를 반환합니다. 전체 세션을 Opus 5.5에서 실행하려면 ANTHROPIC_MODEL도 설정하세요:

claude-code.sh
export ANTHROPIC_BASE_URL=https://api.kunavo.com   # origin, no /v1
export ANTHROPIC_AUTH_TOKEN=sk-kn-...

# Run the session on Opus 5.5 (Claude Code v2.1.280 or later).
export ANTHROPIC_MODEL=claude-opus-5-5
# Pin the aliases to models Kunavo serves. The sonnet alias asks for
# Sonnet 5.5, which Kunavo does not serve: without the SONNET line,
# /model sonnet, opusplan's execution phase and sonnet subagents get a 404.
export ANTHROPIC_DEFAULT_OPUS_MODEL=claude-opus-5-5
export ANTHROPIC_DEFAULT_SONNET_MODEL=claude-sonnet-5
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-4-5

claude

나머지 설정(원본 전용 base URL, ANTHROPIC_AUTH_TOKEN가 아닌 ANTHROPIC_API_KEY를 사용하는 이유, settings.json 형식)은 Claude Code 페이지에서 확인할 수 있습니다.

자주 묻는 질문

Claude Opus 5.5 API 비용은 얼마인가요?

Anthropic은 Claude Opus 5.5를 100만 입력 토큰당 $4.00, 100만 출력 토큰당 $20.00로 책정하며, 캐시 읽기는 $0.20, 5분 캐시 쓰기는 $5.00입니다. Kunavo에서는 100만 토큰당 입력 $2.80 / 출력 $14.00로, Anthropic 공식 가격보다 30% 낮고, 캐시 읽기는 $0.14, 캐시 쓰기는 $3.50입니다. 구독 없이 선불 잔액에서 종량제로 결제합니다.

Claude Opus 5.5의 모델 ID는 무엇인가요?

API 모델 ID는 claude-opus-5-5이며 Claude API, Google Cloud, Microsoft Foundry, Kunavo에서 동일한 문자열을 사용합니다. Amazon Bedrock에서는 anthropic.claude-opus-5-5 접두사를 붙입니다. 날짜가 붙은 스냅샷 접미사는 없습니다. 4.6 세대부터 Anthropic의 날짜 없는 ID 자체가 고정된 스냅샷입니다. claude-opus-5.5와 같은 표기는 유효하지 않습니다.

Claude Opus 5.5가 Opus 5보다 나은가요?

Anthropic 자체 수치에 따르면 그렇고, 더 저렴합니다. Anthropic은 Terminal-Bench 4.0에서 Opus 5.5가 66.4%, Opus 5가 52.3%라고 보고했으며, 대부분의 작업에서 "Claude Fable 5.1 수준으로 수행"한다고 설명합니다. 또한 Opus 5.5는 Opus 5보다 출력을 30% 넘게 빠르게 생성하고 실행 비용은 40% 낮습니다. 정가는 $4.00 / $20.00로 Opus 5의 $5.00 / $25.00와 비교됩니다. Kunavo에서는 $2.80 / $14.00로, $3.50 / $17.50와 비교해 출력이 20% 저렴합니다.

Claude Opus 5.5에서 사고 기능을 끌 수 있나요?

아니요. 적응형 사고는 항상 활성화되어 있습니다. Anthropic에서는 모든 effort 수준에서 thinking: {type: "disabled"}와 budget_tokens 설정이 모두 400을 반환하며, 유일한 제어 수단은 effort 매개변수이고 Opus 5.5의 기본값은 medium입니다. Kunavo에서는 2026년 9월 24일 테스트했을 때 비활성화 요청이 오류를 내지 않았지만 무시되었고 모델은 계속 사고했습니다. effort 값도 측정 가능한 차이를 만들지 않았습니다. 사고 토큰은 출력 요율로 청구되므로 사고와 답변을 위한 max_tokens 크기를 함께 설정하세요.

Claude Code는 기본적으로 Opus 5.5를 사용하나요?

예. Claude Code v2.1.280부터 Anthropic API 계정의 기본 모델과 opus 별칭은 모두 Opus 5.5(code.claude.com model-config)로 확인되며 Kunavo는 claude-opus-5-5를 제공합니다. Kunavo의 Claude Code 설정은 opus 별칭을 claude-opus-5-5로 고정하며, v2.1.280 이상이 필요합니다(이전 설치에서는 claude update 실행). 또한 세션을 claude-sonnet-5로 유지합니다. 전체 세션을 Opus 5.5에서 실행하려면 ANTHROPIC_MODEL=claude-opus-5-5로 설정하세요. ANTHROPIC_DEFAULT_SONNET_MODEL=claude-sonnet-5도 고정해야 합니다. sonnet 별칭은 Sonnet 5.5를 요청하지만 Kunavo는 제공하지 않으므로 이 설정이 없으면 /model sonnet, opusplan의 실행 단계 및 sonnet으로 설정된 하위 에이전트가 404를 반환합니다.

Claude Opus 5.5의 컨텍스트 윈도우는 얼마인가요?

Anthropic 모델 페이지에 따르면 Messages API에서 요청당 컨텍스트는 1M 토큰, 출력은 최대 128K 토큰입니다. 1M 윈도우가 기본값이므로 베타 헤더가 필요하지 않으며, 긴 요청도 짧은 요청과 동일한 토큰당 요율로 청구됩니다. Anthropic Batch API는 베타 헤더를 사용하면 출력을 300K로 늘리지만 Kunavo는 Batch API를 제공하지 않습니다.

Claude Opus 5.5에서 강제 tool_choice가 작동하나요?

신뢰할 수 없습니다. Anthropic은 Opus 5.5에서 강제 도구 사용을 지원하지 않습니다. tool_choice {type: "any"} 또는 {type: "tool"}은 그곳에서 400을 반환하며, Kunavo의 OpenAI 호환 엔드포인트는 tool_choice "required"를 "any"로 변환합니다. Kunavo에서 2026년 9월 24일 테스트했을 때 강제 도구 요청은 400이 아닌 200을 반환했으므로 어느 쪽이든 강제가 보장된다고 볼 수 없습니다. tool_choice "auto"를 보내고 지침에서 도구 이름을 지정하거나, 강제 호출의 유일한 목적이 구조화된 출력을 얻는 것이었다면 JSON 스키마 응답 형식을 사용하세요.