SillyTavern은 API도 구독도 판매하지 않으므로 SillyTavern에 가장 좋은 API를 선택하는 것은 모델과 제공자를 구매하는 일이며, 결정적인 수치는 백만 토큰당 표시 가격이 아니라 자신의 Context Size에서 한 턴에 드는 비용입니다. SillyTavern은 모든 생성마다 캐릭터 카드, 시스템 프롬프트, 들어갈 수 있는 만큼의 기록을 다시 전송하므로 요율이 변하지 않아도 대화가 길어질수록 청구액이 증가합니다.
릴리스 1.19.0은 2026년 9월 14일에 AGPL-3.0 라이선스로 공개되었으며, 저장소의 마지막 푸시는 2026년 9월 14일에 이루어졌습니다(2026년 9월 18일 확인). SillyTavern과는 다른 두 프로젝트가 있습니다. 하나는 SillyTavern의 전신인 별도 프로젝트 TavernAI입니다. 문서에 따르면 SillyTavern은 "2023년 2월에 TavernAI 1.2.8의 포크로" 시작되었습니다. 다른 하나는 SillyTavern-Extras이며, 현재 이 저장소의 설명은 "[OBSOLETE]"로 시작합니다. Extras를 설치하라고 안내하는 튜토리얼은 오래된 정보입니다.
무료인 것과 무료가 아닌 것
| 구매하는 것 | 가격 | 출처 |
|---|---|---|
| 모든 플랫폼의 SillyTavern | $0, AGPL-3.0, 유료 계층 없음, 프로젝트가 판매하는 호스팅 서비스 없음 | 문서에는 "항상 무료이며 오픈 소스로 제공될 것"이라고 명시되어 있습니다 |
| 실행할 대상 | Node.js 20 이상 | package.json에 "engines": { "node": ">= 20" }가 선언되어 있습니다 |
| 응답을 작성하는 모델 | 이것이 전체 반복 청구액입니다 | 문서에서는 이를 "텍스트 생성 LLM과 상호작용할 수 있게 해 주는 로컬 설치형 사용자 인터페이스"라고 설명합니다 |
| 타사 "SillyTavern 호스팅" 또는 유료 모바일 앱 | 다른 사람이 제공하는 제품 | sillytavern.app에는 어떤 종류의 가격도 게시되어 있지 않습니다 |
2026년 9월 18일 확인한 출처: 프로젝트 저장소와 공식 FAQ. FAQ는 백엔드를 무료로 실행할 수 있는 자체 호스팅 모델과, 표현 그대로 "사용하는 데 비용이 드는" 유료 웹 서비스로 나눕니다.
SillyTavern 채팅에서 청구액이 생성되는 방식
SillyTavern의 Context Size 문서는 이 설정을 응답 길이를 제외하고 SillyTavern이 프롬프트로 API에 전송하는 최대 토큰 수로 정의하며, 컨텍스트가 "캐릭터 정보, 시스템 프롬프트, 채팅 기록 등으로 구성된다"고 설명합니다. 채팅에서 점선 위에 있는 메시지는 요약되는 것이 아니라 단순히 전송되지 않습니다. 따라서 한 턴의 비용은 대략 context tokens × input rate + reply tokens × output rate이며, 응답을 재생성하면 입력 비용을 다시 전액 지불합니다.
기본 Chat Completion 컨텍스트는 4,095토큰이며, 2026년 9월 18일에 확인한 제공된 기본값에서 설정됩니다. 슬라이더를 사용하면 이 값을 여러 자릿수 규모로 늘릴 수 있고, 컨텍스트 잠금을 해제하면 더 늘릴 수 있습니다. 따라서 Context Size는 애플리케이션에서 가장 큰 예산 조절 항목입니다. 같은 요율에서 값을 네 배로 늘리면 이후 모든 메시지의 입력 비용도 대략 네 배가 됩니다.
모델 후보 목록과 각 모델의 비용
백만 입력 토큰 / 출력 토큰당 USD: 2026년 9월 18일에 모두 확인한 현재 Kunavo 카탈로그 요율과 제공자가 자체적으로 게시한 정가를 나란히 표시합니다.
| 모델 | Kunavo: 입력 / 출력 | 공급업체 목록: 입력 / 출력 | 적합한 용도 |
|---|---|---|---|
| GPT-5.6 Terra | $0.70 / $4.20 | $2.00 / $12.00 | Claude가 아닌 음성으로, 동일한 캐릭터 카드에 대한 추가 의견을 받을 때 유용합니다 |
| Claude Haiku 4.5 | $0.70 / $3.50 | $1.00 / $5.00 | 여기서 가장 저렴한 행 — 턴당 입력이 큰 비중을 차지하는 긴 세션에 적합한 저가 Claude |
| Claude Sonnet 5 | $1.40 / $7.00 | $2.00 / $10.00 | 품질과 턴당 비용의 일상적인 균형 |
| Claude Opus 5 | $3.50 / $17.50 | $5.00 / $25.00 | 더 높은 Claude 등급입니다. 더 비싸다고 단정하기 전에 해당 행을 비교하세요 |
| Claude Fable 5.1 | $7.00 / $35.00 | $10.00 / $50.00 | 이 표에서 턴당 가장 비싸며, 카탈로그 가격과 정가 모두 기준입니다 |
공급업체 가격은 Anthropic의 가격 페이지와 OpenAI 개발자 가격 페이지에서 가져왔습니다.
월간 예상 비용 예시
한 달에 100번 생성하고, 프롬프트가 약 16,000토큰까지 늘어나며, 300토큰으로 답하고, 재생성은 없다고 가정하세요. 입력 토큰은 160만 개, 출력 토큰은 30,000개입니다. 위 카탈로그 요금 기준으로는 다음과 같습니다.
| 모델 | 100턴의 예상 총액 |
|---|---|
| GPT-5.6 Terra | $1.25 |
| Claude Haiku 4.5 | $1.22 |
| Claude Sonnet 5 | $2.45 |
| Claude Fable 5.1 | $12.25 |
이는 가정한 수치에 따른 토큰 계산이며, 실제 세션 측정값도 아니고 청구액의 상한도 아닙니다. 가정을 바꾸면 결과도 달라집니다. Context Size를 늘리거나, 답변을 재생성하거나, 100턴 대신 500턴을 실행하면 모두 입력 측 비용이 그에 따라 증가합니다. 다음 섹션에서 다룰 캐시 요금도 제외되어 있습니다.
긴 대화를 결정하는 캐시 차이
UI 내부에서는 보이지 않는 부분입니다. 해당 chat-completions 백엔드의 1.19.0 릴리스 브랜치(2026년 9월 18일 확인)에서 모든 cache_control 마커는 내장 소스를 확인하는 조건 안에 있습니다. 해당 조건은 Claude 소스, claude- 모델 ID에 대한 ElectronHub 소스, anthropic/claude 모델 ID에 대한 OpenRouter 소스, 캐시 가능하다고 판단한 google/gemini ID에 대해 역시 OpenRouter 소스를 확인하는 조건, 그리고 NanoGPT 플래그입니다. Custom(OpenAI-compatible) 브랜치는 이러한 확인 중 어느 것에도 포함되지 않으며 어떤 종류의 cache_control 필드도 설정하지 않습니다. 대신 설정하는 것은 logprobs, JSON 스키마를 구성한 경우의 response_format, 사용자가 지정한 Include Headers와 Include Body Parameters, 그리고 사용자가 요청한 경우의 reasoning_effort 또는 verbosity입니다. 또한 claude:와 gemini: 캐싱 스위치가 있는 배포된 구성에는 custom: 섹션이 없습니다.
결과는 Anthropic 프로토콜에만 해당합니다. Custom 소스는 cache_control 마커를 설정하지 않으므로, 엔드포인트가 직접 중단점을 삽입하지 않는 한 Claude 모델에서는 매 턴 전체 대화 기록에 입력 요금이 전액 다시 부과됩니다. 그렇다고 이 경로에서 아무것도 캐시되지 않는다는 뜻은 아닙니다. OpenAI의 프롬프트 캐싱은 지원되는 모델에서 기본적으로 활성화되며 클라이언트에 아무것도 요구하지 않으므로, 동일한 Custom 소스를 통한 GPT 경로에서는 캐싱이 가능하지만 Claude 경로에서는 캐싱이 이루어지지 않을 수 있습니다. 캐싱은 SillyTavern이 보내는 내용이 아니라 모델과 엔드포인트가 결정합니다. Kunavo의 OpenAI-to-Anthropic 변환은 중단점을 삽입합니다. 도구 및 시스템 블록에 중단점을 추가하고, 대화에 이미 assistant 턴이 있으면 마지막 메시지에 순환 중단점을 추가합니다. 이는 첫 번째 턴 이후 SillyTavern 대화의 형태입니다. 이 삽입은 프롬프트가 최소 8,192자일 때만 활성화되며, 삽입 후에도 전체 중단점 수가 공급업체 한도인 네 개를 넘지 않습니다. 모델의 첫 응답 이후에 보낸 시스템 메시지(채팅 안에 깊이를 지정해 삽입한 Author's Note 등)는 대화 안에 그대로 남고, 중단점도 그에 맞춰 배치됩니다. 프롬프트가 그런 메시지로 끝나면 순환 중단점은 그 바로 앞 블록에 놓이고, 한도 안에서 남는 중단점은 뒤에 내용이 더 이어지는 그런 메시지들 바로 앞에, 가장 마지막 것부터 차례로 놓입니다. 자세한 내용은 호출자가 직접 중단점을 설정하는 상황을 전제로 작성된 캐싱 문서를 참조하세요.
예측이 아닌 최선의 경우로서 이것이 어느 정도의 가치가 있는지 살펴보겠습니다. 16,000개 프롬프트 토큰 중 12,000개가 매 턴 Claude Sonnet 5의 Kunavo 캐시 읽기 요금($0.14/백만 토큰)으로 캐시에서 읽힌다면, 동일한 100턴의 비용은 $2.45가 아니라 약 $0.94가 됩니다. 이를 이용 가능한 최대 절감액으로 보되 실제 지불액의 상한으로 보지는 마세요. 모든 턴에서 캐시 적중이 발생하고 캐시 쓰기 비용은 계산하지 않은 가정이므로 실제 청구액은 이보다 높습니다. Anthropic은 캐시 읽기에 기본 입력 요금의 0.1배를 부과하며(Fable 5.1에서는 0.025배), 5분 창의 캐시 쓰기에는 1.25배를 부과합니다. 메시지 사이에 5분보다 오래 걸리는 역할극 사용자는 읽기 대신 다시 쓰기 요금을 지불합니다. Anthropic은 1시간 쓰기 요금으로 2배도 판매합니다. 이 가이드 작성에 실제 SillyTavern 세션을 게이트웨이로 청구하지 않았으므로, 캐시 적중을 기준으로 예산을 세우기 전에 자신의 첫 번째 긴 대화에서 보고된 사용량을 먼저 확인하세요.
직접 연결, 게이트웨이, 구독 또는 로컬 중 무엇이 유리한가
| 경로 | 다음과 같은 경우 구매하세요 | 절충점 |
|---|---|---|
| 직접 공급업체(Anthropic, OpenAI, Google) | 한 공급업체와 해당 공급업체를 위한 SillyTavern 내장 소스를 원할 때 | 내장 Claude 소스는 Custom 소스에 코드 경로가 없는 캐싱 설정을 제공합니다. 공급업체마다 계정 하나가 필요합니다 |
| 다중 모델 게이트웨이 | 하나의 키와 잔액으로 Claude 및 GPT ID를 사용하고 싶을 때 | SillyTavern은 게이트웨이에 일반 OpenAI 채팅 형식으로 통신하므로, 게이트웨이가 제공하는 공급업체별 제어 기능은 내장 소스에 남아 있습니다 |
| 정액제 오픈 웨이트 호스트 | 매일 대화하며 예측 가능한 월 비용을 원할 때 | 등급의 제한 사항을 확인하세요. Arli AI의 요금제는 긴 대화가 소비하는 정확한 리소스인 최대 컨텍스트 길이에 따라 나뉩니다 |
| 무료 호스팅 | 앱을 시험해 보거나 대기열을 감수할 수 있는 대화에 적합합니다 | 청구서 대신 우선순위와 속도 제한이 적용됩니다 |
| 로컬 모델 | 하드웨어가 있고 콘텐츠 필터와 키 없이 사용하고 싶을 때 | 내 장비, 내 유지 관리, 내 품질 상한 |
2026년 9월 18일 확인한 구체적인 수치입니다. OpenRouter는 공급업체 가격을 그대로 전달하고 카드 크레딧 구매에 5.5%(최소 $0.80)를 부과합니다. 무료 모델은 하루 50회 요청으로 제한되며, 크레딧을 최소 $10 구매하면 1,000회로 늘어납니다. NanoGPT는 사용량 기반 요금과 선택형 월 $12 구독을 판매하며, 최소 입금액은 암호화폐 $0.10 또는 카드 $1입니다. Arli AI는 무료 등급과 월 $10, $15, $20, $30, $160 등급을 운영하며, 최대 컨텍스트 길이(무료 등급 12K부터 최고 등급 512K까지), 모델 크기 및 병렬 요청 수에 따라 다릅니다. Infermatic은 무료 요금제와 $9, $16, $20 요금제를 제공합니다. Featherless는 Chat을 월 $25, Developer를 $50에 제공합니다. AI Horde는 스스로를 "무료 · 커뮤니티 운영 · 오픈 소스"라고 설명합니다. FAQ에 따르면 대기열 순서는 총 kudos 잔액을 따르며 익명 사용자는 0에서 시작하므로 등록 사용자가 그들보다 우선합니다. Google은 무료 Gemini 등급을 제공하지만 요청 속도 제한 페이지에는 무료 등급의 모델별 수치가 없고 AI Studio를 안내하므로, 다른 곳에서 읽은 구체적인 무료 등급 할당량은 검증되지 않은 것으로 취급하세요.
Kunavo에는 무료 등급이나 가입 크레딧이 없습니다. 최소 금액은 선불 크레딧 10$이며, 구독이 없고 잔액은 만료되지 않습니다. 카탈로그 예상액 역시 가격 상한이 아닙니다. 요금이 정산되는 방식은 청구를 참조하세요.
가격보다 콘텐츠 규칙이 먼저입니다
SillyTavern 자체 FAQ는 유료 웹 서비스가 "검열되는 경우가 많으며 특정 주제에 관해 대화하기를 거부할 것"이라고 설명합니다. 이는 공식 안내이며, 설정해야 할 올바른 기대치입니다. Anthropic의 사용 정책은 성적인 대화와 노골적인 성적 생성을 금지하며 성인 사용자에 대한 예외도 없습니다. 게이트웨이를 사용해도 모델에 적용되는 정책은 바뀌지 않습니다. Kunavo 자체 정책은 전송하는 내용에 상위 공급업체 정책이 적용된다고 명시합니다. 이 페이지의 어떤 내용도 필터 없는 엔드포인트를 제공한다는 의미로 읽어서는 안 됩니다. 제한 없는 성인 역할극이 요구 사항이라면 정직한 답은 로컬 모델 또는 오픈 웨이트 호스트이며, 위 모델 후보 목록은 적절한 선택지가 아닙니다.
구성한 다음 청구액을 관리하세요
문서화된 경로는 Chat Completion → Custom (OpenAI-compatible)이며, Custom Endpoint (Base URL)과 Custom API Key를 입력합니다. /chat/completions을 추가하지 말고 연결에 실패할 때만 /v1을 추가하세요. 첫 번째 긴 대화 전에 알아둘 네 가지 사항은 다음과 같습니다.
- 모델 ID가 제거 목록에 있지 않으면 샘플링 매개변수가 전송됩니다. 프런트엔드 요청 빌더는 모든 Chat Completion 요청에
temperature,top_p,frequency_penalty,presence_penalty를 넣습니다. 1.19.0 릴리스 브랜치에서는claude-fable,claude-opus-5또는claude-sonnet-5와 일치하는 모든 모델 ID에 대해 이 네 항목과top_k를 삭제합니다. 이 규칙은 소스 확인 없이 모델 ID를 기준으로 하므로 Custom 소스에도 적용됩니다. Claude Haiku 4.5에는 적용되지 않으며, 그 옆의 해당 GPT-5 규칙은 내장 OpenAI, Azure 및 OpenRouter 소스에서만 실행되므로 해당 ID는 사용자 지정 엔드포인트를 통해서도 샘플링 필드를 전달합니다. Kunavo의 카탈로그는 위에 나열된 Claude 5 모델에서temperature,top_p,top_k를 별도로 지원되지 않는 것으로 표시하고 업스트림 호출 전에 제거합니다. 이를 수행하지 않는 엔드포인트에서는 Additional Parameters 창의 Exclude Body Parameters를 통해 해당 항목을 비우세요. 그렇지 않으면 필드를 거부하는 모델이 400 오류로 응답합니다. - Prompt Post-Processing을 None으로 시작하세요. Anthropic의 Messages API는 연속된 동일 역할 턴을 자체적으로 결합하고 시스템 프롬프트를 최상위 매개변수로 받으므로, 각 시스템 메시지를 어디에 둘지는 변환 게이트웨이가 정합니다. Kunavo는 모델의 첫 응답 전에 보낸 시스템 메시지를 그 매개변수에 넣고, 그 뒤에 보낸 시스템 메시지(채팅 안에 깊이를 지정해 삽입한 Author's Note나 World Info 항목 등)는 보낸 턴에 그대로 둡니다. SillyTavern 문서에서 None은 "API에 의해 엄격히 요구되지 않는 한 명시적 처리를 적용하지 않음", Semi-strict는 역할을 병합하고 선택적 시스템 메시지를 하나만 허용함, Strict는 여기에 더해 첫 메시지가 user 메시지여야 함으로 정의됩니다. 따라서 메시지 역할에 관한 400 오류가 표시되면 Semi-strict로 올리세요. Merge, Semi-strict, Strict는 "with tools" 변형을 선택하지 않는 한 도구 호출도 제거한다는 점에 유의하세요.
- 토큰 카운터는 추정치입니다. SillyTavern의 토크나이저 문서에 따르면 백엔드가 토크나이저를 제공하지 않을 때 토큰 수는 "선택한 토크나이저 유형을 기준으로 추정"됩니다. Best-match 규칙도 임의의 사용자 지정 엔드포인트가 아니라 특정 공급업체를 지정합니다. Anthropic은 Claude 4.7 및 이후 모델이 동일한 텍스트에 대해 "약 30% 더 많은 토큰"을 생성하는 새로운 토크나이저를 사용한다고 명시합니다. 따라서 구형 토크나이저가 산출한 수치는 해당 모델의 실제 청구량에 비해 낮게 표시됩니다.
- Reverse Proxy 창은 다른 기능입니다. 배포된 UI의 경고 블록은 내장 소스(
data-source="openai,claude,mistralai,…")에만 적용되며 "프록시를 사용하는 경우 모든 지원 요청이 거부됩니다"라고 표시합니다. 해당 이름의 문서 페이지는 SillyTavern 자체를 Traefik, NGINX 또는 Caddy 뒤에 배치하는 방법에 관한 것으로, 또 다른 주제입니다. Custom 소스가 지원되는 경로이며 이 창과는 다릅니다.
Kunavo는 정확한 필드 값을 포함한 SillyTavern 설정 가이드를 제공합니다. 이는 문서화된 구성이지, 사용자를 대신해 실행한 런타임 호환성 테스트가 아닙니다. 위 요금이 대화에 적합하다면 계정을 만들고 구독 대신 최소 $10부터 시작하세요.
자주 묻는 질문
SillyTavern의 비용은 얼마인가요?
SillyTavern 자체는 무료입니다. AGPL-3.0 소프트웨어로, 사용자가 로컬에 설치하고 실행합니다. 릴리스 1.19.0은 2026년 9월 14일에 공개되었으며 프로젝트 문서에는 "항상 무료이며 오픈 소스로 제공될 것"이라고 적혀 있습니다. 비용이 발생하는 것은 연결하는 모델 API이며, 선택한 제공자에 따라 토큰별로 청구됩니다. 모델을 로컬에서 실행한다면 하드웨어와 전기 요금이 발생합니다. SillyTavern 가격을 광고하는 페이지는 애플리케이션 자체가 아니라 호스팅이나 API 구독을 판매하는 것입니다.
SillyTavern에 가장 저렴한 API는 무엇인가요?
청구액이 전혀 발생하지 않는 경로로는 로컬 추론(KoboldCpp, llama.cpp, Ollama, Oobabooga)과 AI Horde가 있습니다. AI Horde는 자원봉사자들이 운영하는 서비스로 SillyTavern이 기본적으로 연결하며, 비용 대신 대기열 우선순위를 감수합니다. 일부 제공자는 자체 무료 요금제도 제공합니다. 유료 엔드포인트에서는 등록된 최저 요율과 완료된 채팅의 최저 비용이 서로 다른 주장입니다. SillyTavern은 생성할 때마다 전체 프롬프트를 다시 전송하므로, 여러 번 재생성해야 하는 모델의 낮은 토큰당 요율이 한 번에 답을 내는 더 비싼 모델보다 실제로 더 많이 들 수 있습니다. 표시 요율이 아니라 실제 Context Size에서 턴당 비용을 비교하세요.
SillyTavern에 가장 좋은 모델은 무엇인가요?
이 페이지는 문장 품질을 측정하지 않았으므로 어떤 모델도 그 기준으로 순위를 매기지 않습니다. 실제로 가격을 계산할 수 있는 제약 조건인 턴당 비용을 기준으로 선택하세요. 긴 대화에서 턴당 비용을 가장 낮추려면 Claude Haiku 4.5 같은 저가 계층을 살펴보세요. 일상적인 균형을 원한다면 Claude Sonnet 5 또는 Claude Opus 5를 고려하세요. 이 페이지에서 비교한 모델 중 Claude Fable 5.1은 턴당 비용이 가장 높으므로, 자신의 대화에서 차이를 확인할 수 있을 때만 선택할 가치가 있습니다. SillyTavern 1.19.0 릴리스 노트에는 Claude Fable 5 및 5.1, Claude Opus 4.8 및 5, Claude Sonnet 5, GPT-5.6 모델에 대한 백엔드 지원이 추가되었다고 기록되어 있으므로, 기본 제공 Anthropic 및 OpenAI 소스는 이미 해당 ID를 알고 있습니다.
SillyTavern에서 사용자 지정 OpenAI 호환 API를 사용할 수 있나요?
예. 이는 우회 방법이 아니라 문서화된 일급 경로입니다. API를 Chat Completion으로 설정하고, Chat Completion Source를 Custom (OpenAI-compatible)으로 설정한 다음 Custom Endpoint (Base URL)와 Custom API Key를 입력하세요. SillyTavern 문서에서는 기본 URL에 /chat/completions 접미사를 추가하지 말고 연결에 실패하면 /v1을 추가해 보라고 안내합니다. 엔드포인트가 GET /v1/models를 구현하면 Available Models 드롭다운이 자동으로 채워지고, 그렇지 않으면 모델 ID를 직접 입력해야 합니다.
SillyTavern의 채팅이 길어질수록 요금이 증가하는 이유는 무엇인가요?
프롬프트가 길어지기 때문입니다. SillyTavern은 모든 생성마다 캐릭터 카드, 시스템 프롬프트, Context Size에 들어가는 최대한의 채팅 기록을 전송합니다. 따라서 토큰당 요율이 같아도 200번째 턴은 2번째 턴보다 입력 비용이 훨씬 큽니다. 이를 바꾸는 수단은 프롬프트 캐싱입니다. 그러나 1.19.0 릴리스 브랜치에서는 SillyTavern이 보내는 모든 cache_control이 기본 제공 소스에 종속됩니다. 자체 Claude 소스, claude-* 모델 ID를 위한 ElectronHub 소스, anthropic/claude 모델 ID 및 캐시 가능한 google/gemini 모델을 위한 OpenRouter 소스, 그리고 NanoGPT 전용 플래그가 해당됩니다. Custom (OpenAI-compatible) 소스는 여기에 포함되지 않으므로 사용자 지정 엔드포인트에서는 캐싱을 엔드포인트 자체가 제공해야 합니다.
검열되지 않은 롤플레이에 유료 API를 사용할 수 있나요?
주요 프런티어 제공자에서는 사용할 수 없습니다. SillyTavern 자체 FAQ는 유료 웹 서비스가 종종 검열되고 특정 주제를 거부한다고 경고하며, Anthropic Usage Policy는 에로틱 채팅과 성적으로 노골적인 생성을 전면 금지합니다. 같은 요청을 게이트웨이를 통해 라우팅해도 모델에 적용되는 정책은 바뀌지 않으며, Kunavo의 허용 가능한 사용 정책은 업스트림 제공자 정책이 이를 통해 전송되는 콘텐츠에 적용된다고 명시합니다. 제한 없는 성인 콘텐츠가 요구 사항이라면 Claude, GPT 또는 Gemini 엔드포인트가 아니라 로컬 모델이나 오픈 웨이트 호스트를 선택해야 합니다.
SillyTavern 릴리스 상태, 문서, 배포된 소스 및 경쟁 서비스 가격은 2026년 9월 18일에 확인했습니다. Kunavo 요금은 실시간 카탈로그에서 읽었으며, 여기의 모든 총액은 명시된 가정에 따른 토큰 계산이지 실제 세션 측정값이 아닙니다.