ガイド一覧へ戻る
APIプロバイダー·2026年9月18日·最終更新 2026年9月24日·読了7分

SillyTavernに最適なAPI:モデル選択、コンテキスト、月額コスト

SillyTavernの実行費用はありません。請求額の全体がモデルエンドポイントです。ターンあたりのコストでモデルを比較し、直接接続、ゲートウェイ、定額制、ローカルのどれが最適かを判断します。

最終確認日:。

SillyTavernはAPIもサブスクリプションも販売していないため、SillyTavernに最適なAPIを選ぶことは、モデルとプロバイダーを購入することです。決め手となる数値は、100万トークン当たりの表示価格ではなく、Context Sizeにおける1ターンのコストです。 SillyTavernは、キャラクターカード、システムプロンプト、収まる限りの履歴を生成のたびに再送するため、料金は単価が変わらなくても会話とともに増加します。

リリース1.19.0は2026年9月14日にAGPL-3.0で公開され、リポジトリへの最後のプッシュも2026年9月14日でした(2026年9月18日に確認)。SillyTavernではないものが2つあります。TavernAIは別の祖先プロジェクトで、ドキュメントによると、SillyTavernは「2023年2月にTavernAI 1.2.8のフォークとして」誕生しました。もう1つはSillyTavern-Extrasで、そのリポジトリの説明は現在「[OBSOLETE]」で始まります。Extrasのインストールを案内するチュートリアルは古いものです。

無料のものと無料でないもの

購入するもの価格出典
すべてのプラットフォームのSillyTavern$0、AGPL-3.0、有料ティアなし、プロジェクトが販売するホスティングサービスなしドキュメントには「will always be free and open-sourced」と記載されています
実行するためのものNode.js 20以降package.jsonは"engines": { "node": ">= 20" }を宣言します
返信を生成するモデルこれが継続的に発生する請求の全額ですドキュメントでは「text generation LLMsと対話できる、ローカルにインストールされたユーザーインターフェース」と説明されています
第三者による「SillyTavern hosting」または有料モバイルアプリ他者の製品sillytavern.appは、いかなる種類の価格も掲載していません

2026年9月18日に確認した情報源:プロジェクトリポジトリと公式FAQ。FAQはバックエンドを、無料で実行できるセルフホストモデルと、FAQの表現では「利用にお金がかかる」有料Webサービスに分けています。

SillyTavernのチャットが請求額を生む仕組み

SillyTavernのContext Sizeドキュメントでは、この設定を、応答の長さを差し引いたうえでSillyTavernがプロンプトとしてAPIに送信する最大トークン数と定義し、コンテキストには「キャラクター情報、システムプロンプト、チャット履歴など」が含まれると説明しています。チャット内の点線より上にあるメッセージは要約されるのではなく、単純に送信されません。したがって1ターンのコストはおよそcontext tokens × input rate + reply tokens × output rateで、返信を再生成すると入力分を再び全量支払います。

デフォルトのChat Completionコンテキストは4,095トークンで、同梱のデフォルト設定に設定されています(2026年9月18日に確認)。スライダーを動かすと桁違いに増やせ、コンテキストのロック解除によりさらに増やせます。したがってContext Sizeはアプリケーション内で最大の予算制御です。同じ単価なら、4倍にすると以降の各メッセージの入力料金もおよそ4倍になります。

モデル候補とそれぞれのコスト

入力/出力トークン100万個当たりのUSD:現在のKunavoカタログ料金と、ベンダー自身が公開している表示価格を併記しています。すべて2026年9月18日に確認しました。

モデルKunavo:入力/出力ベンダー一覧:入力/出力用途
GPT-5.6 Terra$0.70 / $4.20$2.00 / $12.00Claudeではない音声。同じキャラクターカードについてセカンドオピニオンを得るのに便利
Claude Haiku 4.5$0.70 / $3.50$1.00 / $5.00ここで最も低価格の行 — 1ターンあたりの入力が支配的な長時間セッション向けの安価なClaude
Claude Sonnet 5$1.40 / $7.00$2.00 / $10.00品質と1ターンあたりのコストの普段使い向けバランス
Claude Opus 5$3.50 / $17.50$5.00 / $25.00より上位のClaudeティア。より高価だと決めつける前に、その行と比較してください
Claude Fable 5.1$7.00 / $35.00$10.00 / $50.00この表では、カタログ価格でも表示価格でも、1ターンあたりで最も高価

ベンダー価格はAnthropicの価格ページとOpenAIの開発者向け価格から取得しています。

月間見積もりの例

1か月に100回生成し、約16,000トークンまで成長したプロンプトに対して300トークンの返信を行い、再生成はしないとします。入力トークンは160万、出力トークンは30,000です。上記のカタログ料金では:

モデル100ターンの推定合計
GPT-5.6 Terra$1.25
Claude Haiku 4.5$1.22
Claude Sonnet 5$2.45
Claude Fable 5.1$12.25

これは仮定した数値に基づくトークン計算であり、実測セッションでも、請求額の上限でもありません。仮定を一つでも変更すれば結果は変わります。Context Sizeを増やす、返信を再生成する、100ターンではなく500ターン実行する、といった変更はすべて入力側を比例して増やします。また、次のセクションで扱うキャッシュ料金は含まれていません。

長いチャットを左右するキャッシュ差

これはUIの内部からは見えない部分です。SillyTavernのチャット補完バックエンドの1.19.0リリースブランチ(2026年9月18日に確認)では、すべてのcache_controlマーカーが組み込みソースのチェックの背後にあります。Claudeソース、claude-モデルID用のElectronHubソース、anthropic/claudeモデルID用のOpenRouterソース、キャッシュ可能と判断したgoogle/gemini ID用のOpenRouterソース、そしてNanoGPTフラグです。Custom(OpenAI互換)ブランチはこれらのチェックのいずれにも含まれず、いかなるcache_controlフィールドも設定しません。設定するのはlogprobs、JSONスキーマを設定した場合のresponse_format、ユーザーが指定したInclude HeadersとInclude Body Parameters、そして要求した場合のreasoning_effortまたはverbosityです。また、claude:とgemini:のキャッシュ切り替えが置かれている同梱の設定にも、custom:セクションはありません。

この結果はAnthropicのプロトコルに特有のものです。Customソースはcache_controlマーカーを設定しないため、Claudeモデルでは、エンドポイント自体がブレークポイントを挿入しない限り、会話履歴全体が毎ターン、通常の入力単価で再請求されます。ただし、この経路では何もキャッシュされないという意味ではありません。OpenAIのプロンプトキャッシュは対応モデルでデフォルト有効で、クライアント側には何も要求しないため、同じCustomソースを通るGPT経路では、Claude経路でキャッシュされなくてもキャッシュが可能です。キャッシュはSillyTavernが送信する内容ではなく、モデルとエンドポイントによって決まります。KunavoのOpenAIからAnthropicへの変換では、実際にブレークポイントを挿入します。ツールブロックとシステムブロックに挿入し、さらに会話にすでにassistantターンが含まれる場合は、最後のメッセージにローリングブレークポイントを一つ挿入します。これは最初のターンを終えた後のSillyTavernチャットの形です。この挿入はプロンプトが8,192文字以上の場合にのみ適用され、挿入後もブレークポイントの合計がベンダーの定める四つという上限を超えることはありません。モデルの最初の回答の後に送られたシステムメッセージ(チャット内に深さを指定して挿入したAuthor's Noteなど)は会話の中に残り、ブレークポイントもそれに合わせて配置されます。プロンプトがそうしたメッセージで終わる場合、ローリングブレークポイントはその直前のブロックに置かれ、余ったブレークポイントは、後ろにまだ内容が続くそうしたメッセージの直前に、最後のものから順に置かれます。詳細はキャッシュのドキュメントにあります。これはブレークポイントを自分で設定する呼び出し元向けに書かれています。

予測ではなく最良の場合として、その価値を見てみましょう。16,000個のプロンプトトークンのうち12,000個が各ターンでClaude Sonnet 5のKunavoキャッシュ読み取り料金(100万個あたり$0.14)でキャッシュから読み取られた場合、同じ100ターンの合計は$2.45ではなく約$0.94になります。これは利用可能な最大の節約額として扱い、支払額の上限とは考えないでください。毎ターンのキャッシュヒットを仮定し、キャッシュ書き込みを数えていないため、実際の請求額はこれを上回ります。Anthropicの料金設定では、キャッシュ読み取りは基本入力料金の0.1倍(Fable 5.1では0.025倍)、5分間の有効期間のキャッシュ書き込みは1.25倍です。メッセージ間の時間が5分を超えるロールプレイヤーは、読み取りではなく再び書き込み料金を支払います。Anthropicは1時間の有効期間のキャッシュ書き込みも2倍で提供しています。このガイドのために実際のSillyTavernセッションをゲートウェイ経由で実行して請求を受けたわけではないため、キャッシュヒットを前提に予算を立てる前に、自分の最初の長いチャットで報告された使用量を確認してください。

直接接続、ゲートウェイ、サブスクリプション、ローカルのどれが有利か

ルート購入する場合トレードオフ
直接ベンダー(Anthropic、OpenAI、Google)1つのベンダーと、そのベンダー用のSillyTavern組み込みソースを使いたい組み込みのClaudeソースは、Customソースにはコードパスがないキャッシュ設定を公開します。ベンダーごとに1アカウント
マルチモデルゲートウェイ1つのキーと1つの残高でClaudeとGPTのIDを使いたいSillyTavernは通常のOpenAIチャットとして接続するため、公開されるプロバイダー固有の制御は組み込みソースに残ります
定額制のオープンウェイトホスト毎日チャットし、予測可能な月額を求めるティアの上限を確認してください。Arli AIのプランは最大コンテキスト長で分かれており、これは長いチャットが消費する正確なリソースです
無料ホストアプリを試している、または待ち行列に耐えられるチャット請求ではなく、優先度とレート制限
ローカルモデルハードウェアを持っており、コンテンツフィルターもキーも不要自分のマシン、自分の保守、自分で決まる品質上限

具体的な数値は2026年9月18日に確認しました。OpenRouterはプロバイダー価格をそのまま通し、カードでのクレジット購入に5.5%(最低$0.80)を課金します。無料モデルは1日50リクエストに制限されますが、少なくとも$10のクレジットを購入すると1,000になります。NanoGPTは従量課金に加え、任意の月額$12サブスクリプションを販売しており、最低入金額は暗号資産で$0.10、カードで$1です。Arli AIは無料ティアと、月額$10、$15、$20、$30、$160のティアを提供しています。これらは最大コンテキスト長(無料の12Kから最上位ティアの512Kまで)、モデルサイズ、並列リクエスト数が異なります。Infermaticは無料プランに加え、$9、$16、$20のプランを掲載しています。FeatherlessはChatを月額$25、Developerを$50で掲載しています。AI Hordeは自らを「無料・コミュニティ運営・オープンソース」と説明しています。そのFAQでは、待ち行列の順位は総kudos残高に従い、匿名ユーザーはゼロから始まるため、登録ユーザーが匿名ユーザーより上位になると説明しています。Googleは無料のGeminiティアを公開していますが、レート制限ページには無料ティアのモデル別数値がなく、代わりにAI Studioを案内しています。したがって、他所で見た具体的な無料ティアの割り当ては未確認として扱ってください。

Kunavoには無料ティアも登録クレジットもありません。最低額は前払いクレジットの$10で、サブスクリプションはなく、残高に有効期限はありません。カタログ見積もりも料金上限ではありません。請求の確定方法については請求を参照してください。

価格より先にコンテンツ規則

SillyTavern自身のFAQは、有料ウェブサービスについて「しばしば検閲され、特定の話題についてチャットすることを拒否する」と述べています。これは一次情報であり、設定すべき正しい期待値です。Anthropicの利用ポリシーは、成人ユーザーであっても例外なく、性的なチャットと露骨な性的生成を禁止しています。ゲートウェイを使っても、提供されるモデルに適用されるポリシーは変わりません。Kunavo自身のポリシーも、送信内容には上流プロバイダーのポリシーが適用されると定めています。このページのどの記述も、無制限のエンドポイントを提供していると読まないでください。制限のない成人向けロールプレイが要件なら、正直な答えはローカルモデルまたはオープンウェイトホストです。上記のモデル候補一覧は、そのための棚ではありません。

設定してから料金を管理する

文書化された経路はChat Completion → Custom (OpenAI-compatible)です。Custom Endpoint (Base URL)とCustom API Keyを入力します。/chat/completionsは追加しないでください。接続に失敗した場合は/v1を追加します。最初の長いチャットの前に知っておくべきことは4つあります。

  1. モデルIDが除外リストにある場合を除き、サンプリングパラメーターは送信されます。 フロントエンドのリクエストビルダーは、すべてのChat Completionリクエストにtemperature、top_p、frequency_penalty、presence_penaltyを含めます。1.19.0リリースブランチでは、claude-fable、claude-opus-5、またはclaude-sonnet-5に一致するモデルIDについて、この4つに加えてtop_kを削除します。このルールはソースを確認せずモデルIDだけをキーにするため、Customソースにも適用されます。Claude Haiku 4.5は対象外です。その隣にある同等のGPT-5ルールは、組み込みのOpenAI、Azure、OpenRouterソースでのみ実行されるため、これらのIDはカスタムエンドポイントを通じてもサンプリングフィールドを保持します。Kunavoのカタログでは、上記のClaude 5モデルについてtemperature、top_p、top_kを別途未対応として扱い、上流呼び出しの前に削除します。これらのフィールドを削除しないエンドポイントでは、Additional ParametersドロワーのExclude Body Parametersでこれらを空にしてください。そうしないと、そのフィールドを拒否するモデルは400を返します。
  2. Prompt Post-ProcessingはNoneから開始してください。 AnthropicのMessages APIは連続する同じロールのターンを自身で結合し、システムプロンプトをトップレベルパラメーターで受け取るため、各システムメッセージをどこに置くかは変換ゲートウェイが決めます。Kunavoは、モデルが最初に回答する前に送られたシステムメッセージをそのパラメーターに入れ、回答の後に送られたもの(チャット内に深さを指定して挿入したAuthor's NoteやWorld Infoのエントリーなど)は、送られたターンにそのまま残します。SillyTavernのドキュメントでは、Noneを「APIが厳密に要求しない限り、明示的な処理を適用しない」、Semi-strictをロールを結合し任意のsystemメッセージを一つだけ許可するもの、Strictをさらに最初にuserメッセージを要求するものと定義しています。メッセージロールに関する400が表示されたら、Semi-strictへ上げてください。Merge、Semi-strict、Strictでは「with tools」バリアントを選ばない限り、ツール呼び出しも削除される点に注意してください。
  3. トークンカウンターは推定値です。 SillyTavernのトークナイザー文書によれば、バックエンドがトークナイザーを提供しない場合、カウントは「選択されたトークナイザータイプに基づく推定」です。また、Best-matchルールは任意のカスタムエンドポイントではなく、特定のベンダーを指定しています。Anthropicは、Claude 4.7以降のモデルでは、同じテキストに対して「約30%多くのトークン」を生成する新しいトークナイザーを使用すると述べています。そのため、古いトークナイザーで得たカウントは、これらのモデルの請求上の数値より少なく表示されます。
  4. Reverse Proxyドロワーは別の機能です。 出荷時のUIにある警告ブロックは組み込みソース(data-source="openai,claude,mistralai,…")を対象としており、「プロキシを使用している場合、ANY support requests will be REFUSED」と表示されます。その名前のドキュメントページは、SillyTavern自体をTraefik、NGINX、Caddyの背後に置く方法についてのもので、これも別の話題です。Customソースが対応している経路であり、このドロワーではありません。

Kunavoは、正確なフィールド値を記載したSillyTavern設定ガイドを公開しています。これは記述された設定であり、あなたに代わって実行したランタイム互換性テストではありません。上記の料金が自分のチャットに合うなら、アカウントを作成し、サブスクリプションではなく$10の最低額から始めてください。

よくある質問

SillyTavernの料金はいくらですか?

SillyTavern自体は無料です。ローカルにインストールして実行するAGPL-3.0ソフトウェアであり、リリース1.19.0は2026年9月14日に公開され、プロジェクトのドキュメントには「今後も常に無料で、オープンソースであり続ける」とあります。費用がかかるのは接続先のモデルAPIで、選択したプロバイダーによってトークン単位で請求されます。モデルをローカルで実行する場合は、ハードウェアと電気代がかかります。SillyTavernの価格を宣伝するページは、アプリケーションではなくホスティングまたはAPIサブスクリプションを販売しています。

SillyTavernで最も安いAPIは何ですか?

請求がまったく発生しないルートには、ローカル推論(KoboldCpp、llama.cpp、Ollama、Oobabooga)と、ボランティア運営のサービスであるAI Hordeがあります。SillyTavernはAI Hordeへ標準で接続でき、金銭の代わりにキューの優先度がトレードオフになります。ベンダーによっては独自の無料枠も公開しています。有料エンドポイントでは、掲載料金が最安であることと、完成したチャットが最安であることは別の主張です。SillyTavernは生成のたびにプロンプト全体を再送するため、何度も再生成が必要なモデルの低いトークン単価は、1回で返信が決まる高価なモデルより高くつくことがあります。表示料金ではなく、実際のContext Sizeで1ターン当たりのコストを比較してください。

SillyTavernに最適なモデルは何ですか?

このページは文章品質でモデルを順位付けしていません。何も測定していないためです。実際に価格を比較できる制約、つまり1ターン当たりのコストで選んでください。長いチャットで1ターン当たりのコストを最小にするなら、Claude Haiku 4.5のような安価なティアを検討してください。日常的なバランスならClaude Sonnet 5またはClaude Opus 5です。このページで比較したモデルの中ではClaude Fable 5.1が1ターン当たり最も高価なので、自分のチャットで違いを認識できる場合にのみ価値があります。SillyTavern 1.19.0のリリースノートには、Claude Fable 5および5.1、Claude Opus 4.8および5、Claude Sonnet 5、GPT-5.6モデルのバックエンドサポート追加が記録されているため、組み込みのAnthropicおよびOpenAIソースはすでにこれらのIDを認識しています。

SillyTavernはカスタムOpenAI互換APIで動作しますか?

はい。回避策ではなく、文書化された正式な経路です。APIをChat Completionに設定し、Chat Completion SourceをCustom (OpenAI-compatible)に設定してから、Custom Endpoint (Base URL)とCustom API Keyを入力します。SillyTavernのドキュメントでは、ベースURLに/chat/completionsサフィックスを追加しないよう案内し、接続に失敗した場合は/v1の追加を試すよう説明しています。エンドポイントがGET /v1/modelsを実装していれば、Available Modelsのドロップダウンが自動入力されます。そうでなければ、モデルIDを手入力します。

チャットが長くなるとSillyTavernの請求額が増えるのはなぜですか?

プロンプトが大きくなるためです。SillyTavernは、キャラクターカード、システムプロンプト、Context Sizeに収まる限りのチャット履歴を、生成のたびに送信します。そのため、同じトークン単価でも200ターン目は2ターン目よりはるかに多くの入力に対して課金されます。これを変える手段はプロンプトキャッシュですが、1.19.0のリリースブランチでは、SillyTavernが送信するすべてのcache_controlが組み込みソースに依存します。対象は、独自のClaudeソース、claude-*モデルID用のElectronHubソース、anthropic/claudeモデルIDおよびキャッシュ可能なgoogle/geminiモデル用のOpenRouterソース、NanoGPT固有のフラグです。Custom (OpenAI-compatible)ソースは含まれていないため、カスタムエンドポイントではキャッシュをエンドポイント自体が提供する必要があります。

無検閲のロールプレイに有料APIを使えますか?

フロンティアベンダーでは使えません。SillyTavernのFAQ自体が、有料のWebサービスはしばしば検閲され、特定のテーマを拒否すると警告しています。また、AnthropicのUsage Policyはエロティックなチャットと性的に露骨な生成を明確に禁止しています。同じリクエストをゲートウェイ経由でルーティングしても、モデルが提供される際に適用されるポリシーは変わりません。Kunavoのacceptable use policyにも、経由して送信されるコンテンツには上流プロバイダーのポリシーが適用されると記載されています。制限のない成人向けコンテンツが要件なら、その選択はClaude、GPT、Geminiのエンドポイントではなく、ローカルモデルまたはオープンウェイトホストに委ねられます。

SillyTavernのリリース状況、ドキュメント、出荷済みソース、競合サービスの価格は2026年9月18日に確認しました。Kunavoの料金はライブカタログから読み取ったものです。ここでの合計はすべて、記載した仮定に基づくトークン計算であり、実測セッションではありません。