ドキュメント

ドキュメント

SillyTavern

SillyTavernのCustom (OpenAI-compatible)ソースには、ベースURLとキーが必要です。Kunavoを接続すると、ClaudeとGPTの両方が同じモデルのドロップダウンに表示されます。

SillyTavernをKunavoに接続するには、API Connectionsを開き、APIをChat Completion、Chat Completion SourceをCustom (OpenAI-compatible)に設定し、次の2つのフィールドを入力します。Custom Endpoint = https://api.kunavo.com/v1、Custom API Key = お使いのsk-kn-…キー。Connectを押すと、SillyTavernがGET /v1/modelsを呼び出し、応答からモデルのドロップダウンリストを読み込みます。

SillyTavernのフィールド値
APIChat Completion
Chat Completion SourceCustom (OpenAI-compatible)
Custom Endpoint(ベースURL)https://api.kunavo.com/v1
Custom API Keysk-kn-…
利用可能なモデルConnect後に自動で入力されます — 任意のidを選択できます
/v1のサフィックスはこのフィールドに含めてください。SillyTavernのカスタムソースはOpenAIの規約に従い、ルートだけを付加するため、https://api.kunavo.comに/v1がないと接続に失敗し、モデル一覧が空になります。

手順

  1. /app/keys でキーを作成してコピーします。キーは一度だけ表示されます。
  2. SillyTavernで、上部バーのプラグアイコン(API Connections)を開きます。
  3. APIをChat Completionに、次にChat Completion SourceをCustom (OpenAI-compatible)に設定します。
  4. https://api.kunavo.com/v1をCustom Endpointに、キーをCustom API Keyに貼り付けます。
  5. Connectを押します。ステータスが緑色になり、利用可能なモデルのドロップダウンに項目が表示されれば、接続できています。
  6. ドロップダウンからモデルidを選んでチャットを開始します。後でモデルを切り替える際に再接続する必要はありません。

この画面については、SillyTavernの公式リファレンスであるChat Completions API connectionsページを参照してください。

UIの問題を調べる前に確認

1回のリクエストで、失敗の原因がエンドポイント、キー、SillyTavernのどれかを切り分けられます。モデルidのJSONリストが返されれば、同じURLとキーでドロップダウンにモデルが表示されます。

# Confirms the key and the endpoint before you touch SillyTavern.
# A JSON list of model ids means the same URL will populate the dropdown.
curl -sS https://api.kunavo.com/v1/models \
  -H "Authorization: Bearer sk-kn-..."

選ぶモデル

Kunavo上のすべてのテキストモデルが同じドロップダウンから利用できます。全リストはモデルページにあり、GET /v1/modelsからリアルタイムに取得されます。料金は100万トークンあたりの米ドル額で、入力/出力の順です。

モデル IDKunavo 入力 / 出力用途
claude-haiku-4-5$0.70 / $3.50最安のClaude — 1ターンあたりのコストを最重視する長時間セッション向け
claude-sonnet-5$1.40 / $7.00品質と価格の標準的なバランス
claude-opus-5$3.50 / $17.50最高品質の Claude ティア
claude-fable-5$7.00 / $35.00コンテキストウィンドウが1Mトークンの最先端の推論モデル — チャット履歴自体が問題になる場合の選択肢
長時間のSillyTavernセッションで最初に制約となるのはコンテキスト長です。ターンごとに履歴全体が再送されるため、トークン消費は一定ではなく、会話の長さに応じて増加します。Kunavoは月額料金なしで、プリペイド残高からトークン単位で請求するため、利用しない月には費用がかかりません。詳細は請求をご覧ください。同じコンテキストを繰り返し使う場合は、プロンプトキャッシュが最も有効な対策です。

トラブルシューティング

症状原因修正方法
接続に失敗し、モデル一覧が空のままCustom Endpointに/v1がないhttps://api.kunavo.com/v1を使ってください。上記のcurlで確認できます。
401 / 無効なキーキーに空白が含まれているか、キーが失効している/app/keysからコピーし直してください。401と403を参照してください
応答がストリーミングされず、一度に届く接続の前段にあるプロキシがサーバー送信イベントをバッファリングしているエンドポイント側はストリーミングに対応しています — ストリーミングエラー
モデルidが拒否されるこのエンドポイントで提供されていないidドロップダウンから選択するか、model_not_foundを参照してください
長いチャットでのみエラーが発生する履歴がモデルのコンテキストウィンドウを超えている履歴を短くするか、より長いコンテキストに対応したモデルに切り替えてください — context_length_exceeded

正直に伝えておきたい2点

提携関係はありません

SillyTavernは独立したオープンソースプロジェクトであり、Kunavoとは提携していません。このページでは、SillyTavernが任意のOpenAI互換エンドポイントに対応しているため可能な設定を説明しています。どちらの側でも、特別な調整は行っていません。

コンテンツポリシーは引き続き適用されます

Kunavo経由のリクエストは上流プロバイダーに送られ、各プロバイダーは送信されたコンテンツに独自の利用ポリシーを適用します。ゲートウェイを使っても制限はなくなりません。そうでないと説明するページは、何かを売り込んでいます。Kunavo独自の利用条件は利用規定をご覧ください。

よくある質問

SillyTavernをカスタムAPIエンドポイントに接続するにはどうすればよいですか?

SillyTavernで、API Connectionsタブ(プラグアイコン)を開き、APIをChat Completion、Chat Completion SourceをCustom (OpenAI-compatible)に設定します。Custom EndpointにゲートウェイのOpenAI互換ベースURLを入力します。Kunavoの場合はhttps://api.kunavo.com/v1です。Custom API Keyにキーを入力してConnectを押すと、SillyTavernがそのエンドポイントにGET /v1/modelsを送信し、応答からモデルのドロップダウンリストを読み込みます。

SillyTavernはOpenAI互換エンドポイント経由でClaudeモデルを使えますか?

はい。SillyTavernのCustom (OpenAI-compatible)ソースが必要とするのはPOST /v1/chat/completionsを実装したエンドポイントだけです。その形式で提供されるClaudeモデルは、SillyTavernの別個のAnthropicソースを使わずに動作します。Kunavoでは、ClaudeとGPTのモデルidが1つのキーで同じドロップダウンに表示され、切り替え時に再接続する必要はありません。

カスタムエンドポイントを使う場合、SillyTavernでストリーミングは動作しますか?

エンドポイントが/v1/chat/completionsでサーバー送信イベントを実装していればストリーミングは動作します。Kunavoはこれに対応しています。応答が一括で届く場合、通常はエンドポイントではなく、接続の前段にあるプロキシがストリームをバッファリングしています。

接続後にSillyTavernのモデル一覧が空なのはなぜですか?

SillyTavernでモデルのドロップダウンが空になる場合、GET /v1/modelsの呼び出しに失敗しています。原因はSillyTavernではなく、エンドポイントまたはキーにあります。よくある原因は、ベースURLに/v1サフィックスがないことと、そのエンドポイントで使えないキーであることです。同じキーを使って/v1/modelsにcurlを実行すれば、SillyTavernの外でも失敗を再現でき、どちらが原因かを確認できます。