文件

文件

SillyTavern

SillyTavern 的 Custom (OpenAI-compatible) 來源需要基礎 URL 和金鑰。將它指向 Kunavo 後,Claude 和 GPT 都會出現在同一個模型下拉選單中。

若要讓 SillyTavern 連接 Kunavo,請開啟 API Connections,將 API 設為 Chat Completion,並將 Chat Completion Source 設為 Custom (OpenAI-compatible),接著填寫兩個欄位:Custom Endpoint = https://api.kunavo.com/v1,Custom API Key = 您的 sk-kn-… 金鑰。按下 Connect 後,SillyTavern 會呼叫 GET /v1/models,並根據回應填入模型下拉選單。

SillyTavern 欄位值
APIChat Completion
Chat Completion SourceCustom (OpenAI-compatible)
Custom Endpoint(基礎 URL)https://api.kunavo.com/v1
Custom API Keysk-kn-…
Available Models按下 Connect 後會自動填入——選擇任一 id
此欄位的值必須包含 /v1 後綴。SillyTavern 的自訂來源遵循 OpenAI 慣例,只會附加路徑,因此若 https://api.kunavo.com 未包含 /v1,連線就會失敗,模型清單也會是空的。

逐步操作

  1. 在 /app/keys 建立金鑰並複製——金鑰只會顯示一次。
  2. 在 SillyTavern 中,點選頂端列的 插頭圖示(API Connections)。
  3. 將 API → Chat Completion,再將 Chat Completion Source → Custom (OpenAI-compatible)。
  4. 將 https://api.kunavo.com/v1 貼到 Custom Endpoint,並將金鑰貼到 Custom API Key。
  5. 按下 Connect。若狀態顯示綠色,且 Available Models 下拉選單已填入內容,就表示連線成功。
  6. 從下拉選單中選擇模型 id,然後開始聊天。之後切換模型不需要重新連線。

SillyTavern 對此畫面的官方參考文件是 Chat Completions API 連線頁面。

先驗證,再開始除錯介面

只要送出一個請求,就能判斷問題出在端點、金鑰還是 SillyTavern。如果回傳的是模型 id 的 JSON 清單,同一組 URL 和金鑰就能填入下拉選單。

# Confirms the key and the endpoint before you touch SillyTavern.
# A JSON list of model ids means the same URL will populate the dropdown.
curl -sS https://api.kunavo.com/v1/models \
  -H "Authorization: Bearer sk-kn-..."

該選哪些模型

Kunavo 上的所有文字模型都能從同一個下拉選單存取——完整清單請見模型頁面,並會從 GET /v1/models 即時取得。費率以每 1M token 的美元計價,順序為輸入/輸出。

模型 IDKunavo 輸入/輸出適用情境
claude-haiku-4-5$0.70 / $3.50最便宜的 Claude——適合最重視每輪成本的長時間對話
claude-sonnet-5$1.40 / $7.00品質與價格的預設平衡選擇
claude-opus-5$3.50 / $17.50品質最高的 Claude 級別
claude-fable-5$7.00 / $35.00具備 1M-token 上下文視窗的前沿推理模型——當聊天記錄本身造成問題時可選用
在 SillyTavern 的長時間對話中,上下文長度是最先造成限制的因素:每一輪都會重新傳送完整歷史記錄,因此 token 用量會隨對話增加,而不會維持固定。Kunavo 以預付餘額按 token 計費,沒有月費,因此閒置一個月不會產生費用——詳情請見 計費;重複使用上下文時,最關鍵的調整方式是 提示快取。

疑難排解

症狀原因修正方法
連線失敗,模型清單維持空白Custom Endpoint 未包含 /v1請使用 https://api.kunavo.com/v1。以上方的 curl 命令確認。
401/金鑰無效貼上的金鑰含有空白字元,或金鑰已撤銷從 /app/keys 重新複製;請參閱 401 和 403
回應一次完整送達,未以串流傳送連線前方的代理伺服器正在緩衝伺服器傳送事件端點支援串流——請參閱串流錯誤
模型 id 遭拒此端點未提供該 id從下拉選單選擇,或參閱 model_not_found
只有長時間聊天時才發生錯誤歷史記錄已超出模型的上下文視窗縮短歷史記錄,或改用上下文更長的模型——請參閱 context_length_exceeded

兩點說明

無隸屬關係

SillyTavern 是獨立的開源專案,與 Kunavo 無隸屬關係。本頁說明可行的設定方式,是因為 SillyTavern 支援任意 OpenAI 相容端點——Kunavo 或 SillyTavern 都沒有針對此設定做特別處理。

內容政策仍然適用

透過 Kunavo 傳送的請求會送達上游提供者,而各提供者會依其自身使用政策處理收到的內容。閘道不會移除這些限制,任何宣稱相反的頁面都只是在兜售說法。Kunavo 自身的條款請見可接受使用政策。

常見問題

如何讓 SillyTavern 連接至自訂 API 端點?

在 SillyTavern 中開啟 API Connections 分頁(插頭圖示),將 API 設為 Chat Completion,並將 Chat Completion Source 設為 Custom (OpenAI-compatible)。將閘道的 OpenAI 相容基礎 URL 填入 Custom Endpoint——Kunavo 的網址是 https://api.kunavo.com/v1——將金鑰填入 Custom API Key,然後按下 Connect。SillyTavern 接著會呼叫該端點的 GET /v1/models,並依據回應填入模型下拉選單。

SillyTavern 能透過 OpenAI 相容端點使用 Claude 模型嗎?

可以。SillyTavern 的 Custom (OpenAI-compatible) 來源只需要支援 POST /v1/chat/completions 的端點,因此以此格式提供的 Claude 模型可正常使用,不必改用 SillyTavern 獨立的 Anthropic 來源。在 Kunavo 上,Claude 和 GPT 模型 id 都會顯示在同一個下拉選單中,並共用一個金鑰;切換模型不需要重新連線。

在 SillyTavern 中使用自訂端點時,串流功能能正常運作嗎?

只要端點在 /v1/chat/completions 上支援伺服器傳送事件,串流就能正常運作;Kunavo 符合此條件。如果回應只會一次完整送達,常見原因是連線前方的代理伺服器緩衝了串流,而非端點本身。

為什麼連線後 SillyTavern 的模型清單是空的?

SillyTavern 的模型下拉選單為空,表示 GET /v1/models 呼叫失敗,問題出在端點或金鑰,而非 SillyTavern。最常見的兩個原因是基礎 URL 少了 /v1 後綴,或金鑰不適用於該端點。使用同一把金鑰對 /v1/models 執行 curl,可在 SillyTavern 外重現失敗,並判斷是哪一種原因。