文件
SillyTavern
SillyTavern 的 Custom (OpenAI-compatible) 來源需要基礎 URL 和金鑰。將它指向 Kunavo 後,Claude 和 GPT 都會出現在同一個模型下拉選單中。
若要讓 SillyTavern 連接 Kunavo,請開啟 API Connections,將 API 設為 Chat Completion,並將 Chat Completion Source 設為 Custom (OpenAI-compatible),接著填寫兩個欄位:Custom Endpoint = https://api.kunavo.com/v1,Custom API Key = 您的 sk-kn-… 金鑰。按下 Connect 後,SillyTavern 會呼叫 GET /v1/models,並根據回應填入模型下拉選單。
| SillyTavern 欄位 | 值 |
|---|---|
| API | Chat Completion |
| Chat Completion Source | Custom (OpenAI-compatible) |
| Custom Endpoint(基礎 URL) | https://api. |
| Custom API Key | sk-kn-… |
| Available Models | 按下 Connect 後會自動填入——選擇任一 id |
/v1 後綴。SillyTavern 的自訂來源遵循 OpenAI 慣例,只會附加路徑,因此若 https://api.kunavo.com 未包含 /v1,連線就會失敗,模型清單也會是空的。逐步操作
- 在
/app/keys建立金鑰並複製——金鑰只會顯示一次。 - 在 SillyTavern 中,點選頂端列的 插頭圖示(API Connections)。
- 將 API → Chat Completion,再將 Chat Completion Source → Custom (OpenAI-compatible)。
- 將
https://api.kunavo.com/v1貼到 Custom Endpoint,並將金鑰貼到 Custom API Key。 - 按下 Connect。若狀態顯示綠色,且 Available Models 下拉選單已填入內容,就表示連線成功。
- 從下拉選單中選擇模型 id,然後開始聊天。之後切換模型不需要重新連線。
SillyTavern 對此畫面的官方參考文件是 Chat Completions API 連線頁面。
先驗證,再開始除錯介面
只要送出一個請求,就能判斷問題出在端點、金鑰還是 SillyTavern。如果回傳的是模型 id 的 JSON 清單,同一組 URL 和金鑰就能填入下拉選單。
# Confirms the key and the endpoint before you touch SillyTavern.
# A JSON list of model ids means the same URL will populate the dropdown.
curl -sS https://api.kunavo.com/v1/models \
-H "Authorization: Bearer sk-kn-..."該選哪些模型
Kunavo 上的所有文字模型都能從同一個下拉選單存取——完整清單請見模型頁面,並會從 GET /v1/models 即時取得。費率以每 1M token 的美元計價,順序為輸入/輸出。
| 模型 ID | Kunavo 輸入/輸出 | 適用情境 |
|---|---|---|
claude-haiku-4-5 | $0.70 / $3.50 | 最便宜的 Claude——適合最重視每輪成本的長時間對話 |
claude-sonnet-5 | $1.40 / $7.00 | 品質與價格的預設平衡選擇 |
claude-opus-5 | $3.50 / $17.50 | 品質最高的 Claude 級別 |
claude-fable-5 | $7.00 / $35.00 | 具備 1M-token 上下文視窗的前沿推理模型——當聊天記錄本身造成問題時可選用 |
疑難排解
| 症狀 | 原因 | 修正方法 |
|---|---|---|
| 連線失敗,模型清單維持空白 | Custom Endpoint 未包含 /v1 | 請使用 https://api.。以上方的 curl 命令確認。 |
| 401/金鑰無效 | 貼上的金鑰含有空白字元,或金鑰已撤銷 | 從 /app/keys 重新複製;請參閱 401 和 403 |
| 回應一次完整送達,未以串流傳送 | 連線前方的代理伺服器正在緩衝伺服器傳送事件 | 端點支援串流——請參閱串流錯誤 |
| 模型 id 遭拒 | 此端點未提供該 id | 從下拉選單選擇,或參閱 model_not_found |
| 只有長時間聊天時才發生錯誤 | 歷史記錄已超出模型的上下文視窗 | 縮短歷史記錄,或改用上下文更長的模型——請參閱 context_length_exceeded |
兩點說明
無隸屬關係
SillyTavern 是獨立的開源專案,與 Kunavo 無隸屬關係。本頁說明可行的設定方式,是因為 SillyTavern 支援任意 OpenAI 相容端點——Kunavo 或 SillyTavern 都沒有針對此設定做特別處理。
內容政策仍然適用
透過 Kunavo 傳送的請求會送達上游提供者,而各提供者會依其自身使用政策處理收到的內容。閘道不會移除這些限制,任何宣稱相反的頁面都只是在兜售說法。Kunavo 自身的條款請見可接受使用政策。
常見問題
如何讓 SillyTavern 連接至自訂 API 端點?
在 SillyTavern 中開啟 API Connections 分頁(插頭圖示),將 API 設為 Chat Completion,並將 Chat Completion Source 設為 Custom (OpenAI-compatible)。將閘道的 OpenAI 相容基礎 URL 填入 Custom Endpoint——Kunavo 的網址是 https://api.kunavo.com/v1——將金鑰填入 Custom API Key,然後按下 Connect。SillyTavern 接著會呼叫該端點的 GET /v1/models,並依據回應填入模型下拉選單。
SillyTavern 能透過 OpenAI 相容端點使用 Claude 模型嗎?
可以。SillyTavern 的 Custom (OpenAI-compatible) 來源只需要支援 POST /v1/chat/completions 的端點,因此以此格式提供的 Claude 模型可正常使用,不必改用 SillyTavern 獨立的 Anthropic 來源。在 Kunavo 上,Claude 和 GPT 模型 id 都會顯示在同一個下拉選單中,並共用一個金鑰;切換模型不需要重新連線。
在 SillyTavern 中使用自訂端點時,串流功能能正常運作嗎?
只要端點在 /v1/chat/completions 上支援伺服器傳送事件,串流就能正常運作;Kunavo 符合此條件。如果回應只會一次完整送達,常見原因是連線前方的代理伺服器緩衝了串流,而非端點本身。
為什麼連線後 SillyTavern 的模型清單是空的?
SillyTavern 的模型下拉選單為空,表示 GET /v1/models 呼叫失敗,問題出在端點或金鑰,而非 SillyTavern。最常見的兩個原因是基礎 URL 少了 /v1 後綴,或金鑰不適用於該端點。使用同一把金鑰對 /v1/models 執行 curl,可在 SillyTavern 外重現失敗,並判斷是哪一種原因。