Dokumentation

Dokumentation

SillyTavern

Die Quelle Custom (OpenAI-compatible) von SillyTavern benötigt eine Basis-URL und einen Schlüssel. Richten Sie sie auf Kunavo aus; dann erscheinen Claude und GPT gemeinsam im selben Modell-Dropdown.

Um SillyTavern mit Kunavo zu verbinden, öffnen Sie API Connections, setzen Sie API auf Chat Completion und Chat Completion Source auf Custom (OpenAI-compatible). Füllen Sie dann zwei Felder aus: Custom Endpoint = https://api.kunavo.com/v1 und Custom API Key = Ihr sk-kn-…-Schlüssel. Klicken Sie auf Connect. SillyTavern ruft GET /v1/models auf und füllt das Modell-Dropdown anhand der Antwort.

SillyTavern-FeldWert
APIChat Completion
Chat Completion SourceCustom (OpenAI-compatible)
Custom Endpoint (Basis-URL)https://api.kunavo.com/v1
Custom API Keysk-kn-…
Verfügbare ModelleWird nach dem Verbinden automatisch ausgefüllt – wählen Sie eine beliebige ID aus.
Das Suffix /v1 gehört in dieses Feld. Die benutzerdefinierte Quelle von SillyTavern folgt der OpenAI-Konvention und hängt nur den Pfad an. Fehlt bei https://api.kunavo.com das /v1, schlägt die Verbindung fehl und die Modellliste bleibt leer.

Schritt für Schritt

  1. Erstellen Sie unter /app/keys einen Schlüssel und kopieren Sie ihn — er wird nur einmal angezeigt.
  2. Öffnen Sie in SillyTavern oben in der Leiste das Steckersymbol (API Connections).
  3. Setzen Sie API → Chat Completion und anschließend Chat Completion Source → Custom (OpenAI-compatible).
  4. Fügen Sie https://api.kunavo.com/v1 unter Custom Endpoint und den Schlüssel unter Custom API Key ein.
  5. Klicken Sie auf Connect. Ein grüner Status und ein gefülltes Dropdown für Verfügbare Modelle zeigen an, dass die Verbindung funktioniert.
  6. Wählen Sie eine Modell-ID aus dem Dropdown aus und starten Sie einen Chat. Für einen späteren Modellwechsel ist keine erneute Verbindung erforderlich.

Die Referenz von SillyTavern zu diesem Bildschirm ist die Seite zu API-Verbindungen für Chat Completions.

Vor der Fehlersuche in der Oberfläche prüfen

Mit einer einzigen Anfrage lässt sich feststellen, ob ein Fehler am Endpunkt, am Schlüssel oder an SillyTavern liegt. Gibt sie eine JSON-Liste von Modell-IDs zurück, füllen dieselbe URL und derselbe Schlüssel das Dropdown.

# Confirms the key and the endpoint before you touch SillyTavern.
# A JSON list of model ids means the same URL will populate the dropdown.
curl -sS https://api.kunavo.com/v1/models \
  -H "Authorization: Bearer sk-kn-..."

Welche Modelle Sie auswählen sollten

Jedes Textmodell auf Kunavo ist über dasselbe Dropdown erreichbar. Die vollständige Liste finden Sie auf der Modellseite; sie wird live über GET /v1/models abgerufen. Preise in USD pro 1 Mio. Tokens, Eingabe / Ausgabe.

Modell-IDKunavo: Ein- und AusgabeEinsatzbereich
claude-haiku-4-5$0.70 / $3.50Günstigstes Claude-Modell – für lange Sitzungen, in denen die Kosten pro Runde am wichtigsten sind
claude-sonnet-5$1.40 / $7.00Das standardmäßige Verhältnis von Qualität und Preis
claude-opus-5$3.50 / $17.50Claude-Modell der höchsten Qualitätsstufe
claude-fable-5$7.00 / $35.00Frontier-Reasoning mit einem Kontextfenster von 1 Mio. Tokens – die richtige Wahl, wenn der Chatverlauf selbst das Problem ist
Bei einer langen SillyTavern-Sitzung ist die Kontextlänge die erste Einschränkung, die sich bemerkbar macht: Der gesamte Verlauf wird in jeder Runde erneut gesendet, daher steigen die Tokenkosten mit der Unterhaltung und bleiben nicht konstant. Kunavo rechnet pro Token von einem Prepaid-Guthaben ab und erhebt keine Monatsgebühr. Ein ungenutzter Monat kostet daher nichts. Einzelheiten finden Sie unter Abrechnung; bei wiederholtem Kontext ist Prompt-Caching der wichtigste Hebel.

Fehlerbehebung

SymptomUrsacheLösung
Verbindung schlägt fehl, Modellliste bleibt leer/v1 fehlt in Custom EndpointVerwenden Sie https://api.kunavo.com/v1. Prüfen Sie es mit dem obigen curl-Aufruf.
401 / ungültiger SchlüsselSchlüssel mit Leerzeichen eingefügt oder widerrufenKopieren Sie ihn erneut aus /app/keys; siehe 401 und 403
Antworten treffen auf einmal ein, nicht im StreamEin Proxy vor der Verbindung puffert die servergesendeten EreignisseStreaming wird auf Endpunktseite unterstützt – Streaming-Fehler
Modell-ID abgelehntDiese ID wird von diesem Endpunkt nicht bereitgestelltWählen Sie eine ID aus dem Dropdown oder lesen Sie model_not_found
Fehler treten nur bei langen Chats aufDer Verlauf überschreitet das Kontextfenster des ModellsKürzen Sie den Verlauf oder wechseln Sie zu einem Modell mit längerem Kontext – context_length_exceeded

Zwei wichtige Hinweise

Keine Zugehörigkeit

SillyTavern ist ein unabhängiges Open-Source-Projekt und nicht mit Kunavo verbunden. Diese Seite beschreibt eine Konfiguration, die funktioniert, weil SillyTavern beliebige OpenAI-kompatible Endpunkte unterstützt. Keine der beiden Seiten enthält dafür eine Sonderbehandlung.

Die Inhaltsrichtlinien gelten weiterhin

Anfragen über Kunavo erreichen die Upstream-Anbieter, und jeder Anbieter setzt seine eigenen Nutzungsrichtlinien für die übermittelten Inhalte durch. Ein Gateway hebt diese Einschränkungen nicht auf; wer etwas anderes behauptet, will Ihnen etwas verkaufen. Die eigenen Bedingungen von Kunavo finden Sie in den Richtlinien zur zulässigen Nutzung.

Häufig gestellte Fragen

Wie verbinde ich SillyTavern mit einem benutzerdefinierten API-Endpunkt?

Öffnen Sie in SillyTavern den Tab API Connections (Steckersymbol), setzen Sie API auf Chat Completion und Chat Completion Source auf Custom (OpenAI-compatible). Tragen Sie die OpenAI-kompatible Basis-URL des Gateways unter Custom Endpoint ein – bei Kunavo ist das https://api.kunavo.com/v1 –, geben Sie den Schlüssel unter Custom API Key ein und klicken Sie auf Connect. SillyTavern ruft dann GET /v1/models auf diesem Endpunkt auf und füllt das Modell-Dropdown anhand der Antwort.

Funktioniert SillyTavern mit Claude-Modellen über einen OpenAI-kompatiblen Endpunkt?

Ja. SillyTaverns Quelle Custom (OpenAI-compatible) benötigt lediglich einen Endpunkt, der POST /v1/chat/completions implementiert. Claude-Modelle, die in diesem Format bereitgestellt werden, funktionieren daher ohne SillyTaverns separate Anthropic-Quelle. Bei Kunavo erscheinen die Claude- und GPT-Modell-IDs gemeinsam in einem Dropdown hinter einem Schlüssel. Für den Wechsel zwischen ihnen ist keine erneute Verbindung erforderlich.

Funktioniert Streaming in SillyTavern mit einem benutzerdefinierten Endpunkt?

Streaming funktioniert, sofern der Endpunkt servergesendete Ereignisse unter /v1/chat/completions implementiert, was bei Kunavo der Fall ist. Wenn Antworten nur als vollständiger Block eintreffen, ist die übliche Ursache ein Proxy vor der Verbindung, der den Stream puffert, nicht der Endpunkt selbst.

Warum ist die Modellliste in SillyTavern nach dem Verbinden leer?

Ein leeres Modell-Dropdown in SillyTavern bedeutet, dass der Aufruf von GET /v1/models fehlgeschlagen ist. Das weist auf ein Problem mit dem Endpunkt oder Schlüssel hin, nicht mit SillyTavern. Die beiden üblichen Ursachen sind eine Basis-URL ohne das Suffix /v1 und ein Schlüssel, der für diesen Endpunkt ungültig ist. Wenn Sie curl mit demselben Schlüssel gegen /v1/models ausführen, lässt sich der Fehler auch außerhalb von SillyTavern reproduzieren und feststellen, welche der beiden Ursachen vorliegt.