Documentation

Documentation

SillyTavern

La source Custom (OpenAI-compatible) de SillyTavern nécessite une URL de base et une clé. Configurez-la pour Kunavo : Claude et GPT apparaîtront tous deux dans la même liste déroulante des modèles.

Pour connecter SillyTavern à Kunavo, ouvrez API Connections, définissez API sur Chat Completion et Chat Completion Source sur Custom (OpenAI-compatible), puis renseignez deux champs : Custom Endpoint = https://api.kunavo.com/v1 et Custom API Key = votre clé sk-kn-…. Cliquez sur Connect ; SillyTavern appelle GET /v1/models et remplit la liste déroulante des modèles à partir de la réponse.

Champ SillyTavernValeur
APIChat Completion
Chat Completion SourceCustom (OpenAI-compatible)
Custom Endpoint (Base URL)https://api.kunavo.com/v1
Custom API Keysk-kn-…
Available ModelsSe remplit automatiquement après avoir cliqué sur Connect — choisissez n’importe quel id
Le suffixe /v1 doit figurer dans ce champ. La source personnalisée de SillyTavern suit la convention OpenAI et n’ajoute que le chemin ; https://api.kunavo.com sans /v1 entraîne donc un échec de la connexion et une liste de modèles vide.

Étape par étape

  1. Créez une clé sur /app/keys et copiez-la — elle n’est affichée qu’une seule fois.
  2. Dans SillyTavern, ouvrez l’icône de prise (API Connections) dans la barre supérieure.
  3. Définissez API → Chat Completion, puis Chat Completion Source → Custom (OpenAI-compatible).
  4. Collez https://api.kunavo.com/v1 dans Custom Endpoint et saisissez la clé dans Custom API Key.
  5. Cliquez sur Connect. Un statut vert et une liste déroulante Available Models remplie indiquent que la connexion a réussi.
  6. Choisissez un id de modèle dans la liste déroulante et démarrez une conversation. Il n’est pas nécessaire de se reconnecter pour changer de modèle ensuite.

La référence de SillyTavern consacrée à cet écran est la page des connexions d’API Chat Completions.

Vérifiez avant de déboguer l’interface

Une seule requête permet de déterminer si l’échec vient du point de terminaison, de la clé ou de SillyTavern. Si elle renvoie une liste JSON d’id de modèles, la même URL et la même clé rempliront la liste déroulante.

# Confirms the key and the endpoint before you touch SillyTavern.
# A JSON list of model ids means the same URL will populate the dropdown.
curl -sS https://api.kunavo.com/v1/models \
  -H "Authorization: Bearer sk-kn-..."

Quels modèles choisir ?

Tous les modèles textuels de Kunavo sont accessibles depuis la même liste déroulante — la liste complète se trouve sur la page des modèles et est renvoyée en temps réel par GET /v1/models. Les tarifs sont en USD par million de jetons, entrée / sortie.

Identifiant du modèleEntrée / sortie sur KunavoUtilisation conseillée
claude-haiku-4-5$0.70 / $3.50Le modèle Claude le moins cher — pour les longues sessions où le coût par tour compte le plus
claude-sonnet-5$1.40 / $7.00Le meilleur équilibre par défaut entre qualité et prix
claude-opus-5$3.50 / $17.50Le niveau de qualité le plus élevé de Claude
claude-fable-5$7.00 / $35.00Raisonnement de pointe avec une fenêtre de contexte de 1M jetons — à choisir lorsque l’historique de conversation pose problème
Dans une longue session SillyTavern, c’est la longueur du contexte qui devient d’abord contraignante : tout l’historique est renvoyé à chaque tour, si bien que le nombre de jetons consommés augmente avec la conversation au lieu de rester stable. Kunavo facture chaque jeton à partir d’un solde prépayé, sans frais mensuels ; un mois sans activité ne coûte donc rien — consultez les détails dans la facturation. La mise en cache des prompts est le levier qui compte le plus lorsque le contexte est répété.

Dépannage

SymptômeCauseCorrectif
La connexion échoue, la liste des modèles reste vide/v1 absent de Custom EndpointUtilisez https://api.kunavo.com/v1. Vérifiez avec la commande curl ci-dessus.
401 / clé invalideClé collée avec des espaces superflus, ou révoquéeRecopiez-la depuis /app/keys ; voir 401 et 403
Les réponses arrivent en bloc, sans streamingUn proxy en amont de la connexion met en mémoire tampon les événements envoyés par le serveurLe streaming côté point de terminaison est pris en charge — erreurs de streaming
Id du modèle refuséId non proposé par ce point de terminaisonChoisissez-le dans la liste déroulante, ou consultez model_not_found
Erreurs uniquement dans les longues conversationsL’historique dépasse la fenêtre de contexte du modèleRéduisez l’historique ou passez à un modèle à contexte plus long — context_length_exceeded

Deux précisions importantes

Aucune affiliation

SillyTavern est un projet open source indépendant et n’est pas affilié à Kunavo. Cette page décrit une configuration fonctionnelle parce que SillyTavern prend en charge des points de terminaison OpenAI compatibles arbitraires — aucune adaptation particulière n’a été effectuée de part et d’autre.

La politique de contenu reste applicable

Les requêtes envoyées via Kunavo atteignent les fournisseurs en amont, et chacun applique sa propre politique d’utilisation au contenu qu’il reçoit. Une passerelle ne supprime pas ces limites ; toute page affirmant le contraire cherche à vous vendre quelque chose. Les conditions propres à Kunavo figurent dans la politique d’utilisation acceptable.

Questions fréquentes

Comment connecter SillyTavern à un point de terminaison d’API personnalisé ?

Dans SillyTavern, ouvrez l’onglet API Connections (l’icône de prise), définissez API sur Chat Completion et Chat Completion Source sur Custom (OpenAI-compatible). Saisissez l’URL de base compatible avec OpenAI de la passerelle dans Custom Endpoint — pour Kunavo, il s’agit de https://api.kunavo.com/v1 —, saisissez la clé dans Custom API Key, puis cliquez sur Connect. SillyTavern appelle ensuite GET /v1/models sur ce point de terminaison et remplit la liste déroulante des modèles à partir de la réponse.

SillyTavern fonctionne-t-il avec des modèles Claude via un point de terminaison compatible avec OpenAI ?

Oui. La source Custom (OpenAI-compatible) de SillyTavern nécessite uniquement un point de terminaison qui implémente POST /v1/chat/completions ; les modèles Claude proposés dans ce format fonctionnent donc sans passer par la source Anthropic distincte de SillyTavern. Sur Kunavo, les id des modèles Claude et GPT apparaissent tous dans la même liste déroulante derrière une seule clé, et il n’est pas nécessaire de se reconnecter pour passer de l’un à l’autre.

Le streaming fonctionne-t-il dans SillyTavern avec un point de terminaison personnalisé ?

Le streaming fonctionne tant que le point de terminaison implémente les événements envoyés par le serveur sur /v1/chat/completions, ce que fait Kunavo. Si les réponses arrivent sous la forme d’un seul bloc complet, la cause habituelle est un proxy placé en amont de la connexion qui met le flux en mémoire tampon, et non le point de terminaison lui-même.

Pourquoi la liste des modèles SillyTavern est-elle vide après la connexion ?

Une liste déroulante vide dans SillyTavern signifie que l’appel GET /v1/models a échoué ; le problème vient donc du point de terminaison ou de la clé, et non de SillyTavern. Les deux causes les plus fréquentes sont une URL de base à laquelle manque le suffixe /v1 et une clé invalide pour ce point de terminaison. En exécutant curl sur /v1/models avec la même clé, vous reproduisez l’échec hors de SillyTavern et pouvez déterminer laquelle de ces deux causes est en jeu.