Nouveautés

Nos dernières nouveautés

Lancements de modèles, ajustements tarifaires, améliorations du tableau de bord et de la plateforme : tout dans une seule chronologie.

  1. Tarifs

    Claude Sonnet 5 coûte désormais $1.40 / $7.00 par 1M tokens

    Claude Sonnet 5 passe de $2.00 / $10.00 par 1M token d’entrée / de sortie, le tarif officiel d’Anthropic, à $1.40 / $7.00. Les lectures et écritures du cache bénéficient de la même remise, comme pour tous les modèles. Les appels déjà facturés ne sont pas concernés.

  2. Tarifs

    Les prix du cache suivent désormais les ratios propres à chaque fournisseur

    Les prix du cache suivent désormais les ratios propres à chaque fournisseur, avec la remise du modèle. Les lectures du cache sont facturées à 10 % du prix d’entrée chez tous les fournisseurs (OpenAI et Gemini étaient à 20 % ; les lectures de Claude Fable 5.1 sont à 2,5 %). Les écritures du cache sont facturées à 1,25× le prix d’entrée sur Claude et GPT-5.6+ (elles étaient au tarif d’entrée normal). Le palier long contexte d’OpenAI au-delà de 272K tokens d’entrée et celui de Gemini 3.1 Pro au-delà de 200K s’appliquent désormais : toute la requête est facturée à 2× le prix d’entrée et 1,5× le prix de sortie.

  3. Authentification

    Nouvelle authentification interne (auth-v2)

    Auth.js a été remplacé par un flux interne JWT + lien magique + Google OAuth. Le tableau de bord, la connexion et le middleware ont tous migré.

  4. Plateforme

    Widget de commentaires UserSay installé

    Le déclencheur de première utilisation, le hook identify et le webhook de récompense sont désormais tous connectés dans le tableau de bord.

  5. Tarifs

    Amélioration de la tarification du cache

    La surcharge d’écriture du cache a été totalement supprimée ; les lectures du cache sur OpenAI/Gemini passent de 0.25× à 0.20× du prix d’entrée. Les prompts répétés coûtent moins cher.

  6. Tableau de bord

    Onglet AI Agent dans le hero de la page d’accueil

    Déposez directement dans votre agent une instruction prête à coller pour lui faire appeler Kunavo sans écrire le code passe-partout du SDK.

  7. Plateforme

    Mise en cache des prompts, de bout en bout

    Les économies du cache sont visibles dans le tableau de bord, les pages marketing et la documentation. Le routage par affinité maintient les prompts répétés en cache sur le même nœud en amont, avec jusqu’à 90 % de réduction sur le coût d’entrée.

  8. Plateforme

    Tableau de bord SLO avec suivi du TTFB et des déconnexions

    Le TTFB et les taux de déconnexion en cours de flux sont désormais visibles par dispatcher dans la console d’administration. Il est plus facile de repérer les régressions en amont avant les utilisateurs.

  9. Plateforme

    Téléversements publics sur files.kunavo.com

    Les images téléversées par les utilisateurs pour la retouche d’image et la conversion image-vidéo sont désormais servies depuis files.kunavo.com — URL permanentes, bucket neutre, identifiants dédiés.

  10. Plateforme

    La réservation du solde empêche les dépassements concurrents

    Le coût estimé de l’appel est désormais réservé à l’avance, afin que plusieurs appels simultanés ne puissent pas faire passer un compte sous zéro. Cette protection est couverte par un nouveau test de concurrence.