Nos dernières nouveautés
Lancements de modèles, ajustements tarifaires, améliorations du tableau de bord et de la plateforme : tout dans une seule chronologie.
- Tarifs
Claude Sonnet 5 coûte désormais $1.40 / $7.00 par 1M tokens
Claude Sonnet 5 passe de $2.00 / $10.00 par 1M token d’entrée / de sortie, le tarif officiel d’Anthropic, à $1.40 / $7.00. Les lectures et écritures du cache bénéficient de la même remise, comme pour tous les modèles. Les appels déjà facturés ne sont pas concernés.
- Tarifs
Les prix du cache suivent désormais les ratios propres à chaque fournisseur
Les prix du cache suivent désormais les ratios propres à chaque fournisseur, avec la remise du modèle. Les lectures du cache sont facturées à 10 % du prix d’entrée chez tous les fournisseurs (OpenAI et Gemini étaient à 20 % ; les lectures de Claude Fable 5.1 sont à 2,5 %). Les écritures du cache sont facturées à 1,25× le prix d’entrée sur Claude et GPT-5.6+ (elles étaient au tarif d’entrée normal). Le palier long contexte d’OpenAI au-delà de 272K tokens d’entrée et celui de Gemini 3.1 Pro au-delà de 200K s’appliquent désormais : toute la requête est facturée à 2× le prix d’entrée et 1,5× le prix de sortie.
- Authentification
Nouvelle authentification interne (auth-v2)
Auth.js a été remplacé par un flux interne JWT + lien magique + Google OAuth. Le tableau de bord, la connexion et le middleware ont tous migré.
- Plateforme
Widget de commentaires UserSay installé
Le déclencheur de première utilisation, le hook identify et le webhook de récompense sont désormais tous connectés dans le tableau de bord.
- Tarifs
Amélioration de la tarification du cache
La surcharge d’écriture du cache a été totalement supprimée ; les lectures du cache sur OpenAI/Gemini passent de 0.25× à 0.20× du prix d’entrée. Les prompts répétés coûtent moins cher.
- Tableau de bord
Onglet AI Agent dans le hero de la page d’accueil
Déposez directement dans votre agent une instruction prête à coller pour lui faire appeler Kunavo sans écrire le code passe-partout du SDK.
- Plateforme
Mise en cache des prompts, de bout en bout
Les économies du cache sont visibles dans le tableau de bord, les pages marketing et la documentation. Le routage par affinité maintient les prompts répétés en cache sur le même nœud en amont, avec jusqu’à 90 % de réduction sur le coût d’entrée.
- Plateforme
Tableau de bord SLO avec suivi du TTFB et des déconnexions
Le TTFB et les taux de déconnexion en cours de flux sont désormais visibles par dispatcher dans la console d’administration. Il est plus facile de repérer les régressions en amont avant les utilisateurs.
- Plateforme
Téléversements publics sur files.kunavo.com
Les images téléversées par les utilisateurs pour la retouche d’image et la conversion image-vidéo sont désormais servies depuis files.kunavo.com — URL permanentes, bucket neutre, identifiants dédiés.
- Plateforme
La réservation du solde empêche les dépassements concurrents
Le coût estimé de l’appel est désormais réservé à l’avance, afin que plusieurs appels simultanés ne puissent pas faire passer un compte sous zéro. Cette protection est couverte par un nouveau test de concurrence.