Lo que hemos lanzado últimamente
Lanzamientos de modelos, ajustes de precios, mejoras del panel y de la plataforma: todo en una sola cronología.
- Precios
Claude Sonnet 5 ahora cuesta $1.40 / $7.00 por 1M de tokens
Claude Sonnet 5 baja de $2.00 / $10.00 por cada 1M de tokens de entrada / salida, el precio oficial de Anthropic, a $1.40 / $7.00. Las lecturas y escrituras de caché mantienen el mismo descuento, como en todos los modelos. Las llamadas ya facturadas no se ven afectadas.
- Precios
Los precios de caché ahora siguen las proporciones de cada proveedor
Los precios de caché ahora siguen las proporciones propias de cada proveedor, con el descuento del modelo. Las lecturas de caché se facturan al 10 % del precio de entrada en todos los proveedores (antes eran del 20 % en OpenAI y Gemini; las lecturas de Claude Fable 5.1 son del 2,5 %). Las escrituras de caché se facturan a 1,25× el precio de entrada en Claude y GPT-5.6+ (antes tenían la tarifa normal de entrada). Ahora se aplican el nivel de contexto largo de OpenAI por encima de 272K tokens de entrada y el de Gemini 3.1 Pro por encima de 200K: toda la solicitud se factura a 2× la entrada y 1,5× la salida.
- Autenticación
Nueva autenticación interna (auth-v2)
Se sustituyó Auth.js por un flujo interno de JWT + enlace mágico + Google OAuth. El panel, el inicio de sesión y el middleware ya se han migrado.
- Plataforma
Widget de comentarios de UserSay instalado
El activador de primer uso, el hook de identificación y el webhook de recompensas ya están conectados en todo el panel.
- Precios
Mejoras en los precios de caché
Se eliminó por completo el recargo por escritura en caché; las lecturas de caché en OpenAI/Gemini bajaron de 0,25× a 0,20× del precio de entrada. Los prompts repetidos cuestan menos.
- Panel
Pestaña AI Agent en el hero de la página de inicio
Pega directamente en tu agente un fragmento de instrucciones listo para usar y haz que llame a Kunavo sin escribir código repetitivo del SDK.
- Plataforma
Caché de prompts de extremo a extremo
El panel, el marketing y la documentación muestran ahora el ahorro de la caché. El enrutamiento por afinidad mantiene los prompts repetidos en caché en el mismo nodo ascendente, con hasta un 90 % de descuento en el coste de entrada.
- Plataforma
Panel de SLO con supervisión de TTFB y desconexiones
Las tasas de TTFB y de desconexiones durante el flujo de cada dispatcher ahora son visibles en la consola de administración. Es más fácil detectar regresiones ascendentes antes que los usuarios.
- Plataforma
Cargas públicas en files.kunavo.com
Las imágenes subidas por los usuarios para la edición de imágenes y la conversión de imagen a vídeo ahora se sirven desde files.kunavo.com: URL permanentes, bucket neutral y credenciales dedicadas.
- Plataforma
La reserva de saldo evita sobregiros simultáneos
Ahora el coste estimado de la llamada se reserva por adelantado, de modo que varias llamadas simultáneas no pueden agotar una cuenta por debajo de cero. Está cubierto por una nueva prueba de concurrencia.