Registro de alterações

O que lançamos recentemente

Lançamentos de modelos, ajustes de preços, melhorias no painel e na plataforma — tudo em uma linha do tempo.

  1. Preços

    Claude Sonnet 5 agora custa $1.40 / $7.00 por 1 milhão de tokens

    O Claude Sonnet 5 caiu de $2.00 / $10.00 por 1 milhão de tokens de entrada / saída, o preço oficial da Anthropic, para $1.40 / $7.00. As leituras e gravações em cache seguem o mesmo desconto, como em todos os modelos. As chamadas já cobradas não são afetadas.

  2. Preços

    Os preços de cache agora seguem as proporções de cada fornecedor

    Os preços de cache agora seguem as proporções de cada fornecedor, com o desconto do modelo. As leituras em cache custam 10% do preço de entrada em todos os fornecedores (OpenAI e Gemini cobravam 20%; as leituras do Claude Fable 5.1 custam 2,5%). As gravações em cache custam 1,25× o preço de entrada no Claude e no GPT-5.6+ (antes, custavam a taxa normal de entrada). A faixa de contexto longo da OpenAI acima de 272K tokens de entrada e a faixa do Gemini 3.1 Pro acima de 200K agora se aplicam: toda a solicitação é cobrada a 2× o preço de entrada e 1,5× o preço de saída.

  3. Autenticação

    Novo sistema interno de autenticação (auth-v2)

    Substituímos o Auth.js por um fluxo interno de JWT + magic link + Google OAuth. O painel, o login e o middleware foram todos migrados.

  4. Plataforma

    Widget de feedback UserSay instalado

    O gatilho de primeiro uso, o hook de identificação e o webhook de recompensa foram todos integrados ao painel.

  5. Preços

    Melhorias nos preços de cache

    Eliminamos completamente a sobretaxa de gravação em cache; as leituras em cache na OpenAI/Gemini caíram de 0,25× para 0,20× do preço de entrada. Prompts repetidos agora custam menos.

  6. Painel

    Aba AI Agent no destaque da página inicial

    Cole um trecho de instrução pronto diretamente no seu agente para que ele chame o Kunavo sem escrever código boilerplate de SDK.

  7. Plataforma

    Prompt caching de ponta a ponta

    A economia do cache agora aparece em todo o painel, no marketing e na documentação. O roteamento por afinidade mantém prompts repetidos aquecidos no mesmo nó upstream, com até 90% de economia na entrada.

  8. Plataforma

    Painel de SLO com monitoramento de TTFB e desconexões

    As taxas de TTFB e de desconexões no meio do fluxo agora são visíveis no console administrativo para cada dispatcher. Ficou mais fácil identificar regressões no upstream antes que os usuários percebam.

  9. Plataforma

    Uploads públicos em files.kunavo.com

    As imagens enviadas pelos usuários para edição de imagem e conversão de imagem em vídeo agora são servidas por files.kunavo.com — URLs permanentes, bucket neutro e credenciais dedicadas.

  10. Plataforma

    A reserva de saldo impede débitos excedentes concorrentes

    O custo estimado da chamada agora é reservado antecipadamente, portanto várias chamadas concorrentes não podem esgotar o saldo da conta abaixo de zero. A cobertura inclui um novo teste de concorrência.