Änderungsprotokoll

Unsere neuesten Neuerungen

Neue Modelle, Preisänderungen, Dashboard-Updates und Plattformverbesserungen – alles in einer Zeitleiste.

  1. Preise

    Claude Sonnet 5 kostet jetzt $1.40 / $7.00 pro 1M Tokens

    Claude Sonnet 5 sinkt von $2.00 / $10.00 pro 1M Eingabe- / Ausgabe-Tokens — dem offiziellen Listenpreis von Anthropic — auf $1.40 / $7.00. Cache-Lese- und Schreibvorgänge folgen wie bei jedem Modell demselben Rabatt. Bereits abgerechnete Aufrufe sind nicht betroffen.

  2. Preise

    Cache-Preise folgen jetzt den jeweiligen Anbieterquoten

    Cache-Preise folgen jetzt den jeweiligen Anbieterquoten und erhalten den Rabatt des Modells. Cache-Lesevorgänge kosten bei jedem Anbieter 10 % des Eingabepreises (bei OpenAI und Gemini waren es 20 %; bei Claude Fable 5.1 kosten Lesevorgänge 2,5 %). Cache-Schreibvorgänge kosten bei Claude und GPT-5.6+ das 1,25-Fache des Eingabepreises (zuvor galt der normale Eingabepreis). OpenAIs Long-Context-Stufe bei mehr als 272K Eingabe-Tokens und die von Gemini 3.1 Pro bei mehr als 200K Eingabe-Tokens gelten jetzt ebenfalls: Die gesamte Anfrage wird mit dem 2-Fachen des Eingabe- und dem 1,5-Fachen des Ausgabepreises berechnet.

  3. Authentifizierung

    Neue interne Authentifizierung (auth-v2)

    Auth.js wurde durch einen internen JWT- + Magic-Link- + Google-OAuth-Ablauf ersetzt. Dashboard, Anmeldung und Middleware wurden vollständig migriert.

  4. Plattform

    UserSay-Feedback-Widget installiert

    First-Use-Trigger, Identify-Hook und Reward-Webhook sind jetzt im gesamten Dashboard verdrahtet.

  5. Preise

    Verbesserungen bei der Cache-Preisgestaltung

    Der Aufpreis für Cache-Schreibvorgänge wurde vollständig abgeschafft; Cache-Lesevorgänge bei OpenAI/Gemini sanken von 0.25× auf 0.20× des Eingabepreises. Wiederholte Prompts kosten weniger.

  6. Dashboard

    AI-Agent-Tab im Hero-Bereich der Startseite

    Fügen Sie Ihrem Agenten direkt ein kopierfertiges Anweisungs-Snippet ein, damit er Kunavo aufruft, ohne SDK-Boilerplate schreiben zu müssen.

  7. Plattform

    Prompt-Caching durchgängig

    Cache-Einsparungen werden jetzt im Dashboard, im Marketing und in der Dokumentation angezeigt. Affinitätsrouting hält wiederholte Prompts auf demselben Upstream-Knoten warm, mit bis zu 90 % Einsparung bei Eingaben.

  8. Plattform

    SLO-Dashboard mit TTFB- und Verbindungsabbruchüberwachung

    TTFB und Raten von Verbindungsabbrüchen während des Streams sind jetzt pro Dispatcher in der Administrationskonsole sichtbar. So lassen sich Upstream-Regressionen erkennen, bevor Nutzer sie bemerken.

  9. Plattform

    Öffentliche Uploads auf files.kunavo.com

    Von Nutzern hochgeladene Bilder für Bildbearbeitung und Bild-zu-Video werden jetzt über files.kunavo.com bereitgestellt — dauerhafte URLs, neutraler Bucket, eigene Zugangsdaten.

  10. Plattform

    Guthabenreservierung verhindert gleichzeitige Überziehungen

    Die geschätzten Kosten eines Aufrufs werden jetzt im Voraus reserviert, sodass mehrere parallele Aufrufe ein Konto nicht unter null leeren können. Dies wird durch einen neuen Parallelitätstest abgedeckt.