Unsere neuesten Neuerungen
Neue Modelle, Preisänderungen, Dashboard-Updates und Plattformverbesserungen – alles in einer Zeitleiste.
- Preise
Claude Sonnet 5 kostet jetzt $1.40 / $7.00 pro 1M Tokens
Claude Sonnet 5 sinkt von $2.00 / $10.00 pro 1M Eingabe- / Ausgabe-Tokens — dem offiziellen Listenpreis von Anthropic — auf $1.40 / $7.00. Cache-Lese- und Schreibvorgänge folgen wie bei jedem Modell demselben Rabatt. Bereits abgerechnete Aufrufe sind nicht betroffen.
- Preise
Cache-Preise folgen jetzt den jeweiligen Anbieterquoten
Cache-Preise folgen jetzt den jeweiligen Anbieterquoten und erhalten den Rabatt des Modells. Cache-Lesevorgänge kosten bei jedem Anbieter 10 % des Eingabepreises (bei OpenAI und Gemini waren es 20 %; bei Claude Fable 5.1 kosten Lesevorgänge 2,5 %). Cache-Schreibvorgänge kosten bei Claude und GPT-5.6+ das 1,25-Fache des Eingabepreises (zuvor galt der normale Eingabepreis). OpenAIs Long-Context-Stufe bei mehr als 272K Eingabe-Tokens und die von Gemini 3.1 Pro bei mehr als 200K Eingabe-Tokens gelten jetzt ebenfalls: Die gesamte Anfrage wird mit dem 2-Fachen des Eingabe- und dem 1,5-Fachen des Ausgabepreises berechnet.
- Authentifizierung
Neue interne Authentifizierung (auth-v2)
Auth.js wurde durch einen internen JWT- + Magic-Link- + Google-OAuth-Ablauf ersetzt. Dashboard, Anmeldung und Middleware wurden vollständig migriert.
- Plattform
UserSay-Feedback-Widget installiert
First-Use-Trigger, Identify-Hook und Reward-Webhook sind jetzt im gesamten Dashboard verdrahtet.
- Preise
Verbesserungen bei der Cache-Preisgestaltung
Der Aufpreis für Cache-Schreibvorgänge wurde vollständig abgeschafft; Cache-Lesevorgänge bei OpenAI/Gemini sanken von 0.25× auf 0.20× des Eingabepreises. Wiederholte Prompts kosten weniger.
- Dashboard
AI-Agent-Tab im Hero-Bereich der Startseite
Fügen Sie Ihrem Agenten direkt ein kopierfertiges Anweisungs-Snippet ein, damit er Kunavo aufruft, ohne SDK-Boilerplate schreiben zu müssen.
- Plattform
Prompt-Caching durchgängig
Cache-Einsparungen werden jetzt im Dashboard, im Marketing und in der Dokumentation angezeigt. Affinitätsrouting hält wiederholte Prompts auf demselben Upstream-Knoten warm, mit bis zu 90 % Einsparung bei Eingaben.
- Plattform
SLO-Dashboard mit TTFB- und Verbindungsabbruchüberwachung
TTFB und Raten von Verbindungsabbrüchen während des Streams sind jetzt pro Dispatcher in der Administrationskonsole sichtbar. So lassen sich Upstream-Regressionen erkennen, bevor Nutzer sie bemerken.
- Plattform
Öffentliche Uploads auf files.kunavo.com
Von Nutzern hochgeladene Bilder für Bildbearbeitung und Bild-zu-Video werden jetzt über files.kunavo.com bereitgestellt — dauerhafte URLs, neutraler Bucket, eigene Zugangsdaten.
- Plattform
Guthabenreservierung verhindert gleichzeitige Überziehungen
Die geschätzten Kosten eines Aufrufs werden jetzt im Voraus reserviert, sodass mehrere parallele Aufrufe ein Konto nicht unter null leeren können. Dies wird durch einen neuen Parallelitätstest abgedeckt.