Dokumentation
Page Assist
Page Assist wurde für ein lokales Ollama entwickelt, aber über denselben Bildschirm lässt sich auch ein gehosteter Endpunkt einrichten: Einstellungen → OpenAI Compatible API → Add Provider → Custom. Drei Felder genügen, und die Seitenleiste fasst den gerade geöffneten Tab mit Claude oder GPT zusammen, statt mit einem Modell, das in den Arbeitsspeicher Ihres Laptops passt.
Settings → OpenAI Compatible API → Add Provider → Custom: Provider Name, eine Base URL mit /v1 und der Schlüssel — anschließend Modell-IDs aus der von Page Assist selbst geladenen Liste auswählen.
Provider Name Kunavo
Base URL https://api.kunavo.com/v1
API Key sk-kn-...
[ Save ]
Model List (appears after Save — fetched from GET /v1/models)
[x] claude-haiku-4-5
[x] claude-sonnet-5
[x] gpt-5-6-terraBase URL muss ihr Suffix /v1 behalten. Auf der Seite OpenAI Compatible API steht das nicht ausdrücklich – aber im Feld selbst. Der Hilfetext lautet „The base URL of the OpenAI API provider. eg (http://localhost:1234/v1)“, und die beiden zugehörigen Anbieterseiten, die eine konkrete URL für dasselbe Feld angeben, bestätigen es: Bei LM Studio heißt es „by default it is http://localhost:1234/v1“, und bei LLaMA.cpp steht http://localhost:8080/v1. Page Assist fügt nur den Pfad an. Daher führt der reine Ursprung zu 404 statt 401 – anders als bei Clients im Anthropic-Stil, die nur den Ursprung benötigen.Save öffnet Page Assist ein Model List mit der Aufforderung „Please select the chat models you want to use with this provider“. Die Liste wird anhand des Endpunkts befüllt. Kunavo antwortet mit GET /v1/models, daher wird die Liste automatisch ausgefüllt. Bleibt sie leer, zeigt die Erweiterung „No model found. Make sure you have added correct provider with base URL and API key“ an. Das trifft zu: Eine leere Liste weist viel häufiger auf ein Problem mit der Base-URL oder dem Schlüssel hin als auf ein Problem mit dem Katalog. Prüfen Sie dies zunächst mit dem unten stehenden curl, bevor Sie die Erweiterung ändern. IDs lassen sich auch manuell über Add Custom Model hinzufügen. Das Feld Model ID akzeptiert einen Slug aus der Tabelle auf dieser Seite unverändert.Add Custom Model enthält die Auswahl Model Type, aber Kunavo stellt kein Einbettungsmodell bereit – im Katalog gibt es kein Modell, das auf diesen Endpunkt antwortet, daher lässt sich die zweite Option hier nicht verwenden. Die Knowledge-Base-Funktion benötigt ein solches Modell: Auf der eigenen Seite des Anbieters steht, dass eines in den RAG-Einstellungen festgelegt werden muss; empfohlen wird nomic-embed-text. Verwenden Sie dafür zusätzlich zu diesem Anbieter ein lokal konfiguriertes Ollama. Page Assist kann mehrere Anbieter gleichzeitig speichern, und die beiden Aufgaben müssen nicht vom selben Anbieter erfüllt werden.curl funktioniert. Wie sich die Erweiterung mit einem funktionierenden Endpunkt verhält, müssen Sie mit Page Assist klären.sk-kn-) und füge ab $10 Guthaben hinzu – Aufrufe werden aus diesem Guthaben bezahlt, fehlgeschlagene Aufrufe werden nicht berechnet. Das Dashboard öffnet anschließend die Page Assist-Einrichtung.Schritt für Schritt
- Erstellen Sie unter
/app/keyseinen Schlüssel und kopieren Sie ihn — er wird nur einmal angezeigt. - Klicken Sie auf das Page-Assist-Symbol in der Browser-Symbolleiste, dann auf das Symbol Settings und wechseln Sie zum Tab OpenAI Compatible API.
- Klicken Sie auf Add Provider. Kunavo ist keine der Voreinstellungen im Dropdown-Menü. Wählen Sie daher
Custom– laut Schritt 5 des Anbieters ist dies der richtige Weg für Anbieter, die nicht in der Liste stehen. - Geben Sie Provider Name, Base URL =
https://api.kunavo.com/v1und API Key ein und klicken Sie dann auf Save. - Aktivieren Sie in der geöffneten Model List die gewünschten IDs. Zwei sind in der Regel die richtige Anzahl: ein günstiges Modell für Seitenzusammenfassungen und ein leistungsstarkes für die anschließenden Fragen.
- Öffnen Sie die Seitenleiste auf einer echten Webseite –
Ctrl+Shift+Löffnet die Weboberfläche –, wählen Sie das Modell in der Auswahlliste aus und fragen Sie es zum geöffneten Tab. Eine Seite mit tatsächlichem Inhalt sagt mehr aus als eine Begrüßung, denn der Seitentext ist der Teil, der Kosten verursacht.
Abgeglichen mit Die Seite OpenAI Compatible API von Page Assist am 21. September 2026. Einstellungen von Drittanbietern können sich ändern; wenn ein Feldname hier nicht mehr mit deiner Ansicht übereinstimmt, ist diese Seite maßgeblich, nicht diese hier.
Vor dem Debugging des Clients prüfen
Eine Anfrage klärt, ob der Fehler am Endpunkt, am Schlüssel oder an der Konfigurationsdatei liegt. Wenn diese Anfrage JSON zurückgibt, funktionieren dieselbe Basis-URL und derselbe Schlüssel in Page Assist.
# Settles whether a failure is the endpoint, the key, or the client.
curl -sS https://api.kunavo.com/v1/models \
-H "Authorization: Bearer sk-kn-..."Welche Modell-ID in das Feld gehört
Jedes Textmodell ist über eine Modell-ID erreichbar – die aktuelle Liste findest du unter GET /v1/models, den Katalog mit Preisen auf der Modellseite. Die Tarife sind USD pro 1 Mio. Token, Eingabe / Ausgabe.
| Modell-ID | Kunavo: Ein- und Ausgabe | Wo es in Page Assist hineinpasst |
|---|---|---|
claude-haiku-4-5 | $0.70 / $3.50 | die Standardeinstellung für eine Seitenleiste: Seitenzusammenfassungen und Folgefragen, bei denen das Volumen entscheidend ist |
gpt-5-6-terra | $0.70 / $4.20 | lange Seiten – Dokumentationen, Threads, Transkripte –, die vollständig statt gekürzt gesendet werden |
claude-sonnet-5 | $1.40 / $7.00 | die Frage im Anschluss an die Zusammenfassung, wenn die Antwort stimmen muss |
gpt-5-6-sol | $2.00 / $12.00 | eine zweite Einschätzung aus einer anderen Familie; fügen Sie sie als zweite angekreuzte ID desselben Anbieters hinzu |
Was die Seite kostet und was den Browser verlässt
Ein Seitenleisten-Client verursacht andere Kosten als ein Editor, und der Unterschied liegt in der Seite. Bei jeder Unterhaltung von Page Assist mit dem Tab wird der extrahierte Text dieses Tabs als Eingabetokens mitgesendet. Eine Dokumentationsseite oder ein langer Thread kann Zehntausende davon enthalten; bei jeder Folgefrage derselben Unterhaltung wird der Text erneut gesendet. Deshalb stehen in der obigen Modelltabelle zunächst die günstigen IDs: Bei diesem Client überwiegen die Eingabetokens meist die Ausgabetokens um eine Größenordnung. claude-haiku-4-5 oder gpt-5-6-terra können eine ganze Seite verarbeiten und sind damit besser als ein leistungsstärkeres Modell, das nur einen gekürzten Text erhält.
Drei Einstellungen verursachen zusätzlichen Datenverkehr, den Sie nicht ausdrücklich angefordert haben. Alle drei sind auf der Seite „Settings“ des Anbieters aufgeführt:
- Generate Title using AI – „Automatically generates a chat title from the conversation“. Ein zusätzlicher Aufruf pro Unterhaltung mit dem jeweils ausgewählten Modell.
- Internet Search, wobei Internet Search ON by default und Total Search Results eingestellt sind. Abgerufene Seiten werden in den Prompt aufgenommen, sodass die Tokenkosten mit der Anzahl der Suchergebnisse steigen.
- Page Action, die zugehörige Erweiterung – das Modell „starts by reading the page, then performs the actions one step at a time“. Pro Schritt wird also das DOM gelesen, nicht pro Unterhaltung. Die Einstellung Require approval before each action ist standardmäßig aktiviert und sollte eingeschaltet bleiben.
Die Datenschutzgrenze verläuft an derselben Stelle. Page Assist speichert Chats, Knowledge Base und Einstellungen lokal im Browserspeicher. Über das Netzwerk werden die von Ihnen gesendeten Daten übertragen. Sobald dieser Anbieter ausgewählt ist, gehen also der Seitentext, Ihre Nachricht und der bisherige Gesprächsverlauf an api.kunavo.com und von dort an den jeweiligen Upstream-Anbieter, der die Modell-ID bereitstellt. Informationen dazu, welche Daten auf dieser Seite gespeichert werden, finden Sie in der Datenschutzerklärung. Wenn Sie einen Text nicht in ein Chatfenster einfügen würden, wechseln Sie für die betreffende Seite zurück zu einem lokalen Ollama. Die Erweiterung speichert beide Anbieter gleichzeitig, sodass Sie mit einem Wechsel im Dropdown-Menü umschalten können.
Wenn Sie über die OpenRouter-Voreinstellung hierher gelangt sind
Für OpenRouter benötigen Sie den Zweig Custom nicht. OpenRouter ist eine der Voreinstellungen auf der Seite OpenAI Compatible API des Anbieters – neben Ollama, LM Studio, Groq, Together, Mistral, xAI und etwa zwanzig weiteren. Führen Sie dieselben ersten vier Schritte aus und wählen Sie dann im Dropdown-Menü OpenRouter statt Custom, geben Sie den Schlüssel unter API Key ein und klicken Sie auf Save. Die Voreinstellung enthält ihre eigene Base-URL. OpenRouter-Modell-IDs haben ein Anbieterpräfix in der Form anthropic/claude-sonnet-4.5, während die IDs in der obigen Tabelle ohne Präfix angegeben sind. Mit der Wahl des Anbieters legen Sie fest, welchen Namensraum für IDs Sie verwenden.
Ein Wechsel lohnt sich bei diesem Client insbesondere, wenn Sie über eine Oberfläche auch auf Modelle zugreifen möchten, die Kunavo nicht anbietet, oder wenn Sie bereits einen Schlüssel eingerichtet haben und der zusätzliche Einrichtungsaufwand entfällt. Ein Wechsel zu Kunavo lohnt sich, wenn Sie dieselben IDs auch in Ihren Programmierwerkzeugen verwenden: Ein Schlüssel deckt dann beides ab. Außerdem sind Prompt-Caching und erneut gesendeter Seitenkontext entscheidend für die Kosten einer Seitenleiste – siehe Caching. Sie können beide Anbieter behalten: Page Assist führt sie gemeinsam auf, und die Modellauswahl hängt nicht davon ab, aus welcher Zeile ein Modell stammt.
Häufig gestellte Fragen
Wie verwende ich eine benutzerdefinierte API mit Page Assist?
Klicken Sie auf das Page-Assist-Symbol in der Browser-Symbolleiste, öffnen Sie Settings, wechseln Sie zum Tab OpenAI Compatible API und klicken Sie auf Add Provider. Wenn Ihr Endpunkt keine der Voreinstellungen im Dropdown-Menü ist, wählen Sie Custom und füllen Sie Provider Name, Base URL und API Key aus. Klicken Sie anschließend auf Save. Page Assist öffnet dann eine Model List, die vom Endpunkt abgerufen wurde. Aktivieren Sie darin die Chatmodelle, die Sie mit diesem Anbieter verwenden möchten. Wenn beim Abruf keine Modelle gefunden werden, können Sie IDs auch manuell über Add Custom Model eingeben.
Muss die Base-URL von Page Assist /v1 enthalten?
Ja, bei einem OpenAI-kompatiblen Endpunkt. Auf der Seite OpenAI Compatible API steht es zwar nicht ausdrücklich, aber im Hilfetext des Felds Base URL schon: „The base URL of the OpenAI API provider. eg (http://localhost:1234/v1)“. Auch auf den Seiten zu LM Studio und LLaMA.cpp ist für dasselbe Feld dasselbe Suffix angegeben: http://localhost:1234/v1 und http://localhost:8080/v1. Für Kunavo lautet die URL daher https://api.kunavo.com/v1. Page Assist fügt nur den Pfad an. Wenn das Suffix fehlt, erhalten Sie 404 statt eines Authentifizierungsfehlers.
Warum zeigt Page Assist nach dem Hinzufügen eines Anbieters keine Modelle an?
Die Liste wird anhand des Endpunkts mit dem gerade eingegebenen Schlüssel abgerufen. Die Meldung der Erweiterung selbst gibt an, was zu prüfen ist: „No model found. Make sure you have added correct provider with base URL and API key.“ Testen Sie dieselbe Kombination außerhalb der Erweiterung mit einem curl-Aufruf an /v1/models. Eine JSON-Antwort bedeutet, dass das Problem beim Anbietereintrag liegt; 401 weist auf den Schlüssel hin; 404 deutet meist darauf hin, dass /v1 in der Base-URL fehlt. Falls das nicht hilft, können Sie IDs manuell über Add Custom Model hinzufügen. Diese Funktion hängt nicht vom Abruf ab.
Kann Page Assist Claude oder GPT statt eines lokalen Modells verwenden?
Ja. „OpenAI Compatible API“ bezeichnet das Wire-Format, nicht den Anbieter. Die Modell-ID wird an die konfigurierte Base-URL weitergegeben. Daher wird eine Claude- oder GPT-ID an diesem Endpunkt aufgelöst, nicht innerhalb der Erweiterung. Die Funktionen für lokale Modelle bleiben davon unberührt: Page Assist kann mehrere Anbieter gleichzeitig speichern, sodass ein Ollama-Eintrag neben einem gehosteten Anbieter stehen kann. Zwischen ihnen wechseln Sie über die Modellauswahl.
Welches Modell ist für Page Assist am günstigsten?
Bei diesem Client überwiegt die Eingabeseite, da bei der Unterhaltung mit einem Tab der extrahierte Text dieses Tabs bei jeder Gesprächsrunde erneut gesendet wird. Als Standardeinstellung eignet sich daher ein günstiges Modell mit großem Kontextfenster – claude-haiku-4-5 für gewöhnliche Seiten, gpt-5-6-terra für lange Seiten. Aktivieren Sie zusätzlich eine leistungsstärkere ID wie claude-sonnet-5 für Fragen, bei denen es auf die Antwort ankommt. Die Preise pro Million Tokens sind in der Tabelle auf dieser Seite aufgeführt. Prompt-Caching beeinflusst die Kosten einer Seitenleiste stärker als die Modellwahl.
Kann die Knowledge Base von Page Assist Kunavo verwenden?
Nicht für die Indexierung. Die Knowledge Base ist eine RAG-Funktion. Laut Dokumentation des Anbieters muss in den RAG-Einstellungen ein Einbettungsmodell festgelegt werden; empfohlen wird nomic-embed-text. Kunavo stellt kein Einbettungsmodell bereit, daher benötigen Sie für diesen Platz einen anderen Anbieter. Üblicherweise wird dafür ein lokales Ollama verwendet, das parallel und ohne Konflikte mit diesem Anbieter laufen kann. Der Chatteil ist davon nicht betroffen: Sobald die Dokumente indexiert sind, kann jede Chat-ID dieses Anbieters Fragen dazu beantworten.
Hat Kunavo Page Assist getestet?
Nein. Am 21. September 2026 wurden die eigene Dokumentation zur OpenAI Compatible API von Page Assist und die englischen Texte in der Erweiterung geprüft. Die dort zitierten Angaben zu den Schritten unter Settings, den Feldbezeichnungen und ihrer Reihenfolge, dem Beispiel für die Base-URL und der Meldung bei leerer Liste stammen daraus. Kunavo hat die Erweiterung nicht installiert, keine Version festgelegt und keine Anfrage darüber gesendet. Es macht keine Aussagen dazu, ob Streaming, Seitentextextraktion oder der Abruf der Model List in einer bestimmten Version wie vorgesehen funktionieren. Den curl-Aufruf auf dieser Seite können Sie unabhängig überprüfen.