Bei den meisten Open-Source-Agent-Clients können Sie Ihre eigene API-Basis-URL festlegen, aber drei Dinge entscheiden darüber, ob das tatsächlich funktioniert: das vom Client verwendete Wire-Protokoll, die Position der Grenze für eigene Schlüssel und die Frage, ob das Projekt noch gepflegt wird. Dieses Verzeichnis listet 77 Agent-Clients — 64 aus den Bereichen Terminal-Coding-Agenten, Editoren, Desktop-Chat-Apps, Workflow-Builder und ständig aktive persönliche Agenten, zusätzlich 3 ohne dokumentierten Drittanbieter-Endpunkt und 10 eingestellte oder abgelöste — jeweils mit separat angegebenem Protokoll, Endpunktgrenze und Lebenszyklus, damit Sie „akzeptiert eine Base-URL“ von „erledigt, was Sie benötigen“ unterscheiden können.
Dies ist ein Navigationsindex, keine Rangliste. Kein Client hier hat in einem aufgezeichneten Test eine Anfrage über Kunavo erfolgreich abgeschlossen, nichts wird bewertet, und eingestellte Projekte erscheinen mit ihrem Status, statt stillschweigend entfernt zu werden. Die Client-Fakten wurden am 17. September 2026 erhoben. Am 18. September 2026 wurde jede Lebenszykluszelle in den Tabellen für archivierte Projekte und Projekte ohne Endpunkt erneut anhand der GitHub-API geprüft, ebenso die meisten als aktiv aufgeführten Zeilen; Protokoll- und Details zu eigenen Schlüsseln wurden für eine Teilmenge erneut gelesen, nicht für alle 77. Jede Zeile verlinkt auf die Seite, aus der sie erstellt wurde, sodass jede Zelle an der Quelle erneut geprüft werden kann. Am 1. Oktober 2026 wurde jeder Client mit einem öffentlichen Repository erneut über die GitHub-API geprüft und jeder Quellenlink erneut geöffnet: Seitdem war keiner archiviert worden, jede Quelle antwortete weiterhin, und die Daten in den Lebenszykluszellen sind die September-Messungen, wie aufgezeichnet, sofern eine Zelle nichts anderes angibt.
Die drei Achsen, die entscheiden, ob ein benutzerdefinierter Endpunkt funktioniert
Eine einzelne Spalte „unterstützt benutzerdefinierte API“ verschleiert die meisten tatsächlichen Fehlerquellen. Jede folgende Zeile trennt sie auf.
1. Wire-Protokoll
„OpenAI-kompatibel“ ist die häufigste Form, aber nicht die einzige, und die von Clients verwendeten Bezeichnungen entsprechen nicht immer dem, was sie senden.
| Protokoll | Was der Client sendet | Was das für einen Endpunkt bedeutet |
|---|---|---|
| OpenAI Chat Completions | POST an /v1/chat/completions | Die am breitesten unterstützte Form; die Standardannahme in den meisten hier aufgeführten Clients |
| OpenAI Responses | POST an /v1/responses | Ein anderer Endpunkt. Ein Gateway, das nur Chat Completions implementiert, wird darauf nicht antworten |
| Anthropic Messages | POST an /v1/messages | Eine vollständig andere Anfrage- und Antwortform, keine Änderung des Headers |
| Google Gemini oder Vertex nativ | models/*:generateContent | Gemini CLI akzeptiert eine Base-URL, spricht aber weiterhin dieses Protokoll; daher funktioniert dort keine OpenAI-kompatible URL |
| Nur nativ | Feste Anbieter-Endpunkte | Es gibt kein Base-URL-Feld; der Endpunkt ist fest einkompiliert |
Zwei Benennungsfallen sollte man sich merken, weil der Fehler wie ein defekter Endpunkt statt wie ein falsches Protokoll aussieht. In PicoClaw sendet provider: "anthropic" OpenAI-förmige Chat Completions und anthropic-messages die native Messages API, daher gibt ein Endpunkt, der nur /v1/messages bereitstellt, unter dem ersten Wert 404 zurück. In Factorys Droid bedeutet provider: openai die Responses API und generic-chat-completion-api ist der Wert für ein Chat-Completions-Gateway.
2. Grenze für eigene Schlüssel
| Grenze | Wie es aussieht | Beispiele in diesem Verzeichnis |
|---|---|---|
| Frei konfigurierbar | Dokumentiertes Base-URL-Feld, ohne beteiligtes Konto oder kostenpflichtigen Tarif | Die meisten Terminal-Agenten, die meisten selbst gehosteten Chat-Frontends |
| Oberflächenabhängig | Funktioniert auf einigen Oberflächen des Produkts, auf anderen nicht | Droid (nur CLI und Desktop), Qoder (IDE, nicht CLI), OpenHands (lokales Agent-Server-Backend, nicht Cloud), AutoGPT Platform (selbst gehosteter Chat-Agent, nicht die Block-Ebene) |
| Tarifabhängig | Erfordert einen kostenpflichtigen oder Early-Access-Tarif | Benutzerdefinierte Endpunkt-URLs von Amp, Warp für Organisationen mit mehr als zehn Mitarbeitenden, Smart Chat Pro |
| Protokollabhängig | Das Feld ist vorhanden, akzeptiert aber nur das Protokoll eines Anbieters | Gemini CLI, nanocode, NanoClaw in seiner Standard-Laufzeitumgebung |
| Keine dokumentiert | Kein Endpunktfeld — nur Anbieterschlüssel oder nicht einmal diese | Devon (Anbieterschlüssel, kein Endpunkt), Kiro CLI (weder noch) |
3. Lebenszyklus
Ein nicht archiviertes Repository ist ein schwacher Beleg. Continue ist schreibgeschützt, trägt aber kein Archivkennzeichen, daher weist eine Prüfung auf das Archivkennzeichen es als aktiv aus; auch das Repository von Aider ist nicht archiviert, hatte aber seit August 2025 keine Veröffentlichung, und das von Stakpak hat weder ein Archivkennzeichen noch einen Commit seit Juli 2026. Ein Push-Datum ist noch schwächer, weil es sich ändert, wenn irgendwo im Repository etwas gepusht wird, während der Standard-Branch unverändert bleibt — diese Lücke ist der Grund, warum Continue und Witsy frischer erscheinen, als sie sind. Die folgenden Lebenszykluszellen beruhen auf dem Commit-Protokoll des Standard-Branches, der Release-Liste und der eigenen Aussage des Projekts, nicht auf einem Push-Datum.
Warum eine Base-URL keine Kompatibilitätsgarantie ist
Dies sind die wiederkehrenden Gründe, warum sich ein korrekt konfigurierter Endpunkt weiterhin fehlerhaft verhält; alle stammen aus der eigenen Dokumentation der Clients:
- Pfadbehandlung. Cherry Studio erwartet die Provider-Wurzel und hängt den Versionspfad selbst an; wenn Sie eine vollständige Chat-Completions-URL einfügen, wird der Pfad verdoppelt. Jan benötigt den Versionspfad in der Base-URL. TypingMind erwartet den vollständigen Pfad
/v1/chat/completions. SillyTavern weist an, das Suffix nicht hinzuzufügen. Dify hängt die Version bei Nicht-LLM-Modelltypen selbst an. - Anforderungen an die Modellliste. Der Anmeldedatentest von n8n sendet
GET /modelsund bewertet die Antwort allein anhand des Statuscodes. Ohne Modellliste schlägt er daher fehl, kann aber bei einer falschen Base-URL bestehen, die dort irgendeine 200 zurückgibt. Die Überschreibung der Kontextlänge in pool wird nur angewendet, wenn das Modell in der Modellliste des Providers erscheint. Open WebUI umgeht eine fehlende Liste mit einem manuellen Feld für eine Allowlist. - Manuell deklarierte Modellmetadaten. Keines von Zed, Crush, Theia, OpenClaw, ChatWise oder Dyad ermittelt die Grenzen eines Modells über Ihren Endpunkt. Was das kostet, unterscheidet sich: Bei Zed, Crush und ChatWise geben Sie Kontextfenster, Ausgabelimits oder Preise pro Token ein; OpenClaw und Dyad behandeln diese Felder als optional und wenden Standardwerte an, wenn Sie sie leer lassen; der benutzerdefinierte Modelleitrag von Theia enthält überhaupt keine Limits oder Preise. Wenn ein Client Ausgaben anhand von von Ihnen eingegebenen Zahlen meldet, entspricht der Wert Ihren Eingaben, nicht dem abgerechneten Betrag.
- Funktionsumfang. Twinnys Autovervollständigung verwendet die veraltete Completions-Route, während der Chat Chat Completions verwendet. AnythingLLM konfiguriert Embeddings getrennt vom Chat. Jan kann Tool-, Vision- oder Audio-Unterstützung für einen benutzerdefinierten Provider nicht ableiten. Oh My Pi benötigt ein Flag für Endpunkte, die strikte Tool-Definitionen ablehnen.
Die fünf folgenden Tabellen können anhand derselben Fragen eingegrenzt werden: Protokoll, Grenze für eigene Schlüssel, ob für einen benutzerdefinierten Endpunkt ein kostenpflichtiger Tarif erforderlich ist, und Lebenszyklus. Jede Zeile bleibt auf der Seite; der Filter blendet Zeilen nur aus, während Sie ihn verwenden, und „Nicht angegeben“ bedeutet, dass die Quellen der Zeile die Frage nicht klären.
Terminal-Coding-Agenten
Eingestellte und abgelöste Terminal-Projekte — SWE-agent, Plandex, Mentat, die archivierte Go-OpenCode-CLI und iFlow CLI — befinden sich weiter unten im archivierten Abschnitt statt in dieser Tabelle. Kiro CLI und Devon stehen in der Tabelle ohne Endpunkt.
| Client | Lebenszyklus | Protokoll-/BYOK-Grenze | Am besten geeignet für | Schlüsselbegrenzung | Kunavo-Seite |
|---|---|---|---|---|---|
| Aider | Nicht archiviert, aber inaktiv: letzte Veröffentlichung 2025-08-09, letzter Commit im Standard-Branch 2026-05-22 | OpenAI Chat Completions über das Präfix openai/ des Modells und OPENAI_API_BASE. Frei konfigurierbar | Pair-Programming im Terminal auf einem vorhandenen Git-Repository, mit angewendeten Änderungen und automatischen Commits | Seit über 13 Monaten keine Veröffentlichung, daher können Metadaten für neuere Modelle veraltet sein und müssen möglicherweise manuell angegeben werden | Preise, Einrichtung |
| goose | Aktiv, aber verlagert: von Block an die Agentic AI Foundation gespendet, Repository nach aaif-goose/goose und Dokumentation nach goose-docs.ai verschoben, angekündigt am 2026-04-07 | OpenAI Chat Completions (OPENAI_HOST plus OPENAI_BASE_PATH) und Anthropic Messages (ANTHROPIC_HOST). Frei konfigurierbar | Ein vielseitiger lokaler Agent über das Programmieren hinaus – Desktop-App, CLI und einbettbare API, erweitert über MCP | Die Basis-URL ist auf zwei Variablen aufgeteilt, daher muss ein Endpunkt, dessen Basis ein Versionspfad ist, diesen Pfad ausdrücklich setzen | vs. Claude Code, Einrichtung |
| Crush | Aktiv; am 2026-09-18 veröffentlicht, am selben Tag überprüft | Unterschiedliche Typen: openai, openai-compat für nicht mit OpenAI kompatible APIs und anthropic. Frei über crushrc oder crush.json konfigurierbar | Ein ausgereifter Terminal-Agent, bei dem Kontextfenster und Preise pro Modell lokal angegeben werden, sodass die Kosten innerhalb der Sitzung sichtbar sind | Nichts wird entdeckt – Kontextfenster, maximale Tokenzahl und Preise werden manuell eingetragen. Beide Konfigurationsdateien sind vertrauenswürdiger Code: crushrc wird in einer Shell ausgeführt, und die Befehlsersetzung in crush.json wird beim Laden ausgeführt | Preise, Einrichtung, vs. OpenCode |
| Pi | Aktiv; earendil-works/pi wurde am 2026-09-18 veröffentlicht. Der ältere Pfad badlogic/pi-mono leitet hierher weiter | openai-completions, openai-responses, anthropic-messages, google-generative-ai in ~/.pi/agent/models.json – die vier api-Werte, die Pi bis zur Dokumentationsaktualisierung vom 22. September 2026 für einen benutzerdefinierten Anbieter dokumentierte und deren Liste anschließend entfernt wurde. Der Quellcode in v0.99.2 typisiert das Feld als freien String und leitet es an diejenige von zehn integrierten Implementierungen weiter, die übereinstimmt; nur die vier wurden jemals für einen benutzerdefinierten Anbieter dokumentiert, und keine der anderen sechs wurde hier getestet. Frei konfigurierbar | Aufbauend auf einem kleinen, leicht anpassbaren Agentenkern oder dessen Einbettung | Die README besagt, dass neue Issues und Pull Requests von neuen Beitragenden standardmäßig automatisch geschlossen werden, und dass man ein Harness-Monorepo übernimmt statt nur eine CLI | Preise, vs. OpenCode, Einrichtung |
| Oh My Pi | Aktiver Pi-Fork; am 2026-09-18 veröffentlicht | Neun Chat-Drahtprotokolle in models.yml: openai-completions, openai-responses, openai-codex-responses, azure-openai-responses, anthropic-messages, bedrock-converse-stream und drei Google-Varianten (google-generative-ai, google-gemini-cli, google-vertex). Dieselbe Liste enthält außerdem zwei Bewertungs-APIs, typesafe und openrouter-decisions, die Bewertungsanfragen statt Chats beantworten; das Schema in v18.4.8 akzeptiert genau diese elf. Frei über models.yml konfigurierbar | Die am umfassendsten dokumentierten Chat-Protokolle aller Terminal-Agenten in dieser Tabelle, mit integrierten LSP- und DAP-Werkzeugen | Anthropic-kompatible Endpunkte, die das strikte Feld in Tool-Definitionen ablehnen, benötigen disableStrictTools; die Erkennung erzwingt einen /v1/models-Pfad, sofern sie nicht ausdrücklich deaktiviert wird | Preise, Einrichtung, vs. Pi |
| pool | Aktiv, aber klein: am 2026-08-18 veröffentlicht, 425 Sterne, kommerziell von Poolside unterstützt | Nur über die benutzerdefinierte Route mit OpenAI kompatibel (POOLSIDE_STANDALONE_BASE_URL); unterstützt separat ACP. Ausschließlich über Umgebungsvariable, keine Einschränkung | Ein ACP-nativer Terminal-Agent, der auch als Server für einen kompatiblen Editor ausgeführt werden kann | Der Endpunkt muss GET /v1/models bereitstellen und das ausgewählte Modell auflisten, sonst wird die Überschreibung der Kontextlänge stillschweigend nicht mehr angewendet | — |
| DeepSeek Harness | Aktiv, selbst als Entwickler-Vorschau bezeichnet; am 2026-09-17 veröffentlicht | openai-completions, openai-responses oder anthropic-messages, ein Protokoll pro Anbieter, gespeichert in 0.2.0-rc.2 in cordis.patch.yml des Profils. Frei konfigurierbar | DeepSeeks Plugin-Architektur-Harness als lokale Weboberfläche ausprobieren, die auf einen beliebigen Endpunkt zeigt | Die Maintainer kündigen inkompatible Änderungen an, und in 0.2.0-rc.2 kann die Models-Seite noch keinen Anbieter hinzufügen, der sich per OAuth anmeldet, etwa Codex | Einrichtung |
| Droid (Factory) | Aktives kommerzielles Produkt, Closed Source; Dokumentation und Preisseite waren am 2026-09-18 erreichbar. factory.ai leitet zu factory.com weiter | anthropic ist Messages, openai ist Responses, generic-chat-completion-api ist Chat Completions. Oberflächenabhängig: nur CLI und Desktop-App | Einen kommerziell unterstützten Agenten beibehalten und gleichzeitig die Inferenz auf lokalen Oberflächen an den eigenen Endpunkt verlagern | Benutzerdefinierte Modelle erscheinen nie in den gehosteten Web- oder Mobil-Apps. Auf der BYOK-Seite wird keine Tarifbeschränkung genannt, und die Preisseite führt die Funktion nicht auf – das ist das Fehlen einer dokumentierten Einschränkung, kein Beweis, dass es keine gibt | Preise, Einrichtung |
| Qwen Code | Aktiv; am 2026-09-18 veröffentlicht | OpenAI Chat Completions, Anthropic Messages, Google GenAI und Vertex, jeweils mit eigener Basis-URL-Variable, plus einer ausdrücklichen Option „Custom Provider“. Frei konfigurierbar | Protokoll und Anbieter zur Laufzeit aus einem einzigen Terminal-Client heraus wechseln | Das kostenlose Qwen-OAuth-Kontingent wurde am 2026-04-15 eingestellt und aus dem Authentifizierungsdialog entfernt; daher ist jede Anleitung, die weiterhin ein kostenloses tägliches Kontingent verspricht, veraltet | Preise, Einrichtung |
| Kimi Code CLI | Aktiv; MoonshotAI/kimi-code wurde am 2026-09-18 veröffentlicht. Das ältere Kimi-CLI-Repository besagt, dass es sich zu diesem entwickelt und schrittweise eingestellt wird | OpenAI Chat Completions und Responses, Anthropic Messages, Google GenAI, Vertex – Anbieterblöcke in config.toml. Frei konfigurierbar | Eine verwaltete Moonshot-Anmeldung als einen Anbieter beibehalten und daneben einen Drittanbieter-Endpunkt hinzufügen | Anmeldedaten werden nie aus einer impliziten Shell-Variable gelesen: Der Variablenname muss in der Konfiguration deklariert werden, sonst schlägt der Start fehl | vs. Claude Code, Einrichtung |
| OpenHands | Aktiv, aber umstrukturiert: Die Organisation wurde von All-Hands-AI umbenannt, das Haupt-Repository liefert nun Agent Canvas (1.20.0, 2026-09-17), während der Agent in einem separaten SDK-Repository liegt. Der CLI-Modus ist weiterhin dokumentiert | LiteLLM, daher ist ein Anbieterpräfix obligatorisch. Backendabhängig: Anbieter-Verbindungen sind auf lokalen agent-server-Backends verfügbar und auf einem Cloud-Backend verborgen | Autonome, isolierte Arbeit in mehreren Schritten – Aufgaben von Issue bis Pull Request und geplante Automatisierungen – auf dem eigenen Rechner oder Server | Beim Proxy-Pfad muss der Modellname bereits auf diesem Proxy konfiguriert sein. Ob das Cloud-Backend einen direkten Schlüssel in einem Anbieterprofil zulässt, ist ebenfalls nicht dokumentiert | vs. OpenCode, Einrichtung |
| mini-SWE-agent | Aktiv; am 2026-09-14 veröffentlicht, derzeit auf v2, während v1 in einem Branch beibehalten wird | LiteLLM; ein benutzerdefinierter Endpunkt wird über model_kwargs mit einem OpenAI-kompatiblen Anbieter und einer api_base eingebunden. Frei konfigurierbar | Günstige, skriptfähige Batch- und Benchmark-Läufe mit einer Kernschleife, die kurz genug ist, um sie vor dem Vertrauen darauf zu lesen | Ein Modell außerhalb der LiteLLM-Registry unterbricht die Kostenverfolgung, und v2 hat die Konfigurationsstruktur geändert, sodass Anweisungen aus der v1-Ära nicht übernommen werden können | Preise, Einrichtung, vs. Claude Code |
| Nanocoder | Aktiv; am 2026-09-18 veröffentlicht. Wird von einem Community-Kollektiv statt von einem Unternehmen betrieben | OpenAI-kompatibel, außerdem Ollama und Voreinstellungen pro Anbieter. Ein Anbietereintrag in agents.config.json oder im Einstellungsassistenten. Frei konfigurierbar | Terminal-Programmierung mit lokalem Fokus, bei der eine Remote-API eine Option unter lokalen Modellen ist und nicht als Standard vorausgesetzt wird | Einstellungen werden Block für Block aufgelöst, sodass eine Projektüberschreibung mit einem einzigen Feld den Rest dieses Blocks verwirft und stattdessen auf integrierte Standardwerte zurückfällt, nicht auf die globale Konfiguration | Modelle und API-Kosten, Einrichtung, vs. OpenCode |
| Mistral Vibe | Aktiv; am 2026-09-18 veröffentlicht. Ein offizielles Mistral-Projekt | Standardmäßig OpenAI-kompatibel; Anbieterblöcke in config.toml enthalten api_base und den Namen der Schlüsselvariablen. Frei konfigurierbar | Eine kleine, überprüfbare Python-CLI eines Modellanbieters mit einem eigenen Endpunkt darunter | Die Anbieterreferenz befindet sich in der im Repository enthaltenen Konfigurationsreferenz statt in der README, sodass sich Schlüsselnamen zwischen Veröffentlichungen ändern können – in allen Einrichtungsanweisungen eine Version festlegen | Einrichtung, vs. Claude Code, Alternativen |
| Gemini CLI | Aktiv; am 2026-09-18 veröffentlicht | Nur natives Gemini. Die Überschreibung der Basis-URL gilt für die API-Schlüssel-Authentifizierung, muss HTTPS verwenden, sofern sie nicht auf localhost zeigt, und ein OpenAI-kompatibler Modus ist nicht dokumentiert | Gemini-orientierte Terminal-Arbeit – und das deutlichste Beispiel dafür, warum Protokoll und Endpunkt getrennte Fragen sind | Die Überschreibung ist nur für den API-Schlüssel-Pfad dokumentiert; verlassen Sie sich daher nicht darauf, dass sie die OAuth-Anmeldung über ein Google-Konto erreicht. Eine OpenAI-kompatible URL funktioniert nicht, sofern der Endpunkt nicht ebenfalls das Gemini-Drahtprotokoll bereitstellt | vs. Claude Code |
| GitHub Copilot CLI | Aktiv; Veröffentlichung v1.0.86 am 2026-09-17. Nicht die archivierte Erweiterung gh copilot, die sich in einem separaten Repository befindet und deren letzter Push am 2025-10-30 erfolgte | OpenAI Chat Completions, Azure OpenAI oder Anthropic, ausgewählt durch eine Anbieter-Typ-Variable neben einer Basis-URL-Variable. Keine Tarifbeschränkung für Einzelpersonen; BYOK für Organisationen und Unternehmen wurde nicht geprüft | Den Coding-Agenten von GitHub gegen den eigenen Endpunkt ausführen, ohne Copilot-Sitzplatz und ohne GitHub-Anmeldung | BYOK ermöglicht der CLI die Ausführung ohne GitHub-Authentifizierung, und die Authentifizierungsseite führt auf, was ohne sie nicht funktioniert: /delegate, der GitHub-MCP-Server und GitHub Code Search. Modellaufrufe funktionieren weiterhin; man kann sich anmelden und zusätzlich einen Schlüssel mitbringen, um beides zu behalten | vs. Claude Code, Einrichtung |
| gptme | Aktiv; vom persönlichen Namespace in die gptme-Organisation verschoben, alte Pfade leiten weiter; am 2026-09-18 veröffentlicht | Nur für benutzerdefinierte Endpunkte OpenAI-kompatibel, über ein lokales Modellpräfix mit einer Basis-URL-Variable oder einen benannten Anbieter-Eintrag. Frei konfigurierbar | Ein allgemeiner Terminal-Agent mit Shell- und Browser-Werkzeugen, der durch Setzen einer Umgebungsvariable umgeleitet wird | Für einen Endpunkt, der ausschließlich Anthropic Messages unterstützt, gibt es keinen dokumentierten Anschluss; jedes andere Protokoll erfordert ein Plugin, das gegen den Anbieter-Einstiegspunkt geschrieben wird | — |
| Open Interpreter | Aktiv, aber in ein anderes Programm umgeschrieben: nun eine auf Codex basierende Rust-Implementierung, Veröffentlichungen mit dem Tag rust-v0.0.44 am 2026-09-15, und der Repository-Pfad selbst wurde nach openinterpreter/openinterpreter verschoben | Eine TOML-Anbietertabelle, in der wire_api responses oder chat akzeptiert. Frei konfigurierbar | Ein bewusst auf günstige offene Modelle abgestimmtes Codex-ähnliches Harness, konfiguriert über eine Anbietertabelle | Der Name bedeutet nicht mehr das, was die meisten Darstellungen damit meinen – alte Python-Konfigurationsdateien, Flags und Tutorials gelten nicht. Das dokumentierte Beispiel verwendet das Responses-Drahtprotokoll, daher muss ein ausschließlich Chat Completions unterstützender Endpunkt ausdrücklich angegeben werden | Einrichtung, vs. Claude Code, Alternativen |
| Amp | Kommerziell aktiv; ein Sourcegraph-Agent mit einer auf 2026-09-13 datierten Richtlinienankündigung. Die Tarife sind Hobby (kostenlos), Individual/Megawatt, Gigawatt, Teams und Enterprise | Beliebige benutzerdefinierte Endpunkt-URLs sind für Megawatt- und Gigawatt-Mitglieder als Early Access verfügbar und hinter einem experimentellen Feature-Schalter verborgen; die Ankündigung verspricht lediglich, dass dies bald für alle ausgerollt wird, ohne Datum. Einfaches Bring-your-own-key ist davon getrennt und weiter gefasst – dieselbe Ankündigung besagt, dass es für niemanden außer dem Enterprise-Tarif BYOK-Tokengebühren oder -limits gibt und dass jeder Amp mit eigenen Schlüsseln ohne monatliche Gebühr verwenden kann | Teams, die einen kommerziellen Agenten mit leistungsfähiger Codesuche möchten, während die Tokenkosten auf dem eigenen Anbieter-Konto verbleiben | Keine beliebige Basis-URL voraussetzen: Am 2026-09-18 war diese konkrete Funktion nur als Early Access verfügbar | Preise, Einrichtung, vs. Claude Code |
| nanocode | Veröffentlicht, aber kaum gepflegt: erstellt am 2026-04-01, letzter Push am 2026-04-02, 20 Sterne | Nur Anthropic Messages, trotz der Tabelle in der README. Die Basis-URL wird über eine Umgebungsvariable oder einen Konfigurationsbefehl gesetzt. Frei konfigurierbar | Lesen statt Ausführen – eine kurze Python-Codebasis, die zeigt, wie eine Agentenschleife nach dem Vorbild von Claude Code zusammengesetzt wird | Die beworbene OpenAI-Kompatibilität existiert im Code nicht: Der Client kapselt das Anthropic-SDK, daher funktioniert ein einfacher Chat-Completions-Endpunkt nicht | — |
| QodeX | Aktiv, aber sehr klein: erstellt am 2026-06-11, letzter Push am 2026-08-22, 32 Sterne. Nicht mit OpenAIs Codex verbunden | Ein openai-Typ, der eine beliebige Basis-URL akzeptiert, ein ollama-Typ und ein anthropic-Typ mit standardmäßig aktiviertem Prompt-Caching. Die Konfiguration enthält den Namen der Schlüsselvariablen, nicht den Schlüssel. Frei konfigurierbar | Arbeit mit lokalem Fokus, bei der eine Konfiguration sowohl einen lokalen Server als auch einen Cloud-Endpunkt enthält, die pro Lauf über ein Profil umgeschaltet werden | Skalierung mit nur einem Maintainer, ohne Community, die eine inkompatible Änderung am Upstream auffangen könnte, und nichts davon wird zur Laufzeit von irgendjemandem verifiziert | — |
| GoCode | Aktiv, aber minimal: erstellt am 2026-07-25, letzter Commit im Standard-Branch am 2026-09-17, 5 Sterne | Über neun benannte Gateways hinweg überwiegend OpenAI-ähnlich, mit Anthropic als einzigem nativen Eintrag; base_url pro Anbieter in config.toml. Frei konfigurierbar | Eine einzelne kleine Go-Binärdatei mit Anbieterwechsel innerhalb der Sitzung und ohne Node- oder Python-Laufzeit auf dem Rechner | Die mitgelieferten Standardmodell-IDs sind bereits veraltet, daher müssen Sie sie manuell festlegen – und der Name kollidiert mit dem seit Langem etablierten Go-Daemon für Autovervollständigung | — |
| Jan Agent | Vorschau: Die Dokumentation besagt, dass das Installationsprogramm aus einem Nightly-Kanal lädt. Das übergeordnete Repository ist aktiv, letzter Commit am 2026-09-18 | Standardmäßig OpenAI-kompatibel, Anthropic Messages über ein api-type-Flag. Flags, eine Konfigurationsdatei oder eine Umgebungsvariable. Frei konfigurierbar | Ein Terminal-Agent, der durch Ändern eines Flags auf einen OpenAI- oder Anthropic-ähnlichen Endpunkt ausgerichtet werden kann | Vorschau-Software aus einem Nightly-Kanal, daher können sich Flags und Verhalten zwischen Builds ändern und jede festgehaltene Einrichtung ist versionsspezifisch | Einrichtung |
| Junie CLI | Aktiv; die Dokumentationsseite für benutzerdefinierte JetBrains-Modelle trug am 18. September 2026, dem Tag der Überprüfung, diesen Zeitstempel | Ein JSON-Modellprofil mit einer Basis-URL, einem Schlüssel (Interpolation von Umgebungsvariablen wird unterstützt) und einem apiType, der das Format OpenAI Completions, Anthropic oder Gemini auswählt. Die BYOK-Seite besagt, dass kein JetBrains-AI-Abonnement erforderlich ist | JetBrains-Nutzer, die den Junie-Agenten in einem Terminal verwenden und über ihren eigenen Anbieter abrechnen möchten | Die Dokumentation beschreibt ausdrücklich die CLI und bestätigt nicht, dass dieselben Profile für das IDE-Plugin gelten; außerdem wird betont, dass das Modell leistungsfähig genug für agentische Tool-Nutzung sein muss | Preise, Einrichtung, vs. Claude Code |
| Docker Agent | Aktiv, von cagent umbenannt; der alte Repository-Pfad führt zum neuen, und Präfixe älterer Umgebungsvariablen funktionieren weiterhin | OpenAI Chat Completions über einen ausdrücklichen api_type mit Basis-URL und dem Namen der Schlüsselvariablen, plus native anthropic-, google- und bedrock-Anbietertypen. Frei konfigurierbar | Deklarative Multi-Agent-Teams, die in YAML geschrieben und als OCI-Artefakte ausgeliefert werden | Verwirrung bei Benennung und Abrechnung: Älteres cagent-Material, die aktuellen Docker-Agent-Dokumente und die eigenen KI-Abonnementseiten von Docker beschreiben unterschiedliche Dinge | — |
| fast-agent | Aktiv; Repository nicht archiviert, zum Zeitpunkt der Überprüfung mit offenen Issues und Pull Requests | Ein generischer OpenAI-kompatibler Anbieter, der base_url und api_key in YAML oder ein Basis-URL-Flag für einen einzelnen Lauf akzeptiert. Native Anthropic-, OpenAI-, Google-, Azure- und DeepSeek-Pfade existieren separat. Frei konfigurierbar | Aufbau von MCP-nativen Agenten und Workflow-Mustern in Python, gesteuert über eine interaktive CLI | Ein Framework statt eines Produkts – kein gehosteter Dienst und kein kommerzieller Support – und die dokumentierten generischen Beispiele sind lokale Endpunkte; ein Remote-Endpunkt ist daher spezifikationsgemäß, aber nicht die veranschaulichte Form | — |
| Stakpak | Inaktiv, nicht archiviert: Apache-2.0, aber der neueste Commit im Standard-Branch ist vom 2026-07-06 und die neueste Veröffentlichung v0.3.88 vom 2026-06-10 – zum Zeitpunkt der Überprüfung seit über zwei Monaten ohne Aktivität | OpenAI-kompatibel über einen api_endpoint-Schlüssel; native Anthropic- und OpenAI-Schlüssel werden ebenfalls akzeptiert. Ein Stakpak-Konto ist eine Option, keine Voraussetzung | DevOps- und Infrastrukturarbeit – Kubernetes-Fehlerbehebung, CI/CD und Infrastructure as Code – mit Schutzvorkehrungen gegen destruktive Befehle | Beide funktionierenden Beispiele in der README verweisen mit api_endpoint auf einen lokalen Server, daher ist der Remote-Fall spezifikationsgemäß, aber nicht die veranschaulichte Form. In Verbindung mit der oben genannten Commit-Lücke sollte man es vor der Einführung als zu prüfendes Projekt betrachten, nicht als eines in aktiver Entwicklung | — |
| VT Code | Aktiv, aber ausdrücklich experimentell und von einer Einzelperson gepflegt; die README besagt, dass sich lokale Inferenz und einige Automatisierungsabläufe zwischen Veröffentlichungen ändern können | Ein Array benutzerdefinierter OpenAI-kompatibler Anbieter in vtcode.toml mit base_url und dem Namen der Schlüsselvariablen sowie einer optionalen Anbieterliste. Frei konfigurierbar | Eine einzelne statische Rust-Binärdatei für Nutzer, die eine große Anbieterauswahl plus eine überprüfbare Liste zulässiger Anbieter wünschen | Pflege in der Freizeit durch eine Einzelperson mit selbst als experimentell bezeichneten Oberflächen, sodass die Konfigurationsstabilität zwischen Veröffentlichungen ein reales Risiko ist | vs. OpenCode |
| CodeBuddy Code | Aktiv; ein Tencent-Cloud-Produkt, dessen CLI-Dokumentation auf v2.153.0 verweist | OpenAI-kompatibel über ein Paar aus Basis-URL und Schlüsselvariable, präsentiert für Modelldienste von Drittanbietern. Trotz der vertrauten Benutzeroberfläche findet sich in der Dokumentation kein Anspruch auf Anthropic-Format. Keine Tarifbeschränkung für den Drittanbieterpfad | Ein Terminal-Workflow nach dem Vorbild von Claude Code mit isolierter Ausführung, benutzerdefinierten Sub-Agenten und Hooks | Mehrere voneinander unabhängige Produkte tragen den Namen CodeBuddy, und der eigene Regionsschalter des Anbieters funktioniert nicht mehr, sobald die CLI auf eine Basis-URL eines Drittanbieters zeigt | — |
| Warp | Aktiv; die überprüften Dokumentationsseiten tragen als Datum der letzten Aktualisierung den 16. September 2026 | OpenAI Chat Completions für den benutzerdefinierten Inferenzendpunkt, pro Benutzer in Free- und berechtigten kostenpflichtigen Tarifen konfiguriert. Organisationen mit mehr als zehn Mitarbeitenden benötigen Business oder Enterprise. Eine separate, nur für Enterprise verfügbare Funktion deckt native Pfade von Cloud-Anbietern ab | Eine agentische Terminal-Oberfläche, die gegen den eigenen Endpunkt statt gegen ein gebündeltes Modellkontingent ausgeführt wird | Zwei Einschränkungen greifen zusammen: die Regel zur Organisationsgröße und die zwingende Voraussetzung, dass der Endpunkt öffentlich erreichbar ist – localhost, private Netzwerkadressen und ausschließlich interne Proxys werden unmittelbar abgelehnt | vs. Claude Code |
Editoren und IDE-Forks
Continue, Void und PearAI befinden sich im archivierten und abgelösten Abschnitt, nicht hier.
| Client | Lebenszyklus | Protokoll-/BYOK-Grenze | Am besten geeignet für | Schlüsselbegrenzung | Kunavo-Seite |
|---|---|---|---|---|---|
| Zed | Aktiv; am 2026-09-18 veröffentlicht | Zwei unabhängige Einstellungsstrukturen, OpenAI-kompatibel und Anthropic-kompatibel, jeweils mit eigener api_url. Die Preisseite bietet im kostenlosen Personal-Tarif unbegrenzte Nutzung mit eigenen API-Schlüsseln, daher ist BYOK nicht kostenpflichtig. Edit prediction verfügt über eine eigene Struktur und kann ebenfalls einen OpenAI-kompatiblen Anbieter verwenden | Ein schneller nativer Editor, bei dem ein Schlüssel das Agenten-Panel, die Inline-Unterstützung und die Bearbeitungsvorhersage steuern kann | Keine Modellerkennung: Jedes Modell wird mit eigenen Tokenlimits manuell angegeben, und ein Tippfehler führt zu einem fehlenden Modell statt zu einem Fehler. Zed als Modellanbieter und das Standardmodell für die Bearbeitungsvorhersage erfordern weiterhin eine Zed-Anmeldung | vs. Cursor, Einrichtung |
| Theia IDE | Aktiv; gepusht am 2026-09-18, mit einem am selben Tag markierten Nightly-Build | OpenAI-kompatibel. Ein Präferenz-Array benutzerdefinierter Modellobjekte mit model, url, id und key. Keine Plan- oder Kontobeschränkung, aber die KI-Funktionen sind hinter einem lokalen Schalter deaktiviert | Eine herstellerneutrale Desktop-IDE der Eclipse Foundation, in der jeder Modellendpunkt explizit in den Einstellungen deklariert wird | Keine Modellerkennung; eine falsche url oder id schlägt unbemerkt fehl. Verwechseln Sie die herunterladbare Theia IDE nicht mit der Theia-Plattform, die andere Produkte einbetten — die obige Konfiguration gehört zur IDE | Einrichtung |
| Twinny | Aktiv; gepusht am 2026-09-18, MIT | OpenAI-kompatibel, über zwei verschiedene Routen: Der Chat hängt chat-completions an den konfigurierten Pfad an, während die Autovervollständigung die Legacy-completions-Route verwendet. Anbieter werden einzeln über ein Formular mit einer Testschaltfläche hinzugefügt. Frei konfigurierbar | Kostenlose VS-Code-Autovervollständigung plus Chat, wobei Fill-in-the-Middle und Chat absichtlich auf unterschiedliche Modelle oder sogar unterschiedliche Endpunkte verwiesen werden | Chat-Kompatibilität bedeutet nicht automatisch, dass die Autovervollständigung funktioniert: Ein Endpunkt, der nur Chat-Completions bereitstellt, liefert funktionierenden Chat und toten Geistertext. Überprüfen Sie die Completions-Route und das Fill-in-the-Middle-Template separat | Einrichtung, vs. Continue |
| Qoder | Aktiv; eine agentische Coding-Plattform von Alibaba mit aktueller Dokumentation zu benutzerdefinierten Modellen | Oberflächenabhängig. Die IDE übernimmt eine Basis-URL und einen Schlüssel mit einer Auswahl für OpenAI-kompatibel (Chat-Completions oder Responses) oder Anthropic-kompatibel. Die CLI nicht: Auf der eigenen Seite zu benutzerdefinierten Modellen steht, dass BYOK nicht manuell in settings.json konfiguriert werden soll und dass verfügbare Anbieter, Modelle und Anmeldedatenfelder durch den BYOK-Katalog des Kontos festgelegt sind | Agentische IDE-Arbeit mit Repository-Kontext und eigenem Schlüssel statt eines enthaltenen Kontingents | IDE und CLI verwenden nicht dieselben BYOK-Regeln; daher ist eine produktweite Aussage „Qoder unterstützt benutzerdefinierte Endpunkte“ für die CLI falsch | Einrichtung, vs. Claude Code |
| Dyad | Aktiv; Release v1.15.0 am 2026-09-11 und ein Commit am 2026-09-18 | Nur OpenAI-kompatibel. Fügen Sie einen benutzerdefinierten Anbieter mit ID, Anzeigenamen und Basis-URL hinzu und anschließend jedes Modell mit einer exakten Modell-ID. Dyad-Pro-Credits sind eine Alternative, keine Voraussetzung | Lokale Desktop-App zum Erstellen, bei der der gesamte Build-Zyklus mit dem eigenen Schlüssel ausgeführt wird | Für benutzerdefinierte Modelle müssen Ausgabe-Token- und Kontextfensterlimits manuell eingetragen werden; bleiben sie leer, verwendet die App Standardwerte, die lange Builds unbemerkt begrenzen können | Preise, Einrichtung, vs. Lovable |
| bolt.diy | Inaktiv, nicht archiviert: letzter Commit 2026-02-07, 83 offene Issues, letzter Tag v1.0.0 am 2025-05-12 | OpenAI-kompatibel über einen OpenAI-ähnlichen Anbietereintrag oder ein Basis-URL-und-Schlüssel-Paar in einer lokalen Umgebungsdatei. Vollständig selbst gehostet, keine Beschränkung | Selbst gehostete browserbasierte Full-Stack-App-Erstellung, bei der jeder Schlüssel in der eigenen Umgebungsdatei bleibt | Seit 2026-02-07 hat niemand Code gepusht; neue Modell-IDs, Anbieterbesonderheiten und der offene Rückstand liegen daher bei Ihnen — eine heute funktionierende Einrichtung wird nicht gewartet | Modelle und API-Kosten, vs. Dyad und Bolt.new |
Desktop-Chat- und Wissensdatenbank-Clients
Witsy befindet sich im archivierten Abschnitt; Smart Chat steht in der Tabelle ohne Endpunkt, weil dafür keine beliebige Basis-URL eines Drittanbieters dokumentiert ist.
| Client | Lebenszyklus | Protokoll-/BYOK-Grenze | Am besten geeignet für | Schlüsselbegrenzung | Kunavo-Seite |
|---|---|---|---|---|---|
| Cherry Studio | Aktiv; gepusht am 2026-09-18. AGPL-3.0-Community-Edition mit einer separat verkauften Enterprise-Edition und einer Option für eine kommerzielle Lizenz | Standardmäßig OpenAI-kompatibel, wobei OpenAI Responses, Anthropic und Gemini pro Anbieter auswählbar sind. Geben Sie die Anbieterwurzel ein — die App hängt den Versionspfad selbst an, und ein abschließendes Hash-Zeichen fixiert die Adresse exakt. Frei konfigurierbar | Ein kostenloser Desktop-Arbeitsbereich für eine Person, die viele Anbieter, Assistenten, lokale Modelle und Dokumente verwaltet | Das API-Adressfeld ist eine Wurzel, kein Endpunkt: Auf der Einstellungsseite steht, dass Cherry Studio /v1/chat/completions selbst anhängt, sofern die Adresse nicht mit # endet; das Einfügen einer vollständigen Chat-Completions-URL verdoppelt daher den Pfad. Der Pull Request, der dies entfernt hätte (#19120), wurde am 2026-09-04 ohne Merge geschlossen | Einrichtung |
| Chatbox AI | Aktiv; Repository in chatboxai/chatbox umbenannt, wobei der alte Pfad weiterleitet, gepusht am 2026-09-16 | OpenAI-kompatible Chat-Completions für benutzerdefinierte Anbieter: Fügen Sie einen Anbieter mit API-Host, leerem API-Pfad und Schlüssel hinzu und rufen Sie anschließend die Modellliste ab. Keine Planbeschränkung | Eine funktionierende Desktop-, Mobil- und Web-Lösung für Nichtentwickler, die bereits einen Schlüssel besitzen, mit Abruf der Modellliste statt manuell eingegebener Modell-IDs | Zwei API-Oberflächen tragen denselben Namen und weisen in entgegengesetzte Richtungen: Das Produkt stellt außerdem einen OpenAI-kompatiblen Endpunkt in einem kostenpflichtigen, nach Rechenpunkten abgerechneten Plan bereit, der nicht BYOK ist | Einrichtung |
| Jan Desktop | Aktiv; gepusht am 2026-09-18, neuestes Release v0.8.4 am 2026-07-23. Der ältere Organisationspfad leitet hierher weiter | OpenAI-kompatibel oder Anthropic-kompatibel, pro Anbieter auswählbar. Die Basis-URL muss den vom Server erwarteten Versionspfad enthalten, und ein Schlüssel ist auch für nicht authentifizierte lokale Server erforderlich. Frei konfigurierbar | Für Personen, die lokal und offline mit einer integrierten Inferenz-Engine beginnen, aber möchten, dass dieselbe App einen kostenpflichtigen Cloud-Endpunkt erreicht | Benutzerdefinierte Anbieter werden nicht anhand ihrer Fähigkeiten erkannt — die App kann nicht ermitteln, ob ein Modell Tools, Vision oder Audio unterstützt; diese Funktionen müssen daher pro Modell aktiviert werden, sonst tun sie unbemerkt nichts | Modelle und API-Kosten, vs. LM Studio |
| Msty Studio | Aktiv kommerziell, Closed Source ohne öffentliches Repository; der neueste Eintrag im öffentlichen Changelog ist v2.9.6 vom 2026-07-24, während der von Msty am 2026-10-01 zum Download angebotene Build 2.9.11 war | OpenAI-kompatibel für benutzerdefinierte Anbieter — ein Typ „Open AI Compatible“ mit API Key und Inference Endpoint, die Bezeichnungen stammen aus dem Build 2.9.11 — und dieser Pfad ist nicht planbeschränkt. Azure- und Bedrock-Anbietertypen sind der kostenpflichtigen Stufe vorbehalten | Ein ausgereifter Closed-Source-Desktop-Arbeitsbereich für jemanden, der niemals Docker ausführen wird | Keine öffentliche Commit-Historie; die Wartung stützt sich daher vollständig auf den Changelog des Anbieters. Integrierte Tool-Voreinstellungen sind anbieterspezifisch, und ein benutzerdefinierter Anbieter übernimmt sie nicht | Preise, Einrichtung, vs. LM Studio und AnythingLLM |
| AnythingLLM | Aktiv; MIT, gepusht am 2026-09-17. Wird sowohl als Desktop-App als auch als selbst gehosteter Server ausgeliefert | OpenAI-kompatible Chat-Completions über einen generischen Anbieter mit Basis-URL, Schlüssel, Modellname, Kontextfenster und maximalen Tokens. Bei Selbsthosting keine Planbeschränkung | Dokumentabruf auf dem eigenen Rechner oder Server mit Modellauswahl pro Arbeitsbereich | Chat, Embeddings und Transkription werden unabhängig konfiguriert; ein Chat-Endpunkt liefert daher keine Embeddings, und eine funktionierende Retrieval-Installation benötigt einen zweiten Anbieter. Die Dokumentation weist außerdem darauf hin, dass der generische Anbieter für Entwickler gedacht ist | vs. Open WebUI, Einrichtung |
| Open WebUI | Aktiv; gepusht am 2026-09-18. Nicht standardmäßige Lizenz — BSD-3 plus eine Branding-Klausel für Deployments mit mehr als fünfzig Endnutzern innerhalb eines rollierenden Zeitraums von dreißig Tagen | OpenAI-Chat-Completions sowohl für einfache Modelle als auch für Agent-Backends: Geben Sie unter den Admin-Verbindungen eine URL und einen Schlüssel ein. Ein Modelllisten-Endpunkt wird empfohlen, ist aber optional; ohne ihn tragen Sie die Modell-IDs im Allowlist-Feld ein. Frei konfigurierbar | Ein selbst gehosteter Chatserver für mehrere Benutzer, der einem Endpunkt vorgeschaltet ist und als üblicher Anschluss für ein Agent-Backend dient | Tool-Aufrufe sind nur so gut wie die Schema-Treue des Upstreams; die Dokumentation hebt eine Kompatibilitätsschicht hervor, in der erforderliche Felder fehlen und Tool-Aufrufe unbemerkt fehlschlagen | Einrichtung |
| LibreChat | Aktiv; MIT, gepusht am 2026-09-18 | Standardmäßig OpenAI-kompatibel; ein anthropic-Anbieterwert an einem benutzerdefinierten Endpunkt leitet stattdessen über den nativen Messages-Client. Nur über Konfigurationsdatei, mit der Basis-URL als API-Wurzel. Frei konfigurierbar | Selbst gehostete Deployments für mehrere Benutzer, bei denen jeder Endpunkt eine eigene Schlüsselrichtlinie, Modell-Allowlist und Kostenabrechnung benötigt | Einen Anbieter hinzuzufügen bedeutet, YAML zu bearbeiten und neu zu starten, nicht auf eine Einstellungsseite zu klicken; Tokenpreise pro Endpunkt sind Metadaten, die Sie selbst eingeben, daher sind die angezeigten Kosten nur so genau wie Ihre Eingabe | vs. Open WebUI, Einrichtung |
| LobeHub | Aktiv und umbenannt: Der alte Pfad des lobe-chat-Repositorys leitet nun weiter, gepusht am 2026-09-18. Neupositionierung von einem Chat-Framework zu einem Agenten-Operator. Community-Lizenz mit kommerziellen Bedingungen | Eine benutzerdefinierte Basis-URL ist für den selbst gehosteten Einsatz dokumentiert, und die Optionen des Anbieter-SDKs stellen OpenAI- und Anthropic-Typen bereit. Ob die gehostete Cloud benutzerdefinierte Basis-URLs hinter einem kostenpflichtigen Plan beschränkt, wird in der Dokumentation nicht angegeben | Ein selbst gehosteter Chat- und Agenten-Arbeitsbereich mit Plugin- und MCP-Marktplatz für ein Team, das eine eigene Instanz betreibt | Die Umbenennung ist live, aber das Ökosystem nicht: Anleitungen von Drittanbietern und ältere Anleitungen zu Umgebungsvariablen verwenden weiterhin den früheren Namen, und die Einrichtungsschritte haben sich mit der neuen Version geändert | Einrichtung |
| ChatWise | Aktiv kommerziell, Closed Source ohne öffentliches Repository; Dokumentation und Preisseiten wurden am 2026-09-18 veröffentlicht | OpenAI-kompatibel oder Anthropic-kompatibel pro benutzerdefiniertem Anbieter, wobei Modelle von einem Modelllisten-Endpunkt abgerufen oder manuell hinzugefügt werden. Eine einmalige Pro-Lizenz ist verfügbar; ob benutzerdefinierte Anbieter in der kostenlosen Stufe funktionieren, wird auf keiner der beiden Seiten angegeben | Für jemanden, der einen schnellen nativen Desktop-Client möchte, einmalig statt im Abonnement bezahlt und den eigenen Schlüssel mitbringt | Manuell hinzugefügte Modelle verfügen über keine automatisch erkannten Fähigkeiten — Sie deklarieren Kontextlänge, Vision, Audio und Reasoning selbst, und ein falsches Flag führt zu einer unbemerkt fehlerhaften Funktion. Die kostenlose Stufe ist für die persönliche, nichtkommerzielle Nutzung lizenziert | Einrichtung, API-Kosten, vs. Chatbox |
| TypingMind | Aktiv kommerziell; wird als einmalige Lizenzpläne verkauft, während das Teamprodukt separat abgerechnet wird | Das am 2026-10-01 überprüfte Live-Formular „Add Custom Model“ bietet die API-Typen OpenAI Chat Completions, OpenAI Responses, Claude Messages und Gemini API; das Feld Endpoint URL erwartet die VOLLSTÄNDIGE Route — die offiziellen Beispiele enden mit dem Chat-Completions-Pfad. In der veröffentlichten Plantabelle nicht stufenabhängig | Eine ausgereifte BYOK-Chat-Oberfläche, die Sie einmal kaufen und anschließend mit Ihren eigenen Tokens versorgen | Bei einem als Basis-URL veröffentlichten Endpunkt muss das Suffix manuell angehängt werden. Anfragen gehen direkt vom Browser aus — die Local-AI-Seite von TypingMind sagt dies ausdrücklich — daher muss der Endpunkt CORS-Header senden; der optionale Schalter „Route requests via TypingMind Cloud“ des Formulars ist der dokumentierte Weg, dies zu umgehen | Einrichtung, Preise, Alternativen |
| Copilot for Obsidian | Aktiv; Release 4.0.9 am 2026-09-16, AGPL-3.0. Die Dokumentation wurde auf eine neue Domain verschoben, und die alten Pfade leiten weiter | OpenAI-kompatibel. Fügen Sie einen benutzerdefinierten Anbieter mit Basis-URL und Modell-ID hinzu sowie einen Schlüssel, wenn der Endpunkt einen benötigt. Die Dokumentation besagt, dass dafür keine Self-Host-Lizenz erforderlich ist; die kostenpflichtigen Stufen sind ein separater verwalteter Pfad | Mit dem eigenen Schlüssel mit einem Obsidian-Tresor chatten und darin suchen, ohne ein Abonnement für den gehosteten Dienst des Plugins | Wenn der Verbindungstest erfolgreich ist, der Chat aber weiterhin fehlschlägt, müssen Sie die CORS-Option des Anbieters aktivieren — dadurch wird Streaming deaktiviert, sodass Antworten erst nach Abschluss statt Token für Token erscheinen | Einrichtung, API-Kosten, vs. Smart Connections |
| NextChat | Aktiv, aber langsamer werdend und kommerzialisiert: letzter Commit 2026-08-11, letzter markierter Release 2025-07-29. Das Repository stellt nun einen kostenpflichtigen gehosteten Dienst in den Vordergrund, während Selbsthosting der dokumentierte Bereitstellungspfad bleibt | OpenAI-kompatibel: Eine Basis-URL-Variable schreibt die OpenAI-Route um, und andere Anbieter haben eigene Variablen. Nur selbst gehostet, keine Planbeschränkung | Eine selbst gehostete Chat-Oberfläche mit Ein-Klick-Bereitstellung vor einem Endpunkt, bei der eine Modellnamenvariable exakt festlegt, welche Namen Ihre Benutzer sehen | Die Modell-IDs Ihres Endpunkts erscheinen erst, wenn Sie sie in dieser Variable auflisten — allein das Setzen der Basis-URL lässt Benutzer weiterhin das Standardmenü sehen | Einrichtung |
| ChatGPTBox | Aktiv; Besitz an eine Projektorganisation übertragen, wobei der alte Pfad weiterleitet, Release v2.7.1 am 2026-09-06. Eine Übertragung, keine Produktumbenennung | OpenAI-kompatibel im Modus für benutzerdefinierte Modelle, der eine benutzerdefinierte API-Adresse und einen Schlüssel akzeptiert. Frei konfigurierbar | Ein browserbasierter Assistent innerhalb der Seite — Auswahlaktionen, Zusammenfassungen, eine Seitenleiste mit Suchergebnissen — der auf Ihren eigenen Endpunkt verweist | Die hervorgehobenen kostenlosen Modi verwenden eine angemeldete Websitzung statt Ihres Schlüssels; BYOK gilt erst, wenn Sie bewusst in den Modus für benutzerdefinierte Modelle wechseln | — |
Workflow-Builder
Flowise befindet sich im archivierten Abschnitt, nicht hier.
| Client | Lebenszyklus | Protokoll-/BYOK-Grenze | Am besten geeignet für | Schlüsselbegrenzung | Kunavo-Seite |
|---|---|---|---|---|---|
| Dify | Aktiv und schnelllebig: letzter Commit 2026-09-18, Release 1.17.1 am 2026-09-10. Modifizierte Apache 2.0 | OpenAI-kompatibel, pro Modelltyp über ein erstklassiges Kompatibilitäts-Plugin deklariert — eine separate Plugin-Instanz für LLM, Embedding, Rerank, Speech-to-Text und Text-to-Speech. Bei Selbsthosting keine Planbeschränkung | Teams, die visuell Retrieval-Pipelines und Agenten-Workflows zusammenstellen, wobei ein Schlüssel hinter vielen Modellfeldern liegt | Bei Nicht-LLM-Typen hängt das Plugin die API-Version selbst an; eine Basis-URL, die bereits mit einem Versionspfad endet, erzeugt daher einen doppelten Pfad. Die Lizenz verbietet außerdem, es ohne kommerzielle Lizenz als mandantenfähigen Dienst zu betreiben | Einrichtung, API-Kosten, vs. n8n |
| n8n | Aktiv; letzter Commit 2026-09-18. Fair-Code unter der Sustainable Use License, mit Enterprise-lizenzierten Dateien, die im Baum gekennzeichnet sind | OpenAI-kompatibel. Die Zugangsdaten enthalten ein Basis-URL-Feld, das als Überschreibung der standardmäßigen API-Basis beschrieben wird; dies wurde direkt im Zugangsdatenquelltext und nicht nur in der Dokumentation verifiziert. Im aktuellen OpenAI-Chat-Model-Node (Version 1.3, n8n 2.41.4) ist „Use Responses API“ standardmäßig aktiviert; Anfragen gehen daher an die Responses-Route, sofern Sie die Option nicht deaktivieren. Bei Selbsthosting keine Planbeschränkung | Selbst gehostete Automatisierung, bei der ein LLM-Schritt in einem größeren Workflow sitzt und eine Änderung der Basis-URL jeden KI-Node gleichzeitig verschiebt | Der Zugangsdaten-Test stellt eine Modelllisten-Anfrage an Ihre Basis-URL und prüft nur den HTTP-Status; ein Endpunkt ohne eine solche Route besteht den Test daher nicht — und eine falsche Basis-URL, die auf diesem Pfad zufällig mit 200 antwortet, besteht ihn. In der gehosteten Cloud kann derselbe Node statt Ihrer Zugangsdaten die eigenen Credits des Anbieters verwenden — bestätigen Sie, welche Option ausgewählt ist | Einrichtung, API-Kosten, vs. n8n |
| AutoGPT Platform | Das Repository ist aktiv (gepusht am 2026-09-18), aber AutoGPT Classic — der autonome Agent von 2023, den der meiste Suchverkehr meint — wird ausdrücklich nicht gewartet; die offizielle Dokumentation erklärt, dass Abhängigkeiten nicht aktualisiert und Issues nicht behoben werden | OpenAI-kompatible Chat-Completions, wobei sich die beiden Produkthälften unterscheiden. Oberflächenabhängig: Der AutoPilot-Chat-Agent übernimmt CHAT_BASE_URL bei einer selbst gehosteten Installation, und die Anleitung führt eine verwaltete OpenAI-kompatible API unter den unterstützten Formen auf. Der Provider-Helfer auf Blockebene ist das Gegenteil: eine geschlossene Anbieteraufzählung, deren OpenAI- und Anthropic-Clients ohne Basis-URL erstellt werden; der einzige vom Benutzer festlegbare Host ist ein Ollama-Host, der gegen eine Allowlist vertrauenswürdiger Hostnamen geprüft wird | Ein blockbasierter visueller Builder mit Marktplatz, bei dem der danebenliegende Chat-Agent auf Ihrem eigenen Endpunkt laufen kann | Die beiden Pfade lesen unterschiedliche Umgebungsvariablen; das Konfigurieren der einen konfiguriert daher nicht die andere, und die Anleitung erklärt, dass die gehostete agpt.co-Bereitstellung diese Variablen vollständig ignoriert — dies ist ein Self-Hosting-Pfad. Der Chat-Transport verweigert außerdem den Fallback auf einen vorhandenen OpenAI-Schlüssel, daher muss CHAT_API_KEY explizit gesetzt werden. Ausgeführt mit dem Single-Container-Image von v0.8.2 gegen einen Aufzeichnungs-Stub am 2026-10-01: Eine Chat-Runde und drei Tool-Roundtrips wurden abgeschlossen | Einrichtung der benutzerdefinierten API, Preise, Alternativen |
Ständig aktive persönliche Agenten
| Client | Lebenszyklus | Protokoll-/BYOK-Grenze | Am besten geeignet für | Schlüsselbegrenzung | Kunavo-Seite |
|---|---|---|---|---|---|
| OpenClaw | Aktiv; gepusht am 2026-09-18. Zweimal umbenannt — Clawdbot, dann Moltbot, dann OpenClaw — und beide alten Repository-Pfade verweisen weiterhin hierher | Ein anbieterspezifisches api-Feld wählt den Anfrageadapter neben baseUrl, apiKey und einem models-Array in JSON. Die Beispiele für benutzerdefinierte Anbieter verwenden openai-completions und anthropic-messages; die Referenz zur Gateway-Konfiguration listet elf Adapter auf, darunter openai-responses, google-generative-ai, google-vertex und bedrock-converse-stream, und setzt für eine baseUrl ohne api standardmäßig openai-completions. Das Konfigurationsschema in v2026.9.7 akzeptiert zwölf: diese elf plus google-interactions, hinzugefügt am 25. September 2026 und auf der Google-Anbieterseite dokumentiert, aber noch nicht in der Referenz. Frei konfigurierbar | Der standardmäßige persönliche Allzweck-Agent, wenn Sie das größte Plugin-Ökosystem und die umfassendste Community-Abdeckung wünschen | Keine Katalogerkennung: Jedes Modell muss anhand seiner ID aufgelistet werden, und contextWindow, maxTokens sowie die Kostenfelder pro Token sind optional; beim Weglassen werden Standardwerte angewendet. Lassen Sie die Kosten weg, sind die Ausgabenangaben Schätzungen; tragen Sie sie ein, spiegeln sie Ihre Eingaben statt der tatsächlich abgerechneten Werte wider | Preise, Alternativen |
| Hermes Agent | Aktiv; MIT, gepusht am 2026-09-18, Release-Tag v2026.9.14 | Standardmäßig OpenAI-kompatibel; ein Transportfeld am benutzerdefinierten Anbieter schaltet auf Anthropic Messages um. Interaktiv oder in einer YAML-Konfiguration festlegbar. Keine Plan-, Abonnement- oder Kontobeschränkung | Ein dauerhaft laufender persönlicher CLI-Agent mit Speicher in einer lokalen Datenbank, der über einen Endpunkt von mehreren Chat-Plattformen aus erreichbar ist | Standardmäßig werden OpenAI-ähnliche Chat-Completions angenommen; ein ausschließlich Anthropic-kompatibler Endpunkt benötigt daher dieses separate Transportfeld — der Fehler sieht wie ein defekter Endpunkt und nicht wie ein falsches Übertragungsformat aus | Preise, vs. OpenClaw |
| nanobot | Aktiv; MIT, gepusht am 2026-09-18, veröffentlicht von HKUDS. Ein anderes, ebenfalls aktives Projekt verwendet denselben Namen an anderer Stelle — prüfen Sie die Organisation, bevor Sie einem Link folgen | OpenAI-kompatibel für benutzerdefinierte und beliebig benannte Anbieter; ein Anthropic-ähnlicher Endpunkt muss stattdessen die Basis des integrierten anthropic-Anbieters überschreiben. Die Dokumentation verlangt, den Versionspfad einzuschließen. Frei konfigurierbar | Ein selbst gehosteter persönlicher Agent, der als Weboberfläche, Terminal oder Chat-App läuft und selbst eine OpenAI-kompatible API bereitstellt | Beliebig benannte benutzerdefinierte Anbieter sind ausschließlich OpenAI-ähnlich und verwenden nicht das Anthropic-Anfrageformat; native Backends weisen das Proxy-Feld vollständig zurück | vs. OpenClaw |
| ZeroClaw | Aktiv; Apache-2.0, gepusht am 2026-09-18 | Ein wire_api-Feld wählt pro Anbieter Chat-Completions oder OpenAI Responses, während Anthropic-ähnliche Routen in einem separaten Anbieterfeld liegen. Das uri-Feld ist im benutzerdefinierten Feld erforderlich und überschreibt außerdem jede integrierte Familie. Jedes Feld kann über eine Umgebungsvariable gesetzt werden. Frei konfigurierbar | Eine sicherheitsorientierte Rust-Laufzeitumgebung, klein genug für günstige Hardware, mit überwachter Autonomie und Sandboxing auf Betriebssystemebene | Die Übertragungsart ändert das Verhalten, nicht nur den Transport: OpenAI-kompatible und Responses-Übertragungen können keine Anthropic-Ablehnungsmetadaten transportieren; der automatische Fallback funktioniert daher nur über das Anthropic-Feld, und Prompt-Caching über eine Chat-Completions-Route benötigt ein nicht standardmäßiges Flag | vs. OpenClaw |
| NanoClaw | Aktiv; MIT, zuletzt gepusht am 2026-09-17 | Anthropic-orientiert und auf dem Standardpfad kontogebunden: Die Standardlaufzeit ist das Claude Agent SDK, daher wird standardmäßig ein Claude-Abonnement oder ein Anthropic-Schlüssel erwartet. Jeder Anthropic-kompatible Endpunkt funktioniert über ein Paar aus Basis-URL und Token; der OpenAI-kompatible Zugriff erfolgt indirekt durch Delegation über einen Skill | Eine containerisolierte Alternative zu OpenClaw für Personen, die bereits mit Claude Code arbeiten, angebunden an mehrere Messaging-Plattformen | Ein ausschließlich für OpenAI vorgesehener Endpunkt muss über einen Delegations-Skill erreicht werden. Ein separater Codex-Provider, installiert mit /add-codex (fixiert auf @openai/codex 0.155.1), führt OpenAI-Modelle über den eigenen OpenAI-Dienst mit einem OpenAI-Schlüssel oder einer ChatGPT-Anmeldung aus; ein dort hängender Responses-WebSocket endet nach zehn Minuten mit dem Turn-Timeout von NanoClaw, reproduziert am 2026-10-01. Das Projekt liefert außerdem absichtlich keine Konfigurationsdateien aus, daher liegen BYOK-Einstellungen in einer Env-Datei und in CLI-Befehlen pro Gruppe | vs. OpenClaw, Codex-Timeout |
| PicoClaw | Aktiv; MIT, zuletzt gepusht am 2026-09-17, veröffentlicht von Sipeed. Von Grund auf in Go geschrieben, ausdrücklich kein Fork | Namensfalle: Der Provider-Wert anthropic verwendet OpenAI-kompatible Chat-Completions, während anthropic-messages die native Messages API verwendet. Ein Feld api_base überschreibt den Endpunkt, und benutzerdefinierte Header können die Autorisierung überschreiben. Frei konfigurierbar | Der geringste Footprint hier — eine Go-Binärdatei mit Agent-, Gateway- und TUI-Modi, ausgelegt für dauerhaft aktive und eingebettete Deployments | Ein Endpunkt, der ausschließlich die Messages-Route bereitstellt, gibt unter dem Wert anthropic 404 zurück. Bedrock und der Azure-Identitätspfad sind nicht in der Standard-Binärdatei enthalten und erfordern einen Neubau mit Build-Tags | API-Kosten und Einrichtung, 404-Fehler, vs. OpenClaw |
| IronClaw | Aktiv; Apache-2.0, zuletzt gepusht am 2026-09-13, veröffentlicht unter der nearai-Organisation | Ein generischer OpenAI-kompatibler Chat-Completions-Adapter, bei dem die Basis-URL obligatorisch ist, sowie native Anthropic-, Gemini-, Bedrock- und weitere Provider, die jeweils eine Überschreibung der Basis-URL akzeptieren. Ein Fallback über Umgebungsvariablen deckt Container und einmalige Ausführungen ab. Frei konfigurierbar | Ein auf Datenschutz und Sicherheit ausgerichtetes Agent-Betriebssystem mit verschlüsseltem lokalem Secret-Speicher, sandboxed Tools und progressiver Tool-Offenlegung | Der generische Adapter hat keinen Standard-Host, daher muss die Basis-URL angegeben werden — jedes dokumentierte Beispiel setzt sie ausdrücklich, und keines davon ist ein gehosteter Drittanbieter-Endpunkt. Auf welcher Ebene eine fehlende Basis-URL fehlschlägt, ist in der Dokumentation nicht angegeben | Benutzerdefinierte API, Kontextbudget-Fehler, vs. OpenClaw |
| Agent Zero | Aktiv; zuletzt gepusht am 2026-09-18, erstellt am 2024-06-10 — das älteste Projekt in dieser Gruppe. Die Eigentümerschaft wechselte von einem persönlichen Konto zur agent0ai-Organisation, und der alte Pfad leitet weiter | OpenAI-kompatible Chat-Completions über einen generischen Provider mit einem API-URL-Feld pro Modell und separat eingegebenem Schlüssel. Nur UI: Die Installationsanleitung dokumentiert kein Äquivalent über Konfigurationsdatei oder Umgebungsvariable. Keine Planbeschränkung | Ein hackbares, promptgesteuertes Agent-Framework, das in Docker mit einer Web-UI ausgeführt wird und eher einem Framework gleicht, das man selbst gestaltet, als einem fertigen Assistenten | Chat-, Utility- und Embedding-Modelle werden unabhängig konfiguriert; daher erzwingt ein Endpunkt, der Chat, aber keine Embeddings bereitstellt, eine getrennte Einrichtung. Die Dokumentation warnt, dass sehr kleine Utility-Modelle bei Speicheraufgaben vollständig scheitern | vs. OpenClaw |
| OpenManus | Aktiv, aber sichtbar langsamer: zuletzt gepusht am 2026-08-22, mit den neuesten Commits vom 2026-08-16. Falle bei veralteten Links — der ursprüngliche Repository-Pfad leitet NICHT weiter und verweist nun auf ein separates, unabhängiges Repository | OpenAI-kompatible Chat-Completions, im Quellcode und nicht nur in der Dokumentation bestätigt. Ein config.toml-Block mit base_url, api_key und model; ein api_type-Feld wechselt zu Azure- oder Bedrock-Clients. Frei konfigurierbar | Eine offene Neuimplementierung einer General-Agent-Schleife für Forschung und Browser-Automatisierung sowie die mechanischste Konfiguration in dieser Gruppe | Es gibt zwei unabhängige LLM-Blöcke, einen für das Hauptmodell und einen für Vision, die jeweils ihre eigene Basis-URL und ihren eigenen Schlüssel benötigen. Die Beispielkonfiguration fixiert außerdem weiterhin eine Modell-ID aus dem Jahr 2025, die bei den meisten aktuellen Endpunkten fehlschlagen wird | API-Kosten und Einrichtung, Token- und Tool-Fehler |
| SillyTavern | Aktiv; AGPL-3.0, zuletzt gepusht am 2026-09-14 | OpenAI-kompatible Chat-Completions über eine benutzerdefinierte Completion-Quelle. Die Dokumentation sagt, dass das Suffix für Chat-Completions nicht hinzugefügt werden soll und bei fehlgeschlagener Verbindung versucht werden soll, den Versionspfad hinzuzufügen. Frei konfigurierbar | Langformatiges Rollenspiel und Charakter-Chat mit starker Prompt-Steuerung — eine tatsächlich andere Zielgruppe als die Coding-Kohorte, mit anderen Kontext- und Tokenmustern | Der Modus zur Prompt-Nachbearbeitung ist wichtiger als der Endpunkt: Die Varianten „no tools“ entfernen Tool-Aufrufe aus dem Prompt, und Tool-Aufrufe werden unter diesen Varianten nicht unterstützt — ohne Fehlermeldung | Beste API, Einrichtung |
| Msty Go | Aktiv, umbenannt von Msty Claw am 2026-08-04. Closed Source; die Preisseite führt es in einem Beta-Tarif für 0 $, Team-Tarife sind als geplant gekennzeichnet | Unbekannt. Die Einstellungen dokumentieren einen Typ, Anzeigenamen, eine Basis-URL, einen Schlüssel und das Verhalten der Modellliste, aber die Dokumentation listet die Typoptionen nie auf; daher ist das Wire-Format eines benutzerdefinierten Providers nicht veröffentlicht | Ein begrenzter Desktop-Task-Runner mit expliziten Ordnern, isolierter Ausführung und überprüfbarer Arbeit | Closed Source, kostenlose Beta und eine undokumentierte Liste von Providertypen: Aus der Dokumentation lässt sich nicht bestätigen, dass ein beliebiger OpenAI-kompatibler Endpunkt funktioniert. Dies muss durch eine Installation nachgewiesen werden | Einrichtung |
| Page Assist | Aktiv; MIT, zuletzt gepusht am 2026-09-13 | OpenAI-kompatibel. Die Einstellungen bieten einen OpenAI-kompatiblen Tab, in dem eine Custom-Option die API-URL und den Schlüssel übernimmt. Frei konfigurierbar | Ein Chat in der Browser-Seitenleiste, der die aktuell geöffnete Seite lesen kann, für Personen, die niemals ein Terminal öffnen werden | Eine Chat-UI als Browser-Erweiterung statt eines autonomen Agenten — keine Coding- oder Tool-Ausführungsschleife — und der Schwerpunkt liegt weiterhin auf lokalen Modellen, sodass Cloud-Pfade vergleichsweise wenig getestet werden | Einrichtung |
Clients ohne dokumentierten Drittanbieter-Endpunkt
Diese drei sind ausreichend aktiv, um in Suchergebnissen zu erscheinen, aber keiner dokumentiert, dass der Client auf eine beliebige Basis-URL gerichtet werden kann. Halte hier drei verschiedene Fakten auseinander, da sie routinemäßig zu einem einzigen zusammengefasst werden: ob du deinen eigenen Vendor-Schlüssel angeben kannst, ob du deinen eigenen Endpunkt angeben kannst und ob niemand dies in irgendeiner Richtung geklärt hat. Devon akzeptiert Vendor-Schlüssel und dokumentiert kein Basis-URL-Feld; Kiro CLI akzeptiert weder das eine noch das andere — die API-Schlüssel, die in der Enterprise-Dokumentation beschrieben werden, gehören Kiro selbst und dienen dazu, die CLI in Skripten auszuführen, nicht dazu, den Schlüssel eines Modellanbieters einzubringen; Smart Chat ist planbeschränkt, und die Unterstützung beliebiger Endpunkte ist schlicht unbestätigt, was nicht dasselbe ist wie eine Ablehnung. Nur die Endpunktspalte macht einen Client von Kunavo aus erreichbar.
| Client | Kategorie | Lebenszyklus | Was tatsächlich verfügbar ist | Was daraus für dich folgt |
|---|---|---|---|---|
| Kiro CLI | Terminal | Aktiv, umbenannt von Amazon Q Developer CLI (verfügbar seit 2025-11-17, automatisch aktualisiert am 2025-11-24; alte Einstiegspunkte funktionieren weiterhin). Separat enden der Support für Amazon-Q-Developer-IDE-Plugins und kostenpflichtige Abonnements am 2027-04-30; neue Anmeldungen sind ab 2026-05-15 gesperrt | Nichts dokumentiert. Modelle werden über Abonnementstufen bereitgestellt und über Bedrock ausgeliefert; die Modelldokumentation enthält keine Option für einen benutzerdefinierten Provider, Schlüssel oder eine Basis-URL. BYOK existiert nur in offenen Feature-Anfragen | Ein Drittanbieter-Endpunkt ist derzeit nicht möglich. Verwechsle dies nicht mit Kiro Crew, einem separaten Open-Source-Orchestrierungsprodukt, das auf der CLI aufbaut. Was es bietet und wann es einen Agenten mit benutzerdefiniertem Endpunkt übertrifft, wird unter Kiro CLI vs. Claude Code verglichen |
| Devon | Terminal | Nicht offiziell archiviert, aber faktisch aufgegeben: Der neueste Commit des Standard-Branches datiert vom 2024-07-29, und der letzte Push des Repositorys jeglicher Art erfolgte am 2025-05-26 | Schlüssel ja, Endpunkt nein. Die README dokumentiert Variablen für Schlüssel pro Anbieter und einen lokalen Ollama-Pfad, enthält aber nirgendwo eine Überschreibung für base-URL oder api-base | Nur historische Referenz. Der Verzeichniswert dient der Disambiguierung: Devon (Open Source, inaktiv) ist nicht Devin, ein anderes kommerzielles Produkt, das dieselben Suchergebnisse dominiert |
| Smart Chat (Smart Connections) | Obsidian-Plugin | Aktiv, aber in separate Produkte aufgeteilt: Der kostenlose Kern ist als semantische Suche ohne erforderlichen Schlüssel positioniert, während der Chat mit API-Modellen eine separate Erweiterung ist. Letzter Commit am 2026-09-16 | Planbeschränkt, und ein beliebiger Endpunkt ist nicht bestätigt. Der dokumentierte Workflow erfordert Smart Chat Pro sowie ein Modell aus einer festen Menge benannter Adapter; die einzige dokumentierte benutzerdefinierte Basis-URL gilt für eine bestimmte selbst gehostete App | Behandle die Unterstützung beliebiger Endpunkte als unbekannt und nicht als nicht vorhanden — nichts in der aktuellen Dokumentation klärt dies. Die älteren Einrichtungsseiten von Smart Connections sind ausdrücklich veraltet und sollten nicht wiederverwendet werden. Der Vergleich mit einem Client, der einen benutzerdefinierten Endpunkt akzeptiert, steht unter Copilot für Obsidian vs. Smart Connections |
Außer Betrieb, archiviert und abgelöst
Diese zehn sind im Verzeichnis enthalten, damit eine Suche nach dem Namen zum Status und nicht zu einem Installationsbefehl führt. Keines davon ist derzeit eine Empfehlung.
| Client | Status | Was es jetzt ist | Wohin stattdessen wechseln |
|---|---|---|---|
| Continue | Wartung eingestellt; das Repository ist nach einer letzten Version 2.0.0 der VS-Code-Erweiterung, CLI und des JetBrains-Plugins schreibgeschützt. Die eigene Website des Unternehmens erklärt, dass das Unternehmen von Cursor übernommen wurde. Letzter Commit des Standard-Branches am 2026-07-21 | Ein eingefrorener Coding-Agent — VS-Code-Erweiterung, CLI und JetBrains-Plugin — der weiterhin auf einen Drittanbieter-Endpunkt umgeleitet werden kann, nachdem die gebündelte Authentifizierung entfernt wurde | Nur für bestehende Installationen, kein Ausgangspunkt. Mechanischer Warnhinweis für eine erneute Prüfung: Das Repository ist nicht als archiviert markiert und sein Push-Datum ändert sich weiterhin täglich, sodass eine Prüfung des Archiv-Flags es als aktiv meldet. Bestehende Einrichtungsseite |
| Void | Archiviert am 2026-06-02; schreibgeschützt und nimmt keine Beiträge an. Die README beginnt mit der Erklärung, dass es veraltet ist | Ein archivierter VS-Code-Fork, den die README selbst hauptsächlich als Referenz für das Forken von VS Code empfiehlt | Migrieren. Die README verweist auf ein Repository mit Community-Forks; Zed und Theia sind die gepflegten Editoren in diesem Verzeichnis. Lektüre zur Migration: Alternativen zum Void-Editor |
| PearAI | Das Editor-Repository wurde seit dem 2025-05-20 nicht mehr veröffentlicht; die neueste Aktivität irgendwo in der Organisation stammt vom 2026-06-19. Die Homepage ist aktiv und verkauft weiterhin ein Router-Abonnement | Ein Editor aus der Continue-Linie, dessen BYOK-Anweisungen zuletzt Ende November 2024 bearbeitet wurden und weiterhin Modelle aus dem Jahr 2024 als aktuelle Produktpalette aufführt | Stelle es nicht als funktionierendes BYOK-Ziel dar. Der Ablauf für benutzerdefinierte Endpunkte kann derzeit von niemandem gegen einen aktuellen Build bestätigt werden — prüfe ihn zuerst anhand einer installierten Kopie und schließe aus dem Editor-Repository allein nicht, dass das Produkt tot ist |
| Witsy | An einen Unternehmenseigentümer übertragen und inaktiv: Verlagerung am 2026-04-08, letzte Veröffentlichung am 2026-03-04, neuester Commit am 2026-04-09. Die Produktdomain leitet nun zum Repository weiter | Ein BYOK-Desktop-Assistent und MCP-Client, dessen Dokumentation korrekt, aber nicht gepflegt ist | Keine aktuelle Empfehlung. Wähle einen gepflegten Desktop-Client aus der obigen Tabelle |
| Flowise | Archiviert am 2026-08-13, zusammen mit seinen Dokumentations- und Embed-Repositories. Issues und Pull Requests sind gesperrt, und die Maintainer erklären, dass veröffentlichte Pakete als veraltet markiert werden | Eine Apache-2.0-Codebasis, bei der die Maintainer den Nutzern zum Forken raten. Ob die gehostete Cloud weiterhin betrieben wird, ist weder in die eine noch in die andere Richtung angegeben, und die Marketing-Website enthält keinen Archivhinweis | Nur ein Schritt zur Migration oder zum Ausstieg. Dify und n8n sind die gepflegten Workflow-Builder in diesem Verzeichnis. Lektüre zur Migration: Flowise-Alternativen, Dify vs. Flowise und Flowise vs. n8n |
| SWE-agent | Nur noch Wartung und abgelöst. Das Repository ist nicht archiviert (letzter Push am 2026-09-14), aber sowohl die README als auch die Dokumentation erklären, dass die Entwicklung verlagert wurde | Weiterhin nutzbar, um veröffentlichte Benchmark-Läufe aus einer einzigen vollständig dokumentierten YAML-Konfiguration zu reproduzieren | Upstream empfiehlt mini-SWE-agent für neue Arbeiten; es befindet sich in der obigen Terminal-Tabelle |
| Plandex | Inaktiv, und die Domain wird nicht mehr aufgelöst. Letzter Push am 2025-10-03; am 2026-09-18 wurden weder die Website noch die gehostete Dokumentation aufgelöst, bestätigt durch zwei unabhängige öffentliche Resolver | Ein selbst gehosteter Planungsagent, dessen Website, gehostete Dokumentation und Cloud allesamt unerreichbar sind. Benutzerdefinierte Provider erforderten selbst gehostetes Hosting, selbst als die Website erreichbar war — der Cloud-BYOK-Tarif konnte nur integrierte Provider verwenden | Als nicht gepflegt behandeln, bis Upstream etwas anderes mitteilt. Lektüre zur Migration: Plandex vs. Aider |
| Mentat (archivierte CLI) | Archiviert, letzter Push am 2025-01-07. Das Repository wurde absichtlich in einen Archivpfad umbenannt, und die README beginnt mit einem Hinweis auf das archivierte Projekt | Ein totes Kommandozeilen-Tool. Der Name wurde neu vergeben — laut der Archiv-README bezeichnet Mentat nun ein anderes Produkt, einen gehosteten Code-Review-Bot, dessen aktueller Betriebsstatus in dieser Umgebung nicht verifiziert werden konnte | Innerhalb des Projekts gibt es nichts, wohin migriert werden kann. Wähle oben einen beliebigen gepflegten Terminal-Agenten |
| OpenCode (archivierte Go-CLI) | Archiviert, letzter Push am 2025-09-18. Die README beginnt mit dem Hinweis, dass das Projekt unter dem Namen Crush fortgeführt wurde | Das ursprüngliche Go- und TUI-OpenCode, nur zur Herkunftsdokumentation aufbewahrt | Crush in der obigen Terminal-Tabelle. Verwechsle dies nicht mit dem OpenCode, das heute verwendet wird; dabei handelt es sich um ein separates TypeScript-Projekt — Kunavos bestehende OpenCode-Seiten beschreiben dieses, nicht dieses archivierte Repository. Crush vs. OpenCode erklärt die Entwicklungslinie |
| iFlow CLI | Eingestellt. Der Repository-Hinweis besagt, dass die Einstellung am 17. April 2026 erfolgen würde; dieses Datum ist verstrichen, und der Hinweis steht weiterhin oben in der README | Ein außer Betrieb genommener OpenAI-kompatibler Terminal-Agent, dessen Konfigurationsdokumentation weiterhin erreichbar ist — genau darin liegt die Falle | Nur Migration. Wähle oben aus der Tabelle einen gepflegten OpenAI-kompatiblen Terminal-Agenten. Lektüre zur Migration: Alternativen zur iFlow CLI |
Kunavo-Verifizierungsstatus
Kein Client in diesem Verzeichnis hat in einem aufgezeichneten Test eine Anfrage über Kunavo abgeschlossen. Das ist der ehrliche Status und sollte klar ausgesprochen werden, statt ihn zu verstecken, denn diese Unterscheidung verändert, was du als Nächstes tun solltest.
| Status | Bedeutung | Was es nicht bedeutet |
|---|---|---|
| Einrichtungsanleitung veröffentlicht | Kunavo hat Konfigurationsschritte für diesen Client verfasst, basierend auf der eigenen Dokumentation des Clients | Es bedeutet nicht, dass eine Anfrage gesendet, ein Tool-Aufruf gemessen oder der Client zertifiziert, verifiziert oder offiziell unterstützt wurde |
| Anfragepfade geprüft | Kunavo hat den Client ausgeführt oder eine Anfrage von ihm an einen lokalen Mock-Endpunkt gesendet oder einen absichtlich ungültigen Schlüssel verwendet und aufgezeichnet, was er gesendet hat und was zurückkam | Es bedeutet nicht, dass eine Completion, ein Stream oder ein Tool-Aufruf über Kunavo erfolgreich war |
| Nicht getestet | Die Protokoll- und Endpunktdetails in der Zeile stammen aus der Dokumentation, README oder dem Repository-Quellcode des Anbieters am angegebenen Prüftag | Es bedeutet nicht, dass der Client fehlschlägt — nur, dass ihn hier niemand ausgeführt hat |
40 von 77 Clients in diesem Verzeichnis verfügen über eine veröffentlichte Kunavo-Einrichtungsanleitung: Aider, goose, Crush, Pi, Oh My Pi, DeepSeek Harness, Factory Droid, Qwen Code, Kimi Code, OpenHands, mini-SWE-agent, Nanocoder, Mistral Vibe CLI, GitHub Copilot CLI, Open Interpreter, Amp, Jan Agent, Junie CLI, Zed, Theia IDE, twinny, Qoder, Dyad, Cherry Studio, Chatbox, Msty Studio, AnythingLLM, Open WebUI, LibreChat, LobeChat, ChatWise, TypingMind, Copilot for Obsidian, NextChat, Dify, n8n, SillyTavern, Msty Go, Page Assist und Continue. Die Anleitungen für n8n und TypingMind sind die beiden mit geprüften Anfragepfaden; die übrigen wurden anhand der Dokumentation oder des Quellcodes des jeweiligen Clients verfasst. Jede andere Zeile in diesem Verzeichnis ist ungetestet, ebenso die spezifischen Funktionen innerhalb dieser Anleitungen.
Eine praktische Konsequenz: Behandle deine erste Aufgabe mit jedem neuen Client als Verifizierungsschritt. Sende eine begrenzte Anfrage, bestätige, dass die Antwort gestreamt wird, bestätige, dass ein Tool-Aufruf zurückkehrt, und prüfe die aufgezeichnete Abbuchung, bevor du geplante oder kostenpflichtige Arbeit darauf verlagerst.
Was der Betrieb mit deinem eigenen Schlüssel kostet
Sobald ein Client auf deinen eigenen Endpunkt gerichtet ist, wird pro Token statt pro Sitzplatz abgerechnet. Zu Kunavos aktuellen Katalogpreisen führt Claude Sonnet 5 $1.40 pro Million Eingabetoken und $7.00 pro Million Ausgabetoken auf; Claude Haiku 4.5 führt $0.70 und $3.50 auf.
Eine hypothetische Agentensitzung mit 400.000 nicht zwischengespeicherten Eingabetoken und 30.000 Ausgabetoken hat eine Katalogschätzung von $0.77 auf Claude Sonnet 5 und $0.38 auf Claude Haiku 4.5. Das ist Token-Arithmetik auf Grundlage angenommener Mengen, keine gemessenen Aufgabenkosten und keine Obergrenze für eine Rechnung. Cache-Gebühren, externe Tools und vom Agenten durchgeführte Wiederholungen sind ausgeschlossen; ein Agent, der einen fehlgeschlagenen Tool-Aufruf wiederholt, bezahlt jeden Versuch.
Der günstigste aufgeführte Tarif und die niedrigsten Kosten zum Abschließen einer Aufgabe sind unterschiedliche Aussagen, und dieses Verzeichnis verspricht keine von beiden. Ein kleineres Modell mit niedrigerem Tarif kann mehr Versuche und mehr Überprüfung benötigen; vergleiche Kandidaten anhand einer Preistabelle und miss anschließend dieselbe reale Aufgabe mit zwei von ihnen. Kunavos Mindestbetrag ist eine $10-Vorauszahlung ohne Abonnement — siehe Abrechnungsdetails, um zu erfahren, wie eine Katalogschätzung mit der endgültigen Abbuchung zusammenhängt, und Preise für den aktuellen Katalog.
Weiterführende Lektüre: OpenAI-kompatible API behandelt die Endpunktstruktur, die die meisten dieser Clients erwarten, Anthropic-Basis-URL behandelt die Clients des Messages-Protokolls, und der Schnellstart bringt einen ersten Schlüssel zum Laufen. Erstelle ein Kunavo-Konto, wenn du bereit bist, einen dieser Clients gegen einen echten Endpunkt zu testen.
Häufig gestellte Fragen
Welche KI-Agent-Clients können einen benutzerdefinierten API-Endpunkt verwenden?
Die meisten Open-Source-Terminal-Agenten, die meisten selbst gehosteten Chat-Frontends und die meisten ständig aktiven persönlichen Agenten dokumentieren ein Feld für eine Base-URL ohne Anforderungen an Tarif oder Konto. Die Ausnahmen fallen in vier Gruppen: Clients, bei denen das Endpunktfeld nur auf einigen Oberflächen vorhanden ist (Factory Droid in CLI und Desktop, Qoder in der IDE, aber nicht in der CLI, OpenHands mit lokalem Backend, aber nicht mit seinem Cloud-Backend, der Chat-Agent der AutoGPT Platform bei Selbsthosting, aber nicht in der gehosteten Cloud), Clients, bei denen eine beliebige Base-URL hinter einem kostenpflichtigen oder Early-Access-Tarif liegt (benutzerdefinierte Endpunkt-URLs von Amp, Warp für Organisationen mit mehr als zehn Mitarbeitenden, Smart Chat Pro), Clients, die nur das Protokoll eines Anbieters sprechen (Gemini CLI akzeptiert eine Base-URL, sendet aber weiterhin native Gemini-Anfragen), und Clients ohne Endpunktfeld überhaupt (Kiro CLI, Devon).
Bedeutet ein dokumentierter benutzerdefinierter Endpunkt, dass jede Funktion funktioniert?
Nein. Ein Base-URL-Feld legt nur fest, wohin Anfragen gesendet werden. Tool-Aufrufe, Prompt-Caching, Fill-in-the-Middle-Autovervollständigung, Embeddings, Vision und Streaming sind separate Funktionen, die jeweils fehlschlagen können, während der Chat funktioniert. Twinny sendet Autovervollständigung an die veraltete Completions-Route statt an Chat Completions, AnythingLLM konfiguriert Embeddings als separaten Provider, SillyTavern entfernt Tool-Aufrufe bei bestimmten Modi der Prompt-Nachbearbeitung, und mehrere Clients verlangen, dass Sie Kontextfenster und Tokenpreise jedes Modells manuell eingeben. Testen Sie die konkreten Funktionen, die Sie benötigen, bevor Sie echte Arbeit verlagern.
Hat Kunavo diese Agent-Clients getestet?
Nicht durchgängig. Kein Client in diesem Verzeichnis hat in einem aufgezeichneten Test eine Anfrage über Kunavo erfolgreich abgeschlossen. Wo ein Kunavo-Einrichtungsleitfaden existiert, wurden die Konfigurationsschritte aus der eigenen Dokumentation oder dem veröffentlichten Quellcode des Clients übernommen, nicht gemessen. Zwei Einrichtungsseiten gehen einen Schritt weiter: Die Aufzeichnungen von n8n enthalten Läufe von n8n 2.41.4 gegen einen lokalen Mock-Endpunkt und gegen Kunavo mit einem ungültigen Schlüssel, und die Aufzeichnungen von TypingMind enthalten eine von typingmind.com gesendete Browseranfrage mit einem ungültigen Schlüssel — Prüfungen auf Anfrageebene, keine erfolgreichen Läufe. Jede Protokoll- und Endpunktaussage hier wurde am angegebenen Prüfdatum aus der Dokumentation, README oder dem Repository-Quellcode des Anbieters übernommen. Betrachten Sie die erste Aufgabe, die Sie mit einem neuen Client ausführen, als eigenen Verifizierungsschritt.
Mit welchen dieser Projekte sollte ich nicht beginnen?
Continue ist nach einer abschließenden Version 2.0.0 schreibgeschützt, und das Unternehmen gibt an, von Cursor übernommen worden zu sein. Void wurde am 2026-06-02 und Flowise am 2026-08-13 archiviert. iFlow CLI hat selbst den 17. April 2026 als Abschaltdatum veröffentlicht. Mentat und die Go-OpenCode-CLI sind archiviert, und SWE-agent wird nur noch gewartet, wobei Upstream stattdessen mini-SWE-agent empfiehlt. Bei Plandex gab es seit 2025-10-03 keine Repository-Aktivität mehr, und die Domain löst nicht mehr auf. Devon hat seit 2024-07-29 keinen Commit im Standard-Branch, und PearAIs Anweisungen für eigene Schlüssel wurden zuletzt im November 2024 bearbeitet. Diese Projekte gehören in ein Verzeichnis für Migration und Disambiguierung, nicht an den Anfang.
Ist der günstigste aufgeführte Modellpreis die günstigste Möglichkeit, eine Aufgabe abzuschließen?
Nicht unbedingt. Ein aufgeführter Preis pro Token und die Gesamtkosten für den Abschluss einer Arbeit sind unterschiedliche Messgrößen. Ein kleineres Modell mit niedrigerem Preis kann mehr Versuche, einen längeren Kontext oder mehr menschliche Prüfung benötigen, und ein Agent, der einen fehlgeschlagenen Tool-Aufruf wiederholt, bezahlt jeden Versuch. Vergleichen Sie eine Preisliste, um Kandidaten auszuwählen, und messen Sie dann dieselbe reale Aufgabe mit zwei Modellen, bevor Sie sich entscheiden. Kunavo veröffentlicht Katalogpreise pro Token und beginnt bei einer Prepaid-Aufladung von 10 $, ohne Abonnement.
Jeder Clientname in den obigen Tabellen verlinkt auf die eigene Dokumentationsseite, README oder Repository-Datei des Projekts, auf deren Grundlage die Zeile verfasst wurde; wenn eine Zeile zusätzlich auf einer zweiten Seite beruht — etwa auf einer separaten CLI-Dokumentation oder der Authentifizierungsseite eines Anbieters — ist diese Seite inline in der Zelle verlinkt, die die Aussage enthält. Diese Fakten wurden am 17. September 2026 zusammengetragen. Die Prüfung vom 18. September 2026 überprüfte den Lebenszyklus über die GitHub-REST-API — Archiv-Flags, Push-Daten, Commit-Daten und Weiterleitungen alter Pfade — für jede archivierte Zeile und jede Zeile ohne Endpunkt sowie für die meisten aktiven Zeilen und las die verlinkte Dokumentation für eine Auswahl der Protokoll- und Bring-your-own-Key-Zellen erneut, nicht für jede Zeile. Wenn die Marketing-Website eines Projekts und sein Repository voneinander abwichen, wurden das Repository und die eigenen Aussagen der Maintainer verwendet; die Abweichung ist in der Zeile vermerkt. Sternzahlen, Push-Daten und Tarifstrukturen sind zeitpunktabhängig und werden sich ändern — jede Lebenszykluszelle ist so formuliert, dass dieselbe Prüfung erneut durchgeführt werden kann. Am 1. Oktober 2026 wurde der Lebenszyklus für jeden Client mit öffentlichem Repository erneut über die GitHub-API geprüft, jeder Quelllink erneut geöffnet und die Zeilen für n8n, TypingMind und Msty Studio sowie die Abgrenzung von Kiro CLI anhand der Prüfungen dieses Tages korrigiert. Am selben Tag wurde die Protokollzelle für Pi anhand der aktualisierten Modellseite von Pi sowie anhand des Typs api, seiner Dispatch-Logik und der registrierten Implementierungen im Pi-Quellcode in v0.99.2 erneut geprüft und korrigiert; der Protokollfilter bildet weiterhin die vier dokumentierten Werte ab. Ebenfalls an diesem Tag korrigiert: die Protokoll- und Best-for-Zellen von Oh My Pi, erneut geprüft anhand seines docs/models.md und models.yml-Schemas in v18.4.8, sowie die Protokollzelle und der Filter von OpenClaw, erneut geprüft anhand seiner Seite für benutzerdefinierte Provider, der Gateway-Konfigurationsreferenz, der Google-Provider-Seite und des Konfigurationsschemas in v2026.9.7. Kunavo-Tokenpreise werden aus dem Live-Katalog gelesen; Kostenbeispiele sind illustrative Token-Arithmetik.