Zurück zu den Leitfäden
Integration·18. September 2026·Aktualisiert am 1. Oktober 2026·16 Min. Lesezeit

Verzeichnis für KI-Agenten-APIs: BYOK, Anbieterunterstützung und Einrichtungsanleitungen

Finden Sie einen Agenten-Client nach Kategorie und prüfen Sie anschließend sein Protokoll, seine Bring-your-own-key-Grenze und ob er noch gepflegt wird.

Zuletzt überprüft am .

Bei den meisten Open-Source-Agent-Clients können Sie Ihre eigene API-Basis-URL festlegen, aber drei Dinge entscheiden darüber, ob das tatsächlich funktioniert: das vom Client verwendete Wire-Protokoll, die Position der Grenze für eigene Schlüssel und die Frage, ob das Projekt noch gepflegt wird. Dieses Verzeichnis listet 77 Agent-Clients — 64 aus den Bereichen Terminal-Coding-Agenten, Editoren, Desktop-Chat-Apps, Workflow-Builder und ständig aktive persönliche Agenten, zusätzlich 3 ohne dokumentierten Drittanbieter-Endpunkt und 10 eingestellte oder abgelöste — jeweils mit separat angegebenem Protokoll, Endpunktgrenze und Lebenszyklus, damit Sie „akzeptiert eine Base-URL“ von „erledigt, was Sie benötigen“ unterscheiden können.

Dies ist ein Navigationsindex, keine Rangliste. Kein Client hier hat in einem aufgezeichneten Test eine Anfrage über Kunavo erfolgreich abgeschlossen, nichts wird bewertet, und eingestellte Projekte erscheinen mit ihrem Status, statt stillschweigend entfernt zu werden. Die Client-Fakten wurden am 17. September 2026 erhoben. Am 18. September 2026 wurde jede Lebenszykluszelle in den Tabellen für archivierte Projekte und Projekte ohne Endpunkt erneut anhand der GitHub-API geprüft, ebenso die meisten als aktiv aufgeführten Zeilen; Protokoll- und Details zu eigenen Schlüsseln wurden für eine Teilmenge erneut gelesen, nicht für alle 77. Jede Zeile verlinkt auf die Seite, aus der sie erstellt wurde, sodass jede Zelle an der Quelle erneut geprüft werden kann. Am 1. Oktober 2026 wurde jeder Client mit einem öffentlichen Repository erneut über die GitHub-API geprüft und jeder Quellenlink erneut geöffnet: Seitdem war keiner archiviert worden, jede Quelle antwortete weiterhin, und die Daten in den Lebenszykluszellen sind die September-Messungen, wie aufgezeichnet, sofern eine Zelle nichts anderes angibt.

Die drei Achsen, die entscheiden, ob ein benutzerdefinierter Endpunkt funktioniert

Eine einzelne Spalte „unterstützt benutzerdefinierte API“ verschleiert die meisten tatsächlichen Fehlerquellen. Jede folgende Zeile trennt sie auf.

1. Wire-Protokoll

„OpenAI-kompatibel“ ist die häufigste Form, aber nicht die einzige, und die von Clients verwendeten Bezeichnungen entsprechen nicht immer dem, was sie senden.

ProtokollWas der Client sendetWas das für einen Endpunkt bedeutet
OpenAI Chat CompletionsPOST an /v1/chat/completionsDie am breitesten unterstützte Form; die Standardannahme in den meisten hier aufgeführten Clients
OpenAI ResponsesPOST an /v1/responsesEin anderer Endpunkt. Ein Gateway, das nur Chat Completions implementiert, wird darauf nicht antworten
Anthropic MessagesPOST an /v1/messagesEine vollständig andere Anfrage- und Antwortform, keine Änderung des Headers
Google Gemini oder Vertex nativmodels/*:generateContentGemini CLI akzeptiert eine Base-URL, spricht aber weiterhin dieses Protokoll; daher funktioniert dort keine OpenAI-kompatible URL
Nur nativFeste Anbieter-EndpunkteEs gibt kein Base-URL-Feld; der Endpunkt ist fest einkompiliert

Zwei Benennungsfallen sollte man sich merken, weil der Fehler wie ein defekter Endpunkt statt wie ein falsches Protokoll aussieht. In PicoClaw sendet provider: "anthropic" OpenAI-förmige Chat Completions und anthropic-messages die native Messages API, daher gibt ein Endpunkt, der nur /v1/messages bereitstellt, unter dem ersten Wert 404 zurück. In Factorys Droid bedeutet provider: openai die Responses API und generic-chat-completion-api ist der Wert für ein Chat-Completions-Gateway.

2. Grenze für eigene Schlüssel

GrenzeWie es aussiehtBeispiele in diesem Verzeichnis
Frei konfigurierbarDokumentiertes Base-URL-Feld, ohne beteiligtes Konto oder kostenpflichtigen TarifDie meisten Terminal-Agenten, die meisten selbst gehosteten Chat-Frontends
OberflächenabhängigFunktioniert auf einigen Oberflächen des Produkts, auf anderen nichtDroid (nur CLI und Desktop), Qoder (IDE, nicht CLI), OpenHands (lokales Agent-Server-Backend, nicht Cloud), AutoGPT Platform (selbst gehosteter Chat-Agent, nicht die Block-Ebene)
TarifabhängigErfordert einen kostenpflichtigen oder Early-Access-TarifBenutzerdefinierte Endpunkt-URLs von Amp, Warp für Organisationen mit mehr als zehn Mitarbeitenden, Smart Chat Pro
ProtokollabhängigDas Feld ist vorhanden, akzeptiert aber nur das Protokoll eines AnbietersGemini CLI, nanocode, NanoClaw in seiner Standard-Laufzeitumgebung
Keine dokumentiertKein Endpunktfeld — nur Anbieterschlüssel oder nicht einmal dieseDevon (Anbieterschlüssel, kein Endpunkt), Kiro CLI (weder noch)

3. Lebenszyklus

Ein nicht archiviertes Repository ist ein schwacher Beleg. Continue ist schreibgeschützt, trägt aber kein Archivkennzeichen, daher weist eine Prüfung auf das Archivkennzeichen es als aktiv aus; auch das Repository von Aider ist nicht archiviert, hatte aber seit August 2025 keine Veröffentlichung, und das von Stakpak hat weder ein Archivkennzeichen noch einen Commit seit Juli 2026. Ein Push-Datum ist noch schwächer, weil es sich ändert, wenn irgendwo im Repository etwas gepusht wird, während der Standard-Branch unverändert bleibt — diese Lücke ist der Grund, warum Continue und Witsy frischer erscheinen, als sie sind. Die folgenden Lebenszykluszellen beruhen auf dem Commit-Protokoll des Standard-Branches, der Release-Liste und der eigenen Aussage des Projekts, nicht auf einem Push-Datum.

Warum eine Base-URL keine Kompatibilitätsgarantie ist

Dies sind die wiederkehrenden Gründe, warum sich ein korrekt konfigurierter Endpunkt weiterhin fehlerhaft verhält; alle stammen aus der eigenen Dokumentation der Clients:

  • Pfadbehandlung. Cherry Studio erwartet die Provider-Wurzel und hängt den Versionspfad selbst an; wenn Sie eine vollständige Chat-Completions-URL einfügen, wird der Pfad verdoppelt. Jan benötigt den Versionspfad in der Base-URL. TypingMind erwartet den vollständigen Pfad /v1/chat/completions. SillyTavern weist an, das Suffix nicht hinzuzufügen. Dify hängt die Version bei Nicht-LLM-Modelltypen selbst an.
  • Anforderungen an die Modellliste. Der Anmeldedatentest von n8n sendet GET /models und bewertet die Antwort allein anhand des Statuscodes. Ohne Modellliste schlägt er daher fehl, kann aber bei einer falschen Base-URL bestehen, die dort irgendeine 200 zurückgibt. Die Überschreibung der Kontextlänge in pool wird nur angewendet, wenn das Modell in der Modellliste des Providers erscheint. Open WebUI umgeht eine fehlende Liste mit einem manuellen Feld für eine Allowlist.
  • Manuell deklarierte Modellmetadaten. Keines von Zed, Crush, Theia, OpenClaw, ChatWise oder Dyad ermittelt die Grenzen eines Modells über Ihren Endpunkt. Was das kostet, unterscheidet sich: Bei Zed, Crush und ChatWise geben Sie Kontextfenster, Ausgabelimits oder Preise pro Token ein; OpenClaw und Dyad behandeln diese Felder als optional und wenden Standardwerte an, wenn Sie sie leer lassen; der benutzerdefinierte Modelleitrag von Theia enthält überhaupt keine Limits oder Preise. Wenn ein Client Ausgaben anhand von von Ihnen eingegebenen Zahlen meldet, entspricht der Wert Ihren Eingaben, nicht dem abgerechneten Betrag.
  • Funktionsumfang. Twinnys Autovervollständigung verwendet die veraltete Completions-Route, während der Chat Chat Completions verwendet. AnythingLLM konfiguriert Embeddings getrennt vom Chat. Jan kann Tool-, Vision- oder Audio-Unterstützung für einen benutzerdefinierten Provider nicht ableiten. Oh My Pi benötigt ein Flag für Endpunkte, die strikte Tool-Definitionen ablehnen.

Die fünf folgenden Tabellen können anhand derselben Fragen eingegrenzt werden: Protokoll, Grenze für eigene Schlüssel, ob für einen benutzerdefinierten Endpunkt ein kostenpflichtiger Tarif erforderlich ist, und Lebenszyklus. Jede Zeile bleibt auf der Seite; der Filter blendet Zeilen nur aus, während Sie ihn verwenden, und „Nicht angegeben“ bedeutet, dass die Quellen der Zeile die Frage nicht klären.

Alle Clients sind unten aufgeführt.

Terminal-Coding-Agenten

Eingestellte und abgelöste Terminal-Projekte — SWE-agent, Plandex, Mentat, die archivierte Go-OpenCode-CLI und iFlow CLI — befinden sich weiter unten im archivierten Abschnitt statt in dieser Tabelle. Kiro CLI und Devon stehen in der Tabelle ohne Endpunkt.

ClientLebenszyklusProtokoll-/BYOK-GrenzeAm besten geeignet fürSchlüsselbegrenzungKunavo-Seite
AiderNicht archiviert, aber inaktiv: letzte Veröffentlichung 2025-08-09, letzter Commit im Standard-Branch 2026-05-22OpenAI Chat Completions über das Präfix openai/ des Modells und OPENAI_API_BASE. Frei konfigurierbarPair-Programming im Terminal auf einem vorhandenen Git-Repository, mit angewendeten Änderungen und automatischen CommitsSeit über 13 Monaten keine Veröffentlichung, daher können Metadaten für neuere Modelle veraltet sein und müssen möglicherweise manuell angegeben werdenPreise, Einrichtung
gooseAktiv, aber verlagert: von Block an die Agentic AI Foundation gespendet, Repository nach aaif-goose/goose und Dokumentation nach goose-docs.ai verschoben, angekündigt am 2026-04-07OpenAI Chat Completions (OPENAI_HOST plus OPENAI_BASE_PATH) und Anthropic Messages (ANTHROPIC_HOST). Frei konfigurierbarEin vielseitiger lokaler Agent über das Programmieren hinaus – Desktop-App, CLI und einbettbare API, erweitert über MCPDie Basis-URL ist auf zwei Variablen aufgeteilt, daher muss ein Endpunkt, dessen Basis ein Versionspfad ist, diesen Pfad ausdrücklich setzenvs. Claude Code, Einrichtung
CrushAktiv; am 2026-09-18 veröffentlicht, am selben Tag überprüftUnterschiedliche Typen: openai, openai-compat für nicht mit OpenAI kompatible APIs und anthropic. Frei über crushrc oder crush.json konfigurierbarEin ausgereifter Terminal-Agent, bei dem Kontextfenster und Preise pro Modell lokal angegeben werden, sodass die Kosten innerhalb der Sitzung sichtbar sindNichts wird entdeckt – Kontextfenster, maximale Tokenzahl und Preise werden manuell eingetragen. Beide Konfigurationsdateien sind vertrauenswürdiger Code: crushrc wird in einer Shell ausgeführt, und die Befehlsersetzung in crush.json wird beim Laden ausgeführtPreise, Einrichtung, vs. OpenCode
PiAktiv; earendil-works/pi wurde am 2026-09-18 veröffentlicht. Der ältere Pfad badlogic/pi-mono leitet hierher weiteropenai-completions, openai-responses, anthropic-messages, google-generative-ai in ~/.pi/agent/models.json – die vier api-Werte, die Pi bis zur Dokumentationsaktualisierung vom 22. September 2026 für einen benutzerdefinierten Anbieter dokumentierte und deren Liste anschließend entfernt wurde. Der Quellcode in v0.99.2 typisiert das Feld als freien String und leitet es an diejenige von zehn integrierten Implementierungen weiter, die übereinstimmt; nur die vier wurden jemals für einen benutzerdefinierten Anbieter dokumentiert, und keine der anderen sechs wurde hier getestet. Frei konfigurierbarAufbauend auf einem kleinen, leicht anpassbaren Agentenkern oder dessen EinbettungDie README besagt, dass neue Issues und Pull Requests von neuen Beitragenden standardmäßig automatisch geschlossen werden, und dass man ein Harness-Monorepo übernimmt statt nur eine CLIPreise, vs. OpenCode, Einrichtung
Oh My PiAktiver Pi-Fork; am 2026-09-18 veröffentlichtNeun Chat-Drahtprotokolle in models.yml: openai-completions, openai-responses, openai-codex-responses, azure-openai-responses, anthropic-messages, bedrock-converse-stream und drei Google-Varianten (google-generative-ai, google-gemini-cli, google-vertex). Dieselbe Liste enthält außerdem zwei Bewertungs-APIs, typesafe und openrouter-decisions, die Bewertungsanfragen statt Chats beantworten; das Schema in v18.4.8 akzeptiert genau diese elf. Frei über models.yml konfigurierbarDie am umfassendsten dokumentierten Chat-Protokolle aller Terminal-Agenten in dieser Tabelle, mit integrierten LSP- und DAP-WerkzeugenAnthropic-kompatible Endpunkte, die das strikte Feld in Tool-Definitionen ablehnen, benötigen disableStrictTools; die Erkennung erzwingt einen /v1/models-Pfad, sofern sie nicht ausdrücklich deaktiviert wirdPreise, Einrichtung, vs. Pi
poolAktiv, aber klein: am 2026-08-18 veröffentlicht, 425 Sterne, kommerziell von Poolside unterstütztNur über die benutzerdefinierte Route mit OpenAI kompatibel (POOLSIDE_STANDALONE_BASE_URL); unterstützt separat ACP. Ausschließlich über Umgebungsvariable, keine EinschränkungEin ACP-nativer Terminal-Agent, der auch als Server für einen kompatiblen Editor ausgeführt werden kannDer Endpunkt muss GET /v1/models bereitstellen und das ausgewählte Modell auflisten, sonst wird die Überschreibung der Kontextlänge stillschweigend nicht mehr angewendet—
DeepSeek HarnessAktiv, selbst als Entwickler-Vorschau bezeichnet; am 2026-09-17 veröffentlichtopenai-completions, openai-responses oder anthropic-messages, ein Protokoll pro Anbieter, gespeichert in 0.2.0-rc.2 in cordis.patch.yml des Profils. Frei konfigurierbarDeepSeeks Plugin-Architektur-Harness als lokale Weboberfläche ausprobieren, die auf einen beliebigen Endpunkt zeigtDie Maintainer kündigen inkompatible Änderungen an, und in 0.2.0-rc.2 kann die Models-Seite noch keinen Anbieter hinzufügen, der sich per OAuth anmeldet, etwa CodexEinrichtung
Droid (Factory)Aktives kommerzielles Produkt, Closed Source; Dokumentation und Preisseite waren am 2026-09-18 erreichbar. factory.ai leitet zu factory.com weiteranthropic ist Messages, openai ist Responses, generic-chat-completion-api ist Chat Completions. Oberflächenabhängig: nur CLI und Desktop-AppEinen kommerziell unterstützten Agenten beibehalten und gleichzeitig die Inferenz auf lokalen Oberflächen an den eigenen Endpunkt verlagernBenutzerdefinierte Modelle erscheinen nie in den gehosteten Web- oder Mobil-Apps. Auf der BYOK-Seite wird keine Tarifbeschränkung genannt, und die Preisseite führt die Funktion nicht auf – das ist das Fehlen einer dokumentierten Einschränkung, kein Beweis, dass es keine gibtPreise, Einrichtung
Qwen CodeAktiv; am 2026-09-18 veröffentlichtOpenAI Chat Completions, Anthropic Messages, Google GenAI und Vertex, jeweils mit eigener Basis-URL-Variable, plus einer ausdrücklichen Option „Custom Provider“. Frei konfigurierbarProtokoll und Anbieter zur Laufzeit aus einem einzigen Terminal-Client heraus wechselnDas kostenlose Qwen-OAuth-Kontingent wurde am 2026-04-15 eingestellt und aus dem Authentifizierungsdialog entfernt; daher ist jede Anleitung, die weiterhin ein kostenloses tägliches Kontingent verspricht, veraltetPreise, Einrichtung
Kimi Code CLIAktiv; MoonshotAI/kimi-code wurde am 2026-09-18 veröffentlicht. Das ältere Kimi-CLI-Repository besagt, dass es sich zu diesem entwickelt und schrittweise eingestellt wirdOpenAI Chat Completions und Responses, Anthropic Messages, Google GenAI, Vertex – Anbieterblöcke in config.toml. Frei konfigurierbarEine verwaltete Moonshot-Anmeldung als einen Anbieter beibehalten und daneben einen Drittanbieter-Endpunkt hinzufügenAnmeldedaten werden nie aus einer impliziten Shell-Variable gelesen: Der Variablenname muss in der Konfiguration deklariert werden, sonst schlägt der Start fehlvs. Claude Code, Einrichtung
OpenHandsAktiv, aber umstrukturiert: Die Organisation wurde von All-Hands-AI umbenannt, das Haupt-Repository liefert nun Agent Canvas (1.20.0, 2026-09-17), während der Agent in einem separaten SDK-Repository liegt. Der CLI-Modus ist weiterhin dokumentiertLiteLLM, daher ist ein Anbieterpräfix obligatorisch. Backendabhängig: Anbieter-Verbindungen sind auf lokalen agent-server-Backends verfügbar und auf einem Cloud-Backend verborgenAutonome, isolierte Arbeit in mehreren Schritten – Aufgaben von Issue bis Pull Request und geplante Automatisierungen – auf dem eigenen Rechner oder ServerBeim Proxy-Pfad muss der Modellname bereits auf diesem Proxy konfiguriert sein. Ob das Cloud-Backend einen direkten Schlüssel in einem Anbieterprofil zulässt, ist ebenfalls nicht dokumentiertvs. OpenCode, Einrichtung
mini-SWE-agentAktiv; am 2026-09-14 veröffentlicht, derzeit auf v2, während v1 in einem Branch beibehalten wirdLiteLLM; ein benutzerdefinierter Endpunkt wird über model_kwargs mit einem OpenAI-kompatiblen Anbieter und einer api_base eingebunden. Frei konfigurierbarGünstige, skriptfähige Batch- und Benchmark-Läufe mit einer Kernschleife, die kurz genug ist, um sie vor dem Vertrauen darauf zu lesenEin Modell außerhalb der LiteLLM-Registry unterbricht die Kostenverfolgung, und v2 hat die Konfigurationsstruktur geändert, sodass Anweisungen aus der v1-Ära nicht übernommen werden könnenPreise, Einrichtung, vs. Claude Code
NanocoderAktiv; am 2026-09-18 veröffentlicht. Wird von einem Community-Kollektiv statt von einem Unternehmen betriebenOpenAI-kompatibel, außerdem Ollama und Voreinstellungen pro Anbieter. Ein Anbietereintrag in agents.config.json oder im Einstellungsassistenten. Frei konfigurierbarTerminal-Programmierung mit lokalem Fokus, bei der eine Remote-API eine Option unter lokalen Modellen ist und nicht als Standard vorausgesetzt wirdEinstellungen werden Block für Block aufgelöst, sodass eine Projektüberschreibung mit einem einzigen Feld den Rest dieses Blocks verwirft und stattdessen auf integrierte Standardwerte zurückfällt, nicht auf die globale KonfigurationModelle und API-Kosten, Einrichtung, vs. OpenCode
Mistral VibeAktiv; am 2026-09-18 veröffentlicht. Ein offizielles Mistral-ProjektStandardmäßig OpenAI-kompatibel; Anbieterblöcke in config.toml enthalten api_base und den Namen der Schlüsselvariablen. Frei konfigurierbarEine kleine, überprüfbare Python-CLI eines Modellanbieters mit einem eigenen Endpunkt darunterDie Anbieterreferenz befindet sich in der im Repository enthaltenen Konfigurationsreferenz statt in der README, sodass sich Schlüsselnamen zwischen Veröffentlichungen ändern können – in allen Einrichtungsanweisungen eine Version festlegenEinrichtung, vs. Claude Code, Alternativen
Gemini CLIAktiv; am 2026-09-18 veröffentlichtNur natives Gemini. Die Überschreibung der Basis-URL gilt für die API-Schlüssel-Authentifizierung, muss HTTPS verwenden, sofern sie nicht auf localhost zeigt, und ein OpenAI-kompatibler Modus ist nicht dokumentiertGemini-orientierte Terminal-Arbeit – und das deutlichste Beispiel dafür, warum Protokoll und Endpunkt getrennte Fragen sindDie Überschreibung ist nur für den API-Schlüssel-Pfad dokumentiert; verlassen Sie sich daher nicht darauf, dass sie die OAuth-Anmeldung über ein Google-Konto erreicht. Eine OpenAI-kompatible URL funktioniert nicht, sofern der Endpunkt nicht ebenfalls das Gemini-Drahtprotokoll bereitstelltvs. Claude Code
GitHub Copilot CLIAktiv; Veröffentlichung v1.0.86 am 2026-09-17. Nicht die archivierte Erweiterung gh copilot, die sich in einem separaten Repository befindet und deren letzter Push am 2025-10-30 erfolgteOpenAI Chat Completions, Azure OpenAI oder Anthropic, ausgewählt durch eine Anbieter-Typ-Variable neben einer Basis-URL-Variable. Keine Tarifbeschränkung für Einzelpersonen; BYOK für Organisationen und Unternehmen wurde nicht geprüftDen Coding-Agenten von GitHub gegen den eigenen Endpunkt ausführen, ohne Copilot-Sitzplatz und ohne GitHub-AnmeldungBYOK ermöglicht der CLI die Ausführung ohne GitHub-Authentifizierung, und die Authentifizierungsseite führt auf, was ohne sie nicht funktioniert: /delegate, der GitHub-MCP-Server und GitHub Code Search. Modellaufrufe funktionieren weiterhin; man kann sich anmelden und zusätzlich einen Schlüssel mitbringen, um beides zu behaltenvs. Claude Code, Einrichtung
gptmeAktiv; vom persönlichen Namespace in die gptme-Organisation verschoben, alte Pfade leiten weiter; am 2026-09-18 veröffentlichtNur für benutzerdefinierte Endpunkte OpenAI-kompatibel, über ein lokales Modellpräfix mit einer Basis-URL-Variable oder einen benannten Anbieter-Eintrag. Frei konfigurierbarEin allgemeiner Terminal-Agent mit Shell- und Browser-Werkzeugen, der durch Setzen einer Umgebungsvariable umgeleitet wirdFür einen Endpunkt, der ausschließlich Anthropic Messages unterstützt, gibt es keinen dokumentierten Anschluss; jedes andere Protokoll erfordert ein Plugin, das gegen den Anbieter-Einstiegspunkt geschrieben wird—
Open InterpreterAktiv, aber in ein anderes Programm umgeschrieben: nun eine auf Codex basierende Rust-Implementierung, Veröffentlichungen mit dem Tag rust-v0.0.44 am 2026-09-15, und der Repository-Pfad selbst wurde nach openinterpreter/openinterpreter verschobenEine TOML-Anbietertabelle, in der wire_api responses oder chat akzeptiert. Frei konfigurierbarEin bewusst auf günstige offene Modelle abgestimmtes Codex-ähnliches Harness, konfiguriert über eine AnbietertabelleDer Name bedeutet nicht mehr das, was die meisten Darstellungen damit meinen – alte Python-Konfigurationsdateien, Flags und Tutorials gelten nicht. Das dokumentierte Beispiel verwendet das Responses-Drahtprotokoll, daher muss ein ausschließlich Chat Completions unterstützender Endpunkt ausdrücklich angegeben werdenEinrichtung, vs. Claude Code, Alternativen
AmpKommerziell aktiv; ein Sourcegraph-Agent mit einer auf 2026-09-13 datierten Richtlinienankündigung. Die Tarife sind Hobby (kostenlos), Individual/Megawatt, Gigawatt, Teams und EnterpriseBeliebige benutzerdefinierte Endpunkt-URLs sind für Megawatt- und Gigawatt-Mitglieder als Early Access verfügbar und hinter einem experimentellen Feature-Schalter verborgen; die Ankündigung verspricht lediglich, dass dies bald für alle ausgerollt wird, ohne Datum. Einfaches Bring-your-own-key ist davon getrennt und weiter gefasst – dieselbe Ankündigung besagt, dass es für niemanden außer dem Enterprise-Tarif BYOK-Tokengebühren oder -limits gibt und dass jeder Amp mit eigenen Schlüsseln ohne monatliche Gebühr verwenden kannTeams, die einen kommerziellen Agenten mit leistungsfähiger Codesuche möchten, während die Tokenkosten auf dem eigenen Anbieter-Konto verbleibenKeine beliebige Basis-URL voraussetzen: Am 2026-09-18 war diese konkrete Funktion nur als Early Access verfügbarPreise, Einrichtung, vs. Claude Code
nanocodeVeröffentlicht, aber kaum gepflegt: erstellt am 2026-04-01, letzter Push am 2026-04-02, 20 SterneNur Anthropic Messages, trotz der Tabelle in der README. Die Basis-URL wird über eine Umgebungsvariable oder einen Konfigurationsbefehl gesetzt. Frei konfigurierbarLesen statt Ausführen – eine kurze Python-Codebasis, die zeigt, wie eine Agentenschleife nach dem Vorbild von Claude Code zusammengesetzt wirdDie beworbene OpenAI-Kompatibilität existiert im Code nicht: Der Client kapselt das Anthropic-SDK, daher funktioniert ein einfacher Chat-Completions-Endpunkt nicht—
QodeXAktiv, aber sehr klein: erstellt am 2026-06-11, letzter Push am 2026-08-22, 32 Sterne. Nicht mit OpenAIs Codex verbundenEin openai-Typ, der eine beliebige Basis-URL akzeptiert, ein ollama-Typ und ein anthropic-Typ mit standardmäßig aktiviertem Prompt-Caching. Die Konfiguration enthält den Namen der Schlüsselvariablen, nicht den Schlüssel. Frei konfigurierbarArbeit mit lokalem Fokus, bei der eine Konfiguration sowohl einen lokalen Server als auch einen Cloud-Endpunkt enthält, die pro Lauf über ein Profil umgeschaltet werdenSkalierung mit nur einem Maintainer, ohne Community, die eine inkompatible Änderung am Upstream auffangen könnte, und nichts davon wird zur Laufzeit von irgendjemandem verifiziert—
GoCodeAktiv, aber minimal: erstellt am 2026-07-25, letzter Commit im Standard-Branch am 2026-09-17, 5 SterneÜber neun benannte Gateways hinweg überwiegend OpenAI-ähnlich, mit Anthropic als einzigem nativen Eintrag; base_url pro Anbieter in config.toml. Frei konfigurierbarEine einzelne kleine Go-Binärdatei mit Anbieterwechsel innerhalb der Sitzung und ohne Node- oder Python-Laufzeit auf dem RechnerDie mitgelieferten Standardmodell-IDs sind bereits veraltet, daher müssen Sie sie manuell festlegen – und der Name kollidiert mit dem seit Langem etablierten Go-Daemon für Autovervollständigung—
Jan AgentVorschau: Die Dokumentation besagt, dass das Installationsprogramm aus einem Nightly-Kanal lädt. Das übergeordnete Repository ist aktiv, letzter Commit am 2026-09-18Standardmäßig OpenAI-kompatibel, Anthropic Messages über ein api-type-Flag. Flags, eine Konfigurationsdatei oder eine Umgebungsvariable. Frei konfigurierbarEin Terminal-Agent, der durch Ändern eines Flags auf einen OpenAI- oder Anthropic-ähnlichen Endpunkt ausgerichtet werden kannVorschau-Software aus einem Nightly-Kanal, daher können sich Flags und Verhalten zwischen Builds ändern und jede festgehaltene Einrichtung ist versionsspezifischEinrichtung
Junie CLIAktiv; die Dokumentationsseite für benutzerdefinierte JetBrains-Modelle trug am 18. September 2026, dem Tag der Überprüfung, diesen ZeitstempelEin JSON-Modellprofil mit einer Basis-URL, einem Schlüssel (Interpolation von Umgebungsvariablen wird unterstützt) und einem apiType, der das Format OpenAI Completions, Anthropic oder Gemini auswählt. Die BYOK-Seite besagt, dass kein JetBrains-AI-Abonnement erforderlich istJetBrains-Nutzer, die den Junie-Agenten in einem Terminal verwenden und über ihren eigenen Anbieter abrechnen möchtenDie Dokumentation beschreibt ausdrücklich die CLI und bestätigt nicht, dass dieselben Profile für das IDE-Plugin gelten; außerdem wird betont, dass das Modell leistungsfähig genug für agentische Tool-Nutzung sein mussPreise, Einrichtung, vs. Claude Code
Docker AgentAktiv, von cagent umbenannt; der alte Repository-Pfad führt zum neuen, und Präfixe älterer Umgebungsvariablen funktionieren weiterhinOpenAI Chat Completions über einen ausdrücklichen api_type mit Basis-URL und dem Namen der Schlüsselvariablen, plus native anthropic-, google- und bedrock-Anbietertypen. Frei konfigurierbarDeklarative Multi-Agent-Teams, die in YAML geschrieben und als OCI-Artefakte ausgeliefert werdenVerwirrung bei Benennung und Abrechnung: Älteres cagent-Material, die aktuellen Docker-Agent-Dokumente und die eigenen KI-Abonnementseiten von Docker beschreiben unterschiedliche Dinge—
fast-agentAktiv; Repository nicht archiviert, zum Zeitpunkt der Überprüfung mit offenen Issues und Pull RequestsEin generischer OpenAI-kompatibler Anbieter, der base_url und api_key in YAML oder ein Basis-URL-Flag für einen einzelnen Lauf akzeptiert. Native Anthropic-, OpenAI-, Google-, Azure- und DeepSeek-Pfade existieren separat. Frei konfigurierbarAufbau von MCP-nativen Agenten und Workflow-Mustern in Python, gesteuert über eine interaktive CLIEin Framework statt eines Produkts – kein gehosteter Dienst und kein kommerzieller Support – und die dokumentierten generischen Beispiele sind lokale Endpunkte; ein Remote-Endpunkt ist daher spezifikationsgemäß, aber nicht die veranschaulichte Form—
StakpakInaktiv, nicht archiviert: Apache-2.0, aber der neueste Commit im Standard-Branch ist vom 2026-07-06 und die neueste Veröffentlichung v0.3.88 vom 2026-06-10 – zum Zeitpunkt der Überprüfung seit über zwei Monaten ohne AktivitätOpenAI-kompatibel über einen api_endpoint-Schlüssel; native Anthropic- und OpenAI-Schlüssel werden ebenfalls akzeptiert. Ein Stakpak-Konto ist eine Option, keine VoraussetzungDevOps- und Infrastrukturarbeit – Kubernetes-Fehlerbehebung, CI/CD und Infrastructure as Code – mit Schutzvorkehrungen gegen destruktive BefehleBeide funktionierenden Beispiele in der README verweisen mit api_endpoint auf einen lokalen Server, daher ist der Remote-Fall spezifikationsgemäß, aber nicht die veranschaulichte Form. In Verbindung mit der oben genannten Commit-Lücke sollte man es vor der Einführung als zu prüfendes Projekt betrachten, nicht als eines in aktiver Entwicklung—
VT CodeAktiv, aber ausdrücklich experimentell und von einer Einzelperson gepflegt; die README besagt, dass sich lokale Inferenz und einige Automatisierungsabläufe zwischen Veröffentlichungen ändern könnenEin Array benutzerdefinierter OpenAI-kompatibler Anbieter in vtcode.toml mit base_url und dem Namen der Schlüsselvariablen sowie einer optionalen Anbieterliste. Frei konfigurierbarEine einzelne statische Rust-Binärdatei für Nutzer, die eine große Anbieterauswahl plus eine überprüfbare Liste zulässiger Anbieter wünschenPflege in der Freizeit durch eine Einzelperson mit selbst als experimentell bezeichneten Oberflächen, sodass die Konfigurationsstabilität zwischen Veröffentlichungen ein reales Risiko istvs. OpenCode
CodeBuddy CodeAktiv; ein Tencent-Cloud-Produkt, dessen CLI-Dokumentation auf v2.153.0 verweistOpenAI-kompatibel über ein Paar aus Basis-URL und Schlüsselvariable, präsentiert für Modelldienste von Drittanbietern. Trotz der vertrauten Benutzeroberfläche findet sich in der Dokumentation kein Anspruch auf Anthropic-Format. Keine Tarifbeschränkung für den DrittanbieterpfadEin Terminal-Workflow nach dem Vorbild von Claude Code mit isolierter Ausführung, benutzerdefinierten Sub-Agenten und HooksMehrere voneinander unabhängige Produkte tragen den Namen CodeBuddy, und der eigene Regionsschalter des Anbieters funktioniert nicht mehr, sobald die CLI auf eine Basis-URL eines Drittanbieters zeigt—
WarpAktiv; die überprüften Dokumentationsseiten tragen als Datum der letzten Aktualisierung den 16. September 2026OpenAI Chat Completions für den benutzerdefinierten Inferenzendpunkt, pro Benutzer in Free- und berechtigten kostenpflichtigen Tarifen konfiguriert. Organisationen mit mehr als zehn Mitarbeitenden benötigen Business oder Enterprise. Eine separate, nur für Enterprise verfügbare Funktion deckt native Pfade von Cloud-Anbietern abEine agentische Terminal-Oberfläche, die gegen den eigenen Endpunkt statt gegen ein gebündeltes Modellkontingent ausgeführt wirdZwei Einschränkungen greifen zusammen: die Regel zur Organisationsgröße und die zwingende Voraussetzung, dass der Endpunkt öffentlich erreichbar ist – localhost, private Netzwerkadressen und ausschließlich interne Proxys werden unmittelbar abgelehntvs. Claude Code

Editoren und IDE-Forks

Continue, Void und PearAI befinden sich im archivierten und abgelösten Abschnitt, nicht hier.

ClientLebenszyklusProtokoll-/BYOK-GrenzeAm besten geeignet fürSchlüsselbegrenzungKunavo-Seite
ZedAktiv; am 2026-09-18 veröffentlichtZwei unabhängige Einstellungsstrukturen, OpenAI-kompatibel und Anthropic-kompatibel, jeweils mit eigener api_url. Die Preisseite bietet im kostenlosen Personal-Tarif unbegrenzte Nutzung mit eigenen API-Schlüsseln, daher ist BYOK nicht kostenpflichtig. Edit prediction verfügt über eine eigene Struktur und kann ebenfalls einen OpenAI-kompatiblen Anbieter verwendenEin schneller nativer Editor, bei dem ein Schlüssel das Agenten-Panel, die Inline-Unterstützung und die Bearbeitungsvorhersage steuern kannKeine Modellerkennung: Jedes Modell wird mit eigenen Tokenlimits manuell angegeben, und ein Tippfehler führt zu einem fehlenden Modell statt zu einem Fehler. Zed als Modellanbieter und das Standardmodell für die Bearbeitungsvorhersage erfordern weiterhin eine Zed-Anmeldungvs. Cursor, Einrichtung
Theia IDEAktiv; gepusht am 2026-09-18, mit einem am selben Tag markierten Nightly-BuildOpenAI-kompatibel. Ein Präferenz-Array benutzerdefinierter Modellobjekte mit model, url, id und key. Keine Plan- oder Kontobeschränkung, aber die KI-Funktionen sind hinter einem lokalen Schalter deaktiviertEine herstellerneutrale Desktop-IDE der Eclipse Foundation, in der jeder Modellendpunkt explizit in den Einstellungen deklariert wirdKeine Modellerkennung; eine falsche url oder id schlägt unbemerkt fehl. Verwechseln Sie die herunterladbare Theia IDE nicht mit der Theia-Plattform, die andere Produkte einbetten — die obige Konfiguration gehört zur IDEEinrichtung
TwinnyAktiv; gepusht am 2026-09-18, MITOpenAI-kompatibel, über zwei verschiedene Routen: Der Chat hängt chat-completions an den konfigurierten Pfad an, während die Autovervollständigung die Legacy-completions-Route verwendet. Anbieter werden einzeln über ein Formular mit einer Testschaltfläche hinzugefügt. Frei konfigurierbarKostenlose VS-Code-Autovervollständigung plus Chat, wobei Fill-in-the-Middle und Chat absichtlich auf unterschiedliche Modelle oder sogar unterschiedliche Endpunkte verwiesen werdenChat-Kompatibilität bedeutet nicht automatisch, dass die Autovervollständigung funktioniert: Ein Endpunkt, der nur Chat-Completions bereitstellt, liefert funktionierenden Chat und toten Geistertext. Überprüfen Sie die Completions-Route und das Fill-in-the-Middle-Template separatEinrichtung, vs. Continue
QoderAktiv; eine agentische Coding-Plattform von Alibaba mit aktueller Dokumentation zu benutzerdefinierten ModellenOberflächenabhängig. Die IDE übernimmt eine Basis-URL und einen Schlüssel mit einer Auswahl für OpenAI-kompatibel (Chat-Completions oder Responses) oder Anthropic-kompatibel. Die CLI nicht: Auf der eigenen Seite zu benutzerdefinierten Modellen steht, dass BYOK nicht manuell in settings.json konfiguriert werden soll und dass verfügbare Anbieter, Modelle und Anmeldedatenfelder durch den BYOK-Katalog des Kontos festgelegt sindAgentische IDE-Arbeit mit Repository-Kontext und eigenem Schlüssel statt eines enthaltenen KontingentsIDE und CLI verwenden nicht dieselben BYOK-Regeln; daher ist eine produktweite Aussage „Qoder unterstützt benutzerdefinierte Endpunkte“ für die CLI falschEinrichtung, vs. Claude Code
DyadAktiv; Release v1.15.0 am 2026-09-11 und ein Commit am 2026-09-18Nur OpenAI-kompatibel. Fügen Sie einen benutzerdefinierten Anbieter mit ID, Anzeigenamen und Basis-URL hinzu und anschließend jedes Modell mit einer exakten Modell-ID. Dyad-Pro-Credits sind eine Alternative, keine VoraussetzungLokale Desktop-App zum Erstellen, bei der der gesamte Build-Zyklus mit dem eigenen Schlüssel ausgeführt wirdFür benutzerdefinierte Modelle müssen Ausgabe-Token- und Kontextfensterlimits manuell eingetragen werden; bleiben sie leer, verwendet die App Standardwerte, die lange Builds unbemerkt begrenzen könnenPreise, Einrichtung, vs. Lovable
bolt.diyInaktiv, nicht archiviert: letzter Commit 2026-02-07, 83 offene Issues, letzter Tag v1.0.0 am 2025-05-12OpenAI-kompatibel über einen OpenAI-ähnlichen Anbietereintrag oder ein Basis-URL-und-Schlüssel-Paar in einer lokalen Umgebungsdatei. Vollständig selbst gehostet, keine BeschränkungSelbst gehostete browserbasierte Full-Stack-App-Erstellung, bei der jeder Schlüssel in der eigenen Umgebungsdatei bleibtSeit 2026-02-07 hat niemand Code gepusht; neue Modell-IDs, Anbieterbesonderheiten und der offene Rückstand liegen daher bei Ihnen — eine heute funktionierende Einrichtung wird nicht gewartetModelle und API-Kosten, vs. Dyad und Bolt.new

Desktop-Chat- und Wissensdatenbank-Clients

Witsy befindet sich im archivierten Abschnitt; Smart Chat steht in der Tabelle ohne Endpunkt, weil dafür keine beliebige Basis-URL eines Drittanbieters dokumentiert ist.

ClientLebenszyklusProtokoll-/BYOK-GrenzeAm besten geeignet fürSchlüsselbegrenzungKunavo-Seite
Cherry StudioAktiv; gepusht am 2026-09-18. AGPL-3.0-Community-Edition mit einer separat verkauften Enterprise-Edition und einer Option für eine kommerzielle LizenzStandardmäßig OpenAI-kompatibel, wobei OpenAI Responses, Anthropic und Gemini pro Anbieter auswählbar sind. Geben Sie die Anbieterwurzel ein — die App hängt den Versionspfad selbst an, und ein abschließendes Hash-Zeichen fixiert die Adresse exakt. Frei konfigurierbarEin kostenloser Desktop-Arbeitsbereich für eine Person, die viele Anbieter, Assistenten, lokale Modelle und Dokumente verwaltetDas API-Adressfeld ist eine Wurzel, kein Endpunkt: Auf der Einstellungsseite steht, dass Cherry Studio /v1/chat/completions selbst anhängt, sofern die Adresse nicht mit # endet; das Einfügen einer vollständigen Chat-Completions-URL verdoppelt daher den Pfad. Der Pull Request, der dies entfernt hätte (#19120), wurde am 2026-09-04 ohne Merge geschlossenEinrichtung
Chatbox AIAktiv; Repository in chatboxai/chatbox umbenannt, wobei der alte Pfad weiterleitet, gepusht am 2026-09-16OpenAI-kompatible Chat-Completions für benutzerdefinierte Anbieter: Fügen Sie einen Anbieter mit API-Host, leerem API-Pfad und Schlüssel hinzu und rufen Sie anschließend die Modellliste ab. Keine PlanbeschränkungEine funktionierende Desktop-, Mobil- und Web-Lösung für Nichtentwickler, die bereits einen Schlüssel besitzen, mit Abruf der Modellliste statt manuell eingegebener Modell-IDsZwei API-Oberflächen tragen denselben Namen und weisen in entgegengesetzte Richtungen: Das Produkt stellt außerdem einen OpenAI-kompatiblen Endpunkt in einem kostenpflichtigen, nach Rechenpunkten abgerechneten Plan bereit, der nicht BYOK istEinrichtung
Jan DesktopAktiv; gepusht am 2026-09-18, neuestes Release v0.8.4 am 2026-07-23. Der ältere Organisationspfad leitet hierher weiterOpenAI-kompatibel oder Anthropic-kompatibel, pro Anbieter auswählbar. Die Basis-URL muss den vom Server erwarteten Versionspfad enthalten, und ein Schlüssel ist auch für nicht authentifizierte lokale Server erforderlich. Frei konfigurierbarFür Personen, die lokal und offline mit einer integrierten Inferenz-Engine beginnen, aber möchten, dass dieselbe App einen kostenpflichtigen Cloud-Endpunkt erreichtBenutzerdefinierte Anbieter werden nicht anhand ihrer Fähigkeiten erkannt — die App kann nicht ermitteln, ob ein Modell Tools, Vision oder Audio unterstützt; diese Funktionen müssen daher pro Modell aktiviert werden, sonst tun sie unbemerkt nichtsModelle und API-Kosten, vs. LM Studio
Msty StudioAktiv kommerziell, Closed Source ohne öffentliches Repository; der neueste Eintrag im öffentlichen Changelog ist v2.9.6 vom 2026-07-24, während der von Msty am 2026-10-01 zum Download angebotene Build 2.9.11 warOpenAI-kompatibel für benutzerdefinierte Anbieter — ein Typ „Open AI Compatible“ mit API Key und Inference Endpoint, die Bezeichnungen stammen aus dem Build 2.9.11 — und dieser Pfad ist nicht planbeschränkt. Azure- und Bedrock-Anbietertypen sind der kostenpflichtigen Stufe vorbehaltenEin ausgereifter Closed-Source-Desktop-Arbeitsbereich für jemanden, der niemals Docker ausführen wirdKeine öffentliche Commit-Historie; die Wartung stützt sich daher vollständig auf den Changelog des Anbieters. Integrierte Tool-Voreinstellungen sind anbieterspezifisch, und ein benutzerdefinierter Anbieter übernimmt sie nichtPreise, Einrichtung, vs. LM Studio und AnythingLLM
AnythingLLMAktiv; MIT, gepusht am 2026-09-17. Wird sowohl als Desktop-App als auch als selbst gehosteter Server ausgeliefertOpenAI-kompatible Chat-Completions über einen generischen Anbieter mit Basis-URL, Schlüssel, Modellname, Kontextfenster und maximalen Tokens. Bei Selbsthosting keine PlanbeschränkungDokumentabruf auf dem eigenen Rechner oder Server mit Modellauswahl pro ArbeitsbereichChat, Embeddings und Transkription werden unabhängig konfiguriert; ein Chat-Endpunkt liefert daher keine Embeddings, und eine funktionierende Retrieval-Installation benötigt einen zweiten Anbieter. Die Dokumentation weist außerdem darauf hin, dass der generische Anbieter für Entwickler gedacht istvs. Open WebUI, Einrichtung
Open WebUIAktiv; gepusht am 2026-09-18. Nicht standardmäßige Lizenz — BSD-3 plus eine Branding-Klausel für Deployments mit mehr als fünfzig Endnutzern innerhalb eines rollierenden Zeitraums von dreißig TagenOpenAI-Chat-Completions sowohl für einfache Modelle als auch für Agent-Backends: Geben Sie unter den Admin-Verbindungen eine URL und einen Schlüssel ein. Ein Modelllisten-Endpunkt wird empfohlen, ist aber optional; ohne ihn tragen Sie die Modell-IDs im Allowlist-Feld ein. Frei konfigurierbarEin selbst gehosteter Chatserver für mehrere Benutzer, der einem Endpunkt vorgeschaltet ist und als üblicher Anschluss für ein Agent-Backend dientTool-Aufrufe sind nur so gut wie die Schema-Treue des Upstreams; die Dokumentation hebt eine Kompatibilitätsschicht hervor, in der erforderliche Felder fehlen und Tool-Aufrufe unbemerkt fehlschlagenEinrichtung
LibreChatAktiv; MIT, gepusht am 2026-09-18Standardmäßig OpenAI-kompatibel; ein anthropic-Anbieterwert an einem benutzerdefinierten Endpunkt leitet stattdessen über den nativen Messages-Client. Nur über Konfigurationsdatei, mit der Basis-URL als API-Wurzel. Frei konfigurierbarSelbst gehostete Deployments für mehrere Benutzer, bei denen jeder Endpunkt eine eigene Schlüsselrichtlinie, Modell-Allowlist und Kostenabrechnung benötigtEinen Anbieter hinzuzufügen bedeutet, YAML zu bearbeiten und neu zu starten, nicht auf eine Einstellungsseite zu klicken; Tokenpreise pro Endpunkt sind Metadaten, die Sie selbst eingeben, daher sind die angezeigten Kosten nur so genau wie Ihre Eingabevs. Open WebUI, Einrichtung
LobeHubAktiv und umbenannt: Der alte Pfad des lobe-chat-Repositorys leitet nun weiter, gepusht am 2026-09-18. Neupositionierung von einem Chat-Framework zu einem Agenten-Operator. Community-Lizenz mit kommerziellen BedingungenEine benutzerdefinierte Basis-URL ist für den selbst gehosteten Einsatz dokumentiert, und die Optionen des Anbieter-SDKs stellen OpenAI- und Anthropic-Typen bereit. Ob die gehostete Cloud benutzerdefinierte Basis-URLs hinter einem kostenpflichtigen Plan beschränkt, wird in der Dokumentation nicht angegebenEin selbst gehosteter Chat- und Agenten-Arbeitsbereich mit Plugin- und MCP-Marktplatz für ein Team, das eine eigene Instanz betreibtDie Umbenennung ist live, aber das Ökosystem nicht: Anleitungen von Drittanbietern und ältere Anleitungen zu Umgebungsvariablen verwenden weiterhin den früheren Namen, und die Einrichtungsschritte haben sich mit der neuen Version geändertEinrichtung
ChatWiseAktiv kommerziell, Closed Source ohne öffentliches Repository; Dokumentation und Preisseiten wurden am 2026-09-18 veröffentlichtOpenAI-kompatibel oder Anthropic-kompatibel pro benutzerdefiniertem Anbieter, wobei Modelle von einem Modelllisten-Endpunkt abgerufen oder manuell hinzugefügt werden. Eine einmalige Pro-Lizenz ist verfügbar; ob benutzerdefinierte Anbieter in der kostenlosen Stufe funktionieren, wird auf keiner der beiden Seiten angegebenFür jemanden, der einen schnellen nativen Desktop-Client möchte, einmalig statt im Abonnement bezahlt und den eigenen Schlüssel mitbringtManuell hinzugefügte Modelle verfügen über keine automatisch erkannten Fähigkeiten — Sie deklarieren Kontextlänge, Vision, Audio und Reasoning selbst, und ein falsches Flag führt zu einer unbemerkt fehlerhaften Funktion. Die kostenlose Stufe ist für die persönliche, nichtkommerzielle Nutzung lizenziertEinrichtung, API-Kosten, vs. Chatbox
TypingMindAktiv kommerziell; wird als einmalige Lizenzpläne verkauft, während das Teamprodukt separat abgerechnet wirdDas am 2026-10-01 überprüfte Live-Formular „Add Custom Model“ bietet die API-Typen OpenAI Chat Completions, OpenAI Responses, Claude Messages und Gemini API; das Feld Endpoint URL erwartet die VOLLSTÄNDIGE Route — die offiziellen Beispiele enden mit dem Chat-Completions-Pfad. In der veröffentlichten Plantabelle nicht stufenabhängigEine ausgereifte BYOK-Chat-Oberfläche, die Sie einmal kaufen und anschließend mit Ihren eigenen Tokens versorgenBei einem als Basis-URL veröffentlichten Endpunkt muss das Suffix manuell angehängt werden. Anfragen gehen direkt vom Browser aus — die Local-AI-Seite von TypingMind sagt dies ausdrücklich — daher muss der Endpunkt CORS-Header senden; der optionale Schalter „Route requests via TypingMind Cloud“ des Formulars ist der dokumentierte Weg, dies zu umgehenEinrichtung, Preise, Alternativen
Copilot for ObsidianAktiv; Release 4.0.9 am 2026-09-16, AGPL-3.0. Die Dokumentation wurde auf eine neue Domain verschoben, und die alten Pfade leiten weiterOpenAI-kompatibel. Fügen Sie einen benutzerdefinierten Anbieter mit Basis-URL und Modell-ID hinzu sowie einen Schlüssel, wenn der Endpunkt einen benötigt. Die Dokumentation besagt, dass dafür keine Self-Host-Lizenz erforderlich ist; die kostenpflichtigen Stufen sind ein separater verwalteter PfadMit dem eigenen Schlüssel mit einem Obsidian-Tresor chatten und darin suchen, ohne ein Abonnement für den gehosteten Dienst des PluginsWenn der Verbindungstest erfolgreich ist, der Chat aber weiterhin fehlschlägt, müssen Sie die CORS-Option des Anbieters aktivieren — dadurch wird Streaming deaktiviert, sodass Antworten erst nach Abschluss statt Token für Token erscheinenEinrichtung, API-Kosten, vs. Smart Connections
NextChatAktiv, aber langsamer werdend und kommerzialisiert: letzter Commit 2026-08-11, letzter markierter Release 2025-07-29. Das Repository stellt nun einen kostenpflichtigen gehosteten Dienst in den Vordergrund, während Selbsthosting der dokumentierte Bereitstellungspfad bleibtOpenAI-kompatibel: Eine Basis-URL-Variable schreibt die OpenAI-Route um, und andere Anbieter haben eigene Variablen. Nur selbst gehostet, keine PlanbeschränkungEine selbst gehostete Chat-Oberfläche mit Ein-Klick-Bereitstellung vor einem Endpunkt, bei der eine Modellnamenvariable exakt festlegt, welche Namen Ihre Benutzer sehenDie Modell-IDs Ihres Endpunkts erscheinen erst, wenn Sie sie in dieser Variable auflisten — allein das Setzen der Basis-URL lässt Benutzer weiterhin das Standardmenü sehenEinrichtung
ChatGPTBoxAktiv; Besitz an eine Projektorganisation übertragen, wobei der alte Pfad weiterleitet, Release v2.7.1 am 2026-09-06. Eine Übertragung, keine ProduktumbenennungOpenAI-kompatibel im Modus für benutzerdefinierte Modelle, der eine benutzerdefinierte API-Adresse und einen Schlüssel akzeptiert. Frei konfigurierbarEin browserbasierter Assistent innerhalb der Seite — Auswahlaktionen, Zusammenfassungen, eine Seitenleiste mit Suchergebnissen — der auf Ihren eigenen Endpunkt verweistDie hervorgehobenen kostenlosen Modi verwenden eine angemeldete Websitzung statt Ihres Schlüssels; BYOK gilt erst, wenn Sie bewusst in den Modus für benutzerdefinierte Modelle wechseln—

Workflow-Builder

Flowise befindet sich im archivierten Abschnitt, nicht hier.

ClientLebenszyklusProtokoll-/BYOK-GrenzeAm besten geeignet fürSchlüsselbegrenzungKunavo-Seite
DifyAktiv und schnelllebig: letzter Commit 2026-09-18, Release 1.17.1 am 2026-09-10. Modifizierte Apache 2.0OpenAI-kompatibel, pro Modelltyp über ein erstklassiges Kompatibilitäts-Plugin deklariert — eine separate Plugin-Instanz für LLM, Embedding, Rerank, Speech-to-Text und Text-to-Speech. Bei Selbsthosting keine PlanbeschränkungTeams, die visuell Retrieval-Pipelines und Agenten-Workflows zusammenstellen, wobei ein Schlüssel hinter vielen Modellfeldern liegtBei Nicht-LLM-Typen hängt das Plugin die API-Version selbst an; eine Basis-URL, die bereits mit einem Versionspfad endet, erzeugt daher einen doppelten Pfad. Die Lizenz verbietet außerdem, es ohne kommerzielle Lizenz als mandantenfähigen Dienst zu betreibenEinrichtung, API-Kosten, vs. n8n
n8nAktiv; letzter Commit 2026-09-18. Fair-Code unter der Sustainable Use License, mit Enterprise-lizenzierten Dateien, die im Baum gekennzeichnet sindOpenAI-kompatibel. Die Zugangsdaten enthalten ein Basis-URL-Feld, das als Überschreibung der standardmäßigen API-Basis beschrieben wird; dies wurde direkt im Zugangsdatenquelltext und nicht nur in der Dokumentation verifiziert. Im aktuellen OpenAI-Chat-Model-Node (Version 1.3, n8n 2.41.4) ist „Use Responses API“ standardmäßig aktiviert; Anfragen gehen daher an die Responses-Route, sofern Sie die Option nicht deaktivieren. Bei Selbsthosting keine PlanbeschränkungSelbst gehostete Automatisierung, bei der ein LLM-Schritt in einem größeren Workflow sitzt und eine Änderung der Basis-URL jeden KI-Node gleichzeitig verschiebtDer Zugangsdaten-Test stellt eine Modelllisten-Anfrage an Ihre Basis-URL und prüft nur den HTTP-Status; ein Endpunkt ohne eine solche Route besteht den Test daher nicht — und eine falsche Basis-URL, die auf diesem Pfad zufällig mit 200 antwortet, besteht ihn. In der gehosteten Cloud kann derselbe Node statt Ihrer Zugangsdaten die eigenen Credits des Anbieters verwenden — bestätigen Sie, welche Option ausgewählt istEinrichtung, API-Kosten, vs. n8n
AutoGPT PlatformDas Repository ist aktiv (gepusht am 2026-09-18), aber AutoGPT Classic — der autonome Agent von 2023, den der meiste Suchverkehr meint — wird ausdrücklich nicht gewartet; die offizielle Dokumentation erklärt, dass Abhängigkeiten nicht aktualisiert und Issues nicht behoben werdenOpenAI-kompatible Chat-Completions, wobei sich die beiden Produkthälften unterscheiden. Oberflächenabhängig: Der AutoPilot-Chat-Agent übernimmt CHAT_BASE_URL bei einer selbst gehosteten Installation, und die Anleitung führt eine verwaltete OpenAI-kompatible API unter den unterstützten Formen auf. Der Provider-Helfer auf Blockebene ist das Gegenteil: eine geschlossene Anbieteraufzählung, deren OpenAI- und Anthropic-Clients ohne Basis-URL erstellt werden; der einzige vom Benutzer festlegbare Host ist ein Ollama-Host, der gegen eine Allowlist vertrauenswürdiger Hostnamen geprüft wirdEin blockbasierter visueller Builder mit Marktplatz, bei dem der danebenliegende Chat-Agent auf Ihrem eigenen Endpunkt laufen kannDie beiden Pfade lesen unterschiedliche Umgebungsvariablen; das Konfigurieren der einen konfiguriert daher nicht die andere, und die Anleitung erklärt, dass die gehostete agpt.co-Bereitstellung diese Variablen vollständig ignoriert — dies ist ein Self-Hosting-Pfad. Der Chat-Transport verweigert außerdem den Fallback auf einen vorhandenen OpenAI-Schlüssel, daher muss CHAT_API_KEY explizit gesetzt werden. Ausgeführt mit dem Single-Container-Image von v0.8.2 gegen einen Aufzeichnungs-Stub am 2026-10-01: Eine Chat-Runde und drei Tool-Roundtrips wurden abgeschlossenEinrichtung der benutzerdefinierten API, Preise, Alternativen

Ständig aktive persönliche Agenten

ClientLebenszyklusProtokoll-/BYOK-GrenzeAm besten geeignet fürSchlüsselbegrenzungKunavo-Seite
OpenClawAktiv; gepusht am 2026-09-18. Zweimal umbenannt — Clawdbot, dann Moltbot, dann OpenClaw — und beide alten Repository-Pfade verweisen weiterhin hierherEin anbieterspezifisches api-Feld wählt den Anfrageadapter neben baseUrl, apiKey und einem models-Array in JSON. Die Beispiele für benutzerdefinierte Anbieter verwenden openai-completions und anthropic-messages; die Referenz zur Gateway-Konfiguration listet elf Adapter auf, darunter openai-responses, google-generative-ai, google-vertex und bedrock-converse-stream, und setzt für eine baseUrl ohne api standardmäßig openai-completions. Das Konfigurationsschema in v2026.9.7 akzeptiert zwölf: diese elf plus google-interactions, hinzugefügt am 25. September 2026 und auf der Google-Anbieterseite dokumentiert, aber noch nicht in der Referenz. Frei konfigurierbarDer standardmäßige persönliche Allzweck-Agent, wenn Sie das größte Plugin-Ökosystem und die umfassendste Community-Abdeckung wünschenKeine Katalogerkennung: Jedes Modell muss anhand seiner ID aufgelistet werden, und contextWindow, maxTokens sowie die Kostenfelder pro Token sind optional; beim Weglassen werden Standardwerte angewendet. Lassen Sie die Kosten weg, sind die Ausgabenangaben Schätzungen; tragen Sie sie ein, spiegeln sie Ihre Eingaben statt der tatsächlich abgerechneten Werte widerPreise, Alternativen
Hermes AgentAktiv; MIT, gepusht am 2026-09-18, Release-Tag v2026.9.14Standardmäßig OpenAI-kompatibel; ein Transportfeld am benutzerdefinierten Anbieter schaltet auf Anthropic Messages um. Interaktiv oder in einer YAML-Konfiguration festlegbar. Keine Plan-, Abonnement- oder KontobeschränkungEin dauerhaft laufender persönlicher CLI-Agent mit Speicher in einer lokalen Datenbank, der über einen Endpunkt von mehreren Chat-Plattformen aus erreichbar istStandardmäßig werden OpenAI-ähnliche Chat-Completions angenommen; ein ausschließlich Anthropic-kompatibler Endpunkt benötigt daher dieses separate Transportfeld — der Fehler sieht wie ein defekter Endpunkt und nicht wie ein falsches Übertragungsformat ausPreise, vs. OpenClaw
nanobotAktiv; MIT, gepusht am 2026-09-18, veröffentlicht von HKUDS. Ein anderes, ebenfalls aktives Projekt verwendet denselben Namen an anderer Stelle — prüfen Sie die Organisation, bevor Sie einem Link folgenOpenAI-kompatibel für benutzerdefinierte und beliebig benannte Anbieter; ein Anthropic-ähnlicher Endpunkt muss stattdessen die Basis des integrierten anthropic-Anbieters überschreiben. Die Dokumentation verlangt, den Versionspfad einzuschließen. Frei konfigurierbarEin selbst gehosteter persönlicher Agent, der als Weboberfläche, Terminal oder Chat-App läuft und selbst eine OpenAI-kompatible API bereitstelltBeliebig benannte benutzerdefinierte Anbieter sind ausschließlich OpenAI-ähnlich und verwenden nicht das Anthropic-Anfrageformat; native Backends weisen das Proxy-Feld vollständig zurückvs. OpenClaw
ZeroClawAktiv; Apache-2.0, gepusht am 2026-09-18Ein wire_api-Feld wählt pro Anbieter Chat-Completions oder OpenAI Responses, während Anthropic-ähnliche Routen in einem separaten Anbieterfeld liegen. Das uri-Feld ist im benutzerdefinierten Feld erforderlich und überschreibt außerdem jede integrierte Familie. Jedes Feld kann über eine Umgebungsvariable gesetzt werden. Frei konfigurierbarEine sicherheitsorientierte Rust-Laufzeitumgebung, klein genug für günstige Hardware, mit überwachter Autonomie und Sandboxing auf BetriebssystemebeneDie Übertragungsart ändert das Verhalten, nicht nur den Transport: OpenAI-kompatible und Responses-Übertragungen können keine Anthropic-Ablehnungsmetadaten transportieren; der automatische Fallback funktioniert daher nur über das Anthropic-Feld, und Prompt-Caching über eine Chat-Completions-Route benötigt ein nicht standardmäßiges Flagvs. OpenClaw
NanoClawAktiv; MIT, zuletzt gepusht am 2026-09-17Anthropic-orientiert und auf dem Standardpfad kontogebunden: Die Standardlaufzeit ist das Claude Agent SDK, daher wird standardmäßig ein Claude-Abonnement oder ein Anthropic-Schlüssel erwartet. Jeder Anthropic-kompatible Endpunkt funktioniert über ein Paar aus Basis-URL und Token; der OpenAI-kompatible Zugriff erfolgt indirekt durch Delegation über einen SkillEine containerisolierte Alternative zu OpenClaw für Personen, die bereits mit Claude Code arbeiten, angebunden an mehrere Messaging-PlattformenEin ausschließlich für OpenAI vorgesehener Endpunkt muss über einen Delegations-Skill erreicht werden. Ein separater Codex-Provider, installiert mit /add-codex (fixiert auf @openai/codex 0.155.1), führt OpenAI-Modelle über den eigenen OpenAI-Dienst mit einem OpenAI-Schlüssel oder einer ChatGPT-Anmeldung aus; ein dort hängender Responses-WebSocket endet nach zehn Minuten mit dem Turn-Timeout von NanoClaw, reproduziert am 2026-10-01. Das Projekt liefert außerdem absichtlich keine Konfigurationsdateien aus, daher liegen BYOK-Einstellungen in einer Env-Datei und in CLI-Befehlen pro Gruppevs. OpenClaw, Codex-Timeout
PicoClawAktiv; MIT, zuletzt gepusht am 2026-09-17, veröffentlicht von Sipeed. Von Grund auf in Go geschrieben, ausdrücklich kein ForkNamensfalle: Der Provider-Wert anthropic verwendet OpenAI-kompatible Chat-Completions, während anthropic-messages die native Messages API verwendet. Ein Feld api_base überschreibt den Endpunkt, und benutzerdefinierte Header können die Autorisierung überschreiben. Frei konfigurierbarDer geringste Footprint hier — eine Go-Binärdatei mit Agent-, Gateway- und TUI-Modi, ausgelegt für dauerhaft aktive und eingebettete DeploymentsEin Endpunkt, der ausschließlich die Messages-Route bereitstellt, gibt unter dem Wert anthropic 404 zurück. Bedrock und der Azure-Identitätspfad sind nicht in der Standard-Binärdatei enthalten und erfordern einen Neubau mit Build-TagsAPI-Kosten und Einrichtung, 404-Fehler, vs. OpenClaw
IronClawAktiv; Apache-2.0, zuletzt gepusht am 2026-09-13, veröffentlicht unter der nearai-OrganisationEin generischer OpenAI-kompatibler Chat-Completions-Adapter, bei dem die Basis-URL obligatorisch ist, sowie native Anthropic-, Gemini-, Bedrock- und weitere Provider, die jeweils eine Überschreibung der Basis-URL akzeptieren. Ein Fallback über Umgebungsvariablen deckt Container und einmalige Ausführungen ab. Frei konfigurierbarEin auf Datenschutz und Sicherheit ausgerichtetes Agent-Betriebssystem mit verschlüsseltem lokalem Secret-Speicher, sandboxed Tools und progressiver Tool-OffenlegungDer generische Adapter hat keinen Standard-Host, daher muss die Basis-URL angegeben werden — jedes dokumentierte Beispiel setzt sie ausdrücklich, und keines davon ist ein gehosteter Drittanbieter-Endpunkt. Auf welcher Ebene eine fehlende Basis-URL fehlschlägt, ist in der Dokumentation nicht angegebenBenutzerdefinierte API, Kontextbudget-Fehler, vs. OpenClaw
Agent ZeroAktiv; zuletzt gepusht am 2026-09-18, erstellt am 2024-06-10 — das älteste Projekt in dieser Gruppe. Die Eigentümerschaft wechselte von einem persönlichen Konto zur agent0ai-Organisation, und der alte Pfad leitet weiterOpenAI-kompatible Chat-Completions über einen generischen Provider mit einem API-URL-Feld pro Modell und separat eingegebenem Schlüssel. Nur UI: Die Installationsanleitung dokumentiert kein Äquivalent über Konfigurationsdatei oder Umgebungsvariable. Keine PlanbeschränkungEin hackbares, promptgesteuertes Agent-Framework, das in Docker mit einer Web-UI ausgeführt wird und eher einem Framework gleicht, das man selbst gestaltet, als einem fertigen AssistentenChat-, Utility- und Embedding-Modelle werden unabhängig konfiguriert; daher erzwingt ein Endpunkt, der Chat, aber keine Embeddings bereitstellt, eine getrennte Einrichtung. Die Dokumentation warnt, dass sehr kleine Utility-Modelle bei Speicheraufgaben vollständig scheiternvs. OpenClaw
OpenManusAktiv, aber sichtbar langsamer: zuletzt gepusht am 2026-08-22, mit den neuesten Commits vom 2026-08-16. Falle bei veralteten Links — der ursprüngliche Repository-Pfad leitet NICHT weiter und verweist nun auf ein separates, unabhängiges RepositoryOpenAI-kompatible Chat-Completions, im Quellcode und nicht nur in der Dokumentation bestätigt. Ein config.toml-Block mit base_url, api_key und model; ein api_type-Feld wechselt zu Azure- oder Bedrock-Clients. Frei konfigurierbarEine offene Neuimplementierung einer General-Agent-Schleife für Forschung und Browser-Automatisierung sowie die mechanischste Konfiguration in dieser GruppeEs gibt zwei unabhängige LLM-Blöcke, einen für das Hauptmodell und einen für Vision, die jeweils ihre eigene Basis-URL und ihren eigenen Schlüssel benötigen. Die Beispielkonfiguration fixiert außerdem weiterhin eine Modell-ID aus dem Jahr 2025, die bei den meisten aktuellen Endpunkten fehlschlagen wirdAPI-Kosten und Einrichtung, Token- und Tool-Fehler
SillyTavernAktiv; AGPL-3.0, zuletzt gepusht am 2026-09-14OpenAI-kompatible Chat-Completions über eine benutzerdefinierte Completion-Quelle. Die Dokumentation sagt, dass das Suffix für Chat-Completions nicht hinzugefügt werden soll und bei fehlgeschlagener Verbindung versucht werden soll, den Versionspfad hinzuzufügen. Frei konfigurierbarLangformatiges Rollenspiel und Charakter-Chat mit starker Prompt-Steuerung — eine tatsächlich andere Zielgruppe als die Coding-Kohorte, mit anderen Kontext- und TokenmusternDer Modus zur Prompt-Nachbearbeitung ist wichtiger als der Endpunkt: Die Varianten „no tools“ entfernen Tool-Aufrufe aus dem Prompt, und Tool-Aufrufe werden unter diesen Varianten nicht unterstützt — ohne FehlermeldungBeste API, Einrichtung
Msty GoAktiv, umbenannt von Msty Claw am 2026-08-04. Closed Source; die Preisseite führt es in einem Beta-Tarif für 0 $, Team-Tarife sind als geplant gekennzeichnetUnbekannt. Die Einstellungen dokumentieren einen Typ, Anzeigenamen, eine Basis-URL, einen Schlüssel und das Verhalten der Modellliste, aber die Dokumentation listet die Typoptionen nie auf; daher ist das Wire-Format eines benutzerdefinierten Providers nicht veröffentlichtEin begrenzter Desktop-Task-Runner mit expliziten Ordnern, isolierter Ausführung und überprüfbarer ArbeitClosed Source, kostenlose Beta und eine undokumentierte Liste von Providertypen: Aus der Dokumentation lässt sich nicht bestätigen, dass ein beliebiger OpenAI-kompatibler Endpunkt funktioniert. Dies muss durch eine Installation nachgewiesen werdenEinrichtung
Page AssistAktiv; MIT, zuletzt gepusht am 2026-09-13OpenAI-kompatibel. Die Einstellungen bieten einen OpenAI-kompatiblen Tab, in dem eine Custom-Option die API-URL und den Schlüssel übernimmt. Frei konfigurierbarEin Chat in der Browser-Seitenleiste, der die aktuell geöffnete Seite lesen kann, für Personen, die niemals ein Terminal öffnen werdenEine Chat-UI als Browser-Erweiterung statt eines autonomen Agenten — keine Coding- oder Tool-Ausführungsschleife — und der Schwerpunkt liegt weiterhin auf lokalen Modellen, sodass Cloud-Pfade vergleichsweise wenig getestet werdenEinrichtung

Clients ohne dokumentierten Drittanbieter-Endpunkt

Diese drei sind ausreichend aktiv, um in Suchergebnissen zu erscheinen, aber keiner dokumentiert, dass der Client auf eine beliebige Basis-URL gerichtet werden kann. Halte hier drei verschiedene Fakten auseinander, da sie routinemäßig zu einem einzigen zusammengefasst werden: ob du deinen eigenen Vendor-Schlüssel angeben kannst, ob du deinen eigenen Endpunkt angeben kannst und ob niemand dies in irgendeiner Richtung geklärt hat. Devon akzeptiert Vendor-Schlüssel und dokumentiert kein Basis-URL-Feld; Kiro CLI akzeptiert weder das eine noch das andere — die API-Schlüssel, die in der Enterprise-Dokumentation beschrieben werden, gehören Kiro selbst und dienen dazu, die CLI in Skripten auszuführen, nicht dazu, den Schlüssel eines Modellanbieters einzubringen; Smart Chat ist planbeschränkt, und die Unterstützung beliebiger Endpunkte ist schlicht unbestätigt, was nicht dasselbe ist wie eine Ablehnung. Nur die Endpunktspalte macht einen Client von Kunavo aus erreichbar.

ClientKategorieLebenszyklusWas tatsächlich verfügbar istWas daraus für dich folgt
Kiro CLITerminalAktiv, umbenannt von Amazon Q Developer CLI (verfügbar seit 2025-11-17, automatisch aktualisiert am 2025-11-24; alte Einstiegspunkte funktionieren weiterhin). Separat enden der Support für Amazon-Q-Developer-IDE-Plugins und kostenpflichtige Abonnements am 2027-04-30; neue Anmeldungen sind ab 2026-05-15 gesperrtNichts dokumentiert. Modelle werden über Abonnementstufen bereitgestellt und über Bedrock ausgeliefert; die Modelldokumentation enthält keine Option für einen benutzerdefinierten Provider, Schlüssel oder eine Basis-URL. BYOK existiert nur in offenen Feature-AnfragenEin Drittanbieter-Endpunkt ist derzeit nicht möglich. Verwechsle dies nicht mit Kiro Crew, einem separaten Open-Source-Orchestrierungsprodukt, das auf der CLI aufbaut. Was es bietet und wann es einen Agenten mit benutzerdefiniertem Endpunkt übertrifft, wird unter Kiro CLI vs. Claude Code verglichen
DevonTerminalNicht offiziell archiviert, aber faktisch aufgegeben: Der neueste Commit des Standard-Branches datiert vom 2024-07-29, und der letzte Push des Repositorys jeglicher Art erfolgte am 2025-05-26Schlüssel ja, Endpunkt nein. Die README dokumentiert Variablen für Schlüssel pro Anbieter und einen lokalen Ollama-Pfad, enthält aber nirgendwo eine Überschreibung für base-URL oder api-baseNur historische Referenz. Der Verzeichniswert dient der Disambiguierung: Devon (Open Source, inaktiv) ist nicht Devin, ein anderes kommerzielles Produkt, das dieselben Suchergebnisse dominiert
Smart Chat (Smart Connections)Obsidian-PluginAktiv, aber in separate Produkte aufgeteilt: Der kostenlose Kern ist als semantische Suche ohne erforderlichen Schlüssel positioniert, während der Chat mit API-Modellen eine separate Erweiterung ist. Letzter Commit am 2026-09-16Planbeschränkt, und ein beliebiger Endpunkt ist nicht bestätigt. Der dokumentierte Workflow erfordert Smart Chat Pro sowie ein Modell aus einer festen Menge benannter Adapter; die einzige dokumentierte benutzerdefinierte Basis-URL gilt für eine bestimmte selbst gehostete AppBehandle die Unterstützung beliebiger Endpunkte als unbekannt und nicht als nicht vorhanden — nichts in der aktuellen Dokumentation klärt dies. Die älteren Einrichtungsseiten von Smart Connections sind ausdrücklich veraltet und sollten nicht wiederverwendet werden. Der Vergleich mit einem Client, der einen benutzerdefinierten Endpunkt akzeptiert, steht unter Copilot für Obsidian vs. Smart Connections

Außer Betrieb, archiviert und abgelöst

Diese zehn sind im Verzeichnis enthalten, damit eine Suche nach dem Namen zum Status und nicht zu einem Installationsbefehl führt. Keines davon ist derzeit eine Empfehlung.

ClientStatusWas es jetzt istWohin stattdessen wechseln
ContinueWartung eingestellt; das Repository ist nach einer letzten Version 2.0.0 der VS-Code-Erweiterung, CLI und des JetBrains-Plugins schreibgeschützt. Die eigene Website des Unternehmens erklärt, dass das Unternehmen von Cursor übernommen wurde. Letzter Commit des Standard-Branches am 2026-07-21Ein eingefrorener Coding-Agent — VS-Code-Erweiterung, CLI und JetBrains-Plugin — der weiterhin auf einen Drittanbieter-Endpunkt umgeleitet werden kann, nachdem die gebündelte Authentifizierung entfernt wurdeNur für bestehende Installationen, kein Ausgangspunkt. Mechanischer Warnhinweis für eine erneute Prüfung: Das Repository ist nicht als archiviert markiert und sein Push-Datum ändert sich weiterhin täglich, sodass eine Prüfung des Archiv-Flags es als aktiv meldet. Bestehende Einrichtungsseite
VoidArchiviert am 2026-06-02; schreibgeschützt und nimmt keine Beiträge an. Die README beginnt mit der Erklärung, dass es veraltet istEin archivierter VS-Code-Fork, den die README selbst hauptsächlich als Referenz für das Forken von VS Code empfiehltMigrieren. Die README verweist auf ein Repository mit Community-Forks; Zed und Theia sind die gepflegten Editoren in diesem Verzeichnis. Lektüre zur Migration: Alternativen zum Void-Editor
PearAIDas Editor-Repository wurde seit dem 2025-05-20 nicht mehr veröffentlicht; die neueste Aktivität irgendwo in der Organisation stammt vom 2026-06-19. Die Homepage ist aktiv und verkauft weiterhin ein Router-AbonnementEin Editor aus der Continue-Linie, dessen BYOK-Anweisungen zuletzt Ende November 2024 bearbeitet wurden und weiterhin Modelle aus dem Jahr 2024 als aktuelle Produktpalette aufführtStelle es nicht als funktionierendes BYOK-Ziel dar. Der Ablauf für benutzerdefinierte Endpunkte kann derzeit von niemandem gegen einen aktuellen Build bestätigt werden — prüfe ihn zuerst anhand einer installierten Kopie und schließe aus dem Editor-Repository allein nicht, dass das Produkt tot ist
WitsyAn einen Unternehmenseigentümer übertragen und inaktiv: Verlagerung am 2026-04-08, letzte Veröffentlichung am 2026-03-04, neuester Commit am 2026-04-09. Die Produktdomain leitet nun zum Repository weiterEin BYOK-Desktop-Assistent und MCP-Client, dessen Dokumentation korrekt, aber nicht gepflegt istKeine aktuelle Empfehlung. Wähle einen gepflegten Desktop-Client aus der obigen Tabelle
FlowiseArchiviert am 2026-08-13, zusammen mit seinen Dokumentations- und Embed-Repositories. Issues und Pull Requests sind gesperrt, und die Maintainer erklären, dass veröffentlichte Pakete als veraltet markiert werdenEine Apache-2.0-Codebasis, bei der die Maintainer den Nutzern zum Forken raten. Ob die gehostete Cloud weiterhin betrieben wird, ist weder in die eine noch in die andere Richtung angegeben, und die Marketing-Website enthält keinen ArchivhinweisNur ein Schritt zur Migration oder zum Ausstieg. Dify und n8n sind die gepflegten Workflow-Builder in diesem Verzeichnis. Lektüre zur Migration: Flowise-Alternativen, Dify vs. Flowise und Flowise vs. n8n
SWE-agentNur noch Wartung und abgelöst. Das Repository ist nicht archiviert (letzter Push am 2026-09-14), aber sowohl die README als auch die Dokumentation erklären, dass die Entwicklung verlagert wurdeWeiterhin nutzbar, um veröffentlichte Benchmark-Läufe aus einer einzigen vollständig dokumentierten YAML-Konfiguration zu reproduzierenUpstream empfiehlt mini-SWE-agent für neue Arbeiten; es befindet sich in der obigen Terminal-Tabelle
PlandexInaktiv, und die Domain wird nicht mehr aufgelöst. Letzter Push am 2025-10-03; am 2026-09-18 wurden weder die Website noch die gehostete Dokumentation aufgelöst, bestätigt durch zwei unabhängige öffentliche ResolverEin selbst gehosteter Planungsagent, dessen Website, gehostete Dokumentation und Cloud allesamt unerreichbar sind. Benutzerdefinierte Provider erforderten selbst gehostetes Hosting, selbst als die Website erreichbar war — der Cloud-BYOK-Tarif konnte nur integrierte Provider verwendenAls nicht gepflegt behandeln, bis Upstream etwas anderes mitteilt. Lektüre zur Migration: Plandex vs. Aider
Mentat (archivierte CLI)Archiviert, letzter Push am 2025-01-07. Das Repository wurde absichtlich in einen Archivpfad umbenannt, und die README beginnt mit einem Hinweis auf das archivierte ProjektEin totes Kommandozeilen-Tool. Der Name wurde neu vergeben — laut der Archiv-README bezeichnet Mentat nun ein anderes Produkt, einen gehosteten Code-Review-Bot, dessen aktueller Betriebsstatus in dieser Umgebung nicht verifiziert werden konnteInnerhalb des Projekts gibt es nichts, wohin migriert werden kann. Wähle oben einen beliebigen gepflegten Terminal-Agenten
OpenCode (archivierte Go-CLI)Archiviert, letzter Push am 2025-09-18. Die README beginnt mit dem Hinweis, dass das Projekt unter dem Namen Crush fortgeführt wurdeDas ursprüngliche Go- und TUI-OpenCode, nur zur Herkunftsdokumentation aufbewahrtCrush in der obigen Terminal-Tabelle. Verwechsle dies nicht mit dem OpenCode, das heute verwendet wird; dabei handelt es sich um ein separates TypeScript-Projekt — Kunavos bestehende OpenCode-Seiten beschreiben dieses, nicht dieses archivierte Repository. Crush vs. OpenCode erklärt die Entwicklungslinie
iFlow CLIEingestellt. Der Repository-Hinweis besagt, dass die Einstellung am 17. April 2026 erfolgen würde; dieses Datum ist verstrichen, und der Hinweis steht weiterhin oben in der READMEEin außer Betrieb genommener OpenAI-kompatibler Terminal-Agent, dessen Konfigurationsdokumentation weiterhin erreichbar ist — genau darin liegt die FalleNur Migration. Wähle oben aus der Tabelle einen gepflegten OpenAI-kompatiblen Terminal-Agenten. Lektüre zur Migration: Alternativen zur iFlow CLI

Kunavo-Verifizierungsstatus

Kein Client in diesem Verzeichnis hat in einem aufgezeichneten Test eine Anfrage über Kunavo abgeschlossen. Das ist der ehrliche Status und sollte klar ausgesprochen werden, statt ihn zu verstecken, denn diese Unterscheidung verändert, was du als Nächstes tun solltest.

StatusBedeutungWas es nicht bedeutet
Einrichtungsanleitung veröffentlichtKunavo hat Konfigurationsschritte für diesen Client verfasst, basierend auf der eigenen Dokumentation des ClientsEs bedeutet nicht, dass eine Anfrage gesendet, ein Tool-Aufruf gemessen oder der Client zertifiziert, verifiziert oder offiziell unterstützt wurde
Anfragepfade geprüftKunavo hat den Client ausgeführt oder eine Anfrage von ihm an einen lokalen Mock-Endpunkt gesendet oder einen absichtlich ungültigen Schlüssel verwendet und aufgezeichnet, was er gesendet hat und was zurückkamEs bedeutet nicht, dass eine Completion, ein Stream oder ein Tool-Aufruf über Kunavo erfolgreich war
Nicht getestetDie Protokoll- und Endpunktdetails in der Zeile stammen aus der Dokumentation, README oder dem Repository-Quellcode des Anbieters am angegebenen PrüftagEs bedeutet nicht, dass der Client fehlschlägt — nur, dass ihn hier niemand ausgeführt hat

40 von 77 Clients in diesem Verzeichnis verfügen über eine veröffentlichte Kunavo-Einrichtungsanleitung: Aider, goose, Crush, Pi, Oh My Pi, DeepSeek Harness, Factory Droid, Qwen Code, Kimi Code, OpenHands, mini-SWE-agent, Nanocoder, Mistral Vibe CLI, GitHub Copilot CLI, Open Interpreter, Amp, Jan Agent, Junie CLI, Zed, Theia IDE, twinny, Qoder, Dyad, Cherry Studio, Chatbox, Msty Studio, AnythingLLM, Open WebUI, LibreChat, LobeChat, ChatWise, TypingMind, Copilot for Obsidian, NextChat, Dify, n8n, SillyTavern, Msty Go, Page Assist und Continue. Die Anleitungen für n8n und TypingMind sind die beiden mit geprüften Anfragepfaden; die übrigen wurden anhand der Dokumentation oder des Quellcodes des jeweiligen Clients verfasst. Jede andere Zeile in diesem Verzeichnis ist ungetestet, ebenso die spezifischen Funktionen innerhalb dieser Anleitungen.

Eine praktische Konsequenz: Behandle deine erste Aufgabe mit jedem neuen Client als Verifizierungsschritt. Sende eine begrenzte Anfrage, bestätige, dass die Antwort gestreamt wird, bestätige, dass ein Tool-Aufruf zurückkehrt, und prüfe die aufgezeichnete Abbuchung, bevor du geplante oder kostenpflichtige Arbeit darauf verlagerst.

Was der Betrieb mit deinem eigenen Schlüssel kostet

Sobald ein Client auf deinen eigenen Endpunkt gerichtet ist, wird pro Token statt pro Sitzplatz abgerechnet. Zu Kunavos aktuellen Katalogpreisen führt Claude Sonnet 5 $1.40 pro Million Eingabetoken und $7.00 pro Million Ausgabetoken auf; Claude Haiku 4.5 führt $0.70 und $3.50 auf.

Eine hypothetische Agentensitzung mit 400.000 nicht zwischengespeicherten Eingabetoken und 30.000 Ausgabetoken hat eine Katalogschätzung von $0.77 auf Claude Sonnet 5 und $0.38 auf Claude Haiku 4.5. Das ist Token-Arithmetik auf Grundlage angenommener Mengen, keine gemessenen Aufgabenkosten und keine Obergrenze für eine Rechnung. Cache-Gebühren, externe Tools und vom Agenten durchgeführte Wiederholungen sind ausgeschlossen; ein Agent, der einen fehlgeschlagenen Tool-Aufruf wiederholt, bezahlt jeden Versuch.

Der günstigste aufgeführte Tarif und die niedrigsten Kosten zum Abschließen einer Aufgabe sind unterschiedliche Aussagen, und dieses Verzeichnis verspricht keine von beiden. Ein kleineres Modell mit niedrigerem Tarif kann mehr Versuche und mehr Überprüfung benötigen; vergleiche Kandidaten anhand einer Preistabelle und miss anschließend dieselbe reale Aufgabe mit zwei von ihnen. Kunavos Mindestbetrag ist eine $10-Vorauszahlung ohne Abonnement — siehe Abrechnungsdetails, um zu erfahren, wie eine Katalogschätzung mit der endgültigen Abbuchung zusammenhängt, und Preise für den aktuellen Katalog.

Weiterführende Lektüre: OpenAI-kompatible API behandelt die Endpunktstruktur, die die meisten dieser Clients erwarten, Anthropic-Basis-URL behandelt die Clients des Messages-Protokolls, und der Schnellstart bringt einen ersten Schlüssel zum Laufen. Erstelle ein Kunavo-Konto, wenn du bereit bist, einen dieser Clients gegen einen echten Endpunkt zu testen.

Häufig gestellte Fragen

Welche KI-Agent-Clients können einen benutzerdefinierten API-Endpunkt verwenden?

Die meisten Open-Source-Terminal-Agenten, die meisten selbst gehosteten Chat-Frontends und die meisten ständig aktiven persönlichen Agenten dokumentieren ein Feld für eine Base-URL ohne Anforderungen an Tarif oder Konto. Die Ausnahmen fallen in vier Gruppen: Clients, bei denen das Endpunktfeld nur auf einigen Oberflächen vorhanden ist (Factory Droid in CLI und Desktop, Qoder in der IDE, aber nicht in der CLI, OpenHands mit lokalem Backend, aber nicht mit seinem Cloud-Backend, der Chat-Agent der AutoGPT Platform bei Selbsthosting, aber nicht in der gehosteten Cloud), Clients, bei denen eine beliebige Base-URL hinter einem kostenpflichtigen oder Early-Access-Tarif liegt (benutzerdefinierte Endpunkt-URLs von Amp, Warp für Organisationen mit mehr als zehn Mitarbeitenden, Smart Chat Pro), Clients, die nur das Protokoll eines Anbieters sprechen (Gemini CLI akzeptiert eine Base-URL, sendet aber weiterhin native Gemini-Anfragen), und Clients ohne Endpunktfeld überhaupt (Kiro CLI, Devon).

Bedeutet ein dokumentierter benutzerdefinierter Endpunkt, dass jede Funktion funktioniert?

Nein. Ein Base-URL-Feld legt nur fest, wohin Anfragen gesendet werden. Tool-Aufrufe, Prompt-Caching, Fill-in-the-Middle-Autovervollständigung, Embeddings, Vision und Streaming sind separate Funktionen, die jeweils fehlschlagen können, während der Chat funktioniert. Twinny sendet Autovervollständigung an die veraltete Completions-Route statt an Chat Completions, AnythingLLM konfiguriert Embeddings als separaten Provider, SillyTavern entfernt Tool-Aufrufe bei bestimmten Modi der Prompt-Nachbearbeitung, und mehrere Clients verlangen, dass Sie Kontextfenster und Tokenpreise jedes Modells manuell eingeben. Testen Sie die konkreten Funktionen, die Sie benötigen, bevor Sie echte Arbeit verlagern.

Hat Kunavo diese Agent-Clients getestet?

Nicht durchgängig. Kein Client in diesem Verzeichnis hat in einem aufgezeichneten Test eine Anfrage über Kunavo erfolgreich abgeschlossen. Wo ein Kunavo-Einrichtungsleitfaden existiert, wurden die Konfigurationsschritte aus der eigenen Dokumentation oder dem veröffentlichten Quellcode des Clients übernommen, nicht gemessen. Zwei Einrichtungsseiten gehen einen Schritt weiter: Die Aufzeichnungen von n8n enthalten Läufe von n8n 2.41.4 gegen einen lokalen Mock-Endpunkt und gegen Kunavo mit einem ungültigen Schlüssel, und die Aufzeichnungen von TypingMind enthalten eine von typingmind.com gesendete Browseranfrage mit einem ungültigen Schlüssel — Prüfungen auf Anfrageebene, keine erfolgreichen Läufe. Jede Protokoll- und Endpunktaussage hier wurde am angegebenen Prüfdatum aus der Dokumentation, README oder dem Repository-Quellcode des Anbieters übernommen. Betrachten Sie die erste Aufgabe, die Sie mit einem neuen Client ausführen, als eigenen Verifizierungsschritt.

Mit welchen dieser Projekte sollte ich nicht beginnen?

Continue ist nach einer abschließenden Version 2.0.0 schreibgeschützt, und das Unternehmen gibt an, von Cursor übernommen worden zu sein. Void wurde am 2026-06-02 und Flowise am 2026-08-13 archiviert. iFlow CLI hat selbst den 17. April 2026 als Abschaltdatum veröffentlicht. Mentat und die Go-OpenCode-CLI sind archiviert, und SWE-agent wird nur noch gewartet, wobei Upstream stattdessen mini-SWE-agent empfiehlt. Bei Plandex gab es seit 2025-10-03 keine Repository-Aktivität mehr, und die Domain löst nicht mehr auf. Devon hat seit 2024-07-29 keinen Commit im Standard-Branch, und PearAIs Anweisungen für eigene Schlüssel wurden zuletzt im November 2024 bearbeitet. Diese Projekte gehören in ein Verzeichnis für Migration und Disambiguierung, nicht an den Anfang.

Ist der günstigste aufgeführte Modellpreis die günstigste Möglichkeit, eine Aufgabe abzuschließen?

Nicht unbedingt. Ein aufgeführter Preis pro Token und die Gesamtkosten für den Abschluss einer Arbeit sind unterschiedliche Messgrößen. Ein kleineres Modell mit niedrigerem Preis kann mehr Versuche, einen längeren Kontext oder mehr menschliche Prüfung benötigen, und ein Agent, der einen fehlgeschlagenen Tool-Aufruf wiederholt, bezahlt jeden Versuch. Vergleichen Sie eine Preisliste, um Kandidaten auszuwählen, und messen Sie dann dieselbe reale Aufgabe mit zwei Modellen, bevor Sie sich entscheiden. Kunavo veröffentlicht Katalogpreise pro Token und beginnt bei einer Prepaid-Aufladung von 10 $, ohne Abonnement.

Jeder Clientname in den obigen Tabellen verlinkt auf die eigene Dokumentationsseite, README oder Repository-Datei des Projekts, auf deren Grundlage die Zeile verfasst wurde; wenn eine Zeile zusätzlich auf einer zweiten Seite beruht — etwa auf einer separaten CLI-Dokumentation oder der Authentifizierungsseite eines Anbieters — ist diese Seite inline in der Zelle verlinkt, die die Aussage enthält. Diese Fakten wurden am 17. September 2026 zusammengetragen. Die Prüfung vom 18. September 2026 überprüfte den Lebenszyklus über die GitHub-REST-API — Archiv-Flags, Push-Daten, Commit-Daten und Weiterleitungen alter Pfade — für jede archivierte Zeile und jede Zeile ohne Endpunkt sowie für die meisten aktiven Zeilen und las die verlinkte Dokumentation für eine Auswahl der Protokoll- und Bring-your-own-Key-Zellen erneut, nicht für jede Zeile. Wenn die Marketing-Website eines Projekts und sein Repository voneinander abwichen, wurden das Repository und die eigenen Aussagen der Maintainer verwendet; die Abweichung ist in der Zeile vermerkt. Sternzahlen, Push-Daten und Tarifstrukturen sind zeitpunktabhängig und werden sich ändern — jede Lebenszykluszelle ist so formuliert, dass dieselbe Prüfung erneut durchgeführt werden kann. Am 1. Oktober 2026 wurde der Lebenszyklus für jeden Client mit öffentlichem Repository erneut über die GitHub-API geprüft, jeder Quelllink erneut geöffnet und die Zeilen für n8n, TypingMind und Msty Studio sowie die Abgrenzung von Kiro CLI anhand der Prüfungen dieses Tages korrigiert. Am selben Tag wurde die Protokollzelle für Pi anhand der aktualisierten Modellseite von Pi sowie anhand des Typs api, seiner Dispatch-Logik und der registrierten Implementierungen im Pi-Quellcode in v0.99.2 erneut geprüft und korrigiert; der Protokollfilter bildet weiterhin die vier dokumentierten Werte ab. Ebenfalls an diesem Tag korrigiert: die Protokoll- und Best-for-Zellen von Oh My Pi, erneut geprüft anhand seines docs/models.md und models.yml-Schemas in v18.4.8, sowie die Protokollzelle und der Filter von OpenClaw, erneut geprüft anhand seiner Seite für benutzerdefinierte Provider, der Gateway-Konfigurationsreferenz, der Google-Provider-Seite und des Konfigurationsschemas in v2026.9.7. Kunavo-Tokenpreise werden aus dem Live-Katalog gelesen; Kostenbeispiele sind illustrative Token-Arithmetik.