Zurück zu den Leitfäden
Preise·21. September 2026·Aktualisiert am 3. Oktober 2026·12 Min. Lesezeit

LibreChat-Preise und API-Kosten – was die Software kostet und was die Tokens kosten

MIT-Software, eine Preisseite mit 404-Fehler und eine Kostenanzeige, die deinen Traffic anhand einer mitgelieferten Tabelle bepreist.

Zuletzt überprüft am .

LibreChat kostet nichts. Es handelt sich um Software unter der MIT-Lizenz ohne Pläne, Sitze oder überhaupt eine Preisseite – librechat.ai/pricing gab 404 zurück, als diese Seite am 19. September 2026 geprüft wurde. Was ein Betreiber budgetiert, besteht aus drei getrennten Dingen: einem Ort, an dem die Software ausgeführt wird, den Modell-API-Token, die sie sendet, und optionalen Zusatzdiensten. Der Posten, der die Rechnung bestimmt, sind die Token – und die Falle besteht darin, dass der von LibreChat angezeigte Dollarbetrag anhand einer mitgelieferten Tabelle berechnet wird und nicht anhand dessen, was Ihr Anbieter tatsächlich berechnet hat.

Drei Dinge werden mit einem LibreChat-Preis verwechselt. Das erste ist die Code Interpreter API, ein separater Dienst, den das Team früher verkauft hat und dessen Store jetzt „Subscriptions Currently Unavailable“ anzeigt und keinen Betrag veröffentlicht. Das zweite ist Managed Hosting von Drittanbietern, also die Hostinggebühr dieses Anbieters. Das dritte ist ein vollständig anderes Projekt: libre-chat auf PyPI, ein ruhender Python-Chatbot von Vincent Emonet, dessen letzte Version 0.0.6 am 9. Januar 2024 hochgeladen wurde – seine Dokumentation konfiguriert dieses Projekt nicht. Verzeichnisse, die LibreChat mit Tarifstufen oder einem Angebotsformular darstellen, beschreiben einen Tarif, den das Projekt nicht verkauft.

Läuft bereits eine Instanz? Wechseln Sie zur Gateway-Konfiguration und Abrechnungsprüfung oder verwenden Sie den speziellen LibreChat-Einrichtungsleitfaden.

LibreChat-Preise, Zeile für Zeile

PositionWas es kostetQuelle
LibreChat selbst$0, MITLICENSE auf main und die About-Seite
Ein gehosteter LibreChat-TarifExistiert nicht/pricing ist ein 404; die Websitenavigation enthält keinen Link zu Pricing, Cloud oder Enterprise
Code Interpreter API (das eine kostenpflichtige Produkt)Für neue Abonnenten geschlossen; kein Preis veröffentlichtcode.librechat.ai/pricing
Code Interpreter, selbst gehosteter ErsatzSoftware für 0 $, Apache-2.0; Sie bezahlen die RechenleistungLibreChat-AI/code-interpreter
Administrationsbereich$0, AGPL-3.0LibreChat-AI/admin-panel
Agents API (Beta)0 $; eine Funktion Ihrer eigenen InstanzAgents-API-Dokumentation – hinter remoteAgents verborgen; laut Dokumentation sind Berechtigungen standardmäßig false, mit Ausnahme von Admin-Benutzern
Modell-API-TokensDer Token-Tarif Ihres AnbietersDie eigene Abrechnung Ihres Anbieters
Ein Ort, an dem die Software ausgeführt wirdDer Preis Ihres HostsLibreChat veröffentlicht kein Mindestmaß für RAM, vCPU oder Speicherplatz und keine Beispielrechnung
Verwaltetes Image eines DrittanbietersSoftwaregebühr von 0,05 $ pro Stunde zuzüglich AWS-InfrastrukturAWS-Marketplace-Eintrag von Cloud Infrastructure Services

Eine Korrektur, bevor Sie Ihre Planung auf das Projekt stützen. LibreChat wurde von ClickHouse übernommen, was am 4. November 2025 bekannt gegeben wurde; der Beitrag verpflichtet sich zur Beibehaltung der MIT-Lizenz und sagt, dass bestehende Bereitstellungen nicht betroffen sind. Das Repository ist unverändert aktiv – nicht archiviert, MIT-lizenziert und laut GitHub-API zuletzt am 21. September 2026 aktualisiert. Die Lizenzen unterscheiden sich im gesamten Stack, was relevant ist, wenn Sie weiterverteilen: Die App und die RAG-API stehen unter MIT, der Code-Interpreter-Dienst unter Apache-2.0 und das Admin Panel unter AGPL-3.0. Eine Unstimmigkeit müssen Sie selbst klären, falls die Lizenz entscheidend ist – die LICENSE-Datei und die About-Seite nennen beide MIT, während package.json in main ISC angibt. Die beiden Angaben widersprechen sich; maßgeblich ist die LICENSE-Datei. Ob ClickHouse inzwischen ein kostenpflichtiges LibreChat-Produkt verkauft, konnte diese Seite ebenfalls nicht abschließend feststellen.

Bei der Versionsfixierung gibt es eine erwähnenswerte Besonderheit. Jedes GitHub-Release-Objekt in diesem Repository ist als Pre-Release gekennzeichnet, daher liefert der Endpunkt „latest release“ überhaupt nichts zurück. Der neueste Tag ist v0.8.8-rc3 vom 15. September 2026; der neueste Tag ohne rc ist v0.8.7 vom 24. Juni 2026.

Die von LibreChat angezeigten Kosten sind nicht die von Ihnen bezahlten Kosten

Das ist der Teil, den eine Preisseite Ihnen nicht sagen kann, und der Grund, warum ein Gateway-Benutzer am Ende ein Hauptbuch haben kann, das keinen Bezug zu seinem Guthaben hat. LibreChat verwendet eine eigene interne Währung: Die Dokumentation zur Token-Nutzung legt 1.000.000 Credits auf einen US-Dollar fest. Wenn Sie den Tarif nicht selbst überschreiben, wird jede Anfrage anhand eines Tarifs in Credits umgerechnet, den LibreChat auf seiner Seite nachschlägt.

Dieser Abgleich erfolgt als Teilzeichenkettenvergleich. Der Kommentar in packages/api/src/utils/tokens.ts beschreibt die Regel eindeutig: Der Abgleich verwendet den längsten Schlüssel in der Preistabelle, der im Modellnamen enthalten ist. Und die Tabelle in packages/data-schemas/src/methods/tx.ts enthält die Listenpreise der Anbieter. Zusammengenommen bedeutet das, dass eine Gateway-Modell-ID so bepreist wird, wie es der zufällig enthaltene kürzere Schlüssel vorgibt.

Von Ihnen gesendete Modell-IDKunavo-Katalog, Ein-/Ausgabe pro 1 Mio.Passender TabellenschlüsselBelastung im Hauptbuch, pro 1 Mio. ein-/ausgehend
claude-haiku-4-5$0.70 / $3.50claude-haiku-4-5$1.00 / $5.00
gpt-5-6-terra$0.70 / $4.20gpt-5$1.25 / $10.00
claude-sonnet-4-6$2.10 / $10.50claude-sonnet-4-6$3.00 / $15.00
claude-sonnet-5$1.40 / $7.00claude-sonnet-5$2.00 / $10.00

Die linke Spalte ist der aktuelle Kunavo-Katalog; die rechte Spalte enthält LibreChats eigene Konstanten, aus main gelesen am 19. September 2026. Drei Fälle. claude-sonnet-5 passt auf sich selbst und beide Seiten stimmen überein, sodass nichts falsch aussieht – genau deshalb wird dies leicht übersehen. claude-sonnet-4-6 passt ebenfalls auf sich selbst, jedoch zum Listenpreis des Anbieters statt zum Katalogpreis, der Ihnen berechnet wird. Und gpt-5-6-terra hat keinen eigenen Eintrag: Der längste darin enthaltene Tabellenschlüssel ist gpt-5, daher belastet das Hauptbuch dieses Modell.

Wenn überhaupt nichts passt, gibt der Quellcode einen festen Fallback von 6 Credits pro Token zurück, gleichermaßen auf Eingabe und Ausgabe angewendet – 6 $ pro Million Token in beide Richtungen, deutlich über dem Eingabetarif jedes oben aufgeführten Modells. In beiden Fällen ist die Lösung dieselbe: Deklarieren Sie einen tokenConfig-Block unter Ihrem benutzerdefinierten Endpunkt. Der Code prüft diese Überschreibung vor der eigenen Tabelle, und sein Kommentar sagt genau das. Die Tarife werden als USD pro Million Token angegeben, und prompt, completion sowie context sind für jedes Modell erforderlich.

Zwei verwandte Standardwerte aus der Guthabendokumentation: Ausgabenlimits sind deaktiviert, bis Sie balance.enabled setzen, und wenn Sie sie aktivieren, beginnt ein neuer Benutzer mit 20.000 Credits – zwei US-Cent nach der eigenen Umrechnung von LibreChat. Die automatische Aufladung ist separat deaktiviert und standardmäßig auf 10.000 Credits alle 30 Tage eingestellt. Zwei weitere Angaben aus den benachbarten Seiten derselben Konfigurationsreferenz: Kostenangaben bleiben für Benutzer verborgen, bis interface.contextCost aktiviert wird, was standardmäßig false ist, und auf der Transaktionsseite steht, dass das Aktivieren von Guthaben unabhängig von der Einstellung transactions.enabled die Aufzeichnung von Transaktionen aktiviert.

Beste API für LibreChat: Welche Route gewinnt wann?

WegVorteile, wennWorauf Sie verzichten
Direkte Anbieter-APIAlle verwenden einen Anbieter und Sie möchten dessen eigenes Caching und Batch-Rabatte nutzenEin zweiter Anbieter bedeutet einen zweiten Schlüssel und einen zweiten Block für einen benutzerdefinierten Endpunkt
Ein Gateway, ein benutzerdefinierter EndpunktDie Auswahl sollte mehrere Anbieter unter einem Schlüssel und einem Guthaben bündelnModell-IDs können in LibreChats Preistabelle der falschen Zeile zugeordnet werden, daher ist tokenConfig ein einmaliger manueller Schritt
Googles kostenlose StufeEine persönliche oder Evaluierungsinstanz, bei der die Kosten null sein müssenAuf Googles Preisseite steht, dass Daten der kostenlosen Stufe zur Verbesserung seiner Produkte verwendet werden; laut kostenpflichtiger Stufe ist dies nicht der Fall
BYOK pro BenutzerJede Person sollte ihre eigene Nutzung finanzierenSetzen Sie apiKey oder baseURL auf den Literalwert user_provided; bei einer vom Benutzer bereitgestellten baseURL leitet LibreChat Ihre konfigurierten Header-Vorlagen nicht weiter
Lokales ModellPrivate oder unkritische Arbeit ohne Gebühr pro AnfrageEine Lücke bei den Fähigkeiten gegenüber gehosteten Frontier-Modellen sowie Hardware, die Sie selbst betreiben
Ein Chat-Abonnement für EndkundenFür diesen Zweck niemalsLibreChat benötigt einen API-Schlüssel. Ein Claude-Pro-Sitz für 17 $ pro Monat bei jährlicher Abrechnung oder 20 $ bei monatlicher Abrechnung versorgt LibreChat nicht

Zur Budgetorientierung am 19. September 2026 geprüfte Anbieterpreise: Anthropic nennt für Claude Sonnet 5 2 $ für Eingabe und 10 $ für Ausgabe pro Million Token, mit dem Hinweis, dass der Tarif von 2 $/10 $ nun Standard ist und eine geplante Erhöhung nicht stattfinden wird; OpenAI nennt für gpt-5 1,25 $/10 $ und für gpt-5-nano 0,05 $/0,40 $ in den Kurzkontext-Spalten seiner Standardtabelle; Google nennt für Gemini 3.8 Flash im kostenpflichtigen Tarif bis zum 31. Dezember 2026 0,75 $ für Eingabe und 3,75 $ für Ausgabe, danach 1,50 $/7,50 $, darüber hinaus gibt es eine tatsächlich kostenlose Stufe. Die Claude-Abonnementpreise stammen aus derselben Prüfung. Die ChatGPT-Abonnementpreise fehlen absichtlich: openai.com gab am Prüftag bei jedem automatisierten Abruf 403 zurück, und ein nicht verifizierter Betrag gehört nicht in ein Budget.

Günstigste API für LibreChat

Unter den gehosteten APIs ist die günstigste aufgeführte Option weder ein Gateway noch ein Rabatt. Es ist Googles kostenlose Stufe der Gemini Developer API, die für Eingabe, Ausgabe oder Kontext-Caching bei Gemini 3.8 Flash nichts berechnet – mit einem auf derselben Seite genannten Nachteil: Daten der kostenlosen Stufe werden zur Verbesserung von Googles Produkten verwendet, während dies laut kostenpflichtiger Stufe nicht der Fall ist. Grounding mit Google Search wird separat nach Nutzung abgerechnet: 5.000 kostenlose Anfragen pro Monat, gemeinsam für die Gemini-3.x-Modelle, danach 14 $ pro 1.000. Für eine persönliche LibreChat-Instanz, bei der die Kosten null sein müssen und die Inhalte nicht sensibel sind, ist das die ehrliche Antwort. Das Einzige, was darunter liegt, ist ein lokales Modell, das überhaupt keine Kosten pro Anfrage verursacht und stattdessen die Hardware kostet.

Danach sind der günstigste aufgeführte Preis und die geringsten Kosten für den Abschluss der Aufgabe unterschiedliche Aussagen, und diese Seite verspricht keinen absolut niedrigsten Preis. Ein kleines Modell, das drei Versuche für eine Zusammenfassung benötigt, kostet mehr als ein Modell der mittleren Klasse, das einen einzigen Durchlauf benötigt. In LibreChat zeigt sich der Unterschied zweimal: einmal im erneuten Versuch und einmal im Gesprächsverlauf, den dieser Versuch hinterlässt und der bei jeder späteren Runde erneut gesendet wird. Drei Gewohnheiten wirken sich stärker auf die Rechnung aus als ein Tarifvergleich. Legen Sie ein günstiges titleModel fest, damit Titel nie einen Flaggschiff-Tarif verwenden. Halten Sie die Standardmodellliste kurz, damit niemand aus Neugier das teure Modell auswählt. Und deklarieren Sie tokenConfig, damit die Zahlen, gegen die Sie optimieren, Ihre eigenen sind und nicht aus LibreChats integrierter Tabelle stammen. Dieselbe Überlegung wird ausführlicher unter KI-Kostenoptimierung behandelt.

Ein ausgearbeitetes Monatsbudget für eine LibreChat-Instanz

Dies sind veranschaulichende Token-Berechnungen, keine gemessenen Kosten und keine Obergrenze für eine Rechnung. Es gibt keine veröffentlichte Zahl dafür, wie viele Token ein LibreChat-Benutzer pro Monat verbraucht. Die folgende Form ist daher eine Annahme, die Sie durch Ihr eigenes Transkriptvolumen ersetzen sollten. Nehmen wir an, ein aktiver Benutzer sendet 120 Nachrichtenwechsel pro Monat, jeweils mit 8.000 Eingabe-Token aus dem angesammelten Verlauf und 700 Ausgabe-Token – 960k Eingabe- und 84k Ausgabe-Token. Die Tarife sind aktuelle Preise aus dem Kunavo-Katalog.

ModellEingabe / Ausgabe pro 1 Mio.Schätzung, ein Benutzer pro MonatSchätzung, 50 Benutzer pro Monat
Claude Haiku 4.5$0.70 / $3.50$0.97$48.30
GPT-5.6 Terra$0.70 / $4.20$1.02$51.24
Claude Sonnet 4.6$2.10 / $10.50$2.90$144.90
Claude Sonnet 5$1.40 / $7.00$1.93$96.60

Unterhaltungstitel sind ein separater Posten, den die meisten Budgets vergessen. Bei aktiviertem titleConvo stellt LibreChat eine eigene Anfrage zur Erzeugung jedes Titels, und titleModel bestimmt, welches Modell antwortet. Nehmen wir 40 neue Unterhaltungen pro Benutzer und Monat mit jeweils 1.200 Eingabe- und 30 Ausgabe-Token an: Für 50 Benutzer entspricht das $3.78 auf Claude Sonnet 5 gegenüber $1.89 auf Claude Haiku 4.5. Ein günstiges Titelmodell festzulegen, ist eine einzige YAML-Zeile.

Und die Abweichung in der Abrechnung aus dem vorherigen Abschnitt, in denselben Einheiten. Angenommen, dieser Monat läuft mit GPT-5.6 Terra, dessen Katalogschätzung $1.02 pro Benutzer beträgt. Ohne einen tokenConfig-Block ordnet LibreChat die ID seinem gpt-5-Eintrag zu und belastet das interne Guthaben stattdessen mit $2.04. Wenn die ID überhaupt keinem Eintrag entsprochen hätte, würde der Fallback-Tarif für dieselben 1.044 Millionen Token $6.26 belasten. Guthaben, die anhand eines unkonfigurierten Hauptbuchs festgelegt werden, sperren Benutzer viel früher, als sie das ausgeben, was Sie erwarten.

Der Betrag im Kunavo-Katalog ist eine Abrechnungsuntergrenze, keine Obergrenze: Wenn der vorgelagerte Anbieter seine Kosten meldet, wird der höhere der beiden Beträge in Rechnung gestellt: die Katalogkosten oder die Kosten des vorgelagerten Anbieters multipliziert mit dem geltenden Aufschlagsfaktor. Cache-Gebühren und die unten aufgeführten Zusatzdienste sind in diesem Beispiel nicht enthalten. Die Mindestaufladung beträgt $10 als Prepaid-Guthaben. Damit wird ein Guthaben aufgeladen, kein Tarif gekauft — siehe Details zur Abrechnung.

Bestes Modell für LibreChat: Wählen Sie danach, was der Endpunkt erreichen muss

Dafür gibt es keine offizielle Antwort, und jede Seite, die Ihnen eine Rangfolge nennt, gibt eine Meinung wieder. Was LibreChat veröffentlicht, ist eine Liste von Einschränkungen. Die Kompatibilitätsmatrix, zuletzt am 18. Juni 2026 geprüft, kennzeichnet für einen benutzerdefinierten OpenAI-kompatiblen Endpunkt Streaming, Websuche, Code Interpreter, Artefakte, Dateisuche, OCR und Memory als unterstützt – während Tools und Function Calling sowie Vision als modellabhängig gekennzeichnet sind und Bildgenerierung und MCP nur über den Agents-Endpunkt und nicht über eine einfache Chat-Unterhaltung erreichbar sind.

Damit wird die Modellauswahl zu drei konkreten Fragen. Wenn Benutzer Agents oder MCP-Tools ausführen, muss das Modell zuverlässig Tools aufrufen; die günstigste Stufe ist daher nicht automatisch nutzbar. Wenn Benutzer Screenshots oder PDFs einfügen, benötigt es Vision. Wenn nichts davon zutrifft – bei einer Instanz, die hauptsächlich zum Entwerfen und für Fragen und Antworten verwendet wird – erledigt ein Modell der mittleren Klasse die Arbeit, und das Flaggschiff ist optional. Unsere eigene Empfehlung mit offengelegter Begründung statt eines behaupteten Urteils: Legen Sie ein starkes und ein günstiges Modell in models.default ab, legen Sie das günstige als titleModel fest und lassen Sie Benutzer wechseln. Eine Auswahl mit zwei sinnvollen Optionen ist besser als eine Rangliste, die schnell veraltet.

Was niemals über Ihren Modellendpunkt läuft

Vier LibreChat-Funktionen sehen wie Modellfunktionen aus und werden vollständig an anderer Stelle abgerechnet. Wenn Sie sie als Teil Ihrer Modell-API-Ausgaben budgetieren, überschätzen Sie die Belastung durch den Endpunkt und unterschätzen zugleich die Gesamtkosten.

FunktionWer rechnet es ab?Wie wird es konfiguriert?
Code InterpreterDer von Ihnen betriebene Sandbox-Dienst oder dessen RechenleistungLIBRECHAT_CODE_BASEURL plus JWT-Authentifizierung oder LIBRECHAT_CODE_API_KEY
WebsucheSeparate Anbieter für Suche, Scraping und RerankingSerper, SearXNG, Tavily oder das schlüssellose Keenable für die Suche; Firecrawl, Tavily oder Keenable zum Abrufen; Jina oder Cohere für Reranking oder keiner
OCRDer OCR-Anbieter mit eigenem Schlüssel und eigener Basis-URLocr.apiKey und ocr.baseURL; optional, da die Funktion auf einfaches Parsen von Text zurückfällt
Dateichat-EmbeddingsWelchen Embeddings-Anbieter Sie auch in der RAG-API angebenDie eigenen RAG_OPENAI_API_KEY, RAG_OPENAI_BASEURL und EMBEDDINGS_PROVIDER der RAG-API

Bei den Embeddings muss eines klar gesagt werden: Kunavo stellt kein Embedding-Modell bereit. Daher läuft der Dateichat-Schritt von LibreChat selbst dann gegen einen externen Anbieter oder lokal, wenn Kunavo Ihren Chatverkehr verarbeitet. Ob ein anderes Gateway Embeddings bereitstellt, ist eine Frage für den eigenen Katalog dieses Gateways. Wenn es nichts kosten soll, sagt die Konfigurationsseite der RAG-API ausdrücklich, dass das standardmäßige Docker-Image die Lite-Version ist und nur Remote-Embeddings unterstützt; für lokale Embeddings muss das Image in der Compose-Datei gegen die vollständige Version ausgetauscht werden. Auch für die Websuche gibt es einen kostenlosen Weg, da Keenable sowohl für die Suche als auch für den Seitenabruf ohne Schlüssel funktioniert. Diese Seite hat die Preise der Anbieter selbst nicht geprüft, daher werden hier keine genannt.

Ein Gateway mit deklarierten Preisen anbinden

Alles Folgende folgt dem Schema für benutzerdefinierte Endpunkte, geprüft am 19. September 2026. name, apiKey, baseURL und models sind jeweils erforderlich, und der Endpunktname muss eindeutig sein und darf keinen integrierten Namen wie openAI oder anthropic wiederverwenden.

librechat.yaml
# librechat.yaml — a gateway as a custom endpoint, with prices declared.
# Schema version on main is 1.3.16; published examples still show older values.
version: 1.3.16

endpoints:
  custom:
    # The name must be unique and must not reuse a built-in endpoint name.
    - name: "Kunavo"
      apiKey: "${KUNAVO_API_KEY}"
      # LibreChat appends /chat/completions to this unless directEndpoint: true
      baseURL: "https://api.kunavo.com/v1"
      models:
        default: ["claude-sonnet-5", "gpt-5-6-terra", "claude-haiku-4-5"]
        fetch: true                        # populate the picker from GET /models
      titleConvo: true
      titleModel: "claude-haiku-4-5"          # titles do not need a flagship

      # Without this block LibreChat prices your traffic from its own table.
      # prompt/completion are USD per MILLION tokens; context is that model's
      # own window. All three are required for every model you list here.
      tokenConfig:
        claude-sonnet-5:
          prompt: 1.4
          completion: 7
          context: 1000000
        gpt-5-6-terra:
          prompt: 0.7
          completion: 4.2
          context: 1050000

Drei Dinge führen häufig zu Problemen. Erstens hängt LibreChat standardmäßig /chat/completions an Ihre Basis-URL an. Setzen Sie directEndpoint: true daher nur, wenn Ihre Basis-URL bereits der vollständige Completions-Endpunkt ist. Zweitens ist OPENAI_REVERSE_PROXY – was ältere Anleitungen für ein Gateway weiterhin empfehlen – in der Referenz für Umgebungsvariablen als veraltet gekennzeichnet; dort wird stattdessen auf einen benutzerdefinierten Endpunkt verwiesen. Drittens kann ein benutzerdefinierter Endpunkt über die native Anthropic-Messages-Protokollvariante statt über Chat Completions kommunizieren, indem provider: 'anthropic' gesetzt wird, derzeit der einzige unterstützte Wert. Dieses Feld ist im Konfigurationsschema ab Tag v0.8.7 vorhanden und in v0.8.6 nicht vorhanden; behandeln Sie es daher als v0.8.7 und neuer. Listen Sie damit Modelle ausdrücklich unter models.default auf, da der Abruf von Modellen im OpenAI-Stil auf diesem Pfad nicht verwendet wird.

Ein benutzerdefinierter Endpunktname kann laut Agents-Konfiguration auch in endpoints.agents.allowedProviders verwendet werden, sodass gateway-gestützte Modelle für LibreChat Agents nutzbar sind und nicht auf einfache Chats beschränkt bleiben.

Speichern Sie die Checkliste zur Gateway-Migration, bevor Sie Ihre funktionierende Konfiguration ändern.

Einrichtung

Kunavo veröffentlicht einen OpenAI-kompatiblen Endpunkt und mehrere Anleitungen zur Client-Einrichtung; das obige YAML folgt dem von LibreChat dokumentierten Schema. Dies ist eine Konfigurationsreferenz und kein Kompatibilitätstest: LibreChat wurde hier nicht zur Laufzeit mit dem Kunavo-Endpunkt getestet, und alle Angaben auf dieser Seite stammen aus dem Quellcode und der Dokumentation von LibreChat und nicht aus einer laufenden Instanz. Halten Sie während des Ausprobierens eine funktionierende Route verfügbar, senden Sie eine begrenzte Unterhaltung und vergleichen Sie anschließend, was Ihr Konto aufgezeichnet hat, mit dem, was LibreChats eigenes Hauptbuch meldet – die Abweichung zwischen diesen beiden Zahlen ist der gesamte Zweck des tokenConfig-Blocks.

Beginnen Sie mit dem OpenAI-kompatiblen API-Leitfaden und dem Index für Client-Integrationen und erstellen Sie ein Kunavo-Konto, sobald Sie bereit sind, einen Schlüssel aufzuladen. Wenn Sie noch eine Schnittstelle auswählen, vergleicht LibreChat vs Open WebUI beide hinsichtlich des Einrichtungsaufwands; bestes LLM-Gateway behandelt die Routing-Frage eigenständig.

Häufig gestellte Fragen

Wie viel kostet LibreChat?

Nichts. LibreChat ist MIT-lizenzierte Software ohne Tarife, Sitzplätze oder Abonnement; librechat.ai/pricing liefert HTTP 404, und die Seitennavigation enthält keinen Link zu Preisen, Cloud oder Enterprise. Was ein Betreiber bezahlt, sind der Ort, an dem die Software ausgeführt wird, die Tokens der Modell-APIs, die sie sendet, und optionale Zusatzdienste – Websuche, OCR, eine Code-Sandbox, Embeddings für Dateichats –, die jeweils getrennt von ihrem eigenen Anbieter abgerechnet werden. Verzeichnisse, die LibreChat mit Tarifstufen oder einem Angebotsformular darstellen, beschreiben ein Produkt, das nicht existiert.

Gibt es einen kostenpflichtigen LibreChat-Tarif oder eine gehostete Version?

Nicht vom Projekt selbst. Das einzige kostenpflichtige Produkt auf den eigenen Seiten des Projekts ist die Code Interpreter API unter code.librechat.ai; der dortige Store zeigt inzwischen einen Hinweis, dass Abonnements nicht verfügbar sind und keine neuen Abonnements angenommen werden; der Akquisitionsbeitrag von 2025 kündigte die Einstellung in der aktuellen Form mit dem Zieltermin 1. Mai 2026 an. Der Ersatz ist ein Apache-2.0-Sandbox-Dienst, den Sie selbst hosten und auf den Sie LibreChat verweisen. Drittanbieter verkaufen zwar verwaltetes LibreChat – ein AWS-Marketplace-Image von Cloud Infrastructure Services erhebt zusätzlich zur AWS-Infrastruktur eine Softwaregebühr von $0.05 pro Stunde –, doch das sind Hostinggebühren dieses Anbieters, nicht der Preis von LibreChat.

Was ist die beste API für LibreChat?

Das hängt davon ab, wie viele Personen die Instanz nutzen und ob Sie zwischen Modellen wechseln. Eine direkte Anbieter-API ist die beste Wahl, wenn alle die Modelle eines Anbieters nutzen und Sie dessen eigenes Caching und Batch-Rabatte möchten. Ein Gateway hinter einem einzigen benutzerdefinierten Endpunkt ist die beste Wahl, wenn die Modellauswahl mehrere Anbieter unter einem Schlüssel und einem Guthaben bündeln soll. BYOK pro Nutzer, eingerichtet durch das Schreiben des Literals user_provided in apiKey, ist die beste Wahl, wenn jede Person ihre eigene Nutzung finanzieren soll. Ein lokales Modell über Ollama ist die beste Wahl für private oder wenig kritische Arbeiten ohne Gebühr pro Anfrage. Es gibt keine offizielle LibreChat-Empfehlung. Die Kompatibilitätsmatrix legt für einen benutzerdefinierten Endpunkt strukturelle Anforderungen fest, keine anbieterbezogenen: Tools, Function Calling und Vision sind als modellabhängig gekennzeichnet, und Bildgenerierung sowie MCP sind nur über den Agents-Endpunkt erreichbar.

Was ist die günstigste API für LibreChat?

Unter den gehosteten APIs ist die günstigste aufgeführte Option Googles kostenlose Stufe der Gemini Developer API, die für Eingabe, Ausgabe oder Kontext-Caching bei Gemini 3.8 Flash nichts berechnet – mit dem ausdrücklich genannten Nachteil, dass Daten der kostenlosen Stufe zur Verbesserung von Googles Produkten verwendet werden, während dies laut kostenpflichtiger Stufe nicht der Fall ist. Ein lokales Modell verursacht überhaupt keine Kosten pro Anfrage, dafür fallen die Kosten für die von Ihnen betriebene Hardware an. Darüber hinaus sind der günstigste Preis pro Token und die geringsten Kosten für den Abschluss der Aufgabe zwei verschiedene Fragen: Ein kleines Modell, das drei Versuche für eine Zusammenfassung benötigt, kann mehr kosten als eines, das einen Versuch benötigt. Planen Sie anhand Ihres eigenen Transkriptvolumens statt nur anhand einer Preistabelle und denken Sie daran, dass Websuche, OCR und Embeddings für den Dateichat vollständig außerhalb Ihres Modellendpunkts abgerechnet werden.

Warum zeigt LibreChat für meine Modelle die falschen Kosten an?

Weil LibreChat Anfragen anhand einer mitgelieferten Tabelle bepreist und nicht anhand dessen, was Ihr Anbieter berechnet hat. Der Abgleich verwendet den längsten Eintrag in dieser Tabelle, der in Ihrer Modell-ID enthalten ist. Daher entspricht eine Gateway-ID wie gpt-5-6-terra dem Eintrag gpt-5 und wird zum Tarif dieses Eintrags belastet. Wenn überhaupt kein Eintrag passt, verwendet der Quellcode auf main einen festen Fallback-Tarif von 6 Credits pro Token, also 6 $ pro Million Token in beide Richtungen. Die Lösung ist ein tokenConfig-Block unter Ihrem benutzerdefinierten Endpunkt, der Prompt, Completion und Kontext pro Modell in USD pro Million Token festlegt; der Quellcode prüft diese Überschreibung vor der eigenen Tabelle.

Welches ist das beste Modell für LibreChat?

Wählen Sie danach aus, was der Endpunkt erreichen muss, nicht nach einer Bestenliste. Die eigene Kompatibilitätsmatrix von LibreChat kennzeichnet Tools und Function Calling sowie Vision für einen benutzerdefinierten OpenAI-kompatiblen Endpunkt als modellabhängig und leitet Bildgenerierung und MCP über den Agents-Endpunkt statt über eine einfache Chat-Unterhaltung. Eine Instanz, die Agents oder MCP-Tools ausführt, benötigt daher ein Modell, das tatsächlich Tools aufruft, und eine Instanz, in der Benutzer Screenshots einfügen, benötigt ein Vision-Modell. Legen Sie unabhängig davon ein separates günstiges Modell als titleModel fest, da Unterhaltungstitel durch eine eigene Anfrage erzeugt werden und es keinen Grund gibt, dafür einen Flaggschiff-Tarif zu bezahlen.

Hat LibreChat Nutzungslimits oder Budgets pro Benutzer?

Ja, diese sind standardmäßig deaktiviert. Wenn Sie balance.enabled auf true setzen, wird die Nachverfolgung von Token-Credits aktiviert. Die dokumentierten Standardwerte geben einem neuen Benutzer ein startBalance von 20.000 Credits, und LibreChat definiert 1.000.000 Credits als einen US-Dollar; das Anfangsguthaben entspricht daher zwei US-Cent. Die automatische Aufladung ist ein separater Schalter, standardmäßig deaktiviert, mit einem Intervall von 30 Tagen und einer Aufladung von 10.000 Credits. Die Aktivierung von Guthaben erzwingt unabhängig von der Einstellung transactions die Aufzeichnung von Transaktionen, und Kostenangaben bleiben für Benutzer verborgen, bis interface.contextCost aktiviert wird.

Überprüft am 19. September und erneut am 21. September 2026: die LibreChat-GitHub-API und die beiden LibreChat-AI-Satelliten-Repositories, der 404-Fehler auf librechat.ai/pricing, der Hinweis im Code-Interpreter-Store, der ClickHouse-Übernahmebeitrag, die Dokumentationsseiten zu benutzerdefinierten Endpunkten, Token-Nutzung, Guthaben und Kompatibilität sowie die Preistabelle und das Konfigurationsschema im Repository unter main, v0.8.6 und v0.8.7. Anthropic, OpenAI und Google: Preise, die an diesen Tagen von den jeweiligen Preislisten abgelesen wurden. Die Kunavo-Tokenpreise stammen aus dem Live-Katalog. ChatGPT-Abonnementpreise und ein etwaiger historischer API-Preis des Code Interpreter konnten nicht verifiziert werden und werden nicht angegeben. Jedes Dollarbeispiel ist hier eine illustrative Tokenberechnung und keine gemessene Rechnung.