n8n rechnet einmal pro Workflow-Ausführung ab; Ihre KI-Modell-API rechnet jeden Modellaufruf innerhalb dieser Ausführung ab. Das sind zwei getrennte Zähler, und nur der erste hat ein Kontingent. Die eigene Definition von n8n lässt keinen Spielraum: „Eine Ausführung ist ein einzelner Lauf Ihres gesamten Workflows. Es spielt keine Rolle, wie viele Schritte der Workflow enthält oder wie viele Daten er verarbeitet“ (n8n-Preisseite, geprüft am 19. September 2026). Ein AI-Agent-Node innerhalb dieser einen Ausführung kann standardmäßig bis zu zehn Modell-Roundtrips durchführen, und der OpenAI-Chat-Model-Node wiederholt einen fehlgeschlagenen Aufruf zweimal — daher kann eine einzelne Ausführung, die 1/2.500 des Kontingents eines Starter-Tarifs verbraucht, bis zu ungefähr dreißig abgerechnete Modellaufrufe enthalten.
Eine Klarstellung vor den Zahlen, da sich die Anfrage in drei Richtungen aufteilt. Die öffentliche REST API von n8n — die Workflows auflistet und auslöst — hat keinen veröffentlichten Preis pro Aufruf; laut n8n-Dokumentation ist sie während der kostenlosen Testphase nicht verfügbar und fordert Sie zu einem Upgrade auf (n8n-API-Dokumentation). Ein n8n-Tarif wird nach Ausführungen berechnet und unten ausschließlich als Gegenüberstellung der Rechnung behandelt. Die Modell-Token, die Ihre Workflows verbrauchen, sind Gegenstand dieser Seite. n8n ist aktiv und wurde nicht umbenannt: Diese Seite entnimmt sein Verhalten dem Release n8n@2.39.8, veröffentlicht am 18. September 2026, und seitdem wurden neuere Tags veröffentlicht (GitHub-Releases).
Messgröße eins: Was eine n8n-Ausführung zählt
Die Ausführungsabrechnung ist der Grund dafür, dass sich die beiden Kontingente unabhängig voneinander verändern. Ein Workflow mit hundert Nodes und ein Workflow mit zwei Nodes kosten jeweils eine Ausführung. Was variiert, ist, welche Läufe überhaupt gezählt werden.
| Ausführungstyp | Wird auf das Kontingent angerechnet? | Dokumentierte Regel |
|---|---|---|
| Schedule Trigger | Ja | Eine Ausführung jedes Mal, wenn der Node ausgelöst wird, unabhängig vom Ergebnis |
| Webhook Trigger | Ja | Eine Ausführung pro eingehender Anfrage, die den Trigger aktiviert, einschließlich eines leeren Bodys |
| Polling-Trigger | Nur wenn Daten gefunden werden | Abfragen, die keine Daten zurückgeben, werden nicht gezählt |
| Manueller Lauf aus dem Editor | Nein | Manuelle Ausführungen sind ausgeschlossen |
| Teil-Workflow über Execute Sub-workflow | Nein | Nur die übergeordnete Top-Level-Ausführung wird gezählt |
| Fehler-Workflow | Nein | Ausführungen des Fehler-Workflows sind ausgeschlossen |
Alle sechs Regeln sind der Dokumentation zu Ausführungen von n8n entnommen, geprüft am 19. September 2026. Eine Sache klärt diese Seite nicht, daher wird sie hier nicht behauptet: ob ein manueller Wiederholungsversuch einer fehlgeschlagenen Ausführung zählt. Den angrenzenden Fall klärt sie jedoch — ein Schedule Trigger zählt „unabhängig vom Ergebnis“, und eine fehlerhafte Webhook-Anfrage, die vor dem Start des Workflows fehlschlägt, zählt nicht. Beachten Sie außerdem, dass Kontingente kein reines Cloud-Konzept sind — auf derselben Seite steht, dass kostenpflichtige Pläne, ob Cloud oder selbst gehostet, ein Ausführungslimit haben.
Das Größenbeispiel, das n8n in den FAQs auf seiner Preisseite veröffentlicht, ist hilfreich: Ein täglicher Zeitplan erzeugt 30 oder 31 Ausführungen pro Monat, während ein Zeitplan mit einem Intervall von fünf Minuten etwa 8.600 bis 8.900 erzeugt. Dieselbe FAQ erklärt, dass der Verlauf gespeicherter Ausführungen separat begrenzt ist — durch die Anzahl, den Speicherplatz auf Cloud-Instanzen und ein Aufbewahrungsfenster — und dass das Erreichen eines dieser Limits die weitere Ausführung von Workflows nicht verhindert, sondern nur den aufbewahrten Verlauf verkürzt. Das sollte man auseinanderhalten, da Verlaufslimits leicht mit Ausgabenlimits verwechselt werden.
| Tarif | Veröffentlichter Preis | Ausführungen | AI-Assistant-Credits |
|---|---|---|---|
| Selbst gehostete Community-Version | Kostenlos | Kein Plan-Kontingent; Sie zahlen für Ihren eigenen Server und Betrieb | Eigenen Schlüssel verwenden, keine Credit-Obergrenze |
| Kostenlose Cloud-Testphase | Kostenlos, keine Karte erforderlich | 1.000, 5 gleichzeitig, 180-Sekunden-Timeout | 800, plus 100 AI-Credits und 20 AI-Builder-Credits |
| Cloud Starter | 20 €/Monat, jährliche Abrechnung | 2,500 | 2.300/Monat |
| Cloud Pro | 50 €/Monat, jährliche Abrechnung | 10,000 | Bis zu 13.700/Monat |
| Business | 667 €/Monat, jährliche Abrechnung | 40.000; bei Überschreitung 4.000 EUR je weitere 300.000, mit 45 Tagen Verzögerung nachträglich abgerechnet | Nicht aufgeführt |
| Startup (nur Self-hosted) | 333 €/Monat, jährliche Abrechnung | 40.000; Teilnahmeberechtigung unter 20 Mitarbeitenden und unter 5 Mio. € Finanzierung | Nicht aufgeführt |
| Cloud Enterprise | Vertrieb kontaktieren | Individuell | Nicht enthalten |
Von der n8n-Preisseite und der Startup-Plan-Seite, geprüft am 19. September 2026. Drei Einschränkungen, die diese Seite nicht beschönigen wird. Monatliche Preise ohne Jahresbindung werden auf dieser Seite nicht serverseitig dargestellt, daher wird hier keine Monatszahl genannt. Die für diese Prüfung ausgelieferten Preise waren in Euro und können geografisch aufgelöst sein; bestätigen Sie Ihre eigene Währung beim Checkout. Und die Antwort zum Überkontingent in n8ns Preis-FAQ gilt für Business und Enterprise — weder diese Seite noch die Startup-Plan-Seite sagt, was bei ausgeschöpftem Ausführungskontingent auf Starter oder Pro geschieht.
Messgröße zwei: die Modellabrechnung und die Defaults, die sie vervielfachen
Die Formel ist einfach; das Geld verschwindet bei den Defaults:
cost = production executions × model calls per execution × (input tokens × input rate + output tokens × output rate)
Der mittlere Term ist der, für den niemand budgetiert, weil n8ns Abrechnung ihn nie ausweist. Jede unten genannte Zahl wurde aus dem veröffentlichten Quellcode unter dem Tag n8n@2.39.8 abgelesen, nicht aus der Dokumentation.
| Node und Einstellung | Standard | Auswirkung auf die Abrechnung |
|---|---|---|
| AI Agent — Max Iterations | 10 | Bis zu zehn Modell-Roundtrips innerhalb einer abgerechneten Ausführung; der Kontext wächst mit jeder Runde, daher kosten spätere Iterationen mehr als frühe |
| OpenAI Chat Model — Max Retries | 2 | Bis zu drei abgerechnete Versuche pro Aufruf; ein wiederholter Aufruf, der vor dem Fehlschlagen Tokens erzeugt hat, hat Sie in der Regel bereits etwas gekostet |
| OpenAI Chat Model — Timeout | 60.000 ms | Ein langsamer Aufruf wird nach 60 s abgebrochen und anschließend wiederholt, sodass ein Timing-Problem als Kostenproblem erscheint |
| OpenAI Chat Model — Maximum Number of Tokens | -1 (unbegrenzt) | Keine Obergrenze für die Ausgabelänge, sofern Sie keine festlegen |
| Anthropic Chat Model — Max Tokens | 4,096 | Eine harte Ausgabegrenze; standardmäßig günstiger, aber lange Generierungen werden abgeschnitten, statt fortgesetzt zu werden |
| Embeddings OpenAI — Batch Size | 512 Dokumente pro Anfrage | Ein Node-Lauf kann eine sehr große Einzelanfrage senden; Kunavo stellt diesen Node überhaupt nicht bereit (siehe unten) |
Quellen, alle am 19. September 2026 gelesen: die Tools-Agent-Optionen des Agents, der OpenAI-Chat-Model-Node, der Anthropic-Chat-Model-Node und der Embeddings-OpenAI-Node. Zehn Iterationen mal drei Versuche sind eine Obergrenze, kein typischer Lauf — aber eine Obergrenze, die dreißig Modellaufrufe kostet und in Ihrem n8n-Plan trotzdem als eine Ausführung erscheint.
Eine durchgerechnete n8n-AI-API-Kostenschätzung
Dies sind veranschaulichende Tokenberechnungen, keine gemessenen Workflow-Kosten und keine Abrechnungsobergrenze. Nehmen wir eine AI-Agent-Ausführung an, die drei Modell-Roundtrips ausführt — deutlich unter der Standardobergrenze von zehn — und bei jedem 6,000 Eingabe-Tokens (System-Prompt, Tool-Schemas und ein Scratchpad, das mit jeder Runde wächst) sendet und 350 Ausgabe-Tokens empfängt. Die Preise sind aktuelle Preise aus dem Kunavo-Katalog pro eine Million Tokens; die Kontingentspalten multiplizieren lediglich mit den Starter- und Pro-Ausführungsfreigaben, damit die beiden Messgrößen nebeneinanderstehen.
| Modell | Eingabe / Ausgabe pro 1 Mio. | Pro Ausführung | × 2,500 Ausführungen | × 10,000 Ausführungen |
|---|---|---|---|---|
| Claude Haiku 4.5 | $0.70 / $3.50 | $0.0163 | $40.69 | $162.75 |
| GPT-5.6 Terra | $0.70 / $4.20 | $0.0170 | $42.52 | $170.10 |
| Claude Sonnet 5 | $1.40 / $7.00 | $0.0325 | $81.37 | $325.50 |
Zwei Betrachtungen. Erstens ist der Abstand zwischen der obersten und der untersten Zeile unter diesen Annahmen größer als die gesamte n8n-Plan-Gebühr. Deshalb streitet man vor der Modellwahl über die kleinere Zahl, wenn man über Starter oder Pro diskutiert. Zweitens ist die Iterationsobergrenze die eigentliche Varianz: Dasselbe Claude Sonnet 5 Ausführungsmodell, das bei drei Aufrufen mit $0.0325 angesetzt wird, kostet $0.3255, wenn es die vollen zehn Iterationen mit jeweils zwei Wiederholungen pro Aufruf ausführt — das Zehnfache der Kosten, ohne jede Änderung an Ihrer n8n-Ausführungsanzahl. Bei Claude Haiku 4.5 wird dieselbe Drei-Aufruf-Ausführung mit $0.0163 angesetzt.
Skalieren Sie anhand Ihrer eigenen täglichen Ausführungen, bevor Sie irgendetwas davon als Budget betrachten. Der Katalogbetrag von Kunavo ist ein Abrechnungsuntergrenze und keine Obergrenze: Wenn der Upstream seine Kosten meldet, ist die Abrechnung der höhere Wert aus den Katalogkosten und den Upstream-Kosten multipliziert mit dem anwendbaren Aufschlag. Cache-Kosten und externe Tools sind in diesem Beispiel nicht enthalten. Die minimale Kunavo-Aufladung beträgt $10 als Prepaid-Guthaben; das ist ein Finanzierungsminimum und weder ein Abonnement noch eine Gebühr pro Aufgabe — siehe Abrechnungsdetails.
n8ns „AI-Credits“ sind nicht Ihr Modellbudget
Dies ist der am häufigsten wiederholte Fehler in veröffentlichten n8n-Kostentexten, und man sollte ihn klar benennen. n8n dokumentiert drei verschiedene Credit-Guthaben, und das auf der Preisseite beworbene ist nicht dasjenige, mit dem die Modellaufrufe Ihrer Workflows bezahlt werden.
| Guthaben | Wofür es tatsächlich bezahlt | Wo es gilt |
|---|---|---|
| Gateway-Credits | AI-Modelle und von Nodes in Ihren Workflows verwendete Tool-Dienste | Nur Cloud Starter und Pro, ab n8n 2.36.0 |
| n8n-Assistant-Credits | Ihre Nutzung von n8n Assistant und dem AI Workflow Builder | Alle Cloud-Pläne außer Enterprise; die Zahlen 2.300 / bis zu 13.700 |
| Kostenlose OpenAI-API-Credits | Ein einmaliges Legacy-Kontingent für neue Cloud-Nutzer | Nur bei Instanzen ohne Gateway-Credits |
Die ersten beiden Spalten sind der Dokumentation zu Gateway-Credits von n8n entnommen, geprüft am 19. September 2026; der Geltungsbereich der Assistant-Credits stammt aus der FAQ auf der Preisseite, die besagt, dass AI Assistant in allen n8n-Cloud-Plänen außer Enterprise enthalten ist und ungenutzte Credits nicht übertragen werden. Community-Threads zu „kostenlosen OpenAI-Credits in n8n“ beschreiben das dritte, veraltete Guthaben und sollten nicht als aktuell gelesen werden.
Gateway-Credits sind wirklich praktisch: n8n leitet die Anfragen des Nodes über sein eigenes Gateway weiter und authentifiziert sich im Namen von n8n beim Anbieter, sodass ein Workflow einen Modell-Node ganz ohne Anbieter-Konto ausführen kann. Laut n8ns Seite Use Gateway credits wechselt ein Node über einen einzigen Selektor zwischen „Use Gateway credits“ und „Use my own credential“, ohne dass der Workflow neu erstellt werden muss — bei Nodes, auf denen nur ein Teil der Funktionalität unterstützt wird, werden die nicht unterstützten Vorgänge jedoch ausgeblendet, solange Gateway-Credits ausgewählt sind.
Diese Seite kann Ihnen keinen numerischen Vergleich zwischen Gateway-Credits und Kunavo liefern, und außerhalb eines Cloud-Logins kann das niemand. n8n veröffentlicht seine Gateway-Preise nur unter app.n8n.cloud/service-pricing, hinter einer Authentifizierung, und erklärt, dass die Preise je nach Modell und Dienst variieren. Eine veröffentlichte Umrechnung von Credits in Dollar gibt es nicht. Jeder Artikel, der Ihnen diese Tabelle zeigt, hat sie aus etwas anderem als einer Quelle erstellt. Was vergleichbar ist, ist die Struktur:
| Frage | n8n-Gateway-Credits | Ihr eigener Schlüssel (beliebiger Anbieter) |
|---|---|---|
| Auf Self-hosted verfügbar? | Nein — nur Cloud Starter und Pro, nicht auf Cloud Enterprise | Ja, überall; keine Planbeschränkung für das Base-URL-Feld |
| Läuft das Guthaben ab? | Aufgeladene Credits laufen 12 Monate nach dem Kauf ab | Hängt von Ihrem Anbieter ab; Kunavo-Credits laufen nicht nach 12 Monaten ab |
| Erstattungsfähig? | Aufladungen sind endgültig; ungenutzte Credits werden nicht erstattet, außer wenn das Gesetz dies verlangt | Die Bedingungen Ihres Anbieters |
| Wenn Sie das Konto schließen? | Verbleibende Credits verfallen | Die Bedingungen Ihres Anbieters |
| Wer kann aufladen? | Nur der Instanzinhaber, und ein aktives kostenpflichtiges Abonnement ist erforderlich; Testphasen können nicht aufladen | Wer das Abrechnungskonto besitzt |
| Geltungsbereich des Guthabens | Ein Guthaben pro Cloud-Instanz, von allen Nutzern gemeinsam verwendet | Pro Schlüssel oder pro Konto, je nach Ihrer Struktur |
| Wessen Anbieterkonto sieht die Prompts | Das von n8n | Ihres oder das Ihres Gateways |
Jede Zeile stammt aus derselben Dokumentation zu Gateway-Credits und ihrer Aufladeseite. Die praktische Konsequenz: Wenn Sie n8n selbst hosten, gibt es Gateway-Credits für Sie nicht, und Bring-your-own-Key ist keine Präferenz, sondern der einzige Weg.
Welche Route gewinnt und wann
| Weg | Vorteile, wenn | Worauf Sie verzichten |
|---|---|---|
| n8n-Gateway-Credits | Sie nutzen Cloud Starter oder Pro, möchten keinerlei Anbieter-Konten und schätzen eine schnelle Einrichtung höher als Preistransparenz | Self-hosted und Enterprise können es nicht verwenden; ein Prepaid-Guthaben, das nach 12 Monaten verfällt, nicht erstattungsfähig ist und bei Kontoschließung verfällt; Preise, die Sie vor der Anmeldung nicht lesen können |
| Direkte Anbieter-API | Die Modelle eines Anbieters erledigen alles, und Sie möchten das Prompt-Caching und die Batch-Rabatte dieses Anbieters nutzen | Eine zweite Modellfamilie bedeutet ein zweites Konto, einen zweiten Schlüssel und ein zweites zu überwachendes Guthaben |
| Ein OpenAI-kompatibles Gateway | Verschiedene Workflows benötigen verschiedene Modellfamilien mit einem Schlüssel und einem Guthaben, und Sie hosten selbst | Anbieterspezifische Extras hinter dem generischen Protokoll sind möglicherweise nicht erreichbar; Sie setzen die Base URL einmal pro Credential von Hand |
| Lokales Modell (Ollama-Node) | Schritte mit hohem Volumen, niedrigen Risiken und sensiblen Daten, bei denen keine Gebühr pro Anfrage akzeptabel ist | Funktionslücke gegenüber gehosteten Frontier-Modellen; Hardware und Betrieb werden zu Ihren Kosten |
Ein Budgetierungshinweis, der für die drei Zeilen mit eigenem Konto gilt: n8n setzt keine Ausgabenobergrenze für Modellaufrufe, die außerhalb von n8n abgerechnet werden. Das Ausführungskontingent begrenzt, wie oft ein Workflow startet, nicht, was in ihm geschieht. (Gateway-Credits sind die Ausnahme — das Guthaben selbst stoppt bei null, und die automatische Aufladung akzeptiert ein optionales monatliches Limit.) Wenn Sie eine harte Obergrenze möchten, muss sie von der Anbieterseite kommen — ein Prepaid-Guthaben, das bei Leerstand einfach stoppt, ist die direkteste und zuverlässigste Variante. KI-Kostenoptimierung behandelt den Rest der Methode, und das API-Verzeichnis für KI-Agenten zeigt, wie n8n neben den anderen Clients steht, die einen benutzerdefinierten Endpunkt verwenden.
Einen Drittanbieter-Endpunkt in n8n einbinden
n8n liefert keinen generischen „OpenAI-kompatiblen“ Modell-Node. Der OpenAI-Node plus eine Credential-Base-URL ist der generische Weg, und der häufigste Fehler in Anleitungen besteht darin, dieses Feld an der falschen Stelle zu suchen.
Die Base URL befindet sich im Credential, nicht im Node. Im veröffentlichten Quellcode ist die Base-URL-Option im OpenAI-Chat-Model-Node ab Node-Version 1.1 und höher ausgeblendet, und die entsprechende Option des Embeddings-Nodes ab 1.2 — bei jedem Node, den Sie heute hinzufügen, ist die Überschreibung im Node daher unsichtbar, und das Credential ist der einzige Ort, an dem sie existiert. Weder n8ns OpenAI-Credential-Seite noch seine Anthropic-Credential-Seite dokumentiert das Feld, aber beide Credentials führen es im Quellcode mit.
Credential type: OpenAI (used by the "OpenAI Chat Model" sub-node)
API Key: sk-kn-… # your Kunavo key
Base URL: https://api.kunavo.com/v1
# Then in the OpenAI Chat Model node:
Model: ID mode -> claude-sonnet-5
Options > Built-in Tools: leave OFF on a non-OpenAI endpointEin Konflikt zwischen Quellcode und Dokumentation, den Sie kennen sollten. n8ns Node-Dokumentation sagt, dass der OpenAI-Chat-Model-Node standardmäßig die Chat-Completions-API verwendet. Der veröffentlichte Quellcode unter n8n@2.39.8 sagt etwas anderes: responsesApiEnabled hat auf Node-Version 1.3 und höher default: true, sodass ein frisch hinzugefügter Node an /v1/responses statt an /v1/chat/completions sendet. Beides wird hier gezeigt, statt stillschweigend eine Variante auszuwählen; das Verhalten folgt dem ausgelieferten Code, und ein Endpunkt, der nur Chat Completions implementiert, schlägt sofort fehl, bis dieser Schalter deaktiviert wird. Kunavos /v1/responses-Route akzeptiert wie /v1/chat/completions jedes aktivierte Chat-Modell, sodass der Standardendpunkt des Nodes hier existiert und nicht mit 404 antwortet — allerdings wurde kein Workflow Ende zu Ende ausgeführt, um den Roundtrip zu bestätigen. Siehe die Chat-API-Dokumentation und den Leitfaden zur OpenAI-kompatiblen API.
Drei Grenzen, die Sie vor dem Aufbau kennen sollten.
| Grenze | Was passiert | Was zu tun ist |
|---|---|---|
| Anthropic-Credential gegenüber Kunavo | n8ns Anthropic-Credential authentifiziert sich mit x-api-key, und sowohl der Test als auch das Modell-Dropdown führen einen GET-Aufruf an /v1/models aus. Kunavo liest den Schlüssel bei jeder Route aus diesem Header, einschließlich der Modellliste, daher sollten beide antworten — das From-List-Dropdown bezeichnet jedes Modell jedoch mit einem display_name, das Kunavos Liste nicht enthält, sodass nur die IDs angezeigt werden; außerdem wird der gesamte Katalog aufgelistet, während der Anthropic-Node nur die claude--IDs verwenden kann, die /v1/messages bereitstellt | Wählen Sie eine claude--ID aus der Liste oder stellen Sie den Modellselektor auf den ID-Modus und geben Sie den Slug ein; für GPT und andere Nicht-Claude-Chatmodelle verwenden Sie den OpenAI-Chat-Model-Node mit der Kunavo-Base-URL |
| Google-Gemini-Node | Er spricht das native Protokoll von Google, das Kunavo nicht bereitstellt | Verwenden Sie den OpenAI-Chat-Model-Node für die Claude- und GPT-Slugs, die Kunavo bereitstellt |
| Embeddings-OpenAI-Node | Er berücksichtigt die Credential-Base-URL, aber Kunavo stellt kein Embedding-Modell bereit — die Route existiert, und der dahinterliegende Katalog ist leer | Halten Sie für den Embedding-Schritt jedes RAG-Workflows einen zweiten Anbieter oder ein lokal ausgeführtes Modell bereit; siehe RAG-Implementierung |
Lassen Sie außerdem die integrierten Tools des OpenAI-Nodes bei einem benutzerdefinierten Endpunkt deaktiviert. Web Search, File Search und Code Interpreter bilden diese Sammlung im veröffentlichten Quellcode; Conversation ID, Prompt Cache Key und Service Tier stehen im Abschnitt Options des Nodes daneben. Alle sechs sind Funktionen der OpenAI-Plattform; es ist nicht verifiziert, dass irgendeine davon über Kunavo funktioniert, und bei Modellen, die auf Chat übersetzt werden, können sie es nicht. n8n gibt am Node genau für diese Situation eine eigene Warnung aus: Bei der Verwendung von Nicht-OpenAI-Modellen über eine Base-URL-Überschreibung sind möglicherweise nicht alle Modelle chatkompatibel oder unterstützen andere Funktionen wie Tool-Aufrufe oder das JSON-Antwortformat.
Einrichten und die erste Abrechnung prüfen
Kunavo hat n8n nicht zur Laufzeit getestet. Hier gibt es noch keine veröffentlichte n8n-Integrationsseite, und jedes oben beschriebene n8n-Verhalten wurde aus dem veröffentlichten Quellcode unter n8n@2.39.8 und aus der eigenen Dokumentation von n8n abgeleitet — dies ist eine Konfigurationsreferenz, kein Kompatibilitätstest. Betrachten Sie den ersten Aufbau als Test: Halten Sie eine funktionierende Route bereit, führen Sie einen begrenzten Workflow mit einer kleinen Ausführungsanzahl aus und lesen Sie anschließend die von Ihrem Konto tatsächlich aufgezeichnete Abrechnung ab, statt sie aus der obigen Tabelle zu schätzen.
Wenn Sie zwischen Gateways statt zwischen Routen wählen, behandeln OpenRouter-Alternativen und der Leitfaden zu LLM-Gateways diesen Vergleich, während günstigste Claude-API speziell die Claude-Familie behandelt. Wenn Sie bereit sind, einen Schlüssel zu finanzieren, erstellen Sie ein Kunavo-Konto.
Häufig gestellte Fragen
Verursacht die n8n API Kosten?
Das hängt davon ab, welche API gemeint ist. Die eigene öffentliche REST API von n8n — die Workflows auflistet und auslöst — hat keinen veröffentlichten Preis pro Aufruf; laut n8n-Dokumentation ist sie während der kostenlosen Testphase nicht verfügbar und Sie sollten ein Upgrade durchführen, um sie zu nutzen. Die KI-Modell-APIs, die Ihre Workflows aufrufen, werden vollständig separat an den jeweiligen Anbieter des Modells bezahlt, nach Token berechnet und ohne Zusammenhang mit Ihrem n8n-Tarif. Wenn jemand nach den Kosten der n8n API fragt, ist fast immer die zweite gemeint.
Bezahlen die KI-Guthaben auf der n8n-Preisseite meine Modellaufrufe?
Nein, und das ist der häufigste Fehler bei der Beschreibung der n8n-Kosten. Die Werte 2.300 und bis zu 13.700 auf der n8n-Preisseite sind AI-Assistant-Guthaben — das Kontingent für den Workflow-Erstellungs-Copiloten und den AI Workflow Builder, monatlich erneuert und nicht übertragbar. Modellaufrufe von Nodes innerhalb Ihrer Workflows greifen auf ein anderes Guthaben namens Gateway-Guthaben zu, das n8n als separates Produkt mit eigenen Regeln für Aufladung, Ablauf und Verfügbarkeit dokumentiert. Ein drittes, veraltetes Guthaben aus kostenlosen OpenAI-Guthaben existiert nur auf Cloud-Instanzen, die kein Gateway-Guthaben haben. Drei Guthaben, drei Bedeutungen.
Welche API ist die beste für n8n?
Es gibt keinen eindeutigen Gewinner; die Antwort richtet sich nach Ihrer Bereitstellung und Ihrem Wechselverhalten. Selbst gehostetes n8n kann Gateway-Guthaben von n8n überhaupt nicht verwenden, daher gilt es definitionsgemäß als Bring-your-own-Key. Bei Cloud Starter oder Pro kaufen Gateway-Guthaben Bequemlichkeit — kein Anbieter-Konto muss eröffnet werden — zum Preis eines vorausbezahlten Guthabens, dessen Aufladeguthaben zwölf Monate nach dem Kauf abläuft, nicht erstattet wird und verfällt, wenn Sie das Konto schließen. Eine direkte Anbieter-API gewinnt, wenn die Modelle eines Anbieters alles erledigen und Sie dessen eigene Cache- und Batch-Rabatte nutzen möchten. Ein Gateway wie Kunavo oder OpenRouter gewinnt, wenn verschiedene Workflows unterschiedliche Modellfamilien mit einem Schlüssel und einem Guthaben benötigen. Ein lokales Modell gewinnt für kleine, private Schritte mit hohem Volumen, bei denen keine Gebühr pro Anfrage akzeptabel ist.
Welche API ist die günstigste für n8n?
Am günstigsten pro Token und am günstigsten für die Fertigstellung des Workflows sind zwei verschiedene Fragen. Innerhalb eines n8n-AI-Agent-Nodes entscheidet das Modell, wie viele Roundtrips die Ausführung benötigt: Die Standard-Maximale-Iterationszahl des Agenten beträgt 10, und ein schwächeres Modell, das einen Tool-Aufruf falsch formt, kann mehrere dieser Iterationen für die Wiederherstellung verbrauchen; dadurch wird sein Vorteil pro Token innerhalb einer abgerechneten Ausführung aufgehoben. Die praktische Methode besteht darin, das günstigste Modell auszuwählen, das Ihren Workflow zuverlässig abschließt, und anschließend die Belastung zu prüfen, die Ihr Anbieter-Konto für einen begrenzten Test-Batch tatsächlich aufgezeichnet hat. Kein Anbieter, auch Kunavo nicht, kann die niedrigsten Gesamtkosten für eine Aufgabe versprechen, die er nicht ausgeführt hat.
Welches KI-Modell ist das günstigste für n8n?
Für deterministische Aufgaben in einem Durchlauf — Klassifizierung, Feldextraktion, Routing, kurze Umschreibungen — ist das günstigste kleine Modell, das Ihre Genauigkeitsprüfung besteht, die richtige Wahl, da diese Schritte genau einen Modellaufruf pro Ausführung erzeugen und der Tokenpreis die gesamte Rechnung ausmacht. Bei agentischen Schritten mit Tools sollten Sie anhand abgeschlossener Ausführungen und nicht anhand der Preisliste entscheiden, da die Anzahl der Iterationen Teil der Kosten ist. Zwei strukturelle Warnungen: Eine Ausgabeobergrenze ist ebenso wichtig wie der Tarif, da der n8n-Anthropic-Chat-Model-Node die Ausgabe standardmäßig auf 4.096 Token begrenzt, während der OpenAI-Node standardmäßig ohne Limit ausgeliefert wird; außerdem sollte jedes Modell, dessen Preis auf einem vorübergehenden Einführungstarif eines Anbieters beruht, erneut geprüft werden, bevor Sie darauf ein Budget aufbauen.
Welches Modell ist am besten für n8n-Workflows?
Passen Sie das Modell an den Node an, nicht an eine Rangliste. Eine Basic LLM Chain zur Extraktion ist ein Aufruf und belohnt das günstigste ausreichend genaue Modell. Ein AI Agent mit drei oder vier Tools belohnt zuverlässige Tool-Aufrufe, da jeder fehlerhafte Aufruf eine weitere Iteration mit Kontext kostet, der mit jeder Runde wächst. Bei einem Zusammenfassungsschritt über lange Dokumente dominieren die Eingabetoken, daher ist der Eingabetarif wichtiger als der Ausgabetarif. Beachten Sie, dass diese Frage auch in einem anderen Sinn gestellt wird — welches Modell n8n-Workflow-JSON am besten schreibt —, was das Erstellen und nicht das Ausführen innerhalb eines aktiven Workflows betrifft. Diese Seite beantwortet die Frage nach den Laufzeitkosten.
Kann ich n8n auf einen benutzerdefinierten OpenAI-kompatiblen Endpunkt richten?
Ja. Im veröffentlichten n8n-Quellcode enthält der OpenAI-Anmeldedatensatz ein Feld für die Base URL mit dem Standardwert https://api.openai.com/v1, und der Anthropic-Anmeldedatensatz enthält eines mit dem Standardwert https://api.anthropic.com. Keines der beiden Felder wird auf den Dokumentationsseiten zu n8n-Anmeldedaten beschrieben, aber beide existieren im Quellcode. Bei heute hinzugefügten Nodes ist die Base-URL-Option im Node verborgen, daher gehört die Überschreibung in die Anmeldedaten. Ein Hinweis: Der Test der Anmeldedaten führt einen einfachen GET auf die Modellliste aus; daher schlägt bei einem Endpunkt, der auf derselben Anmeldedatenkonfiguration keinen solchen Aufruf beantwortet, die grüne Prüfung fehl, selbst wenn Chat-Aufrufe funktionieren würden.
n8n-Planpreise, Ausführungsregeln, Bedingungen für Gateway-Credits und API-Dokumentation geprüft am 19. September 2026; Node-Defaults und Credential-Felder aus dem veröffentlichten Quellcode unter dem Tag n8n@2.39.8 gelesen. Dass Kunavos Modellliste den Schlüssel sowohl als x-api-key als auch als Bearer-Token akzeptiert, wurde aus dem Authentifizierungscode dieses Repositorys abgeleitet, ebenso wie die Bezeichnung dieser Liste im Anthropic-Dropdown aus dem n8n-Quellcode unter demselben Tag; beides wurde nicht gegen die Live-API gemessen. Es wurde kein n8n-Workflow mit Kunavo erstellt oder ausgeführt. Kunavos Tokenpreise stammen aus dem Live-Katalog, und jede Dollarzahl auf dieser Seite ist eine veranschaulichende Tokenberechnung statt eines gemessenen Laufs.