Zurück zu den Leitfäden
Preise·21. September 2026·Aktualisiert am 1. Oktober 2026·10 Min. Lesezeit

n8n-KI-API-Kosten: eine Ausführung, viele Modellaufrufe, zwei Rechnungen

Trennen Sie die Plattformrechnung für eine Ausführung von der Modellrechnung pro Aufruf und finden Sie anschließend die n8n-Node-Standardeinstellungen, die Letztere unbemerkt vervielfachen.

Zuletzt überprüft am .

n8n rechnet einmal pro Workflow-Ausführung ab; Ihre KI-Modell-API rechnet jeden Modellaufruf innerhalb dieser Ausführung ab. Das sind zwei getrennte Zähler, und nur der erste hat ein Kontingent. Die eigene Definition von n8n lässt keinen Spielraum: „Eine Ausführung ist ein einzelner Lauf Ihres gesamten Workflows. Es spielt keine Rolle, wie viele Schritte der Workflow enthält oder wie viele Daten er verarbeitet“ (n8n-Preisseite, geprüft am 19. September 2026). Ein AI-Agent-Node innerhalb dieser einen Ausführung kann standardmäßig bis zu zehn Modell-Roundtrips durchführen, und der OpenAI-Chat-Model-Node wiederholt einen fehlgeschlagenen Aufruf zweimal — daher kann eine einzelne Ausführung, die 1/2.500 des Kontingents eines Starter-Tarifs verbraucht, bis zu ungefähr dreißig abgerechnete Modellaufrufe enthalten.

Eine Klarstellung vor den Zahlen, da sich die Anfrage in drei Richtungen aufteilt. Die öffentliche REST API von n8n — die Workflows auflistet und auslöst — hat keinen veröffentlichten Preis pro Aufruf; laut n8n-Dokumentation ist sie während der kostenlosen Testphase nicht verfügbar und fordert Sie zu einem Upgrade auf (n8n-API-Dokumentation). Ein n8n-Tarif wird nach Ausführungen berechnet und unten ausschließlich als Gegenüberstellung der Rechnung behandelt. Die Modell-Token, die Ihre Workflows verbrauchen, sind Gegenstand dieser Seite. n8n ist aktiv und wurde nicht umbenannt: Diese Seite entnimmt sein Verhalten dem Release n8n@2.39.8, veröffentlicht am 18. September 2026, und seitdem wurden neuere Tags veröffentlicht (GitHub-Releases).

Messgröße eins: Was eine n8n-Ausführung zählt

Die Ausführungsabrechnung ist der Grund dafür, dass sich die beiden Kontingente unabhängig voneinander verändern. Ein Workflow mit hundert Nodes und ein Workflow mit zwei Nodes kosten jeweils eine Ausführung. Was variiert, ist, welche Läufe überhaupt gezählt werden.

AusführungstypWird auf das Kontingent angerechnet?Dokumentierte Regel
Schedule TriggerJaEine Ausführung jedes Mal, wenn der Node ausgelöst wird, unabhängig vom Ergebnis
Webhook TriggerJaEine Ausführung pro eingehender Anfrage, die den Trigger aktiviert, einschließlich eines leeren Bodys
Polling-TriggerNur wenn Daten gefunden werdenAbfragen, die keine Daten zurückgeben, werden nicht gezählt
Manueller Lauf aus dem EditorNeinManuelle Ausführungen sind ausgeschlossen
Teil-Workflow über Execute Sub-workflowNeinNur die übergeordnete Top-Level-Ausführung wird gezählt
Fehler-WorkflowNeinAusführungen des Fehler-Workflows sind ausgeschlossen

Alle sechs Regeln sind der Dokumentation zu Ausführungen von n8n entnommen, geprüft am 19. September 2026. Eine Sache klärt diese Seite nicht, daher wird sie hier nicht behauptet: ob ein manueller Wiederholungsversuch einer fehlgeschlagenen Ausführung zählt. Den angrenzenden Fall klärt sie jedoch — ein Schedule Trigger zählt „unabhängig vom Ergebnis“, und eine fehlerhafte Webhook-Anfrage, die vor dem Start des Workflows fehlschlägt, zählt nicht. Beachten Sie außerdem, dass Kontingente kein reines Cloud-Konzept sind — auf derselben Seite steht, dass kostenpflichtige Pläne, ob Cloud oder selbst gehostet, ein Ausführungslimit haben.

Das Größenbeispiel, das n8n in den FAQs auf seiner Preisseite veröffentlicht, ist hilfreich: Ein täglicher Zeitplan erzeugt 30 oder 31 Ausführungen pro Monat, während ein Zeitplan mit einem Intervall von fünf Minuten etwa 8.600 bis 8.900 erzeugt. Dieselbe FAQ erklärt, dass der Verlauf gespeicherter Ausführungen separat begrenzt ist — durch die Anzahl, den Speicherplatz auf Cloud-Instanzen und ein Aufbewahrungsfenster — und dass das Erreichen eines dieser Limits die weitere Ausführung von Workflows nicht verhindert, sondern nur den aufbewahrten Verlauf verkürzt. Das sollte man auseinanderhalten, da Verlaufslimits leicht mit Ausgabenlimits verwechselt werden.

TarifVeröffentlichter PreisAusführungenAI-Assistant-Credits
Selbst gehostete Community-VersionKostenlosKein Plan-Kontingent; Sie zahlen für Ihren eigenen Server und BetriebEigenen Schlüssel verwenden, keine Credit-Obergrenze
Kostenlose Cloud-TestphaseKostenlos, keine Karte erforderlich1.000, 5 gleichzeitig, 180-Sekunden-Timeout800, plus 100 AI-Credits und 20 AI-Builder-Credits
Cloud Starter20 €/Monat, jährliche Abrechnung2,5002.300/Monat
Cloud Pro50 €/Monat, jährliche Abrechnung10,000Bis zu 13.700/Monat
Business667 €/Monat, jährliche Abrechnung40.000; bei Überschreitung 4.000 EUR je weitere 300.000, mit 45 Tagen Verzögerung nachträglich abgerechnetNicht aufgeführt
Startup (nur Self-hosted)333 €/Monat, jährliche Abrechnung40.000; Teilnahmeberechtigung unter 20 Mitarbeitenden und unter 5 Mio. € FinanzierungNicht aufgeführt
Cloud EnterpriseVertrieb kontaktierenIndividuellNicht enthalten

Von der n8n-Preisseite und der Startup-Plan-Seite, geprüft am 19. September 2026. Drei Einschränkungen, die diese Seite nicht beschönigen wird. Monatliche Preise ohne Jahresbindung werden auf dieser Seite nicht serverseitig dargestellt, daher wird hier keine Monatszahl genannt. Die für diese Prüfung ausgelieferten Preise waren in Euro und können geografisch aufgelöst sein; bestätigen Sie Ihre eigene Währung beim Checkout. Und die Antwort zum Überkontingent in n8ns Preis-FAQ gilt für Business und Enterprise — weder diese Seite noch die Startup-Plan-Seite sagt, was bei ausgeschöpftem Ausführungskontingent auf Starter oder Pro geschieht.

Messgröße zwei: die Modellabrechnung und die Defaults, die sie vervielfachen

Die Formel ist einfach; das Geld verschwindet bei den Defaults:

cost = production executions × model calls per execution × (input tokens × input rate + output tokens × output rate)

Der mittlere Term ist der, für den niemand budgetiert, weil n8ns Abrechnung ihn nie ausweist. Jede unten genannte Zahl wurde aus dem veröffentlichten Quellcode unter dem Tag n8n@2.39.8 abgelesen, nicht aus der Dokumentation.

Node und EinstellungStandardAuswirkung auf die Abrechnung
AI Agent — Max Iterations10Bis zu zehn Modell-Roundtrips innerhalb einer abgerechneten Ausführung; der Kontext wächst mit jeder Runde, daher kosten spätere Iterationen mehr als frühe
OpenAI Chat Model — Max Retries2Bis zu drei abgerechnete Versuche pro Aufruf; ein wiederholter Aufruf, der vor dem Fehlschlagen Tokens erzeugt hat, hat Sie in der Regel bereits etwas gekostet
OpenAI Chat Model — Timeout60.000 msEin langsamer Aufruf wird nach 60 s abgebrochen und anschließend wiederholt, sodass ein Timing-Problem als Kostenproblem erscheint
OpenAI Chat Model — Maximum Number of Tokens-1 (unbegrenzt)Keine Obergrenze für die Ausgabelänge, sofern Sie keine festlegen
Anthropic Chat Model — Max Tokens4,096Eine harte Ausgabegrenze; standardmäßig günstiger, aber lange Generierungen werden abgeschnitten, statt fortgesetzt zu werden
Embeddings OpenAI — Batch Size512 Dokumente pro AnfrageEin Node-Lauf kann eine sehr große Einzelanfrage senden; Kunavo stellt diesen Node überhaupt nicht bereit (siehe unten)

Quellen, alle am 19. September 2026 gelesen: die Tools-Agent-Optionen des Agents, der OpenAI-Chat-Model-Node, der Anthropic-Chat-Model-Node und der Embeddings-OpenAI-Node. Zehn Iterationen mal drei Versuche sind eine Obergrenze, kein typischer Lauf — aber eine Obergrenze, die dreißig Modellaufrufe kostet und in Ihrem n8n-Plan trotzdem als eine Ausführung erscheint.

Eine durchgerechnete n8n-AI-API-Kostenschätzung

Dies sind veranschaulichende Tokenberechnungen, keine gemessenen Workflow-Kosten und keine Abrechnungsobergrenze. Nehmen wir eine AI-Agent-Ausführung an, die drei Modell-Roundtrips ausführt — deutlich unter der Standardobergrenze von zehn — und bei jedem 6,000 Eingabe-Tokens (System-Prompt, Tool-Schemas und ein Scratchpad, das mit jeder Runde wächst) sendet und 350 Ausgabe-Tokens empfängt. Die Preise sind aktuelle Preise aus dem Kunavo-Katalog pro eine Million Tokens; die Kontingentspalten multiplizieren lediglich mit den Starter- und Pro-Ausführungsfreigaben, damit die beiden Messgrößen nebeneinanderstehen.

ModellEingabe / Ausgabe pro 1 Mio.Pro Ausführung× 2,500 Ausführungen× 10,000 Ausführungen
Claude Haiku 4.5$0.70 / $3.50$0.0163$40.69$162.75
GPT-5.6 Terra$0.70 / $4.20$0.0170$42.52$170.10
Claude Sonnet 5$1.40 / $7.00$0.0325$81.37$325.50

Zwei Betrachtungen. Erstens ist der Abstand zwischen der obersten und der untersten Zeile unter diesen Annahmen größer als die gesamte n8n-Plan-Gebühr. Deshalb streitet man vor der Modellwahl über die kleinere Zahl, wenn man über Starter oder Pro diskutiert. Zweitens ist die Iterationsobergrenze die eigentliche Varianz: Dasselbe Claude Sonnet 5 Ausführungsmodell, das bei drei Aufrufen mit $0.0325 angesetzt wird, kostet $0.3255, wenn es die vollen zehn Iterationen mit jeweils zwei Wiederholungen pro Aufruf ausführt — das Zehnfache der Kosten, ohne jede Änderung an Ihrer n8n-Ausführungsanzahl. Bei Claude Haiku 4.5 wird dieselbe Drei-Aufruf-Ausführung mit $0.0163 angesetzt.

Skalieren Sie anhand Ihrer eigenen täglichen Ausführungen, bevor Sie irgendetwas davon als Budget betrachten. Der Katalogbetrag von Kunavo ist ein Abrechnungsuntergrenze und keine Obergrenze: Wenn der Upstream seine Kosten meldet, ist die Abrechnung der höhere Wert aus den Katalogkosten und den Upstream-Kosten multipliziert mit dem anwendbaren Aufschlag. Cache-Kosten und externe Tools sind in diesem Beispiel nicht enthalten. Die minimale Kunavo-Aufladung beträgt $10 als Prepaid-Guthaben; das ist ein Finanzierungsminimum und weder ein Abonnement noch eine Gebühr pro Aufgabe — siehe Abrechnungsdetails.

n8ns „AI-Credits“ sind nicht Ihr Modellbudget

Dies ist der am häufigsten wiederholte Fehler in veröffentlichten n8n-Kostentexten, und man sollte ihn klar benennen. n8n dokumentiert drei verschiedene Credit-Guthaben, und das auf der Preisseite beworbene ist nicht dasjenige, mit dem die Modellaufrufe Ihrer Workflows bezahlt werden.

GuthabenWofür es tatsächlich bezahltWo es gilt
Gateway-CreditsAI-Modelle und von Nodes in Ihren Workflows verwendete Tool-DiensteNur Cloud Starter und Pro, ab n8n 2.36.0
n8n-Assistant-CreditsIhre Nutzung von n8n Assistant und dem AI Workflow BuilderAlle Cloud-Pläne außer Enterprise; die Zahlen 2.300 / bis zu 13.700
Kostenlose OpenAI-API-CreditsEin einmaliges Legacy-Kontingent für neue Cloud-NutzerNur bei Instanzen ohne Gateway-Credits

Die ersten beiden Spalten sind der Dokumentation zu Gateway-Credits von n8n entnommen, geprüft am 19. September 2026; der Geltungsbereich der Assistant-Credits stammt aus der FAQ auf der Preisseite, die besagt, dass AI Assistant in allen n8n-Cloud-Plänen außer Enterprise enthalten ist und ungenutzte Credits nicht übertragen werden. Community-Threads zu „kostenlosen OpenAI-Credits in n8n“ beschreiben das dritte, veraltete Guthaben und sollten nicht als aktuell gelesen werden.

Gateway-Credits sind wirklich praktisch: n8n leitet die Anfragen des Nodes über sein eigenes Gateway weiter und authentifiziert sich im Namen von n8n beim Anbieter, sodass ein Workflow einen Modell-Node ganz ohne Anbieter-Konto ausführen kann. Laut n8ns Seite Use Gateway credits wechselt ein Node über einen einzigen Selektor zwischen „Use Gateway credits“ und „Use my own credential“, ohne dass der Workflow neu erstellt werden muss — bei Nodes, auf denen nur ein Teil der Funktionalität unterstützt wird, werden die nicht unterstützten Vorgänge jedoch ausgeblendet, solange Gateway-Credits ausgewählt sind.

Diese Seite kann Ihnen keinen numerischen Vergleich zwischen Gateway-Credits und Kunavo liefern, und außerhalb eines Cloud-Logins kann das niemand. n8n veröffentlicht seine Gateway-Preise nur unter app.n8n.cloud/service-pricing, hinter einer Authentifizierung, und erklärt, dass die Preise je nach Modell und Dienst variieren. Eine veröffentlichte Umrechnung von Credits in Dollar gibt es nicht. Jeder Artikel, der Ihnen diese Tabelle zeigt, hat sie aus etwas anderem als einer Quelle erstellt. Was vergleichbar ist, ist die Struktur:

Fragen8n-Gateway-CreditsIhr eigener Schlüssel (beliebiger Anbieter)
Auf Self-hosted verfügbar?Nein — nur Cloud Starter und Pro, nicht auf Cloud EnterpriseJa, überall; keine Planbeschränkung für das Base-URL-Feld
Läuft das Guthaben ab?Aufgeladene Credits laufen 12 Monate nach dem Kauf abHängt von Ihrem Anbieter ab; Kunavo-Credits laufen nicht nach 12 Monaten ab
Erstattungsfähig?Aufladungen sind endgültig; ungenutzte Credits werden nicht erstattet, außer wenn das Gesetz dies verlangtDie Bedingungen Ihres Anbieters
Wenn Sie das Konto schließen?Verbleibende Credits verfallenDie Bedingungen Ihres Anbieters
Wer kann aufladen?Nur der Instanzinhaber, und ein aktives kostenpflichtiges Abonnement ist erforderlich; Testphasen können nicht aufladenWer das Abrechnungskonto besitzt
Geltungsbereich des GuthabensEin Guthaben pro Cloud-Instanz, von allen Nutzern gemeinsam verwendetPro Schlüssel oder pro Konto, je nach Ihrer Struktur
Wessen Anbieterkonto sieht die PromptsDas von n8nIhres oder das Ihres Gateways

Jede Zeile stammt aus derselben Dokumentation zu Gateway-Credits und ihrer Aufladeseite. Die praktische Konsequenz: Wenn Sie n8n selbst hosten, gibt es Gateway-Credits für Sie nicht, und Bring-your-own-Key ist keine Präferenz, sondern der einzige Weg.

Welche Route gewinnt und wann

WegVorteile, wennWorauf Sie verzichten
n8n-Gateway-CreditsSie nutzen Cloud Starter oder Pro, möchten keinerlei Anbieter-Konten und schätzen eine schnelle Einrichtung höher als PreistransparenzSelf-hosted und Enterprise können es nicht verwenden; ein Prepaid-Guthaben, das nach 12 Monaten verfällt, nicht erstattungsfähig ist und bei Kontoschließung verfällt; Preise, die Sie vor der Anmeldung nicht lesen können
Direkte Anbieter-APIDie Modelle eines Anbieters erledigen alles, und Sie möchten das Prompt-Caching und die Batch-Rabatte dieses Anbieters nutzenEine zweite Modellfamilie bedeutet ein zweites Konto, einen zweiten Schlüssel und ein zweites zu überwachendes Guthaben
Ein OpenAI-kompatibles GatewayVerschiedene Workflows benötigen verschiedene Modellfamilien mit einem Schlüssel und einem Guthaben, und Sie hosten selbstAnbieterspezifische Extras hinter dem generischen Protokoll sind möglicherweise nicht erreichbar; Sie setzen die Base URL einmal pro Credential von Hand
Lokales Modell (Ollama-Node)Schritte mit hohem Volumen, niedrigen Risiken und sensiblen Daten, bei denen keine Gebühr pro Anfrage akzeptabel istFunktionslücke gegenüber gehosteten Frontier-Modellen; Hardware und Betrieb werden zu Ihren Kosten

Ein Budgetierungshinweis, der für die drei Zeilen mit eigenem Konto gilt: n8n setzt keine Ausgabenobergrenze für Modellaufrufe, die außerhalb von n8n abgerechnet werden. Das Ausführungskontingent begrenzt, wie oft ein Workflow startet, nicht, was in ihm geschieht. (Gateway-Credits sind die Ausnahme — das Guthaben selbst stoppt bei null, und die automatische Aufladung akzeptiert ein optionales monatliches Limit.) Wenn Sie eine harte Obergrenze möchten, muss sie von der Anbieterseite kommen — ein Prepaid-Guthaben, das bei Leerstand einfach stoppt, ist die direkteste und zuverlässigste Variante. KI-Kostenoptimierung behandelt den Rest der Methode, und das API-Verzeichnis für KI-Agenten zeigt, wie n8n neben den anderen Clients steht, die einen benutzerdefinierten Endpunkt verwenden.

Einen Drittanbieter-Endpunkt in n8n einbinden

n8n liefert keinen generischen „OpenAI-kompatiblen“ Modell-Node. Der OpenAI-Node plus eine Credential-Base-URL ist der generische Weg, und der häufigste Fehler in Anleitungen besteht darin, dieses Feld an der falschen Stelle zu suchen.

Die Base URL befindet sich im Credential, nicht im Node. Im veröffentlichten Quellcode ist die Base-URL-Option im OpenAI-Chat-Model-Node ab Node-Version 1.1 und höher ausgeblendet, und die entsprechende Option des Embeddings-Nodes ab 1.2 — bei jedem Node, den Sie heute hinzufügen, ist die Überschreibung im Node daher unsichtbar, und das Credential ist der einzige Ort, an dem sie existiert. Weder n8ns OpenAI-Credential-Seite noch seine Anthropic-Credential-Seite dokumentiert das Feld, aber beide Credentials führen es im Quellcode mit.

n8n-Anmeldedaten: OpenAI (Überschreibung der Base URL)
Credential type:  OpenAI  (used by the "OpenAI Chat Model" sub-node)
API Key:          sk-kn-…            # your Kunavo key
Base URL:         https://api.kunavo.com/v1

# Then in the OpenAI Chat Model node:
Model:            ID mode -> claude-sonnet-5
Options > Built-in Tools:   leave OFF on a non-OpenAI endpoint

Ein Konflikt zwischen Quellcode und Dokumentation, den Sie kennen sollten. n8ns Node-Dokumentation sagt, dass der OpenAI-Chat-Model-Node standardmäßig die Chat-Completions-API verwendet. Der veröffentlichte Quellcode unter n8n@2.39.8 sagt etwas anderes: responsesApiEnabled hat auf Node-Version 1.3 und höher default: true, sodass ein frisch hinzugefügter Node an /v1/responses statt an /v1/chat/completions sendet. Beides wird hier gezeigt, statt stillschweigend eine Variante auszuwählen; das Verhalten folgt dem ausgelieferten Code, und ein Endpunkt, der nur Chat Completions implementiert, schlägt sofort fehl, bis dieser Schalter deaktiviert wird. Kunavos /v1/responses-Route akzeptiert wie /v1/chat/completions jedes aktivierte Chat-Modell, sodass der Standardendpunkt des Nodes hier existiert und nicht mit 404 antwortet — allerdings wurde kein Workflow Ende zu Ende ausgeführt, um den Roundtrip zu bestätigen. Siehe die Chat-API-Dokumentation und den Leitfaden zur OpenAI-kompatiblen API.

Drei Grenzen, die Sie vor dem Aufbau kennen sollten.

GrenzeWas passiertWas zu tun ist
Anthropic-Credential gegenüber Kunavon8ns Anthropic-Credential authentifiziert sich mit x-api-key, und sowohl der Test als auch das Modell-Dropdown führen einen GET-Aufruf an /v1/models aus. Kunavo liest den Schlüssel bei jeder Route aus diesem Header, einschließlich der Modellliste, daher sollten beide antworten — das From-List-Dropdown bezeichnet jedes Modell jedoch mit einem display_name, das Kunavos Liste nicht enthält, sodass nur die IDs angezeigt werden; außerdem wird der gesamte Katalog aufgelistet, während der Anthropic-Node nur die claude--IDs verwenden kann, die /v1/messages bereitstelltWählen Sie eine claude--ID aus der Liste oder stellen Sie den Modellselektor auf den ID-Modus und geben Sie den Slug ein; für GPT und andere Nicht-Claude-Chatmodelle verwenden Sie den OpenAI-Chat-Model-Node mit der Kunavo-Base-URL
Google-Gemini-NodeEr spricht das native Protokoll von Google, das Kunavo nicht bereitstelltVerwenden Sie den OpenAI-Chat-Model-Node für die Claude- und GPT-Slugs, die Kunavo bereitstellt
Embeddings-OpenAI-NodeEr berücksichtigt die Credential-Base-URL, aber Kunavo stellt kein Embedding-Modell bereit — die Route existiert, und der dahinterliegende Katalog ist leerHalten Sie für den Embedding-Schritt jedes RAG-Workflows einen zweiten Anbieter oder ein lokal ausgeführtes Modell bereit; siehe RAG-Implementierung

Lassen Sie außerdem die integrierten Tools des OpenAI-Nodes bei einem benutzerdefinierten Endpunkt deaktiviert. Web Search, File Search und Code Interpreter bilden diese Sammlung im veröffentlichten Quellcode; Conversation ID, Prompt Cache Key und Service Tier stehen im Abschnitt Options des Nodes daneben. Alle sechs sind Funktionen der OpenAI-Plattform; es ist nicht verifiziert, dass irgendeine davon über Kunavo funktioniert, und bei Modellen, die auf Chat übersetzt werden, können sie es nicht. n8n gibt am Node genau für diese Situation eine eigene Warnung aus: Bei der Verwendung von Nicht-OpenAI-Modellen über eine Base-URL-Überschreibung sind möglicherweise nicht alle Modelle chatkompatibel oder unterstützen andere Funktionen wie Tool-Aufrufe oder das JSON-Antwortformat.

Einrichten und die erste Abrechnung prüfen

Kunavo hat n8n nicht zur Laufzeit getestet. Hier gibt es noch keine veröffentlichte n8n-Integrationsseite, und jedes oben beschriebene n8n-Verhalten wurde aus dem veröffentlichten Quellcode unter n8n@2.39.8 und aus der eigenen Dokumentation von n8n abgeleitet — dies ist eine Konfigurationsreferenz, kein Kompatibilitätstest. Betrachten Sie den ersten Aufbau als Test: Halten Sie eine funktionierende Route bereit, führen Sie einen begrenzten Workflow mit einer kleinen Ausführungsanzahl aus und lesen Sie anschließend die von Ihrem Konto tatsächlich aufgezeichnete Abrechnung ab, statt sie aus der obigen Tabelle zu schätzen.

Wenn Sie zwischen Gateways statt zwischen Routen wählen, behandeln OpenRouter-Alternativen und der Leitfaden zu LLM-Gateways diesen Vergleich, während günstigste Claude-API speziell die Claude-Familie behandelt. Wenn Sie bereit sind, einen Schlüssel zu finanzieren, erstellen Sie ein Kunavo-Konto.

Häufig gestellte Fragen

Verursacht die n8n API Kosten?

Das hängt davon ab, welche API gemeint ist. Die eigene öffentliche REST API von n8n — die Workflows auflistet und auslöst — hat keinen veröffentlichten Preis pro Aufruf; laut n8n-Dokumentation ist sie während der kostenlosen Testphase nicht verfügbar und Sie sollten ein Upgrade durchführen, um sie zu nutzen. Die KI-Modell-APIs, die Ihre Workflows aufrufen, werden vollständig separat an den jeweiligen Anbieter des Modells bezahlt, nach Token berechnet und ohne Zusammenhang mit Ihrem n8n-Tarif. Wenn jemand nach den Kosten der n8n API fragt, ist fast immer die zweite gemeint.

Bezahlen die KI-Guthaben auf der n8n-Preisseite meine Modellaufrufe?

Nein, und das ist der häufigste Fehler bei der Beschreibung der n8n-Kosten. Die Werte 2.300 und bis zu 13.700 auf der n8n-Preisseite sind AI-Assistant-Guthaben — das Kontingent für den Workflow-Erstellungs-Copiloten und den AI Workflow Builder, monatlich erneuert und nicht übertragbar. Modellaufrufe von Nodes innerhalb Ihrer Workflows greifen auf ein anderes Guthaben namens Gateway-Guthaben zu, das n8n als separates Produkt mit eigenen Regeln für Aufladung, Ablauf und Verfügbarkeit dokumentiert. Ein drittes, veraltetes Guthaben aus kostenlosen OpenAI-Guthaben existiert nur auf Cloud-Instanzen, die kein Gateway-Guthaben haben. Drei Guthaben, drei Bedeutungen.

Welche API ist die beste für n8n?

Es gibt keinen eindeutigen Gewinner; die Antwort richtet sich nach Ihrer Bereitstellung und Ihrem Wechselverhalten. Selbst gehostetes n8n kann Gateway-Guthaben von n8n überhaupt nicht verwenden, daher gilt es definitionsgemäß als Bring-your-own-Key. Bei Cloud Starter oder Pro kaufen Gateway-Guthaben Bequemlichkeit — kein Anbieter-Konto muss eröffnet werden — zum Preis eines vorausbezahlten Guthabens, dessen Aufladeguthaben zwölf Monate nach dem Kauf abläuft, nicht erstattet wird und verfällt, wenn Sie das Konto schließen. Eine direkte Anbieter-API gewinnt, wenn die Modelle eines Anbieters alles erledigen und Sie dessen eigene Cache- und Batch-Rabatte nutzen möchten. Ein Gateway wie Kunavo oder OpenRouter gewinnt, wenn verschiedene Workflows unterschiedliche Modellfamilien mit einem Schlüssel und einem Guthaben benötigen. Ein lokales Modell gewinnt für kleine, private Schritte mit hohem Volumen, bei denen keine Gebühr pro Anfrage akzeptabel ist.

Welche API ist die günstigste für n8n?

Am günstigsten pro Token und am günstigsten für die Fertigstellung des Workflows sind zwei verschiedene Fragen. Innerhalb eines n8n-AI-Agent-Nodes entscheidet das Modell, wie viele Roundtrips die Ausführung benötigt: Die Standard-Maximale-Iterationszahl des Agenten beträgt 10, und ein schwächeres Modell, das einen Tool-Aufruf falsch formt, kann mehrere dieser Iterationen für die Wiederherstellung verbrauchen; dadurch wird sein Vorteil pro Token innerhalb einer abgerechneten Ausführung aufgehoben. Die praktische Methode besteht darin, das günstigste Modell auszuwählen, das Ihren Workflow zuverlässig abschließt, und anschließend die Belastung zu prüfen, die Ihr Anbieter-Konto für einen begrenzten Test-Batch tatsächlich aufgezeichnet hat. Kein Anbieter, auch Kunavo nicht, kann die niedrigsten Gesamtkosten für eine Aufgabe versprechen, die er nicht ausgeführt hat.

Welches KI-Modell ist das günstigste für n8n?

Für deterministische Aufgaben in einem Durchlauf — Klassifizierung, Feldextraktion, Routing, kurze Umschreibungen — ist das günstigste kleine Modell, das Ihre Genauigkeitsprüfung besteht, die richtige Wahl, da diese Schritte genau einen Modellaufruf pro Ausführung erzeugen und der Tokenpreis die gesamte Rechnung ausmacht. Bei agentischen Schritten mit Tools sollten Sie anhand abgeschlossener Ausführungen und nicht anhand der Preisliste entscheiden, da die Anzahl der Iterationen Teil der Kosten ist. Zwei strukturelle Warnungen: Eine Ausgabeobergrenze ist ebenso wichtig wie der Tarif, da der n8n-Anthropic-Chat-Model-Node die Ausgabe standardmäßig auf 4.096 Token begrenzt, während der OpenAI-Node standardmäßig ohne Limit ausgeliefert wird; außerdem sollte jedes Modell, dessen Preis auf einem vorübergehenden Einführungstarif eines Anbieters beruht, erneut geprüft werden, bevor Sie darauf ein Budget aufbauen.

Welches Modell ist am besten für n8n-Workflows?

Passen Sie das Modell an den Node an, nicht an eine Rangliste. Eine Basic LLM Chain zur Extraktion ist ein Aufruf und belohnt das günstigste ausreichend genaue Modell. Ein AI Agent mit drei oder vier Tools belohnt zuverlässige Tool-Aufrufe, da jeder fehlerhafte Aufruf eine weitere Iteration mit Kontext kostet, der mit jeder Runde wächst. Bei einem Zusammenfassungsschritt über lange Dokumente dominieren die Eingabetoken, daher ist der Eingabetarif wichtiger als der Ausgabetarif. Beachten Sie, dass diese Frage auch in einem anderen Sinn gestellt wird — welches Modell n8n-Workflow-JSON am besten schreibt —, was das Erstellen und nicht das Ausführen innerhalb eines aktiven Workflows betrifft. Diese Seite beantwortet die Frage nach den Laufzeitkosten.

Kann ich n8n auf einen benutzerdefinierten OpenAI-kompatiblen Endpunkt richten?

Ja. Im veröffentlichten n8n-Quellcode enthält der OpenAI-Anmeldedatensatz ein Feld für die Base URL mit dem Standardwert https://api.openai.com/v1, und der Anthropic-Anmeldedatensatz enthält eines mit dem Standardwert https://api.anthropic.com. Keines der beiden Felder wird auf den Dokumentationsseiten zu n8n-Anmeldedaten beschrieben, aber beide existieren im Quellcode. Bei heute hinzugefügten Nodes ist die Base-URL-Option im Node verborgen, daher gehört die Überschreibung in die Anmeldedaten. Ein Hinweis: Der Test der Anmeldedaten führt einen einfachen GET auf die Modellliste aus; daher schlägt bei einem Endpunkt, der auf derselben Anmeldedatenkonfiguration keinen solchen Aufruf beantwortet, die grüne Prüfung fehl, selbst wenn Chat-Aufrufe funktionieren würden.

n8n-Planpreise, Ausführungsregeln, Bedingungen für Gateway-Credits und API-Dokumentation geprüft am 19. September 2026; Node-Defaults und Credential-Felder aus dem veröffentlichten Quellcode unter dem Tag n8n@2.39.8 gelesen. Dass Kunavos Modellliste den Schlüssel sowohl als x-api-key als auch als Bearer-Token akzeptiert, wurde aus dem Authentifizierungscode dieses Repositorys abgeleitet, ebenso wie die Bezeichnung dieser Liste im Anthropic-Dropdown aus dem n8n-Quellcode unter demselben Tag; beides wurde nicht gegen die Live-API gemessen. Es wurde kein n8n-Workflow mit Kunavo erstellt oder ausgeführt. Kunavos Tokenpreise stammen aus dem Live-Katalog, und jede Dollarzahl auf dieser Seite ist eine veranschaulichende Tokenberechnung statt eines gemessenen Laufs.