Zurück zu den Leitfäden
Einrichtung·21. September 2026·Aktualisiert am 24. September 2026·10 Min. Lesezeit

Einrichtung einer benutzerdefinierten IronClaw-API: Anbieter, Schlüssel und Datenschutzgrenzen

IronClaw nimmt einen benutzerdefinierten Endpunkt in vier Feldern entgegen – doch die Liste der Dinge, die dieser Endpunkt anschließend nicht erhält, ist länger als die Konfiguration selbst.

Zuletzt überprüft am .

IronClaw nimmt eine benutzerdefinierte API in einem Block mit vier Feldern entgegen: einen [llm.default]-Slot in ~/.ironclaw/reborn/config.toml mit provider_id, base_url, model und api_key_env — oder, wenn kein Slot vorhanden ist, die Umgebungsvariablen LLM_BACKEND / LLM_BASE_URL / LLM_API_KEY, auf die es zurückgreift. Beide Formen sind aktuell und dokumentiert. Was die Konfigurationsseiten nicht an einer Stelle zusammenfassen, ist die Liste der Funktionen, die ein benutzerdefinierter Endpunkt anschließend nicht erhält — darunter natives Streaming, Modellentdeckung, Anthropic-cache_control-Breakpoints und eine genaue Kostenanzeige — und genau diese Liste sollten Sie lesen, bevor Sie einen Anbieter auswählen.

Zunächst eine Abgrenzung, weil die Suchergebnisse von anderen Produkten dominiert werden. Diese Seite handelt von github.com/nearai/ironclaw, das in den Metadaten seines eigenen Repositorys als „IronClaw is an Agent OS focused on privacy, security and extensibility“ beschrieben wird: Rust, nicht archiviert und kein Fork, 12,626 Sterne, erstellt am 3. Februar 2026 und zuletzt am 21. September 2026 gepusht (GitHub API, am selben Tag). Es handelt sich nicht um die Corsair-Gamingmaus dieses Namens, das Tabletop-RPG von Sanguine Productions, den IRONCLAW-Kryptotoken oder das nicht verwandte Repository JoasASantos/ironclaw — deren Preise und Konfigurationen gehören nicht auf diese Seite. Die maßgebliche Dokumentation befindet sich unter docs.ironclaw.com und im eigenen docs/-Verzeichnis des Repositorys; ein Drittanbieter-Mintlify-Spiegel rankt für dieselben Titel und kann veraltet sein.

Die Zuordnung ist es wert, zitiert statt paraphrasiert zu werden, weil sich die eigenen Präsenzen des Anbieters unterscheiden: ironclaw.com stellt neben einem NEAR-Logo „Built by“ und im Text die Worte „Near Foundation“ dar sowie in der Fußzeile „— by NEAR AI“, während die GitHub-Organisation nearai lautet.

Die minimale Konfiguration eines benutzerdefinierten IronClaw-Anbieters

Die Slot-Struktur in ironclaw_config akzeptiert genau vier optionale Felder, und die zugehörigen Dokumentationskommentare beschreiben sie als Überschreibungen des Katalogeintrags: model überschreibt default_model des Anbieters, api_key_env überschreibt api_key_env und base_url überschreibt default_base_url. Die Anbieterdokumentation ergänzt, dass base_url „auch bei jedem anderen Anbieter funktioniert, wenn Sie ihn über einen Proxy oder einen regionalen Endpunkt leiten müssen“ — dies ist also nicht nur eine Funktion des generischen Adapters.

~/.ironclaw/reborn/config.toml
[llm.default]
provider_id = "openai_compatible"
base_url    = "https://api.kunavo.com/v1"
model       = "claude-sonnet-4-6"
api_key_env = "LLM_API_KEY"

Drei Regeln, die ins Gewicht fallen. Das Weglassen von base_url ist fatal und wird nicht durch einen Standardwert ersetzt: Laut Dokumentation „zeigt der Slot dann nirgendwohin und die Modellauflösung schlägt fehl“, und der Katalogeintrag openai_compatible enthält base_url_required: true. api_key_env erwartet einen Variablennamen, niemals einen Schlüssel — ein eingefügtes Geheimnis wird „beim Parsen abgelehnt und nicht stillschweigend akzeptiert“, während ironclaw config set <provider>.api_key mit verborgener Eingabe danach fragt. Nichts wird wirksam, bevor ein Neustart erfolgt: config set „startet nichts neu“, sondern gibt den noch auszuführenden Schritt ironclaw service restart aus. Und erwarten Sie nicht, dass config set den Slot für Sie schreibt — auf der Konfigurationsseite wird [llm.default] als einer der Abschnitte aufgeführt, die „direkt in config.toml bearbeitet“ werden, und config set „lehnt einen nicht unterstützten Schlüssel ab, statt stillschweigend nichts zu tun“.

Die Umgebungsvariablenform ist der dokumentierte Rückfall, wenn [llm.default] fehlt, und die Dokumentation entscheidet die Wahl eindeutig: „Beide funktionieren … Bevorzugen Sie den TOML-Slot für eine dauerhafte Installation und die Umgebungsvariablenform für einmalige Ausführungen und Container.“

Einmalige Ausführungen und Container
export LLM_BACKEND=openai_compatible
export LLM_BASE_URL=https://api.kunavo.com/v1
export LLM_API_KEY=sk-kn-...
export LLM_MODEL=claude-sonnet-4-6

# optional: LLM_EXTRA_HEADERS is the openai_compatible entry's
# extra_headers_env; the timeout is a general .env.example setting
export LLM_EXTRA_HEADERS=X-Title:MyAgent
export LLM_REQUEST_TIMEOUT_SECS=120

Die Auflösungsreihenfolge lautet compiled defaults < config.toml < environment variables < CLI flags, sodass eine exportierte Variable unbemerkt Vorrang vor der Datei hat, die Sie gerade bearbeitet haben. Der CLI-Weg vermeidet die manuelle Bearbeitung vollständig: ironclaw models list, dann ironclaw models set-provider <id> --model <model>, dann ironclaw models status. Bestätigen Sie Ihre Pfade mit ironclaw config path, statt einer der dokumentierten Angaben zu vertrauen — auf der Quickstart-Seite heißt es, alles befinde sich unter ~/.ironclaw, während die Konfigurations- und Onboarding-Seiten ~/.ironclaw/reborn nennen. Eine betriebliche Falle für gehostete Nutzer: Auf der Konfigurationsseite steht, dass ironclaw service-Befehle „auf einer von NEAR AI gehosteten Instanz nicht funktionieren — es gibt dort keinen Benutzerdienst-Manager, mit dem sie kommunizieren könnten“. Für ironclaw config melden Sie sich daher per SSH an und starten den Dienst anschließend im Agent Dashboard neu. Alle Zitate stammen aus dem main-Branch und wurden am 21. September 2026 gelesen.

Was ein benutzerdefinierter Endpunkt nicht erreicht

Dies sind IronClaws eigene Aussagen über das beabsichtigte Laufzeitverhalten, gelesen aus Quell- und Vertragsdateien im main. Es handelt sich nicht um beobachtete Ausführungen, und main lag beim Lesen vor dem Release-Tag 1.4.0 — laut GitHub-Releases-API veröffentlicht am 28. August 2026.

FähigkeitBei einem benutzerdefinierten OpenAI-kompatiblen SlotWo dies angegeben ist
Natives SSE-StreamingNein — gepuffert. Aktiviert „nur dort, wo IronClaw ein maßgebliches Abschlussereignis beobachten kann: NEAR AI, Anthropic OAuth und Codex Responses“. Auch der Anthropic-API-Key-Transport und OpenRouter sind gepuffert.ironclaw_llm/CONTRACT.md
ModellentdeckungNein — can_list_models ist für openai_compatible und openrouter false, daher werden IDs exakt manuell eingegeben.assets/providers.json
Basis-URL über die UmgebungJa, in diesem Fall — openai_compatible definiert LLM_BASE_URL. Es ist einer von nur 7 der 26 Katalogeinträge, die überhaupt eine Variable für die Basis-URL definieren; openrouter, together, fireworks, groq, deepseek, mistral und die übrigen müssen das Feld in config.toml verwenden.assets/providers.json
Tool-Schemas in der vorliegenden FormNein — sie werden an der Anbietergrenze in den OpenAI-Strict-Modus umgeschrieben: additionalProperties: false, wobei alle Eigenschaften in required erzwungen und optionale Eigenschaften nullable gemacht werden.ironclaw_llm/CONTRACT.md
Prompt-CachingGemischt, nicht einfach abwesend. Anthropic-cache_control-Breakpoints werden nur von den beiden Anthropic-Transporten ausgegeben, daher sendet ein OpenAI-kompatibler Slot keine. OpenAIs prompt_cache_key wird jedoch weitergegeben: Das Flag wird „true von den generischen OpenAI-kompatiblen, DeepSeek- und OpenRouter-Factories gesetzt“, wobei das Loop-Host-Gateway die einzige Nahtstelle ist, die einen Wert liefert. Ob Ihr Endpunkt anschließend tatsächlich etwas cached, ist sein eigenes Verhalten, das IronClaw weder anfordert noch einsehen kann.ironclaw_llm/CONTRACT.md
Failover zwischen AnbieternNein — der Failover-Dekorator wechselt über NEARAI_FALLBACK_MODEL zwischen NEAR-AI-Modellen; alles über verschiedene Anbietertypen hinweg „erfordert eine manuelle Erstellung“.ironclaw_llm/CONTRACT.md
Antwortcache für Tool-RundenNie zwischengespeichert — complete_with_tools() ist wegen möglicher Seiteneffekte ausgeschlossen.ironclaw_llm/CONTRACT.md
Von Nutzern bei einer Mehrbenutzerinstallation auswählbarNicht automatisch — „Die Anbieterkonfiguration allein veröffentlicht keine Modelle für Nutzer“; ein Administrator fügt jede ID unter Einstellungen → Inferenz → Nutzerzugriff auf Modelle hinzu.Anbieterdokumentation

IronClaws Katalog ist ein Chat-Katalog, und Kunavo bietet kein Embedding-, Text-to-Speech- oder Speech-to-Text-Modell an. Jeder Teil Ihrer Einrichtung, der eines davon benötigt, muss daher vollständig auf einen anderen Ort verweisen.

IronClaws Kostenanzeige ist nicht Ihre Rechnung

Innerhalb von IronClaw berechnen zwei getrennte Pfade Geld, sie widersprechen sich, und keiner liest Ihren Anbieter aus. price_usage() in ironclaw_common bepreist anhand einer fest codierten Tabelle pro Token und fällt auf default_cost() zurück — 0.0000025 für Eingaben und 0.00001 pro Token, also ein GPT-4o-ähnlicher Preis von $2.50 / $10.00 pro Million — mit der angegebenen Begründung, dass „ein neues kostenpflichtiges Modell niemals stillschweigend mit null bepreist wird“. Derweil macht StaticModelCostTable des Loop-Hosts bei Budgetreservierungen das Gegenteil: Ein Profil, das in seiner Tabelle fehlt, „fällt auf None zurück, was der Buchhalter als kostenlos behandelt“. Und auf dem Pfad llm_costs wird der Rabatt für Cache-Lesevorgänge anhand eines Teilstrings im Modellnamen geraten — claude teilt durch zehn, gpt oder ein Präfix o1/o3/o4 durch zwei, alles andere durch eins.

Die praktische Folge ist, dass IronClaws budget.user_daily_usd, budget.pause_at und die übrigen Schlüssel aus [budget] eine Schätzung überwachen, keine Belastung. Bei einem ständig laufenden Agenten lohnt es sich dennoch, sie zu setzen — ein außer Kontrolle geratener Loop, der früh gestoppt wird, ist genau der Zweck —, aber gleichen Sie sie mit der vom Anbieter aufgezeichneten Nutzung ab und nicht mit der Zahl auf dem Bildschirm.

Eine Beispielberechnung für einen Agententag

Dies ist eine Token-Berechnung, keine gemessenen Aufgabenkosten und keine Rechnungsobergrenze. Nehmen wir einen Tag Agentenaktivität mit insgesamt 1.000.000 nicht zwischengespeicherten Eingabetokens und 40.000 Ausgabetokens an — eine Annahme zur Veranschaulichung, gewählt, weil eine ständig laufende Laufzeit Eingaben über Heartbeat-Ticks und Routinen ansammelt statt über lange Antworten. Die Preise sind aktuelle Kunavo-Katalog-Preise pro Million Tokens.

ModellEingabe / Ausgabe pro 1 Mio.Geschätzter AgententagPassen die Vision-Muster zu dieser ID?
Claude Haiku 4.5$0.70 / $3.50$0.840Ja
GPT-5.6 Terra$0.70 / $4.20$0.868Nein
Claude Sonnet 4.6$2.10 / $10.50$2.520Ja
Claude Opus 5$3.50 / $17.50$4.200Ja

Die letzte Spalte enthält die nützliche Überraschung: Sie ist eine Eigenschaft der ID-Zeichenkette und nicht des Modells. vision_models.rs gleicht eine feste Liste per Teilstring ab, die claude-opus-, claude-sonnet-, claude-haiku- und claude-fable- enthält; diese IDs leiten Bildanhänge weiter. Die übrigen IDs in der obigen Tabelle stimmen mit keinem von gpt-4o, gemini-1.5, gemini-2 oder dem Rest der Liste überein und würden als reiner Text eingestuft. Bei einem Fehlschlag sendet das Loop-Host-Gateway den Nachrichtentext ohne die Bildteile und erzeugt keinen Fehler — das dauerhafte Transkript behält einen <attachments>-Verweis, aber das Modell sieht das Bild nie. Lesen Sie die Musterliste anhand der exakten ID, die Sie eingeben möchten, bevor Sie davon ausgehen, dass Bildeingaben funktionieren. Skalieren Sie die Dollarbeträge anhand Ihrer eigenen Anzahl an Tagen, bevor Sie sie als Budget betrachten. Kunavos Katalogbetrag ist eine Abrechnungsuntergrenze und keine Obergrenze: Wenn der Upstream seine Belastung meldet, entspricht die Rechnung dem höheren Wert aus den Katalogkosten und den Upstream-Kosten multipliziert mit dem jeweils geltenden Aufschlag. Cache-Gebühren und externe Tools sind in diesem Beispiel nicht enthalten, und die minimale Aufladung beträgt $10 als Prepaid-Guthaben — eine Mindestfinanzierung, keine Aufgabengebühr und kein Abonnement. Siehe Abrechnungsdetails.

Welche Route gewinnt, und was IronClaw selbst kostet

Die Software ist kostenlos: Im Repository-Stammverzeichnis befinden sich sowohl LICENSE-APACHE als auch LICENSE-MIT, und die README nennt MIT OR Apache 2.0. Es gibt keine kostenpflichtige Edition der Binärdatei und keine Lizenzgebühr. Sie bezahlen für Tokens sowie gegebenenfalls für das Hosting des Anbieters.

WegVeröffentlichter PreisVorteile, wenn
Selbst gehostetes IronClawSoftware für 0 $, MIT OR Apache-2.0Sie betreiben bereits einen Host und möchten die vollständige Kontrolle über den Endpunkt
ironclaw.com StarterDerzeit 0 $ bei durchgestrichenen 5 $; „5-$-Guthaben enthalten“Sie testen den gehosteten Weg. Betrachten Sie ihn als Werbeangebot, nicht als dauerhaftes 0-$-Abo
ironclaw.com Basic20 $/Monat, „20-$-Guthaben enthalten“„bis zu 2 Agent-Instanzen“, Nutzungs-Pooling über Deployments hinweg
ironclaw.com Pro+200 $/Monat, „200-$-Guthaben enthalten“„bis zu 5 Agent-Instanzen“, frühzeitiger Zugriff auf fortgeschrittene Modelle, bevorzugter Support
NEAR AI Cloud-Tokens0,15 $ / 0,50 $ pro 1 Mio. (GLM 5.3 Flash) bis zu 3,30 $ / 16,50 $ (Kimi K3)Der vom Anbieter empfohlene Standard und das einzige Backend, bei dem das integrierte Failover Modelle austauscht
Ein OpenAI-kompatibles GatewayDie Tokenpreise Ihres GatewaysSie wechseln je nach Aufgabe zwischen Modellfamilien und möchten einen einzigen Schlüssel verwenden — und akzeptieren gepuffertes Streaming sowie manuell eingetragene IDs
Lokales Modell über OllamaKeine Gebühr pro AnfrageKleine oder private Aufgaben; erhöhen Sie LLM_REQUEST_TIMEOUT_SECS, wie in .env.example vorgeschlagen

Die Preise der gehosteten Tarife wurden am 21. September 2026 von ironclaw.com abgelesen; es gibt keine Seite /pricing, die Tarife befinden sich auf der Startseite, und das gerenderte Markup zeigt die 5 $ in einem durchgestrichenen Span mit 0 $ als aktuellem Preis. Auf der Startseite steht außerdem „Bis zu 5 Agenten in einer Trusted Execution Environment mit bis zu 130 Mio. Tokens pro Monat starten“ — dieser Satz steht über allen drei Karten und nennt keinen Tarif; ordnen Sie ihn daher keinem einzelnen Tarif zu. Drei Dinge konnte dieser Leitfaden nicht feststellen und wird sie nicht erraten: ob die gehosteten Tarife überhaupt einen Drittanbieter-Schlüssel erlauben, was das enthaltene Guthaben tatsächlich kauft oder was geschieht, wenn es aufgebraucht ist, und zu welchem Tarif die Zahl 130 Mio. gehört. Die Tokenpreise wurden am selben Tag von near.ai/pricing abgelesen; dort steht „Es gibt keine Plattformgebühr zusätzlich zum Modellpreis“, und die Angaben beziehen sich ausschließlich auf die vertraulichen Textmodelle des Dienstes.

Eine Datenschutzgrenze sollte ausdrücklich genannt werden, denn sie ist der Grund, warum sich Menschen für diese Laufzeitumgebung entscheiden. Die Kontrollen, die IronClaws eigene README und Sicherheitsseite beschreiben — Geheimnisse „at rest verschlüsselt“ und an der Host-Grenze injiziert, die WASM-Sandbox für nicht vertrauenswürdige Tools, eine Zulassungsliste für Endpunkte und Leckerkennung — sind lokale Kontrollen über den Rechner, auf dem der Agent läuft. Die Hardware-Beglaubigung ist eine separate Eigenschaft der NEAR AI Cloud: near.ai sagt, dass die Inferenz dort „in einer vertraulichen Intel-TDX- + NVIDIA-GPU-Enklave ausgeführt wird“ und dass „jede Antwort ein überprüfbares Hardware-Zitat enthält“. Wenn Sie IronClaw auf einen Drittanbieter-Endpunkt richten, werden Prompt-Inhalte gemäß den Bedingungen dieses Endpunkts an ihn gesendet; nichts aus einer der beiden Listen folgt dorthin. Die vom Anbieter verfasste Tabelle „OpenClaw vs IronClaw“ auf ironclaw.com ist Marketing einer Seite und kein neutraler Vergleich — und seien Sie bei Suchergebnissen vorsichtig: In einer am 17. September 2026 erstellten Stichprobe einer Ergebnisseite lieferten die vier Suchformen best api for ironclaw, cheapest api for ironclaw, best model for ironclaw und ironclaw custom provider jeweils mindestens acht OpenClaw-Ergebnisse unter den Top Ten, deren Modellrankings ein anderes Produkt beschreiben.

Richten Sie es ein und prüfen Sie dann die erste Abbuchung

Kunavo veröffentlicht einen OpenAI-kompatiblen Endpunkt unter https://api.kunavo.com/v1 sowie einen Anthropic-kompatiblen Endpunkt, die den Provider-IDs openai_compatible und anthropic zugeordnet sind. Kunavo hat IronClaw nicht zur Laufzeit getestet. Betrachten Sie den obigen Block daher als Ausgangspunkt auf Basis dokumentierter Protokolle und nicht als Kompatibilitätszusage: Halten Sie eine funktionierende Route bereit, führen Sie eine begrenzte Aufgabe aus und lesen Sie die Belastung ab, die Ihr Konto tatsächlich verzeichnet hat. Wenn Sie Goose von IronClaw über ACP steuern — .env.example dokumentiert die Agent Client Protocol-Sandbox und den Befehl ironclaw acp add goose — behandelt die Goose-Integration diese Seite separat, und das Erstellen eines Kunavo-Kontos lädt einen Schlüssel auf, sobald Sie bereit sind. Informationen zu den umliegenden Optionen finden Sie in der Referenz zur OpenAI-kompatiblen API, bei OpenRouter-Alternativen und in der KI-Kostenoptimierung.

Häufig gestellte Fragen

Wie richte ich einen benutzerdefinierten Anbieter in IronClaw ein?

Schreiben Sie in ~/.ironclaw/reborn/config.toml einen Abschnitt [llm.default] mit provider_id, base_url, model und api_key_env — dies sind die vier optionalen Felder, die die Slot-Struktur akzeptiert, und base_url überschreibt für jede provider_id, nicht nur für die generische, deren default_base_url. Verwenden Sie provider_id = "openai_compatible", wenn Ihr Endpunkt keinen eigenen Katalogeintrag besitzt; in der Anbieterdokumentation werden vLLM, LiteLLM, LM Studio und ein internes Gateway als dafür vorgesehene Fälle genannt. api_key_env muss der NAME einer Umgebungsvariablen sein, da ein dort eingefügter Literal-Schlüssel beim Parsen der Datei abgelehnt und nicht stillschweigend akzeptiert wird. `ironclaw config set` ist dafür nicht das richtige Werkzeug: In der Konfigurationsdokumentation wird `[llm.default]` als einer der Abschnitte aufgeführt, die „direkt in config.toml bearbeitet“ werden, und es wird erklärt, dass `config set` nur Schlüssel mit einem Routing-Ziel akzeptiert und einen nicht unterstützten Schlüssel ablehnt. Bearbeiten Sie die Datei oder verwenden Sie `ironclaw models set-provider`, das laut Anbieterdokumentation die Auswahl als Modell-Slot in config.toml schreibt. Starten Sie anschließend neu — nichts wird wirksam, bevor `ironclaw service restart` ausgeführt wurde. Geprüft gegen den main-Branch von nearai/ironclaw am 21. September 2026.

Funktioniert IronClaw mit OpenRouter?

Ja, und die beiden dokumentierten Vorgehensweisen widersprechen einander. Der einkompilierte Anbieterkatalog enthält einen eigenen openrouter-Eintrag mit einem eigenen open_router-Protokoll, der über OPENROUTER_API_KEY angesprochen wird. Die Anbieterdokumentation sagt, OpenRouter, Together AI und Fireworks hätten inzwischen eigene provider_id-Einträge und sollten direkt statt über den generischen Adapter verwendet werden. Die .env.example des Repositorys enthält weiterhin das ältere Rezept, das LLM_BACKEND=openai_compatible setzt und LLM_BASE_URL auf die API von OpenRouter richtet. Beide Dateien befanden sich am 21. September 2026 im main-Branch. Bevorzugen Sie die dedizierte ID; beachten Sie, dass der openrouter-Eintrag keine Umgebungsvariable für die Basis-URL definiert. Wenn Sie ihn über einen Proxy leiten müssen, verwenden Sie stattdessen das Feld base_url in config.toml. Zu den Preisen erklärt die eigene FAQ von OpenRouter (openrouter.ai/docs/faq, gelesen am 21. September 2026), dass die Preise des zugrunde liegenden Anbieters ohne Aufschlag weitergegeben werden, bei Kartenguthabenkäufen 5,5 % mit einem Mindestbetrag von $0.80 und bei Krypto 5 % berechnet werden und bei der Nutzung eines eigenen Schlüssels oberhalb eines monatlichen Freibetrags 5 % der entsprechenden OpenRouter-Kosten anfallen; dieselbe Seite beziffert den Freibetrag bei Pay-as-you-go auf $25,000.

Was ist die beste API für IronClaw?

Es gibt keinen eindeutigen Gewinner, und die Suche danach ist hier besonders irreführend, weil die Ergebnisseite diese Marke umdeutet: In einer am 17. September 2026 erstellten Stichprobe lieferten sowohl „best api for ironclaw“ als auch „cheapest api for ironclaw“ unter den ersten zehn jeweils mindestens acht OpenClaw-Ergebnisse. Rankings, die Sie unter diesen Suchbegriffen finden, beschreiben daher oft ein anderes Produkt. Gemessen an dem, was IronClaws eigener Code tut, lassen sich vier Wege klar unterscheiden. NEAR AI Cloud ist der vom Anbieter empfohlene Standard und das einzige Backend, bei dem der integrierte Failover tatsächlich zwischen Modellen wechselt. Eine direkte Anbieter-API ist überlegen, wenn Sie den ganzen Tag einen Anbieter verwenden und dessen natives Caching nutzen möchten — IronClaw gibt Anthropic-cache_control-Breakpoints nur über seine beiden Anthropic-Transporte aus, obwohl ein OpenAI-kompatibler Slot weiterhin OpenAIs prompt_cache_key überträgt; ein Endpunkt mit automatischem Präfix-Caching ist daher nicht ausgeschlossen. Ein OpenAI-kompatibles Gateway ist sinnvoll, wenn Sie einen Schlüssel und ein Guthaben über mehrere Modellfamilien hinweg nutzen möchten, allerdings um den Preis gepufferter statt nativer Streams und manuell eingegebener Modell-IDs. Ein lokales Modell über Ollama eignet sich für private, kleine Aufgaben ohne Kosten pro Anfrage. Wählen Sie danach, welche dieser Einschränkungen Sie hinnehmen können, nicht nach einem hervorgehobenen Preis.

Was ist die günstigste API für IronClaw?

Der günstigste angegebene Preis und die niedrigsten Kosten für die Fertigstellung einer Aufgabe sind unterschiedliche Aussagen. Bei einem ständig laufenden Agenten wird der Abstand größer, weil Heartbeat-Ticks, Routinen und Hintergrundaufgaben abgerechnet werden, unabhängig davon, ob Sie gerade tippen. Als Preisreferenz für das vom Anbieter selbst empfohlene Backend führte near.ai/pricing am 21. September 2026 GLM 5.3 Flash mit $0.15 für Eingabe- und $0.50 für Ausgabetokens pro Million als günstigstes vertrauliches Textmodell und Kimi K3 mit $3.30 und $16.50 als teuerstes auf, ohne zusätzliche Plattformgebühr auf den Modellpreis. Unabhängig davon, welchen Endpunkt Sie wählen, sollten Sie anhand der eigenen Nutzungsberichte des Anbieters kalkulieren und nicht anhand der von IronClaw angezeigten Kosten, die aus einer fest codierten Tabelle berechnet werden und für eine nicht erkannte Modell-ID auf einen GPT-4o-ähnlichen Preis zurückfallen.

Was ist das beste Modell für IronClaw?

IronClaw setzt dieser Auswahl zwei mechanische Grenzen, bevor die Fähigkeiten berücksichtigt werden, und beide werden durch den wörtlichen Text der Modell-ID bestimmt. Bildanhänge werden anhand eines Teilstring-Abgleichs mit einer festen Liste von Vision-Mustern in vision_models.rs weitergeleitet — der Quellcodekommentar warnt, dass Bildanhänge bei einem Fehlschlag stillschweigend verworfen werden. Eine ID, die von Formen wie claude-sonnet-, gpt-4o, gemini-2 oder pixtral umbenannt oder wegaliased wurde, verliert daher die Bildeingabe ohne Fehlermeldung. Denk-Prompts sind sicherer: Die entsprechende Liste von Reasoning-Mustern ist derzeit leer, sodass unbekannte Namen, Aliase und Modelle mit nativem Denken alle auf das Direktantwortformat zurückfallen. Darüber hinaus sollten Sie ein Modell bevorzugen, das beim Tool-Aufruf zuverlässig funktioniert, da über den RigAdapter-Pfad gesendete Tool-Definitionen an der Anbietergrenze in den OpenAI-Strict-Modus umgeschrieben werden. Alle drei Verhaltensweisen wurden am 21. September 2026 aus dem main-Branch gelesen.

Kann ich IronClaw auf Kunavo richten?

Kunavo veröffentlicht einen OpenAI-förmigen Endpunkt unter https://api.kunavo.com/v1 und einen Anthropic-förmigen Endpunkt unter https://api.kunavo.com/v1/messages; diese entsprechen jeweils den IronClaw-provider_ids openai_compatible und anthropic. Das ist eine aus der Dokumentation beider Seiten abgeleitete Protokollübereinstimmung und keine getestete Integration: Kunavo hat keine IronClaw-zu-Kunavo-Anfrage ausgeführt und beansprucht keine verifizierte Kompatibilität. Zwei Einzelheiten sollten Sie selbst prüfen, bevor Sie sich darauf verlassen. Der Eintrag openai_compatible setzt base_url_required, daher schlägt die Modellauflösung ohne Basis-URL fehl. Außerdem wurde das genaue Pfadsuffix, das IronClaw unter dem Anthropic-Protokoll anhängt, in dieser Recherche nicht bestätigt — als dokumentierter Standard für ANTHROPIC_BASE_URL ist der reine Host https://api.anthropic.com angegeben, was darauf hindeutet, dass die Laufzeit den Pfad ergänzt; bestätigen Sie dies mit einer Anfrage, bevor Sie eine Konfiguration festschreiben. Die minimale Aufladung bei Kunavo beträgt $10 als Prepaid-Guthaben.

Repository-Metadaten, providers.json, CONTRACT.md, llm_costs.rs, vision_models.rs, der docs/-Baum, ironclaw.com und near.ai/pricing wurden am 21. September 2026 aus dem main-Branch und nicht aus dem Release-Tag 1.4.0 abgelesen. Es wurde keine IronClaw-Anfrage an einen Kunavo-Endpunkt gesendet; jede Kompatibilitätsaussage hier ist eine Auswertung der Dokumentation beider Seiten. Die Kunavo-Tokenpreise stammen aus dem Live-Katalog, und jedes Dollarbeispiel ist eine beispielhafte Tokenberechnung.