Zurück zu den Leitfäden
Coding-Agenten·21. September 2026·Aktualisiert am 1. Oktober 2026·11 Min. Lesezeit

IronClaw-Kontextbudget überschritten: vier Fehler, eine fest codierte Zahl

Vier Fehler verwenden diese Formulierung, keiner bezieht sich auf das Fenster Ihres Modells, und kein Konfigurationsschlüssel, keine Umgebungsvariable und kein CLI-Flag ändert die Zahl dahinter.

Zuletzt überprüft am .

„Context budget exceeded“ ist in IronClaw kein einzelner Fehler. Vier verschiedene Fehlervarianten enthalten diese Formulierung; keine davon bezeichnet das Kontextfenster Ihres Modells, und weder eine Konfigurationsdatei noch eine Umgebungsvariable noch ein CLI-Flag ändert die dahinterliegende Zahl. Das Budget beträgt einkompilierte 128.000 Tokens mit einer Reserve von 20.000 Tokens, und die drei Bereiche, die es belasten — Identitätsdateien, Skill-Snippets und Tool-Schemas — werden zusätzlich zu diesem Spielraum zusammengestellt und nicht innerhalb davon; das ist IronClaws eigener offener Fehlerbericht und keine Theorie dieser Seite.

Eine Klarstellung, da der Name mehrfach verwendet wird. Dies ist github.com/nearai/ironclaw, die Rust-Agent-Laufzeit von NEAR AI — nicht die Gaming-Maus von Corsair, die kommerzielle Suchergebnisse zum Wort dominiert, und nicht das unabhängige Unternehmen unter ironclaw.tech, das ebenfalls Agentensoftware verkauft und sich ebenfalls mit OpenClaw vergleicht. IronClaw vs. OpenClaw zieht diese Grenze vollständig. Jede nachfolgende Zahl auf Quellebene wurde aus main bei Commit b0b999d (committed am 10. September 2026) am 21. September 2026 über die GitHub-Contents-API gelesen. Dieser Commit ist später als der am 28. August 2026 veröffentlichte Release-Tag ironclaw-v1.4.0. Am 1. Oktober 2026 wurde die neuere ironclaw-v1.4.1 Release-Binärdatei (veröffentlicht am 29. September 2026, ein Patch für Google OAuth und Wasmtime ohne Budgetänderung in den Hinweisen) gegen einen lokalen Testendpunkt ausgeführt; was sie tat, ist unten dokumentiert und auf diese Version beschränkt, während die Quellzahlen auf den Commit beschränkt bleiben.

Welchen „context budget exceeded“-Fehler Sie vor sich haben

Dies sind Rust-thiserror-Anzeigetexte, die in Protokollen und Fehlerdetails erscheinen. Anhand der genauen Formulierung erkennen Sie, welcher Bereich fehlgeschlagen ist.

Exakter StringWo er ausgelöst wirdWas ihn auslöst
skill context: context budget exceededironclaw_loop_contracts/src/skill_context.rsEin Skill-Snippet mit mehr als 64 KiB Modellinhalt oder insgesamt 256 KiB. Bytes, keine Tokens — der gesamte Skill-Kontextaufbau schlägt fehl, statt den Verursacher zu verwerfen
skill context budget exceededironclaw_loop_host/src/skill_bundle_context_source.rsMehr als 100 sichtbare Skill-Bundle-Kandidaten, gezählt, bevor irgendein Tokenbudget berücksichtigt wird. Die Host-Schicht verwendet diese Formulierung außerdem erneut, wenn sie den oben genannten Bytefehler auf Vertragsebene abbildet; allein der String unterscheidet die beiden Fälle daher nicht
skill activation context budget exceededskill_activation/activation.rsMehr als 8 aktive Skills in einem Durchlauf oder ein Skill, dessen geschätzte Kosten das verbleibende Tokenbudget des Selektors überschreiten. Dieses Budget beträgt 4.000 nach dem eigenen Standardwert des Selektors und 6.000, wenn die Composition-Laufzeit die Dateisystem-Skill-Quelle verdrahtet
identity context budget exceededironclaw_loop_host/src/identity_context.rsHeute nichts. Der eigene Dokumentationskommentar sagt, dass dies „für einen künftigen Modus mit harter Begrenzung reserviert“ ist und dass der Builder „bei einer Budgetüberschreitung still kürzt, statt diesen Fehler zurückzugeben“

Was ein Benutzer bei einem tatsächlichen Überlauf des Modells sieht, enthält keines dieser Wörter. Die vom Host verfasste Fehlerdarstellung ist der feste Satz „The run failed because the model context was too large. Retry with a shorter request or start a new thread.“, und der vom Modell-Gateway abgebildete Fehler lautet „model request exceeded its context budget“. Zwei Hinweise. Diese Seite hat keinen End-to-End-Lauf nachverfolgt; daher ist hier nicht geklärt, in welchen benutzerseitigen Satz ein Fehler in der Skill-Spur letztlich überführt wird. Und ein häufig wiederholter String, „Model request context exceeds the available input budget“, erscheint nirgendwo in nearai/ironclaw — er gehört zu einem anderen Agentenprojekt und sollte nicht zur Diagnose dieses Projekts verwendet werden.

Die 128.000, die Sie nicht konfigurieren können

PromptContextTokenBudget liefert drei Konstanten: ein Kontextlimit von 128.000 Tokens, eine Reserve von 20.000 Tokens und einen Max-Output-Wert der Hauptschleife von 0. Der sichtbare Transkriptspielraum ist das Limit abzüglich des größeren der beiden letzten Werte, also 108.000 Tokens — eine Berechnung aus den Standardwerten, kein Literal in der Datei. Der dritte Wert wird außerhalb von Tests nie zugewiesen, daher bleibt die Reserve immer bei 20.000. Jede Konstruktion außerhalb von Tests im Repository verwendet den einfachen PromptContextTokenBudget::default() — eine in der Kompaktierungsstrategie, eine als Standardwert des Loop-Driver-Hosts TextOnlyLoopHostConfig; jeder ::new(…)-Aufruf mit anderen Zahlen befindet sich innerhalb eines #[cfg(test)]-Moduls.

IronClaws eigener Issue #5739 sagt es bereits im Titel — „Effective context budget is a hardcoded 128K that ignores the model's context_length and has no config override“ — seit dem 6. Juli 2026 offen und am 21. September 2026 weiterhin offen. Daraus ergeben sich drei Fallstricke:

  • Die Schlüssel budget.* sind nicht dafür zuständig. IronClaws Konfigurationsseite dokumentiert budget.user_daily_usd, budget.pause_at und verwandte Schlüssel unter einem Abschnitt mit der Überschrift „budget — cost controls“, der dort als Begrenzung der Agentenausgaben beschrieben wird. Es handelt sich um Geldeinstellungen (zwei davon, budget.overestimate_factor und budget.default_tz, sind ein Multiplikator bzw. eine Zeitzone und keine Dollarbeträge). Kein Schlüssel auf irgendeiner Ebene setzt ein Kontextlimit, eine Reserve, die Identitätsobergrenze oder das Skillbudget — und die veröffentlichte Prioritätsreihenfolge lautet „compiled defaults < config.toml < environment variables < CLI flags“; ein fehlender Schlüssel fehlt daher überall.
  • PR #5790 ist eine falsche Spur. Sein Titel bietet eine „prompt-context budget override through host factory“. Die API meldet, dass er am 27. August 2026 mit merged: false geschlossen wurde.
  • Die Korrekturen sind allesamt Vorschläge. #8053, das 90 % des beworbenen Modellfensters mit derselben Reserve von 20.000 verwenden würde, sowie #7976 und #5435 waren bei der Prüfung alle offen.

Für einen Drittanbieter-Endpunkt gibt es einen weiteren Schritt, und er ist entscheidend. ModelMetadata.context_length ist vom Typ Option, der Standardwert des LlmProvider-Traits gibt None zurück — „Default returns the model name with no size info“ — und der generische OpenAI-kompatible Adapter definiert keine Überschreibung, sodass er diesen Standardwert übernimmt. Ein benutzerdefinierter Endpunkt gibt daher überhaupt kein Fenster bekannt. IronClaw plant mit 108.000 Transkript-Tokens, unabhängig davon, ob Ihr Modell eine Million oder 32.000 Tokens aufnehmen kann, und #8053 würde genau das Feld auslesen, das dieser Pfad nie setzt. Eine Anleitung zur Konfiguration dieses Endpunkts finden Sie unter IronClaw – Einrichtung einer benutzerdefinierten API; diese Seite bleibt beim Budget.

Die Bereiche, die den Prompt füllen, ohne das Budget zu berühren

IronClaws offener Verbesserungs-Issue #8057, eingereicht am 3. September 2026 und bei der Prüfung weiterhin offen, beschreibt den Mechanismus mit den eigenen Worten des Anbieters: Das Promptbudget „dimensioniert nur das Transkript“, während Identitätsinhalte, Skill- und Memory-Snippets, Kanal-Kontext und Tool-Schemas „zusätzlich zum Transkriptspielraum zusammengestellt werden, ohne ihn zu reduzieren, sodass die Anfrage, die der Anbieter erhält, das Budget überschreiten kann, dessen Einhaltung die Schleife annimmt“. Das ist ein Fehlerbericht und keine Dokumentation ausgelieferten Verhaltens — aber er erklärt, warum ein Lauf wegen der Größe fehlschlagen kann, obwohl jeder einzelne Bereich unauffällig wirkt.

BereichEigene ObergrenzeVerhalten an der Obergrenze
Transkript-Tokens108.000 geschätztDurchläuft die Nachrichten vom neuesten zum ältesten und break bei der ersten Nachricht, die nicht hineinpasst, wodurch alle älteren Nachrichten verworfen werden. Bewusste Entscheidung in main: Das Überspringen einer Nachricht in der Mitte „kann Provider-Toolaufrufe von ihren Ergebnisreferenzen trennen“
Transkriptnachrichten128Eine separate Anzahlbegrenzung wird vor der Tokenbudgetierung angewendet, sodass ein langer Thread mit kurzen Nachrichten weit unter 108.000 gekürzt wird
Identitätsdateien8.000 geschätztBricht ebenfalls bei break ab, sodass auch alles nach dem ersten zu großen Kandidaten verworfen wird — stillschweigend. Die Kandidaten stammen aus einer festen Zulassungsliste mit 11 Dateien, darunter SOUL.md, AGENTS.md, SYSTEM.md und MEMORY.md
Skill-Aktivierung8 Slots; 4.000 geschätzte Tokens nach dem Standardwert des Selektors, 6.000 bei der Verdrahtung durch die Composition-LaufzeitLöst bei beiden Fällen skill activation context budget exceeded aus
Bytes der Skill-Snippets64 KiB je Snippet, insgesamt 256 KiBHarter Fehler, der gesamte Aufbau schlägt fehl
Beworbene Tools12.000 geschätzte Tokens, 32 Tools — oder ein Zehntel des Modellfensters, je nachdem, was kleiner ist, sofern ein Fenster bekannt istStellt den Rest zurück. Begrenzt die unabhängig vom Modus beworbenen 27 Namen der Kerntools nicht
Angeheftete akzeptierte AufgabeMuss allein in 108.000 passenVollständig andere Fehlerklasse: accepted task exceeds the prompt context token budget, ausgelöst vor jeder Wiederholung

Die Tool-Spur ist messbar, und IronClaw misst sie. Der festgeschriebene Benchmark mit einem synthetischen Fixture aus 93 Tools verzeichnet eine Reduktion von 21.355 auf 3.843 geschätzte Schema-Tokens bei 22 beworbenen Tools — 82,0 %, im Repository abgesichert durch eine Drift-Toleranz von 2,0 Punkten und eine Untergrenze von 50,0 %. Diese Zahlen wurden aus der Testdatei gelesen und nicht hier durch Ausführung erzeugt — die gemessene Nutzlast der veröffentlichten Binärdatei steht in dem Abschnitt oben und hat eine andere Form: der Standardsatz von Tools, kein Fixture aus 93 Tools. Betrachten Sie sie als IronClaws interne, auf der Zeichenanzahl basierende Token-Schätzungen für ein Fixture, nicht als Ihren Tool-Prompt und nicht als Tokenanzahlen des Anbieter-Tokenizers. Die ehrliche Aussage betrifft die Form: Progressive Offenlegung entfernt den Großteil des Schemas und lässt dennoch eine Untergrenze von einigen tausend Tokens bestehen, die keine Einstellung entfernt, weil die 27 Kernnamen in jedem Offenlegungsmodus beworben werden.

Was die veröffentlichte Binärdatei 1.4.1 getan hat

Am 1. Oktober 2026 lief die checksum-verifizierte Release-Binärdatei ironclaw-v1.4.1 in einem Wegwerfcontainer mit einem [llm.default]-Slot beim openai_compatible-Anbieter, der auf einen lokalen Testserver zeigte, der jede Anfrage aufzeichnete. Pro Lauf eine kurze Nachricht über ironclaw repl:

REBORN_TOOL_DISCLOSURETool-Schemas in der AnfrageBytes des Tool-Schemas
nicht gesetzt, namespaces oder bridged26 — 23 integrierte plus tool_search, tool_describe und tool_call35,703
compact2635,406
signatures2635,435
off5061,630
true — kein gültiger Wert5061.630, identisch mit off

Die Untergrenze ist im veröffentlichten Build also real: Kein Offenlegungsmodus sendete weniger als 26 Schemas, und nach IronClaws eigener Schätzung von vier Zeichen pro Token entsprechen 35.703 Bytes ungefähr 8.900 Tokens, bevor auch nur ein einziges Wort von Ihnen hinzukommt — die System- und Identitätsnachrichten fügen etwa 24.000 weitere Bytes hinzu. Das ist eine Berechnung anhand von Bytes, keine Tokenanzahl des Anbieters. Die unten beschriebene Tippfehlergefahr ist bestätigt und nicht nur abgeleitet: true erzeugte exakt die off-Nutzlast und verdoppelte damit den Tool-Prompt beinahe, ohne dass auf dem Bildschirm darauf hingewiesen wurde.

Das harte Budget wurde wie vom Quelltext angekündigt ausgelöst. Eine Nachricht mit etwa 380.000 Zeichen wurde an den Endpunkt gesendet; eine Nachricht mit etwa 460.000 Zeichen – mehr als 108.000 Token bei vier Zeichen pro Token – verließ den Rechner nie. Die REPL gab nur Warnprotokollzeilen aus, in denen die Stufe Prompt, die Art BudgetExceeded und die Zusammenfassung accepted task exceeds the prompt context token budget genannt wurden. Es wurde weder in der Konfiguration noch in der Umgebung eine Einstellung gefunden, die diese Zeile verlagert hätte. Die Fehler der Skill-Lane, der Überlauf eines echten Modells und jegliche Anfrage über Kunavo wurden nicht ausgeführt.

Erneutes Ausführen ist keine Lösung, und ein Tippfehler macht es schlimmer

Die standardmäßige Wiederherstellungsstrategie versucht einen Kontextüberlauf genau einmal auf Iterationsebene erneut, mit einer Änderung ShrinkContext, und bricht danach ab – die eigenen Testnamen des Anbieters lauten model_context_overflow_compacts_once_then_aborts und second_model_context_overflow_aborts_without_another_compaction. Daher kann ein erneuter Versuch derselben übergroßen Anfrage nicht erfolgreich sein. Zur Einordnung: Die Standardwerte derselben Strategie erlauben max_model_availability_attempts: 12 und max_attempts_per_class: 2; diese Klasse erhält den einzigen ShrinkContext-Versuch.

Auch eine Komprimierung hilft nicht früher: Der Auslöseschwellenwert der Komprimierung ist ebenfalls 108.000, daher erzwingt nichts eine Komprimierung, bevor das Transkript diesen Wert erreicht. Erzwungene und Wiederherstellungskomprimierungen umgehen den Circuit Breaker, was der einzige Weg der Schleife ist, einen übergroßen Prompt vor einem erneuten Versuch zu verkleinern. Ein Vorbehalt zur alternativen Strategie: Das seit dem 3. Juli 2026 offene Issue #5582 berichtet, dass ActiveTaskPreservingCompactionStrategy das Überlaufflag nie liest. Welche Strategie eine bestimmte Bereitstellung auswählt, wurde hier nicht nachverfolgt.

Ein Konfigurationsrisiko sollte vor allem anderen geprüft werden. Die progressive Tool-Offenlegung wird aus REBORN_TOOL_DISCLOSURE gelesen, akzeptiert off | compact | signatures | namespaces | bridged und verwendet bei fehlendem oder leerem Wert standardmäßig namespaces. Jeder andere nicht leere Wert – ein Tippfehler, ein veraltetes true oder on – wird stillschweigend zu Off aufgelöst, dokumentiert in derselben Datei als „Control arm: advertise every authorized schema.“ Ein Nicht-UTF-8-Wert bewirkt dasselbe. Das einzige Signal ist eine tracing::debug!-Zeile, und die Auswirkung ist ein wesentlich größerer Tool-Prompt. Entfernen Sie die Variable, statt über ihre Schreibweise zu raten.

Was Sie heute tatsächlich ändern können

Es gibt keine veröffentlichte IronClaw-Dokumentationsseite zum Kontextbudget, zur Komprimierung oder zu einem dieser vier Fehler. Die folgenden Stellschrauben werden daher gemeinsam von Dokumentation und Code gestützt – sie sind kein vom Anbieter bestätigtes Heilmittel.

Die einzige dokumentierte Stellschraube, die den Druck durch den Skill-Kontext reduziert, ist ein Konfigurations-Flag, keine Umgebungsvariable. Auf der Skills-Seite von IronClaw steht, dass es unter [skills] gesetzt wird; außerdem wird darauf hingewiesen, dass die Aktivierung über Schlüsselwörter und Tags sowie explizite Erwähnungen von $my-skill weiterhin Skills einfügt:

~/.ironclaw/reborn/config.toml
[skills]
# Documented lever: stops regex auto-activation from loading full skill
# context. Keyword/tag activation and $my-skill mentions still inject skills.
regex_activation_enabled = false

Drei weitere Punkte, einschließlich ihrer Grenzen. Das Frontmatter-Feld max_context_tokens eines Skills hat laut derselben Dokumentationsseite standardmäßig den Wert 2000. Eine dort eingetragene kleine Zahl verkleinert einen großen Skill jedoch nicht: Wenn die Schätzung des Inhalts mehr als doppelt so hoch ist wie der deklarierte Wert, protokolliert der Selektor „using actual estimate“ und berechnet die gemessene Größe. Eine reaktive Routine kann ihre Tool-Oberfläche über allowed_tools einschränken; dies gilt für diese Routine und nicht für interaktive Durchläufe. Dateitools sind deaktiviert, sofern nicht ALLOW_LOCAL_TOOLS=true gesetzt ist: In der Dokumentation zu IronClaws Dateitools steht, dass sie standardmäßig „to prevent accidental filesystem access in hosted or shared environments“ deaktiviert sind. Sie deaktiviert zu lassen bedeutet daher einen weiteren Satz von Schemata weniger im Prompt. Keiner dieser drei Punkte berührt die 128.000.

Planen Sie schließlich nicht mit einer veralteten Zahl. Issue #7485 berichtete, dass das Budget von 108.000 Token für ASCII-Inhalte „effectively ~54k real tokens“ betrug und die Komprimierung „roughly 2× early“ ausgelöst wurde. Das war eine Doppelzählung in einem von zwei Token-Schätzern. PR #7502 vereinheitlichte sie und wurde am 11. August 2026 zusammengeführt; die Vergleichs-API von GitHub ordnet den Merge-Commit innerhalb der Tags v1.3.0 und v1.4.0 sowie innerhalb von main ein. Gegen v1.2.0 und v1.1.0 liefert der Vergleich „diverged“, daher ist die früheste Version, die ihn enthält, nicht festgestellt – nennen Sie v1.3.0 und später. Der einzige aktuelle Schätzer berechnet ASCII mit vier Zeichen pro Token und ungefähr 1,5 Token pro 3-Byte-Zeichen außerhalb von ASCII. Das bedeutet, dass ein CJK-lastiges Transkript 108.000 deutlich schneller füllt als ein englisches.

Was die Obergrenze pro Durchlauf kostet und welcher Weg gewinnt

Dies ist eine beispielhafte Token-Berechnung, keine Messung der Kosten einer Aufgabe und keine Abrechnungsobergrenze. Nehmen wir einen maximal ausgelasteten Durchlauf an: das Transkript an seiner Obergrenze von 108.000 Token, 8.000 für die Identität, 4.000 für den Skill-Kontext (das Standardbudget des Selektors; eine zusammengesetzte Laufzeitkonfiguration mit 6.000 würde diesen Wert erhöhen) und 3.843 für die angebotenen Tool-Schemata aus dem oben dokumentierten Benchmark – 123,843 geschätzte Eingabetoken – plus 2,000 Ausgabetoken. Dies sind IronClaws eigene Schätzungen anhand synthetischer Testdaten; ein tatsächlicher Tokenizer des Anbieters wird davon abweichen. Die Preise sind aktuelle Preise des Kunavo-Katalogs pro Million Token.

ModellEingabe / Ausgabe pro 1 Mio.Geschätzte Kosten für einen Durchlauf bei voller ObergrenzeZusätzlich pro Durchlauf, wenn die Offenlegung auf Off zurückfällt
Claude Haiku 4.5$0.70 / $3.50$0.094+$0.012
GPT-5.6 Terra$0.70 / $4.20$0.095+$0.012
Claude Sonnet 4.6$2.10 / $10.50$0.281+$0.037
Claude Opus 5$3.50 / $17.50$0.468+$0.061

Die letzte Spalte ist der Kern dieses Abschnitts. Ein falsch geschriebenes REBORN_TOOL_DISCLOSURE fügt 17,512 geschätzte Eingabetoken zu jedem Durchlauf hinzu – auf Claude Sonnet 4.6 sind das $0.037 pro Durchlauf, bevor sich irgendetwas anderes ändert, und ein ständig aktiver Agent führt täglich viele Durchläufe aus. Die zweite Erkenntnis ist, dass der Wechsel zu einem Modell mit langem Kontext dieses Problem nicht löst: IronClaw erstellt den Prompt unabhängig davon bis zu seiner eigenen Zahl, sodass das zusätzliche Fenster nichts bringt, während der höhere Tarif für alle 123,843 Token berechnet wird. Multiplizieren Sie die Werte mit Ihren eigenen Durchläufen pro Tag, bevor Sie irgendetwas davon als Budget betrachten.

WegVeröffentlichter PreisVorteile, wenn
Selbst gehostetes IronClaw$0 Software; das README-Badge lautet „License: MIT OR Apache-2.0“, während das einzelne Lizenzfeld der GitHub-API Apache-2.0 meldetSie möchten Kontrolle über den Endpunkt. Für den Start ist kein Datenbankserver erforderlich – laut Speicherdokumentation liegt der Zustand im Standardprofil in eingebetteten Dateien, und PostgreSQL ist die Option für bereitgestellte oder Mehrbenutzer-Bereitstellungen
Direkte Anbieter-APIDie Tokenpreise des AnbietersEine Familie den ganzen Tag nutzen und das native Caching dieses Anbieters verwenden
Ein OpenAI-kompatibles GatewayDie Tokenpreise des GatewaysSie wechseln je nach Aufgabe zwischen Familien und möchten einen Schlüssel verwenden – mit der Akzeptanz, dass kein Kontextfenster beworben wird, was auf diesem Pfad für jedes Gateway zutrifft
ironclaw.com StarterAls 5 $ durchgestrichen auf 0 $/Monat dargestellt, „5 $ Guthaben inklusive“, 1 Agent-InstanzSie testen den gehosteten Weg. Betrachten Sie ihn als Werbeangebot, nicht als dauerhaftes 0-$-Abo
ironclaw.com Basic20 $/Monat, „20 $ Guthaben inklusive“, bis zu 2 Agent-Instanzen, gemeinsame Nutzung des KontingentsZwei Bereitstellungen teilen sich ein Guthaben
ironclaw.com Pro+200 $/Monat, „200 $ Guthaben inklusive“, bis zu 5 Agent-Instanzen, früher Zugriff auf fortgeschrittene Modelle, bevorzugter SupportDie höchste gehostete Tarifstufe
Lokales ModellKeine Gebühr pro Anfrage; stattdessen HardwareKleine oder private Aufgaben – beachten Sie jedoch, dass IronClaw auch bei einem kleinen lokalen Fenster weiterhin 108.000 Token zusammenstellt

Die Zeilen der gehosteten Tarife wurden am 21. September 2026 von ironclaw.com gelesen; ironclaw.com/pricing liefert HTTP 404, daher befinden sich die Tarife auf der Startseite. Die Überschrift über allen drei Karten lautet „Spin up to 5 agents in a Trusted Execution Environment with up to 130M tokens per month“ – fünf Agenten sind das Maximum von Pro+, daher nennt diese Überschrift die Obergrenze des höchsten Tarifs und nicht die einer einzelnen Karte; außerdem erscheint die Zahl von 130M Token auf keiner Karte. Wieviel die enthaltenen Guthaben in Token umrechnen und was geschieht, wenn sie aufgebraucht sind, ist nicht veröffentlicht und wird hier nicht vermutet.

Kunavo bietet kein Embedding-, Text-to-Speech- oder Speech-to-Text-Modell an. Daher muss jeder Abruf- oder Sprachschritt in Ihrem Setup einen externen Anbieter aufrufen.

Probieren Sie es aus und lesen Sie dann die Abrechnung

Wenn Sie IronClaw über ein OpenAI-kompatibles Gateway routen, entspricht Kunavos Chat-Completions-Endpunkt der Form, die die Anbieter-ID openai_compatible erwartet. Dies ist eine aus der Dokumentation beider Seiten abgeleitete Übereinstimmung des Protokolls – der oben beschriebene Lauf vom 1. Oktober verwendete einen lokalen Testserver, nicht Kunavo; Kunavo erhebt daher keinen Kompatibilitätsanspruch. Halten Sie eine funktionierende Route bereit, führen Sie eine begrenzte Aufgabe aus und gleichen Sie sie mit der von Ihrem Konto erfassten Nutzung ab, nicht mit den von IronClaw angezeigten Kosten, da diese auf eigener Arithmetik beruhen. Der Katalogbetrag von Kunavo ist eine Abrechnungsuntergrenze und keine Obergrenze: Wenn der Upstream seine Kosten meldet, entspricht die Rechnung dem höheren Wert aus den Katalogkosten und den Upstream-Kosten multipliziert mit dem anwendbaren Aufschlag. Die minimale Aufladung beträgt $10 als Prepaid-Guthaben – eine Finanzierungsuntergrenze, keine Aufgabengebühr und kein Abonnement; siehe Abrechnungsdetails und erstellen Sie ein Konto, wenn Sie einen Schlüssel aufladen möchten. Für die angrenzenden Entscheidungen behandelt KI-Kostenoptimierung die Messung der Kosten pro abgeschlossener Aufgabe, und PicoClaw sowie ZeroClaw behandeln zwei verwandte Laufzeiten, bei denen die Länge der Schleife auf dieselbe Weise ein Kostenhebel ist.

Häufig gestellte Fragen

Was bedeutet „context budget exceeded“ in IronClaw?

Es handelt sich nicht um einen einzigen Fehler. Vier separate Rust-Fehlervarianten in nearai/ironclaw enthalten diese Formulierung: „skill context: context budget exceeded“ für ein Skill-Snippet mit mehr als 64 KiB Modellinhalt oder mehr als 256 KiB über alle Snippets hinweg; „skill context budget exceeded“, ausgelöst bei mehr als 100 sichtbaren Skill-Bundle-Kandidaten und außerdem verwendet, wenn die Host-Schicht den Bytefehler neu abbildet; „skill activation context budget exceeded“ für mehr als 8 aktive Skills in einem Durchlauf oder einen Skill, dessen geschätzte Kosten das verbleibende Tokenbudget des Selektors überschreiten — 4.000 nach dem eigenen Standardwert des Selektors, 6.000 dort, wo die Composition-Laufzeit die Dateisystem-Skill-Quelle verdrahtet; sowie „identity context budget exceeded“, das ein Quellkommentar als für einen künftigen Modus mit harter Begrenzung reserviert kennzeichnet, weil die Identitätsspur stattdessen still gekürzt wird. Keine dieser vier Varianten bezeichnet das Kontextfenster des Modells. Gelesen aus dem main-Branch bei Commit b0b999d am 21. September 2026.

Wie erhöhe ich das Kontextbudget von IronClaw?

Das können Sie nicht, ohne neu zu kompilieren. Das Prompt-Kontextbudget ist ein einkompiliertes Limit von 128.000 Tokens mit einer Reserve von 20.000 Tokens; jede Konstruktion außerhalb von Tests im Repository verwendet den einfachen Standardwert, und es gibt dafür keinen Konfigurationsschlüssel, keine Umgebungsvariable und kein CLI-Flag. IronClaws eigener Issue #5739, der seit dem 6. Juli 2026 offen ist, sagt dasselbe bereits im Titel. Die Schlüssel budget.* auf der Konfigurationsseite steuern Kosten, nicht Kontext-Tokens, und der Konfigurationsabschnitt [skills] enthält in der Rust-Konfigurationsstruktur genau ein Feld: regex_activation_enabled. PR #5790, dessen Titel eine Überschreibung des Prompt-Kontextbudgets verspricht, wurde am 27. August 2026 geschlossen, ohne zusammengeführt worden zu sein — ihn als Lösung anzuführen, würde aufgegebene Arbeit als Lösung darstellen. Alle Zustände wurden am 21. September 2026 geprüft.

Behebt ein Modell mit einem größeren Kontextfenster das Problem?

Nicht an einem benutzerdefinierten OpenAI-kompatiblen Endpunkt. IronClaw dimensioniert seinen Prompt anhand seiner eigenen einkompilierten Zahl, nicht anhand des Modells, und ein generischer Endpunkt teilt ihm nichts anderes mit: ModelMetadata.context_length ist vom Typ Option, der Standardwert des LlmProvider-Traits gibt None zurück mit dem Kommentar „Default returns the model name with no size info“, und der generische OpenAI-kompatible Adapter definiert keine Überschreibung, sodass er dieses None übernimmt. Verweisen Sie IronClaw auf ein Modell mit einer Million Tokens, plant es weiterhin mit 108.000 Transkript-Tokens; verweisen Sie es auf ein kleines lokales Modell, erstellt es 108.000 und lässt den Anbieter die Anfrage ablehnen. Der nicht zusammengeführte PR #8053 würde das Budget aus dem beworbenen Fenster ableiten — genau aus dem Feld, das dieser Pfad nie setzt. Gelesen bei Commit b0b999d am 21. September 2026.

Warum verwirft IronClaw frühere Nachrichten, bevor das Limit erreicht ist?

Vor dem Tokenbudget greifen zwei Begrenzungen. Eine separate Obergrenze von 128 Nachrichten gilt für den Transkriptscan, sodass ein langer Thread mit kurzen Nachrichten nach Anzahl gekürzt werden kann, obwohl das Tokenlimit noch längst nicht erreicht ist. Anschließend durchläuft die Transkriptauswahl die Nachrichten vom neuesten zum ältesten und bricht bei der ersten Nachricht ab, die nicht hineinpasst, wodurch jede ältere Nachricht verworfen wird, statt diese eine zu überspringen — im main-Branch ist dies eine bewusst dokumentierte Entscheidung; der Kommentar erklärt, dass das Überspringen einer Nachricht in der Mitte „Provider-Toolaufrufe von ihren Ergebnisreferenzen trennen kann“. IronClaw Issue #7485 schlug stattdessen das Überspringen vor; dieser Vorschlag wurde nicht übernommen. Gelesen bei Commit b0b999d am 21. September 2026.

Ändert das Setzen von SKILLS_MAX_TOKENS das Skillbudget?

Nein, und dies ist ein dokumentierter Widerspruch, den man kennen sollte. Die chinesische Skill-Dokumentation von IronClaw enthält einen Codeblock mit SKILLS_MAX_TOKENS=4000 und beschreibt, dass Skills ausgewählt werden, bis dieses Budget ausgeschöpft ist. Die englische Skill-Seite erwähnt die Variable nie, und IronClaws eigene Regeldatei im Repository erklärt: „the former SKILLS_MAX_TOKENS env var is not read by anything“. Eine GitHub-Codesuche über das Repository am 21. September 2026 ergab drei Dateien: diese Regeldatei, die chinesische Dokumentationsseite und ein internes Animationsskript — keinen Rust-Code. Der tatsächlich geltende Wert ist einkompiliert: DEFAULT_MAX_SKILL_CONTEXT_TOKENS beträgt als Standardwert des Selektors 4000, und die Composition-Laufzeit verdrahtet die Dateisystem-Skill-Quelle mit 6000. In beiden Fällen lässt er sich nur durch erneutes Kompilieren ändern.

Hilft es, dieselbe Anfrage erneut zu senden?

Nein. IronClaws standardmäßige Wiederherstellungsstrategie wiederholt einen Modellkontextüberlauf genau einmal, auf Iterationsebene, mit einer ShrinkContext-Änderung, und bricht beim zweiten Mal ab — die eigenen Tests des Anbieters heißen model_context_overflow_compacts_once_then_aborts und second_model_context_overflow_aborts_without_another_compaction. Eine angeheftete Nachricht mit akzeptierter Aufgabe, die größer als der sichtbare Transkriptspielraum ist, erhält diese Wiederholung nicht einmal: Sie schlägt sofort mit einer anderen Fehlerklasse fehl, die die Nachricht „accepted task exceeds the prompt context token budget“ enthält. Kürzen Sie die Anfrage oder beginnen Sie einen neuen Thread; genau dazu fordert Sie IronClaws eigener benutzerseitiger Fehlersatz auf. Gelesen bei Commit b0b999d am 21. September 2026.

Lauf vom 1. Oktober 2026: das Binärprogramm der Version ironclaw-v1.4.1 gegen einen lokalen Testserver – die Offenlegungstabelle und die obige Budgetprüfung; die Issue-Status für #5739, #8053, #8057, #7976 und #5435 wurden am selben Tag erneut geprüft und waren alle weiterhin offen. Geprüft am 21. September 2026. Konstanten aus dem Quellcode, Fehlerzeichenketten, die Wiederherstellungsstrategie, der Token-Schätzer, die Offenlegungsmodi und die Benchmark-Basis wurden aus nearai/ironclaw main bei Commit b0b999d über die GitHub-Contents-API gelesen; Issue- und Pull-Request-Status über die GitHub-Issues-API; die Skills-, Konfigurations-, Speicher- und Dateitool-Seiten auf docs.ironclaw.com sowie die Tarifkarten auf ironclaw.com wurden durch direkten Abruf gelesen. Der Release-Tag v1.4.0 wurde nicht ausgecheckt, keine IronClaw-Instanz wurde ausgeführt, kein Test im Repository wurde ausgeführt, keiner der vier Fehler wurde reproduziert, und Kunavo hat IronClaw nicht zur Laufzeit getestet. Die Kunavo-Tokenpreise stammen aus dem aktuellen Katalog, und jeder Dollarbetrag ist eine beispielhafte Token-Arithmetik.