Voltar aos guias
Agentes de programação·21 de setembro de 2026·Atualizado em 1 de outubro de 2026·11 min de leitura

Orçamento de contexto do IronClaw excedido: quatro erros, um número codificado

Quatro erros compartilham essa formulação; nenhum se refere à janela do seu modelo, e nenhuma chave de configuração, variável de ambiente ou flag de CLI altera o número por trás deles.

Última revisão em .

«Context budget exceeded» não é um único erro no IronClaw. Quatro variantes distintas de erro contêm essa formulação; nenhuma delas corresponde à janela de contexto do seu modelo, e nenhum arquivo de configuração, variável de ambiente ou flag da CLI altera o número por trás de qualquer uma delas. O orçamento é fixado no código compilado em 128.000 tokens, com uma reserva de 20.000 tokens, e as três camadas que o pressionam — arquivos de identidade, trechos de skills e esquemas de ferramentas — são montadas sobre essa alocação, e não dentro dela; isso consta do próprio relatório de defeito aberto do IronClaw, não é uma teoria desta página.

Uma desambiguação, porque o nome é bastante concorrido. Trata-se de github.com/nearai/ironclaw, o runtime de agentes em Rust da NEAR AI — não do mouse gamer da Corsair, que domina as buscas comerciais por essa palavra, nem da empresa não relacionada ironclaw.tech, que também vende software para agentes e também se compara ao OpenClaw. IronClaw vs OpenClaw explica essa distinção por completo. Todos os números no nível do código-fonte abaixo foram lidos de main no commit b0b999d (commitado em 10 de setembro de 2026), em 21 de setembro de 2026, por meio da API de conteúdo do GitHub. Esse commit é posterior à tag de release ironclaw-v1.4.0 publicada em 28 de agosto de 2026. Em 1º de outubro de 2026, o binário da release mais nova ironclaw-v1.4.1 (publicado em 29 de setembro de 2026, um patch para o Google OAuth e o Wasmtime sem alteração de orçamento nas notas) foi executado contra um endpoint de teste local; o que ele fez está registrado abaixo e se aplica a essa versão, enquanto os números do código-fonte continuam vinculados ao commit.

Qual «context budget exceeded» você está analisando

Estas são strings de exibição em Rust thiserror, que é o que chega aos logs e aos detalhes do erro. Ler a formulação exata informa qual camada falhou.

String exataOnde é geradoO que o dispara
skill context: context budget exceededironclaw_loop_contracts/src/skill_context.rsUm único trecho de skill com mais de 64 KiB de conteúdo do modelo, ou 256 KiB somados entre todos. Bytes, não tokens — e isso faz toda a compilação do contexto da skill falhar, em vez de simplesmente descartar o causador
skill context budget exceededironclaw_loop_host/src/skill_bundle_context_source.rsMais de 100 candidatos visíveis de pacotes de skills, contados antes de qualquer cálculo de orçamento de tokens. A camada de hospedagem também relança essa formulação ao mapear o erro de bytes no nível dos contratos acima, portanto a string, sozinha, não distingue os dois casos
skill activation context budget exceededskill_activation/activation.rsMais de 8 skills ativas em um turno, ou uma skill cujo custo estimado exceda o orçamento de tokens restante do seletor. Esse orçamento é 4.000 pelo padrão do próprio seletor e 6.000 quando o runtime de composição conecta a origem de skills do sistema de arquivos
identity context budget exceededironclaw_loop_host/src/identity_context.rsNada, atualmente. O comentário da própria documentação diz que está «Reservado para um modo de limite rígido futuro» e que o builder «trunca silenciosamente quando há estouro do orçamento, em vez de retornar este erro»

O que o usuário vê em um estouro real de modelo não contém nenhuma dessas palavras. A projeção fixa da falha, escrita pelo host, é a frase «The run failed because the model context was too large. Retry with a shorter request or start a new thread.», e o erro mapeado pelo provedor a partir do gateway do modelo é «model request exceeded its context budget». Duas ressalvas. Esta página não rastreou uma execução ponta a ponta, portanto não está estabelecido aqui qual frase voltada ao usuário uma falha na camada de skills finalmente projeta. E uma string amplamente repetida, «Model request context exceeds the available input budget», não aparece em nenhum lugar de nearai/ironclaw — ela pertence a outro projeto de agente e não deve ser usada para diagnosticar este caso.

Os 128.000 que você não pode configurar

PromptContextTokenBudget fornece três constantes: um limite de contexto de 128.000 tokens, uma reserva de 20.000 tokens e um valor máximo de saída do loop principal igual a 0. O transcript visível é o limite menos o maior dos dois últimos valores, ou seja, 108.000 tokens — aritmética derivada dos padrões, não um literal no arquivo. O terceiro termo nunca recebe valor fora dos testes, portanto a reserva é sempre os 20.000 fixos. E toda construção que não é de teste no repositório é o simples PromptContextTokenBudget::default() — uma na estratégia de compactação, outra no padrão TextOnlyLoopHostConfig do host do driver do loop; toda chamada ::new(…) com números diferentes fica dentro de um módulo #[cfg(test)].

A issue #5739 do próprio IronClaw diz isso no título — «Effective context budget is a hardcoded 128K that ignores the model's context_length and has no config override» — aberta desde 6 de julho de 2026 e ainda aberta em 21 de setembro de 2026. Três armadilhas decorrem disso:

  • As chaves budget.* não são isso. A página de configuração do IronClaw documenta budget.user_daily_usd, budget.pause_at e outras semelhantes em uma seção intitulada «budget — cost controls», descrita ali como limitadora dos gastos do agente. São configurações monetárias (duas delas, budget.overestimate_factor e budget.default_tz, são um multiplicador e um fuso horário, não valores em dólares). Nenhuma chave, em qualquer nível, define um limite de contexto, uma reserva, o teto de identidade ou o orçamento de skills — e a ordem de precedência publicada é «compiled defaults < config.toml < environment variables < CLI flags», portanto uma chave ausente está ausente em todos os lugares.
  • A PR #5790 é uma falsa pista. Seu título oferece um «prompt-context budget override through host factory». A API informa que ela foi encerrada em 27 de agosto de 2026 com merged: false.
  • As correções são todas propostas. #8053, que usaria 90% da janela anunciada de um modelo com a mesma reserva de 20.000, além de #7976 e #5435, estavam todas abertas quando verificadas.

Para um endpoint de terceiros, há uma etapa adicional, e ela é decisiva. ModelMetadata.context_length é um Option, a implementação padrão do trait LlmProvider retorna None — "Por padrão, retorna o nome do modelo sem informações de tamanho" — e o adaptador genérico compatível com OpenAI não define nenhuma substituição, portanto herda esse padrão. Um endpoint personalizado, assim, nunca anuncia uma janela. O IronClaw planeja 108.000 tokens de transcrição, quer seu modelo comporte um milhão ou 32.000, e a #8053 leria exatamente o campo que este caminho nunca define. Consulte Configuração de API personalizada do IronClaw para saber como esse endpoint é configurado; esta página permanece focada no orçamento.

As camadas que preenchem o prompt sem tocar no orçamento

A issue de aprimoramento aberta do IronClaw #8057, registrada em 3 de setembro de 2026 e ainda aberta quando verificada, descreve o mecanismo nas próprias palavras do fornecedor: o orçamento do prompt «dimensiona apenas o transcript», enquanto o conteúdo de identidade, os trechos de skills e memória, o contexto do canal e os esquemas de ferramentas «são montados sobre a alocação do transcript sem reduzi-la, portanto a solicitação recebida pelo provedor pode exceder o orçamento que o loop acredita estar respeitando». Isso é um relatório de defeito, não uma documentação do comportamento disponibilizado — mas explica por que uma execução pode falhar por tamanho enquanto cada camada individual parece obediente.

CamadaSeu próprio tetoComportamento no teto
Tokens do transcript108.000 estimadosPercorre do mais novo para o mais antigo e faz break na primeira mensagem que não cabe, descartando todas as anteriores. Isso é deliberado em main: ignorar uma mensagem intermediária «pode deixar chamadas de ferramentas do provedor sem as referências aos seus resultados»
Mensagens do transcript128Um limite de contagem separado aplicado antes do orçamento de tokens, portanto uma thread longa de mensagens curtas é cortada enquanto ainda está muito abaixo de 108.000
Arquivos de identidade8.000 estimadosTambém faz break, portanto tudo após o primeiro candidato grande também é descartado — silenciosamente. Os candidatos vêm de uma lista de permissões fixa de 11 arquivos, incluindo SOUL.md, AGENTS.md, SYSTEM.md e MEMORY.md
Ativação de skills8 slots; 4.000 tokens estimados por padrão no seletor, 6.000 conforme configurado pelo runtime de composiçãoGera skill activation context budget exceeded em qualquer um dos dois casos
Bytes dos trechos de skills64 KiB cada, 256 KiB no totalErro rígido; toda a compilação falha
Ferramentas anunciadas12.000 tokens estimados, 32 ferramentas — ou um décimo da janela do modelo, o que for menor, quando uma janela é conhecidaAdia o restante. Não limita os 27 nomes de ferramentas principais anunciados independentemente do modo
Tarefa aceita fixadaDeve caber sozinha em 108.000Classe de erro totalmente diferente: accepted task exceeds the prompt context token budget, gerado antes de qualquer nova tentativa

A camada de ferramentas é mensurável, e o IronClaw a mede. Seu benchmark commitado, sobre um fixture sintético de 93 ferramentas, registra uma redução de 21.355 para 3.843 tokens estimados de esquema, com 22 ferramentas anunciadas — 82,0%, protegida no repositório por uma tolerância de desvio de 2,0 pontos e um piso de 50,0%. Esses números foram lidos do arquivo de teste, não produzidos por sua execução aqui — o payload medido do binário lançado está na seção acima e tem formato diferente: o conjunto padrão de ferramentas, não um fixture de 93 ferramentas. Trate-os como estimativas internas do IronClaw, baseadas na contagem de caracteres de um fixture, não como o seu prompt de ferramentas nem como contagens do tokenizador do provedor. A leitura honesta é a forma: a divulgação progressiva remove a maior parte do esquema e ainda deixa um piso de alguns milhares de tokens que nenhuma configuração remove, porque os 27 nomes principais são anunciados em todos os modos de divulgação.

O que o binário lançado 1.4.1 fez

Em 1º de outubro de 2026, o binário de release ironclaw-v1.4.1, com checksum verificado, foi executado em um contêiner descartável com um slot [llm.default] no provedor openai_compatible, apontado para um servidor de teste local que registrava cada solicitação. Uma mensagem curta por execução através de ironclaw repl:

REBORN_TOOL_DISCLOSUREEsquemas de ferramentas na solicitaçãoBytes do esquema de ferramentas
não definido, namespaces ou bridged26 — 23 integradas mais tool_search, tool_describe e tool_call35,703
compact2635,406
signatures2635,435
off5061,630
true — não é um valor válido5061.630, idêntico a off

Portanto, o piso é real no build lançado: nenhum modo de divulgação enviou menos de 26 esquemas e, pela estimativa do próprio IronClaw de quatro caracteres por token, 35.703 bytes equivalem aproximadamente a 8.900 tokens antes de uma única palavra sua — com as mensagens de sistema e identidade adicionando cerca de 24.000 bytes. Isso é aritmética em bytes, não uma contagem de tokens do provedor. O risco de erro de digitação descrito abaixo foi confirmado, não inferido: true produziu exatamente o payload off, quase dobrando o prompt de ferramentas, sem nada na tela que indicasse isso.

O orçamento rígido foi acionado como o código-fonte dizia que seria. Uma mensagem de aproximadamente 380.000 caracteres foi enviada ao endpoint; uma de aproximadamente 460.000 caracteres — além de 108.000 tokens a quatro caracteres por token — nunca saiu da máquina. A REPL imprimiu apenas linhas de log de aviso nomeando o estágio Prompt, o tipo BudgetExceeded e o resumo accepted task exceeds the prompt context token budget. Nenhuma configuração foi encontrada, nem na configuração nem no ambiente, que alterasse essa linha. Os erros da camada de skills, o estouro de um modelo real e qualquer solicitação através do Kunavo não foram executados.

Tentar novamente não corrige o problema, e um erro de digitação o agrava

A estratégia de recuperação padrão tenta novamente um estouro de contexto exatamente uma vez, no escopo da iteração, com uma alteração ShrinkContext, e então aborta — os próprios nomes dos testes do fornecedor são model_context_overflow_compacts_once_then_aborts e second_model_context_overflow_aborts_without_another_compaction. Portanto, repetir a tentativa na mesma solicitação grande demais não pode funcionar. Para dar escala, os padrões da mesma estratégia permitem max_model_availability_attempts: 12 e max_attempts_per_class: 2; esta classe recebe a única tentativa ShrinkContext.

A compactação também não salvará você antes disso: seu limiar de acionamento é o mesmo 108.000, portanto nada força uma compactação antes de a transcrição chegar a esse valor. As compactações forçadas e de recuperação contornam o disjuntor; elas são a única forma de o loop reduzir um prompt grande demais antes de uma nova tentativa. Uma ressalva sobre a estratégia alternativa: a issue #5582, aberta desde 3 de julho de 2026, relata que ActiveTaskPreservingCompactionStrategy nunca lê a flag de estouro. Não foi rastreado aqui qual estratégia uma determinada implantação seleciona.

Vale verificar um risco de configuração antes de qualquer outra coisa. A divulgação progressiva de ferramentas é lida de REBORN_TOOL_DISCLOSURE, aceita off | compact | signatures | namespaces | bridged e, quando não definida ou vazia, usa o padrão namespaces. Qualquer outro valor não vazio — um erro de digitação, um true obsoleto ou on — é resolvido silenciosamente como Off, documentado no mesmo arquivo como "Grupo de controle: anunciar todos os esquemas autorizados." Um valor que não seja UTF-8 produz o mesmo resultado. O único sinal é uma linha tracing::debug!, e o efeito é um prompt de ferramentas materialmente maior. Remova a variável em vez de tentar adivinhar sua grafia.

O que você pode realmente alterar hoje

Não existe uma página publicada da documentação do IronClaw que cubra o orçamento de contexto, a compactação ou qualquer um desses quatro erros, portanto as alavancas abaixo são as que a documentação e o código sustentam em conjunto — não um remédio endossado pelo fornecedor.

A única alavanca documentada que reduz a pressão sobre o contexto de skills é uma flag de configuração, não uma variável de ambiente. A página de skills do IronClaw diz para defini-la em [skills] e observa que a ativação por palavra-chave e tag, além de menções explícitas a $my-skill, ainda injeta skills:

~/.ironclaw/reborn/config.toml
[skills]
# Documented lever: stops regex auto-activation from loading full skill
# context. Keyword/tag activation and $my-skill mentions still inject skills.
regex_activation_enabled = false

Há mais três, com seus limites declarados. O campo de frontmatter max_context_tokens de uma skill tem padrão 2000 segundo a mesma página de documentação, mas escrever um número pequeno ali não reduz uma skill grande: quando a estimativa do corpo supera duas vezes o valor declarado, o seletor registra que está "using actual estimate" e contabiliza o tamanho medido. Uma rotina reativa pode restringir sua superfície de ferramentas por meio de allowed_tools, que se aplica a essa rotina e não a turnos interativos. E as ferramentas de arquivo ficam desativadas, a menos que ALLOW_LOCAL_TOOLS=true: a documentação de ferramentas de arquivo do IronClaw diz que elas ficam desativadas por padrão "para evitar acesso acidental ao sistema de arquivos em ambientes hospedados ou compartilhados", portanto mantê-las desligadas significa um conjunto a menos de esquemas no prompt. Nenhuma dessas três opções afeta os 128.000.

Por fim, não planeje com base em um número obsoleto. A issue #7485 relatou que o orçamento de 108.000 tokens era «efetivamente ~54 mil tokens reais» para conteúdo ASCII e que a compactação era acionada «aproximadamente 2× antes». Isso era uma contagem dupla em um de dois estimadores de tokens. A PR #7502 unificou-os e foi integrada em 11 de agosto de 2026; a API de comparação do GitHub coloca o commit de merge dentro das tags v1.3.0 e v1.4.0 e dentro de main. Em comparação com v1.2.0 e v1.1.0, o resultado é «diverged», portanto o primeiro release que o contém não está estabelecido — considere v1.3.0 e posteriores. O único estimador atual cobra 4 caracteres por token para ASCII e aproximadamente 1,5 token por caractere não ASCII de 3 bytes, o que significa que um transcript predominantemente CJK preenche 108.000 muito mais rápido que um em inglês.

Quanto custa o teto por turno e qual rota vence

Isto é aritmética ilustrativa de tokens, não um custo de tarefa medido nem um teto de cobrança. Suponha um turno carregado ao máximo: o transcript no teto de 108.000 tokens, 8.000 de identidade, 4.000 de contexto de skills (o orçamento padrão do seletor; um runtime composto que conecte 6.000 elevaria esse valor) e 3.843 de esquema de ferramentas anunciado do benchmark registrado acima — 123,843 tokens de entrada estimados — mais 2,000 tokens de saída. Essas são estimativas do próprio IronClaw sobre um fixture sintético, portanto um tokenizador real de provedor discordará. As tarifas são os preços atuais do catálogo do Kunavo por milhão de tokens.

ModeloEntrada / saída por 1MCusto estimado, um turno no teto completoAdicionado por turno se a divulgação voltar para Off
Claude Haiku 4.5$0.70 / $3.50$0.094+$0.012
GPT-5.6 Terra$0.70 / $4.20$0.095+$0.012
Claude Sonnet 4.6$2.10 / $10.50$0.281+$0.037
Claude Opus 5$3.50 / $17.50$0.468+$0.061

A última coluna é o objetivo desta seção. Um REBORN_TOOL_DISCLOSURE digitado incorretamente adiciona 17,512 tokens de entrada estimados a cada turno — em Claude Sonnet 4.6, isso corresponde a $0.037 por turno antes de qualquer outra alteração, e um agente sempre ativo executa muitos turnos por dia. A segunda conclusão é que pagar por um modelo de contexto longo para escapar disso não funciona: o IronClaw monta até seu próprio número de qualquer forma, portanto a janela adicional não compra nada, enquanto a tarifa mais alta cobra todos os 123,843 tokens. Multiplique pelos seus próprios turnos por dia antes de tratar qualquer valor como orçamento.

OpçãoPreço publicadoVantagens
IronClaw auto-hospedadoSoftware de $0; o selo do README diz «License: MIT OR Apache-2.0», enquanto o campo de licença único da API do GitHub informa Apache-2.0Você quer controlar o endpoint. Não é necessário um servidor de banco de dados para começar — a documentação de armazenamento diz que o estado fica em arquivos incorporados no perfil local padrão, e PostgreSQL é a opção para implantações servidas ou multiusuário
API direta do fornecedorAs tarifas do fornecedor por tokenUma única família o dia todo, e você quer o cache nativo desse fornecedor
Gateway compatível com OpenAIAs tarifas do gateway por tokenVocê alterna entre famílias por tarefa e quer uma única chave — aceitando que nenhuma janela seja anunciada, o que é verdade neste caminho para qualquer gateway
ironclaw.com StarterRenderizado como $5 riscado para $0/mês, «$5 credits included», 1 instância de agenteExperimentando o caminho hospedado. Leia isso como promocional, não como um plano permanente de $0
ironclaw.com Basic$20/mês, «$20 credits included», até 2 instâncias de agente, compartilhamento de usoDuas implantações compartilhando crédito
ironclaw.com Pro+$200/mês, «$200 credits included», até 5 instâncias de agente, acesso antecipado a modelos avançados, suporte prioritárioA categoria hospedada mais alta
Modelo localSem cobrança por solicitação; hardware em vez dissoTrabalho pequeno ou privado — mas observe que o IronClaw ainda montará 108.000 tokens com uma janela local pequena

As linhas dos planos hospedados foram lidas de ironclaw.com em 21 de setembro de 2026; ironclaw.com/pricing retorna HTTP 404, portanto os planos estão na página inicial. O título acima dos três cards diz «Spin up to 5 agents in a Trusted Execution Environment with up to 130M tokens per month» — cinco agentes é o máximo do Pro+, portanto esse título declara o teto do plano mais alto, não o de um card específico, e o valor de 130M tokens não aparece em nenhum card. O que os créditos incluídos convertem em tokens e o que acontece quando acabam não foi publicado e não é estimado aqui.

O Kunavo não oferece nenhum modelo de embeddings, conversão de texto em fala ou conversão de fala em texto, portanto qualquer etapa de recuperação ou voz na sua configuração precisa chamar um provedor externo.

Experimente e depois leia a cobrança

Se você direcionar o IronClaw para um gateway compatível com OpenAI, o endpoint de chat-completions do Kunavo tem o formato esperado pelo ID de provedor openai_compatible. Essa é uma correspondência de protocolo lida na documentação dos dois lados — a execução de 1º de outubro acima usou um servidor de teste local, não o Kunavo, portanto o Kunavo não faz nenhuma alegação de compatibilidade. Mantenha uma rota funcional disponível, execute uma tarefa limitada e reconcilie com o uso registrado pela sua conta, não com o custo exibido pelo IronClaw, que é uma aritmética própria. O valor do catálogo do Kunavo é um piso de cobrança, não um limite: quando o upstream informa sua cobrança, a fatura é o maior entre o custo do catálogo e o custo do upstream multiplicado pelo markup aplicável. O recarregamento mínimo é de $10 em crédito pré-pago — um mínimo de financiamento, não uma taxa por tarefa nem uma assinatura; consulte detalhes de cobrança e crie uma conta quando estiver pronto para financiar uma chave. Para as escolhas relacionadas, Otimização de custos de IA aborda a medição do custo por tarefa concluída, e PicoClaw e ZeroClaw abordam dois runtimes irmãos cuja duração do loop é uma alavanca de custo da mesma forma.

Perguntas frequentes

O que significa "context budget exceeded" no IronClaw?

Não é um único erro. Quatro variantes de erro Rust distintas em nearai/ironclaw contêm essa formulação: "skill context: context budget exceeded" para um trecho de skill com mais de 64 KiB de conteúdo do modelo ou 256 KiB somados entre todos eles; "skill context budget exceeded", gerado para mais de 100 candidatos visíveis de pacotes de skills e também usado quando a camada de host remapeia esse erro de bytes; "skill activation context budget exceeded" para mais de 8 skills ativas em um turno, ou uma skill cujo custo estimado excede o orçamento de tokens restante do seletor — 4,000 pelo padrão próprio do seletor, 6,000 quando o runtime de composição conecta a fonte de skills do sistema de arquivos; e "identity context budget exceeded", que um comentário no código-fonte marca como reservado para um futuro modo de limite rígido, porque a faixa de identidade é truncada silenciosamente em vez disso. Nenhuma das quatro corresponde à janela de contexto do modelo. Lido na branch principal no commit b0b999d em 21 de setembro de 2026.

Como aumento o orçamento de contexto do IronClaw?

Você não pode, sem recompilar. O orçamento de contexto do prompt é um limite de 128,000 tokens incorporado na compilação, com uma reserva de 20,000 tokens; toda construção que não seja de teste no repositório usa o padrão simples, e não há chave de configuração, variável de ambiente ou flag de CLI para isso. A própria issue #5739 do IronClaw, aberta desde 6 de julho de 2026, diz a mesma coisa em seu título. As chaves budget.* da página de configuração controlam custos financeiros, não tokens de contexto, e a seção de configuração [skills] contém exatamente um campo na struct de configuração Rust, regex_activation_enabled. A PR #5790, cujo título promete uma substituição do orçamento de contexto do prompt, foi encerrada sem ser mesclada em 27 de agosto de 2026 — citá-la como solução é citar trabalho abandonado. Todos os estados foram verificados em 21 de setembro de 2026.

Um modelo com uma janela de contexto maior resolverá isso?

Não em um endpoint personalizado compatível com OpenAI. O IronClaw dimensiona seu prompt a partir de seu próprio número incorporado na compilação, não do modelo, e um endpoint genérico nunca informa o contrário: ModelMetadata.context_length é uma Option, o padrão do trait LlmProvider retorna None com o comentário "Default returns the model name with no size info", e o adaptador genérico compatível com OpenAI não define nenhuma substituição, portanto herda esse None. Aponte o IronClaw para um modelo de um milhão de tokens e ele ainda planejará 108,000 tokens de transcrição; aponte-o para um modelo local pequeno e ele montará 108,000 e deixará o provedor rejeitar a solicitação. A PR não mesclada #8053 derivaria o orçamento da janela anunciada, exatamente o campo que esse caminho nunca define. Lido no commit b0b999d em 21 de setembro de 2026.

Por que o IronClaw descarta mensagens anteriores antes de atingir o limite?

Dois limitadores são executados antes do orçamento de tokens. Um teto separado de 128 mensagens se aplica à análise da transcrição, portanto uma conversa longa de mensagens curtas pode ser interrompida pela contagem enquanto ainda está muito abaixo da alocação de tokens. Em seguida, a seleção da transcrição percorre as mensagens da mais recente para a mais antiga e para na primeira mensagem que não cabe, descartando todas as mensagens mais antigas em vez de ignorá-la — na branch principal, essa é uma escolha deliberada e documentada, com o comentário explicando que ignorar uma mensagem intermediária "pode deixar chamadas de ferramentas do provedor sem suas referências de resultado". A issue #7485 do IronClaw propôs ignorá-la; a proposta não foi adotada. Lido no commit b0b999d em 21 de setembro de 2026.

Definir SKILLS_MAX_TOKENS altera o orçamento de skills?

Não, e essa é uma contradição documentada que vale conhecer. A documentação chinesa de skills do IronClaw publica um bloco de código com SKILLS_MAX_TOKENS=4000 e descreve a seleção de skills até esgotar esse orçamento. A página de skills em inglês nunca menciona a variável, e o próprio arquivo de regras no repositório do IronClaw afirma que "the former SKILLS_MAX_TOKENS env var is not read by anything". Uma pesquisa de código do GitHub em todo o repositório em 21 de setembro de 2026 retornou três arquivos: esse arquivo de regras, a página de documentação chinesa e um script interno de animação — nenhum Rust. O valor efetivamente em vigor é incorporado na compilação: DEFAULT_MAX_SKILL_CONTEXT_TOKENS é 4000 como padrão do seletor, e o runtime de composição conecta a fonte de skills do sistema de arquivos em 6000. De qualquer forma, ele só muda com uma recompilação.

Tentar novamente a mesma solicitação ajuda?

Não. A estratégia de recuperação padrão do IronClaw tenta novamente um estouro de contexto do modelo exatamente uma vez, no escopo da iteração, com uma alteração ShrinkContext, e aborta na segunda vez — os próprios nomes dos testes do fornecedor são model_context_overflow_compacts_once_then_aborts e second_model_context_overflow_aborts_without_another_compaction. Uma mensagem de tarefa aceita e fixada que seja maior do que a alocação de transcrição visível nem sequer recebe isso: ela falha imediatamente com uma classe de erro diferente contendo a mensagem "accepted task exceeds the prompt context token budget". Encurte a solicitação ou inicie uma nova conversa, que é o que a própria frase de falha voltada ao usuário do IronClaw orienta você a fazer. Lido no commit b0b999d em 21 de setembro de 2026.

Executado em 1º de outubro de 2026: o binário de release ironclaw-v1.4.1 contra um servidor de teste local — a tabela de divulgação e a sondagem de orçamento acima; os estados das issues #5739, #8053, #8057, #7976 e #5435 foram verificados novamente no mesmo dia e todas continuavam abertas. Verificado em 21 de setembro de 2026. As constantes do código-fonte, strings de erro, estratégia de recuperação, estimador de tokens, modos de divulgação e linha de base do benchmark foram lidos de nearai/ironclaw main no commit b0b999d por meio da API de conteúdo do GitHub; os estados de issues e pull requests, pela API de issues do GitHub; as páginas de skills, configuração, armazenamento e ferramentas de arquivo em docs.ironclaw.com e os cards de planos em ironclaw.com, por busca direta. A tag de release v1.4.0 não foi obtida em checkout, nenhuma instância do IronClaw foi executada, nenhum teste do repositório foi executado, nenhum dos quatro erros foi reproduzido em execução e o Kunavo não testou o IronClaw em runtime. As tarifas de tokens do Kunavo vêm do catálogo atual, e todo valor em dólares é aritmética ilustrativa de tokens.