Claude Opus 5.5 é o Opus mais recente da Anthropic, lançado September 22, 2026, e o modelo para o qual a Anthropic agora direciona “a maioria das cargas de trabalho”. O preço da API é $4.00 de entrada / $20.00 de saída por 1M de tokens na Anthropic — abaixo dos $5.00 / $25.00 do Opus 5 — e $2.80 / $14.00 no Kunavo, 30% abaixo desse preço de tabela. O ID do modelo é claude-opus-5-5; ele tem uma janela de contexto de 1M de tokens e até 128K tokens de saída, e raciocina em todas as solicitações.
Preços da API do Claude Opus 5.5
Tarifas publicadas pela Anthropic ao lado das do Kunavo, por 1M de tokens. A Anthropic cobra 5% pela leitura do cache do Opus 5.5, em vez dos 10% cobrados na maioria dos modelos Claude, e o Kunavo repassa a mesma proporção:
| Classe de token | Lista da Anthropic | Kunavo |
|---|---|---|
| Entrada | $4.00 | $2.80 |
| Saída (incluindo raciocínio) | $20.00 | $14.00 |
| Gravação no cache | $5.00 (5 min) · $8.00 (1 hora) | $3.50, qualquer TTL |
| Leitura do cache | $0.20 | $0.14 |
Ao lado do restante da linha Claude no Kunavo, o Opus 5.5 é a forma mais barata de obter raciocínio no nível Opus — mais barato que Claude Opus 5 ($3.50 / $17.50). Claude Sonnet 5 custa ainda menos ($1.40 / $7.00), com Claude Fable 5.1 a $7.00 / $35.00 no topo da linha e Claude Haiku 4.5 a $0.70 / $3.50 na base. Todas as tarifas do Claude, com exemplos calculados, estão no guia de preços da Claude API; a página do próprio modelo é /models/claude-opus-5-5.
Chamar o Claude Opus 5.5
Uma única chave do Kunavo alcança o Opus 5.5 pelo endpoint compatível com OpenAI e pela API Anthropic Messages nativa. Com o OpenAI SDK, altere base_url e a string do modelo:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["KUNAVO_API_KEY"],
base_url="https://api.kunavo.com/v1",
)
# Opus 5.5 always thinks, and thinking bills as output — leave max_tokens
# generous or the budget is spent before the answer starts.
resp = client.chat.completions.create(
model="claude-opus-5-5",
max_tokens=4096,
messages=[{"role": "user", "content": "Review this migration plan for failure modes."}],
)
print(resp.choices[0].message.content)Com o Anthropic SDK, informe a origem como base_url; o SDK acrescenta /v1/messages automaticamente:
from anthropic import Anthropic
# Native Messages API: pass the origin — the SDK appends /v1/messages.
client = Anthropic(base_url="https://api.kunavo.com", auth_token="sk-kn-...")
msg = client.messages.create(
model="claude-opus-5-5",
max_tokens=8192, # thinking plus the answer
messages=[{"role": "user", "content": "Find the race condition in this diff."}],
)
for block in msg.content:
if block.type == "text":
print(block.text)As chaves são criadas em /app/keys; o guia de chaves da Claude API mostra o procedimento.
O que mudou em relação ao Opus 5 — e como isso afeta suas solicitações
A Anthropic lista quatro mudanças incompatíveis para código executado no Opus 5 e uma alteração no formato da resposta. Escreva de acordo com as regras da Anthropic — mas saiba que duas delas não falharam pelo Kunavo quando testamos em 24 de setembro de 2026:
- O raciocínio não pode ser desativado. Na Anthropic,
thinking: {type: "disabled"}ebudget_tokensretornam 400 em todos os níveis de esforço, e effort (padrãomedium) é o único controle. Pelo Kunavo, a solicitação de desativação retornou 200 e o modelo raciocinou mesmo assim, enquantooutput_config.effortnão produziu diferença mensurável — o canal que oferece o Opus 5.5 não aplica nenhuma das duas configurações. O raciocínio é cobrado como saída: uma resposta de uma palavra consumiu 15 dos 16 tokens de saída pensando. Mantenhamax_tokenscom margem suficiente. - O uso forçado de ferramentas não é compatível. Na Anthropic,
tool_choicedeanyoutoolretorna 400 (o"required"compatível com OpenAI é mapeado paraany). Pelo Kunavo, uma solicitação de ferramenta forçada retornou 200; portanto, não se deve depender do forçamento. Useautoe nomeie a ferramenta no prompt. - Os blocos de raciocínio estão vinculados ao modelo e à conversa. Reproduza-os sem alterações no Opus 5.5; editar o prompt do sistema, as ferramentas ou os turnos anteriores os invalida. Consulte o guia de erros de assinatura de raciocínio.
- A ferramenta mais antiga de uso do computador foi removida.
computer_20251124não é aceita na Claude API. - O texto entre chamadas de ferramentas chega como blocos de raciocínio, vazio na configuração padrão
display— um aplicativo que transmite texto de progresso fica silencioso entre chamadas de ferramentas.
Os parâmetros de amostragem já haviam sido removidos no Opus 5; no Opus 5.5, o Kunavo remove temperature, top_p e top_k antes que a solicitação saia do gateway, como no restante da família Claude 5.
Opus 5.5 versus Opus 5, segundo os números da Anthropic
O anúncio da Anthropic afirma que o Opus 5.5 “tem desempenho no nível do Claude Fable 5.1 na maioria dos trabalhos e custa 40% menos para executar do que o Opus 5” e que gera saídas mais de 30% mais rápido. Suas pontuações publicadas em comparação com o Opus 5 (números da Anthropic, não do Kunavo):
| Benchmark | Opus 5.5 | Opus 5 |
|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 52.3% |
| CursorBench 4.0 | 57.8% | 46.6% |
| FrontierCode v1.1 (Principal) | 54.4% | 48.0% |
| OSWorld 2.0 | 81.8% | 74.0% |
| GDPval-AA v2.1 (Elo) | 1846 | 1708 |
Para trabalhos novos, há pouca razão para continuar no Opus 5: o Opus 5.5 é mais rápido, obtém pontuações maiores e custa menos, e a string do modelo é a única alteração, a menos que seu código dependa da desativação do raciocínio ou do forçamento de uma ferramenta. Permaneça em claude-opus-5 somente até reescrever esses dois caminhos.
Claude Code no Kunavo com Opus 5.5
A partir do Claude Code v2.1.280, o modelo padrão e seu alias opus resolvem para o Opus 5.5, que a Kunavo oferece. O guia de configuração da Kunavo fixa o alias opus em claude-opus-5-5, portanto /model opus e a fase de planejamento do opusplan são cobrados a $2.80 / $14.00 por 1M de tokens; em uma versão mais antiga do Claude Code, execute claude update primeiro. O guia também fixa o alias sonnet em claude-sonnet-5: o alias solicita o Sonnet 5.5, que a Kunavo não oferece; portanto, sem essa configuração, /model sonnet, a fase de execução do opusplan e os subagentes configurados para sonnet retornariam 404. Para executar toda a sessão no Opus 5.5, defina também ANTHROPIC_MODEL:
export ANTHROPIC_BASE_URL=https://api.kunavo.com # origin, no /v1
export ANTHROPIC_AUTH_TOKEN=sk-kn-...
# Run the session on Opus 5.5 (Claude Code v2.1.280 or later).
export ANTHROPIC_MODEL=claude-opus-5-5
# Pin the aliases to models Kunavo serves. The sonnet alias asks for
# Sonnet 5.5, which Kunavo does not serve: without the SONNET line,
# /model sonnet, opusplan's execution phase and sonnet subagents get a 404.
export ANTHROPIC_DEFAULT_OPUS_MODEL=claude-opus-5-5
export ANTHROPIC_DEFAULT_SONNET_MODEL=claude-sonnet-5
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-4-5
claudeO restante da configuração — a URL base somente de origem, por que usar ANTHROPIC_AUTH_TOKEN em vez de ANTHROPIC_API_KEY e o formato de settings.json — está na página do Claude Code.
Perguntas frequentes
Quanto custa a API do Claude Opus 5.5?
A Anthropic lista o Claude Opus 5.5 a $4.00 por 1M de tokens de entrada e $20.00 por 1M de tokens de saída, com leituras de cache a $0.20 e gravações de cache de 5 minutos a $5.00. No Kunavo, o preço é $2.80 de entrada / $14.00 de saída por 1M — 30% abaixo do preço de tabela da Anthropic —, com leituras de cache a $0.14 e gravações de cache a $3.50, em um modelo pré-pago conforme o uso, a partir de um saldo sem assinatura.
Qual é o ID do modelo Claude Opus 5.5?
O ID do modelo da API é claude-opus-5-5 — a mesma string na Claude API, no Google Cloud, no Microsoft Foundry e no Kunavo; o Amazon Bedrock adiciona o prefixo anthropic.claude-opus-5-5. Não há sufixo de snapshot com data: a partir da geração 4.6, os IDs sem data da Anthropic já são snapshots fixados. Grafias como claude-opus-5.5 não são válidas.
O Claude Opus 5.5 é melhor que o Opus 5?
Segundo os próprios números da Anthropic, sim, e ele é mais barato. A Anthropic informa que o Opus 5.5 alcança 66,4% no Terminal-Bench 4.0, contra 52,3% do Opus 5, diz que ele “tem desempenho no nível do Claude Fable 5.1 na maioria dos trabalhos”, gera saídas mais de 30% mais rápido que o Opus 5 e custa 40% menos para operar. Seu preço de tabela é $4.00 / $20.00, contra $5.00 / $25.00 do Opus 5; na Kunavo, ele custa $2.80 / $14.00, contra $3.50 / $17.50, 20% menos na saída.
Posso desativar o raciocínio no Claude Opus 5.5?
Não. O raciocínio adaptativo está sempre ativado: na Anthropic, thinking: {type: "disabled"} e uma configuração budget_tokens retornam 400 em todos os níveis de esforço, e o único controle é o parâmetro effort, cujo padrão no Opus 5.5 é medium. Pelo Kunavo, testado em 24 de setembro de 2026, a solicitação de desativação não gerou erro — foi ignorada e o modelo continuou raciocinando — e os valores de effort não produziram diferença mensurável. Os tokens de raciocínio são cobrados à tarifa de saída; portanto, dimensione max_tokens para o raciocínio e a resposta.
O Claude Code usa o Opus 5.5 por padrão?
Sim, a partir do Claude Code v2.1.280: para contas da Anthropic API, o modelo padrão e o alias opus resolvem ambos para o Opus 5.5 (configuração de modelos em code.claude.com), e a Kunavo oferece claude-opus-5-5. A configuração do Claude Code da Kunavo fixa o alias opus em claude-opus-5-5, que requer v2.1.280 ou posterior (execute claude update em uma instalação mais antiga), e mantém a sessão em claude-sonnet-5; defina ANTHROPIC_MODEL=claude-opus-5-5 para executar toda a sessão no Opus 5.5. Fixe também ANTHROPIC_DEFAULT_SONNET_MODEL=claude-sonnet-5: o alias sonnet solicita o Sonnet 5.5, que a Kunavo não oferece; sem essa configuração, /model sonnet, a fase de execução do opusplan e os subagentes configurados para sonnet retornam 404.
Qual é a janela de contexto do Claude Opus 5.5?
1M tokens de contexto e até 128K tokens de saída por solicitação na Messages API, segundo a página de modelos da Anthropic. A janela de 1M é o padrão — não é necessário cabeçalho beta —, e solicitações longas são cobradas pela mesma tarifa por token que solicitações curtas. A Batch API da Anthropic eleva a saída para 300K com um cabeçalho beta; o Kunavo não oferece a Batch API.
O tool_choice forçado funciona no Claude Opus 5.5?
Não de forma confiável. A Anthropic não oferece suporte ao uso forçado de ferramentas no Opus 5.5: tool_choice {type: "any"} ou {type: "tool"} retorna 400, e o endpoint compatível com OpenAI do Kunavo traduz tool_choice "required" para "any". Pelo Kunavo, testado em 24 de setembro de 2026, uma solicitação de ferramenta forçada retornou 200 em vez de 400; portanto, não se pode contar com o forçamento em nenhum dos sentidos. Envie tool_choice "auto" e nomeie a ferramenta nas instruções, ou use um formato de resposta com esquema JSON quando a chamada forçada existia apenas para obter uma saída estruturada.