Voltar aos guias
Modelos·24 de setembro de 2026·Atualizado em 4 de outubro de 2026·6 min de leitura

API do Claude Opus 5.5 — preço, ID do modelo e o que mudou em relação ao Opus 5

A Anthropic lançou o Claude Opus 5.5 em 22 de setembro de 2026 — mais barato que o Opus 5 e, segundo os números da Anthropic, melhor. Aqui estão seu preço de API na Anthropic e no Kunavo, o ID do modelo, o impacto das mudanças incompatíveis nas solicitações escritas para o Opus 5 e código funcional para o SDK da OpenAI, o SDK da Anthropic e o Claude Code.

Última revisão em .

Claude Opus 5.5 é o Opus mais recente da Anthropic, lançado September 22, 2026, e o modelo para o qual a Anthropic agora direciona “a maioria das cargas de trabalho”. O preço da API é $4.00 de entrada / $20.00 de saída por 1M de tokens na Anthropic — abaixo dos $5.00 / $25.00 do Opus 5 — e $2.80 / $14.00 no Kunavo, 30% abaixo desse preço de tabela. O ID do modelo é claude-opus-5-5; ele tem uma janela de contexto de 1M de tokens e até 128K tokens de saída, e raciocina em todas as solicitações.

Preços da API do Claude Opus 5.5

Tarifas publicadas pela Anthropic ao lado das do Kunavo, por 1M de tokens. A Anthropic cobra 5% pela leitura do cache do Opus 5.5, em vez dos 10% cobrados na maioria dos modelos Claude, e o Kunavo repassa a mesma proporção:

Classe de tokenLista da AnthropicKunavo
Entrada$4.00$2.80
Saída (incluindo raciocínio)$20.00$14.00
Gravação no cache$5.00 (5 min) · $8.00 (1 hora)$3.50, qualquer TTL
Leitura do cache$0.20$0.14

Ao lado do restante da linha Claude no Kunavo, o Opus 5.5 é a forma mais barata de obter raciocínio no nível Opus — mais barato que Claude Opus 5 ($3.50 / $17.50). Claude Sonnet 5 custa ainda menos ($1.40 / $7.00), com Claude Fable 5.1 a $7.00 / $35.00 no topo da linha e Claude Haiku 4.5 a $0.70 / $3.50 na base. Todas as tarifas do Claude, com exemplos calculados, estão no guia de preços da Claude API; a página do próprio modelo é /models/claude-opus-5-5.

Chamar o Claude Opus 5.5

Uma única chave do Kunavo alcança o Opus 5.5 pelo endpoint compatível com OpenAI e pela API Anthropic Messages nativa. Com o OpenAI SDK, altere base_url e a string do modelo:

opus55_openai.py
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["KUNAVO_API_KEY"],
    base_url="https://api.kunavo.com/v1",
)

# Opus 5.5 always thinks, and thinking bills as output — leave max_tokens
# generous or the budget is spent before the answer starts.
resp = client.chat.completions.create(
    model="claude-opus-5-5",
    max_tokens=4096,
    messages=[{"role": "user", "content": "Review this migration plan for failure modes."}],
)
print(resp.choices[0].message.content)

Com o Anthropic SDK, informe a origem como base_url; o SDK acrescenta /v1/messages automaticamente:

opus55_messages.py
from anthropic import Anthropic

# Native Messages API: pass the origin — the SDK appends /v1/messages.
client = Anthropic(base_url="https://api.kunavo.com", auth_token="sk-kn-...")

msg = client.messages.create(
    model="claude-opus-5-5",
    max_tokens=8192,   # thinking plus the answer
    messages=[{"role": "user", "content": "Find the race condition in this diff."}],
)
for block in msg.content:
    if block.type == "text":
        print(block.text)

As chaves são criadas em /app/keys; o guia de chaves da Claude API mostra o procedimento.

O que mudou em relação ao Opus 5 — e como isso afeta suas solicitações

A Anthropic lista quatro mudanças incompatíveis para código executado no Opus 5 e uma alteração no formato da resposta. Escreva de acordo com as regras da Anthropic — mas saiba que duas delas não falharam pelo Kunavo quando testamos em 24 de setembro de 2026:

  • O raciocínio não pode ser desativado. Na Anthropic, thinking: {type: "disabled"} e budget_tokens retornam 400 em todos os níveis de esforço, e effort (padrão medium) é o único controle. Pelo Kunavo, a solicitação de desativação retornou 200 e o modelo raciocinou mesmo assim, enquanto output_config.effort não produziu diferença mensurável — o canal que oferece o Opus 5.5 não aplica nenhuma das duas configurações. O raciocínio é cobrado como saída: uma resposta de uma palavra consumiu 15 dos 16 tokens de saída pensando. Mantenha max_tokens com margem suficiente.
  • O uso forçado de ferramentas não é compatível. Na Anthropic, tool_choice de any ou tool retorna 400 (o "required" compatível com OpenAI é mapeado para any). Pelo Kunavo, uma solicitação de ferramenta forçada retornou 200; portanto, não se deve depender do forçamento. Use auto e nomeie a ferramenta no prompt.
  • Os blocos de raciocínio estão vinculados ao modelo e à conversa. Reproduza-os sem alterações no Opus 5.5; editar o prompt do sistema, as ferramentas ou os turnos anteriores os invalida. Consulte o guia de erros de assinatura de raciocínio.
  • A ferramenta mais antiga de uso do computador foi removida. computer_20251124 não é aceita na Claude API.
  • O texto entre chamadas de ferramentas chega como blocos de raciocínio, vazio na configuração padrão display — um aplicativo que transmite texto de progresso fica silencioso entre chamadas de ferramentas.

Os parâmetros de amostragem já haviam sido removidos no Opus 5; no Opus 5.5, o Kunavo remove temperature, top_p e top_k antes que a solicitação saia do gateway, como no restante da família Claude 5.

Opus 5.5 versus Opus 5, segundo os números da Anthropic

O anúncio da Anthropic afirma que o Opus 5.5 “tem desempenho no nível do Claude Fable 5.1 na maioria dos trabalhos e custa 40% menos para executar do que o Opus 5” e que gera saídas mais de 30% mais rápido. Suas pontuações publicadas em comparação com o Opus 5 (números da Anthropic, não do Kunavo):

BenchmarkOpus 5.5Opus 5
Terminal-Bench 4.066.4%52.3%
CursorBench 4.057.8%46.6%
FrontierCode v1.1 (Principal)54.4%48.0%
OSWorld 2.081.8%74.0%
GDPval-AA v2.1 (Elo)18461708

Para trabalhos novos, há pouca razão para continuar no Opus 5: o Opus 5.5 é mais rápido, obtém pontuações maiores e custa menos, e a string do modelo é a única alteração, a menos que seu código dependa da desativação do raciocínio ou do forçamento de uma ferramenta. Permaneça em claude-opus-5 somente até reescrever esses dois caminhos.

Claude Code no Kunavo com Opus 5.5

A partir do Claude Code v2.1.280, o modelo padrão e seu alias opus resolvem para o Opus 5.5, que a Kunavo oferece. O guia de configuração da Kunavo fixa o alias opus em claude-opus-5-5, portanto /model opus e a fase de planejamento do opusplan são cobrados a $2.80 / $14.00 por 1M de tokens; em uma versão mais antiga do Claude Code, execute claude update primeiro. O guia também fixa o alias sonnet em claude-sonnet-5: o alias solicita o Sonnet 5.5, que a Kunavo não oferece; portanto, sem essa configuração, /model sonnet, a fase de execução do opusplan e os subagentes configurados para sonnet retornariam 404. Para executar toda a sessão no Opus 5.5, defina também ANTHROPIC_MODEL:

claude-code.sh
export ANTHROPIC_BASE_URL=https://api.kunavo.com   # origin, no /v1
export ANTHROPIC_AUTH_TOKEN=sk-kn-...

# Run the session on Opus 5.5 (Claude Code v2.1.280 or later).
export ANTHROPIC_MODEL=claude-opus-5-5
# Pin the aliases to models Kunavo serves. The sonnet alias asks for
# Sonnet 5.5, which Kunavo does not serve: without the SONNET line,
# /model sonnet, opusplan's execution phase and sonnet subagents get a 404.
export ANTHROPIC_DEFAULT_OPUS_MODEL=claude-opus-5-5
export ANTHROPIC_DEFAULT_SONNET_MODEL=claude-sonnet-5
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-4-5

claude

O restante da configuração — a URL base somente de origem, por que usar ANTHROPIC_AUTH_TOKEN em vez de ANTHROPIC_API_KEY e o formato de settings.json — está na página do Claude Code.

Perguntas frequentes

Quanto custa a API do Claude Opus 5.5?

A Anthropic lista o Claude Opus 5.5 a $4.00 por 1M de tokens de entrada e $20.00 por 1M de tokens de saída, com leituras de cache a $0.20 e gravações de cache de 5 minutos a $5.00. No Kunavo, o preço é $2.80 de entrada / $14.00 de saída por 1M — 30% abaixo do preço de tabela da Anthropic —, com leituras de cache a $0.14 e gravações de cache a $3.50, em um modelo pré-pago conforme o uso, a partir de um saldo sem assinatura.

Qual é o ID do modelo Claude Opus 5.5?

O ID do modelo da API é claude-opus-5-5 — a mesma string na Claude API, no Google Cloud, no Microsoft Foundry e no Kunavo; o Amazon Bedrock adiciona o prefixo anthropic.claude-opus-5-5. Não há sufixo de snapshot com data: a partir da geração 4.6, os IDs sem data da Anthropic já são snapshots fixados. Grafias como claude-opus-5.5 não são válidas.

O Claude Opus 5.5 é melhor que o Opus 5?

Segundo os próprios números da Anthropic, sim, e ele é mais barato. A Anthropic informa que o Opus 5.5 alcança 66,4% no Terminal-Bench 4.0, contra 52,3% do Opus 5, diz que ele “tem desempenho no nível do Claude Fable 5.1 na maioria dos trabalhos”, gera saídas mais de 30% mais rápido que o Opus 5 e custa 40% menos para operar. Seu preço de tabela é $4.00 / $20.00, contra $5.00 / $25.00 do Opus 5; na Kunavo, ele custa $2.80 / $14.00, contra $3.50 / $17.50, 20% menos na saída.

Posso desativar o raciocínio no Claude Opus 5.5?

Não. O raciocínio adaptativo está sempre ativado: na Anthropic, thinking: {type: "disabled"} e uma configuração budget_tokens retornam 400 em todos os níveis de esforço, e o único controle é o parâmetro effort, cujo padrão no Opus 5.5 é medium. Pelo Kunavo, testado em 24 de setembro de 2026, a solicitação de desativação não gerou erro — foi ignorada e o modelo continuou raciocinando — e os valores de effort não produziram diferença mensurável. Os tokens de raciocínio são cobrados à tarifa de saída; portanto, dimensione max_tokens para o raciocínio e a resposta.

O Claude Code usa o Opus 5.5 por padrão?

Sim, a partir do Claude Code v2.1.280: para contas da Anthropic API, o modelo padrão e o alias opus resolvem ambos para o Opus 5.5 (configuração de modelos em code.claude.com), e a Kunavo oferece claude-opus-5-5. A configuração do Claude Code da Kunavo fixa o alias opus em claude-opus-5-5, que requer v2.1.280 ou posterior (execute claude update em uma instalação mais antiga), e mantém a sessão em claude-sonnet-5; defina ANTHROPIC_MODEL=claude-opus-5-5 para executar toda a sessão no Opus 5.5. Fixe também ANTHROPIC_DEFAULT_SONNET_MODEL=claude-sonnet-5: o alias sonnet solicita o Sonnet 5.5, que a Kunavo não oferece; sem essa configuração, /model sonnet, a fase de execução do opusplan e os subagentes configurados para sonnet retornam 404.

Qual é a janela de contexto do Claude Opus 5.5?

1M tokens de contexto e até 128K tokens de saída por solicitação na Messages API, segundo a página de modelos da Anthropic. A janela de 1M é o padrão — não é necessário cabeçalho beta —, e solicitações longas são cobradas pela mesma tarifa por token que solicitações curtas. A Batch API da Anthropic eleva a saída para 300K com um cabeçalho beta; o Kunavo não oferece a Batch API.

O tool_choice forçado funciona no Claude Opus 5.5?

Não de forma confiável. A Anthropic não oferece suporte ao uso forçado de ferramentas no Opus 5.5: tool_choice {type: "any"} ou {type: "tool"} retorna 400, e o endpoint compatível com OpenAI do Kunavo traduz tool_choice "required" para "any". Pelo Kunavo, testado em 24 de setembro de 2026, uma solicitação de ferramenta forçada retornou 200 em vez de 400; portanto, não se pode contar com o forçamento em nenhum dos sentidos. Envie tool_choice "auto" e nomeie a ferramenta nas instruções, ou use um formato de resposta com esquema JSON quando a chamada forçada existia apenas para obter uma saída estruturada.