O modelo Jev agora está integrado e disponível · Grok 4.7 foi adicionado
Blogue
Guia

Claude Opus 5.5: vale a pena?

O preço menor torna a atualização atraente, mas a integração precisa passar por uma revisão.

11 min de leituraOmniaKey
Claude Opus 5.5Preço da APIComparação com Opus 5Claude CodeComo usar

O Claude Opus 5.5 merece entrar nos testes de quem usa agentes para programação complexa e tarefas longas. Lançado pela Anthropic em 22 de setembro de 2026, ele custa US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de saída na API padrão. Os resultados publicados avançam em relação ao Opus 5, com preço menor por token.

Só trocar o nome do modelo, porém, pode quebrar uma integração. Requisições antes válidas passam a retornar 400 e a interface pode deixar de exibir progresso entre chamadas de ferramentas. Comece em medium, o novo padrão, e compare tarefas concluídas, cobrança total e tempo de revisão humana.

Verificado em 23 de setembro de 2026. Esta análise usa o anúncio e a documentação da Anthropic. Não executamos benchmark independente nem teste pago de latência. Os números de desempenho têm fonte identificada; os custos são cálculos com a tabela da API direta.

O que mudou no Opus 5.5?

É o primeiro modelo da família Claude 5.5, voltado a migrações de código, depuração difícil, análise de documentos e tarefas com muitas etapas. A Anthropic também relata escrita mais clara, melhor leitura visual e menos passos para finalizar trabalhos. Casos de acesso antecipado ajudam a escolher o que avaliar, sem prometer o mesmo resultado no seu projeto.

ItemOpus 5.5
Lançamento22 de setembro de 2026
ID da APIclaude-opus-5-5
Contexto / saída padrão máxima1M / 128K tokens
Entrada → saídaTexto e imagens → texto
Conhecimento confiável atéJunho de 2026
Raciocínio / effort padrãoAdaptativo sempre ativo / medium
Mínimo para cache512 tokens

O contexto de 1M e o limite padrão de saída de 128K permanecem iguais aos do Opus 5. A saída de 300K na Batch API é uma opção beta separada, não o limite de requisições síncronas. Entender imagens ou gerar código gráfico também não significa gerar imagens e vídeos nativamente.

Opus 5.5 vs Opus 5: três diferenças práticas

Entrada e saída ficam 20% mais baratas; a leitura de cache cai 60%. Agentes que releem um contexto estável de repositório podem ganhar mais com a mudança de cache.

O effort padrão muda de high para medium. No mesmo nível nominal, o 5.5 pode pensar mais por rodada, especialmente em xhigh e max. Reutilizar a configuração antiga não fixa o consumo de processamento.

A API tem mudanças incompatíveis. Não é mais possível desligar o raciocínio nem forçar uma ferramenta, e a edição do histórico recebe restrições. Veja a análise do Opus 5 e o guia de modelos para Claude Code para organizar a escolha por tarefa.

Benchmarks e desempenho em programação

A tabela vem do anúncio da Anthropic. Não é uma reprodução da OmniaKey nem uma nova consulta a rankings independentes.

AvaliaçãoOpus 5.5Opus 5Fable 5.1
Terminal-Bench 4.066.4%52.3%55.8%
FrontierCode v1.1 Main54.4%48.0%50.3%
CursorBench 4.057.8%46.6%51.8%
GDPval-AA v2.1184617081735

O 5.5 usa max salvo indicação contrária; Terminal-Bench usa xhigh, com erro padrão de ±2,6 pontos. As proteções de produção estavam ligadas, e algumas tarefas de cibersegurança, biologia e desenvolvimento de modelos avançados foram concluídas por modelos de fallback. Portanto, a comparação não usa condições idênticas e irrestritas para todos.

No padrão medium, a Anthropic informa 54,6% no FrontierCode e 52,5% no CursorBench. O primeiro supera levemente o resultado max da tabela, lembrando que aumentar esforço não garante melhora em toda avaliação. GDPval-AA v2.1 também não deve ser comparado diretamente com números antigos da v2.

A leitura útil é que vale testar o 5.5 em trabalho difícil. A tabela não determina sua latência nem o custo de uma alteração aprovada.

Quanto custa a API do Claude Opus 5.5?

Todos os valores são em dólares dos EUA por milhão de tokens, para a API direta global padrão. Não incluem ferramentas, impostos, câmbio, residência de dados nem preços de gateways.

CategoriaOpus 5.5Opus 5Redução da tarifa
Entrada sem cache$4$520%
Saída, incluindo raciocínio faturado$20$2520%
Leitura de cache$0.20$0.5060%
Gravação de cache por 5 minutos$5$6.2520%
Gravação de cache por 1 hora$8$1020%

Nos exemplos, a saída inclui todos os tokens faturados, inclusive de raciocínio.

Mesmo volume de tokensCálculo do 5.5Opus 5.5Opus 5
100K entrada + 10K saída0.1 × $4 + 0.01 × $20$0.60$0.75
100K entrada + 900K em cache + 10K saída0.1 × $4 + 0.9 × $0.20 + 0.01 × $20$0.78$1.20

O exemplo com cache economiza 35%, mas não conta a gravação inicial. Confirme o acerto de cache nos dados de uso do fornecedor. Reenviar o mesmo texto não prova que houve leitura de cache.

A declaração oficial de 40% menos custo típico por tarefa combina tarifa e consumo nas configurações padrão. Não é um desconto universal. A promessa de saída mais de 30% mais rápida também não garante redução equivalente no tempo total de execução.

Fast mode é uma prévia de pesquisa com entrada/saída a $8/$40, velocidade anunciada de até 2,5× e opção API apenas na plataforma própria da Anthropic. Batch assíncrono custa $2/$10. Assinatura Claude e cobrança por API são separadas; confira o guia de preços do Claude Code.

Como usar: seis cuidados na migração da API

  1. Remova thinking incompatível. thinking.type: "disabled" e "enabled" com budget_tokens retornam 400. Omita thinking ou use adaptive e controle output_config.effort.
  2. Substitua ferramentas forçadas. tool_choice não aceita any ou tool; use auto ou none. strict: true valida argumentos, mas não força uma chamada. Para JSON conforme a um schema, considere saídas estruturadas.
  3. Preserve o histórico. Em contas criadas desde 31 de agosto de 2026 às 00:00 UTC, reenviar um bloco de pensamento após alterar system, tools ou mensagens anteriores pode causar 400. Prefira acrescentar turnos e siga as regras de preserved thinking quando precisar editar.
  4. Leia blocos pelo type. O progresso entre ferramentas chega em thinking. Com display: "omitted", o texto fica vazio. O guia explica "summarized" e "updates" em beta. Devolva os blocos de pensamento sem mudanças nos ciclos de ferramentas.
  5. Confira computer use por plataforma. Claude API e Google Cloud exigem computer_toolset_20260801. O antigo computer_20251124 continua funcionando no Amazon Bedrock.
  6. Trate recusas e troca de modelo. HTTP 200 com stop_reason: "refusal" não significa conclusão. Voltar ao Opus 5 não preserva o pensamento do 5.5; Fable 5.1 e Mythos 5.1 na Claude API são as exceções documentadas que conseguem lê-lo.

Este exemplo mínimo usa a API direta da Anthropic e exige uma chave Anthropic. Não é configuração de OmniaKey e não executamos a requisição paga.

bash
curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-opus-5-5",
    "max_tokens": 4096,
    "output_config": {"effort": "medium"},
    "messages": [{"role": "user", "content": "Revise este plano de migração e liste os três principais riscos."}]
  }'

Reserve max_tokens para raciocínio e resposta visível. Colete os blocos text em vez de presumir que content[0] contém a resposta.

Para quem vale a pena atualizar?

Quem usa Opus 5 deve começar por refatorações extensas, bugs difíceis e falhas caras. Fixe ferramentas, permissões e critérios de aceitação; compare medium e high registrando sucesso, tentativas, tokens, duração e correções. Use conversas novas para comparar modelos com menos interferência.

Sonnet pode continuar mais econômico em edições curtas ou extração. Usuários de Fable podem testar se 5.5 entrega a qualidade necessária por menos. A Anthropic informa acesso via Claude, Claude Code, Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud e Microsoft Foundry; limites e condições regionais dependem da plataforma.

Este texto não confirma uma rota ativa de Opus 5.5 na OmniaKey. Antes de configurar o gateway, confira ID e preço no catálogo atual de modelos.

Perguntas frequentes

Quando o Opus 5.5 foi lançado?

Em 22 de setembro de 2026. É um lançamento oficial com o ID claude-opus-5-5.

Ele programa melhor que o Opus 5?

As avaliações publicadas pela Anthropic favorecem o 5.5 e sua tarifa é menor. Ainda é necessário validar ferramentas e testes de aceitação antes de migrar produção.

Posso desligar o raciocínio?

Não. Adaptive thinking fica sempre ativo. Reduza effort se quiser economizar ou diminuir a espera e confira se a qualidade continua adequada.

Contexto de 1M significa uso ilimitado?

Não. É capacidade, não crédito grátis. Cobranças de tokens, cache e ferramentas e limites de conta continuam valendo.

Fontes