GPT-6 Sol e Claude Opus 5.5 disponíveisGPT-6 Sol pela metade do preço do 5.6 Sol
Blogue
Guia

Review do Claude Sonnet 5.5

Um modelo diário mais rápido, mas com mudanças de API que merecem atenção antes do upgrade.

12 min de leituraOmniaKey
Claude Sonnet 5.5Review de modeloPreços de APIClaude CodeMigração

Claude Sonnet 5.5 é o upgrade prático da família Claude 5.5 da Anthropic. Ele foi lançado em 28 de setembro de 2026. O preço padrão por token continua igual ao do Sonnet 5, mas a Anthropic afirma que a geração está 30% ou mais rápida e que o custo por tarefa pode cair até 30% porque o modelo usa menos tokens. Os resultados publicados em programação e trabalho de conhecimento também se aproximam do Opus 5.5.

Isso não transforma o Sonnet 5.5 em substituto universal do Opus. Ele é mais indicado para desenvolvimento diário, bugs reproduzíveis, documentos, planilhas e iterações rápidas de agentes. O ponto mais importante para quem integra a API é a compatibilidade: um cliente do Sonnet 5 que desativa thinking, força ferramentas, usa o computer use antigo ou lê somente content[0] deve passar por uma revisão antes da troca do ID.

Verificado em 29 de setembro de 2026. Esta review usa o anúncio da Anthropic e a documentação atual da Claude Platform. Benchmarks, velocidade e economia são números divulgados pela Anthropic; não executamos benchmark independente pago nem medição de latência. Os exemplos de custo usam a API direta global com a mesma quantidade de tokens.

Especificações do Claude Sonnet 5.5

EspecificaçãoClaude Sonnet 5.5
Lançamento28 de setembro de 2026
ID na Claude APIclaude-sonnet-5-5
Janela de contexto1M tokens
Saída máxima padrão128K tokens
Entrada / saída$2 / $10 por milhão de tokens
Escrita / leitura de cache$2.50 / $0.20 por milhão
ThinkingAdaptive por padrão
Effort padrãohigh
Latência relativaFast
Corte de conhecimento confiávelJunho de 2026
Entrada e saídaTexto e imagens → texto

O modelo está disponível na Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform on AWS. O ID pode mudar conforme a plataforma, portanto confira a tabela de disponibilidade antes de atualizar produção. A Messages síncrona oferece contexto de 1M e saída de 128K; a Batch API pode chegar a 300K com o beta header indicado na documentação.

O que melhorou em relação ao Sonnet 5?

A Anthropic destaca mais de 30% de velocidade de geração e até 30% menos custo por tarefa. Não há desconto no token individual: a economia vem de menos tokens de saída e menos etapas de ferramenta.

O anúncio apresenta estes resultados em comparação com o Sonnet 5:

AvaliaçãoSonnet 5.5Sonnet 5O que mede
Terminal-Bench 4.070,6%10,3%Programação de terminal em várias etapas
CursorBench 4.055,5%34,1%Tarefas ambíguas de agentes de código
GDPval-AA v2.118441449Trabalho de conhecimento em várias profissões
AA-Briefcase v1.118111359Trabalho de conhecimento de longo prazo
Humanity’s Last Exam64,5%54,9%Raciocínio multidisciplinar com ferramentas
OSWorld 2.180,1% parcial57,0% parcialComputer use
Chartography61,6%15,6%Reconhecimento visual de gráficos

Esses números são sinais de avaliação, não a taxa de sucesso no seu repositório. O CursorBench fica perto dos 57,8% do Opus 5.5 e o GDPval perto de 1846, mas a Anthropic ainda descreve o Opus como mais forte em trabalho aberto que exige julgamento contínuo. A leitura prudente é que o Sonnet 5.5 reduz a diferença em tarefas repetíveis, sem eliminar o papel de um modelo de escala.

As curvas de custo da Anthropic incluem effort, ferramentas e todos os tokens da tarefa. Mantenha prompt, permissões, commit e teste de aceitação constantes ao comparar com a página do Opus 5.5 ou com sua rota Sonnet atual.

O preço da API não mudou

O Sonnet 5.5 mantém os preços diretos do Sonnet 5:

ItemPreço
Entrada sem cache$2 / MTok
Saída, incluindo tokens de thinking faturados$10 / MTok
Escrita de cache de 5 minutos$2.50 / MTok
Escrita de cache de 1 hora$4 / MTok
Leitura de cache$0.20 / MTok
Batch API50% de desconto em entrada e saída

Uma tarefa sem cache com 100K tokens de entrada e 20K de saída custa 0.1 × $2 + 0.02 × $10 = $0.40. Se 80K dos tokens de entrada forem cache hit, o mesmo volume custa 0.02 × $2 + 0.08 × $0.20 + 0.02 × $10 = $0.376, sem contar a primeira escrita. Thinking, ferramentas, retries e quantidade de turnos alteram a conta real.

Por isso, “até 30% menos por tarefa” não significa desconto uniforme em toda fatura. Meça o custo total por alteração aceita depois dos testes ou da revisão. O preço do gateway OmniaKey é uma rota separada; consulte o catálogo atual antes de fazer o orçamento.

Seis pontos de migração para clientes existentes

Trocar o ID para claude-sonnet-5-5 é simples, mas os parâmetros do Sonnet 5 não são todos compatíveis.

  1. Thinking é Adaptive por padrão. Omita thinking ou envie {"type":"adaptive"}. Para retirar o pensamento inicial, use thinking: {"type":"between_tools"}. {"type":"disabled"} e budget_tokens manual retornam 400.
  2. Uso forçado de ferramentas não é suportado. tool_choice com any ou tool retorna 400. Use auto ou none, além de strict tools ou structured outputs para validar o schema.
  3. Thinking blocks ficam vinculados ao modelo e à conversa. Sonnet 5.5 lê blocks do Sonnet 5, mas Opus 5 e Opus 5.5 não leem os produzidos pelo Sonnet 5.5. Trocar o modelo no meio altera o contexto disponível.
  4. Não edite o histórico e repita o block sem checar. Alterar system, tools ou uma mensagem anterior pode retornar 400 com as verificações novas. Prefira acrescentar instruções ou use o controle de binding documentado.
  5. Atualize computer use conforme a plataforma. Claude API e Google Cloud exigem computer_toolset_20260801; Bedrock ainda aceita computer_20251124.
  6. Leia a resposta por tipo de block. O progresso entre ferramentas pode vir em thinking. Um cliente que só mostra text pode parecer travado mesmo com uma resposta válida.

Exemplo mínimo com thinking adaptativo:

json
{
  "model": "claude-sonnet-5-5",
  "max_tokens": 4096,
  "output_config": {"effort": "high"},
  "messages": [
    {"role": "user", "content": "Revise esta migração e liste os três maiores riscos."}
  ]
}

Revise também valores não padrão de temperature, top_p e top_k, que o endpoint atual rejeita. Deixe espaço em max_tokens para thinking e para a resposta visível.

Onde ele entra no fluxo de trabalho

Comece com Sonnet 5.5 para uma feature delimitada, um bug reproduzível, testes em uma interface conhecida, uma revisão focada, um rascunho de documento ou etapas frequentes de um agente. Testes, typecheck, build e screenshots ajudam a saber rapidamente se o modelo mais barato basta.

Aumente o effort ou escale para um modelo mais forte quando a tarefa atravessar serviços, exigir uma decisão arquitetural difícil ou estiver sem informações. Se o Sonnet recebeu os arquivos e ferramentas corretos e ainda errou a causa raiz, há um limite de capacidade. Se faltou contexto, corrija o contexto antes de pagar mais.

No Claude Code, compare sessões novas com o mesmo commit, prompt, permissões e teste de aceitação. Registre o primeiro resultado útil, tempo total, tokens, retries, ferramentas que falharam e minutos de correção humana. Mais velocidade por token pode desaparecer em uma rodada extra de revisão.

Veredito

Claude Sonnet 5.5 merece ser o primeiro modelo testado para programação e trabalho de conhecimento do dia a dia. O preço permanece, a velocidade e os resultados publicados melhoram, e tarefas bem definidas têm um motivo claro para sair do Sonnet 5.

Não faça deploy trocando apenas uma string. Teste thinking, tool choice, o parser de blocks e computer use. Deixe Opus 5.5 para arquitetura ambígua, debugging difícil e decisões de alto impacto. Para a escolha entre os modelos, veja também a comparação entre Opus 5.5 e Sonnet 5.

Perguntas frequentes

Quando Claude Sonnet 5.5 foi lançado?

Em 28 de setembro de 2026. O ID direto da Claude API é claude-sonnet-5-5.

Ele é mais barato que o Sonnet 5?

O preço por token é o mesmo: $2 por milhão de entrada, $10 por milhão de saída e $0.20 por milhão de leitura de cache. A Anthropic relata até 30% menos por tarefa pelo menor consumo.

Ele é melhor que o Opus 5.5?

Depende da tarefa. Sonnet é mais rápido e barato para trabalho delimitado; Opus é mais forte para julgamento complexo e aberto. Compare resultado aceito, custo total e correções.

Posso desativar thinking?

Não com thinking: {"type":"disabled"}. Use thinking adaptativo ou thinking: {"type":"between_tools"} nos níveis de effort compatíveis.

O contexto é de 1M?

Sim, com saída padrão máxima de 128K. São limites de capacidade, não créditos gratuitos ou uso ilimitado.

Fontes consultadas