GPT-6 Sol e Claude Opus 5.5 disponíveisGPT-6 Sol pela metade do preço do 5.6 Sol
Blogue
Comparação

Opus 5.5 ou Sonnet 5.5

Escolha pelo resultado aprovado e pelo custo total.

11 min de leituraOmniaKey
Claude Opus 5.5Claude Sonnet 5.5ComparaçãoProgramaçãoPreços da API

Claude Opus 5.5 ou Sonnet 5.5: a escolha depende do trabalho aprovado e do custo total. Comece avaliando o Sonnet em tarefas bem definidas, correções reproduzíveis e funcionalidades com testes de aceitação. Vale avaliar o Opus quando o diagnóstico é difícil, a mudança atravessa vários sistemas ou uma solução aparentemente correta pode causar retrabalho caro. Isso é uma estratégia de avaliação, não um ranking universal.

A entrada e a saída padrão do Sonnet custam metade, mas a leitura de cache custa o mesmo nos dois. Os resultados oficiais de programação também não apontam um vencedor em todas as provas.

Fontes oficiais verificadas em 29 de setembro de 2026. Não realizamos testes próprios entre os modelos. As pontuações são atribuídas e os exemplos fixam o número de tokens; não são contas medidas em tarefas reais. A OmniaKey publica este guia e oferece um gateway de API com preços próprios, separados da API direta da Anthropic.

Diferenças entre os dois modelos

O Opus 5.5 foi lançado em 22 de setembro de 2026; o Sonnet 5.5, em 28 de setembro. A comparação com o Sonnet 5 continua dedicada ao modelo anterior.

CaracterísticaSonnet 5.5Opus 5.5
ID na Claude APIclaude-sonnet-5-5claude-opus-5-5
Contexto / saída máxima padrão1M / 128K tokens1M / 128K tokens
Entrada → saídaTexto e imagens → textoTexto e imagens → texto
Effort padrão na APIhighmedium
RaciocínioAdaptive; aceita between_toolsAdaptive, sempre ativo
Classe de latência do fornecedorFastModerate
Entrada / saída por milhão de tokens$2 / $10$4 / $20
Leitura de cache por milhão de tokens$0.20$0.20

Fonte: visão geral oficial. Ter o mesmo contexto não garante a mesma precisão ao recuperar informações. Entrada e saída respeitam o orçamento de contexto. A opção de saída de 300K é uma função beta da Batch API, não o limite síncrono comum.

Preço da API e custo por tarefa

A tabela oficial informa os preços globais padrão da API direta em USD por milhão de tokens. Impostos, ferramentas, opções regionais e outras plataformas ficam à parte. Não são valores fixos em reais.

CategoriaSonnet 5.5Opus 5.5
Entrada sem cache$2$4
Saída faturada$10$20
Gravação de cache de 5 minutos$2.50$5
Gravação de cache de 1 hora$4$8
Leitura de cache$0.20$0.20

A saída faturada inclui raciocínio. Os dois modelos aceitam cache a partir de 512 tokens, mas só os campos de uso confirmam um acerto. Os exemplos abaixo mantêm quantidades iguais; podem somar várias requisições, cada uma respeitando seus limites.

Mesma quantidade de tokensSonnet 5.5Opus 5.5
Entrada sem cache de 100K + saída de 20K$0.40$0.80
Acima + gravação inicial de 800K em cache de 5 minutos$2.40$4.80
Entrada sem cache de 100K + leitura válida de 800K + saída de 20K$0.56$0.96

Na última linha, Sonnet custa 0.1 × 2 + 0.8 × 0.20 + 0.02 × 10 = $0.56; Opus custa 0.1 × 4 + 0.8 × 0.20 + 0.02 × 20 = $0.96. São cerca de 1,71 vezes na etapa de leitura. A gravação anterior é adicional e seus tokens não devem entrar de novo como entrada sem cache.

O consumo e as tentativas mudam em trabalho real. Divida todo o gasto, incluindo falhas, pelo número de resultados aceitos. Registre separadamente o tempo humano de correção antes de aplicar um valor por hora declarado.

Benchmarks de programação: o que realmente comparar

Os números vêm da tabela do lançamento do Sonnet 5.5, com ambos os modelos. Não são uma nova medição da OmniaKey.

AvaliaçãoSonnet 5.5Opus 5.5
Terminal-Bench 4.070.6% (max)66.4% (xhigh)
FrontierCode 1.1 Main46.2% (max); 52.1% (xhigh)54.4%
CursorBench 4.055.5%57.8%
GDPval-AA v2.118441846

O system card, §8.5, descreve 66 tarefas do Terminal-Bench com cinco tentativas por modelo, totalizando 330 cada. Ao tratar as tentativas como independentes, o erro padrão é ±2,5 pontos para Sonnet e ±2,6 para Opus. Foram usados Claude Code em --bare, proteções de produção e modelos de fallback em parte das requisições; a proporção de tentativas afetadas é diferente. A vantagem de 4,2 pontos não prova superioridade em toda programação nem autoriza afirmar significância estatística sem dados adicionais.

No FrontierCode, Sonnet em max fica abaixo de xhigh. A nota oficial relata casos em que um fluxo de revisão mais frequente contribuiu para timeout ou alterações fora do escopo. Mais raciocínio nem sempre entrega um resultado melhor.

GDPval é pontuação, não porcentagem. Os resultados Sonnet de GDPval-AA e AA-Briefcase também têm a ressalva de um bug de saída estruturada no ambiente anterior ao lançamento, já corrigido. Veja detalhes nas análises de Sonnet 5.5 e Opus 5.5.

Velocidade e nível de esforço

“Saída 30%+ mais rápida” e “até 30% menos custo por tarefa” comparam Sonnet 5.5 com Sonnet 5. Não são diferenças para Opus 5.5 nem redução da tarifa API. Já a economia típica aproximada de 40% anunciada para Opus 5.5 é em relação ao Opus 5.

O Sonnet usa high por padrão na API e medium no Claude Code e nos apps. Opus API usa medium. Informe o cliente e o esforço; nomes iguais não garantem o mesmo orçamento computacional. Separe o tempo até a primeira resposta útil do tempo até finalizar e verificar a tarefa.

Quando vale a pena pagar mais pelo Opus

Avalie Sonnet com tarefas fáceis de conferir: funcionalidades pequenas, revisão focada e extração estruturada. Avalie Opus para falhas ambíguas entre serviços, migrações delicadas e investigações longas. Use os mesmos dados e critérios; preço maior não garante precisão ou segurança.

Em documentos longos, confira citações e condições omitidas. Em tarefas visuais, use as capturas e gráficos necessários; entrada de imagem não significa geração nativa de imagem. Esta recomendação considera custo. O guia geral da Anthropic recomenda começar por Opus 5.5 na maioria dos trabalhos; é uma alternativa coerente quando a qualidade vem primeiro. O guia de modelos para Claude Code cobre escolhas mais amplas.

O que muda na integração

Leia os guias de migração de Sonnet e Opus. Sonnet aceita between_tools em high ou abaixo para desativar o raciocínio inicial, não toda forma de raciocínio. Opus mantém adaptive thinking ativo.

Ambos rejeitam tool_choice forçado com any ou tool. Validar argumentos de forma estrita não força uma chamada; confira o suporte da plataforma. Thinking blocks têm regras ligadas ao modelo, à conta e à preservação da conversa. Faça comparações em conversas novas. O progresso entre ferramentas pode vir em thinking blocks ocultos por padrão: processe o tipo de bloco e verifique streaming antes de concluir que o agente travou. Trocar o ID não comprova compatibilidade de qualquer gateway.

Como testar no seu trabalho

Uma proposta é selecionar seis tarefas em cada categoria: código delimitado, depuração/refatoração difícil, ferramentas e documentos/visão. São 24 tarefas × 2 modelos × 3 repetições = 144 execuções, potencialmente muitas mais requisições API. Não fizemos esse experimento aqui.

Fixe commit, prompts, ferramentas, região, permissões, limites de tempo/passos e testes antes de rodar. Reinicie ambiente e conversa e alterne a ordem dos modelos. Separe o teste explícito em medium das configurações padrão ou superiores. Registre falhas, recusas, novas tentativas, fallbacks observados, tokens, custos, tempo e correções reais. Código passa por testes ocultos; documentos, pela conferência das fontes. Três repetições não estimam um P95 preciso por tarefa. Sem resultado aprovado, não registre custo por sucesso igual a zero.

Perguntas frequentes

Sonnet 5.5 é melhor para programar?

O Terminal-Bench publicado favorece Sonnet; as outras avaliações de código citadas favorecem Opus. Ajustes e incerteza impedem generalizar.

O custo por tarefa é sempre metade?

Só as tarifas padrão de entrada sem cache e saída são metade. Cache, uso, tentativas, ferramentas e retrabalho mudam a conta.

Qual escolher no Claude Code?

Sonnet para avaliar tarefas definidas, Opus para investigações difíceis ou como ponto inicial quando qualidade é prioridade. Assinatura e API são separadas; consulte os preços do Claude Code.

O contexto do Opus é maior?

Os dois oferecem 1M de contexto e 128K de saída máxima padrão. Avalie como usam a informação.

Oferta atual e fontes

As páginas de Sonnet 5.5, Opus 5.5 e o catálogo mostram rotas e preços da OmniaKey. As contas da API direta não são cotações do gateway nem testes de chamadas reais. As fontes oficiais da Anthropic vinculadas estão em inglês.