GPT-6 Sol e Claude Opus 5.5 disponibiliGPT-6 Sol a metà prezzo rispetto a 5.6 Sol
Blog
Guida

Recensione di Claude Sonnet 5.5

Un modello quotidiano più veloce, ma il contratto API richiede più attenzione del numero di versione.

12 min di letturaOmniaKey
Claude Sonnet 5.5Recensione modelloPrezzi APIClaude CodeMigrazione

Claude Sonnet 5.5 è l’aggiornamento pratico della famiglia Claude 5.5 di Anthropic. È stato lanciato il 28 settembre 2026. Il prezzo standard per token resta quello di Sonnet 5, ma Anthropic dichiara una generazione più veloce del 30% e un costo per attività fino al 30% più basso perché il modello usa meno token. Anche i risultati pubblicati su programmazione e lavoro della conoscenza si avvicinano a Opus 5.5.

Questo non rende Sonnet 5.5 un sostituto universale di Opus. È più adatto a funzionalità delimitate, bug riproducibili, documenti, fogli di calcolo e cicli rapidi di agenti. Per gli sviluppatori, la parte più delicata è il contratto API: un client Sonnet 5 che disabilita thinking, forza gli strumenti, usa il vecchio computer use o legge solo content[0] va verificato prima di cambiare l’ID.

Verificato il 29 settembre 2026. Questa recensione usa l’annuncio Anthropic e la documentazione corrente di Claude Platform. Benchmark, velocità e risparmi sono dati pubblicati da Anthropic; non abbiamo eseguito benchmark indipendenti a pagamento né misure di latenza. Gli esempi di costo usano l’API diretta globale con lo stesso numero di token.

Specifiche di Claude Sonnet 5.5

SpecificaClaude Sonnet 5.5
Uscita28 settembre 2026
ID Claude APIclaude-sonnet-5-5
Finestra di contesto1M token
Output massimo standard128K token
Input / output$2 / $10 per milione di token
Scrittura / lettura cache$2.50 / $0.20 per milione
ThinkingAdaptive per impostazione predefinita
Effort predefinitohigh
Latenza comparativaFast
Conoscenza affidabile fino aGiugno 2026
Input e outputTesto e immagini → testo

È disponibile su Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform on AWS. L’ID può cambiare a seconda della piattaforma: controlla la tabella di disponibilità prima di aggiornare la produzione. Messages sincrono supporta 1M di contesto e 128K di output; Batch API arriva a 300K con il beta header indicato nella documentazione.

Cosa migliora rispetto a Sonnet 5

Anthropic indica oltre il 30% di velocità in più e fino al 30% di costo in meno per attività. Non è uno sconto sul singolo token: il risparmio nasce da output più brevi e da meno passaggi con gli strumenti.

L’annuncio riporta questi risultati rispetto a Sonnet 5:

ValutazioneSonnet 5.5Sonnet 5Cosa misura
Terminal-Bench 4.070,6%10,3%Coding da terminale in più passaggi
CursorBench 4.055,5%34,1%Attività ambigue di agenti di coding
GDPval-AA v2.118441449Lavoro della conoscenza in varie professioni
AA-Briefcase v1.118111359Lavoro della conoscenza a lungo orizzonte
Humanity’s Last Exam64,5%54,9%Ragionamento multidisciplinare con strumenti
OSWorld 2.180,1% partial57,0% partialComputer use
Chartography61,6%15,6%Riconoscimento visivo di grafici

Sono segnali delle condizioni di test, non il tasso di successo nel tuo repository. CursorBench è vicino al 57,8% di Opus 5.5 e GDPval al suo 1846, ma Anthropic descrive ancora Opus come più forte nei lavori aperti che richiedono giudizio prolungato. La lettura prudente è che Sonnet 5.5 riduce il divario nei compiti ripetibili, senza eliminare il modello di escalation.

Le curve di costo di Anthropic includono effort, strumenti e tutti i token dell’attività. Mantieni fissi prompt, permessi, commit, strumenti e test di accettazione quando confronti la pagina di Opus 5.5 o la tua route Sonnet attuale.

Il prezzo API non cambia

Sonnet 5.5 mantiene i prezzi diretti di Sonnet 5:

VocePrezzo
Input non in cache$2 / MTok
Output, token thinking fatturati inclusi$10 / MTok
Scrittura cache di 5 minuti$2.50 / MTok
Scrittura cache di 1 ora$4 / MTok
Lettura cache$0.20 / MTok
Batch APIsconto del 50% su input e output

Un’attività senza cache con 100K token di input e 20K di output costa 0.1 × $2 + 0.02 × $10 = $0.40. Se 80K dell’input sono cache hit, lo stesso volume costa 0.02 × $2 + 0.08 × $0.20 + 0.02 × $10 = $0.376, esclusa la prima scrittura. Thinking, strumenti, retry e numero di turni cambiano il conto effettivo.

Perciò “fino al 30% in meno per attività” non significa uno sconto uniforme su ogni fattura. Misura il costo totale per modifica accettata dopo test o revisione. Il prezzo del gateway OmniaKey è un’altra route: controlla il catalogo modelli prima di fare il budget.

Sei controlli per la migrazione

Il nuovo ID è claude-sonnet-5-5, ma non tutti i parametri di Sonnet 5 sono trasferibili.

  1. Thinking è Adaptive per impostazione predefinita. Ometti thinking o usa {"type":"adaptive"}. Per togliere il pensiero iniziale usa thinking: {"type":"between_tools"}. {"type":"disabled"} e budget_tokens manuale restituiscono 400.
  2. L’uso forzato degli strumenti non è supportato. tool_choice di tipo any o tool restituisce 400. Usa auto o none, poi strict tools o structured outputs per lo schema.
  3. I thinking block sono legati al modello e alla conversazione. Sonnet 5.5 legge quelli di Sonnet 5, ma Opus 5 e Opus 5.5 non leggono quelli prodotti da Sonnet 5.5. Cambiare modello a metà modifica il contesto disponibile.
  4. Non modificare la cronologia e reinviare il block senza controllo. Cambiare system, tools o un messaggio precedente può dare 400 con i nuovi controlli di binding. Aggiungi istruzioni o usa il controllo documentato.
  5. Computer use dipende dalla piattaforma. Claude API e Google Cloud richiedono computer_toolset_20260801; Bedrock accetta ancora computer_20251124.
  6. Leggi lo stream per tipo di block. Il progresso tra strumenti può arrivare come thinking. Un client che mostra solo text può sembrare fermo anche se la richiesta è riuscita.

Esempio minimo con thinking adattivo:

json
{
  "model": "claude-sonnet-5-5",
  "max_tokens": 4096,
  "output_config": {"effort": "high"},
  "messages": [
    {"role": "user", "content": "Controlla questa migrazione e indica i tre rischi principali."}
  ]
}

Ricontrolla anche valori non predefiniti di temperature, top_p e top_k: l’endpoint attuale li rifiuta. Lascia spazio in max_tokens per il thinking e la risposta visibile.

Dove inserirlo nel flusso di lavoro

Inizia con Sonnet 5.5 per una feature delimitata, un bug riproducibile, test su un’interfaccia conosciuta, una code review circoscritta, una bozza di documento o passaggi frequenti di un agente. Test, typecheck, build e screenshot mostrano rapidamente se il modello più economico è sufficiente.

Aumenta effort o passa a un modello più forte quando il lavoro attraversa più servizi, richiede un’architettura difficile da invertire o manca di informazioni. Se Sonnet ha ricevuto file e strumenti corretti ma non trova la causa, è un limite di capacità. Se manca il contesto, correggi prima il contesto.

In Claude Code confronta sessioni nuove con lo stesso commit, prompt, permessi e test di accettazione. Registra il primo risultato utile, il tempo totale, i token, i retry, gli strumenti falliti e i minuti di correzione umana. Una generazione più rapida può perdersi in un giro di revisione aggiuntivo.

Verdetto

Claude Sonnet 5.5 è il primo candidato da provare per coding e lavoro della conoscenza quotidiani. Il prezzo resta invariato, velocità e risultati pubblicati migliorano, e i compiti ben definiti hanno un motivo concreto per migrare da Sonnet 5.

Non fare deploy sostituendo solo una stringa. Prova thinking, tool choice, parser dei block e computer use. Tieni Opus 5.5 per architettura ambigua, debugging difficile e decisioni ad alto impatto. Per scegliere tra i modelli, leggi anche il confronto tra Opus 5.5 e Sonnet 5.

Domande frequenti

Quando è uscito Claude Sonnet 5.5?

Anthropic lo ha lanciato il 28 settembre 2026. L’ID diretto della Claude API è claude-sonnet-5-5.

È più economico di Sonnet 5?

Il prezzo per token è uguale: $2 per milione di input, $10 per milione di output e $0.20 per milione di lettura cache. Anthropic riporta fino al 30% in meno per attività grazie al consumo più basso.

È migliore di Opus 5.5?

Dipende dal lavoro. Sonnet è più rapido ed economico per attività delimitate; Opus è più forte nel giudizio complesso e aperto. Confronta risultati accettati, costo totale e correzioni.

Posso disattivare thinking?

Non con il vecchio thinking: {"type":"disabled"}. Usa Adaptive oppure thinking: {"type":"between_tools"} a un livello effort supportato.

Il contesto è di 1M?

Sì, con output standard massimo di 128K. Sono limiti di capacità, non crediti gratuiti o uso illimitato.

Fonti verificate