Recensione di Claude Sonnet 5.5
Un modello quotidiano più veloce, ma il contratto API richiede più attenzione del numero di versione.
Claude Sonnet 5.5 è l’aggiornamento pratico della famiglia Claude 5.5 di Anthropic. È stato lanciato il 28 settembre 2026. Il prezzo standard per token resta quello di Sonnet 5, ma Anthropic dichiara una generazione più veloce del 30% e un costo per attività fino al 30% più basso perché il modello usa meno token. Anche i risultati pubblicati su programmazione e lavoro della conoscenza si avvicinano a Opus 5.5.
Questo non rende Sonnet 5.5 un sostituto universale di Opus. È più adatto a funzionalità delimitate, bug riproducibili, documenti, fogli di calcolo e cicli rapidi di agenti. Per gli sviluppatori, la parte più delicata è il contratto API: un client Sonnet 5 che disabilita thinking, forza gli strumenti, usa il vecchio computer use o legge solo content[0] va verificato prima di cambiare l’ID.
Verificato il 29 settembre 2026. Questa recensione usa l’annuncio Anthropic e la documentazione corrente di Claude Platform. Benchmark, velocità e risparmi sono dati pubblicati da Anthropic; non abbiamo eseguito benchmark indipendenti a pagamento né misure di latenza. Gli esempi di costo usano l’API diretta globale con lo stesso numero di token.
Specifiche di Claude Sonnet 5.5
| Specifica | Claude Sonnet 5.5 |
|---|---|
| Uscita | 28 settembre 2026 |
| ID Claude API | claude-sonnet-5-5 |
| Finestra di contesto | 1M token |
| Output massimo standard | 128K token |
| Input / output | $2 / $10 per milione di token |
| Scrittura / lettura cache | $2.50 / $0.20 per milione |
| Thinking | Adaptive per impostazione predefinita |
| Effort predefinito | high |
| Latenza comparativa | Fast |
| Conoscenza affidabile fino a | Giugno 2026 |
| Input e output | Testo e immagini → testo |
È disponibile su Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform on AWS. L’ID può cambiare a seconda della piattaforma: controlla la tabella di disponibilità prima di aggiornare la produzione. Messages sincrono supporta 1M di contesto e 128K di output; Batch API arriva a 300K con il beta header indicato nella documentazione.
Cosa migliora rispetto a Sonnet 5
Anthropic indica oltre il 30% di velocità in più e fino al 30% di costo in meno per attività. Non è uno sconto sul singolo token: il risparmio nasce da output più brevi e da meno passaggi con gli strumenti.
L’annuncio riporta questi risultati rispetto a Sonnet 5:
| Valutazione | Sonnet 5.5 | Sonnet 5 | Cosa misura |
|---|---|---|---|
| Terminal-Bench 4.0 | 70,6% | 10,3% | Coding da terminale in più passaggi |
| CursorBench 4.0 | 55,5% | 34,1% | Attività ambigue di agenti di coding |
| GDPval-AA v2.1 | 1844 | 1449 | Lavoro della conoscenza in varie professioni |
| AA-Briefcase v1.1 | 1811 | 1359 | Lavoro della conoscenza a lungo orizzonte |
| Humanity’s Last Exam | 64,5% | 54,9% | Ragionamento multidisciplinare con strumenti |
| OSWorld 2.1 | 80,1% partial | 57,0% partial | Computer use |
| Chartography | 61,6% | 15,6% | Riconoscimento visivo di grafici |
Sono segnali delle condizioni di test, non il tasso di successo nel tuo repository. CursorBench è vicino al 57,8% di Opus 5.5 e GDPval al suo 1846, ma Anthropic descrive ancora Opus come più forte nei lavori aperti che richiedono giudizio prolungato. La lettura prudente è che Sonnet 5.5 riduce il divario nei compiti ripetibili, senza eliminare il modello di escalation.
Le curve di costo di Anthropic includono effort, strumenti e tutti i token dell’attività. Mantieni fissi prompt, permessi, commit, strumenti e test di accettazione quando confronti la pagina di Opus 5.5 o la tua route Sonnet attuale.
Il prezzo API non cambia
Sonnet 5.5 mantiene i prezzi diretti di Sonnet 5:
| Voce | Prezzo |
|---|---|
| Input non in cache | $2 / MTok |
| Output, token thinking fatturati inclusi | $10 / MTok |
| Scrittura cache di 5 minuti | $2.50 / MTok |
| Scrittura cache di 1 ora | $4 / MTok |
| Lettura cache | $0.20 / MTok |
| Batch API | sconto del 50% su input e output |
Un’attività senza cache con 100K token di input e 20K di output costa 0.1 × $2 + 0.02 × $10 = $0.40. Se 80K dell’input sono cache hit, lo stesso volume costa 0.02 × $2 + 0.08 × $0.20 + 0.02 × $10 = $0.376, esclusa la prima scrittura. Thinking, strumenti, retry e numero di turni cambiano il conto effettivo.
Perciò “fino al 30% in meno per attività” non significa uno sconto uniforme su ogni fattura. Misura il costo totale per modifica accettata dopo test o revisione. Il prezzo del gateway OmniaKey è un’altra route: controlla il catalogo modelli prima di fare il budget.
Sei controlli per la migrazione
Il nuovo ID è claude-sonnet-5-5, ma non tutti i parametri di Sonnet 5 sono trasferibili.
- Thinking è Adaptive per impostazione predefinita. Ometti
thinkingo usa{"type":"adaptive"}. Per togliere il pensiero iniziale usathinking: {"type":"between_tools"}.{"type":"disabled"}ebudget_tokensmanuale restituiscono 400. - L’uso forzato degli strumenti non è supportato.
tool_choicedi tipoanyotoolrestituisce 400. Usaautoonone, poi strict tools o structured outputs per lo schema. - I thinking block sono legati al modello e alla conversazione. Sonnet 5.5 legge quelli di Sonnet 5, ma Opus 5 e Opus 5.5 non leggono quelli prodotti da Sonnet 5.5. Cambiare modello a metà modifica il contesto disponibile.
- Non modificare la cronologia e reinviare il block senza controllo. Cambiare system, tools o un messaggio precedente può dare 400 con i nuovi controlli di binding. Aggiungi istruzioni o usa il controllo documentato.
- Computer use dipende dalla piattaforma. Claude API e Google Cloud richiedono
computer_toolset_20260801; Bedrock accetta ancoracomputer_20251124. - Leggi lo stream per tipo di block. Il progresso tra strumenti può arrivare come
thinking. Un client che mostra solotextpuò sembrare fermo anche se la richiesta è riuscita.
Esempio minimo con thinking adattivo:
{
"model": "claude-sonnet-5-5",
"max_tokens": 4096,
"output_config": {"effort": "high"},
"messages": [
{"role": "user", "content": "Controlla questa migrazione e indica i tre rischi principali."}
]
}
Ricontrolla anche valori non predefiniti di temperature, top_p e top_k: l’endpoint attuale li rifiuta. Lascia spazio in max_tokens per il thinking e la risposta visibile.
Dove inserirlo nel flusso di lavoro
Inizia con Sonnet 5.5 per una feature delimitata, un bug riproducibile, test su un’interfaccia conosciuta, una code review circoscritta, una bozza di documento o passaggi frequenti di un agente. Test, typecheck, build e screenshot mostrano rapidamente se il modello più economico è sufficiente.
Aumenta effort o passa a un modello più forte quando il lavoro attraversa più servizi, richiede un’architettura difficile da invertire o manca di informazioni. Se Sonnet ha ricevuto file e strumenti corretti ma non trova la causa, è un limite di capacità. Se manca il contesto, correggi prima il contesto.
In Claude Code confronta sessioni nuove con lo stesso commit, prompt, permessi e test di accettazione. Registra il primo risultato utile, il tempo totale, i token, i retry, gli strumenti falliti e i minuti di correzione umana. Una generazione più rapida può perdersi in un giro di revisione aggiuntivo.
Verdetto
Claude Sonnet 5.5 è il primo candidato da provare per coding e lavoro della conoscenza quotidiani. Il prezzo resta invariato, velocità e risultati pubblicati migliorano, e i compiti ben definiti hanno un motivo concreto per migrare da Sonnet 5.
Non fare deploy sostituendo solo una stringa. Prova thinking, tool choice, parser dei block e computer use. Tieni Opus 5.5 per architettura ambigua, debugging difficile e decisioni ad alto impatto. Per scegliere tra i modelli, leggi anche il confronto tra Opus 5.5 e Sonnet 5.
Domande frequenti
Quando è uscito Claude Sonnet 5.5?
Anthropic lo ha lanciato il 28 settembre 2026. L’ID diretto della Claude API è claude-sonnet-5-5.
È più economico di Sonnet 5?
Il prezzo per token è uguale: $2 per milione di input, $10 per milione di output e $0.20 per milione di lettura cache. Anthropic riporta fino al 30% in meno per attività grazie al consumo più basso.
È migliore di Opus 5.5?
Dipende dal lavoro. Sonnet è più rapido ed economico per attività delimitate; Opus è più forte nel giudizio complesso e aperto. Confronta risultati accettati, costo totale e correzioni.
Posso disattivare thinking?
Non con il vecchio thinking: {"type":"disabled"}. Usa Adaptive oppure thinking: {"type":"between_tools"} a un livello effort supportato.
Il contesto è di 1M?
Sì, con output standard massimo di 128K. Sono limiti di capacità, non crediti gratuiti o uso illimitato.