GPT-6 Sol e Claude Opus 5.5 disponibiliGPT-6 Sol a metà prezzo rispetto a 5.6 Sol
Blog
Confronto

Opus 5.5 o Sonnet 5.5

Scegli in base al risultato verificato e al costo totale.

11 min di letturaOmniaKey
Claude Opus 5.5Claude Sonnet 5.5ConfrontoProgrammazionePrezzi API

Tra Claude Opus 5.5 e Sonnet 5.5 conviene confrontare il lavoro verificato e il costo totale. Sonnet è un punto di partenza per valutare modifiche circoscritte, bug riproducibili e funzionalità con test di accettazione. Opus merita una valutazione quando la diagnosi è incerta, il cambiamento attraversa più sistemi o correggere una soluzione plausibile ma sbagliata sarebbe costoso. È un criterio operativo, non una classifica universale.

I prezzi standard dei token in ingresso e uscita di Sonnet sono la metà, ma la lettura della cache costa uguale. Anche i benchmark di programmazione pubblicati non assegnano tutte le vittorie allo stesso modello.

Fonti ufficiali verificate il 29 settembre 2026. Non abbiamo svolto un test comparativo indipendente. I punteggi sono attribuiti e i costi calcolati a quantità di token costante, non misurati su esecuzioni reali. OmniaKey pubblica questa guida e offre un gateway API con tariffe distinte dall'API diretta di Anthropic.

Differenze tra Opus 5.5 e Sonnet 5.5

Opus 5.5 è uscito il 22 settembre 2026 e Sonnet 5.5 il 28. Il confronto con Sonnet 5 rimane dedicato alla versione precedente.

CaratteristicaSonnet 5.5Opus 5.5
ID Claude APIclaude-sonnet-5-5claude-opus-5-5
Contesto / output massimo standard1M / 128K token1M / 128K token
Input → outputTesto e immagini → testoTesto e immagini → testo
Effort predefinito nell'APIhighmedium
RagionamentoAdaptive; supporta between_toolsAdaptive, sempre attivo
Categoria di latenza del fornitoreFastModerate
Input / output per milione di token$2 / $10$4 / $20
Lettura cache per milione di token$0.20$0.20

Fonte: panoramica ufficiale. La stessa capacità non implica la stessa precisione nel recuperare informazioni. Input e output rispettano il budget di contesto. L'output da 300K è un'opzione beta della Batch API, non il limite sincrono ordinario.

Quando conviene pagare di più per Opus?

Prova Sonnet su piccole funzionalità verificabili, revisioni mirate ed estrazione strutturata. Il vantaggio di prezzo conta se viene rispettata la stessa soglia qualitativa. Valuta Opus su errori ambigui tra servizi, migrazioni delicate e indagini lunghe. Usa gli stessi materiali e criteri, osservando quanto lavoro di correzione rimane. Un prezzo maggiore non garantisce accuratezza o sicurezza.

Nei documenti lunghi controlla fonti e condizioni omesse; nelle attività visive usa schermate e grafici rappresentativi. Comprendere immagini non significa generarle nativamente. Questa strategia considera il costo. La guida generale di Anthropic consiglia invece di partire da Opus 5.5 per la maggior parte delle attività: è ragionevole se la qualità viene prima. La guida ai modelli per Claude Code tratta la scelta più ampia.

Benchmark di programmazione: leggere anche le condizioni

I numeri provengono dalla tabella comparativa dell'annuncio di Sonnet 5.5. OmniaKey non ha ripetuto le prove.

ValutazioneSonnet 5.5Opus 5.5
Terminal-Bench 4.070.6% (max)66.4% (xhigh)
FrontierCode 1.1 Main46.2% (max); 52.1% (xhigh)54.4%
CursorBench 4.055.5%57.8%
GDPval-AA v2.118441846

La system card, §8.5, descrive 66 attività Terminal-Bench con cinque tentativi ciascuna: 330 per modello. Assumendo tentativi indipendenti, l'errore standard è ±2,5 punti per Sonnet e ±2,6 per Opus. Si è usato Claude Code in modalità --bare, con protezioni di produzione e modelli di fallback per parte delle richieste; la quota di tentativi interessati differisce. I 4,2 punti di scarto non dimostrano superiorità generale né significatività statistica senza altri dati.

In FrontierCode, Sonnet a max ottiene meno di xhigh. La nota dell'annuncio descrive casi analizzati in cui il ricorso più frequente a un flusso di revisione ha contribuito a timeout o modifiche fuori perimetro. Ragionare di più non assicura una patch migliore.

GDPval esprime punti, non percentuali. Per Sonnet, GDPval-AA e AA-Briefcase riportano anche la riserva di un bug negli output strutturati presente nel deployment precedente al rilascio e poi corretto. I dettagli sono nelle analisi di Sonnet 5.5 e Opus 5.5.

Prezzi API e costo della cache

La documentazione prezzi indica queste tariffe globali standard dell'API diretta in USD per milione di token. Tasse, strumenti, opzioni regionali e altre piattaforme sono esclusi.

VoceSonnet 5.5Opus 5.5
Input non in cache$2$4
Output fatturato$10$20
Scrittura cache, 5 minuti$2.50$5
Scrittura cache, 1 ora$4$8
Lettura cache$0.20$0.20

L'output fatturato comprende il ragionamento. Entrambi hanno una soglia minima di 512 token per il prompt memorizzabile, ma il cache hit va verificato nei dati di utilizzo. I calcoli seguenti fissano le quantità; possono sommare più richieste, ognuna soggetta ai propri limiti.

Stesso volume di tokenSonnet 5.5Opus 5.5
100K input non in cache + 20K output$0.40$0.80
Quanto sopra + prima scrittura cache di 800K, 5 minuti$2.40$4.80
100K input non in cache + lettura valida di 800K + 20K output$0.56$0.96

L'ultima riga dà 0.1 × 2 + 0.8 × 0.20 + 0.02 × 10 = $0.56 per Sonnet e 0.1 × 4 + 0.8 × 0.20 + 0.02 × 20 = $0.96 per Opus: circa 1,71 volte nella fase di lettura. La scrittura precedente si paga a parte; i suoi token non vanno contati anche come input non in cache.

Nelle attività reali cambiano consumo e tentativi. Dividi tutte le spese, fallimenti compresi, per i risultati accettati. Misura separatamente il tempo umano di correzione prima di convertirlo con una tariffa oraria esplicita.

Velocità e livello di ragionamento

Le affermazioni Sonnet 5.5 su output più veloce del 30%+ e costo per attività inferiore fino al 30% sono rispetto a Sonnet 5. Non indicano una differenza con Opus 5.5 né un taglio del 30% delle tariffe API. Il risparmio tipico di circa il 40% annunciato per Opus 5.5 riguarda Opus 5.

Sonnet usa high per impostazione predefinita nell'API, medium in Claude Code e nelle app. Opus API usa medium. Specifica client e effort: lo stesso nome non equivale allo stesso budget di calcolo. Separa il tempo prima dell'output utile dal tempo necessario a terminare e verificare il lavoro.

Prima di cambiare modello

Leggi le guide di migrazione Sonnet e Opus. Sonnet permette between_tools a high o meno per eliminare il ragionamento iniziale, non ogni forma di ragionamento. Opus mantiene adaptive thinking.

Entrambi rifiutano tool_choice forzato con any o tool. La validazione rigorosa degli argomenti non impone una chiamata; controlla il supporto della piattaforma. I thinking blocks hanno regole di conservazione legate a modello, account e conversazione. Inizia una conversazione nuova per il confronto. Il progresso tra strumenti può arrivare in thinking blocks nascosti per default: verifica tipi di blocco e streaming prima di interpretare il silenzio come blocco dell'agente. Cambiare ID non dimostra compatibilità con qualsiasi gateway.

Un test riproducibile sul proprio lavoro

Una proposta consiste in sei attività per ciascuna di quattro categorie: codice circoscritto, debugging/refactoring difficile, strumenti e documenti/immagini. 24 attività × 2 modelli × 3 ripetizioni = 144 esecuzioni di attività, potenzialmente molte più richieste API. Non è un esperimento già svolto da noi.

Fissa commit, prompt, strumenti, regione, permessi, limiti di tempo/passaggi e test. Ripristina ambiente e conversazione e alterna l'ordine dei modelli. Separa il confronto esplicito a medium da impostazioni predefinite o più alte. Registra errori, rifiuti, ripetizioni, fallback osservabili, token, costi, tempo e correzioni reali. Verifica il codice con test nascosti e i documenti con le fonti. Tre ripetizioni non bastano per un P95 preciso per attività; senza successi non riportare un costo per successo pari a zero.

Domande frequenti

Sonnet 5.5 è migliore per programmare?

Supera Opus nel Terminal-Bench pubblicato, mentre Opus prevale nelle altre valutazioni di codice citate. Impostazioni e incertezza impediscono una conclusione generale.

Il costo è sempre la metà?

Lo sono le tariffe standard di input non in cache e output, non la lettura della cache. Consumo, ripetizioni, strumenti e correzioni cambiano la spesa finale.

Quale scegliere in Claude Code?

Valuta Sonnet per attività chiare e Opus per indagini difficili, oppure parti da Opus se la qualità è prioritaria. Abbonamento e API sono separati: vedi i prezzi di Claude Code.

Opus ha più contesto?

Questa coppia offre 1M di contesto e 128K di output massimo standard per entrambi. Va verificato l'uso delle informazioni.

Offerta attuale e fonti

Le pagine Sonnet 5.5, Opus 5.5 e il catalogo mostrano rotte e prezzi OmniaKey. I calcoli diretti non sono preventivi del gateway o test di chiamate reali. Le fonti ufficiali Anthropic collegate sono in inglese.