Tecnologie

Claude Sonnet 5.5: prezzi, novità e quando preferirlo a Opus

Claude Sonnet 5.5: stesso prezzo di Sonnet 5, oltre il 30% più veloce. Benchmark contro Opus 5.5, costo di una sessione e i parametri API che cambiano.

Cosmin-Anton Mihoc
8 min di lettura
Claude Sonnet 5.5: prezzi, novità e quando preferirlo a Opus
Indice dei contenuti (8 sezioni)

Claude Sonnet 5.5 è uscito il 28 settembre 2026: costa come Sonnet 5 (2 dollari per milione di token in ingresso e 10 in uscita), è oltre il 30% più veloce e secondo Anthropic chiude le attività con fino al 30% di costo in meno, perché usa meno token e meno chiamate agli strumenti.

Sul terminale Claude Sonnet 5.5 supera perfino Opus 5.5, che costa il doppio.

Io uso Claude ogni giorno per sviluppo, agenti e automazioni per le aziende. Qui trovi cosa cambia davvero con Claude Sonnet 5.5, quanto costa una sessione vera rispetto a Opus 5.5, come passarci in Claude Code e via API, e i due limiti nuovi da conoscere prima di migrare.

Claude Sonnet 5.5 in breve: le novità che contano

  • Stesso listino di Sonnet 5: 2 dollari per milione di token in input, 10 in output, 0,20 per la lettura dalla cache e 2,50 per la scrittura in cache.
  • Più veloce: la generazione della risposta è oltre il 30% più rapida rispetto a Sonnet 5.
  • Più efficiente: nei test di un cliente citato da Anthropic ha fatto un terzo di chiamate agli strumenti in meno e circa la metà dei comandi shell rispetto a Sonnet 5. Da qui arriva il risparmio per attività, non da un taglio di prezzo.
  • Contesto e output: 1 milione di token di contesto, fino a 128.000 token in uscita, conoscenze aggiornate a giugno 2026.
  • Ragionamento adattivo: il modello decide quanto pensare, con livelli di sforzo configurabili. In Claude Code e nelle app il default è medium, sull'API è high.
  • Dove si usa: app Claude, Claude Code, API con l'identificativo claude-sonnet-5-5, e anche su AWS, Google Cloud e Microsoft Azure. È arrivato anche in GitHub Copilot.

Benchmark di Claude Sonnet 5.5 contro Sonnet 5 e Opus 5.5

Questi sono i numeri pubblicati da Anthropic. Sono dati del produttore, quindi li leggo come indicazione, non come verdetto.

Benchmark Sonnet 5.5 Sonnet 5 Opus 5.5
Terminal-Bench 4.0 (agenti da terminale) 70,6% 10,3% 66,4%
CursorBench 4.0 (coding in editor) 55,5% 34,1% 57,8%
OSWorld 2.1 (uso del computer) 80,1% 57,0% 81,8%
GDPval-AA v2.1 (lavoro d'ufficio reale) 1844 1449 1846
Humanity's Last Exam con strumenti 64,5% 54,9% 67,7%

Il salto su Terminal-Bench è enorme: da 10,3% a 70,6%. Era il punto debole di Sonnet 5, che negli agenti da terminale si perdeva spesso. Per chi fa girare agenti che eseguono comandi, test e build, è la novità più concreta.

Sul resto Sonnet 5.5 resta appena sotto Opus 5.5, ma a metà prezzo. Sul lavoro d'ufficio misurato da GDPval i due modelli sono praticamente pari.

Quanto costa Claude Sonnet 5.5: il conto di una sessione

Il listino da solo non basta: conta quanti token consuma il modello per finire il lavoro. Faccio un esempio semplice, una sessione di coding con 200.000 token letti e 20.000 scritti, senza cache.

  • Sonnet 5.5: 0,40 $ di input più 0,20 $ di output, totale 0,60 $.
  • Opus 5.5 (4 e 20 $ per milione): 0,80 $ più 0,40 $, totale 1,20 $.

A parità di token Claude Sonnet 5.5 costa la metà di Opus 5.5.

In più, rispetto a Sonnet 5, per la stessa attività dovrebbe usare meno token: un cliente citato da Anthropic ha misurato circa 121.000 token per risposta contro 497.000 con Sonnet 5. Sui miei progetti lo verifico nei log prima di fidarmi della media.

Se lavori con contesti lunghi e ripetuti, la cache a 0,20 $ per milione cambia il conto più del modello. Ho spiegato come impostarla nella guida al prompt caching su Claude e GPT-6.

Sonnet 5.5 contro GPT-6 Sol

GPT-6 Sol ha lo stesso listino, 2 e 10 dollari. Nei numeri pubblicati da Anthropic, su GDPval Sonnet 5.5 fa 1844 contro 1487 di GPT-6 Sol.

A parità di prezzo la scelta si fa sul tipo di lavoro e sull'ecosistema: per agenti in Claude Code e lavori sul terminale oggi preferisco Sonnet 5.5, per chi è già su Codex il confronto va fatto sul proprio flusso. Ho messo i due mondi a confronto in Claude Code contro Codex e nel pezzo su GPT-6 Sol e Luna.

Claude Sonnet 5.5 o Opus 5.5: quale usare

Anthropic lo dice chiaramente: Sonnet 5.5 è pensato per lavori con un obiettivo definito, Opus 5.5 per i problemi aperti e complessi. Nella pratica io divido così:

  • Sonnet 5.5: correzione di bug, refactoring guidati, test, agenti che lavorano da terminale, documenti, presentazioni e fogli di calcolo, automazioni ad alto volume dove il costo per chiamata pesa.
  • Opus 5.5: architettura di un progetto nuovo, analisi di codice che non conosci, ragionamenti lunghi con tanti vincoli, sessioni di molte ore su compiti ambigui.

Per la maggior parte delle automazioni che costruisco per le PMI, Sonnet 5.5 sarà il modello di partenza. Passo a Opus solo quando vedo che Sonnet sbaglia sullo stesso compito. Se vuoi il quadro completo della famiglia, trovi i dettagli in Claude Opus 5.5: prezzi e novità.

Come usare Claude Sonnet 5.5 in Claude Code e via API

  1. In Claude Code: aggiorna Claude Code, apri una sessione e scegli il modello con il comando /model.
  2. Via API: usa l'identificativo claude-sonnet-5-5, ma prima controlla i parametri della sezione qui sotto: cambiare solo il nome del modello può restituire errori 400.
  3. Imposta lo sforzo: sull'API il default è high. Per attività semplici e ripetitive prova un livello più basso e confronta qualità e costo.
  4. Misura prima di migrare tutto: fai girare gli stessi 10 o 20 compiti reali su Sonnet 5 e Sonnet 5.5, e confronta token, tempi e risultati.
  5. Controlla le integrazioni: alcuni strumenti di terze parti vanno aggiornati per riconoscere i nuovi modelli.

Sonnet 5 per ora resta disponibile, quindi puoi migrare con calma. Per sapere quanto spendi con i piani in abbonamento, trovi il riepilogo in prezzi di Claude e Claude Code.

Migrare da Sonnet 5 via API: cosa si rompe nel codice

Questa è la parte che nelle notizie di lancio non trovi, ed è quella che fa perdere mezza giornata. La guida di migrazione ufficiale elenca parametri che su Sonnet 5 funzionavano e su Claude Sonnet 5.5 restituiscono un errore 400. Prima di cambiare il modello in produzione controlla questi punti:

Su Sonnet 5 Su Sonnet 5.5 Cosa fare
thinking: {"type": "disabled"} Errore 400 Usa {"type": "between_tools"}
Richiesta senza campo thinking Parte il ragionamento adattivo Mettilo in conto nei tempi e nei token
thinking con budget_tokens Errore 400 Usa output_config.effort (low, medium, high, xhigh, max)
tool_choice di tipo tool o any Errore 400 Usa {"type": "auto"} con gli strumenti in modalità strict: true
temperature, top_p, top_k non di default Errore 400 Toglili dalla richiesta
Strumento computer computer_20251124 Errore 400 su API Claude e Google Cloud Usa computer_toolset_20260801

Ci sono anche due cambi utili. La soglia minima per mettere un prompt in cache scende da 1.024 a 512 token, quindi puoi mettere in cache anche prompt più corti. E il testo del ragionamento arriva vuoto per default: se ti serve leggibile, va chiesto il riassunto con display: "summarized".

Su Amazon Bedrock gli output strutturati non sono disponibili per Sonnet 5.5: lì si usa auto senza strict e si valida la risposta a mano. Il modo che seguo io è sempre lo stesso: un ramo con questi cambi, i test che girano, e solo dopo lo spostamento del traffico.

I due limiti nuovi da conoscere

Le richieste cyber ad alto rischio passano a Sonnet 5

Secondo Anthropic, le capacità di sicurezza informatica di Sonnet 5.5 sono paragonabili a quelle di Opus 5. Per questo è il primo Sonnet con le protezioni cyber che prima erano riservate ai modelli di punta: le richieste considerate ad alto rischio vengono passate a Sonnet 5, in modo visibile.

Per lo sviluppo normale non cambia nulla. Se invece fai penetration test o analisi di vulnerabilità, metti in conto il passaggio e valuta il Cyber Verification Program di Anthropic per l'accesso esteso.

Il ragionamento è protetto contro l'estrazione

Sonnet 5.5 è anche il primo Sonnet con classificatori che bloccano l'estrazione massiva del ragionamento del modello. È una difesa contro chi prova a copiarne le capacità. Per chi integra il modello in modo normale non cambia il flusso, ma se salvi e riusi i blocchi di ragionamento in pipeline particolari, verifica il comportamento di Claude Sonnet 5.5 nei tuoi test.

Cosa aspettarsi nelle prossime settimane

Sonnet 5.5 è il secondo modello della famiglia 5.5 dopo Opus 5.5, e Anthropic ha annunciato che Haiku 5.5 arriverà nelle prossime settimane. Per chi aveva scritto codice su Sonnet 5, trovi il riepilogo dei costi della versione precedente in quanto costa Claude Sonnet 5.

La mia conclusione è semplice: se usi Sonnet 5, passare a Claude Sonnet 5.5 conviene quasi sempre, perché paghi lo stesso listino e ottieni un modello più veloce e più bravo con gli agenti. Se vuoi portare Claude nei processi della tua azienda con i costi sotto controllo, guarda come lavoro sull'automazione AI per le aziende oppure scrivimi.

Condividi questo articolo
Hai domande? Contattami

Pronto a dare vita al tuo progetto?

Contattami per discutere della tua idea e ricevere una consulenza gratuita.

Iniziamo insieme