Claude Sonnet 5.5 è uscito il 28 settembre 2026: costa come Sonnet 5 (2 dollari per milione di token in ingresso e 10 in uscita), è oltre il 30% più veloce e secondo Anthropic chiude le attività con fino al 30% di costo in meno, perché usa meno token e meno chiamate agli strumenti.
Sul terminale Claude Sonnet 5.5 supera perfino Opus 5.5, che costa il doppio.
Io uso Claude ogni giorno per sviluppo, agenti e automazioni per le aziende. Qui trovi cosa cambia davvero con Claude Sonnet 5.5, quanto costa una sessione vera rispetto a Opus 5.5, come passarci in Claude Code e via API, e i due limiti nuovi da conoscere prima di migrare.
Claude Sonnet 5.5 in breve: le novità che contano
- Stesso listino di Sonnet 5: 2 dollari per milione di token in input, 10 in output, 0,20 per la lettura dalla cache e 2,50 per la scrittura in cache.
- Più veloce: la generazione della risposta è oltre il 30% più rapida rispetto a Sonnet 5.
- Più efficiente: nei test di un cliente citato da Anthropic ha fatto un terzo di chiamate agli strumenti in meno e circa la metà dei comandi shell rispetto a Sonnet 5. Da qui arriva il risparmio per attività, non da un taglio di prezzo.
- Contesto e output: 1 milione di token di contesto, fino a 128.000 token in uscita, conoscenze aggiornate a giugno 2026.
- Ragionamento adattivo: il modello decide quanto pensare, con livelli di sforzo configurabili. In Claude Code e nelle app il default è medium, sull'API è high.
- Dove si usa: app Claude, Claude Code, API con l'identificativo
claude-sonnet-5-5, e anche su AWS, Google Cloud e Microsoft Azure. È arrivato anche in GitHub Copilot.
Benchmark di Claude Sonnet 5.5 contro Sonnet 5 e Opus 5.5
Questi sono i numeri pubblicati da Anthropic. Sono dati del produttore, quindi li leggo come indicazione, non come verdetto.
| Benchmark | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0 (agenti da terminale) | 70,6% | 10,3% | 66,4% |
| CursorBench 4.0 (coding in editor) | 55,5% | 34,1% | 57,8% |
| OSWorld 2.1 (uso del computer) | 80,1% | 57,0% | 81,8% |
| GDPval-AA v2.1 (lavoro d'ufficio reale) | 1844 | 1449 | 1846 |
| Humanity's Last Exam con strumenti | 64,5% | 54,9% | 67,7% |
Il salto su Terminal-Bench è enorme: da 10,3% a 70,6%. Era il punto debole di Sonnet 5, che negli agenti da terminale si perdeva spesso. Per chi fa girare agenti che eseguono comandi, test e build, è la novità più concreta.
Sul resto Sonnet 5.5 resta appena sotto Opus 5.5, ma a metà prezzo. Sul lavoro d'ufficio misurato da GDPval i due modelli sono praticamente pari.
Quanto costa Claude Sonnet 5.5: il conto di una sessione
Il listino da solo non basta: conta quanti token consuma il modello per finire il lavoro. Faccio un esempio semplice, una sessione di coding con 200.000 token letti e 20.000 scritti, senza cache.
- Sonnet 5.5: 0,40 $ di input più 0,20 $ di output, totale 0,60 $.
- Opus 5.5 (4 e 20 $ per milione): 0,80 $ più 0,40 $, totale 1,20 $.
A parità di token Claude Sonnet 5.5 costa la metà di Opus 5.5.
In più, rispetto a Sonnet 5, per la stessa attività dovrebbe usare meno token: un cliente citato da Anthropic ha misurato circa 121.000 token per risposta contro 497.000 con Sonnet 5. Sui miei progetti lo verifico nei log prima di fidarmi della media.
Se lavori con contesti lunghi e ripetuti, la cache a 0,20 $ per milione cambia il conto più del modello. Ho spiegato come impostarla nella guida al prompt caching su Claude e GPT-6.
Sonnet 5.5 contro GPT-6 Sol
GPT-6 Sol ha lo stesso listino, 2 e 10 dollari. Nei numeri pubblicati da Anthropic, su GDPval Sonnet 5.5 fa 1844 contro 1487 di GPT-6 Sol.
A parità di prezzo la scelta si fa sul tipo di lavoro e sull'ecosistema: per agenti in Claude Code e lavori sul terminale oggi preferisco Sonnet 5.5, per chi è già su Codex il confronto va fatto sul proprio flusso. Ho messo i due mondi a confronto in Claude Code contro Codex e nel pezzo su GPT-6 Sol e Luna.
Claude Sonnet 5.5 o Opus 5.5: quale usare
Anthropic lo dice chiaramente: Sonnet 5.5 è pensato per lavori con un obiettivo definito, Opus 5.5 per i problemi aperti e complessi. Nella pratica io divido così:
- Sonnet 5.5: correzione di bug, refactoring guidati, test, agenti che lavorano da terminale, documenti, presentazioni e fogli di calcolo, automazioni ad alto volume dove il costo per chiamata pesa.
- Opus 5.5: architettura di un progetto nuovo, analisi di codice che non conosci, ragionamenti lunghi con tanti vincoli, sessioni di molte ore su compiti ambigui.
Per la maggior parte delle automazioni che costruisco per le PMI, Sonnet 5.5 sarà il modello di partenza. Passo a Opus solo quando vedo che Sonnet sbaglia sullo stesso compito. Se vuoi il quadro completo della famiglia, trovi i dettagli in Claude Opus 5.5: prezzi e novità.
Come usare Claude Sonnet 5.5 in Claude Code e via API
- In Claude Code: aggiorna Claude Code, apri una sessione e scegli il modello con il comando
/model. - Via API: usa l'identificativo
claude-sonnet-5-5, ma prima controlla i parametri della sezione qui sotto: cambiare solo il nome del modello può restituire errori 400. - Imposta lo sforzo: sull'API il default è high. Per attività semplici e ripetitive prova un livello più basso e confronta qualità e costo.
- Misura prima di migrare tutto: fai girare gli stessi 10 o 20 compiti reali su Sonnet 5 e Sonnet 5.5, e confronta token, tempi e risultati.
- Controlla le integrazioni: alcuni strumenti di terze parti vanno aggiornati per riconoscere i nuovi modelli.
Sonnet 5 per ora resta disponibile, quindi puoi migrare con calma. Per sapere quanto spendi con i piani in abbonamento, trovi il riepilogo in prezzi di Claude e Claude Code.
Migrare da Sonnet 5 via API: cosa si rompe nel codice
Questa è la parte che nelle notizie di lancio non trovi, ed è quella che fa perdere mezza giornata. La guida di migrazione ufficiale elenca parametri che su Sonnet 5 funzionavano e su Claude Sonnet 5.5 restituiscono un errore 400. Prima di cambiare il modello in produzione controlla questi punti:
| Su Sonnet 5 | Su Sonnet 5.5 | Cosa fare |
|---|---|---|
thinking: {"type": "disabled"} |
Errore 400 | Usa {"type": "between_tools"} |
Richiesta senza campo thinking |
Parte il ragionamento adattivo | Mettilo in conto nei tempi e nei token |
thinking con budget_tokens |
Errore 400 | Usa output_config.effort (low, medium, high, xhigh, max) |
tool_choice di tipo tool o any |
Errore 400 | Usa {"type": "auto"} con gli strumenti in modalità strict: true |
temperature, top_p, top_k non di default |
Errore 400 | Toglili dalla richiesta |
Strumento computer computer_20251124 |
Errore 400 su API Claude e Google Cloud | Usa computer_toolset_20260801 |
Ci sono anche due cambi utili. La soglia minima per mettere un prompt in cache scende da 1.024 a 512 token, quindi puoi mettere in cache anche prompt più corti. E il testo del ragionamento arriva vuoto per default: se ti serve leggibile, va chiesto il riassunto con display: "summarized".
Su Amazon Bedrock gli output strutturati non sono disponibili per Sonnet 5.5: lì si usa auto senza strict e si valida la risposta a mano. Il modo che seguo io è sempre lo stesso: un ramo con questi cambi, i test che girano, e solo dopo lo spostamento del traffico.
I due limiti nuovi da conoscere
Le richieste cyber ad alto rischio passano a Sonnet 5
Secondo Anthropic, le capacità di sicurezza informatica di Sonnet 5.5 sono paragonabili a quelle di Opus 5. Per questo è il primo Sonnet con le protezioni cyber che prima erano riservate ai modelli di punta: le richieste considerate ad alto rischio vengono passate a Sonnet 5, in modo visibile.
Per lo sviluppo normale non cambia nulla. Se invece fai penetration test o analisi di vulnerabilità, metti in conto il passaggio e valuta il Cyber Verification Program di Anthropic per l'accesso esteso.
Il ragionamento è protetto contro l'estrazione
Sonnet 5.5 è anche il primo Sonnet con classificatori che bloccano l'estrazione massiva del ragionamento del modello. È una difesa contro chi prova a copiarne le capacità. Per chi integra il modello in modo normale non cambia il flusso, ma se salvi e riusi i blocchi di ragionamento in pipeline particolari, verifica il comportamento di Claude Sonnet 5.5 nei tuoi test.
Cosa aspettarsi nelle prossime settimane
Sonnet 5.5 è il secondo modello della famiglia 5.5 dopo Opus 5.5, e Anthropic ha annunciato che Haiku 5.5 arriverà nelle prossime settimane. Per chi aveva scritto codice su Sonnet 5, trovi il riepilogo dei costi della versione precedente in quanto costa Claude Sonnet 5.
La mia conclusione è semplice: se usi Sonnet 5, passare a Claude Sonnet 5.5 conviene quasi sempre, perché paghi lo stesso listino e ottieni un modello più veloce e più bravo con gli agenti. Se vuoi portare Claude nei processi della tua azienda con i costi sotto controllo, guarda come lavoro sull'automazione AI per le aziende oppure scrivimi.



