Introduzione
Il 28 settembre 2026 Anthropic ha annunciato il rilascio di Claude Sonnet 5.5, secondo modello della famiglia 5.5 dopo Opus 5.5, presentato appena sei giorni prima. La novità principale è una velocità superiore di oltre 30 % rispetto a Sonnet 5, accompagnata da un risparmio di costo per lavoro completato fino al 30 % in molte attività. Nonostante le migliorie tecniche, le tariffe nominali delle API rimangono invariate.
Prezzo e modello di costi
Claude Sonnet 5.5 mantiene le stesse tariffe introdotte da Anthropic nell’agosto 2026: 2 $ per milione di token in input, 10 $ per milione di token in output** e 0,20 $ per milione di token letti dalla cache. Queste cifre sono identiche a quelle di Sonnet 5, il che significa che il risparmio non deriva da un prezzo più basso ma da una riduzione del consumo di risorse necessarie per completare lo stesso compito.
L’azienda afferma che, nella maggior parte dei casi, Sonnet 5.5 richiede meno token per ottenere risultati equivalenti, consentendo così un risparmio fino al 30 % sul costo complessivo di un’attività.
Livelli di “effort” e consumo di token
Anthropic ha introdotto la possibilità di regolare l’“effort”, ossia la quantità di lavoro computazionale dedicata a una richiesta. Nelle applicazioni Claude e Claude Code il livello predefinito è Medium, mentre sulla piattaforma per sviluppatori è impostato a High. Salendo di livello (ad es. High** o Xhigh) il modello può elaborare più a lungo e produrre risposte più accurate, ma il consumo di token cresce proporzionalmente.
Prestazioni nei benchmark interni
Anthropic ha pubblicato una serie di benchmark che mettono a confronto Sonnet 5.5 con Sonnet 5 e Opus 5.5. I risultati più significativi includono:
- Terminal‑Bench 4.0: Sonnet 5.5 raggiunge il 70,6 % contro il 10,3 % di Sonnet 5.
- FrontierCode 1.1 (livello Xhigh): risultato massimo 52,1 %.
- CursorBench 4.0: Sonnet 5.5 segna 55,5 % contro 34,1 % del predecessore.
- GDPval‑AA v2.1: punteggio 1.844, quasi identico ai 1.846 di Opus 5.5.
- AA‑Briefcase: Sonnet 5.5 ottiene 1.811 contro 1.822 di Opus 5.5.
- OSWorld 2.1: 80,1 % di accuratezza.
- Chartography: 61,6 %.
- Humanity’s Last Exam: 64,5 % contro 54,9 % di Sonnet 5 e 67,7 % di Opus 5.5.
Anthropic sottolinea che, nonostante i test standardizzati coprano solo una parte delle capacità del modello, Opus 5.5 rimane il prodotto di riferimento per attività complesse, aperte e prolungate.
Analisi indipendente di Artificial Analysis
Il laboratorio Artificial Analysis, specializzato in confronti indipendenti tra modelli di AI, ha pubblicato risultati contrastanti. Nei test del 28 settembre, Sonnet 5.5 con effort al massimo ha raggiunto 56 punti nell’Artificial Analysis Intelligence Index, due punti in meno rispetto a Opus 5.5 (58 punti). Tuttavia, il test ha registrato circa 193 mila token di output per task, il livello più alto osservato nei propri esperimenti.
In questa configurazione il costo medio per attività è stato di 7,60 $, circa il 50 % più alto rispetto a Sonnet 5. Il risultato non invalida l’affermazione di Anthropic sui risparmi “fino al 30 %”, poiché la loro stima si basa su scenari tipici con effort Low o Medium, dove il consumo di token è notevolmente più contenuto.
Implicazioni per le imprese
La differenza tra prezzo per milione di token e costo reale di un’attività evidenzia che le aziende devono valutare il costo per risultato accettabile. Un modello più costoso per chiamata può risultare più conveniente se conclude il lavoro in pochi passaggi; al contrario, un modello con tariffe più basse può generare fatture più elevate se richiede numerose iterazioni, utilizzo intensivo di strumenti esterni o molte riletture della cache.
Per questo motivo, Anthropic ha orientato la comunicazione verso due aree chiave:
- Sviluppo software: Sonnet 5.5 comprende più rapidamente
