Anthropic ha presentato Claude Sonnet 5.5 con funzionalità migliorate per la programmazione, l’analisi dei dati e l’esecuzione di attività in più fasi.

Velocità e risparmio di token

Rispetto a Claude Sonnet 3.5, il nuovo modello genera risposte oltre il 30% più velocemente e, secondo i test di Anthropic, i costi di esecuzione delle attività possono ridursi fino al 30% senza variazioni tariffarie API.

Claude Sonnet 5.5 integra le chiamate agli strumenti in modo più efficiente ed esegue le attività in un minor numero di passaggi, consumando meno token per ottenere un risultato analogo.

Un milione di token di contesto

Sonnet 5.5 ha mantenuto una finestra di contesto di 1 milione di token e una lunghezza massima di risposta fino a 128 mila token. Ciò consente di lavorare con documenti di grandi dimensioni, basi di codice e ampi set di dati all’interno di una singola richiesta.

Il modello accetta testo e immagini, inclusi screenshot, grafici e interfacce.

Miglioramenti nella programmazione

Anthropic ha registrato il miglioramento più significativo nel test Terminal-Bench 4.0, che valuta la capacità dell’IA di operare autonomamente nel terminale e di eseguire attività in più fasi. Claude Sonnet 5.5 ha ottenuto il 70,6% contro il 10,3% della precedente Sonnet 5.

Il modello è in grado di analizzare il codice, correggere errori, eseguire controlli e continuare a lavorare senza la necessità di impostare manualmente ogni singola azione successiva.

Lavoro con documenti e grafica

Anthropic ha inoltre migliorato la creazione di tabelle, presentazioni, file JSON e documenti strutturati. In base ai test preliminari, Sonnet 5.5 segue con maggiore precisione modelli complessi e genera materiali che richiedono meno correzioni manuali.

Il riconoscimento delle informazioni visive è notevolmente migliorato. Nel test Chartography, il modello ha ottenuto il 61,6% contro il 15,6% di Sonnet 5. Il benchmark valuta la capacità dell’IA di comprendere grafici e diagrammi senza strumenti aggiuntivi.

Risultati dei benchmark

Anthropic ha pubblicato i risultati comparativi di Claude Sonnet 5.5 e del precedente Sonnet 5 in sette test, che coprono programmazione, utilizzo del computer, analisi delle immagini e risoluzione di problemi complessi.

BenchmarkSonnet 5Sonnet 5.5
Terminal-Bench 4.0 (programmazione)10,3%70,6%
CursorBench 4.0 (programmazione)34,1%55,5%
GDPval-AA v2.1 (attività lavorative, indice)14491844
AA-Briefcase v1.1 (attività lavorative, indice)13591811
L’ultimo esame dell’umanità (con strumenti)54,9%64,5%
OSWorld 2.1 (controllo del computer, test parziale)57,0%80,1%
Chartography (analisi dei grafici senza strumenti)15,6%61,6%

Tutti i dati sono basati sui risultati pubblicati da Anthropic. In GDPval-AA e AA-Briefcase vengono utilizzati punteggi indice, mentre negli altri test vengono impiegate percentuali. Un risultato più elevato indica una migliore esecuzione dei compiti nell’ambito del rispettivo benchmark.

Disponibilità e prezzo

Claude Sonnet 3.5 è stata rilasciata il 28/09/2026 ed è già disponibile nelle applicazioni Claude, tramite il API ufficiale, Amazon Web Services, Google Cloud e Microsoft Azure.

Costo di utilizzo tramite API per 1 milione di token:

  • Token di input – $2;
  • Token in uscita – $10;
  • Lettura dalla cache – $0,20;
  • Scrittura nella cache per 5 minuti – $2,50;
  • Scrittura nella cache per 1 ora – $4.

Per gli sviluppatori, il modello è disponibile con l’identificativo claude-sonnet-5-5.

Segui MobiDevices
Telegram