Storia
settembre 28, 2026
Anthropic afferma che Sonnet 5.5 è più veloce ed economico, ma i modelli più intelligenti restano incombenti
La tesi di Anthropic a favore di Sonnet 5.5 è che il lavoro quotidiano con l’IA non richiede sempre il modello più potente dell’azienda: velocità, costo e controlli di sicurezza possono contare di più. Ma le prime discussioni mostrano che il richiamo dei sistemi di fascia alta resta difficile da scuotere, anche quando le differenze nei flussi di lavoro reali sono lievi.
Tre mesi dopo aver presentato Sonnet 5 come un modello efficiente per l’implementazione di agenti IA, Anthropic torna con una proposta più incisiva per la sua offerta Claude di fascia media: rendere il cavallo di battaglia quotidiano più veloce, più economico e sufficientemente capace da sfidare la fascia premium nei lavori che contano di più.1
Al lancio, l’azienda ha dichiarato che Sonnet 5.5 è il 30% più veloce del suo predecessore e costa fino al 30% in meno per la maggior parte del lavoro. Il suo obiettivo è volutamente ordinario ma commercialmente importante: correggere bug, produrre documenti e creare presentazioni, anziché inseguire le attività di frontiera più impegnative.
2 Anthropic afferma inoltre che il modello può superare Opus 5.5 nei benchmark di programmazione agentica, dove la sua capacità di eseguire più agenti senza sforare i limiti di costo potrebbe rappresentare un vantaggio.1
Il compromesso non è semplicemente tra prezzo e potenza. Sonnet 5.5 dispone di capacità di sicurezza informatica che Anthropic descrive come paragonabili a quelle di Opus 5, rendendolo il primo modello Sonnet sottoposto alle stesse più rigorose misure di sicurezza informatica usate per i sistemi di fascia alta dell’azienda.1 Un altro rapporto ha descritto tali protezioni come misure “progettate per impedirne l’uso improprio”.3
Anche la comunicazione sulle prime prestazioni è stata altrettanto mirata. Addy Osmani ha evidenziato miglioramenti nella programmazione agentica e nell’uso del computer, citando punteggi del 70,6% su Terminal-Bench 4.0 e dell’80,1% su OSWorld 2.1.
4 L’argomentazione dell’azienda è chiara: per lavori ben delimitati, il modello più agile potrebbe essere l’acquisto migliore.
Eppure il lancio rivela anche l’ostacolo psicologico che ogni modello di fascia media deve affrontare. Aravind Srinivas ha detto di aver riscontrato “differenze minime” dopo aver trasferito decine di flussi di lavoro a Opus 5.5, ma di avvertire comunque “la FOMO di non usare il modello più intelligente”.
5 Il test per Sonnet 5.5 ora è capire se bollette più basse e risultati più rapidi possano trasformare quell’ansia in una ragione per non passare a un modello superiore.