Daniel Reyes, YuSMP Group
Daniel Reyes Principal Engineer, AI/ML, YuSMP Group · sistemi agentici e di retrieval in produzione per team negli Stati Uniti e in Europa
Modulo server compatto in un data center buio che emette un flusso denso e veloce di particelle di luce ambrata, simbolo di un output più rapido

In breve

Claude Sonnet 5.5 è un puro aggiornamento di efficienza: stesso prezzo di 2 / 10 dollari di Sonnet 5, ma output oltre il 30% più veloce e costo per task fino al 30% più basso, con punteggi di coding agentico che Anthropic colloca alla pari di Opus 5.5. Per i team che lavorano con Claude tramite l’API di Anthropic, AWS, Google Cloud o Azure, il nuovo identificativo del modello è claude-sonnet-5-5.

Due aspetti meritano l’attenzione dei team di engineering. Primo, il risparmio nasce dal fatto che il modello usa meno token e meno chiamate a strumenti: si vede nel costo per task completato, non nel listino, e solo se misurate in questo modo. Secondo, Sonnet 5.5 è il primo Sonnet con protezioni cyber: le richieste di sicurezza a rischio vengono gestite da Sonnet 5. In una pipeline di agenti IA lo stesso workflow può quindi essere servito da due modelli diversi.

Che cosa cambia con Sonnet 5.5?

Il prezzo non si è mosso; il lavoro per dollaro sì. Anthropic mantiene il listino di Sonnet a 2 dollari per milione di token in input e 10 dollari per milione in output, e afferma che il nuovo modello completa gli stessi task con meno token e meno chiamate a strumenti. Insieme a un output oltre il 30% più veloce, è da qui che nasce il dato «fino al 30% in meno per task». I primi numeri dei clienti citati da VentureBeat vanno nella stessa direzione: Lovable riporta un terzo di chiamate a strumenti in meno e circa la metà delle esecuzioni shell, Box misura risposte 2,4 volte più rapide con il 12% di token in meno.

Il salto più ampio riguarda il coding agentico. Anthropic dichiara il 70,6% su Terminal-Bench 4.0, contro il 10,3% di Sonnet 5 e davanti al 66,4% pubblicato una settimana prima per Opus 5.5. Sui benchmark di lavoro più generali i due modelli sono quasi appaiati: 1844 contro 1846 su GDPval-AA e 80,1% contro 81,8% su OSWorld 2.1. Anthropic aggiunge che Sonnet 5.5 con effort Low o Medium può battere il miglior punteggio di Sonnet 5 a circa un decimo del costo per task. Sono tutti risultati del produttore: un motivo per testare, non un verdetto.

TechCrunch descrive il modello come il «partner di lavoro quotidiano» di Anthropic, pensato per task ben delimitati come correggere bug e produrre documenti, presentazioni e fogli di calcolo, mentre Opus resta il livello per i problemi più difficili. Sonnet 5.5 è disponibile su Claude Platform e tramite AWS, Google Cloud e Microsoft Azure, con supporto alla zero data retention.

Come funzionano le nuove protezioni cyber?

Sonnet 5.5 è il primo Sonnet a uscire con le protezioni di cybersicurezza che Anthropic finora riservava ai modelli di punta. Secondo TechCrunch le sue capacità cyber sono paragonabili a quelle di Opus 5, per questo ora si applica la stessa classe di tutele. Quando una richiesta viene classificata come attività di cybersicurezza a rischio, risponde Sonnet 5 invece di Sonnet 5.5. Le organizzazioni che svolgono legittimo lavoro difensivo possono candidarsi al Cyber Verification Program di Anthropic per un accesso a livelli alle piene capacità.

Per la maggior parte dei team di prodotto accadrà raramente. Per chi costruisce su Claude scanner di sicurezza, copiloti per SOC o assistenti per penetration test conta: lo stesso workflow può ora ricevere risposte da due modelli, con qualità e comportamento diversi. Se la vostra integrazione segue lo schema documentato da Anthropic per Opus 5.5, verificate come sono configurati i fallback lato API e che cosa restituisce una chiamata segnalata prima di affidarvici in un agente non presidiato.

Che cosa significa per i team software in Italia?

Primo, il livello predefinito scende di un gradino. Se sui vostri carichi Sonnet 5.5 resta davvero a pochi punti da Opus 5.5, alla metà del prezzo di listino, molti agenti spostati su Opus per la qualità possono tornare indietro. È una decisione di routing, non un interruttore globale: tenete Opus 5.5 per i task lunghi e ambigui dove vince ancora, e mandate a Sonnet 5.5 il coding, il triage e i documenti ben delimitati.

Secondo, il costo per token è la metrica sbagliata. Poiché il risparmio viene da meno token e chiamate a strumenti, una dashboard che segue il prezzo per milione di token non mostrerà alcuna differenza. Misurate invece costo e latenza per task completato, per workflow e per livello di effort. I cinque livelli di effort diventano la leva di costo principale: un agente di triage del supporto su Low e un agente di refactoring su Xhigh sono di fatto prodotti diversi.

Terzo, gli inventari dei modelli devono includere i fallback. Gli obblighi di documentazione dell’AI Act, il principio di responsabilizzazione del GDPR e la maggior parte delle valutazioni del rischio fornitori richiedono di sapere quale sistema ha prodotto un output. Con i fallback cyber, un sistema documentato come basato su Sonnet 5.5 può servire alcune risposte da Sonnet 5. Registrate il modello indicato in ogni risposta, non solo quello richiesto, e conservate questo dato accanto ai risultati delle valutazioni.

Cosa fare prima di passare

  1. Rieseguite il vostro set di valutazione. Confrontate Sonnet 5, Sonnet 5.5 e Opus 5.5 sui vostri task, compresi lunghezza e stile dell’output, prima di spostare traffico.
  2. Misurate il costo per task completato. Registrate token, chiamate a strumenti e latenza per task: è lì che il 30% dichiarato si vede, oppure no.
  3. Scegliete il livello di effort per workflow. Avviate i workflow economici su Low o Medium e alzate l’effort solo dove la qualità lo richiede.
  4. Gestite i fallback in modo esplicito. Registrate quale modello ha risposto, impostate alert su fallback o blocchi di sicurezza inattesi e candidatevi al Cyber Verification Program se il vostro prodotto è uno strumento di sicurezza.
  5. Mantenete un rollback. Tenete claude-sonnet-5 come rotta di riserva finché le vostre metriche non confermano il miglioramento.

Domande frequenti

Che cosa ha lanciato Anthropic il 28 settembre 2026?

Anthropic ha lanciato Claude Sonnet 5.5, secondo modello della famiglia Claude 5.5 dopo Opus 5.5 (22 settembre 2026). È disponibile tramite Claude Platform con l’identificativo claude-sonnet-5-5 e su Amazon Web Services, Google Cloud e Microsoft Azure, con opzione zero data retention. Secondo Anthropic genera output oltre il 30% più velocemente di Sonnet 5 e costa fino al 30% in meno per task. Haiku 5.5 è atteso nelle prossime settimane.

Quanto costa Claude Sonnet 5.5?

Il listino è lo stesso di Sonnet 5: 2 dollari per milione di token in input e 10 dollari per milione in output, con letture della cache a 0,20 dollari e scritture a 2,50 dollari per milione di token. Il risparmio deriva dall’efficienza, non da un taglio di prezzo: il modello completa i task con meno token e meno chiamate a strumenti. Per confronto, Opus 5.5 costa 4 e 20 dollari per milione di token.

Sonnet 5.5 può sostituire Opus 5.5 per gli agenti di coding?

Stando ai numeri pubblicati da Anthropic, ci va vicino. Sonnet 5.5 ottiene il 70,6% su Terminal-Bench 4.0 contro il 66,4% di Opus 5.5, 1844 contro 1846 su GDPval-AA e 80,1% contro 81,8% su OSWorld 2.1, alla metà del prezzo di listino. Sono benchmark del produttore: provate entrambi i modelli sui vostri task prima di spostare il traffico di produzione. Per molti task di codice e documenti ben delimitati Sonnet 5.5 sarà probabilmente la scelta predefinita più economica.

Quali sono le nuove protezioni cyber di Sonnet 5.5?

Sonnet 5.5 è il primo Sonnet lanciato con le protezioni di cybersicurezza che Anthropic applica ai suoi modelli più potenti. Le richieste di cybersicurezza ad alto rischio vengono gestite da Sonnet 5 anziché da Sonnet 5.5. Le organizzazioni che svolgono attività di sicurezza difensiva possono candidarsi al Cyber Verification Program di Anthropic per un accesso a livelli. Chi sviluppa strumenti di sicurezza su Claude dovrebbe verificare quali prompt attivano il fallback.

Cosa devono verificare le aziende italiane prima di passare a Sonnet 5.5?

Oltre a valutazione, misura del costo per task e rollback su Sonnet 5, la tracciabilità: GDPR e AI Act richiedono di sapere quale sistema ha prodotto un output, e con i fallback cyber i modelli possono essere due. Verificate anche tramite quale fornitore e in quale region cloud usate il modello, e se contratti, DPIA e l’informativa verso gli utenti restano coerenti con il cambio di versione.

Fonti

Anthropic — Introducing Claude Sonnet 5.5
Anthropic — Claude Sonnet 5.5 System Card (28 settembre 2026)
TechCrunch — Anthropic releases Sonnet 5.5, which it calls a significantly cheaper, faster work partner
CNBC — Anthropic Sonnet 5.5 launch: price, features and safety
VentureBeat — Anthropic launches Claude Sonnet 5.5 with 30% cost reduction per task