Daniel Reyes, YuSMP Group
Daniel Reyes Principal Engineer, IA/ML, YuSMP Group · Architetture di agenti e ingegneria dei costi LLM per prodotti US/UE
Rete astratta di nodi luminosi interconnessi e flussi di dati in movimento, in blu e ambra su uno sfondo blu notte profondo, che suggerisce molti piccoli agenti software autonomi

La risposta breve

Anthropic ha lanciato Claude Sonnet 5 il 30 giugno 2026 a tariffe API introduttive di 2 dollari per milione di token in input e 10 dollari per milione di token in output, in vigore fino al 31 agosto, poi 3 e 15 dollari. Abbina un modello di taglia media a prestazioni agentiche vicine al modello di punta Opus 4.8 a un prezzo inferiore — abbastanza economico da far girare agenti autonomi su scala di produzione. Per i team, lo spostamento interessante non è il benchmark; sono i costi unitari.

Il lancio è un segnale chiaro che la capacità agentica sta diventando un requisito di base e che la concorrenza tra i fornitori di IA si sta spostando da «il modello sa farlo» a «quanto a buon mercato può farlo su larga scala». È esattamente l'asse che decide se una funzionalità IA viene rilasciata o muore in un foglio di calcolo.

Cosa ha rilasciato davvero Anthropic

Claude Sonnet 5 è la novità più recente nella linea di modelli Anthropic e si colloca nel segmento di taglia media, sotto il modello di punta Opus 4.8. Anthropic lo definisce «il modello Sonnet più agentico finora»: può costruire piani in più fasi, guidare strumenti come browser e terminali e continuare a lavorare in autonomia su un compito dove i modelli Sonnet precedenti si sarebbero fermati. In un test di terze parti citato al lancio, il modello ha aggiornato i livelli di account in un CRM e inviato un annuncio di lancio dall'inizio alla fine senza assistenza.

È inoltre diventato il modello predefinito per i piani Free e Pro di Claude ed è disponibile per gli utenti Max, Team ed Enterprise e tramite API come claude-sonnet-5. Per i team che fanno sviluppo di agenti seriamente, la disponibilità conta meno del posizionamento: Anthropic spinge un comportamento agentico vicino a quello di punta proprio nella fascia di prezzo in cui la maggior parte delle aziende distribuisce realmente su larga scala.

Quanto è più economico?

Il numero che conta è il prezzo dei token, e Anthropic ha lanciato con uno sconto introduttivo. Fino al 31 agosto 2026 l'API costa 2 dollari per milione di token in input e 10 dollari per milione di token in output; successivamente il prezzo standard sale a 3 e 15 dollari. La copertura indipendente colloca Sonnet 5 al di sotto di Opus 4.8, del GPT-5.5 di OpenAI e del Gemini 3.1 Pro di Google in termini di prezzo, pur restando più caro di una fascia leggera come Gemini 3.5 Flash.

Prezzo API di Claude Sonnet 5Input (per 1 mln di token)Output (per 1 mln di token)
Introduttivo (fino al 31 ago 2026)2 $10 $
Standard (dal 1° set 2026)3 $15 $

Una precisazione onesta da segnalare a chiunque costruisca un budget: la tariffa introduttiva è temporanea. Alcuni osservatori hanno notato che mantenere lo stesso prezzo nominale dei token alla chiusura della finestra promozionale equivale di fatto a un aumento del 50% da settembre. Se il vostro agente gira in continuazione, modellate la tariffa standard di 3 $/15 $ per tutto ciò che va oltre agosto — non il prezzo di lancio — altrimenti il primo mese del nuovo trimestre sarà una brutta sorpresa.

È abbastanza buono per gli agenti?

Vicino, ma leggete i numeri con onestà. Sulle valutazioni di lavoro di conoscenza Anthropic dichiara che Sonnet 5 supera leggermente Opus 4.8, e sul benchmark di uso del computer OSWorld-Verified ha registrato il 78,5%. Sul coding agentico più difficile, misurato da SWE-bench Pro, ha ottenuto il 63,2% — un vero balzo rispetto a Sonnet 4.6 (58,1%), ma ancora dietro Opus 4.8 (69,2%). La conclusione non è «Sonnet 5 batte il modello di punta». È «un modello di taglia media ora arriva a pochi punti dal modello di punta sul lavoro che gli agenti fanno davvero».

BenchmarkSonnet 5Sonnet 4.6Opus 4.8
SWE-bench Pro (coding agentico)63,2%58,1%69,2%
OSWorld-Verified (uso del computer)78,5%
Lavoro di conoscenza (Anthropic)Sonnet 5 riportato leggermente davanti a Opus 4.8

Per la maggior parte degli agenti in produzione, «a pochi punti di distanza, a un terzo del prezzo» è esattamente il compromesso che ogni responsabile di ingegneria cerca. Il modello di punta si guadagna ancora il suo costo sul ragionamento e sul coding più difficili; un modello di taglia media si guadagna il suo sui novanta e più per cento di passi che sono di routine.

Cosa significa per i team software US e UE

Tolto il teatro del lancio del modello, Sonnet 5 è un'affermazione sui costi unitari. Un agente IA non è una chiamata al modello; sono decine — pianificazione, chiamate a strumenti, nuovi tentativi, verifica — per un solo compito completato. Questo effetto a ventaglio è il motivo per cui di solito è il prezzo dei token, non la capacità di picco, a decidere se un'automazione vale la pena di essere rilasciata. Abbassate il costo per token di una qualità vicina a quella di punta e spostate la linea di pareggio: workflow classificati come «troppo costosi da eseguire in autonomia» d'improvviso tornano sostenibili.

I team che colgono questo sono quelli che smettono di chiedersi «quale modello è il migliore» e iniziano a costruire il routing dei modelli — modelli economici per i passi di routine, uno di punta riservato a quelli difficili, con costo e qualità misurati per compito. È anche il livello in cui l'integrazione della GenAI in un prodotto esistente vive o muore: il guadagno è architetturale, non un semplice scambio di API. Gli acquirenti regolamentati lo avvertono per primi. Un'operazione FinTech o HealthTech che esegue molti agenti per cliente si preoccupa del costo per esecuzione e della governance dei dati molto prima di un'app consumer a basso volume — e un'inferenza più economica non fa che aumentare la pressione a impostare bene routing, logging e conformità.

Anche nella buona notizia c'è una trappola. Token più economici invogliano a lanciare un agente su tutto, e un agente mal delimitato che entra in loop, ritenta e chiama strumenti senza guardrail può bruciare i risparmi e oltre. La disciplina che conta è la stessa di sempre: delimitare bene il compito, mettere a budget l'esecuzione, valutare sui propri dati e strumentare il costo. Il modello è diventato più economico; l'ingegneria sciatta no.

Come agire già questo trimestre

Ecco la versione operativa. Trattate il lancio come uno stimolo a rivedere il vostro modello di costi IA, non come un motivo per riscrivere tutto.

  1. Rieseguite le vostre valutazioni. I benchmark pubblicizzati sono un punto di partenza, non un verdetto. Testate Sonnet 5 su compiti rappresentativi del vostro prodotto prima di instradarvi traffico reale.
  2. Progettate il routing dei modelli. Inviate i passi di routine e ad alto volume al modello di taglia media ed escalate solo quelli difficili verso uno di punta. Misurate qualità e costo per compito completato, non per chiamata.
  3. Mettete a budget il 1° settembre. Modellate la spesa alla tariffa standard di 3 $/15 $ per tutto ciò che gira oltre il 31 agosto 2026, così la fine della finestra introduttiva sia una voce di bilancio e non una sorpresa.
  4. Aggiungete guardrail di costo. Ponete un tetto a token e chiamate a strumenti per esecuzione, allertate sui loop fuori controllo e registrate la spesa per funzionalità. Un'inferenza più economica rende gli agenti fuori controllo più economici da ignorare, il che è un rischio a sé.
  5. Verificate la governance dei dati. Prima di inviare dati regolamentati o personali a un modello ospitato, confermate dove vengono trattati e a quali condizioni — il costo non prevale mai su GDPR, HIPAA o EU AI Act.
  6. Assegnate un responsabile. Fasce e prezzi dei modelli ora cambiano ogni poche settimane. Nominate qualcuno che li segua e rifaccia i benchmark su base pianificata anziché a sensazione.

Niente di tutto ciò è consulenza finanziaria o legale, e l'economia esatta dipende dal vostro carico di lavoro e dagli acquirenti che servite. Ma il segnale strategico è già chiaro: l'IA vicina a quella di punta sta diventando abbastanza economica da girare in produzione, e il vantaggio si sposta verso i team che progettano per costo e routing — non verso chi adotta per primo il modello più recente.

Domande frequenti

Che cos'è Claude Sonnet 5?

Claude Sonnet 5 è un modello di IA di taglia media che Anthropic ha rilasciato il 30 giugno 2026. È descritto come il modello Sonnet più agentico finora — capace di pianificare, usare strumenti come browser e terminali e lavorare in autonomia — ed è diventato il modello predefinito per gli utenti di Claude Free e Pro, disponibile anche nei piani Max, Team ed Enterprise e tramite API.

Quanto costa Claude Sonnet 5?

La tariffa API introduttiva è di 2 dollari per milione di token in input e 10 dollari per milione di token in output fino al 31 agosto 2026. Successivamente la tariffa standard sale a 3 dollari per milione in input e 15 dollari per milione in output. Mettete a budget la tariffa standard per tutto ciò che gira oltre la fine di agosto.

Claude Sonnet 5 è migliore di Opus 4.8?

Dipende dal compito. Anthropic riferisce prestazioni vicine a Opus 4.8 e leggermente superiori su alcuni lavori di conoscenza, a un prezzo inferiore. Sul benchmark di coding agentico SWE-bench Pro Sonnet 5 ha ottenuto il 63,2% contro il 69,2% di Opus 4.8, quindi il modello di punta resta in testa sul coding più difficile. Sonnet 5 colma gran parte del divario a una frazione del costo.

Perché un modello di IA più economico conta per costruire agenti?

Gli agenti fanno molte chiamate al modello per compito, quindi il costo dei token spesso decide se un'automazione viene rilasciata. Un modello di taglia media con qualità vicina a quella di punta a un prezzo inferiore sposta il punto di pareggio e rende sostenibili workflow autonomi ad alto volume che prima erano troppo costosi da eseguire.

Cosa dovrebbero fare i team prima di passare a Claude Sonnet 5?

Eseguite la vostra valutazione su compiti rappresentativi, aggiungete guardrail di costo per esecuzione e impostate il routing dei modelli così che i modelli più economici gestiscano i passi di routine e uno di punta gestisca quelli difficili. Pianificate lo scalino di prezzo del 31 agosto 2026 e confermate gli obblighi di trattamento dati e conformità prima di inviare dati regolamentati a qualsiasi modello ospitato.

Fonti

Anthropic — Introducing Claude Sonnet 5, 30 giugno 2026 (fonte primaria)
TechCrunch — Anthropic launches Claude Sonnet 5 as a cheaper way to run agents, 30 giugno 2026
IT Pro — Anthropic touts new Claude Sonnet 5 model range at lower prices, luglio 2026