La risposta breve
La spesa in infrastruttura cloud ha raggiunto un record di 143,4 miliardi di dollari nel Q2 2026, crescendo del 43% su base annua — il ritmo più rapido in otto anni —, con l'IA generativa come motore principale. Synergy Research Group ha pubblicato la cifra a fine luglio 2026; è l'undicesimo trimestre consecutivo di crescita in accelerazione, periodo in cui il mercato è all'incirca raddoppiato. I servizi cloud specifici per l'IA sono cresciuti di circa il 165%, mentre il più ampio mercato pubblico IaaS e PaaS cresceva del 47%.
Per i team che costruiscono e gestiscono software, il titolo non è il numero-trofeo — è ciò che un mercato con offerta vincolata e guidato dall'IA fa alla vostra bolletta e alla vostra architettura. Quando la domanda cloud cresce così in fretta, la capacità è scarsa, le voci di IA dominano l'aumento dei costi, e un'economia cloud e DevOps disciplinata smette di essere opzionale. I team che vincono l'anno che viene trattano il costo del cloud come un input di progetto, non come una sorpresa mensile.
Cosa dicono i numeri del Q2
Synergy Research Group ha quantificato la spesa mondiale delle imprese in servizi di infrastruttura cloud in 143,4 miliardi di dollari nel secondo trimestre del 2026 — un aumento di oltre 43 miliardi rispetto allo stesso trimestre di un anno prima, ossia il 43% di crescita anno su anno. È il tasso di crescita annuale più alto che il mercato abbia registrato in otto anni, e non è un picco isolato: è stato l'undicesimo trimestre successivo in cui il tasso di crescita anno su anno saliva, una serie abbastanza lunga da far all'incirca raddoppiare le dimensioni del mercato nel periodo.
Sotto la riga principale, conta il mix. L'infrastructure-as-a-service e la platform-as-a-service pubbliche — il calcolo grezzo, lo storage e le piattaforme gestite su cui la maggior parte dei team costruisce davvero — sono cresciute del 47% nel trimestre. E i servizi cloud specifici per l'IA sono cresciuti molto più rapidamente di tutto il resto, di circa il 165% su base annua. Sommando gli ultimi dodici mesi, il mercato si attesta ora su un ritmo annuale di circa 500 miliardi di dollari. Nelle parole del capo analista di Synergy John Dinsdale: «La tecnologia dell'IA ha acceso un fuoco sotto il mercato del cloud e sta ora trainando una crescita senza precedenti.»
Perché l'IA piega la curva
La crescita del cloud era stata costante per anni; ciò che è cambiato è il passaggio dell'IA generativa dall'esperimento alla produzione. L'addestramento e, sempre più, l'inferenza sono enormi consumatori di calcolo basato su GPU, e quasi tutto gira nel data center di qualcun altro. Una singola azienda che allestisce un assistente rivolto ai clienti, un sistema di retrieval sui propri dati o un workflow agentico può aggiungere una voce cloud che eclissa la sua impronta precedente. Moltiplicatelo per ogni impresa che fa la stessa cosa nello stesso momento e ottenete un'impennata del 165% dei servizi specifici per l'IA che trascina l'intero mercato verso l'alto.
Ecco perché la crescita si concentra esattamente sui servizi su cui si appoggiano i carichi IA, ML e dati — calcolo accelerato, piattaforme vettoriali e analitiche, hosting di modelli e endpoint di inferenza. La conseguenza pratica è che la parte della bolletta cloud che cresce più rapidamente è ora la parte di IA, ed è quella che con più probabilità viene approvvigionata in fretta, senza gli sconti da capacità riservata e la pianificazione delle quote che ottengono i carichi maturi. La velocità di adozione, in altre parole, supera la disciplina di costo.
I tre grandi e il tetto di capacità
A dispetto di tutta la crescita, la forma del mercato in cima è stabile. Nel Q2 2026 Amazon Web Services deteneva circa il 28% del mercato, Microsoft Azure circa il 20% e Google Cloud circa il 15% — all'incirca due terzi di tutta la spesa tra loro. Questa quota si è mossa a malapena perché tutti e tre crescono in fretta; il vincolo per gli hyperscaler oggi riguarda meno la concorrenza e più la rapidità con cui possono portare online capacità di data center, energia e GPU adatte all'IA.
Quel tetto di capacità è la parte che i team sentono direttamente. Si manifesta come tipi di istanza GPU difficili da ottenere nella regione preferita, richieste di quota che richiedono più tempo per l'approvazione, e impegni di capacità riservata che diventano il prezzo della disponibilità garantita anziché un semplice sconto. Quando un mercato cresce del 43% l'anno e l'offerta è il collo di bottiglia, il cliente che ha pianificato la propria capacità si trova in una posizione ben diversa da chi ha dato per scontato che il cloud fosse infinito e istantaneo.
Cosa significa per i team in Italia & nell'UE
La lettura strategica è che il costo del cloud è passato da una riga finanziaria a una disciplina ingegneristica. Quando la quota di IA della vostra bolletta può crescere a tre cifre in un anno, i costi unitari — costo per richiesta, per utente, per token generato — diventano una metrica di prodotto che monitorate da vicino quanto la latenza. I team che rilasciano funzionalità di IA senza un modello di costo firmano di fatto un contratto a tempo indeterminato, e ciò emerge più come un trimestre sgradevole che come una decisione di progetto. Il rimedio è noioso e affidabile: strumentare la spesa per carico, definire budget e allarmi prima di scalare, e trattare un percorso di inferenza costoso come un bug da ottimizzare, non come un costo del fare impresa.
C'è anche un tema di resilienza. Un mercato con offerta vincolata gestito da tre fornitori è un mercato in cui un cambio di prezzo o una carenza regionale di capacità può presentarsi sulla vostra roadmap senza preavviso. Non è un argomento a favore di un multi-cloud riflesso — far girare tutto in doppio di solito costa più di quanto faccia risparmiare — ma della portabilità by design: carichi containerizzati, infrastructure-as-code e un livello del modello astratto così che l'inferenza possa cambiare fornitore all'occorrenza. Per i settori regolati come la FinTech e la sanità, questa stessa portabilità sostiene le aspettative di residenza dei dati, di conformità al GDPR (sotto l'occhio del Garante) e di rischio di concentrazione nell'ambito di quadri come DORA, che sempre più chiedono se una dipendenza critica da un solo cloud disponga di una via d'uscita credibile. Prevederlo ora costa molto meno che adattarlo durante un incidente.
Come agire
Non serve un team FinOps dedicato per anticipare tutto questo. Serve rendere costo e capacità input di primo ordine nel vostro modo di costruire.
- Strumentare la spesa per carico. Etichettare e attribuire il costo cloud a team e funzionalità così che le voci di IA siano visibili, non sepolte in una bolletta condivisa.
- Mettere guardrail all'IA prima di scalare. Definire budget, quote e allarmi su hosting di modelli ed endpoint di inferenza; conoscere il costo per richiesta prima che il traffico cresca, non dopo.
- Pianificare la capacità, non darla per scontata. Riservare o impegnare capacità per i carichi prevedibili e richiedere le quote GPU per tempo — trattare le istanze adatte all'IA come scarse, perché lo sono.
- Progettare per la portabilità. Containerizzare, gestire l'infrastruttura come codice e astrarre il livello del modello così da poter spostare l'inferenza tra fornitori sotto pressione di prezzo o capacità.
- Ridimensionare in continuo. Rivedere tipi di istanza, livelli di storage e risorse inattive su base pianificata; la bolletta che cresce più in fretta è anche dove si nascondono i risparmi più facili.
- Mappare il rischio di concentrazione. Documentare cosa si rompe se il fornitore principale alza i prezzi o resta a corto di capacità, e dare ai carichi critici una via d'uscita credibile.
Nulla di questo è consulenza finanziaria, e quanto lavoro comporti dipende da quanta parte della vostra infrastruttura già usa l'IA. Ma il segnale strategico del Q2 è chiaro: il cloud cresce più in fretta di quanto abbia fatto in quasi un decennio, l'IA ne è la ragione, e i team che trattano costo e capacità come vincoli di progetto — anziché dare per scontato che il cloud sia economico, infinito e istantaneo — sono quelli che scaleranno senza brutte sorprese.
Domande frequenti
Quanto è grande il mercato dell'infrastruttura cloud nel 2026?
La spesa mondiale delle imprese in servizi di infrastruttura cloud ha raggiunto 143,4 miliardi di dollari nel secondo trimestre del 2026, secondo Synergy Research Group. È un aumento del 43% su base annua — la crescita più rapida in otto anni — e l'undicesimo trimestre consecutivo di crescita in accelerazione, periodo in cui il mercato è all'incirca raddoppiato. I ricavi degli ultimi dodici mesi ammontano a circa 500 miliardi di dollari.
Cosa sta trainando la crescita record del cloud nel 2026?
L'IA generativa è il motore principale. Synergy riferisce che i servizi cloud specifici per l'IA sono cresciuti di circa il 165% su base annua nel Q2 2026, superando di gran lunga il mercato complessivo, mentre le piattaforme pubbliche IaaS e PaaS crescevano del 47%. Come ha detto John Dinsdale, capo analista di Synergy, la tecnologia dell'IA ha acceso un fuoco sotto il mercato del cloud e sta ora trainando una crescita senza precedenti. La domanda di GPU, hosting di modelli e inferenza tira verso l'alto l'intero consumo cloud.
Chi guida il mercato del cloud nel Q2 2026?
I tre grandi hyperscaler dominano ancora. Nel Q2 2026 Amazon Web Services deteneva circa il 28% del mercato, Microsoft Azure circa il 20% e Google Cloud circa il 15% — insieme circa il 67%. La loro quota è rimasta sostanzialmente stabile pur crescendo il mercato, perché tutti e tre si espandono rapidamente e sono limitati soprattutto dalla velocità con cui portano online capacità di data center adatta all'IA.
Cosa significa l'aumento della spesa cloud per i budget dei team?
Un mercato che cresce del 43% l'anno spinto dalla domanda di IA significa capacità tesa, e le voci cloud legate all'IA sono la parte della bolletta che cresce più rapidamente. Per i team questo vuol dire che il costo del cloud è ora una preoccupazione ingegneristica di primo piano, non un dettaglio finanziario: mettete a budget la scarsità di GPU e inferenza, ponete guardrail FinOps attorno ai carichi di IA prima di scalarli, e progettate per la portabilità così che prezzi o limiti di capacità di un singolo fornitore non dettino la vostra roadmap.
Conviene passare al multi-cloud a causa dei vincoli di capacità?
Non automaticamente. Il multi-cloud aggiunge un reale sovraccarico operativo e raramente ripaga come strategia generalizzata. La via di mezzo pragmatica è la portabilità by design — carichi containerizzati, infrastructure-as-code e astrazione del livello del modello di IA per poter spostare l'inferenza tra fornitori —, insieme a capacità riservata o impegnata per i carichi prevedibili. Questo dà leva contro gli aumenti di prezzo e le carenze regionali di capacità senza far girare tutto in doppio.
Fonti
Synergy Research Group — Q2 Cloud Market Passes $143 Billion; Highest Growth Rate in Eight Years (fonte primaria)
The Register — Enterprise cloud infrastructure uptake shows no sign of slowing
IT Pro — Cloud infrastructure spending just hit an eight-year high