HomeArtificial IntelligenceAI GovernanceREPORT – Il prezzo dell'intelligenza: scarsità di potenza di calcolo per l'IA,...

REPORT – Il prezzo dell’intelligenza: scarsità di potenza di calcolo per l’IA, inflazione dell’hardware e il crescente divario globale nell’accesso

Introduzione — Dal servizio digitale universale alla capacità di calcolo razionata

Riassunto principale

L’intelligenza artificiale viene spesso presentata come una tecnologia software infinitamente replicabile, eppure ogni risultato economicamente utile dipende da un sistema fisico finito e insolitamente concentrato: fabbricazione di semiconduttori all’avanguardia, packaging avanzato, memorie ad alta larghezza di banda , acceleratori, apparecchiature di rete, capacità dei data center, elettricità, infrastrutture di raffreddamento e manodopera ingegneristica specializzata. Il mercato risultante non può essere valutato solo in base ai prezzi degli abbonamenti dei consumatori. La sua vera struttura inizia a monte, dove barriere tecniche e finanziarie limitano il numero di aziende in grado di produrre i componenti più avanzati, e continua a valle, dove un piccolo gruppo di hyperscaler e sviluppatori di modelli determina quali utenti hanno accesso, a quale livello di prestazioni, con quale latenza, finestra di contesto, garanzie di privacy e limitazioni contrattuali. Le prove disponibili nell’agosto 2026 confermano una straordinaria espansione della domanda e degli investimenti, ma non dimostrano ancora che la scarsità sia stata creata artificialmente o che si siano verificate pratiche di prezzo illecite. NVIDIA ha riportato un fatturato di 215,9 miliardi di dollari per l’anno fiscale 2026 , con un aumento del 65%, e un margine lordo GAAP del 71,1% ; nel trimestre conclusosi il 26 aprile 2026, il fatturato del segmento Data Center ha raggiunto i 75,2 miliardi di dollari , il 92% in più rispetto allo stesso periodo dell’anno precedente. Questi risultati dimostrano un’eccezionale capacità di generare valore in un segmento tecnologico caratterizzato da un’offerta limitata, ma i margini e la crescita del fatturato devono essere successivamente scomposti in rendite da innovazione, rendimenti da proprietà intellettuale, rendite da scarsità, effetti del mix di prodotti e possibile potere di mercato. NVIDIA annuncia i risultati finanziari per il quarto trimestre e l’anno fiscale 2026 – NVIDIA – febbraio 2026 NVIDIA annuncia i risultati finanziari per il primo trimestre dell’anno fiscale 2027 – NVIDIA – maggio 2026

Il vincolo a monte non è riconducibile alla progettazione delle GPU. Gli acceleratori AI richiedono logica all’avanguardia, grandi quantità di HBM , interposer complessi e tecnologie di packaging avanzate in grado di connettere i die logici con più stack di memoria a una larghezza di banda estrema. TSMC ha riferito che la capacità annuale degli impianti gestiti dall’azienda e dalle sue filiali ha superato i 17 milioni di wafer equivalenti a 12 pollici nel 2025 , mentre la sua trascrizione ufficiale per gli investitori del primo trimestre 2025 affermava che l’azienda stava lavorando per raddoppiare la capacità CoWoS durante quell’anno in risposta alla domanda dei clienti. TSMC ha inoltre annunciato separatamente che un’implementazione CoWoS di dimensioni 9,5 reticle, prevista per la produzione di massa nel 2027, è pensata per integrare dodici o più stack HBM in un unico package. Queste rivelazioni dimostrano come le prestazioni dell’IA di frontiera dipendano sempre più dalla co-ottimizzazione tra fabbricazione, memoria e packaging, piuttosto che da un singolo processore. Di conseguenza, i produttori di memorie stanno spostando gli investimenti verso prodotti di intelligenza artificiale a maggior valore aggiunto: Micron ha previsto nel dicembre 2025 che il mercato potenziale totale delle memorie HBM potrebbe aumentare da circa 35 miliardi di dollari nel 2025 a circa 100 miliardi di dollari nel 2028 , mentre Samsung ha annunciato l’intenzione di investire oltre 110 trilioni di won coreani in impianti e ricerca e sviluppo nel corso del 2026, includendo esplicitamente HBM, produzione in fonderia e packaging avanzato. Queste cifre dimostrano una forte domanda e una rapida formazione di capacità, ma non dimostrano di per sé una scarsità permanente. Il problema analitico centrale di questo rapporto sarà quindi quello di stabilire se l’aumento della capacità di fabbricazione, packaging e memoria possa superare la crescita combinata di training, inferenza, servizi multimodali, carichi di lavoro agentici e programmi nazionali di calcolo sovrano. Relazione annuale TSMC 2025 – Taiwan Semiconductor Manufacturing Company – Aprile 2026 Trascrizione della conferenza sugli utili del primo trimestre 2025 di TSMC – Taiwan Semiconductor Manufacturing Company – Aprile 2025 TSMC presenta il processo A14 di nuova generazione al North America Technology Symposium – Taiwan Semiconductor Manufacturing Company – Aprile 2025 Risultati finanziari del primo trimestre fiscale 2026 di Micron – Micron Technology – Dicembre 2025 Piano di miglioramento del valore per gli azionisti di Samsung Electronics – Samsung Electronics – Marzo 2026

Il ciclo degli investimenti a valle indica che l’accesso apparentemente economico odierno a modelli potenti non può essere automaticamente considerato un equilibrio stabile a lungo termine. Alphabet ha riportato spese in conto capitale per 91,4 miliardi di dollari nel 2025, rispetto ai 52,5 miliardi di dollari del 2024, e ha dichiarato di prevedere un ulteriore aumento significativo degli investimenti in infrastrutture tecniche nel corso del 2026; le spese in conto capitale hanno raggiunto i 35,7 miliardi di dollari solo nel primo trimestre del 2026 , rispetto ai 17,2 miliardi di dollari del corrispondente periodo del 2025. Questo investimento non dimostra che i prezzi per i consumatori o per le API debbano necessariamente aumentare, poiché un maggiore utilizzo, l’efficienza algoritmica, la compressione dei modelli, gli acceleratori personalizzati e la concorrenza possono ridurre i costi unitari. Stabilisce, tuttavia, che i servizi di intelligenza artificiale sono supportati da una base di capitale i cui costi di ammortamento, finanziamento, elettricità, rete e sostituzione devono essere recuperati, in ultima analisi, tramite pubblicità, abbonamenti, fatturazione API, contratti aziendali o sovvenzioni incrociate. L’energia sta diventando un vincolo parallelo. L’ Agenzia Internazionale dell’Energia (IEA) prevede un consumo globale di elettricità per i data center di circa 945 TWh nel 2030 , più del doppio del livello attuale rappresentato nello scenario di base e poco meno del 3% del consumo globale di elettricità previsto. L’IEA stima inoltre una crescita media della domanda di elettricità per i data center di circa il 15% annuo tra il 2024 e il 2030, mentre le strutture ottimizzate per l’intelligenza artificiale rappresentano il principale fattore di incremento. Il rapporto deve quindi modellare non solo un prezzo per token, ma una tariffa multidimensionale in cui la capacità del modello, la lunghezza di input e output, l’intensità di ragionamento, la latenza, la capacità riservata, la posizione geografica, la disponibilità di energia e i requisiti di privacy diventano determinanti di prezzo separati. L’analogia con Bitcoin sarà messa alla prova piuttosto che accettata: la potenza di calcolo può essere scarsa e avere un prezzo dinamico, ma a differenza di Bitcoin è eterogenea, deprezzabile, geograficamente limitata, continuamente producibile e consumata nell’erogazione di un servizio. Relazione annuale di Alphabet sul modulo 10-K per l’anno fiscale terminato il 31 dicembre 2025 – Alphabet e US Securities and Exchange Commission – febbraio 2026 Relazione trimestrale di Alphabet sul modulo 10-Q per il trimestre terminato il 31 marzo 2026 – Alphabet e US Securities and Exchange Commission – aprile 2026 Energia e IA: domanda di energia derivante dall’IA – Agenzia internazionale dell’energia – aprile 2025

Per famiglie, studenti, ricercatori e organizzazioni di piccole dimensioni, la differenza decisiva non sta nel possedere o meno un accesso nominale all’IA, ma tra diversi livelli di capacità computazionale ponderata in base alla qualità. Una workstation usata può eseguire un modello quantizzato localmente, ma risultare comunque inadeguata per contesti lunghi, elaborazione multimodale, elevata concorrenza, generazione rapida o carichi di lavoro scientifici specializzati. La RTX 3090 , introdotta a un prezzo di partenza di 1.499 dollari , contiene 24 GB di memoria GDDR6X ; questa quantità rimane utile per carichi di lavoro locali definiti, ma impone un limite rigido alla memoria prima ancora di considerare l’overhead del software, la cache di contesto e l’inferenza concorrente. Un Mac Studio del 2025 con M4 Max può essere configurato con 128 GB di memoria unificata , consentendo un limite teorico di memoria per il modello molto più ampio, sebbene la capacità di memoria unificata non debba essere equiparata alle prestazioni dell’acceleratore NVIDIA, alla compatibilità del software o alla velocità di elaborazione effettiva delle applicazioni. Specifiche della famiglia GeForce RTX 3090 – NVIDIA – Settembre 2020 Specifiche tecniche di Mac Studio 2025 – Apple – Marzo 2025 Il problema della distribuzione internazionale inizia ancora prima: l’ Unione Internazionale delle Telecomunicazioni ha stimato che il 94% delle persone nei paesi ad alto reddito utilizzava Internet nel 2025, rispetto a solo il 23% nelle economie a basso reddito, mentre 2,2 miliardi di persone rimanevano offline. L’IA avanzata arriva quindi in aggiunta a un divario irrisolto in termini di connettività, accessibilità economica, elettricità, dispositivi e competenze. Misurare lo sviluppo digitale: fatti e cifre 2025 – Unione Internazionale delle Telecomunicazioni – Novembre 2025 La risposta dell’Europa illustra la portata strategica del problema: la Commissione europea ha lanciato un bando nel luglio 2026 volto a istituire ben sette Gigafabbriche di IA e sbloccare più di 30 miliardi di euro , mentre la sua architettura definisce tali strutture come infrastrutture che riuniscono più di 100.000 processori di IA avanzati . L’UE lancia un bando per le gigafabbriche di IA per potenziare la capacità di calcolo europea e sbloccare oltre 30 miliardi di euro – Commissione europea – luglio 2026 Fabbriche di IA – Commissione europea – luglio 2026 L’indagine quinquennale determinerà se questo investimento amplierà l’accesso o si limiterà a delocalizzare la capacità concentrata, e se l’IA diventerà un fattore di livellamento della produttività, un servizio industriale a consumo o un meccanismo cumulativo attraverso il quale gli utenti con grandi capitali acquisiranno un vantaggio cognitivo ed economico duraturo.

Ai Compute Access Dashboard
Integrated evidence model · 2026–2031

AI compute, affordability and access

Navigate the ten analytical layers, stress-test five scenarios and change policy intensity without converting estimates into observed facts.

Current classification
HIGH
Upward risk toward severe
Enterprise AI expenditure
300
Index, 2026 = 100
Quality-adjusted API price
32
Index, 2026 = 100
Global AI Access Gini
0.215
Central 2031 estimate
Inference demand
1,100
Index, 2026 = 100

Annual trajectory

Central, low and high paths

Selected scenarioLow referenceHigh reference
Select a point for its exact value.

Critical focal points and falsification thresholds

The classification uses the highest persistent risk dimension corroborated by at least one additional dimension.

Access Gini
0.215
Affordability
8.0%
Capability gap
28 pp
Lead time
11 mo

Evidence integrity ledger

FindingStatusConfidenceInterpretive constraint
Units: indexes use 2026 = 100; Gini is a 0–1 coefficient; affordability is annual adequate-access cost as a share of exposed-group disposable resources. Forecast values are scenario estimates, not observed facts.

Il prezzo dell’intelligenza: come l’informatica sta diventando la nuova infrastruttura del potere economico.

L’intelligenza artificiale non è più principalmente una competizione tra algoritmi. È una competizione per l’accesso ad acceleratori, memorie ad alta larghezza di banda, packaging avanzato, elettricità, data center e al capitale necessario per assemblarli in sistemi utilizzabili. La disuguaglianza decisiva si sta quindi spostando dalla connettività internet alla capacità di calcolo: chi può addestrare, adattare e gestire modelli avanzati; chi deve noleggiare tale capacità; e chi rimane confinato a sistemi più deboli. Questa transizione ha conseguenze sulla produttività industriale, la sovranità scientifica, l’istruzione, la difesa e la distribuzione del potere economico. L’Europa ha iniziato a elaborare una risposta pubblica, ma la questione strategica rimane irrisolta: se il calcolo per l’IA si svilupperà come un’infrastruttura ampiamente accessibile o come un servizio scarso, controllato verticalmente, il cui prezzo e la cui disponibilità sono determinati da un piccolo gruppo di fornitori di tecnologia.

Il nuovo input economico

La potenza di calcolo non può essere semplicemente classificata come un altro fattore produttivo industriale. È al contempo un bene capitale, un servizio a consumo, una componente di infrastrutture critiche e uno strumento di influenza geopolitica. Il suo valore economico dipende non solo dalla velocità di elaborazione del processore, ma anche dalla memoria dell’acceleratore, dalla larghezza di banda, dalle interconnessioni, dalla compatibilità del software, dall’elettricità, dal raffreddamento, dalla latenza di rete e dal suo utilizzo. Un acceleratore nominalmente potente, ma privo di memoria o supporto software adeguati, può risultare economicamente inferiore a un sistema più lento in grado di completare il carico di lavoro richiesto in modo affidabile.

Questa distinzione è essenziale quando si valutano le affermazioni sull’inflazione dell’hardware. I soli prezzi di listino non bastano a stabilire se le capacità dell’IA siano diventate più costose. Un confronto valido deve determinare il costo di completamento dello stesso carico di lavoro con requisiti equivalenti in termini di accuratezza, lunghezza del contesto, latenza, concorrenza, privacy e affidabilità. I ​​miglioramenti dei semiconduttori possono ridurre il costo di un’operazione aritmetica, mentre il costo totale di implementazione di un modello utile aumenta perché il carico di lavoro richiede più memoria, più energia, personale specializzato o un cluster più grande.

Il risultato è un apparente paradosso: la potenza di calcolo complessiva può diventare più abbondante, mentre la potenza di calcolo strategicamente utile rimane scarsa. La scarsità diventa particolarmente acuta quando le organizzazioni richiedono prestazioni di livello all’avanguardia, gestione sovrana dei dati, capacità garantita o operatività locale. Per uno studente, un ricercatore indipendente o una PMI, l’ostacolo rilevante non è se un piccolo modello possa tecnicamente essere eseguito su un computer, ma se quel sistema sia in grado di produrre un lavoro competitivo entro limiti accettabili di tempo, qualità e affidabilità.

Adozione senza pari accesso

Le imprese europee stanno già affrontando questa transizione partendo da posizioni di netto disuguaglianza. Secondo Eurostat, nel 2025 il 19,95% delle imprese dell’UE con almeno dieci dipendenti utilizzava una o più tecnologie di intelligenza artificiale , mentre la percentuale corrispondente tra le grandi imprese raggiungeva il 55,03% . Utilizzo dell’intelligenza artificiale nelle imprese – Eurostat – 2025 — pubblicazione statistica ufficiale .

Questa disparità è rilevante perché l’adozione dell’IA è cumulativa. Le organizzazioni con dati, ingegneri, accordi cloud e budget per l’integrazione possono testare più applicazioni, formare i dipendenti, creare flussi di lavoro proprietari e imparare dagli errori. Le organizzazioni più piccole devono invece sostenere i costi di licenze, sicurezza informatica, conformità, preparazione dei dati, integrazione e supervisione umana prima che i guadagni in termini di produttività siano certi. Di conseguenza, l’IA può diventare di fatto un input obbligatorio: le aziende potrebbero essere costrette ad acquistarla perché i concorrenti la utilizzano, anche quando il loro ritorno sull’investimento rimane difficile da misurare.

Questo crea un’asimmetria strutturale. Le grandi aziende possono negoziare prenotazioni di capacità, diversificare i fornitori e finanziare le infrastrutture locali. Le PMI, invece, acquistano spesso l’accesso al dettaglio tramite contratti standard e sostengono costi di cambio fornitore più elevati rispetto al fatturato. Se le capacità del modello, la latenza e la priorità di accesso saranno sempre più differenziate in base al prezzo, il mercato non si limiterà a dividere gli utenti in abbonati e non abbonati, ma li dividerà in base alla qualità, alla velocità, al contesto e all’affidabilità delle informazioni che possono permettersi.

La risposta infrastrutturale dell’Europa

Il Piano d’azione per il continente dell’IA della Commissione europea , presentato il 9 aprile 2025 , ha posto le infrastrutture fisiche al centro delle politiche europee. La Commissione ha individuato 200 miliardi di euro da mobilitare per investimenti nell’IA, di cui 20 miliardi destinati a finanziare fino a cinque gigafactory per l’IA. Ha inoltre individuato una rete di 19 fabbriche di IA a supporto di start-up, industria e ricerca. AI Continent – ​​Commissione europea – 9 aprile 2025 — pagina ufficiale del programma .

Da allora, quella rete è stata integrata da 13 antenne AI Factory , mentre l’impresa comune europea per il calcolo ad alte prestazioni (EuroHPC) afferma che le AI Factories offrono supporto gratuito e personalizzato alle PMI e alle start-up. AI Factories – European High Performance Computing Joint Undertaking – 2026 — portale ufficiale delle infrastrutture . Il 30/07/2026 , EuroHPC ha lanciato il suo bando AI Gigafactories, definendo le strutture pianificate come ambienti integrati che combinano supercomputer ottimizzati per l’IA, data center avanzati, storage ad alta capacità, reti ad alta velocità, accesso sicuro al cloud e supporto specialistico. L’impresa comune EuroHPC lancia il bando AI Gigafactories – EuroHPC Joint Undertaking – 30/07/2026 — annuncio ufficiale del bando .

L’architettura è strategicamente corretta perché riconosce che l’acquisto di acceleratori non è sufficiente. L’Europa ha bisogno di un ecosistema operativo in grado di allocare capacità oltre confine, supportare gli utenti industriali, proteggere i dati sensibili e convertire le risorse computazionali in applicazioni implementabili. Il pericolo è la frammentazione. Le infrastrutture nazionali che non sono in grado di scambiare carichi di lavoro, utilizzare interfacce compatibili o fornire un accesso prevedibile potrebbero riprodurre a spese pubbliche lo stesso problema di dipendenza che l’Europa cerca di ridurre.

Il vincolo energetico

Anche l’infrastruttura per l’intelligenza artificiale è un’infrastruttura energetica. Il 20/12/2024 , il Dipartimento dell’Energia degli Stati Uniti ha riferito che i data center americani hanno consumato 176 terawattora di elettricità nel 2023, pari a circa il 4,4% del consumo nazionale di elettricità. La stima del Dipartimento per il 2028 era compresa tra 325 e 580 terawattora , ovvero tra il 6,7% e il 12% circa del consumo di elettricità degli Stati Uniti. DOE Releases New Report Evaluating Increase in Electricity Demand from Data Centers – United States Department of Energy – 20/12/2024 — official publication .

Questi dati non rappresentano una previsione per l’Europa, ma mettono in luce la portata concreta della sfida. Le politiche relative ai data center non possono essere separate dalla capacità di generazione, dalle reti di trasmissione, dalle sottostazioni, dai trasformatori, dall’acqua di raffreddamento, dalle autorizzazioni e dall’affidabilità dei sistemi locali. Un Paese può possedere capitali e competenze tecniche, ma non essere in grado di implementare nuove capacità di intelligenza artificiale entro tempi commercialmente utili a causa dell’indisponibilità di connessioni alla rete.

Le politiche pubbliche devono pertanto distinguere tra infrastrutture di valore sociale e costi privati ​​di congestione. I data center dovrebbero contribuire agli investimenti di rete necessari al loro carico, mentre le autorità pubbliche dovrebbero valutare la flessibilità, le emissioni, l’ubicazione e il valore economico dei carichi di lavoro. Sovvenzionare la potenza di calcolo senza finanziare il sistema elettrico che la supporta significherebbe spostare il collo di bottiglia anziché eliminarlo.

La memoria come geopolitica

La memoria ad alta larghezza di banda dimostra come un componente specializzato possa diventare sia un collo di bottiglia industriale che uno strumento di sicurezza. Il 12/02/2024 , il Bureau of Industry and Security del Dipartimento del Commercio degli Stati Uniti ha annunciato controlli che riguardano 24 tipi di apparecchiature per la produzione di semiconduttori , tre categorie di strumenti software , la memoria ad alta larghezza di banda (HBM) e 140 aggiunte alla Entity List. Il BIS ha esplicitamente descritto la HBM come fondamentale per l’addestramento e l’inferenza dell’IA su larga scala. Il Dipartimento del Commercio rafforza i controlli sulle esportazioni per limitare la capacità della Cina di produrre semiconduttori avanzati – Bureau of Industry and Security – 12/02/2024 — annuncio ufficiale .

La decisione illustra perché la potenza di calcolo non può essere considerata una merce fungibile a livello globale. La sua disponibilità dipende dalle regole di origine, dalle licenze di esportazione, dalle soglie tecniche, dalla geografia della produzione e dagli allineamenti politici. A differenza del Bitcoin, la potenza di calcolo è eterogenea, dipendente dalla posizione e soggetta a deprezzamento. La capacità inutilizzata è deperibile; l’hardware obsoleto perde valore relativo; e due sistemi nominalmente equivalenti possono produrre risultati economici diversi a causa di limitazioni di memoria, software o rete.

L’European Chips Act, entrato in vigore il 21/09/2023 , è stato concepito per rafforzare l’ecosistema dei semiconduttori dell’Unione, migliorare la resilienza della catena di approvvigionamento e ridurre la dipendenza dall’esterno. I suoi obiettivi dichiarati includono la leadership nella ricerca, la progettazione, la produzione, il packaging avanzato, la capacità produttiva e le competenze. European Chips Act – Commissione europea – 21/09/2023 — quadro politico ufficiale . La lezione strategica è che la sola produzione all’avanguardia non è sufficiente. Packaging, memorie, substrati, test, apparecchiature, software ed energia devono essere considerati come un sistema industriale interdipendente.

Il costo della dipendenza

L’intelligenza artificiale in cloud risolve un problema di accesso, ma ne crea un altro. Consente alle organizzazioni di utilizzare sistemi avanzati senza dover possedere infrastrutture costose, ma trasferisce il controllo su prezzi, capacità, continuità del modello e condizioni di elaborazione dei dati al fornitore di servizi. I fornitori possono differenziare i prezzi in base a input, output, contesto, latenza, intensità di ragionamento, utilizzo degli strumenti, capacità riservata o priorità del servizio. Questo assomiglia più a una tariffazione di tipo utility che alla vendita di software convenzionale.

Il pericolo non risiede nella misurazione in sé. La misurazione può migliorare l’efficienza e la trasparenza. Il pericolo sorge quando i clienti non possono confrontare il costo totale di carichi di lavoro equivalenti o spostare i propri dati, embedding, record di valutazione e applicazioni senza subire perdite significative. Il Regolamento europeo sulla protezione dei dati (UE) 2023/2854 è in vigore dal 12/09/2025 e stabilisce requisiti volti a facilitare il passaggio tra servizi cloud e edge e a promuovere l’interoperabilità. Spiegazione del Regolamento sulla protezione dei dati – Commissione europea – 15/12/2025 — spiegazione ufficiale .

Il prossimo passo normativo dovrebbe essere la standardizzazione della divulgazione del prezzo effettivo. I fornitori dovrebbero separare i costi di inferenza, archiviazione, recupero, rete, utilizzo degli strumenti, capacità riservata e migrazione. Gli appalti pubblici dovrebbero richiedere dati operativi esportabili, interfacce documentate, periodi di preavviso per le versioni dei modelli e procedure di uscita testate. Le autorità garanti della concorrenza, nel frattempo, dovrebbero esaminare l’auto-preferenza, l’accesso ai dati e le dipendenze dal cloud senza presumere che l’integrazione verticale sia intrinsecamente illegale. La revisione DMA della Commissione, pubblicata il 28/04/2026 , ha individuato l’interoperabilità, la potenziale auto-preferenza, l’accesso ai dati e le dipendenze dal cloud tra le questioni relative all’IA sollevate durante la consultazione. Documento di lavoro dei servizi della Commissione SWD(2026) 123 definitivo – Commissione europea – 28/04/2026 — documento ufficiale .

La divisione globale delle capacità

Il divario nell’IA inizia prima ancora di avere accesso a un acceleratore. Secondo i dati dell’Unione Internazionale delle Telecomunicazioni (ITU) pubblicati il ​​17/11/2025 , circa sei miliardi di persone erano online nel 2025, mentre 2,2 miliardi rimanevano offline. L’ITU ha stimato una copertura 5G dell’84 % della popolazione nei paesi ad alto reddito , rispetto al 4% nei paesi a basso reddito . Fatti e cifre 2025 – Unione Internazionale delle Telecomunicazioni – 17/11/2025 — comunicato ufficiale .

Il divario nell’utilizzo di Internet è altrettanto marcato. I dati dell’ITU pubblicati il ​​15/10/2025 registravano un utilizzo di Internet pari al 94% nei paesi ad alto reddito, ma solo al 23% nelle economie a basso reddito; la cifra corrispondente per l’Africa era del 36% . Fatti e cifre 2025: Utilizzo di Internet – Unione Internazionale delle Telecomunicazioni – 15/10/2025 — analisi statistica ufficiale .

L’intelligenza artificiale può abbassare le barriere traducendo le informazioni, supportando l’istruzione e distribuendo strumenti analitici sofisticati. Tuttavia, questi vantaggi presuppongono connettività, elettricità, lingue compatibili, capacità di pagamento e competenze digitali. Laddove queste basi mancano, l’avvento di modelli più potenti può ampliare la distanza produttiva tra i paesi anziché ridurla. L’obiettivo di sviluppo rilevante non è quindi la creazione di cluster di prestigio, bensì un accesso affidabile, sostenibile e a prezzi accessibili, legato alle competenze locali, alle infrastrutture regionali e alla domanda di servizi pubblici.

Un livello minimo di competenze

La risposta più efficace non è la proprietà universale dell’hardware di frontiera. È piuttosto una capacità minima garantita, combinata con un’offerta competitiva. Studenti e ricercatori dovrebbero ricevere diritti di calcolo commisurati al carico di lavoro, utilizzabili su sistemi pubblici, cloud e open-weight approvati. Le università dovrebbero centralizzare gli acquisti e pubblicare dati sull’utilizzo, sui tempi di attesa e sui costi dei carichi di lavoro completati. Le PMI dovrebbero ottenere l’accesso tramite acquisti cooperativi e la rete AI Factory. Gli istituti che tutelano la privacy dovrebbero poter scegliere tra implementazione locale, sovrana o ibrida, senza subire automaticamente una riduzione delle capacità.

Anche la durata utile dell’hardware è importante. La direttiva (UE) 2024/1799 impone agli Stati membri di applicare il quadro europeo del diritto alla riparazione a partire dal 31/07/2026 . La Commissione stabilisce che i fabbricanti dei prodotti interessati devono offrire la riparazione entro un tempo ragionevole e a un prezzo ragionevole, non possono utilizzare tecniche hardware o software per ostacolare la riparazione e devono garantire l’accesso ai pezzi di ricambio. Recepimento, entrata in vigore o applicazione della legislazione UE: tappe fondamentali – Commissione europea – 01/07/2026 — calendario ufficiale di attuazione . Estendere la durata utile dell’hardware e creare mercati affidabili per i prodotti ricondizionati può ridurre i costi di accesso senza soffocare l’innovazione nel settore dei semiconduttori.

La scelta strategica

La strategia europea per l’IA avrà successo solo se misurerà l’accesso anziché limitarsi ad annunciare la capacità. Gli indicatori decisivi non sono il numero di acceleratori installati o il valore nominale degli investimenti, bensì la quota di capacità che raggiunge le PMI, le università e gli enti pubblici; i tempi di attesa; il costo per carico di lavoro completato; il successo della migrazione; la disponibilità di energia; le prestazioni in lingua locale; e la percentuale di studenti e ricercatori in grado di utilizzare sistemi adeguati alle proprie esigenze.

Il mercato emergente non prezzerà l’intelligenza come una merce uniforme, bensì in base a un accesso differenziato alle sue capacità. La qualità del modello, la memoria, il contesto, la latenza, la privacy e la capacità garantita determineranno ciò che gli utenti potranno realizzare e quanto dovranno pagare. Se tale architettura rimarrà concentrata e difficile da contestare, l’IA amplificherà i vantaggi esistenti in termini di capitale, istruzione e geografia. Se l’Europa combinerà infrastrutture, portabilità, concorrenza, riparazione, modelli aperti e accesso mirato, la potenza di calcolo potrà invece diventare il fondamento di un sistema produttivo più ampio. La decisione politica centrale non è quindi se regolamentare o sovvenzionare l’IA, bensì se le capacità di calcolo avanzate rimarranno un privilegio acquistabile o diventeranno un’infrastruttura economica accessibile.

AI Compute Access Observatory · 2026–2031
Scarcity Transmission Engine
Interactive, source-anchored scenario model connecting compute demand, supply expansion and electricity pressure. Outputs are scenario indices, not observed market-price forecasts.
MODEL ACTIVE
Five-Year Scenario Controls
Demand index Capacity index Access-cost pressure
Dynamic Risk Matrix
Scarcity58
Demand growth relative to supply expansion.
Affordability49
Higher value indicates greater access pressure.
Energy exposure43
Sensitivity to electricity-cost escalation.
Access divide55
Composite inequality transmission indicator.
Local AI Hardware Envelope
Installed accelerator / unified memory 24 GB
Official architecture reference GDDR6X
Theoretical four-bit weight envelope ≈40B parameters
Illustrative ceiling after a 20% weight-loading allowance; context cache, runtime overhead and usable throughput reduce practical capacity.
Method: theoretical parameter envelope = installed memory × 8 ÷ 4 bits ÷ 1.20. It is not a performance benchmark and does not imply that a model of the stated size will run at acceptable speed. The RTX 3090 and Apple unified-memory architecture are not performance-equivalent. Scenario indices use 2026 = 100 and respond only to the user-selected assumptions; they must not be interpreted as audited forecasts or market quotations.

Capitolo 1 — L’economia politica del calcolo basato sull’intelligenza artificiale

1.1 Scopo, ambito e posizione analitica

La potenza di calcolo per l’IA non è né un singolo prodotto né una quantità omogenea. Si tratta piuttosto di una capacità produttiva stratificata, creata combinando la proprietà intellettuale relativa alla progettazione di semiconduttori, la capacità di fabbricazione, il packaging avanzato, la memoria ad alta larghezza di banda, i server, le interconnessioni, lo storage, i data center, l’energia elettrica, il raffreddamento, i framework software, i modelli addestrati e la manodopera specializzata. L’oggetto economico acquistato dall’utente finale non è quindi semplicemente una GPU o un token. Rappresenta l’accesso a una configurazione di capitale, energia, larghezza di banda della memoria, compatibilità software e capacità del modello, limitata nel tempo e specifica per il carico di lavoro. Questa distinzione è fondamentale perché diverse forme di apparente scarsità possono emergere a livelli differenti. Una carenza di schede acceleratrici può riflettere una fabbricazione all’avanguardia insufficiente, un packaging avanzato limitato, l’indisponibilità di HBM, restrizioni all’esportazione, approvvigionamento da parte di hyperscaler, il comportamento dei distributori o uno shock temporaneo della domanda. Un prezzo elevato delle API può invece riflettere il recupero dei costi di addestramento, le spese di inferenza, la capacità riservata, le garanzie di latenza, la scarsità di modelli, la segmentazione commerciale o il potere di determinazione dei prezzi. La relazione non dedurrà una manipolazione illecita del mercato semplicemente dall’aumento dei prezzi, da margini eccezionali o da una struttura concentrata dei fornitori. Determinerà invece se i prezzi superano i parametri economici competitivi, tenendo conto della qualità del prodotto, dei cicli di capacità, dell’ammortamento, dei costi dei fattori produttivi, della crescita della domanda, del rischio e dell’innovazione. La Commissione europea ha individuato autonomamente dati, acceleratori di IA, infrastrutture informatiche, capacità cloud e competenze tecniche come possibili barriere all’ingresso nei mercati dell’IA generativa, pur avvertendo che un collo di bottiglia diventa un problema di concorrenza solo nel contesto economico e giuridico pertinente. Documento informativo sulla politica di concorrenza: Concorrenza nell’IA generativa e nei mondi virtuali – Commissione europea – settembre 2024

La tesi principale di questo rapporto è quindi condizionale: se l’offerta di capacità di calcolo per l’IA, opportunamente ponderata per la qualità, si espande più lentamente della domanda, se la concorrenza effettiva rimane limitata a diversi livelli complementari e se l’accesso a sistemi superiori produce vantaggi cumulativi in ​​termini di istruzione o economia, allora la scarsità di risorse di calcolo può diventare un meccanismo di stratificazione sociale e industriale. L’esito contrario rimane possibile. La capacità produttiva, gli acceleratori alternativi, i modelli a pesi aperti, la quantizzazione, la distillazione, l’ottimizzazione dell’inferenza, l’implementazione edge e le infrastrutture di calcolo pubbliche potrebbero ridurre il costo di un livello fisso di capacità anche se il prezzo nominale dell’hardware di fascia alta aumenta. Il Capitolo 1 definisce il quadro necessario per distinguere tra queste traiettorie. Definisce sei interpretazioni economicamente distinte della capacità di calcolo, mappa la catena del valore, individua le potenziali fonti di scarsità e potere contrattuale, formalizza i concetti utilizzati in tutto il rapporto e specifica otto ipotesi falsificabili. Nessuna ipotesi sarà considerata confermata in questo capitolo. In particolare, le affermazioni riguardanti i prezzi sul mercato dell’usato, l’inflazione dei prodotti Apple o Samsung, il costo reale dell’IA locale e la sostenibilità degli attuali prezzi dei token richiedono set di dati longitudinali che saranno costruiti nei capitoli 2, 4 e 5. Lo stato probatorio all’inizio dell’indagine è quindi “aperto”: la pressione sulla capacità a monte, gli investimenti straordinari e l’adozione diseguale sono già osservabili, mentre la persistente inflazione reale dell’hardware, i premi sistematici sull’usato, gli affitti superiori alla norma e la futura escalation del prezzo dei token restano questioni da verificare formalmente.


1.2 Le sei identità economiche del calcolo basato sull’IA

Il calcolo per l’IA può assumere simultaneamente sei identità economiche, ma l’importanza relativa di ciascuna identità cambia in base al carico di lavoro, all’acquirente e all’orizzonte temporale. Per uno sviluppatore di software che acquista diverse ore di inferenza, il calcolo assomiglia a un input industriale variabile. Per un hyperscaler che investe miliardi di dollari in acceleratori, data center e approvvigionamento energetico, è un bene capitale durevole ma in rapido deprezzamento. Quando viene erogato in modo continuativo tramite API standardizzate con misurazione, livelli di capacità e impegni sui livelli di servizio, acquisisce caratteristiche simili a quelle di un servizio di pubblica utilità. Quando i governi ne fanno uso per la difesa, l’intelligence, la sanità, l’ottimizzazione del sistema energetico o la pubblica amministrazione, diventa un’infrastruttura strategica. Quando l’accesso è condizionato da controlli sulle esportazioni, produzione nazionale, catene di approvvigionamento collegate o capacità cloud nazionale, diventa una risorsa geopolitica. Infine, quando la capacità futura viene riservata tramite contratti a lungo termine, livelli di priorità, opzioni di capacità o diritti trasferibili, può acquisire attributi simili a quelli di una merce e parzialmente finanziarizzati. Nessuna di queste classificazioni è completa se considerata isolatamente. A differenza dell’elettricità, la potenza di calcolo è eterogenea: un’ora di utilizzo di un acceleratore non può essere perfettamente sostituita con un’altra, poiché memoria, precisione, architettura, software, rete, geografia e carichi di lavoro consentiti differiscono. A differenza del petrolio, la potenza di calcolo non viene immagazzinata e successivamente bruciata; la capacità inutilizzata è un flusso di servizi deperibili generato da apparecchiature soggette a deprezzamento. A differenza del Bitcoin, viene prodotta attraverso investimenti industriali e non ha un’offerta algoritmica fissa. Ciononostante, la potenza di calcolo può comunque essere razionata, riservata, scambiata contrattualmente e prezzata dinamicamente, rendendo l’analogia con le materie prime economicamente rilevante entro certi limiti.

identità economicaCaratteristica distintivaacquirente tipicoUnità di prezzo principalePrincipale meccanismo di scarsitàLa lente regolamentare più appropriata
input industriale normaleConsumato nella produzione di un altro bene o servizioImpresa, sviluppatore, laboratorioAccelerator-hour, token, task o chiamata APIRichiesta di carico di lavoro a breve termineTrasferimento dei costi degli input e produttività
bene capitale scarsoRichiede un ingente investimento iniziale e si deprezzaHyperscaler, stato, grande impresaServer, cluster, MW installato o TCO quinquennaleTempi di consegna per fabbricazione, finanziamento e installazione.Investimenti, ammortamenti e formazione delle competenze
Servizio di tipo utilityFornitura continua e misurazioneFamiglia, PMI, istituzioneAbbonamento, token o capacità riservataCongestione e disponibilità del servizioTrasparenza, affidabilità e non discriminazione
Intervento strategicoSostiene funzioni economiche o statali essenzialiGoverno, infrastrutture critiche, ospedaleCapacità sovrana e disponibilità dei serviziResilienza, sicurezza e controllo internoGovernance delle infrastrutture critiche
Risorsa geopoliticaL’accesso dipende dalla giurisdizione e dall’allineamento internazionale.Stato, azienda di difesa, ente sanzionato o controllatoEsecuzione soggetta a licenza e utilizzo finale consentitoControlli sulle esportazioni e concentrazione territorialePolitica commerciale, di sicurezza e industriale
Merce potenzialmente finanziarizzataLa capacità futura è riservata, suddivisa in livelli o contrattualizzata.Hyperscaler, fornitore di modelli, investitore finanziarioImpegno futuro in termini di capacità, priorità o disponibilitàAspettative di futura scarsitàProgettazione del mercato, trasparenza e leva sistemica

La classificazione produce un’immediata conseguenza metodologica: non può esistere un “prezzo universale per il calcolo AI”. Il vettore dei prezzi deve invece essere espresso come P = f(H, M, B, L, E, G, S, Q, R, T), dove H indica l’architettura hardware, M la memoria disponibile, B la larghezza di banda di memoria e di rete, L la latenza, E il consumo energetico, G la geografia, S l’ecosistema software, Q la qualità del modello o del compito, R l’affidabilità e T la durata del contratto. Due servizi che applicano lo stesso importo per milione di token possono avere prezzi effettivi radicalmente diversi se uno produce un output più utile, richiede meno tentativi, supporta contesti più lunghi, preserva la privacy o fornisce capacità garantita. Allo stesso modo, due computer con prezzi di acquisto identici possono avere costi economici diversi perché uno consuma più elettricità, ha un utilizzo inferiore, manca di compatibilità software o diventa obsoleto prima. Il rapporto utilizzerà quindi sia i prezzi nominali che i prezzi ponderati per la qualità e misurerà l’accesso come un pacchetto piuttosto che come una condizione binaria.


1.3 Il calcolo come input industriale e bene capitale

Come input industriale, la potenza di calcolo dell’IA entra in una funzione produttiva insieme a lavoro, dati, capitale convenzionale e conoscenza organizzativa. Il suo valore marginale non dipende semplicemente dalla quantità di potenza di calcolo consumata, ma anche dal fatto che l’impresa possieda risorse complementari in grado di convertire l’output del modello in decisioni affidabili o ricavi. Un’azienda priva di dati puliti, riprogettazione dei processi, sistemi di valutazione, sicurezza informatica, governance legale e personale qualificato può acquistare grandi quantità di token senza ottenere guadagni di produttività misurabili. Al contrario, un modello specializzato di piccole dimensioni integrato in un processo ben progettato può produrre un ritorno maggiore rispetto a un modello di frontiera più costoso utilizzato senza adattamento organizzativo. Una specifica di produzione generale per l’impresa i nel periodo t è Y i,t  = A i,t  × F(K i,t , L i,t , C i,t , D i, t , O i,t ), dove Y è l’output, K è il capitale convenzionale, L è il lavoro, C è la potenza di calcolo ponderata per la qualità, D sono i dati utilizzabili, O è la capacità organizzativa e A cattura altri fattori determinanti della produttività. L’informatica può integrare il lavoro altamente qualificato, sostituire compiti di routine o non generare alcun ritorno materiale in assenza di capacità organizzative. Questa complementarità contribuisce a spiegare perché un abbonamento nominalmente uguale non crea un accesso economico equo: le grandi aziende possono ripartire i costi di integrazione, governance e valutazione su un maggior numero di utenti e transazioni. L’indagine Eurostat del 2025 sulle imprese fornisce un primo indicatore osservabile di questo effetto scala. Le tecnologie di intelligenza artificiale sono state utilizzate dal 55,03% delle grandi imprese dell’UE , rispetto al 30,36% delle medie imprese e al 17,00% delle piccole imprese . L’indagine non stabilisce che i prezzi dell’informatica siano la causa della differenza, ma supporta l’ipotesi che l’accessibilità economica, le competenze e la scala contribuiscano a tale differenza. Utilizzo dell’intelligenza artificiale nelle imprese – Eurostat – dicembre 2025

Essendo un bene capitale, la potenza di calcolo è caratterizzata da elevati costi iniziali, rapida obsolescenza tecnologica, valore residuo incerto e forti effetti di utilizzo. Un cluster che opera vicino alla sua capacità massima può distribuire l’ammortamento e i costi delle infrastrutture su una quantità di output fatturabile di gran lunga superiore rispetto a un impianto locale sottoutilizzato. Il costo medio rilevante è AC t  = FC t  ÷ Q t  + VC t , dove FC include ammortamento, finanziamenti, edifici, rete e costi fissi del lavoro; Q è l’output corretto per la qualità; e VC include i costi marginali di energia, raffreddamento, manutenzione e specifici per il carico di lavoro. Le economie di scala riducono FC ÷ Q fino a quando la congestione, i limiti della rete, la complessità della rete o i costi di gestione non compensano il guadagno. L’intensità di capitale influenza anche il potere contrattuale. Gli acquirenti in grado di impegnarsi in volumi a lungo termine possono assicurarsi capacità e condizioni commerciali preferenziali, mentre studenti, ricercatori, piccole imprese e governi a basso reddito generalmente acquistano a prezzi al dettaglio o a prezzi di servizi condivisi. Le spese in conto capitale di Alphabet sono aumentate da 52,5 miliardi di dollari nel 2024 a 91,4 miliardi di dollari nel 2025 , con la società che ha dichiarato che la spesa rifletteva principalmente l’infrastruttura tecnica e che prevedeva un ulteriore aumento significativo nel 2026. Questo non identifica la quota precisa dell’IA né dimostra futuri aumenti di prezzo, ma stabilisce la portata della mobilitazione di capitale a disposizione di un operatore di piattaforme leader. ( Alphabet Annual Report on Form 10-K for the Fiscal Year Ended December 31, 2025 – Alphabet and US Securities and Exchange Commission – February 2026)


1.4 Il calcolo come servizio di pubblica utilità

L’IA in cloud assomiglia a un servizio di pubblica utilità perché trasforma un complesso sistema di capitale in un accesso continuo, erogato da remoto e a consumo. Gli utenti non hanno bisogno di possedere un impianto di produzione, un cluster di acceleratori o un data center; pagano per un servizio espresso tramite abbonamenti, token di input, token di output, immagini, durata audio, spazio di archiviazione, throughput fornito o operazioni completate. L’erogazione di tipo utility può democratizzare l’accesso perché converte la spesa in conto capitale in spesa variabile e consente ai piccoli acquirenti di consumare frazioni di infrastrutture costose. Allo stesso tempo, può creare dipendenza se le funzioni essenziali diventano inseparabili dall’identità del fornitore, dall’interfaccia del modello, dai formati dei dati, dall’architettura di sicurezza o dagli strumenti proprietari. L’analogia con il servizio di pubblica utilità è quindi più forte in termini di fatturazione, continuità e dipendenza, ma più debole in termini di fungibilità tecnica. L’elettricità a una tensione specifica è sostanzialmente standardizzata; gli output dell’IA non lo sono. Un modello più economico può essere un sostituto inadeguato se ha una minore affidabilità, un ragionamento più debole, una copertura linguistica insufficiente, un contesto più breve o non ha accesso agli strumenti necessari. L’unità effettiva non è quindi un singolo token, ma un’attività completata con successo e sottoposta a controllo qualità. Una misura utile è ECP m,w  = C m,w  ÷ U m,w , dove ECP è il prezzo effettivo di completamento del modello m sul carico di lavoro w, C è la spesa totale, inclusi tentativi e supervisione, e U è il numero di output che soddisfano una soglia di qualità predefinita.

L’analogia con i servizi di pubblica utilità solleva anche questioni relative alla progettazione delle tariffe, alla prenotazione della capacità, all’accesso universale, ai diritti di cambio fornitore e alla continuità del servizio. Se i fornitori si trovano ad affrontare la congestione, possono rispondere attraverso tempi di attesa, limiti di utilizzo, accesso a modalità degradate, prezzi più elevati per le fasce di priorità o razionamento geografico. La tariffazione dinamica non è automaticamente abusiva: può allocare capacità scarse e incentivare la domanda nelle ore di minor consumo. Diventa socialmente rilevante quando l’accesso all’istruzione, alla ricerca, all’assistenza sanitaria o a funzioni aziendali competitive dipende dalla capacità di pagare i sovrapprezzi previsti per le ore di punta o per le tecnologie di frontiera. La dipendenza dal cloud è già sufficientemente ampia da rendere questa questione rilevante. Eurostat ha riportato che il 52,74% delle imprese dell’UE ha acquistato servizi di cloud computing nel 2025, mentre il 40,89% di tutte le imprese intervistate ha acquistato almeno un servizio classificato come sofisticato. Tra le imprese che utilizzano servizi cloud a pagamento, il 77,53% è stato classificato come fortemente dipendente da funzioni cloud sofisticate. Queste cifre riguardano i servizi cloud in generale, piuttosto che l’intelligenza artificiale di frontiera, e non devono essere travisate come un tasso di dipendenza dall’IA. Tuttavia, essi gettano le basi istituzionali attraverso le quali l’IA misurata può diffondersi rapidamente. Cloud Computing: statistiche sull’utilizzo da parte delle imprese – Eurostat – gennaio 2026

Caratteristica di utilitàAnalogo dell’elettricità o delle telecomunicazioniEquivalente di calcolo AIdifferenza critica
MisurazionekWh, minuto, GBToken, immagine, acceleratore-secondo, attività completataLe unità non sono equivalenti in termini di qualità
Prenotazione capacitàPotenza o larghezza di banda contrattualizzateThroughput configurabile e acceleratori riservatiLa disponibilità di hardware e modelli varia
Gestione della congestioneTariffe di picco o limitazioneLimiti di velocità, code, latenza e livelli del modelloAnche la qualità può essere razionata, così come la quantità.
Obbligo di affidabilitàDisponibilità e continuitàAccordo sul livello di servizio e disponibilità del modelloIl comportamento del modello può cambiare dopo gli aggiornamenti
CommutazioneCambiare fornitore utilizzando una connessione standardDati delle porte, richieste, strumenti e flussi di lavoroLe API proprietarie e il comportamento del modello ostacolano la portabilità
Accesso universaleServizio di base regolamentatoPossibile diritto di utilizzo del calcolo a fini didattici o di ricercaNon esiste uno standard minimo universalmente accettato per le capacità dell’IA.
sussidi incrociatiUna classe di utenti sovvenziona un’altraPubblicità, contratti aziendali o capitali di investimento sovvenzionano l’accesso dei consumatoriLa sovvenzione incrociata è spesso poco trasparente

1.5 Infrastruttura strategica e sovranità informatica

L’informatica diventa un’infrastruttura strategica quando la sua indisponibilità può compromettere la continuità economica, la capacità dello Stato, la sicurezza o i servizi essenziali. In questo contesto, la sovranità non richiede che ogni componente sia prodotto a livello nazionale. Nessuna grande economia è completamente autonoma in termini di litografia, software di progettazione, logica avanzata, memoria, substrati, reti, server ed energia. La sovranità operativa in ambito informatico è meglio definita come la capacità di una giurisdizione o di un’istituzione di ottenere, governare, delocalizzare, verificare e mantenere la capacità minima, adeguata alla qualità, necessaria per le sue funzioni critiche in caso di plausibile interruzione. Questa definizione comprende cinque dimensioni: disponibilità fisica, controllo giurisdizionale, competenza operativa, portabilità di software e dati e resilienza della catena di approvvigionamento. Un Paese che possiede un data center ma dipende interamente da acceleratori stranieri, framework proprietari, aggiornamenti remoti e manodopera specializzata importata possiede un’infrastruttura senza piena sovranità operativa. Al contrario, un Paese che utilizza hardware di origine straniera può mantenere un controllo significativo se detiene la capacità installata, pezzi di ricambio diversificati, competenze locali, modelli trasferibili e accordi di continuità legalmente vincolanti.

Un indice di sovranità utilizzato più avanti nel rapporto assumerà la forma CSI j  = Σw k z j,k , dove CSI è l’indice di sovranità computazionale per la giurisdizione j, z rappresenta indicatori normalizzati e i pesi saranno testati secondo specifiche di uguale ponderazione, componenti principali e ponderazione esperta. Gli indicatori riguarderanno la capacità installata degli acceleratori, la potenza dei data center nazionali, la ridondanza, la disponibilità delle regioni cloud, la connettività di rete, l’accesso a componenti di ricambio, il calcolo pubblico per la ricerca, le capacità della forza lavoro, il controllo legale, la portabilità dei modelli e l’esposizione a restrizioni all’esportazione estera. La risposta politica dell’Europa dimostra che i governi non considerano più il calcolo di frontiera come una normale importazione. La Commissione europea descrive le Gigafactory dell’IA come strutture che riuniscono più di 100.000 processori AI avanzati , alimentazione affidabile, reti avanzate e catene di approvvigionamento sicure. Nel luglio 2026, ha lanciato un bando volto a sostenere fino a sette di queste strutture e a sbloccare oltre 30 miliardi di euro di investimenti. Questi sono obiettivi politici piuttosto che capacità completate e devono rimanere classificati come mobilitazioni annunciate. Fabbriche di IA – Commissione europea – luglio 2026 L’UE lancia un bando per le gigafabbriche di IA per potenziare la capacità di calcolo dell’Europa e sbloccare oltre 30 miliardi di euro – Commissione europea – luglio 2026

dimensione della sovranitàDomanda operativaIndicatore propostoCondizioni di prigione
capacità fisicaÈ disponibile una potenza di calcolo sufficiente o è garantita contrattualmente?Capacità di accelerazione ponderata per la qualità per milione di abitanti e per unità di PILI carichi di lavoro critici non possono ottenere capacità
Controllo giurisdizionaleLe leggi straniere o le azioni dei fornitori possono interrompere l’accesso?Quota di capacità critica sotto controllo legale nazionale o alleatoIl fornitore o lo stato esportatore possono interrompere il servizio
resilienza energeticaLa rete elettrica è in grado di supportare carichi di lavoro prolungati?Potenza nominale in MW, ridondanza e disponibilità prevista al netto delle interruzioni.La capacità esiste, ma non può essere fornita in modo affidabile.
resilienza della catena di approvvigionamentoÈ possibile riparare o ampliare i sistemi guasti?Diversità dei fornitori, tempi di consegna per la sostituzione e scorte di pezzi di ricambioUn singolo guasto a monte immobilizza la capacità
Portabilità del softwareÈ possibile spostare i carichi di lavoro tra diversi provider o architetture?Tempi di migrazione, framework compatibili e formati apertiIl passaggio a un altro sistema compromette la funzionalità o richiede una riprogettazione proibitiva.
governance dei datiÈ possibile mantenere il controllo e la tracciabilità dei dati sensibili?Elaborazione locale, crittografia, verifica e applicabilità contrattualeL’accesso alle risorse di calcolo richiede un’esposizione inaccettabile dei dati.
Capacità umanaLe istituzioni locali sono in grado di gestire e ottimizzare il sistema?Ingegneri, amministratori e ricercatori di intelligenza artificiale per unità installataL’hardware rimane sottoutilizzato o gestito da operatori stranieri.
Accesso alla ricercaLe università e i ricercatori indipendenti possono acquisire capacità significative?Ore di utilizzo di risorse di calcolo pubbliche per ricercatoreLa ricerca di frontiera diventa esclusiva delle istituzioni

1.6 L’informatica come risorsa geopolitica

Il settore dell’informatica è geopolitico perché le capacità avanzate di intelligenza artificiale sono concentrate territorialmente, le catene di approvvigionamento attraversano diverse giurisdizioni e l’accesso può essere modificato da licenze di esportazione, sanzioni, controlli sugli investimenti e rapporti di alleanza. L’unità rilevante di potere geopolitico non è il solo semiconduttore, ma la combinazione controllata di progettazione, fabbricazione, confezionamento, memoria, apparecchiature, software e implementazione cloud. Uno Stato può possedere risorse minerarie ma essere privo della tecnologia di fabbricazione; può ospitare la fabbricazione ma dipendere da strumenti stranieri; può gestire data center ma non disporre di acceleratori avanzati; oppure può sviluppare modelli che non possono essere implementati economicamente senza infrastrutture cloud estere. Questa interdipendenza genera potere contrattuale nei punti critici e vulnerabilità laddove la sostituzione è lenta. Crea inoltre una distinzione tra capacità aggregata globale e capacità politicamente accessibile. La produzione di acceleratori aggiuntivi a livello mondiale non riduce la scarsità per tutti gli acquirenti se i controlli sulle esportazioni, gli accordi di allocazione o le norme di sicurezza escludono determinate giurisdizioni.

La filiera dei semiconduttori dimostra questa concentrazione di funzioni tecniche. TSMC ha riferito che le tecnologie avanzate, definite come 7 nanometri e inferiori, hanno rappresentato il 77% del fatturato derivante dai wafer nel secondo trimestre del 2026 , mentre la sua piattaforma di calcolo ad alte prestazioni (HPC) ha rappresentato il 66% del fatturato trimestrale . Queste sono quote di fatturato all’interno di TSMC, non quote di mercato globali, ma mostrano la crescente esposizione dell’azienda alla domanda di tecnologie all’avanguardia e di HPC. Trascrizione della conferenza sugli utili del secondo trimestre 2026 di TSMC – Taiwan Semiconductor Manufacturing Company – luglio 2026. Il documento di NVIDIA per l’anno fiscale 2026 afferma che l’azienda dipende dalle fonderie per la produzione dei suoi wafer di semiconduttori e si presenta come un’azienda di infrastrutture di calcolo full-stack piuttosto che come un fornitore di componenti. Questa combinazione di dipendenza dalla produzione esterna e ampiezza della piattaforma a valle illustra perché il potere nella catena dell’IA è distribuito ma asimmetrico: un’azienda di progettazione può controllare l’architettura e l’ecosistema software senza possedere l’impianto di produzione, mentre la fonderia controlla un processo produttivo limitato senza controllare autonomamente la domanda finale. ( NVIDIA Annual Report on Form 10-K for the Fiscal Year Ended January 25, 2026 – NVIDIA and US Securities and Exchange Commission – February 2026)


1.7 Potenziale finanziarizzazione: cosa spiega l’analogia con Bitcoin e cosa distorce

Il calcolo basato sull’IA potrebbe diventare più finanziarizzato senza trasformarsi in una criptovaluta o in una merce scambiata convenzionalmente. La finanziarizzazione si verifica quando i diritti su capacità future, priorità, ricavi o infrastrutture vengono separati dall’utilizzo fisico immediato e diventano oggetto di contratti, finanziamenti o speculazioni. Ordini di acceleratori a lungo termine, contratti cloud take-or-pay, capacità riservata nei data center, accordi di acquisto di energia, debito garantito da apparecchiature e opzioni di capacità possono trasferire le aspettative di scarsità nel valore attuale degli asset. Un fornitore di modelli può assicurarsi capacità di calcolo future attraverso un investimento strategico da parte di un hyperscaler; quest’ultimo può ottenere accesso preferenziale, diritti di distribuzione o partecipazione ai ricavi; e gli acquirenti più piccoli potrebbero quindi trovarsi di fronte a un mercato spot residuale. Lo studio della Federal Trade Commission del gennaio 2025 sulle principali partnership nel settore dell’IA ha individuato accordi che prevedono impegni sostanziali nel cloud, clausole relative all’esclusività, accesso a informazioni sensibili e potenziali implicazioni in termini di cambio di fornitore. Il rapporto non stabilisce che ogni partnership sia anticoncorrenziale, ma conferma che investimenti, acquisti di servizi cloud e allineamento competitivo possono essere interconnessi a livello contrattuale. Rapporto del personale della FTC sulle partnership e gli investimenti nell’IA – Studio 6(b) – Commissione federale per il commercio – Gennaio 2025

L’analogia con Bitcoin è valida solo a livello di narrazioni di scarsità, unità di consumo divisibili e prezzi guidati dalle aspettative. Fallisce in cinque aspetti fondamentali. Primo, l’offerta di calcolo è endogena: le aziende possono produrre più acceleratori e costruire più data center, sebbene con dei ritardi. Secondo, il calcolo è eterogeneo: un’ora su un’architettura non è necessariamente sostituibile con un’ora su un’altra. Terzo, il valore del calcolo si deprezza man mano che le architetture più recenti migliorano il rapporto prezzo-prestazioni. Quarto, il calcolo è limitato geograficamente e dalla disponibilità di energia elettrica. Quinto, si tratta di capacità produttiva piuttosto che di un bene portante; il valore deriva dai carichi di lavoro che esegue. Un’analogia più accurata è quella di un ibrido tra elettricità, larghezza di banda cloud, macchinari industriali e capacità di trasporto riservata. Il rapporto verificherà la finanziarizzazione attraverso il rapporto FCI t  = V riservato,t  ÷ V totale,t , dove V riservato  è il valore stimato della capacità impegnata in base ad accordi a termine o preferenziali e V totale  è la capacità totale disponibile. Un rapporto elevato indicherebbe che i prezzi al dettaglio quotati descrivono solo un mercato residuale. Poiché la divulgazione contrattuale è incompleta, la misura richiederà intervalli e non dovrà mai essere presentata con falsa precisione.

AttributoBitcoinElettricitàMacchinari industrialiCalcolo dell’intelligenza artificiale
regola di fornituraProtocollo limitatoCapacità e carburante limitatiorientato agli investimentiFabbricazione, confezionamento, memoria, alimentazione e investimenti limitati
OmogeneitàUnità relativamente fungibiliStandardizzato entro i limiti tecniciAltamente eterogeneoAltamente eterogeneo
Magazzinaggiobene digitale al portatoreLimitato e costosoL’asset può rimanere inattivoIl flusso di capacità è deperibile; l’hardware è durevole ma soggetto a deprezzamento.
AmmortamentoNessun deprezzamento fisicoNon applicabile all’energia consumataDeprezzamento fisico e tecnologicoRapido deprezzamento tecnologico ed economico
Dipendenza geograficaAccesso alla reteSpecifico della grigliaSpecifico dell’installazioneSpecifico per data center, griglia, giurisdizione e rete
Uso produttivoIndirettoinput energetico universaleRisorsa di produzione direttaInput cognitivo e computazionale diretto
Potenziale di prezzi dinamiciPrezzo di scambioTariffe spot e di puntaTariffe di noleggio o leasingPrezzi basati su token, latenza, modello, carico di lavoro e livelli di capacità.
Punteggio di analogia appropriatoBassoModerareAltocategoria ibrida

1.8 La catena del valore del calcolo basato sull’intelligenza artificiale

La catena del valore dell’IA è meglio analizzata come un insieme di livelli complementari piuttosto che come una semplice sequenza lineare. Una carenza in qualsiasi livello indispensabile può ridurre la produzione dell’intero sistema, mentre il controllo di un livello tecnicamente sostituibile può generare scarso potere contrattuale se il passaggio è economico. La misura rilevante è quindi la capacità corretta per il collo di bottiglia. Se la capacità effettiva è limitata dall’input complementare minimo disponibile, allora C effettiva  = min(C logica , C memoria , C packaging , C rete , C alimentazione , C software ). Questa rappresentazione in stile Leontief è volutamente rigorosa: in pratica, una certa sostituzione è possibile attraverso una minore precisione, reti più lente, modelli diversi o una qualità del servizio ridotta. Il modello verrà successivamente ampliato in una struttura a elasticità di sostituzione costante. Per il Capitolo 1, esso coglie il punto centrale che la domanda in eccesso di progettazione di acceleratori è economicamente irrilevante se HBM o packaging impediscono la consegna dei sistemi finiti.

Tabella 1.1 — Catena del valore del calcolo AI, nodi di scarsità e potere contrattuale

StratoFunzione economica fondamentaleIntensità di capitaleSostituibilità a breve termineIndicatore di potenziale scarsitàFonte di potere contrattualeCapitolo successivo principale
Apparecchiature per semiconduttoriConsente la fabbricazione all’avanguardiaEstremoMolto bassoArretrati degli strumenti e tempi di consegnaTecnologia di processo proprietaria e base installataCapitolo 3
Software di progettazione e proprietà intellettualeTrasforma l’architettura in un progetto realizzabile.Elevata intensità di conoscenzaBassoConcentrazione della licenza e tempo di commutazioneStandard, librerie e integrazione ingegneristicaCapitolo 3
Architettura dell’acceleratoreEsegue carichi di lavoro di intelligenza artificialeElevato livello di ricerca e sviluppoMedio su periodi più lunghiSpedizioni con qualità regolata e ordini arretratiPrestazioni, ecosistema software e base di sviluppatoriCapitoli 2–3
fonderia all’avanguardiaProduce chip logiciEstremoMolto basso nel breve periodoUtilizzo e capacità dei nodi avanzatiResa, leadership di processo e scalabilitàCapitolo 3
HBM e memoria avanzataFornisce pesi e dati del modello ad alta larghezza di bandaEstremoBassoFornitura contrattualizzata, bit di output e prezzoCompetenza e qualificazione nella produzioneCapitoli 2–3
Imballaggio avanzatoIntegra logica e memoriaEstremoMolto bassoCapacità e tempi di consegna equivalenti a quelli di CoWoS.Qualificazione del processo e capacità limitataCapitolo 3
Substrati e componentiConnettere e supportare i sistemi preconfezionatiAltoDa basso a medioTempi di consegna e concentrazione dei fornitoriVincoli di qualificazione e produzioneCapitolo 3
Integrazione del serverConverte i componenti in sistemi implementabiliAltoMezzoConsegna in rack e disponibilità di raffreddamento a liquidoIntegrazione, garanzia e qualificazione del clienteCapitoli 2–4
RetiCollega gli acceleratori a livello di clusterAltoBasso per l’addestramento di frontieraLarghezza di banda, topologia e disponibilità delle porteEfficienza di scala e compatibilità architetturaleCapitoli 3–5
Strutture del data centerCase e sistemi di raffreddamentoEstremoBasso localmenteMW in costruzione e coda di allacciamentoTerreno, permessi, raffreddamento e accesso alla reteCapitolo 5
ElettricitàGestisce l’infrastrutturaCapitale di sistema estremoBasso durante il vincolo della rete localePotenza fissa in MW, prezzi e tempi di connessioneDisponibilità specifica per localitàCapitoli 5 e 9
Orchestrazione cloudAssegna e misura le risorseEstremoMedio, ma la migrazione è costosaUtilizzo, capacità riservata e disponibilitàDimensioni, base clienti e servizi integratiCapitoli 3 e 5
Modelli di baseTrasforma le infrastrutture in capacitàAllenamento estremo e ricerca e sviluppoDipendente dal compitoAccesso e prezzo adeguati ai parametri di riferimentoQualità del modello, marchio, dati e distribuzioneCapitoli 5 e 7
Livello applicativoIncorpora i modelli nei flussi di lavoroVariabileDa medio ad altoFidelizzazione e integrazione profonda dei clientiBlocco dei dati, del flusso di lavoro e della distribuzioneCapitoli 6–7
Organizzazione utentiConverte la produzione in valore economicoVariabileNon sostituibileCompetenze, governance e capitale complementareDati proprietari e competenza di settoreCapitoli 6–8

Da questa mappa emergono tre conclusioni. In primo luogo, la concentrazione del mercato deve essere misurata separatamente a ogni livello; una singola “quota di mercato dell’IA” è analiticamente priva di significato. In secondo luogo, un’elevata concentrazione non identifica necessariamente il collo di bottiglia determinante. Un livello altamente concentrato con ampia capacità e valide alternative può esercitare meno potere contrattuale rispetto a un livello meno concentrato con lunghi periodi di qualificazione e senza inventario. In terzo luogo, il potere contrattuale può variare nel tempo. Quando gli acceleratori sono scarsi, il progettista o l’allocatore del cloud possono dominare; quando gli acceleratori diventano abbondanti ma le connessioni elettriche subiscono ritardi, la disponibilità di energia e i permessi per i data center diventano il fattore limitante. Il Dipartimento dell’Energia degli Stati Uniti ha riferito che i data center americani hanno consumato circa 176 TWh nel 2023 , ovvero il 4,4% dell’elettricità totale degli Stati Uniti , e ha previsto un intervallo compreso tra 325 e 580 TWh entro il 2028 , equivalente a circa il 6,7-12% del consumo nazionale. Questi sono scenari, non risultati fissi, ma dimostrano perché l’energia deve essere considerata parte integrante della catena di calcolo piuttosto che una spesa operativa esterna. Il Dipartimento dell’Energia degli Stati Uniti pubblica un nuovo rapporto che valuta l’aumento della domanda di elettricità da parte dei data center – Dicembre 2024


1.9 Dove si accumulano valore, scarsità e potere contrattuale

Il valore economico si crea quando un attore controlla un complemento scarso, crea un vantaggio prestazionale difficile da replicare, possiede la distribuzione o aumenta il costo del passaggio a un altro fornitore. Queste condizioni non sempre coincidono. Una fonderia può possedere una forte scarsità tecnica ma rimanere esposta a pochi grandi clienti; un hyperscaler può avere un’infrastruttura abbondante ma possedere potere contrattuale grazie alle relazioni con i clienti e ai servizi in bundle; un fornitore di modelli può avere capacità superiori ma dipendere da un partner cloud per capitale e distribuzione. L’equilibrio può essere rappresentato tramite un punteggio di potere contrattuale BP i  = w₁S i  + w₂L i  + w₃D i  + w₄E i  + w₅V i  − w₆B i , dove S rappresenta la scarsità, L il lock-in, D la differenziazione, E il controllo dell’ecosistema, V la portata verticale e B la concentrazione degli acquirenti. Questo è un indice di ricerca, non una legge consolidata. Ogni componente verrà normalizzato e testato con pesi alternativi.

Tabella 1.2 — Valutazione preliminare del potere contrattuale

NodoScarsità fisicaBlocco dell’ecosistemaConcentrazione degli acquirentiTempo di replicazioneValutazione preliminare della potenzaStato probatorio
Fabbricazione all’avanguardiaAltoMezzoAltoMolto lungoElevato ma limitato dai principali acquirenti e dai cicli di capitaleInferenza del quadro di riferimento
Imballaggio avanzatoAltoMezzoAltoLungoElevato durante l’espansione delle capacità dell’IAIpotesi del collo di bottiglia supportata
HBMAltoMezzoAltoLungoSe la produzione è elevata e contratta, il mercato residuo è ridotto.Da quantificare
Progettazione dell’acceleratoreAltoMolto elevato per ecosistemi software consolidatiAltoLungoLivello molto elevato laddove prestazioni e software si rafforzano a vicenda.Da quantificare
Collegamento di alimentazione del data centerLocalmente elevatoBassoVariabileLungoPotenzialmente decisivo nelle regioni con risorse limitateSupportato dagli scenari del Dipartimento dell’Energia (DOE).
Cloud iperscalabileBarriera ad alta capacitàMolto altoBasso potere d’acquisto per gli utenti al dettaglioMolto lungoElevato grazie al raggruppamento, alla scalabilità e all’allocazioneDa quantificare
Modello di frontieraElevata barriera alla ricerca e sviluppoAltoMistoIncertoElevato se la qualità del compito non è riproducibile tramite alternativeDipendente dal benchmark
Modello a pesi apertiAbbassare la barriera di accesso legaleInferioreBassoPiù cortoPotere limitato di fissare i prezzi direttamente, ma l’infrastruttura rimane necessaria.Dipendente dal carico di lavoro
Applicazione aziendaleSolitamente barriera fisica inferiorePotenziale elevato rischio di vincolo al flusso di lavoroFrammentatoMezzoPuò generare valore attraverso l’integrazione e i dati proprietariDipendente dal settore
Utente finaleBasso individualmenteSpesso bloccatoIndividualmente molto bassoNon applicabileIl prezzo viene calcolato automaticamente a meno che non esista un sistema di acquisto organizzato.Forte aspettativa precedente

I risultati di NVIDIA per l’anno fiscale 2026 illustrano la creazione di valore senza tuttavia risolverne la causa. Il fatturato dell’anno fiscale è stato di 215,9 miliardi di dollari , il 65% in più rispetto all’anno precedente, e il margine lordo GAAP è stato del 71,1% . Nel primo trimestre dell’anno fiscale 2027, il fatturato del settore Data Center ha raggiunto i 75,2 miliardi di dollari , il 92% in più rispetto al trimestre corrispondente dell’anno precedente. Questi dati dimostrano una performance commerciale eccezionale, non una condotta illecita. I capitoli successivi confronteranno i margini con i parametri di riferimento storici, il capitale investito, la ricerca e sviluppo, gli impegni di fornitura, le alternative competitive e le variazioni del mix di prodotti prima di stimare la rendita economica. NVIDIA annuncia i risultati finanziari per il quarto trimestre e l’anno fiscale 2026 – NVIDIA – febbraio 2026 NVIDIA annuncia i risultati finanziari per il primo trimestre dell’anno fiscale 2027 – NVIDIA – maggio 2026


1.10 Concetti chiave e definizioni operative

Tabella 1.3 — Dizionario concettuale

ConcettoDefinizione operativa per questo rapportoMisurazione propostaCiò che non deve essere dedotto automaticamente
Calcolo scarsitàLa domanda, ponderata in base alla qualità, supera la capacità disponibile alle condizioni di prezzo e di servizio vigenti.Utilizzo, code, tempi di consegna, esaurimento scorte, premi e domanda insoddisfattaUn prezzo elevato da solo non dimostra la scarsità
Scarsità fisicaHardware, alimentazione o infrastrutture dispiegabili insufficienti.Unità, MW, tempi di consegna e disponibilitàCiò non implica necessariamente un abuso di mercato.
Scarsità economicaLa capacità esiste, ma è inaccessibile a un gruppo definito di utenti.Rapporto costi/ricavi o costi/ricaviNon equivale a una carenza fisica
Scarsità artificialeL’offerta viene strategicamente trattenuta al di sotto del livello competitivo che massimizza il profitto.Capacità, produzione, scorte, contratti e offerta controfattualeNon si può dedurre dalla sola concentrazione
Sovranità computazionaleCapacità di mantenere un accesso controllato alle risorse di calcolo essenziali in caso di interruzioneIndice composito di resilienza e controlloLa sola proprietà domestica non è sufficiente
disuguaglianza di accessoDistribuzione ineguale delle capacità di intelligenza artificiale corrette per la qualitàGini, Theil, rapporti percentili e indici di accessibilità economicaIl possesso di un abbonamento non equivale alla parità di capacità
Esclusione digitaleImpossibilità di ottenere un utilizzo significativo dell’IA a causa di problemi di connettività, dispositivi, competenze, lingua o costi.Tasso di deprivazione multidimensionaleEssere online non implica un accesso significativo all’intelligenza artificiale
Rendita economicaRendimento superiore al minimo necessario per mantenere il capitale e le capacità nel loro attuale utilizzoROIC in eccesso, reddito residuo e scomposizione del margineL’utile contabile non è identico all’affitto
Effetti di reteIl valore del prodotto aumenta con l’aumentare degli utenti, degli sviluppatori, degli strumenti o dei dati complementari.Base di sviluppatori, integrazioni e fidelizzazioneLa sola dimensione non è prova di un effetto rete
Economie di scalaIl costo medio diminuisce all’aumentare della produzione o dell’utilizzo.Elasticità dei costi rispetto alla produzioneLe grandi dimensioni non sono di per sé prova della persistenza di economie di scala.
economie di scopoI costi di produzione congiunta sono inferiori a quelli di produzione separata.Funzione di costo multiprodottoL’offerta combinata non è sempre efficiente o dannosa
Integrazione verticaleUn’azienda controlla più strati adiacentiMappa delle entrate, della proprietà e del controllo contrattualeL’integrazione può generare efficienza o compromettere la sopravvivenza.
Costo di cambioPerdita economica causata dal trasferimento del fornitore o dell’architetturaSpese di migrazione, tempo, perdita di rendimento e riqualificazioneLe spese di rescissione del contratto comprendono solo una componente
Blocco dei datiI dati utente, gli embedding, le cronologie o i flussi di lavoro non possono essere spostati senza perditaCompletezza della portabilità e costi di migrazioneIl solo possesso dei dati non crea dipendenza
Blocco dell’ecosistemaIl software e le competenze complementari rendono le alternative costoseCompatibilità, strumenti per sviluppatori e riqualificazione professionaleLa sola popolarità non basta
Dipendenza tecnologicaLa capacità critica richiede un fornitore o una giurisdizione senza un sostituto tempestivoTempo di sostituzione ed esposizione aggiustata in base alla criticitàLa dipendenza dalle importazioni non è sempre sinonimo di vulnerabilità

La scarsità di risorse di calcolo verrà scomposta in cinque forme osservabili: scarsità quantitativa, scarsità qualitativa, scarsità temporale, scarsità geografica e scarsità istituzionale. La scarsità quantitativa si verifica quando il numero totale di unità è insufficiente. La scarsità qualitativa si verifica quando sono disponibili alternative con prestazioni inferiori, ma queste non sono in grado di completare il carico di lavoro richiesto. La scarsità temporale si manifesta come tempo di attesa, ritardo nella consegna o code. La scarsità geografica si verifica quando la capacità è disponibile a livello globale, ma non all’interno della giurisdizione o dei limiti di latenza richiesti. La scarsità istituzionale si verifica quando la capacità è accessibile a hyperscaler o università d’élite, ma non a piccole imprese, ricercatori indipendenti o istituzioni pubbliche. Questa scomposizione previene un errore analitico comune: concludere che la scarsità sia scomparsa perché una qualche forma di risorsa di calcolo rimane acquistabile. Un utente in grado di eseguire un piccolo modello locale altamente quantizzato può avere accesso alla quantità, ma rimanere escluso a livello qualitativo da carichi di lavoro che richiedono contesto a lungo termine, multimodalità, elevata affidabilità o inferenza concorrente rapida.


1.11 Effetti di rete, scala, portata e integrazione verticale

I mercati dell’IA possono presentare diversi meccanismi di scala che si rafforzano a vicenda. La scala infrastrutturale riduce i costi fissi medi aumentando l’utilizzo e distribuendo le spese per data center, reti e ingegneria su un maggior numero di carichi di lavoro. La scalabilità dello sviluppo dei modelli consente di ammortizzare i costi di formazione, sicurezza, valutazione e post-formazione su un numero maggiore di utenti. La scalabilità dei dati può migliorare i prodotti quando interazioni legalmente e tecnicamente utilizzabili generano feedback. La scalabilità della distribuzione riduce i costi di acquisizione dei clienti. Gli effetti della rete di sviluppatori aumentano il valore di un’architettura man mano che diventano disponibili più librerie, strumenti di ottimizzazione e personale qualificato. Questi meccanismi possono generare una reale efficienza, innalzando al contempo le barriere all’ingresso. Il compito analitico non è quello di etichettare la scalabilità come dannosa, ma di determinare se i guadagni di efficienza vengono trasferiti agli utenti attraverso prezzi più bassi, adeguati alla qualità, o se vengono trattenuti come rendita duratura.

Le economie di scala saranno testate tramite ln(AC i,t ) = α + βln(Q i,t ) + γX i,t  + ε i,t . Un β statisticamente negativo sarebbe coerente con una diminuzione del costo medio all’aumentare della produzione, fatte salve le limitazioni di qualità e identificazione dei dati. Le economie di scopo saranno esaminate tramite SC = C(Y₁,0) + C(0,Y₂) − C(Y₁,Y₂). Un valore positivo indica un vantaggio di costo derivante dalla produzione congiunta. L’integrazione verticale sarà valutata sia attraverso i canali di efficienza che di preclusione. L’integrazione tra acceleratori, reti, cloud, modelli e applicazioni può ridurre i costi di coordinamento e ottimizzare lo stack. Può anche rendere meno attraenti modelli o hardware concorrenti attraverso l’accesso preferenziale, il bundling, le restrizioni di interoperabilità o condizioni commerciali discriminatorie. Il rapporto della FTC sulle partnership nel campo dell’IA fornisce un punto di partenza empirico rilevante, in quanto ha esaminato come investimenti e partnership potrebbero influenzare l’accesso alle risorse cloud, il passaggio da un fornitore all’altro, l’esclusività e le informazioni sensibili. Non giunge a una conclusione generalizzata secondo cui l’integrazione sia anticoncorrenziale; stabilisce piuttosto i meccanismi contrattuali che devono essere testati. Rapporto del personale della FTC sulle partnership e gli investimenti nel campo dell’IA (Studio 6(b) – Federal Trade Commission – Gennaio 2025)

Tabella 1.4 — Test di efficienza ed esclusione

MeccanismoIpotesi di efficienzaIpotesi di esclusioneDocumentazione richiesta
Integrazione hardware-softwareMigliora le prestazioni e riduce i costi del carico di lavoroVincola gli sviluppatori a un’unica architetturaConfronto tra benchmark multipiattaforma, costi di migrazione e prezzi
Integrazione del modello cloudRiduce i costi di implementazione e la latenzaAssegna la capacità in via preferenziale al modello affiliatoCondizioni di capacità, prezzi e disponibilità per modello
Integrazione modello-applicazioneMigliora l’esperienza utente e l’automazione del flusso di lavoro.Rende i modelli concorrenti tecnicamente o commercialmente inaccessibiliInteroperabilità, impostazioni predefinite e termini contrattuali
Integrazione dati-modelloMigliora la pertinenza e la personalizzazioneTrincee consolidate attraverso dati di feedback inaccessibiliPortabilità dei dati, effetti di apprendimento e prestazioni incrementali
Servizi aziendali in bundleRiduce i costi di approvvigionamento e sicurezzaSfrutta la sua forza in un mercato per precludersi un’altraPrezzi singoli rispetto ai prezzi in pacchetto e cambio di cliente
contratto di capacità a lungo termineFinanzia nuove infrastrutture e stabilizza la domandaRiduce la capacità produttiva dei concorrenti o degli acquirenti residuiDurata del contratto, quota riservata e capacità alternativa
Ecosistema degli sviluppatoriRiduce i costi di implementazioneAumenta gli ostacoli alla riqualificazione e allo sviluppo professionale.Competenze richieste dal mercato del lavoro, compatibilità con le librerie e tempi di trasferimento.

1.12 Concentrazione del mercato, posizione dominante e rendita economica

La concentrazione è un indicatore, non un verdetto. Il rapporto calcolerà la concentrazione a livelli funzionali definiti in modo ristretto utilizzando CR₄ = s₁ + s₂ + s₃ + s₄ e HHI = Σs i ², con le quote espresse in percentuale. La definizione del mercato precederà il calcolo: GPU per data center, GPU per consumatori, HBM, servizi di fonderia all’avanguardia, infrastrutture cloud generali e abbonamenti a modelli di frontiera non possono essere inseriti in un unico denominatore. Le Linee guida sulle fusioni del 2023 degli Stati Uniti affermano che una fusione che produce o aumenta un mercato altamente concentrato può far sorgere una presunzione di illegalità in determinate condizioni, ma le linee guida costituiscono un quadro di applicazione, non una dichiarazione che ogni mercato concentrato sia illegale. Linee guida sulle fusioni del 2023 – Dipartimento di Giustizia degli Stati Uniti e Commissione Federale del Commercio – Dicembre 2023. Il rapporto integrerà quindi l’HHI con le condizioni di ingresso, i vincoli di capacità, i margini prezzo-costo, il potere contrattuale degli acquirenti, l’innovazione, il multi-homing, lo switching e la sostituzione credibile.

La rendita economica verrà stimata attraverso molteplici metodi, poiché nessun singolo indice contabile è in grado di isolare il potere di mercato. La prima misura sarà il rendimento in eccesso: ER i,t  = ROIC i,t  − WACC i,t . La seconda sarà il reddito residuo: RI i,t  = NOPAT i,t  − WACC i,t  × IC i,t . La terza scomporrà le variazioni del margine lordo in prezzo di vendita, mix di prodotti, costo unitario, utilizzo ed effetti contabili. Un rendimento in eccesso positivo può rappresentare una rendita da innovazione, una rendita da scarsità temporanea, capitale immateriale omesso dal bilancio, una gestione superiore o un potere di mercato duraturo. La classificazione dipenderà dalla persistenza, dall’ingresso nel mercato, dalla risposta dei prezzi all’espansione della capacità produttiva e dal fatto che i rendimenti rimangano superiori ai benchmark dopo aver tenuto conto del rischio e degli investimenti immateriali.

Tabella 1.5 — Quadro di classificazione degli affitti

Categoria affittoOrigine economicaDurata previstaImplicazioni per la concorrenzaFirma empirica
Affitto innovativoTecnologia o prodotto di qualità superioreTemporaneo, salvo rinnovo continuo.Spesso pro-competitivoElevata attività di ricerca e sviluppo, rapido miglioramento delle prestazioni e ingresso finale
Affitto di scarsitàLa domanda supera temporaneamente la capacitàCiclico o dipendente dalla capacitàNon intrinsecamente anticoncorrenzialePrezzi e margini calano dopo l’espansione della capacità produttiva.
Quasi-affittoRecupero su investimenti specializzati già effettuatidipendente dalla durata di vita dell’assetDi solito normaleIl rendimento diminuisce con il deprezzamento del capitale o la scadenza dei contratti.
premio assicurativoRisarcimento per investimenti incertiCollegato al rischioNormale se proporzionatoIl rendimento è correlato al rischio di investimento.
Affitto dell’ecosistemaStrumenti e utenti complementari rafforzano quelli esistentiPotenzialmente persistenteAmbiguoElevati costi di passaggio e dipendenza dagli sviluppatori
Rendita di monopolio o di posizione dominanteUn potere di mercato duraturo limita la pressione competitivaPersistentepotenziale problemaMargini elevati, ingresso debole, sostituibilità limitata ed esclusione strategica
Affitto regolamentatoLe norme o i controlli limitano l’accessoDipendente dalle politichePotrebbe essere intenzionale o distorsivoProfitti legati a licenze, quote o accessi protetti
Rendita geopoliticaL’accesso o i controlli giurisdizionali creano un’offerta privilegiataDipendente dall’eventoQuestioni di sicurezza e commercioDivergenze regionali di prezzo e disponibilità

1.13 Disuguaglianza di accesso ed esclusione digitale

La disuguaglianza nell’accesso all’IA deve essere misurata come una distribuzione di capacità piuttosto che come una distribuzione di account. Un modello gratuito, un abbonamento a pagamento per le tecnologie di frontiera, un’istanza aziendale dedicata e un sistema locale ad alta memoria non sono risorse equivalenti. L’accesso ponderato in base alla qualità includerà quindi le prestazioni del modello, i limiti di utilizzo, la capacità del contesto, la latenza, la privacy, la disponibilità, la copertura linguistica e l’accesso agli strumenti. La misura individuale proposta è QAA i,t  = Σw k A i,k,t , dove A rappresenta le dimensioni di accesso normalizzate. L’accessibilità economica sarà misurata come AAI i,t  = C adeguato,i,t  ÷ Y disponibile,i,t . Per le aziende, il denominatore diventa fatturato, spese operative o costo del lavoro. Per le università, diventa spesa per la ricerca o finanziamento per ricercatore. Un sistema sarà considerato accessibile solo in relazione a un carico di lavoro definito; un modello a basso costo che non è in grado di completare l’attività non è un sostituto accessibile.

Il divario digitale di base rimane grave. L’ITU ha stimato che nel 2025 6 miliardi di persone fossero online , mentre 2,2 miliardi sarebbero rimaste offline , principalmente nelle economie a basso e medio reddito. Ha riportato un utilizzo di Internet pari al 94% nei paesi ad alto reddito e al 23% nei paesi a basso reddito . Misurare lo sviluppo digitale: fatti e cifre 2025 – Unione Internazionale delle Telecomunicazioni – Novembre 2025. Queste cifre non misurano l’accesso all’IA, ma ne definiscono il limite inferiore: gli utenti senza una connettività significativa non possono partecipare pienamente all’IA nel cloud, mentre gli utenti con una connettività debole potrebbero non essere in grado di sostenere carichi di lavoro multimodali o interattivi. L’analisi della connettività 2025 dell’ITU inquadra la connettività significativa attraverso qualità, disponibilità, accessibilità economica, dispositivi, competenze e sicurezza, una struttura multidimensionale che questo rapporto estenderà al calcolo per l’IA. Rapporto sulla connettività globale 2025 – Unione Internazionale delle Telecomunicazioni – 2025

Tabella 1.6 — Scala di accesso all’IA

LivelloCapacità accessibileVincolo tipicoConseguenze economiche
0 — EsclusoNessuna connessione internet affidabile o dispositivo compatibileConnettività, elettricità, redditoNessuna partecipazione regolare dell’IA
1 — Accesso nominaleServizio gratuito, fortemente limitato o intermittenteCappelli, code e modelli più vecchiAssistenza di base ma scarsa continuità
2 — Accesso standard per i consumatoriModello a pagamento per scopi generaliConvenienza dell’abbonamento e privacymiglioramento della produttività individuale
3 — Accesso professionale avanzatoLimiti più elevati, strumenti, contesto più ampio e multimodalitàcosti ricorrenti più elevativantaggio professionale materiale
4 — Accesso controllato dall’aziendaSicurezza, integrazione, governance e supportoDimensioni organizzative e costi di implementazioneProduttività a livello di flusso di lavoro e integrazione dei dati
5 — Accesso locale ad alte prestazioniInferenza privata con memoria e velocità di elaborazione considerevoliHardware, energia e competenze tecnicheSovranità e disponibilità prevedibile
6 — Accesso alla ricerca di frontieraGrandi gruppi, addestramento e sperimentazione su larga scalaEstrema concentrazione di capitale e istituzionaleCapacità di creare, anziché semplicemente consumare, sistemi di frontiera

1.14 Ipotesi di ricerca falsificabili

H1 — I prezzi dell’hardware rilevante per l’IA sono aumentati più rapidamente rispetto ai prezzi generali dell’elettronica di consumo.

L’ipotesi H1 sarà supportata solo se un indice rappresentativo dei prezzi dell’hardware AI, ponderato per le transazioni, aumenta più rapidamente rispetto al comparatore appropriato dell’elettronica di consumo nel periodo definito. Il test non può basarsi su prodotti di punta selezionati o su annunci di rivendita isolati. Il Capitolo 2 costruirà indici corrispondenti ed edonici per GPU, memoria, workstation, laptop e configurazioni Apple e Samsung pertinenti. La regressione principale sarà ln(P i,t ) = α + βX i,t  + γ t  + δ b  + ε i,t , dove X cattura memoria, larghezza di banda, prestazioni di calcolo, energia, condizioni e altre caratteristiche misurabili; γ è l’effetto del tempo e δ l’effetto del marchio o della famiglia di prodotti. L’ipotesi H1 sarà rifiutata se i prezzi nominali aumentano ma i prezzi corretti per la qualità diminuiscono a un tasso coerente o più veloce dell’indice di comparazione.

H2 — Il costo, corretto per l’inflazione, di un livello fisso di capacità di IA è aumentato

H2 è più rigoroso di H1. L’unità di analisi sarà un carico di lavoro riproducibile, non l’hardware. Il costo per attività completata con successo includerà i costi di capitale, l’elettricità, il software, il tempo, i tentativi e la correzione umana. Il paniere di capacità fisse comprenderà il ragionamento, la codifica, l’analisi di documenti lunghi, il lavoro multilingue e l’elaborazione multimodale. H2 sarà supportato quando il costo minimo reale per raggiungere una soglia di riferimento costante aumenta significativamente su più carichi di lavoro e modalità di implementazione. Sarà rifiutato se algoritmi migliorati, quantizzazione o efficienza hardware riducono il costo reale del carico di lavoro nonostante prezzi di acquisto più elevati.

H3 — I prezzi del mercato dell’usato indicano una scarsità persistente piuttosto che una speculazione temporanea

H3 confronterà i prezzi dell’usato con il prezzo di listino al lancio, i prezzi del nuovo contemporanei, i parametri di riferimento per il deprezzamento e la disponibilità del prodotto. Il premio di scarsità sarà USP i,t  = (P usato,i,t  − P fondamentale,i,t ) ÷ P fondamentale,i,t . La persistenza richiederà premi su più mesi, regioni e classi di prodotto, accompagnati da bassa disponibilità o ritardi nella consegna. H3 verrà rifiutato se i premi sono limitati a lanci brevi, prodotti da collezione, inserzioni inaffidabili, distorsioni fiscali o episodi speculativi senza prove di transazione.

H4 — La concentrazione consente ai fornitori di mantenere rendite economiche superiori alla norma

L’ipotesi H4 richiederà una relazione tra concentrazione e rendimenti in eccesso persistenti dopo aver controllato per R&S, rischio, capitale immateriale, scala e mix di prodotti. La specificazione del panel sarà ER i,t  = α + βHHI m,t  + γZ i,t  + μ i  + τ t  + ε i,t . Un β positivo da solo non dimostrerà la causalità. Studi di eventi relativi all’espansione della capacità, all’ingresso nel mercato o a shock dell’offerta verificheranno se i margini rispondono in modo competitivo. L’ipotesi H4 verrà rifiutata se gli alti rendimenti si dissipano con l’ingresso nel mercato o sono spiegati dall’innovazione e dagli investimenti corretti per il rischio.

H5 — L’accesso all’IA di frontiera produce vantaggi economici e formativi misurabili.

L’ipotesi H5 verrà testata tramite confronti appaiati o randomizzati laddove esistano dati credibili. I risultati includeranno l’accuratezza del compito, il tempo di completamento, i voti, la produzione di ricerca, la produttività della codifica, i ricavi e i tassi di errore. Il trattamento deve rappresentare l’accesso corretto per la qualità piuttosto che qualsiasi utilizzo dell’IA. La stima preferita è ATE = E[Y(1) − Y(0)], con controlli per capacità pregresse, istituzione, reddito e compito. L’ipotesi H5 verrà rifiutata per carichi di lavoro in cui sistemi più piccoli o più economici raggiungono risultati statisticamente equivalenti.

H6 — Gli utenti e i paesi a basso reddito sono sempre più limitati a sistemi con capacità ridotte

L’ipotesi H6 confronterà l’accesso ponderato per la qualità, e non solo la penetrazione di Internet, tra le diverse fasce di reddito. I test utilizzeranno fattori quali l’accessibilità economica, i livelli di modello disponibili, le regioni cloud, il rapporto tra hardware e salari, l’affidabilità dell’elettricità, il supporto linguistico e le risorse di calcolo pubbliche per la ricerca. L’aumento delle restrizioni richiede un divario sempre maggiore nel tempo. L’ipotesi H6 verrà respinta se l’accesso a basso costo, i modelli aperti e le infrastrutture condivise causano una convergenza delle capacità dopo la ponderazione del potere d’acquisto.

H7 — L’attuale prezzo dei servizi di IA non riflette pienamente i costi infrastrutturali a lungo termine e potrebbe aumentare in modo significativo

L’ipotesi H7 stimerà i prezzi di pareggio del fornitore utilizzando ammortamento, finanziamento, energia, infrastrutture, rete, manodopera, formazione e utilizzo. Il rapporto di recupero dei costi sarà CRR p,t  = Ricavi AI,p,t  ÷ Costi Completamente Allocati AI,p,t . Poiché i dati del segmento pubblico sono incompleti, le stime saranno intervalli. L’ipotesi H7 sarà supportata se i prezzi ricorrenti rimangono al di sotto dei costi di lungo periodo in base a plausibili ipotesi di utilizzo e di sussidi incrociati. Sarà respinta se i prezzi attuali coprono i costi e il rendimento del capitale richiesto o se i costi unitari diminuiscono più rapidamente della pressione tariffaria.

H8 — L’accesso all’IA si sta evolvendo in una risorsa a prezzi dinamici e a consumo.

L’ipotesi H8 riguarda la progettazione del mercato piuttosto che il semplice aumento dei prezzi. Sarà supportata da una documentata evoluzione verso molteplici dimensioni di misurazione: classe del modello, intensità del ragionamento, latenza, durata del contesto, orario della domanda, geografia, prenotazione della capacità e priorità del servizio. Un indice dinamico di complessità dei prezzi conterà e pondererà le dimensioni di prezzo indipendenti. L’ipotesi H8 sarà respinta se i mercati convergeranno verso tariffe semplici, stabili, interoperabili e progressivamente più economiche.


1.15 Matrice di verifica delle ipotesi

Tabella 1.7 — Criteri di falsificazione

IpotesiVariabile dipendente primariaComparatore centraleSostieni gli spuntiniCondizione di rifiutoRischio principale
H1Indice dei prezzi dell’hardware per l’intelligenza artificialeIndice dell’elettronica di consumocrescita cumulativa statisticamente più elevataLa crescita ponderata per la qualità è uguale o inferioreDistorsione nella selezione del prodotto
H2Costo reale per attività a capacità fissaSoglia di riferimento costanteAumento reale significativo in base alle specifiche robusteDiminuiscono i costi reali delle attivitàDeriva di riferimento
H3Premio e durata del mercato dell’usatovalore equo rettificato per l’ammortamentoPremio persistente su più mercati con transazioni confermatePremium di breve durata o solo per l’inserzioneSelezione e annunci falsi
H4rendimento in eccesso corretto per il rischioParametro di riferimento del settore competitivoRendimento eccessivo persistente associato a concentrazione e ingresso deboleRendimenti spiegati da innovazione, rischio o cicloErrore nella definizione del mercato
H5Produttività o risultato educativoAccesso comparabile non di frontieraEffetto del trattamento statisticamente ed economicamente significativo.Risultati equivalenti ottenuti con sistemi a costi inferioriAutoselezione dell’utente
H6divario di accesso corretto per la qualitàGruppi di reddito e regionaliIl divario si allarga nel periodo 2026-2031.Convergenza dopo PPP e aggiustamento della qualitàMancanza di dati sui redditi più bassi
H7rapporto di recupero dei costiCosto di lungo periodo completamente allocatoRapporto inferiore a 1 in base alle ipotesi centraliI prezzi attuali coprono i costi e il rendimento del capitale.Conti del segmento opaco
H8Indice di complessità dei prezziStruttura tariffaria storicaDimensioni e livelli di capacità con prezzi più indipendentiSemplificazione e mercificazioneRiservatezza contrattuale

1.16 Mappa della ricerca: ipotesi, dati e capitoli successivi

Tabella 1.8 — Architettura di ricerca completa

IpotesiSet di dati richiestoFrequenza minimaMetodoTest di robustezzaSviluppato in
H1Prezzo di lancio consigliato dal produttore, prezzi ufficiali attuali, prezzi di transazione verificati, specifiche e indici dell’elettronica.Mensile o trimestrale, 2020–2031Regressione dei prezzi edonici e indice del modello abbinatoMisure di qualità alternative ed effetti fissi geograficiCapitolo 2
H2Costo totale di proprietà (TCO) dell’hardware, prezzi delle API, benchmark, costi dell’elettricità e della revisione umana.Trimestrale o annualeFrontiera dei costi per attività completata con successoParametri di riferimento alternativi, quantificazione e utilizzoCapitoli 2, 4 e 5
H3Transazioni di seconda mano verificate, età, condizioni, garanzia e nuova disponibilitàSettimanale o mensileModelli di studio di durata premium e di eventiAnnunci rispetto alle transazioni completateCapitolo 2
H4Quote di segmento, CR₄, HHI, margini, ROIC, WACC, ingresso e capacitàTrimestrale o annualeRegressione a pannello, reddito residuo e studio degli eventiAdeguamento del capitale immateriale e definizioni di mercatoCapitolo 3
H5Accesso a livello utente, risultati delle attività, tempo, errori e variabili di contestoSperimentale o panelRCT, matching o differenza nelle differenzeCompiti placebo ed effetti eterogeneiCapitolo 7
H6Reddito, accessibilità economica dell’hardware, connettività, accesso al cloud, lingua e risorse di calcolo pubblicheAnnualeIndice composito, Gini, Theil e decomposizionePPP rispetto al tasso di cambio di mercato e ponderazioni alternativeCapitolo 8
H7Spese in conto capitale del fornitore, ammortamenti, energia, utilizzo, ricavi e tariffeTrimestraleModello di costi e punti di pareggio completamente allocatiUtilizzo del metodo Monte Carlo e ipotesi sulla durata utile degli assetCapitolo 5
H8Tariffe API pubbliche, contratti aziendali, prodotti prioritari e capacità riservataMensile o in base agli eventiTassonomia tariffaria e indice di complessitàConfronto tra fornitori e regioniCapitoli 5 e 9

Tabella 1.9 — Mappa delle dipendenze tra i capitoli

Capitolo successivoContributo alle ipotesi del Capitolo 1Produzione principale
Capitolo 2 — Inflazione dell’hardwareEsegue i test H1 e H3; fornisce input hardware per H2Indici dei prezzi nominali, reali e corretti per la qualità
Capitolo 3 — Concentrazione industrialeVerifica H4 e mappa la dipendenza a monteCR₄, HHI, barriere all’ingresso e scomposizione della rendita
Capitolo 4 — Il costo reale dell’IA localeVerifica la componente locale di H2 e H6Costo totale di proprietà (TCO) quinquennale specifico per il carico di lavoro
Capitolo 5 — L’economia dell’IA nel cloudTest H7 e H8 e componente cloud di H2Costo per operazione completata con successo e tariffe di pareggio
Capitolo 6 — Esposizione aziendaleTraduce H2, H7 e H8 in effetti a livello aziendaleCosti dell’IA, ritorno sull’investimento e vulnerabilità del settore
Capitolo 7 — Divario di capacitàTest H5 e componente individuale di H6Effetti del trattamento sull’istruzione e sulla produttività
Capitolo 8 — Disuguaglianza globaleTest a livello nazionale H6Indici globali di accesso all’IA e di sovranità computazionale
Capitolo 9 — PrevisioniTutti i progetti hanno sostenuto le relazioni fino al 2031Intervalli di scenario, intervalli di previsione e indicatori di allarme
Capitolo 10 — PoliticaRisponde solo ai fallimenti comprovati empiricamenteInterventi con costi definiti e indicatori chiave di prestazione (KPI) misurabili.

1.17 Registro delle prove preliminari

Tabella 1.10 — Cosa stabilisce il Capitolo 1 e cosa resta da dimostrare

PropostaStato attualeProve attualmente disponibiliProssimo test richiesto
Il calcolo basato sull’intelligenza artificiale dipende da molteplici livelli fisici e software complementari.Fatto concettuale stabilitoAnalisi della catena di approvvigionamento e dei colli di bottiglia della Commissione europeaQuantifica ogni strato
Gli investimenti nelle infrastrutture per l’IA sono eccezionalmente ingenti.StabilitoPiano di investimenti (capex) di Alphabet per il 2025 e avvio della Gigafactory europeaConfronta aziende, regioni e dati storici di riferimento
La fabbricazione avanzata e la domanda di HPC sono strategicamente importantiStabilitoComposizione dei ricavi di TSMCQuote globali e capacità alternative
L’energia può diventare un vincolo computazionale vincolanteFortemente sostenutoScenari di consumo dei data center del DOEModello regionale dei prezzi dell’energia e della connessione alla rete
L’adozione dell’IA varia notevolmente in base alle dimensioni dell’azienda.Correlazione stabilitaIndagine Eurostat 2025Identificare i contributi causali di costi, competenze e scala
La connettività globale rimane fortemente disegualeStabilitoIndicatori ITU 2025Estendere la connettività all’accesso all’intelligenza artificiale con qualità controllata.
In termini reali, l’hardware per l’intelligenza artificiale è diventato universalmente più costoso.Non dimostratoNon esiste ancora un indice dei prezzi completo corretto per la qualità.Capitolo 2
L’hardware AI usato viene sistematicamente scambiato a un prezzo doppio o triplo rispetto al prezzo di lancio.Non dimostratoRichiede prove a livello di transazioneCapitolo 2
La concentrazione dei fornitori causa prezzi illegaliNon dimostratoLa concentrazione e gli alti margini non sono sufficientiCapitolo 3
Gli attuali prezzi dei token sono insostenibiliNon dimostratoL’allocazione dei costi specifici per fornitore è incompletaCapitolo 5
L’accesso alle frontiere migliora tutti i risultati in ambito educativo e professionale.Non dimostrato e probabilmente dipendente dal compitoRichiede prove di esito causaleCapitolo 7
Le popolazioni a basso reddito sono intrappolate permanentemente in un’intelligenza artificiale inferioreNon dimostratoLe lacune in termini di connettività e adozione aziendale supportano l’indagineCapitolo 8
La potenza di calcolo verrà scambiata come Bitcoin.Economicamente sopravvalutatoÈ possibile riservare una certa capacità e applicare prezzi dinamici.Capitoli 5 e 9

1.18 Conclusione del capitolo

La potenza di calcolo dell’IA dovrebbe essere intesa come un’istituzione economica ibrida: un input industriale quando viene consumato, un bene capitale quando viene posseduto, un servizio di pubblica utilità quando viene erogato tramite il cloud, un’infrastruttura strategica quando da essa dipendono funzioni essenziali, una risorsa geopolitica quando l’accesso è controllato a livello giurisdizionale e una capacità potenzialmente finanziarizzabile quando la disponibilità futura è riservata o monetizzata. Questa natura ibrida spiega perché l’analisi convenzionale dell’elettronica di consumo sia insufficiente. Il prezzo di un laptop non può rivelare il costo totale dell’IA a livello locale; una tariffa simbolica non può rivelare l’economia infrastrutturale a lungo termine; un dato sulle spedizioni globali non può rivelare l’offerta politicamente accessibile; e un tasso di penetrazione di Internet non può rivelare l’accesso alle capacità di frontiera.

Le prime evidenze stabiliscono quattro condizioni che giustificano il rapporto. In primo luogo, la mobilitazione di capitali sta avvenendo su una scala tale da poter avvantaggiare un numero ristretto di imprese e Stati in grado di finanziare le infrastrutture prima che la domanda si concretizzi pienamente. In secondo luogo, la catena contiene nodi complementari – logica avanzata, HBM, packaging, networking ed energia – dove la sostituzione può essere lenta. In terzo luogo, l’adozione da parte delle imprese varia già notevolmente in base alle dimensioni dell’azienda, sebbene non sia ancora stata stabilita una relazione causale. In quarto luogo, la connettività globale e le disuguaglianze di reddito costituiscono una struttura preesistente attraverso la quale la disuguaglianza nell’IA può essere trasmessa. Nessuna di queste condizioni dimostra una scarsità artificiale, un abuso monopolistico o un’inevitabile escalation dei prezzi. L’obiettivo scientifico centrale dei capitoli successivi è determinare se il sistema osservato rifletta un ciclo di investimenti temporaneo seguito da una diminuzione dei costi ponderati per la qualità, oppure un’architettura persistente in cui il controllo concentrato e il potere d’acquisto ineguale trasformano l’intelligenza in una risorsa economica razionata.

Le otto ipotesi del rapporto sono volutamente falsificabili. H1 e H2 separano l’inflazione dei prezzi di listino dal costo della capacità fissa. H3 distingue la scarsità duratura dalla speculazione di seconda mano. H4 separa la concentrazione dalla rendita economica dimostrabile. H5 misura il vantaggio anziché presupponerlo. H6 converte l’idea di un divario nell’IA in una distribuzione comparativa dell’accesso. H7 verifica se le tariffe attuali recuperano i costi a lungo termine. H8 identifica se la misurazione sta diventando multidimensionale e dinamica. Insieme, queste ipotesi creano un programma di ricerca in grado di confermare, respingere o qualificare l’avvertimento centrale del rapporto, senza trasformare una legittima preoccupazione in una conclusione predeterminata.

Avevi ragione riguardo all’errore di formattazione nel Capitolo 1. Tutti gli indici matematici qui sotto utilizzano <sub>tag HTML. Le etichette delle ipotesi, come H1, H2 e H3, rimangono testo normale.

Capitolo 2 — Inflazione dell’hardware: GPU, memoria, computer e mercato dell’usato

2.1 Ambito di applicazione, standard probatorio e conclusione principale

Questo capitolo verifica se l’hardware rilevante per l’IA sia diventato strutturalmente meno accessibile tra il 2020 e il 2026 e se l’aumento osservato rappresenti inflazione nominale, inflazione ponderata per la qualità, scarsità temporanea, distorsione dei prezzi a livello regionale o comportamento speculativo di rivendita. La prima conclusione è metodologicamente decisiva: non esiste un unico “prezzo dell’hardware per l’IA”. Una GPU per il mercato consumer, un acceleratore professionale, un server per data center, una workstation Apple con molta memoria e un laptop con capacità di IA offrono diverse combinazioni di capacità di memoria, larghezza di banda, throughput di calcolo, efficienza energetica, compatibilità software, portabilità, garanzia e durata utile. Un confronto di prezzo valido deve quindi preservare o la configurazione del prodotto o la capacità di elaborazione. Confrontare il prezzo di lancio di una GPU del 2020 con il prezzo di una GPU del 2025 tecnicamente diversa senza tenere conto delle capacità può esagerare o nascondere l’inflazione. Di conseguenza, il capitolo distingue quattro oggetti: il prezzo di acquisto nominale; il prezzo ponderato per l’inflazione generale; il prezzo ponderato per le specifiche; e il costo per completare un carico di lavoro di IA costante.

La sequenza di punta verificata di NVIDIA illustra la differenza. La GeForce RTX 3090 è stata lanciata a settembre 2020 a 1.499 dollari , la RTX 4090 a ottobre 2022 a 1.599 dollari e la RTX 5090 a gennaio 2025 a 1.999 dollari . Il prezzo di ingresso nominale della top di gamma è quindi aumentato del 33,4% tra la RTX 3090 e la RTX 5090. Tuttavia, la capacità di memoria è aumentata da 24 GB a 32 GB , mentre la larghezza di banda ufficiale della memoria è passata da circa 936 GB/s a 1.792 GB/s . Una volta convertiti i prezzi di lancio in dollari di luglio 2026 utilizzando l’indice dei prezzi al consumo statunitense, il prezzo di lancio reale stimato aumenta di circa il 9% , mentre il prezzo reale per GB di memoria acceleratrice diminuisce di circa il 18% e il prezzo reale per GB/s di larghezza di banda diminuisce di oltre il 40% . Questi calcoli non dimostrano che l’IA sia diventata più economica in termini pratici, perché la capacità di memoria e la larghezza di banda da sole non misurano la qualità del modello, l’overhead del software, la lunghezza del contesto, il costo energetico o i token al secondo. Dimostrano però che l’affermazione “le GPU di fascia alta sono diventate due o tre volte più costose” non è rappresentativa della sequenza di prezzi di listino consigliati (MSRP) verificata delle schede grafiche di punta NVIDIA Founders Edition. Presentazione delle schede grafiche GeForce RTX serie 30 – NVIDIA – Settembre 2020 NVIDIA offre un salto quantico nelle prestazioni e introduce una nuova era del rendering neurale con la serie GeForce RTX 40 – NVIDIA – Settembre 2022 La serie NVIDIA Blackwell GeForce RTX 50 apre un nuovo mondo di grafica computerizzata per l’IA – NVIDIA – Gennaio 2025

Tale risultato si applica solo al prezzo di listino al lancio e a denominatori tecnici selezionati. Non descrive i prezzi effettivi di vendita al dettaglio, la disponibilità durante le finestre di lancio, i sovrapprezzi dei partner, le tasse, i costi di importazione o le transazioni di seconda mano. In base al protocollo di prova che regola questo rapporto, un prezzo richiesto non può essere rappresentato come una transazione, una singola inserzione non può stabilire una mediana e un annuncio su un marketplace non può provare che un prodotto sia stato venduto. Nessun produttore ufficiale, agenzia statistica governativa o documento aziendale certificato pubblica una serie internazionale completa 2020-2026 dei prezzi delle GPU usate a livello di transazione. Di conseguenza, le mediane del mercato dell’usato richieste per Stati Uniti, UE, Regno Unito, Cina, Giappone, India, Brasile e mercati a basso reddito sono contrassegnate con ND – non divulgate o non verificabili secondo la gerarchia delle fonti consentita . Non si tratta di un dettaglio mancante che può essere responsabilmente colmato con stime: è una limitazione sostanziale dei dati. L’affermazione secondo cui l’hardware AI usato ordinario viene sistematicamente venduto a due o tre volte il prezzo di listino originale rimane non provata finché non saranno ottenuti, ripuliti e verificati i microdati delle transazioni completate.


2.2 Concetti di prezzo e architettura di misurazione

L’inflazione hardware deve essere scomposta in almeno sette componenti:

  1. inflazione monetaria generale;
  2. cambiamento nella qualità tecnica;
  3. cambiamento di posizione del prodotto all’interno della gamma del produttore;
  4. variazioni di imposte, tariffe e tassi di cambio;
  5. scarsità temporanea;
  6. margine del distributore o del rivenditore;
  7. premi di rivendita speculativi o eccezionali.

Il prezzo locale osservato può essere rappresentato come:

osservato,i,r,t = P base,i,t × FX r,t × (1 + Imposta r,t ) × (1 + Tariffa r,t ) × (1 + Distribuzione i,r,t ) × (1 + Scarsità i,r,t ) × (1 + Speculazione i,r,t )

Dove:

  • osservato,i,r,t è il prezzo osservato del prodotto i nella regione r e nel periodo t;
  • base,i,t è il prezzo di riferimento del produttore;
  • FX r,t è il fattore di conversione del tasso di cambio applicabile;
  • L’imposta r,t comprende l’IVA, l’imposta sulle vendite e altri oneri obbligatori;
  • La tariffa r,t comprende i dazi doganali e le spese di importazione;
  • La distribuzione i,r,t rappresenta il margine all’ingrosso e al dettaglio;
  • La scarsità i,r,t misura il premio associato allo squilibrio tra domanda e offerta;
  • La speculazione i,r,t è il premio residuo non spiegato dalla distribuzione ordinaria e dalla scarsità.

Questa formulazione moltiplicativa impedisce che le imposte e le variazioni valutarie vengano erroneamente classificate come inflazione di produzione. Evita inoltre di considerare il prezzo di listino statunitense al netto delle imposte come direttamente comparabile con un prezzo al consumo nell’UE che normalmente include l’IVA. Un prezzo di 2.000 euro nell’UE, IVA al 22% inclusa, non è economicamente equivalente a un prezzo di 2.000 dollari negli Stati Uniti, imposte escluse. I confronti geografici devono escludere le imposte recuperabili per gli acquirenti aziendali, mantenere le imposte per l’analisi della capacità di spesa delle famiglie e utilizzare, ove opportuno, sia i tassi di cambio di mercato sia le conversioni basate sulla parità di potere d’acquisto.

Tabella 2.1 — Campi obbligatori relativi al prezzo e stato probatorio

CampoDefinizioneprove accettabiliStato attuale
data di lancioPrima disponibilità commerciale ufficialeAnnuncio del produttoreVerificabile
Prezzo di lancio consigliato o SEPPrezzo di lancio consigliato dal produttoreComunicato ufficiale del produttoreVerificabile per molti prodotti di consumo
Prezzo ufficiale attualePrezzo diretto attualmente visualizzato dal produttoreNegozio ufficiale del produttore o pagina prodotto ufficialeVerificabile solo al momento della pubblicazione
Prezzo di stradaPrezzo effettivo della transazione presso il rivenditore autorizzatoTransazioni di vendita al dettaglio verificate o dati ufficiali degli scanner statisticiGeneralmente non disponibile
Prezzo richiestoImporto richiesto dal venditoreAnnuncio sul marketplaceTransazione osservabile ma non completata.
Prezzo di transazione utilizzatoImporto pagato a seguito di una vendita conclusaMicrodati relativi alla vendita conclusaNon disponibile entro i limiti attuali delle risorse.
mediana del mercato dell’usatoMediana delle transazioni completate e puliteSet di dati rappresentativo delle transazioniND
prezzo corretto per l’inflazionePrezzo convertito in valuta a periodo costanteIndice dei prezzi al consumo (CPI) nazionale ufficiale o HICPCalcolabile
prezzo adeguato alla qualitàPrezzo diviso per una misura di capacità stabileDati verificati relativi a prezzi e specifiche tecniche.Parzialmente calcolabile
Prezzo adeguato al carico di lavoroCosto per carico di lavoro costante eseguito correttamenteBenchmark riproducibile e TCO completoRichiede il test del Capitolo 4
Stato della garanziaCopertura del produttore trasferibile rimanenteProve a livello di serie o di fatturaNon è possibile dedurre nulla per gli annunci aggregati di articoli usati
premio regionalePrezzo locale al netto delle imposte rispetto al prezzo di riferimento comunePrezzi regionali ufficiali, tassi di cambio e dati fiscaliRichiede la corrispondenza della configurazione

2.3 Storico dei prezzi delle GPU per i consumatori (dati verificati, 2020-2026)

2.3.1 Sequenza di punta NVIDIA

La tabella seguente utilizza solo i prezzi di lancio e le specifiche tecniche pubblicati dal produttore. La conversione in dollari di luglio 2026 utilizza l’indice CPI-U statunitense per tutti i beni. I valori CPI di settembre 2020, ottobre 2022 e gennaio 2025 sono allineati ai rispettivi mesi di lancio, mentre luglio 2026 è il mese di valutazione comune. Il Bureau of Labor Statistics riporta un livello CPI-U di luglio 2026 pari a 333,918 , basato sul periodo 1982-1984 = 100. Riepilogo dell’indice dei prezzi al consumo, luglio 2026 – US Bureau of Labor Statistics – agosto 2026. La formula di adeguamento all’inflazione è:

2026,i = P lancio,i × CPI luglio 2026 ÷ CPI mese di lancio,i

Tabella 2.2 — Cronologia verificata dei lanci delle schede grafiche di punta NVIDIA

ProdottoLancio ufficialePrezzo di lancio consigliato negli Stati UnitiMemoriaLarghezza di banda ufficiale/derivataAlimentazione della schedaPrezzo consigliato al pubblico (MSRP) di luglio 2026 dollariPrezzo reale per GBPrezzo reale per GB/s
GeForce RTX 309024 settembre 2020$1.49924 GB GDDR6X≈936 GB/s350 W≈$1.923≈$80,13≈$2,05
GeForce RTX 409012 ottobre 2022$1.59924 GB GDDR6X1,008 GB/s450 W≈$1.792≈$74,67≈$1,78
GeForce RTX 509030 gennaio 2025$1.99932 GB GDDR71,792 GB/s575 W≈$2.102≈$65,69≈$1,17

Interpretazione: il prezzo di lancio nominale è aumentato del 33,4% passando dalla RTX 3090 alla RTX 5090. In dollari di luglio 2026, l’aumento stimato è di circa il 9%. Il prezzo reale per GB installato è diminuito da circa 80 a 66 dollari, e il prezzo reale per GB/s di larghezza di banda della memoria è diminuito da circa 2,05 a 1,17 dollari. Il consumo energetico assoluto è tuttavia aumentato in modo sostanziale, il che significa che l’efficienza del prezzo di acquisto non può essere considerata equivalente all’efficienza dei costi operativi. La RTX 5090 offre più memoria e larghezza di banda, ma richiede un alimentatore più esigente, genera una maggiore densità di calore e potrebbe aumentare il costo totale del sistema. La sua capacità di 32 GB rimane inoltre ben al di sotto della memoria richiesta da molti modelli con parametri elevati, maggiore precisione o con cache KV di grandi dimensioni.

NVIDIA specifica ufficialmente che la RTX 5090 ha 32 GB GDDR7 e una larghezza di banda di memoria di 1.792 GB/s . La RTX 4090 ha 24 GB GDDR6X , una larghezza di banda di 1.008 GB/s e un consumo energetico totale di 450 W. Specifiche GeForce RTX 5090 – NVIDIA – Gennaio 2025 Specifiche GeForce RTX 4090 – NVIDIA – Settembre 2022 L’annuncio di lancio della RTX 3090 riporta 24 GB GDDR6X e un prezzo di partenza di $ 1.499 . Presentazione delle schede grafiche GeForce RTX serie 30 – NVIDIA – Settembre 2020

Tabella 2.3 — Variazioni nelle diverse generazioni delle schede grafiche di punta NVIDIA

metricoRTX 3090 → RTX 4090RTX 4090 → RTX 5090RTX 3090 → RTX 5090
Prezzo di lancio nominale consigliato+6,7%+25,0%+33,4%
Memoria installata0,0%+33,3%+33,3%
larghezza di banda della memoria≈+7,7%+77,8%≈+91,5%
Alimentazione della scheda+28,6%+27,8%+64,3%
Prezzo di lancio effettivo in dollari (luglio 2026)≈−6,8%≈+17,3%≈+9,3%
Prezzo reale per GB≈−6,8%≈−12,0%≈−18,0%
Prezzo reale per GB/s≈−13,2%≈−34,3%≈−43,0%

La sequenza RTX supporta quindi una conclusione più sfumata che categorica. Il costo per entrare nell’attuale categoria di punta è aumentato bruscamente in termini nominali, ma l’accessibilità economica, rapportata alle specifiche, è migliorata in termini di capacità di memoria e larghezza di banda. Allo stesso tempo, la spesa minima assoluta è aumentata: un acquirente ha ancora bisogno di circa 2.000 dollari tasse escluse solo per la GPU di riferimento di punta, escludendo computer, memoria di sistema ad alta capacità, archiviazione, raffreddamento e alimentatore. La deflazione ponderata per la qualità può coesistere con un peggioramento della disuguaglianza di accesso, perché un prezzo inferiore per unità di capacità non aiuta una famiglia che non può permettersi l’acquisto minimo più elevato.


2.4 Controfattuale GPU AMD per consumatori

AMD fornisce un essenziale termine di paragone competitivo perché le modifiche apportate alla serie di punta di NVIDIA non possono generare un’inflazione generalizzata sul mercato. La Radeon RX 7900 XTX è stata annunciata con un prezzo di vendita online consigliato di 999 dollari e 24 GB di GDDR6 , mentre la RX 9070 XT è stata lanciata con un prezzo di vendita online consigliato di 599 dollari e 16 GB di GDDR6 . AMD dichiara un consumo energetico totale di 355 W per la RX 7900 XTX e di 304 W per la RX 9070 XT . La RX 9070 XT ha una larghezza di banda di memoria ufficiale fino a 640 GB/s . AMD svela le schede grafiche da gioco più avanzate al mondo, basate sulla rivoluzionaria architettura AMD RDNA 3 – AMD – Novembre 2022 AMD svela l’architettura RDNA 4 di nuova generazione con il lancio delle schede grafiche AMD Radeon RX 9000 Series – AMD Investor Relations – Febbraio 2025 Specifiche della Radeon RX 9070 XT – AMD – 2025

Tabella 2.4 — Prodotti di riferimento AMD verificati

ProdottoDisponibilità al lancioSettembre USAMemoriaLarghezza di bandaAlimentazione della schedaPrezzo nominale per GBPrezzo nominale per GB/s
Radeon RX 7900 XTX13 dicembre 2022$99924 GB GDDR6960 GB/s355 W$41,63$1,04
Radeon RX 7900 XT13 dicembre 2022899 dollari20 GB GDDR6800 GB/s315 W$44,95$1,12
Radeon RX 9070 XT6 marzo 2025$59916 GB GDDR6640 GB/s304 W$37,44$0,94
Radeon RX 90706 marzo 2025$54916 GB GDDR6640 GB/s220 W$34,31$0,86

Questi rapporti di specifica non devono essere interpretati come equivalenti in termini di prestazioni LLM. NVIDIA e AMD differiscono per maturità del software, tipi di dati supportati, ottimizzazione del kernel, integrazione del framework e compatibilità delle applicazioni. Un prezzo nominalmente inferiore per GB non si traduce in un risparmio economico se l’applicazione richiesta non è in grado di utilizzare l’hardware in modo efficiente. Al contrario, escludere l’hardware non NVIDIA perché l’ecosistema software dominante favorisce NVIDIA oscurerebbe la misura in cui il lock-in dell’ecosistema, piuttosto che il costo fisico dei semiconduttori, determina il prezzo effettivo. Il Capitolo 4 misurerà pertanto sia la capacità fisica indipendente dall’hardware sia la capacità realizzata specifica per il carico di lavoro.


2,5 GPU per workstation professionali

Le GPU professionali si distinguono dai prodotti consumer per driver certificati, capacità di memoria, protezione dagli errori, supporto alla virtualizzazione, assistenza aziendale, garanzie e certificazione delle applicazioni. I loro prezzi non sono direttamente paragonabili a quelli delle schede grafiche da gioco GeForce o Radeon. Una scheda professionale può offrire una potenza di calcolo nominale inferiore per dollaro, ma risultare economicamente più vantaggiosa laddove i tempi di inattività, la certificazione o l’integrità della memoria comportino costi elevati. La formula rilevante è:

EACi = PurchasePricei + ExpectedDowntimeLossi + FailureRiskCosti + SoftwareIncompatibilityCosti − WarrantyValuei

Dove EAC rappresenta il costo rettificato previsto. Una GPU per il mercato consumer può sembrare sostanzialmente più economica finché non si considerano i costi derivanti da implementazioni non supportate, interruzioni dell’attività o memoria limitata.

Tabella 2.5 — Requisiti dati per GPU professionali

VariabileScheda utenteTessera professionaleRegolazione necessaria
Capacità di memoriaSolitamente più bassoSpesso materialmente più altoPrezzo per usufruibile GB
ECC o protezione dagli erroriLimitato o dipendente dal prodottoPiù comunemente supportatoAdeguamento del costo dell’errore previsto
Certificazione di guidaApplicazioni per i consumatoriCertificazione professionale per l’applicazioneValore di compatibilità del flusso di lavoro
VirtualizzazioneRistretto o limitatoorientato all’impresaValore di utilizzo multiutente
GaranziaTermini per i consumatoriTermini di supporto professionaleValore atteso del servizio
Orizzonte di disponibilitàGenerazione di vendita al dettaglio più breveSpesso un ciclo di vita aziendale più lungoSostituzione e standardizzazione della flotta
Informativa sui prezziSolitamente il prezzo di listino consigliato al pubblicoSpesso basato su rivenditori o preventiviLe differenze di prezzo ufficiali devono rimanere ND
Idoneità al Master in Diritto (LLM)Forte se supportato dal softwarePiù performante per carichi di lavoro che richiedono un’elevata quantità di memoria.Token al secondo e test di concorrenza

Non è possibile ricostruire uno storico completo dei prezzi delle GPU professionali a partire dai documenti aziendali certificati, poiché i produttori non pubblicano sistematicamente i prezzi di transazione specifici per ogni configurazione. I prezzi indicati nei preventivi non devono essere convertiti in prezzi di listino inventati. Il Capitolo 2, pertanto, considera la misurazione dei prezzi professionali come un’attività controllata di acquisizione dati, anziché come un semplice inserimento nella tabella di valori non verificati forniti dai rivenditori.


2.6 Acceleratori per data center e server di intelligenza artificiale

Gli acceleratori per data center rappresentano il problema maggiore in termini di trasparenza dei prezzi. Il dibattito pubblico spesso attribuisce prezzi unitari a prodotti come gli acceleratori NVIDIA H100, H200, B200 o AMD Instinct, ma i prezzi di transazione dei produttori dipendono dal volume, dalla configurazione del sistema, dalla rete, dall’assistenza, dai termini di consegna e dagli accordi con i clienti. Il prezzo di un singolo acceleratore è economicamente incompleto perché i grandi sistemi di training e inferenza vengono venduti come piattaforme integrate contenenti processori, HBM, rete, switch, raffreddamento, storage, rack e software. In base alle regole di citazione del rapporto, le stime non ufficiali non possono essere presentate come prezzi verificati.

Tabella 2.6 — Trasparenza dei prezzi degli acceleratori per data center

Categoria di prodottoSpecifiche tecniche ufficialiPrezzo di vendita al dettaglio per produttore pubblicoPrezzo medio di transazione osservabile e verificatoTrattamento analitico
Acceleratore di IA individualeSolitamente disponibileIn generale NDNDSolo specifiche
Server multi-GPUConfigurazione disponibileA volte basato su citazioniNDÈ necessario un preventivo per l’intero sistema.
Rack integratoArchitettura disponibileSolitamente NDNDPrezzo per capacità consegnata
Istanza di acceleratore cloudTariffa pubblica spesso disponibilePrezzo del servizio, non prezzo dell’hardware.Parzialmente osservabileCosto per ora di utilizzo dell’acceleratore
capacità cloud riservataSpecifico del contrattoRaramente completamente pubblicoNDAnalisi di scenario o di contratto rivelato
Cluster di IA sovranaSpecifico per gli appaltiA volte pubblico tramite gara d’appaltoPotenzialmente osservabileConfronto gara d’appalto

Per l’hardware dei data center, l’unità di prezzo preferita non è il dollaro per acceleratore, bensì il costo livellato per carico di lavoro completato con successo:

LCW w = [CAPEX × CRF + OPEX annuali ] ÷ Carichi di lavoro di successo annuali,w

Il fattore di recupero del capitale è:

CRF = r(1 + r) n ÷ [(1 + r) n − 1]

Dove r è il tasso di sconto annuo e n la vita economica in anni. CAPEX include i sistemi di accelerazione, la rete, le modifiche alle infrastrutture e l’installazione. OPEX include energia, raffreddamento, manutenzione, software, manodopera specializzata, assicurazione e tempi di inattività. Un prezzo di acquisto inferiore dell’acceleratore potrebbe non ridurre il LCW se l’utilizzo, il supporto software o le prestazioni di rete sono inferiori.

Il documento annuale di NVIDIA per l’anno fiscale 2026 identifica l’azienda come fornitore di infrastrutture di calcolo complete e dichiara di dipendere da fonderie e altri fornitori per la produzione. Non fornisce un prezzo unitario standard realizzato per le GPU per data center. Rapporto annuale di NVIDIA sul modulo 10-K per l’anno fiscale terminato il 25 gennaio 2026 – NVIDIA e US Securities and Exchange Commission – febbraio 2026. Questa assenza è di per sé economicamente rilevante: gli acquirenti aziendali operano in un mercato negoziato, mentre le famiglie acquistano prodotti al dettaglio trasparenti.


2.7 Inflazione della memoria: HBM, DRAM e NAND

La memoria deve essere suddivisa in tre mercati. La DRAM convenzionale fornisce la memoria di sistema; la NAND fornisce la memoria persistente; la HBM fornisce l’estrema larghezza di banda richiesta dagli acceleratori ad alte prestazioni. I loro prezzi non si muovono allo stesso modo perché la complessità produttiva, la domanda, la qualificazione e i mercati finali differiscono. La HBM consuma più capacità di wafer per bit consegnato rispetto alla DRAM convenzionale e richiede un’integrazione di packaging avanzata. Un passaggio della capacità produttiva verso la HBM può quindi ridurre l’offerta di memoria convenzionale anche quando gli investimenti totali in memoria aumentano.

La struttura di misurazione minima è:

MPI m,t = Σw j,0 × P j,t ÷ P j,0 × 100

Dove MPI è l’indice dei prezzi della memoria per la classe di memoria m, P è il prezzo del contratto o della transazione verificato e w è il peso della quantità del periodo base. Un indice concatenato è preferibile quando le generazioni di prodotto cambiano rapidamente. Una media non ponderata dei prezzi dei moduli pubblicizzati non sarebbe valida perché sovrarappresenterebbe i prodotti con molte inserzioni e ignorerebbe i volumi delle transazioni.

Tabella 2.7 — Quadro di riferimento per la misurazione del mercato delle memorie

segmento di memoriaPrincipali ruoli dell’IAUnità appropriataControlli di qualità richiestiIndicatore di scarsità primaria
HBM2e/HBM3/HBM3E/HBM4Larghezza di banda e capacità dell’acceleratorePrezzo per stack, GB e GB/sGenerazione, altezza dello stack, larghezza di banda e qualificazioneCapacità contrattuale e tempi di consegna
DRAM del serverHosting, preelaborazione e database dei modelli lato CPUPrice per GBGenerazione DDR, velocità, ECC e tipo di moduloPrezzo contrattuale e inventario
DRAM per il mercato consumerMemoria di sistema della workstation localePrice per GBGenerazione, velocità e latenza della memoria DDRPrezzo di transazione al dettaglio
NAND aziendaleArchiviazione dei modelli, set di dati e checkpointPrezzo per TB e per unità di durataInterfaccia, durata, latenza e garanziaPrezzo contrattuale e utilizzo
NAND per consumatoriArchiviazione del modello localePrezzo per TBInterfaccia, resistenza e prestazioniPrezzo di transazione al dettaglio

Nel dicembre 2025, Micron ha previsto che il mercato potenziale totale delle memorie HBM potesse crescere da circa 35 miliardi di dollari nel 2025 a circa 100 miliardi di dollari nel 2028 , il che implica un tasso di crescita annuo composto di circa il 40%. Si tratta di una previsione aziendale, non di un risultato di mercato osservato. Risultati finanziari del primo trimestre fiscale 2026 di Micron – Micron Technology – dicembre 2025. Samsung ha annunciato l’intenzione di investire oltre 110 trilioni di won coreani in impianti e ricerca e sviluppo nel corso del 2026, inclusi HBM, attività di fonderia e packaging avanzato. Piano di valorizzazione per gli azionisti di Samsung Electronics – Samsung Electronics – marzo 2026. Queste informazioni supportano la rapida domanda e gli investimenti, ma non forniscono uno storico pubblico e verificabile del prezzo per GB delle memorie HBM. Di conseguenza, il capitolo non crea una serie storica dei prezzi delle memorie HBM.

Tabella 2.8 — Cosa si può verificare per la memoria

Variabile richiestaHBMDRAMNAND
Generazione ufficiale del prodotto
Commento sulla capacità produttiva del produttore
Ricavi del segmento sottoposti a revisione contabileSpessoSpessoSpesso
Prezzo unitario ponderato per le transazioni pubblicheGeneralmente noGeneralmente noGeneralmente no
prezzo mediano di mercato internazionaleNONONO
Mediana del mercato dell’usato completatoNon ha senso per i chip; noNONO
indice pubblico corretto per la qualitàRichiede un set di dati di transazione esternoRichiede un set di datiRichiede un set di dati
Proiezione quinquennaleSolo basato su scenariSolo basato su scenariSolo basato su scenari

2.8 CPU, NPU e il problema dell’incomparabile throughput dell’IA

L’avvento delle NPU integrate cambia la definizione di computer in grado di eseguire IA. Un laptop può eseguire determinate attività di inferenza locale senza una GPU dedicata, ma le prestazioni in TOPS di una NPU non possono essere confrontate direttamente con i TFLOPS di una GPU o con le prestazioni in TOPS di un acceleratore AI. Il valore numerico dipende da precisione, sparsità, operatori supportati, architettura di memoria e carico di lavoro. Una NPU da 50 TOPS non offre necessariamente un cinquantesimo delle prestazioni utili di un acceleratore da 2.500 TOPS, perché il dispositivo più potente potrebbe utilizzare una precisione diversa, presupporre una sparsità strutturata o eseguire carichi di lavoro non supportati dalla NPU.

Il prezzo medio ponderato per la qualità di CPU/NPU è il seguente:

CPU-NPU,i,t QA = P sistema,i,t ÷ G(Q CPU , Q NPU , M, B, E, W)

Dove G è un aggregatore di capacità specifico per il carico di lavoro, M è la memoria accessibile, B la larghezza di banda, E l’efficienza energetica e W la compatibilità del software. Una media geometrica può impedire che un componente molto elevato diventi dominante:

i = ∏Q k,i wₖ

Con Σw k = 1.

Tabella 2.9 — Controlli di confronto CPU/NPU

ControllareMotivo
PrecisioneI valori INT4, INT8, FP8, FP16 e FP32 non sono intercambiabili.
SparsitàAlcuni valori di throughput pubblicizzati presuppongono una sparsità strutturata.
Alimentazione continuaLe prestazioni massime potrebbero non essere mantenute nei laptop sottili.
Memoria accessibileLa memoria condivisa può essere grande ma limitata dalla larghezza di banda
Supporto operatoreGli operatori non supportati potrebbero ripiegare sulla CPU o sulla GPU
Maturità del quadroL’hardware teorico potrebbe non avere percorsi software pratici
dimensione del lottoLa velocità di trasmissione e la latenza rispondono in modo diverso
Tipo di modelloI carichi di lavoro relativi a visione, audio e linguaggio utilizzano l’hardware in modo diverso.
Condizione termicaLe prestazioni a batteria e con alimentazione di rete possono differire
Prezzo del sistemaIl costo NPU integrato non può essere isolato in modo affidabile dal dispositivo

2.9 Computer Apple: variazioni di prezzo, memoria e configurazione

I sistemi Apple richiedono un’analisi a livello di configurazione piuttosto che a livello di marchio. Affermare che “Apple ha aumentato tutti i prezzi” non è scientificamente accettabile a meno che non vengano confrontate configurazioni identiche o edoniche per area geografica e data. Apple a volte ha aumentato i prezzi, li ha mantenuti stabili, li ha ridotti o ha aumentato la memoria inclusa. Ad esempio, il Mac mini M2 del 2023 partiva da 599 dollari , mentre l’iMac M4 del 2024 partiva da 1.299 dollari con 16 GB di memoria unificata . Questi prodotti non sono sostituti longitudinali, ma dimostrano perché le affermazioni sui prezzi a livello aziendale richiedono set di dati per famiglia di prodotti. Apple presenta il nuovo Mac mini con M2 e M2 Pro – Apple – Gennaio 2023 Apple presenta il nuovo iMac potenziato da M4 e Apple Intelligence – Apple – Ottobre 2024

Il MacBook Pro da 14 pollici del 2023 con M2 Pro partiva da 1.999 dollari , mentre la versione da 16 pollici partiva da 2.499 dollari . L’M2 Max supportava fino a 96 GB di memoria unificata con una larghezza di banda di 400 GB/s . Apple presenta il MacBook Pro con M2 Pro e M2 Max – Apple – Gennaio 2023. Il Mac Studio del 2025 con M4 Max poteva essere configurato con 128 GB di memoria unificata , mentre la versione con M3 Ultra offriva un’architettura diversa con maggiore capacità di memoria. Specifiche tecniche del Mac Studio 2025 – Apple – Marzo 2025.

Tabella 2.10 — Schema dati di Apple AI-Workstation

CampoDettagli di configurazione richiesti
Famiglia di prodottiMac mini, Mac Studio, MacBook Pro, iMac
ChipGenerazione e livello esatti
Core CPU/GPUConfigurazione esatta selezionata
Memoria unificataCapacità installata
larghezza di banda della memorialarghezza di banda specifica del chip
MagazzinaggioCapacità SSD installata
Prezzo di lancioPrezzo per la stessa configurazione
Prezzo attualeStessa geografia, trattamento fiscale e configurazione
carico di lavoro di intelligenza artificialeModello, quantizzazione, contesto e motore di inferenza
Token al secondoRisultato medio sostenuto dopo il riscaldamento
EnergiaMisurazione della potenza a muro
GaranziaCopertura standard ed estesa
AggiornabilitàVincoli di sostituzione della memoria e dello storage
Valore residuoSolo transazioni di rivendita verificate e completate.

Il vantaggio economico dei sistemi Apple con elevata memoria risiede nel fatto che la memoria unificata consente di realizzare modelli troppo grandi per una GPU consumer da 24 GB o 32 GB. Il limite, tuttavia, è che la capacità non determina la velocità, la compatibilità con i framework o la gestibilità a livello aziendale. Il prezzo per GB, pertanto, favorisce i sistemi con memoria unificata elevata solo quando il carico di lavoro può sfruttare l’architettura a un ritmo accettabile.


2.10 Dispositivi Samsung e concorrenti rilevanti

Samsung opera nei settori della produzione di memorie, dispositivi mobili, laptop e semiconduttori, distinguendosi economicamente da un produttore di soli dispositivi. Tuttavia, l’azienda non pubblica nei propri bilanci certificati una serie di prezzi per computer con intelligenza artificiale comparabili a livello globale. Nomi dei modelli, processori, configurazioni di memoria, tempistiche di lancio, pacchetti promozionali e tasse variano da paese a paese. Un confronto valido dei prodotti Samsung deve quindi utilizzare i prezzi di lancio ufficiali esatti per ogni singolo SKU ed escludere i crediti di permuta temporanei, a meno che il valore di permuta non venga calcolato separatamente.

Tabella 2.11 — Campioni richiesti da Samsung e dalla concorrenza

CategoriaFamiglia di prodotti SamsungConcorrenti richiestiUnità di confronto
Laptop premium con intelligenza artificialeClasse Galaxy Book Ultra/ProApple MacBook Pro, Dell Precision/XPS, Lenovo ThinkPad/Legion, HP ZBookCosto per carico di lavoro locale completato con successo
Dispositivo mobile basato sull’intelligenza artificialeClasse Galaxy S UltraApple iPhone Pro, Google Pixel ProCapacità di intelligenza artificiale sul dispositivo per prezzo reale
MemoriaDRAM/NAND/HBM SamsungMicron, SK hynixIndice dei prezzi contrattuali per generazione di memoria
Archiviazione aziendaleSSD aziendali SamsungMicron e altri fornitori qualificatiCosto per TB corretto per la resistenza
Componente per workstation basato sull’intelligenza artificialeSistemi Samsung dotati di memoriaConfigurazioni di memoria concorrentiCosto per GB utilizzabile e larghezza di banda

Nessun aumento di prezzo di Samsung viene considerato confermato a meno che non vengano documentate configurazioni e aree geografiche identiche in due date diverse. Le modifiche al mix di prodotti, come ad esempio una maggiore memoria, processori diversi o funzionalità di intelligenza artificiale incluse, devono essere eliminate tramite aggiustamento edonico.


2.11 Computer portatili e workstation desktop ad alte prestazioni

I prezzi dei laptop presentano ulteriori problematiche di misurazione perché il nome della GPU non specifica completamente le prestazioni. I limiti di potenza delle GPU per dispositivi mobili variano a seconda del produttore e dello chassis; una GPU per laptop con la stessa denominazione di famiglia di un’altra potrebbe funzionare con un limite di potenza diverso. Anche il sistema di raffreddamento, la memoria di sistema, lo schermo, la batteria, l’archiviazione e la garanzia influiscono sul prezzo. L’unità corretta è un codice SKU completo, non una classe nominale di GPU.

Tabella 2.12 — Comandi obbligatori per i laptop

Variabilerequisito di misurazione
modello GPUDesignazione esatta della GPU mobile
potenza GPUPotenza configurata sostenuta, non solo portata massima consentita
VRAMCapacità e tipologia
RAM di sistemaCapacità, larghezza di banda e possibilità di aggiornamento
CPU/NPUModello esatto e profilo di alimentazione abilitato
RaffreddamentoBenchmark sostenuto dopo l’equilibrio termico
Modalità batteriaSeparato dal risultato collegato
DisplayRisoluzione e frequenza di aggiornamento come fattori determinanti del prezzo
MagazzinaggioCapacità e prestazioni
PesoControllo della portabilità
GaranziaValore di servizio atteso standardizzato
benchmark dell’IAStesso modello, precisione, contesto e motore di inferenza
GeografiaPrezzo al netto delle imposte e prezzo comprensivo di imposte
PromozioniRegistrato separatamente dal prezzo standard

Per le workstation desktop, al costo della GPU vanno aggiunti il ​​case, la scheda madre, l’alimentatore, il sistema di raffreddamento, la memoria, l’archiviazione e l’assistenza professionale. Una GPU da 1.999 dollari non crea un sistema AI locale da 1.999 dollari. Il prezzo della workstation è:

workstation = P GPU + P CPU + P RAM + P storage + P scheda madre + P alimentatore + P raffreddamento + P case + P sistema operativo + P assemblaggio + P garanzia


2.12 Misure dei prezzi corretti per la qualità

Nessun singolo denominatore è in grado di cogliere appieno le capacità dell’IA. Questo capitolo adotta pertanto sei misure complementari.

2.12.1 Prezzo per GB di memoria acceleratrice utilizzabile

i,t VRAM = P i,t ÷ M utilizzabile,i,t

La memoria utilizzabile deve escludere i costi generali di sistema, la riserva di memoria video e la frammentazione inutilizzabile. La memoria installata è accettabile solo per la tabella hardware preliminare.

2.12.2 Prezzo per GB/s di larghezza di banda della memoria

i,t BW = P i,t ÷ B i,t

Questo è rilevante per l’inferenza limitata dalla memoria, ma non include calcolo, caching o software.

2.12.3 Prezzo per TFLOP comparabile

i,t FLOP = P i,t ÷ F i,t,p

La precisione p deve essere identica. FP32 non può essere diviso per un valore di throughput FP16 o FP8.

2.12.4 Prezzo per token al secondo

i,t,m,c TPS = P system,i,t ÷ TPS i,m,c

Dove m rappresenta il modello e c la configurazione completa del benchmark.

2.12.5 Prezzo per unità di riferimento

i,t BENCH = P i,t ÷ Punteggio i,t

Sono ammessi solo i benchmark riproducibili in modo indipendente con impostazioni identiche.

2.12.6 Prezzo per carico di lavoro completato con successo

i,w SUCCESSO = TCO i,w ÷ N successo,i,w

Questo è l’indicatore economico preferito perché include affidabilità, tentativi, supervisione e costo totale.

Tabella 2.13 — Punti di forza e limiti delle metriche di qualità

metricoPunto di forza principaleDebolezza principale
Prezzo per GB installatoSemplice e pertinente al modello di adattamentoIgnora la velocità e la capacità utilizzabile
Prezzo per usufruibile GBMisura migliore della capacità del modelloRichiede la misurazione a livello di runtime
Price per GB/sCattura il movimento della memoriaIgnora il calcolo e il software
Prezzo per TFLOPCattura la velocità di elaborazione aritmeticaLa precisione e la scarsità possono trarre in inganno
Prezzo per token/sMisura di inferenza direttaModello e impostazioni specifici
Prezzo per punto di riferimentoConsente il confronto compositoLa progettazione del benchmark può falsare i risultati
Prezzo per operazione completata con successoIl più vicino all’utilità economicaCostoso da misurare e specifico per il carico di lavoro

2.13 Modello dei prezzi edonici

La principale specificazione edonica è:

ln(P i,r,t ) = α + Σ k=1 K β k X k,i,t + γ t + δ b + θ r + λ c + ε i,r,t

Dove:

  • i,r,t è il prezzo di transazione al netto delle imposte;
  • k,i,t contiene le caratteristiche tecniche;
  • γ t è l’effetto fisso temporale;
  • δ b è l’effetto fisso del marchio;
  • θ r è l’effetto fisso della regione;
  • λ c è la classe di condizione: nuovo, ricondizionato o usato;
  • ε i,r,t è il residuo.

Il vettore delle caratteristiche includerà:

  • memoria acceleratrice utilizzabile;
  • larghezza di banda della memoria;
  • produttività comparabile in termini di precisione;
  • consumo energetico;
  • età;
  • categoria di prodotto;
  • garanzia;
  • RAM di sistema;
  • magazzinaggio;
  • portabilità;
  • certificazione professionale;
  • ecosistema software;
  • condizione;
  • tipo di venditore;
  • imposta regionale;
  • tasso di cambio;
  • disponibilità verificata.

L’esponente della variabile fittizia temporale produce un indice dei prezzi corretto per la qualità:

HPI t = 100 × exp(γ t − γ base )

Se il modello viene stimato in forma logaritmica, l’interpretazione percentuale deve utilizzare exp(β) − 1 anziché trattare i coefficienti elevati come percentuali esatte.

Tabella 2.14 — Diagnostica del modello

DiagnosticTestRisposta richiesta
EteroschedasticitàBreusch – Pagano o BiancoErrori standard robusti
MulticollinearitàVIF e numero di condizioneUnire o rimuovere le variabili hardware ridondanti
Correlazione serialetest dei residui raggruppati nel tempoRaggruppamento per famiglia di prodotti e periodo
Endogeneità del marchioEffetti fissi e prodotti corrispondentiSensibilità del rapporto
Selezione del campioneDisponibilità e controlli del venditoreSelezione del peso o del modello
Forma funzionaleRESET e confronto splineUtilizzare termini non lineari laddove giustificato
Valori anomaliLeva finanziaria e distanza di CookVerificare, winsorizzare solo secondo la regola divulgata
Dati mancantiMappa delle persone scomparseImputazione multipla solo laddove giustificabile
Rotazione dei prodottiIndice concatenatoEvita di confrontare direttamente generazioni non corrispondenti
Deriva di riferimentoSuite di carichi di lavoro fissiBlocca il modello e le impostazioni all’interno della finestra di prova

2.14 Adeguamento all’inflazione e comparabilità geografica

Il prezzo reale nella valuta del periodo di riferimento è:

i,t→T reale = P i,t × CPI T ÷ CPI t

La variazione di prezzo reale è:

π i,t→T reale = [P i,T nominale ÷ P i,t→T reale − 1] × 100

Per un confronto transfrontaliero:

i,r,t comune = [P lordo,i,r,t ÷ (1 + IVA r,t )] ÷ FX r,t

L’accessibilità economica per le famiglie mantiene l’IVA:

HAI i,r,t = P lordo,i,r,t ÷ Reddito mensile disponibile mediano r,t

La sostenibilità aziendale elimina l’IVA recuperabile, ove applicabile:

EAI i,r,t = P net,i,r,t ÷ MedianMonthlyEnterpriseValueAdded r,t

Tabella 2.15 — Protocollo di normalizzazione geografica

MercatoFonte dell’inflazione al consumoTrattamento dei prezziTrattamento valutarioDistorsione principale
Stati UnitiBLS CPI-USolitamente l’imposta sulle vendite viene esclusa dal prezzo di listino consigliato, mentre per renderlo più accessibile si aggiunge l’imposta locale.base USDVariazioni dell’imposta sulle vendite statale e locale
Unione EuropeaEurostat HICPRegistrazione IVA inclusa e IVA nettaEUR e valuta locale, ove applicabile.Prezzi IVA e tariffe ufficiali regionali differenti
Regno UnitoIL NOSTRO CPIIVA inclusa e al netto dell’IVAGBP, poi valuta comuneMovimenti della sterlina e IVA
CinaÈ richiesto l’indice dei prezzi al consumo (CPI) nazionale ufficialeIncludi le imposte applicabiliCNY e valuta comuneDifferenze tra SKU locali e canali di distribuzione
GiapponeÈ richiesto l’indice dei prezzi al consumo (CPI) nazionale ufficialeIncludi l’imposta sui consumiJPY e valuta comuneVolatilità dello yen
IndiaÈ richiesto l’indice dei prezzi al consumo (CPI) nazionale ufficialeIncludi gli effetti dell’IVA e delle importazioniConfronto tra INR e PPPDazi all’importazione e differenziale di reddito
BrasileÈ richiesto l’indice dei prezzi al consumo (CPI) nazionale ufficialeIncludi le imposte indirette e i costi di importazioneConfronto tra BRL e PPPComplessità fiscale e volatilità valutaria
campione a basso redditoStatistiche nazionali o serie ufficiali internazionaliPrezzo lordo al consumoValuta locale, USD e PPPScarsa distribuzione formale e vincoli di reddito

Eurostat definisce l’IPCA come una misura comparabile delle variazioni dei prezzi al consumo delle famiglie nei paesi europei. Indici armonizzati dei prezzi al consumo – Eurostat – 2026. L’Ufficio di statistica del lavoro degli Stati Uniti (US Bureau of Labor Statistics) mantiene un indice specifico per computer, periferiche e dispositivi di assistenza per la casa intelligente e applica un aggiustamento qualitativo ai prodotti informatici in continua evoluzione. Come il BLS misura la variazione dei prezzi di computer, periferiche e dispositivi di assistenza per la casa intelligente – US Bureau of Labor Statistics – febbraio 2026.


2.15 Mercato dell’usato e del ricondizionato

Il premio per l’usato deve essere calcolato solo sulla base di transazioni comparabili e concluse:

UMP i,r,t = [P utilizzato,i,r,t − P riferimento,i,r,t ] ÷ P riferimento,i,r,t × 100

Il prezzo di riferimento dipende dalla domanda di ricerca:

  • Il lancio del test MSRP verifica se il prezzo dell’usato supera il prezzo nominale originale;
  • Il prezzo di listino corretto per l’inflazione verifica se supera il prezzo reale originale;
  • I nuovi test sui prezzi contemporanei verificano se l’hardware usato ha un prezzo irrazionale rispetto all’offerta di nuovo;
  • Il fair value corretto per l’ammortamento verifica se la scarsità compensa il normale invecchiamento;
  • Il test di prezzo basato sulla capacità di sostituzione verifica se il vecchio prodotto è più economico di un prodotto attuale equivalente.

Un’affermazione che indica un prezzo pari al doppio del prezzo di listino consigliato è:

Moltiplicatore MSRP = Prezzo utilizzato ÷ Prezzo di lancio MSRP

Ma questa non è una prova sufficiente di inflazione di mercato. Un prodotto fuori produzione in edizione limitata può avere valore da collezione; un articolo potrebbe non essere mai venduto; il prodotto potrebbe includere un sistema completo; le tasse potrebbero essere incluse in un prezzo ed escluse in un altro; oppure l’inserzione potrebbe essere fraudolenta.

Tabella 2.16 — Regole per la pulizia del mercato dell’usato

ProblemaTrattamento necessario
Prezzo richiesto rispetto al prezzo di venditaConserva solo le transazioni completate
Annuncio duplicatoElimina i duplicati per identificativo, venditore, immagine e data/ora
FascioSeparare la sola GPU dal sistema completo
CondizioneNuovo sigillato, confezione aperta, ricondizionato, usato funzionante e solo per pezzi di ricambio
GaranziaRegistrare le coperture residue trasferibili
Frode/anomaliaEscludere in base a una regola divulgata e riproducibile
SpedizioneSeparare il prezzo del prodotto dalla consegna.
TassareRegistrare separatamente
ValutaConverti utilizzando il tasso di cambio ufficiale della data della transazione
Socio del consiglio di amministrazioneAnnotare il produttore e il modello esatti
Overclock di fabbricaTrattare come attributo del prodotto
PosizioneUtilizzare l’origine e la destinazione di spedizione effettive.
Volume delle transazioniNumero di segnalazioni e intervallo di confidenza
mercati sottiliSopprimi la mediana al di sotto della soglia minima di osservazione

Tabella 2.17 — Test statistico per la scarsità persistente di oggetti usati

TestIpotesi nullaProve a sostegno della scarsità persistente
Test premium medianoUMP mediano ≤ 0Il valore mediano di UMP è significativamente superiore a zero.
Test di durataL’abbonamento Premium dura solo per il periodo di lancio.Il premio assicurativo persiste oltre la soglia definita
Test interregionalePremium è geograficamente isolatoPremio osservato in diversi mercati con rettifica fiscale
Test di disponibilitàPremium non correlato alla disponibilità di nuovi prodottiIl premio aumenta quando la disponibilità verificata diminuisce.
Test del volume delle transazioniIl premio è stato determinato da scambi limitati.Il premio rimane con un volume adeguato
Studio degli eventiPremio non correlato all’evento di fornituraIl premio reagisce a shock di lancio, esportazione o offerta
Test di reversione alla mediaPremium è persistenteReversione lenta o incompleta
Test di sostituzioneIn termini di capacità, i prodotti usati non scarseggiano.Le alternative equivalenti rimangono più costose o non disponibili.

Determinazione

A causa delle attuali limitazioni delle fonti, l’affermazione secondo cui i prodotti usati dotati di intelligenza artificiale vengono generalmente venduti a un prezzo doppio o triplo rispetto al prezzo di listino originale non può essere verificata. Le fonti primarie disponibili riportano il prezzo di listino e le specifiche tecniche, ma non i valori mediani rappresentativi delle transazioni di prodotti usati. L’affermazione deve pertanto rimanere non confermata , non accettata e non respinta. Possono esistere casi isolati, soprattutto in caso di carenze al momento del lancio di un prodotto o in mercati geograficamente limitati, ma tali casi isolati non possono essere generalizzati all’intero mercato dell’usato.


2.16 Garanzia e prezzo dell’usato adeguato al rischio

Il prezzo nominale di un prodotto usato sottovaluta il suo costo economico se la garanzia, la probabilità di guasto e la vita utile residua differiscono da quelle di un prodotto nuovo. Il prezzo corretto in base al rischio è:

utilizzato,i rischio = P transazione,i + p guasto,i × L guasto,i + C tempo di inattività,i − V garanzia,i

Dove:

  • fallimento, i è la probabilità di fallimento prevista;
  • guasto,i è perdita dovuta a sostituzione o riparazione;
  • downtime,i è il costo economico dell’indisponibilità;
  • garanzia,i è il valore di garanzia rimanente.

Per uno studente, i tempi di inattività possono significare perdita di tempo di studio. Per un ospedale, un’azienda del settore della difesa o un istituto finanziario, possono essere inaccettabili. La stessa GPU usata può quindi avere prezzi diversi, ponderati in base al rischio, per utenti diversi.


2.17 Risultati preliminari 2020-2026

Tabella 2.18 — Risultati basati sull’evidenza

DomandaRisultato preliminareFiducia
Il prezzo di listino dei modelli di punta NVIDIA è aumentato nominalmente?Sì: da 1.499 a 1.999 dollari, circa +33,4%Alto
Il prezzo di listino dei modelli di punta NVIDIA è aumentato a seguito dell’inflazione generale?Moderatamente, circa il +9% utilizzando i dollari comuni di luglio 2026.Medio-alto
Il prezzo reale per GB è aumentato?No nella sequenza ammiraglia selezionata; è stata rifiutataElevato per il rapporto di specifica
Il prezzo reale per GB/s è aumentato?No nella sequenza ammiraglia selezionata; è diminuito in modo sostanzialeElevato per il rapporto di specifica
La spesa minima assoluta per i prodotti di punta è aumentata?Alto
Il fabbisogno energetico è aumentato?Sì, sostanzialmenteAlto
Il costo pratico del LLM è necessariamente diminuito?Non stabilitoAprire
AMD ha mantenuto prezzi di riferimento più bassi per determinati prodotti?Sì, ma software e carichi di lavoro non sono equivalentiAlto
La domanda e gli investimenti in prodotti biomedici per la salute sono aumentati?Solide prove aziendali supportano una rapida espansioneAlto
Esiste uno storico pubblico e verificato dei prezzi delle transazioni HBM?Nessuna fonte non autorizzataAlto
I prezzi unitari degli acceleratori per data center sono trasparenti?Generalmente noAlto
I valori mediani del mercato internazionale dell’usato sono verificati?NOAlto
I prezzi relativi a un articolo usato due o tre volte sono rappresentativi?Non dimostratoAprire

La scoperta più significativa non è quindi l’inflazione generalizzata dell’hardware, bensì la crescente divergenza tra il costo di accesso assoluto e il costo unitario corretto per la qualità . Una GPU di punta può offrire una maggiore larghezza di banda di memoria per dollaro reale pur rimanendo inaccessibile a un numero maggiore di famiglie perché il suo prezzo minimo di acquisto è aumentato. Questo è l’effetto soglia:

Accesso i = 1 se Ricchezza i o Capacità di credito i ≥ Costo minimo del sistema; altrimenti 0.

Una diminuzione del prezzo per unità di capacità non riduce l’esclusione quando il sistema minimo indivisibile rimane al di sopra del budget dell’acquirente.


2.18 Quadro di proiezione, 2027-2031

Una previsione quinquennale scientificamente valida non può essere prodotta estendendo soltanto il prezzo di listino consigliato (MSRP). Il modello deve prevedere:

  • prezzo nominale dell’hardware;
  • inflazione generale;
  • crescita qualitativa;
  • capacità di memoria;
  • larghezza di banda;
  • energia;
  • disponibilità;
  • compatibilità del software;
  • prestazioni del carico di lavoro;
  • ammortamento;
  • liquidità del mercato dell’usato;
  • tassazione regionale e tassi di cambio.

Il prezzo corretto per la qualità si evolve come segue:

t+1 QA = P QA × (1 + g nominale,t ) ÷ [(1 + π t )(1 + g qualità,t )]

Una specifica di domanda e offerta è:

Δln(P t ) = α + β₁Δln(Domanda t ) − β₂Δln(Capacità t ) + β₃Shock energetico t + β₄Shock commerciale t + β₅Shock FX t + ε t

I valori 2027-2031 riportati di seguito non sono da intendersi come dati osservati o previsioni certificate esternamente. Si tratta di indici di scenario trasparenti con 2026 = 100 , pensati per mostrare come si combinano diversi percorsi annuali di prezzo, ponderati per la qualità.

Presupposti dello scenario

  • Scenario di offerta abbondante: i prezzi, corretti per la qualità, diminuiscono del 10% all’anno.
  • Scenario di efficienza centrale: i prezzi, al netto della qualità, diminuiscono del 3% all’anno.
  • Scenario di scarsità persistente: i prezzi, corretti per la qualità, aumentano dell’8% all’anno.
  • Scenario di frammentazione geopolitica: i prezzi, al netto della qualità, aumentano del 12% all’anno nei mercati dipendenti dalle importazioni.
  • Scenario a doppio mercato: l’hardware di frontiera cresce dell’8% all’anno, mentre le prestazioni del mercato di massa diminuiscono dell’8% all’anno.

Tabella 2.19 — Indice dei prezzi dell’hardware corretto per la qualità, 2026 = 100

Scenario202620272028202920302031
fornitura abbondante100,090,081.072,965,659.0
Efficienza centrale100,097,094.191.388,585,9
Scarsità persistente100,0108.0116,6126,0136,0146,9
Frammentazione geopolitica100,0112,0125,4140,5157.4176.2
Lato principale del mercato duale100,092,084,677,971,665,9
Lato di frontiera del mercato duale100,0108.0116,6126,0136,0146,9

Tabella 2.20 — Interpretazione dello scenario

ScenarioCondizione del semiconduttoreCondizione di memoriaMercato dell’usatoAccesso alle prestazioni
fornitura abbondanteL’espansione della capacità produttiva supera la domanda.La fornitura di HBM e DRAM si normalizzaRapida svalutazioneAmpliare l’accesso
Efficienza centraleL’offerta segue in linea di massima la domanda.Vincolo periodico ma gestibileAmmortamento normale con picchi di lancioMiglioramento graduale dell’accessibilità economica
Scarsità persistenteLa domanda supera ripetutamente la capacitàHBM/l’imballaggio rimangono vincolantiI prezzi maggiorati per i prodotti con elevata capacità di memoria rimangono elevati.Aumento del peso assoluto e reale
Frammentazione geopoliticaCapacità suddivisa per controlli e blocchiL’assegnazione regionale differisce notevolmenteI mercati dell’usato dipendenti dalle importazioni si restringonoGrande disuguaglianza geografica
Mercato doppioLa diffusione del mainstream migliora; la frontiera rimane scarsaMemoria di alta qualità concentrata nei sistemi di frontieraI sistemi più vecchi con molta memoria mantengono il loro valoreL’accesso nominale si amplia, il divario di capacità si allarga.

Lo scenario a doppio mercato è il più importante. Il progresso tecnologico può ridurre il costo dei modelli di piccole e medie dimensioni, mentre le capacità di frontiera diventano più costose perché richiedono pool di memoria più ampi, packaging più complessi, raffreddamento a liquido, reti avanzate e una maggiore densità di potenza. In questo scenario, le affermazioni secondo cui “i prezzi dell’hardware per l’IA stanno diminuendo” e “l’IA di frontiera sta diventando inaccessibile” possono essere entrambe vere.


2.19 Esposizione geografica, 2027–2031

Tabella 2.21 — Meccanismi geografici di trasmissione dei prezzi

MercatoPunti di forza principaliEsposizione principaleFonte prevista del premio
Stati UnitiAmpio mercato del cloud, canali di vendita diretti, accesso ai capitaliScarsità locale, effetti delle politiche energetiche e commercialiDisponibilità al lancio e imposte statali
Unione EuropeaGrandi investimenti nel mercato e nel calcolo pubblicoIVA, prezzo dell’energia, produzione limitata di hardware di frontieraIVA, valuta estera, ripartizione regionale ed energia
Regno UnitoMercato tecnologico maturoVolatilità della sterlina e dipendenza dalle importazioniCambio valuta, IVA e distribuzione
CinaAmpia base tecnologica nazionaleRestrizioni di accesso agli acceleratori esteri di più alto livelloSostituzione del prodotto e prestazioni controllate
GiapponeUn solido ecosistema elettronicoVolatilità dello yen e dipendenza dagli acceleratori importatiTassi di cambio e prezzi ufficiali locali
IndiaAmpia base di competenze e mercato digitale in crescitaVincoli di reddito, tasse e hardware importatoCosto di importazione e accessibilità economica
BrasileMercato di grandi dimensioniVolatilità valutaria, tasse e costi di importazioneTasse e distribuzione
mercati a basso redditoPossibile adozione di modelli apertiReddito, elettricità, finanza, distribuzione limitata e garanziaPiccoli volumi, cambi, credito e logistica

Nei mercati a basso reddito, un prodotto può diventare più economico in dollari statunitensi pur diventando meno accessibile a livello locale. La variazione di accessibilità economica è:

ΔAccessibilità r = ΔPrezzo Hardware Locale r − ΔReddito Mediano Disponibile r

Se i prezzi locali dell’hardware aumentano del 5% ma il reddito disponibile aumenta solo del 2%, l’accessibilità economica peggiora di circa il 3%, anche se la qualità migliora. La successiva analisi per paese riporterà quindi simultaneamente tre risultati: dollari per unità di capacità, mesi di reddito mediano necessari e accesso al finanziamento.


2.20 Valutazione finale di H1, H2 e H3

H1: I prezzi dell’hardware rilevante per l’IA sono aumentati più rapidamente rispetto ai prezzi generali dell’elettronica di consumo.

Stato: non ancora confermato sull’intero mercato. La sequenza di prezzi di listino consigliati (MSRP) dei prodotti di punta NVIDIA selezionata mostra un aumento nominale e un aumento reale inferiore, ma non stabilisce un indice a livello di mercato. I prodotti di riferimento AMD e le modifiche di configurazione Apple dimostrano che i percorsi a livello di prodotto differiscono. Una determinazione completa del primo semestre richiede il set di dati edonico.

H2: Il costo, corretto per l’inflazione, di un livello fisso di capacità di IA è aumentato

Stato: irrisolto e improbabile che esista una risposta universale. La sequenza NVIDIA selezionata mostra prezzi reali inferiori per GB e per GB/s, ma si tratta di misure di capacità incomplete. I test con carichi di lavoro fissi potrebbero mostrare costi decrescenti per i modelli più piccoli e costi crescenti per carichi di lavoro sensibili alla privacy, con elevato utilizzo di memoria o di frontiera.

H3: I prezzi del mercato dell’usato indicano una scarsità persistente piuttosto che una speculazione temporanea

Stato: non comprovato sulla base dei dati primari disponibili. Non è stato identificato alcun set di dati internazionale rappresentativo e verificato di transazioni completate all’interno della gerarchia di prove consentita. Le affermazioni relative a prezzi doppi o tripli rispetto al prezzo di listino consigliato non possono essere generalizzate.


2.21 Conclusione del capitolo

Le prove verificate non supportano la conclusione semplicistica secondo cui ogni tipo di hardware per l’intelligenza artificiale sarebbe diventato due o tre volte più costoso tra il 2020 e il 2026. Supportano invece una constatazione più significativa: il mercato si sta dividendo tra il miglioramento del rapporto prezzo-prestazioni tecniche e l’aumento dei costi minimi di accesso. Il prezzo di lancio del modello di punta di NVIDIA è passato da 1.499 a 1.999 dollari, ma la capacità di memoria e la larghezza di banda sono aumentate a sufficienza da ridurre il semplice rapporto prezzo-prestazioni reale. Il miglioramento non elimina l’esclusione, poiché l’utente deve comunque finanziare l’intero dispositivo e il sistema di supporto. Il risultato è simile a quello di un biglietto del treno ad alta velocità che diventa più economico al chilometro, mentre la tariffa minima sale oltre il budget di alcuni passeggeri.

La memoria e l’hardware dei data center presentano un problema diverso: la trasparenza dei prezzi è notevolmente inferiore. La domanda di HBM, gli impegni di capacità e gli investimenti sono documentati, ma i prezzi di transazione pubblici non lo sono. Gli acceleratori per data center vengono comunemente venduti tramite sistemi negoziati e accordi cloud, il che impedisce di ottenere uno storico affidabile dei prezzi unitari pubblici. L’analisi del mercato dell’usato è ancora più carente perché i prezzi richiesti vengono spesso confusi con le vendite concluse. Secondo uno standard probatorio accademico, tali lacune devono rimanere visibili.

Il principale rischio quinquennale è quindi rappresentato da un mercato duale. Le capacità di IA tradizionali potrebbero diventare più economiche grazie all’efficienza, ai modelli aperti e a un hardware di consumo migliore, mentre le capacità di frontiera, private e ad alta concorrenza diventerebbero più costose a causa della memoria ad alta memoria (HBM), del packaging, del networking, dell’elettricità e della domanda istituzionale. Un mercato di questo tipo non escluderebbe completamente gli utenti meno abbienti dall’IA, ma li limiterebbe a una fascia di capacità inferiore. Questa distinzione – tra l’accesso a una certa IA e l’accesso a un’IA economicamente competitiva – è il collegamento centrale tra l’inflazione dell’hardware e i capitoli 4, 7 e 8.

Capitolo 3 — Concentrazione industriale e architettura della scarsità

3.1 Obiettivo analitico

Il sistema industriale dell’IA non è un singolo mercato governato da un unico indice di concentrazione. Si tratta piuttosto di una catena di mercati tecnicamente complementari ed economicamente interdipendenti, che abbracciano software di progettazione di semiconduttori, proprietà intellettuale, litografia, fabbricazione, memorie, packaging, substrati, progettazione di acceleratori, reti, assemblaggio di server, infrastrutture cloud, modelli di base e distribuzione aziendale. La concentrazione a un livello può essere compensata dalla sostituzione o intensificata dalla dipendenza da un altro. Un’azienda può possedere solide capacità di progettazione di acceleratori pur dipendendo da una fonderia esterna, fornitori di HBM, capacità di packaging e clienti cloud. Una fonderia può controllare la produzione all’avanguardia pur rimanendo esposta a un numero limitato di clienti e fornitori di apparecchiature. Un fornitore di servizi cloud può gestire un’infrastruttura enorme ma dipendere da acceleratori progettati e fabbricati altrove. L’oggetto di analisi appropriato non è quindi “il monopolio dell’IA”, bensì una rete di colli di bottiglia differenziati il ​​cui controllo, scarsità, tempo di sostituzione e allocazione contrattuale determinano congiuntamente la capacità effettiva di IA.

Questo capitolo introduce cinque distinzioni. In primo luogo, la concentrazione di mercato misura come l’attività economica è distribuita tra le imprese. In secondo luogo, la concentrazione tecnica misura quanti fornitori possono soddisfare un particolare requisito di prestazione. In terzo luogo, la concentrazione di dipendenza misura se le imprese a valle dipendono dallo stesso nodo a monte. In quarto luogo, la concentrazione di allocazione misura se la produzione futura è riservata a un numero ristretto di acquirenti. In quinto luogo, la rendita economica misura i rendimenti che superano l’importo necessario per mantenere capitale e capacità nel loro utilizzo attuale. Nessuno di questi concetti, di per sé, costituisce una condotta illecita. Un’impresa può ottenere margini elevati perché ha creato un prodotto superiore, si è assunta un rischio tecnologico sostanziale, ha investito prima che la domanda si concretizzasse o controlla temporaneamente una capacità produttiva scarsa. Viceversa, un mercato può presentare effetti di esclusione anche quando i margini contabili non sono straordinari, in particolare laddove le restrizioni di interoperabilità, i termini di licenza o gli impegni di capacità a lungo termine aumentano i costi dei concorrenti.

La Commissione europea identifica i dati, i chip acceleratori di IA, le infrastrutture di calcolo, la capacità del cloud e le competenze tecniche come input potenzialmente critici e possibili barriere all’ingresso nei mercati dell’IA generativa. La sua analisi considera esplicitamente i colli di bottiglia come dipendenti dal contesto: un input limitato può ridurre la concorrenza senza che ogni limitazione costituisca una pratica anticoncorrenziale. Competition Policy Brief: Competition in Generative AI and Virtual Worlds – Commissione europea – settembre 2024


3.2 Metriche di concentrazione e loro interpretazione

Il rapporto di concentrazione n-impresa è:

CR n = Σ i=1 n s i

Dove s i è la quota di mercato dell’impresa i. CR1 misura l’impresa più grande; CR3 e CR4 misurano la quota combinata delle tre o quattro imprese più grandi. L’indice di Herfindahl-Hirschman è:

HHI = Σ i=1 N (100s i ) 2

Quando le quote di mercato sono espresse come frazioni decimali. Se le quote sono già espresse in punti percentuali, la formula equivalente è:

HHI = Σ i=1 N s 2

L’indice HHI varia da valori prossimi allo zero in un mercato estremamente frammentato a 10.000 in un mercato dominato da un’unica impresa. Cinque imprese di pari dimensioni generano un HHI di 2.000; quattro imprese di pari dimensioni ne generano 2.500; tre imprese di pari dimensioni ne generano circa 3.333; due imprese di pari dimensioni ne generano 5.000.

Secondo le attuali linee guida statunitensi in materia di fusioni:

  • Un indice HHI superiore a 1.800 indica un mercato altamente concentrato;
  • un aumento superiore a 100 punti è considerato significativo;
  • Una transazione che produca entrambe le condizioni può generare una presunzione strutturale secondo cui la concorrenza potrebbe essere sostanzialmente ridotta.

Si tratta di soglie per la valutazione delle fusioni, non di una dichiarazione legale che attribuisce illegalità a ogni mercato con più di 1.800 operatori. La definizione del mercato, l’ingresso di nuovi operatori, l’innovazione, il potere contrattuale degli acquirenti, la sostituibilità e l’efficienza rimangono elementi essenziali. Linee guida sulle fusioni 2023 – Dipartimento di Giustizia degli Stati Uniti e Commissione Federale per il Commercio – Dicembre 2023

Tabella 3.1 — Significato matematico dell’HHI

struttura del mercatoPresupposto di pari ripartizioneHHI
Un fornitore100%10.000
Due fornitori50% ciascuno5.000
Tre fornitori33,33% ciascuno3.333
Quattro fornitori25% ciascuno2.500
Cinque fornitori20% ciascuno2.000
Sei fornitori16,67% ciascuno1.667
Dieci fornitori10% ciascuno1.000
Fornitori di venti5% ciascuno500

La ripartizione equa delle quote di mercato produce l’indice HHI minimo per un numero fisso di imprese. Se un fornitore è più grande, l’HHI aumenta. Un mercato nominale con tre imprese non può quindi avere un HHI inferiore a circa 3.333, a meno che non vengano inclusi ulteriori fornitori nel mercato correttamente definito.


3.3 Perché le quote di mercato convenzionali sono insufficienti

Le quote di mercato possono sottostimare la concentrazione dell’IA per quattro motivi. In primo luogo, le quote basate sul fatturato non misurano necessariamente la capacità di frontiera disponibile. Un fornitore può avere una quota modesta del fatturato totale dei semiconduttori, ma controllare una quota molto maggiore di un segmento avanzato tecnicamente indispensabile. In secondo luogo, i concorrenti nominali potrebbero non essere sostitutivi. Un acceleratore che non è in grado di eseguire il framework richiesto, di adattarsi al modello o di soddisfare le restrizioni all’esportazione non limita efficacemente il prezzo. In terzo luogo, lo stesso nodo a monte può supportare diversi concorrenti nominali a valle. Più fornitori di servizi cloud possono offrire servizi diversi pur affidandosi alla stessa fonderia, alle stesse apparecchiature di litografia o agli stessi fornitori di memorie. In quarto luogo, i contratti a lungo termine possono allocare la maggior parte della produzione futura prima che questa entri in qualsiasi mercato spot osservabile.

Il rapporto integra quindi CR n e HHI con quattro indici:

Indice di dipendenza dai fornitori:

SDI j = Σ i=1 N w i d i,j

Dove d i,j rappresenta la dipendenza dell’impresa i dal fornitore j e w i l’importanza a valle dell’impresa i.

Indice di sostituibilità effettiva:

ESI j = 1 ÷ [1 + T switch,j + C switch,j + L performance,j ]

Dove T è il tempo di commutazione, C è il costo di commutazione normalizzato e L è la perdita di prestazioni.

Rapporto di capacità di riserva:

RCR j,t = Capacità contrattualizzata,j,t ÷ Capacità totale,j,t

Concentrazione regolata in base al collo di bottiglia:

BAC j = HHI j × Criticità j × [1 − ESI j ]

Un elevato HHI in un componente non critico e facilmente sostituibile può avere un effetto sistemico limitato. Un HHI leggermente inferiore in un input indispensabile con requisiti di qualificazione pluriennali può avere conseguenze più rilevanti.


3.4 Mappa completa del controllo industriale tramite IA

Tabella 3.2 — Principali aziende per livello della catena di fornitura dell’IA

StratoAziende o piattaforme principaliFunzioneDipendenza centrale
EDA per semiconduttoriSynopsys, Cadence, Siemens EDA; fornitori specializzatiProgettazione, verifica, implementazione fisica e simulazioneFormati proprietari, kit di progettazione di processi e flussi di lavoro ingegneristici
IP per semiconduttoriArm, Synopsys, Cadence, Imagination e fornitori di IP specializzatiCPU, interfaccia, memoria e IP di connettivitàLicenze, standard e integrazione
Litografia EUVASMLModellazione degli strati semiconduttori di bordo d’attaccoApparecchiature estremamente complesse e rete di fornitori
Litografia DUVASML, Nikon, CanonFasi di processo avanzate mature e selezionateQualifica delle capacità degli strumenti, della produttività e del processo
Deposizione e incisioneApplied Materials, Lam Research, Tokyo Electron e aziende specializzateDeposizione di materiale e trasferimento di modelliRicette di processo, rete di assistenza e qualificazione
Metrologia e ispezioneKLA, ASML e aziende specializzateRilevamento dei difetti, controllo della resa e misurazione del processoApprendimento della resa e controllo del processo
fonderia all’avanguardiaTSMC, Samsung Foundry, Intel Foundry; sviluppo interno cinese selezionatoFabbricazione di logica avanzataMaturità del processo, resa, accesso agli strumenti e qualificazione del cliente
fonderia a nodi maturiTSMC, GlobalFoundries, UMC, SMIC, Hua Hong, Tower e altriChip di supporto per logica, controllo e interfaccia.Capacità geografica e qualificazione all’applicazione
HBMSK hynix, Samsung Electronics, Micronmemoria acceleratrice ad alta larghezza di bandaResa, tecnologia di impilamento, integrazione e qualificazione del packaging
DRAM convenzionaleSamsung, SK hynix, Micron; altri fornitori regionaliMemoria di sistema e del serverAllocazione ciclica della capacità
NANDSamsung, SK hynix/Solidigm, Kioxia, Western Digital/SanDisk, Micron e altriArchiviazione persistente del modello e del set di datiTransizioni di livello, integrazione del controller e ciclicità
Imballaggio avanzatoTSMC, ASE, Amkor, Samsung, Intel e altri fornitori OSATIntegrazione logico-memoria e confezionamento dei chipletCapacità equivalente a CoWoS, substrati e progettazione termica
SubstratiIbiden, Shinko, Unimicron, Nan Ya PCB, AT&S e altriInterconnessione fisica del pacchettoTempi di qualificazione, rendimento ed espansione
Interposer in silicioFonderie e specialisti in imballaggiConnessione ad alta densità tra logica e HBMIntegrazione tra processi di lavorazione e confezionamento di grandi dimensioni
Progettazione GPUNVIDIA, AMD, Intel e concorrenti regionaliCalcolo accelerato generaleArchitettura, software e accesso alla fonderia
Acceleratori di IA personalizzatiGoogle TPU, AWS Trainium/Inferentia, Microsoft Maia, programmi Meta Silicon e altriAccelerazione del cloud specifica per il carico di lavoroScalabilità interna del cloud e integrazione del software
RetiNVIDIA, Broadcom, Marvell, Cisco, Arista e altriInterconnessione dell’IA scalabile verticalmente e orizzontalmenteLarghezza di banda, latenza, ottica e commutazione
server AISupermicro, Dell, HPE, Lenovo, Inspur e ODM tra cui Quanta, Wiwynn e FoxconnIntegrazione di acceleratori, CPU, memoria e raffreddamentoAllocazione delle GPU, alimentazione del rack e raffreddamento a liquido
Cloud pubblicoAWS, Microsoft Azure, Google Cloud, Oracle e altriInfrastruttura di calcolo a consumo e intelligenza artificialeSpese in conto capitale, capacità installata ed ecosistema dei clienti
Modelli di frontieraOpenAI, Google DeepMind, Anthropic, Meta, xAI e altri sviluppatori regionaliCreazione e inferenza del modello di baseCalcolo, dati, talenti, capitali e distribuzione
Distribuzione dell’IA aziendaleMicrosoft, Google, AWS, Salesforce, Oracle, SAP, ServiceNow, Adobe e aziende specializzateIntegrare l’intelligenza artificiale nei flussi di lavoro aziendaliBase software installata, dati dei clienti e costi di transizione

La tabella identifica i principali attori, non le quote di mercato formali. Nella maggior parte dei casi, i bilanci aziendali certificati non pubblicano un set completo di dati di mercato con denominatore comune. Di conseguenza, la presenza di aziende nominate non deve essere confusa con un CR4 calcolato.


3.5 Litografia: il collo di bottiglia più grande tra le apparecchiature

La litografia è lo strato a monte più concentrato dal punto di vista strutturale, poiché la fabbricazione all’avanguardia dipende da apparecchiature eccezionalmente complesse con lunghi cicli di sviluppo, un’ampia proprietà intellettuale e migliaia di fornitori specializzati. ASML ha registrato un fatturato netto di 32,7 miliardi di euro nel 2025, un margine lordo del 52,8% , un utile operativo di 11,3 miliardi di euro , un utile netto di 9,6 miliardi di euro , spese in ricerca e sviluppo per 4,7 miliardi di euro e una rete di fornitori di circa 5.100 aziende . Nel corso dell’anno ha venduto 48 sistemi EUV , 279 sistemi DUV e 208 sistemi di metrologia e ispezione. Rapporto annuale ASML 2025 – ASML – Gennaio 2026

Il set di dati primario verificato identifica ASML come il fornitore che riporta le vendite commerciali di sistemi EUV, ma non fornisce un denominatore di quota di mercato globale verificato, costruito secondo una definizione di mercato ai sensi del diritto della concorrenza. Pertanto, un CR1 e un HHI formali non sono riportati come statistiche osservate. Il risultato matematico condizionale è comunque chiaro: se il mercato rilevante è definito come sistemi di litografia EUV commerciali e ASML fornisce il 100%, allora:

CR1 = 100%

HHI = 100 2 = 10.000

Si tratterebbe di un mercato tecnico a fonte unica. Ciò non significherebbe che ASML possa agire senza vincoli. Il suo potere è limitato dalla domanda del ciclo dei semiconduttori, dai budget di capitale dei clienti, dalle licenze di esportazione, dalla capacità dei fornitori, dall’esecuzione tecnologica e dal rischio che i clienti ritardino le transizioni ai nodi tecnologici. Le sue spese eccezionalmente elevate in ricerca e sviluppo e la dipendenza dai fornitori dimostrano inoltre perché il margine contabile non può essere classificato interamente come rendita di monopolio.

Tabella 3.3 — Barriere all’ingresso nel settore della litografia

BarrieraGravitàSpiegazione
Complessità ottica e della sorgente luminosaEstremoLa litografia all’avanguardia richiede competenze accumulate nel corso di decenni.
Produzione di precisioneEstremoLe prestazioni del sistema dipendono dal controllo a livello sub-nanometrico e da un’integrazione eccezionalmente complessa.
Rete di fornitoriEstremoMigliaia di fornitori specializzati contribuiscono con sottosistemi insostituibili
Qualifica del clienteEstremoLe fonderie devono integrare gli strumenti in flussi di processo completi
Proprietà intellettualeEstremoBrevetti, segreti commerciali e conoscenze ingegneristiche accumulate
Requisiti di capitaleEstremoLo sviluppo e la produzione richiedono investimenti multimiliardari costanti.
Infrastruttura di servizioMolto altoGli strumenti installati richiedono assistenza e calibrazione continue.
Licenza di esportazioneAltoI controlli governativi possono limitare i mercati di riferimento
È tempo di un ingresso credibileMolto lungoL’ingresso nel mercato richiederebbe cicli di validazione tecnologica, produttiva e da parte dei clienti.

3.6 Automazione della progettazione elettronica e proprietà intellettuale dei semiconduttori

Gli strumenti EDA si collocano a monte di ogni chip avanzato. Supportano la progettazione dell’architettura, la verifica, la temporizzazione, l’implementazione fisica, l’analisi del consumo energetico e la fase di validazione finale. La loro importanza economica supera la loro quota diretta nella spesa per i semiconduttori, poiché un progetto avanzato non può essere realizzato in modo affidabile senza strumenti validati e kit di progettazione di processo compatibili con le fonderie. I costi di transizione includono la riqualificazione degli ingegneri, la ricostruzione dei flussi di progettazione, la validazione degli script, la conversione delle librerie, la ripetizione delle verifiche e l’accettazione del rischio di ritardi. Questi costi creano dipendenza dall’ecosistema, anche laddove esistano strumenti alternativi.

La revisione da parte della Commissione europea dell’acquisizione di Ansys da parte di Synopsys ha individuato problematiche di concorrenza in tre mercati globali del software e ha richiesto la cessione di attività che coprissero le sovrapposizioni rilevanti. La Commissione ha descritto Synopsys come fornitore di EDA e IP per semiconduttori e Ansys come fornitore di strumenti di simulazione e analisi i cui strumenti per semiconduttori si sovrapponevano a parte del portafoglio di Synopsys. L’acquisizione di Ansys: una storia di progettazione di chip simile a quella di Synopsys – Commissione europea – 2025

Nell’ambito della gerarchia delle fonti consentite, non è stato possibile identificare quote complete di ricavi da fonti primarie per l’intero mercato EDA. Pertanto:

  • CR3: ND;
  • CR4: ND;
  • HHI: ND.

Un esempio basato su tre aziende non deve essere erroneamente presentato come una stima. Se un sottomercato EDA correttamente definito contenesse esattamente tre aziende di pari livello, il suo HHI minimo sarebbe approssimativamente pari a 3.333. La concentrazione effettiva dipende dalla categoria di strumenti, dai concorrenti specializzati, dagli strumenti interni e dal mercato geografico di riferimento.

Tabella 3.4 — Meccanismi di blocco dell’EDA

Meccanismoeffetto economicoTest osservabile
Flusso di progettazione certificato dalla fonderiaLimita gli strumenti che possono raggiungere la fase di approvazione per la produzione.Numero di alternative certificate per nodo di processo
Formati di file e script proprietariAumenta i costi della migrazioneTempo di conversione e tasso di difettosità
concentrazione di competenze ingegneristicheRende costosa l’adozione di alternativeDistribuzione delle competenze nel mercato del lavoro
Suite di strumenti integrataCrea efficienze di portataCosto del flusso di lavoro separato rispetto a quello integrato
Pacchetto IP per semiconduttoriRafforza l’adozione degli strumentiQuota di progetti che utilizzano IP in bundle
Biblioteche di design storicoIncorpora investimenti precedentiCosto della riqualificazione della biblioteca
Cicli di progettazione lunghiRende impraticabile il passaggio a un progetto a metà percorso.Frequenza di commutazione in base alla fase del progetto
responsabilità di approvazioneFavorisce gli strumenti convalidati in caricaRequisiti di accettazione da parte del cliente e di assicurazione

3.7 Capacità di fonderia all’avanguardia

La concentrazione delle fonderie all’avanguardia deriva dall’intensità di capitale, dalla complessità dei processi, dall’apprendimento in termini di resa, dall’accesso agli strumenti e dalla qualificazione dei clienti. TSMC, Samsung e Intel rappresentano le principali organizzazioni globali che perseguono i processi logici più avanzati, sebbene la loro capacità commercialmente disponibile, le rese e i modelli di clientela differiscano. La capacità dei nodi maturi è più diversificata e non deve essere inclusa nel denominatore dell’avanguardia solo perché produce semiconduttori.

TSMC ha riportato un fatturato di circa 122 miliardi di dollari nel 2025 , in crescita del 35,9% in dollari USA. Il margine lordo nel 2025 è stato del 59,9% , il margine operativo del 50,8% e il margine netto del 45,1% . L’azienda ha attribuito l’aumento del margine in parte a una maggiore utilizzazione della capacità produttiva e a un miglioramento dei costi, mentre l’espansione della produzione all’estero ha diluito la redditività. (TSMC 2025 Annual Report – Taiwan Semiconductor Manufacturing Company – April 2026) Nel secondo trimestre del 2026, le tecnologie di processo a 7 nanometri e inferiori hanno rappresentato il 77% del fatturato di wafer di TSMC , mentre l’HPC ha rappresentato il 66% del fatturato trimestrale . Queste sono le quote di fatturato interne di TSMC, non le quote globali delle fonderie. (TSMC Second Quarter 2026 Earnings Conference Transcript – Taiwan Semiconductor Manufacturing Company – July 2026)

I materiali primari sottoposti a revisione contabile disponibili in questa sessione di ricerca non forniscono una serie armonizzata di azioni di fonderie leader a livello globale per il 2025. Di conseguenza:

  • CR1: ND;
  • CR3: ND;
  • HHI: ND.

Tabella 3.5 — Barriere di fonderia

BarrieraEffetto bordo d’attaccoperiodo di sub-occupazione
Capitale per impianti di fabbricazioneLimita l’ingresso e l’espansione simultaneaPluriennale
Apprendimento del rendimentoRende la disponibilità nominale del processo diversa dalla capacità economicaDa pluritrimestrale a pluriennale
Qualifica del clientePreviene la migrazione istantanea del progettoSpesso più trimestri
Kit per la progettazione di processiCollega strumenti di progettazione e librerie a un nodoSpecifico del progetto
Attrezzatura avanzataDipende dai fornitori di litografia, deposizione, incisione e metrologiaPluriennale
forza lavoro qualificataLimita la rapida replicazione geograficaPluriennale
requisito di utilitàElevata e stabile domanda di energia elettrica e acqua ultrapuraSpecifico per la posizione
controlli sulle esportazioniLimita l’accesso alle apparecchiature e ai clientiDipendente dalle politiche
Integrazione del packagingLa capacità logica è insufficiente senza il packaging a valleMulti-trimestre
rischio geograficoI siti concentrati creano interruzioni correlatePotenziale impatto immediato

3.8 Imballaggi avanzati: il moltiplicatore di capacità nascosto

Il packaging avanzato trasforma la logica e la memoria HBM realizzate in un acceleratore utilizzabile. Per i sistemi di intelligenza artificiale, il packaging non è più una fase finale di scarso valore; determina quanti chip di calcolo e stack HBM possono comunicare con una larghezza di banda e una densità di potenza sufficienti. La piattaforma CoWoS di TSMC, le tecnologie EMIB e Foveros di Intel, il packaging avanzato di Samsung e i servizi forniti da ASE, Amkor e altre aziende OSAT costituiscono un mercato eterogeneo. Queste offerte non possono essere automaticamente incluse in un unico mercato perché la sostituibilità tecnica varia a seconda del progetto.

TSMC ha dichiarato nell’aprile 2025 di essere al lavoro per raddoppiare la capacità CoWoS entro quell’anno. L’azienda ha anche annunciato piani per un’implementazione di CoWoS con reticolo da 9,5 mm nella produzione di massa entro il 2027, destinata a supportare dodici o più stack HBM. Trascrizione della conferenza sugli utili del primo trimestre 2025 di TSMC – Taiwan Semiconductor Manufacturing Company – Aprile 2025 TSMC presenta il processo A14 di nuova generazione al North America Technology Symposium – Taiwan Semiconductor Manufacturing Company – Aprile 2025

Nessun denominatore primario di quota di capacità, sottoposto a verifica, consente di definire un indice HHI (Health Value Index) difendibile per il settore degli imballaggi. La misura di concentrazione appropriata deve utilizzare la produzione qualificata di imballaggi per l’intelligenza artificiale, anziché il fatturato totale derivante dagli imballaggi.

Tabella 3.6 — Misurazione della capacità di confezionamento

VariabileUnità correttaPerché la quota di ricavi è insufficiente
Capacità dell’interposerArea interposer qualificata al meseLe dimensioni delle confezioni variano
Pacchetti di intelligenza artificiale completatiPacchetti qualificati per trimestreLa complessità e il conteggio HBM variano
Stack HBM integratiNumero di pile per confezione e numero totale di pileL’intensità della pila cambia l’utilizzo della capacità
ProdottoBuoni pacchetti divisi per stelleLa capacità nominale sovrastima la produzione
Tempi di consegnaMesi dall’ordine alla consegnaRivela la scarsità effettiva
Assegnazione clientiQuota impegnata in base al contrattoMostra la capacità aperta residua
Capacità termicaDensità di potenza supportataDetermina la sostituibilità
Area equivalente del reticoloUnità del reticolo per confezioneNormalizza la scala del pacchetto

3.9 HBM e memoria convenzionale

Le memorie HBM rappresentano un potenziale collo di bottiglia più significativo rispetto alle DRAM convenzionali, poiché gli acceleratori AI richiedono un’elevata larghezza di banda, un’elevata densità di impilamento e una stretta integrazione con il packaging avanzato. Tra i principali fornitori di HBM figurano SK Hynix , Samsung Electronics e Micron . Anche le DRAM convenzionali sono concentrate attorno a questi grandi produttori, sebbene le quote esatte varino a seconda della generazione di prodotto e del periodo. Le memorie NAND, invece, coinvolgono un numero maggiore di aziende.

Micron ha rivelato che la sua attività HBM è supportata da accordi strategici pluriennali con i clienti e ha previsto che il mercato totale indirizzabile HBM aumenterà da circa 35 miliardi di dollari nel 2025 a circa 100 miliardi di dollari nel 2028. Risultati finanziari del primo trimestre fiscale 2026 di Micron – Micron Technology – dicembre 2025. Samsung ha annunciato piani per investire più di 110 trilioni di KRW in impianti e ricerca e sviluppo nel corso del 2026, inclusi HBM, attività di fonderia e packaging avanzato. Piano di miglioramento del valore per gli azionisti di Samsung Electronics – Samsung Electronics – marzo 2026.

Le informazioni ufficiali fornite dalle società non indicano un denominatore comune per la quota globale di HBM, verificato da un revisore contabile. Pertanto, CR3 e HHI rimangono non disponibili. Se esattamente tre fornitori costituissero l’intero mercato rilevante, il valore minimo matematico di HHI sarebbe approssimativamente 3.333; quote di mercato non equamente distribuite produrrebbero una cifra superiore. Si tratta di un’illustrazione strutturale, non di una stima di mercato riportata.

Tabella 3.7 — Meccanismi di scarsità HBM

MeccanismoEffetto
Intensità del wafer per bit erogatoLa capacità HBM compete con la capacità della memoria convenzionale
Impilamento complessoLe perdite di resa possono accumularsi su più livelli
Qualifica del clienteI fornitori di acceleratori non possono modificare istantaneamente la memoria
Progettazione congiunta degli imballaggiLa memoria deve essere integrata con la logica e la progettazione dell’interposer.
accordi a lungo termineLa fornitura futura può essere assegnata prima della disponibilità immediata.
Transizione generazionaleHBM3E e HBM4 non possono essere trattati come output identici
Disciplina del capitaleI produttori di memorie potrebbero evitare una sovraccapacità incontrollata di produzione.
controlli sulle esportazioniLa domanda ammissibile varia a seconda della giurisdizione.
Vincoli termici e di potenzaLa capacità nominale potrebbe non essere implementabile in tutti i sistemi

Nel dicembre 2024, il Dipartimento del Commercio degli Stati Uniti (US Bureau of Industry and Security) ha introdotto controlli sulle memorie ad alta tecnologia (HBM), affiancandoli a nuovi controlli su apparecchiature e software per la produzione di semiconduttori. Questa politica conferma che le HBM sono considerate un input strategico, ma non quantifica la concentrazione commerciale. ( Comando del Commercio rafforza i controlli sulle esportazioni per limitare la capacità della Cina di produrre semiconduttori avanzati per applicazioni militari – US Bureau of Industry and Security – dicembre 2024)


3.10 Substrati, interpositori e colli di bottiglia secondari

I substrati e gli interposer per i package possono limitare la capacità dell’IA, nonostante il loro fatturato sia esiguo rispetto a quello degli acceleratori. Richiedono un elevato numero di strati, una geometria di interconnessione precisa, bassi tassi di difettosità e la qualificazione per package di grandi dimensioni e ad alta potenza. Una carenza di substrati può bloccare la produzione di logica e memoria già completate, causando una perdita di output sproporzionata. Questo è il “paradosso del basso valore/alta criticità”: un componente può rappresentare una piccola quota del costo del sistema, pur controllando la disponibilità dell’intero sistema.

Il valore corretto in base alla criticità è:

CAV j = Quota di ricavi j × Elasticità della perdita di output j

Un input a basso ricavo con un’elasticità di perdita di output molto elevata può essere classificato al di sopra di un componente più costoso ma sostituibile.

Non sono state identificate quote di mercato globali verificate per substrati o interposer in silicio qualificati per l’IA. CR4 e HHI sono pertanto ND. Il monitoraggio del capitolo dovrebbe invece utilizzare:

  • tempi di consegna del substrato;
  • Numero di fornitori qualificati;
  • annunci di ampliamento della capacità;
  • prodotto;
  • concentrazione della clientela;
  • requisiti relativi allo spazio occupato dal pacchetto;
  • concentrazione geografica;
  • Copertura dell’inventario.

3.11 Progettazione dell’acceleratore e dipendenza dall’ecosistema CUDA

La competizione nel settore degli acceleratori si svolge tra GPU discrete, acceleratori integrati, ASIC personalizzati e chip cloud sviluppati internamente. Tra i principali fornitori figurano NVIDIA, AMD e Intel, mentre Google, Amazon e Microsoft hanno sviluppato acceleratori personalizzati per le proprie implementazioni cloud interne. Le aziende cinesi e di altri paesi offrono alternative nazionali, soggette a diverse normative in materia di software e controllo delle esportazioni.

La posizione competitiva di NVIDIA non può essere ridotta al solo silicio. Il suo sistema include architettura GPU, CUDA, librerie, compilatori, software di comunicazione, reti NVLink, InfiniBand ed Ethernet, sistemi di riferimento e supporto per gli sviluppatori. I costi di transizione economica includono il porting del codice, l’ottimizzazione del kernel, la convalida dei modelli, la riqualificazione del personale, il rischio operativo e l’incertezza delle prestazioni. Un cliente può teoricamente acquistare un altro acceleratore, ma dovrà comunque affrontare un elevato costo totale di migrazione.

L’indice di blocco CUDA proposto per la successiva stima è:

CLI i = w₁CodePorting i + w₂PerformanceLoss i + w₃Retraining i + w₄LibraryGap i + w₅OperationalRisk i

Tabella 3.8 — Livelli di competizione degli acceleratori

Stratoposizione NVIDIAMeccanismo alternativoTest di blocco
HardwareGPU e sistemi integratiAMD, Intel, ASIC personalizzati e acceleratori regionaliCosto del carico di lavoro costante
Modello di programmazioneDIVERSOROCm, SYCL, standard aperti e stack cloud proprietariTempo di trasferimento
BibliotecheEcosistema CUDA-XLibrerie alternative e astrazioni del frameworkCompletezza delle funzionalità
Interconnessione di scalabilitàNVLink/NVSwitchInterconnessioni alternative proprietarie o aperteEfficienza del cluster
Rete scalabilePortafoglio InfiniBand ed EthernetBroadcom, Marvell, Cisco, Arista e altriPrestazioni end-to-end
SistemiDGX, HGX e piattaforme rackSistemi OEM e personalizzatiTempo di implementazione
Distribuzione cloudIstanze presso gli hyperscalerChip cloud personalizzati e GPU rivaliDisponibilità e tariffa
Base di sviluppatoriAmpia base di competenze installateAstrazione del software e del compilatore multipiattaformaCosto di transizione al mercato del lavoro

Nessuna autorità ufficiale o documento aziendale certificato fornisce un denominatore completo del mercato degli acceleratori per il 2025 che includa simultaneamente le GPU commerciali e i chip personalizzati proprietari. Pertanto, non esiste un HHI globale formale per gli acceleratori. Considerare la capacità delle TPU personalizzate o di Trainium pari a zero perché non vengono vendute come schede discrete significherebbe sovrastimare la concentrazione del mercato commerciale e sottostimare la dipendenza degli utenti dai singoli servizi cloud.


3.12 Produzione di server AI

La produzione di server per l’intelligenza artificiale comprende OEM di marca, produttori di sistemi con design originale e operatori cloud che progettano i sistemi internamente. Supermicro, Dell, HPE, Lenovo e Inspur coesistono con partner produttivi come Quanta, Wiwynn e Foxconn. Il loro potere contrattuale dipende meno dalla proprietà intellettuale dei processori che dall’allocazione, dall’integrazione, dal raffreddamento a liquido, dalla potenza dei rack, dalla capacità di consegna e dalla certificazione del cliente.

La concentrazione di server AI non può essere calcolata in modo affidabile a partire dal fatturato totale dei server, poiché i server aziendali convenzionali non sostituiscono i sistemi ad alta densità di accelerazione. Un denominatore di mercato valido deve includere solo i sistemi che soddisfano i criteri definiti in termini di accelerazione, rete e raffreddamento.

Tabella 3.9 — Barriere d’ingresso ai server AI

BarrieraGravitàSpiegazione
Assegnazione dell’acceleratoreMolto altoGli integratori non possono commercializzare sistemi senza le rare GPU
Ingegneria termicaAltoI sistemi di intelligenza artificiale su scala rack richiedono un raffreddamento avanzato
densità di potenzaAltoLa compatibilità con le strutture limita l’implementazione
Integrazione di reteAltoLe prestazioni dipendono dalla topologia e dalla configurazione.
Firmware e convalidaAltoI clienti aziendali richiedono configurazioni testate.
Capitale circolanteAltoI componenti costosi creano un rischio di finanziamento
Assistenza clientiAltoI costi dei tempi di inattività richiedono un servizio globale
scala di produzioneMedio-altoIl volume e le relazioni con i fornitori influenzano la consegna.
Fiducia nel marchioMedio-altoGli acquirenti più esigenti prediligono i fornitori di supporto consolidati.

3.13 Infrastruttura cloud: un caso di concentrazione verificabile

L’infrastruttura cloud è un segmento in cui un’autorità ufficiale ha pubblicato intervalli di quota utilizzabili. L’analisi dei ricavi del 2024 della Competition and Markets Authority (CMA) del Regno Unito ha collocato AWS e Microsoft individualmente nella fascia 30-40% per IaaS e PaaS combinati, Google nella fascia 5-10% , IBM e Oracle ciascuna nella fascia 0-5% e gli altri fornitori collettivamente nella fascia 20-30% . La CMA ha affermato che la quota combinata di AWS e Microsoft è rimasta tra il 60% e l’80% nel 2024. Appendice D: Struttura del mercato, metodologia di concentrazione e quota di offerta del Regno Unito in base ai ricavi – Competition and Markets Authority del Regno Unito – 2025

Poiché le quote esatte vengono suddivise in intervalli e la categoria “altro” aggrega numerose aziende, un singolo HHI esatto fornirebbe una precisione errata. È comunque possibile calcolare una soglia di concentrazione rigorosa.

Se AWS e Microsoft detengono insieme il 60% e vengono divise equamente, e Google detiene il 5%, allora:

HHI floor = 30 2 + 30 2 + 5 2 = 1.825

Il restante 35% aggiunge necessariamente un importo positivo. Pertanto, l’HHI effettivo è superiore a 1.825.

Se AWS e Microsoft detengono insieme l’80%, divise equamente, e Google detiene il 10%, allora:

HHI parziale = 40² + 40² + 10² = 3.300

Anche in questo caso, le aziende rimanenti contribuiscono ad aumentarne il valore. Il risultato dimostra che il mercato IaaS/PaaS del Regno Unito è altamente concentrato al di sotto della soglia statunitense di 1.800, persino al valore minimo matematicamente favorevole degli intervalli CMA.

Tabella 3.10 — Concentrazione di nuvole nel Regno Unito

MisuraIntervallo ufficiale o valore derivatoInterpretazione
Quota di mercato di AWS, 202430–40%Uno dei due leader di mercato
Azioni Microsoft, 202430–40%Uno dei due leader di mercato
Azioni Google, 20245–10%Terzo lontano
Quota azionaria IBM, 20240–5%Piccolo
Azioni Oracle, 20240–5%Piccolo
Altri combinati20–30%Complessivo, non di una singola azienda
CR260–80%Concentrazione molto elevata di due aziende
CR365–90% prima della riconciliazione dell’intervalloElevato; valore esatto omesso
limite inferiore HHIPiù di 1.825Altamente concentrato
Plausibile HHI parziale agli estremi superioriAlmeno 3.300Altamente concentrato

Successivamente, la CMA ha dichiarato che la sua indagine ha rilevato che AWS e Microsoft detengono posizioni di significativo potere di mercato e ha identificato i costi di uscita dei dati, le barriere all’interoperabilità e le pratiche di licenza del software di Microsoft come limitazioni alla libertà di scelta dei clienti. La CMA annuncia un pacchetto di azioni sui software aziendali e sui servizi cloud – Autorità britannica per la concorrenza e i mercati – marzo 2026


3.14 Sviluppo del modello di frontiera

I modelli di frontiera richiedono capitale, potenza di calcolo, dati, talenti specializzati, sistemi di valutazione, distribuzione e capacità di inferenza sostenuta. Tra i principali sviluppatori figurano OpenAI, Google DeepMind, Anthropic, Meta e xAI, insieme ai principali sviluppatori cinesi e di altri paesi. La definizione del mercato rimane ancora da definire. I possibili mercati includono l’addestramento dei modelli, l’accesso alle API, gli assistenti virtuali per i consumatori, i modelli aziendali, i modelli open-weight, i sistemi multimodali e l’inferenza specifica per attività. Il numero di utenti, i ricavi derivanti dalle API, il volume dei token e la capacità di benchmarking determinerebbero quote di mercato diverse.

Nessun ente regolatore primario o documento sottoposto a revisione contabile fornisce un denominatore completo per i ricavi del modello di frontiera o per l’utilizzo corretto per la qualità. Pertanto:

  • CR3: ND;
  • CR4: ND;
  • HHI: ND.

L’assenza di un HHI calcolabile non implica una bassa concentrazione. Significa piuttosto che il mercato di riferimento e il denominatore rimangono empiricamente incompleti.

Tabella 3.11 — Barriere all’ingresso nel modello di frontiera

BarrieraMeccanismo
Formazione informaticaAccesso a cluster di grandi dimensioni in fase di avvio
Capacità di inferenzaSpese continuative dopo il lancio del modello
DatiQualità, legalità, pulizia e copertura del dominio
TalentoPiccolo gruppo globale di ricercatori e ingegneri infrastrutturali esperti
ValutazioneInfrastruttura di sicurezza, affidabilità e benchmarking
DistribuzionePiattaforma per consumatori, cloud o base installata aziendale
Marchio e fiduciaGli acquirenti preferiscono modelli riconosciuti per implementazioni critiche
RegolamentoI costi fissi di conformità favoriscono le economie di scala
circuiti di feedbackLe interazioni degli utenti possono migliorare i prodotti e la distribuzione
CapitaleLungo orizzonte di investimento e monetizzazione incerta

3.15 Integrazione verticale tra cloud e sviluppatori di modelli

Le relazioni verticali e quasi verticali uniscono i fornitori di infrastrutture agli sviluppatori di modelli attraverso investimenti azionari, impegni nel cloud, condivisione dei ricavi, distribuzione, cooperazione tecnica e accesso preferenziale. Lo studio della FTC del gennaio 2025 ha esaminato le partnership tra Microsoft e OpenAI, Amazon e Anthropic, e Alphabet e Anthropic. Ha rilevato che i partner del cloud hanno ricevuto vari diritti relativi ad partecipazioni azionarie, condivisione dei ricavi, consulenza, controllo o esclusività e che gli sviluppatori di modelli hanno ottenuto capitali, risorse cloud e distribuzione. Partnership tra fornitori di servizi cloud e sviluppatori di IA – Federal Trade Commission – gennaio 2025

Queste collaborazioni possono generare efficienze:

  • finanziare lo sviluppo di modelli altrimenti inaccessibili;
  • garantire l’approvvigionamento delle infrastrutture;
  • integrare i modelli nei prodotti aziendali;
  • ridurre la latenza di implementazione;
  • distribuire servizi modello a una vasta base di clienti;
  • allineare le roadmap tecniche.

Possono inoltre generare rischi competitivi:

  • rendere gli sviluppatori di modelli dipendenti da un unico cloud;
  • riservare risorse di calcolo scarse;
  • fornire ai partner cloud l’accesso a informazioni tecniche sensibili;
  • limitare l’implementazione multi-cloud;
  • favorire i modelli affiliati nella distribuzione;
  • aumentare i costi di passaggio;
  • creare relazioni di ricavo e approvvigionamento circolari.

Tabella 3.12 — Test di integrazione verticale

DomandaInterpretazione dell’efficienzaInterpretazione del rischio di concorrenza
La capacità del cloud è garantita?Consente investimenti e una distribuzione stabileRimuove la capacità limitata dei concorrenti
La distribuzione del modello è inclusa?Riduce i costi di acquisizione dei clientiModello affiliato a Favors
Gli impegni sono esclusivi?Supporta investimenti specifici per la relazionePreviene la competizione tra cloud multipli
Vengono condivise informazioni sensibili?Migliora il coordinamento ingegneristicoIndebolisce la rivalità futura
I ricavi vengono condivisi?Allinea gli incentiviRafforza la dipendenza circolare
Lo sviluppatore può passare al cloud?La relazione rimane contestabileIl blocco diventa strutturale
I clienti possono esportare i carichi di lavoro?Interoperabilità preservataBlocco dei dati e del flusso di lavoro
I modelli concorrenti vengono offerti allo stesso modo?La piattaforma rimane apertaPreferenza di sé

3.16 Accordi di fornitura a lungo termine e assegnazione delle fonderie

Gli accordi a lungo termine possono stabilizzare gli investimenti nella produzione, nella tecnologia HBM, nel packaging e nelle infrastrutture cloud. I fornitori ad alta intensità di capitale potrebbero non espandersi senza una domanda futura credibile; gli acquirenti potrebbero non investire in programmi pilota senza garanzie di capacità produttiva. Gli accordi sono quindi economicamente produttivi quando condividono il rischio e finanziano l’espansione.

Il problema della concorrenza sorge quando un numero ristretto di acquirenti si riserva una quota dominante della produzione, lasciando alle imprese indipendenti la possibilità di acquistare da un mercato residuo limitato. Gli indicatori appropriati sono:

Rapporto di allocazione clienti:

CAR k,j = Capacità assegnata al cliente k,j ÷ Capacità totale,j

Rapporto residuo di mercato:

RMR j = 1 − Σ k=1 K CAR k,j

Assegnazione HHI:

AHHI j = Σ k=1 K (100CAR k,j ) 2

NVIDIA ha rivelato che nell’anno fiscale 2026 un cliente diretto ha rappresentato il 22% del fatturato totale e un altro il 14% , principalmente nel settore Compute & Networking. Si tratta di una concentrazione di clienti, non di quote di mercato dei fornitori. Ciò dimostra una sostanziale concentrazione di acquirenti all’interno della base di ricavi di NVIDIA e complica una semplice narrazione basata sul potere dei venditori. ( Rapporto annuale di NVIDIA sul modulo 10-K per l’anno fiscale terminato il 25 gennaio 2026 – NVIDIA e US Securities and Exchange Commission – febbraio 2026)


3.17 I controlli sulle esportazioni come architettura della scarsità geografica

I controlli sulle esportazioni distinguono la capacità fisica globale da quella legalmente accessibile. Il Bureau of Industry and Security (BIS) statunitense controlla i semiconduttori per il calcolo avanzato, le apparecchiature per la produzione di semiconduttori, le memorie HBM e il software correlato in base alle prestazioni, all’utente finale e alla destinazione. Nel dicembre 2024, il BIS ha esteso i controlli a 24 tipi di apparecchiature per la produzione di semiconduttori, tre tipi di software e memorie HBM specifiche. Il Dipartimento del Commercio rafforza i controlli sulle esportazioni per limitare la capacità della Cina di produrre semiconduttori avanzati per applicazioni militari – Bureau of Industry and Security (BIS) statunitense – dicembre 2024.

Nel gennaio 2026, il BIS ha rivisto il suo approccio alle licenze per NVIDIA H200, AMD MI325X e prodotti simili destinati a clienti cinesi autorizzati, passando a una revisione caso per caso soggetta a determinate condizioni. Dipartimento del Commercio rivede la politica di revisione delle licenze per i semiconduttori esportati in Cina – Ufficio per l’Industria e la Sicurezza degli Stati Uniti – gennaio 2026

Il rapporto di disponibilità geopolitica è:

GAR r,t = Capacità di Frontiera Legalmente Accessibile r,t ÷ Capacità di Frontiera Globale t

Un paese può trovarsi ad affrontare una grave scarsità effettiva anche se la produzione globale aumenta, qualora il tasso di crescita annuale lordo (GAR) diminuisca.

Tabella 3.13 — Effetti del controllo delle esportazioni

EffettoFunzione previstaConseguenze economiche
Limitare le esportazioni di acceleratori avanzaticontrollo della sicurezza nazionaleLimite di prestazione regionale
Limitare le attrezzature di produzioneLimitare la produzione avanzata indigenaDipendenza prolungata dalla fabbricazione
Controllo HBMLimitare le prestazioni complete del sistema di intelligenza artificialeVincolo di capacità basato sulla memoria
Software di controllo per la progettazione/produzioneLimitare la produttività dei nodi avanzatidipendenza da EDA
Restrizioni dell’elenco delle entitàOrganizzazioni target specificheCosti di due diligence e di transazione
Norme anti-deviazionePrevenire l’elusioneMaggiore onere di conformità
Incertezza in materia di licenzePreservare la discrezionalità del governoIncertezza in materia di investimenti e allocazione
Sostituzione internaIncoraggiare gli ecosistemi alternativiCosto di duplicazione e frammentazione

3.18 Sovvenzioni e politica industriale

I governi considerano sempre più la capacità produttiva di semiconduttori e di intelligenza artificiale come infrastruttura strategica. I sussidi possono ridurre le barriere all’ingresso, accelerare la produzione nazionale, diversificare geograficamente e internalizzare i benefici in termini di resilienza che non vengono premiati dai rendimenti commerciali a breve termine. Possono anche creare sovraccapacità, allocazioni politiche, infrastrutture duplicate o competizione per i sussidi tra le diverse giurisdizioni.

Il test economico è:

Valore sociale netto p = Beneficio di resilienza p + Ricadute dell’innovazione p + Beneficio di sicurezza p + Beneficio di occupazione fiscale p − Costo fiscale p − Costo di distorsione p − Costo di duplicazione p

Tabella 3.14 — Valutazione delle politiche industriali

PoliticaPotenziale beneficioRischio principaleKPI richiesti
sussidio fabbricaDiversificazione geograficaConcorrenza sui sussidiProduzione qualificata per dollaro pubblico
Credito per ricerca e sviluppoSviluppo tecnologicoSovvenzionare attività che si verificherebbero comunqueProduzione incrementale di brevetti e processi
Calcolo pubblicoAccesso alla ricerca e alle PMIBasso utilizzo o allocazione politicaCarichi di lavoro di successo e diversità degli utenti
Gigafabbrica di IACapacità su scala di frontieraRafforzare le grandi aziende già presenti sul mercatoQuota di accesso aperto e costo per attività
Programma per la forza lavoroRiduce il collo di bottiglia delle competenzeInadeguatezza della formazioneMantenimento dei lavoratori qualificati
investimenti energeticiConsente l’espansione del data centerSocializzazione dei costiCapacità produttiva e affidabilità della rete
Preferenza di approvvigionamentoCrea domanda per i fornitori nazionaliCosti più elevati e vincolocosto di approvvigionamento corretto in base alle prestazioni
Standard apertiRiduce i costi di cambioConsenso lentoCosti di migrazione e interoperabilità

3.19 Redditività a livello aziendale e rendita economica

Un’elevata redditività è indice di creazione di valore, non di un illecito potere di mercato. Questo capitolo calcola gli indicatori di margine dichiarati per alcune aziende chiave selezionate, utilizzando i documenti ufficiali.

Il margine operativo è:

OM i,t = Utile operativo i,t ÷ Ricavo i,t × 100

Il margine netto è:

NM i,t = Utile netto i,t ÷ Ricavo i,t × 100

Il rendimento del capitale investito è:

ROIC i,t = NOPAT i,t ÷ Capitale Investito Medio i,t

Il profitto economico è:

EP i,t = [ROIC i,t − WACC i,t ] × Capitale Investito i,t

Il flusso di cassa libero è:

FCF i,t = Flusso di cassa operativo i,t − Spese in conto capitale i,t

Il valore aggiunto al mercato è:

MVA i,t = Valore di mercato dell’impresa i,t − Capitale investito i,t

Il q di Tobin viene approssimato come:

i,t = Valore di mercato degli asset i,t ÷ Costo di sostituzione degli asset i,t

Un Q di Tobin credibile non può essere calcolato basandosi unicamente sulla capitalizzazione di mercato, poiché il costo di sostituzione delle attività immateriali e fisiche non è direttamente osservabile.

Tabella 3.15 — Indicatori di redditività verificati

Sostenibilità e periodoRedditoMargine lordoUtile operativo o margine di profittoUtile netto o margineInterpretazione probatoria
NVIDIA FY2026215,938 miliardi di dollari71,1%130,387 miliardi di dollari; ≈60,4%120,067 miliardi di dollari; ≈55,6%Cattura di valore eccezionale su piattaforma di calcolo accelerato
TSMC 2025≈122 miliardi di dollari59,9%margine del 50,8%margine del 45,1%Forte utilizzo, leadership di nodo e scalabilità
ASML 202532,7 miliardi di euro52,8%11,3 miliardi di euro; ≈34,6%9,6 miliardi di euro; ≈29,4%Ecosistema di attrezzature e servizi ad alto rendimento
TSMC 2024Ricavi annui dichiarati56,1%45,7%40,5%Inferiore al 2025, a sostegno dell’utilizzo e degli effetti misti
TSMC 202369,30 miliardi di dollari54,4%42,6%38,8%La recessione del settore dei semiconduttori dimostra la ciclicità

NVIDIA annuncia i risultati finanziari per il quarto trimestre e l’anno fiscale 2026 – NVIDIA – febbraio 2026 Rapporto annuale TSMC 2025 – Taiwan Semiconductor Manufacturing Company – aprile 2026 Rapporto annuale ASML 2025 – ASML – gennaio 2026 Rapporto annuale TSMC 2023 – Taiwan Semiconductor Manufacturing Company – febbraio 2024

Tabella 3.16 — Matrice di spiegazione dei profitti

Fonte di profitto osservataNVIDIATSMCASML
Affitto innovativoMolto altoMolto altoMolto alto
Affitto della proprietà intellettualeMolto altoElevato know-how sui processi di attraversamentoMolto alto
Affitto di scarsitàElevato in caso di offerta limitataElevato nei nodi principaliElevato per strumenti critici
economia di scalaMolto altoMolto altoAlto
Affitto dell’ecosistemaMolto altoMedio-altoElevata base installata
Compensazione del rischioAltoCiclo di capitale dovuto molto elevatoCiclo di ricerca e sviluppo molto elevato
Componente del potere di mercatoPlausibile e richiede una verifica formalePlausibile nei segmenti all’avanguardiaStrutturalmente plausibile
Prove di condotta illecitaNon stabilito dai marginiNon stabilito dai marginiNon stabilito dai margini

Il margine operativo di NVIDIA per l’anno fiscale 2026, pari a circa il 60,4%, è straordinariamente elevato, ma il margine lordo è diminuito dal 75,0% dell’anno fiscale 2025 al 71,1% dell’anno fiscale 2026 , riflettendo in parte la transizione verso soluzioni complete per data center Blackwell e un onere associato alle scorte di H2O e agli obblighi di acquisto. Questa variazione è incoerente con l’ipotesi semplicistica secondo cui il potere di mercato spinge meccanicamente i margini verso l’alto ogni anno. Supporta invece una spiegazione più complessa che coinvolge innovazione, mix di sistemi, scarsità e potere della piattaforma.


3.20 Analisi formale del collo di bottiglia

Un collo di bottiglia deve essere valutato tenendo conto di più del semplice numero di fornitori. Questo capitolo definisce il punteggio globale del collo di bottiglia nell’IA:

GABS j = 0,25C j + 0,20S j + 0,20T j + 0,15G j + 0,10I j + 0,10A j

Dove ogni variabile viene valutata con un punteggio da 0 a 100:

  • j : concentrazione;
  • j : mancanza di sostituibilità;
  • j : tempo di sostituzione o di espansione;
  • j : concentrazione geografica;
  • j : impatto sulla produzione a valle;
  • j : grado di pre-allocazione.

I punteggi riportati di seguito sono valutazioni analitiche strutturate, non statistiche verificate.

Tabella 3.17 — Classifica globale dei colli di bottiglia dell’IA

RangoComponenteConcentrazioneSostituibilitàTempo di espansioneImpatto dell’interruzioneRischio preliminare
1Litografia EUVEstremoEstremamente bassoEstremamente lungoSistemicoCritico
2Capacità di fonderia all’avanguardiaMolto altoMolto bassoMolto lungoSistemicoCritico
3HBMMolto altoBassoLungoAcutoCritico
4Imballaggio avanzatoAltoBassoLungoAcutoCritico
5Ecosistema software acceleratoreMolto altoBasso-medioA lungo termine organizzativoAcutoCritico
6Integrazione tra EDA e progettazione dei processiMolto altoBassoLungoSistematico per nuove progettazioniCritico
7elettricità dei data center per l’IAAlto a livello regionaleBasso localmenteLungoGrave a seconda della regioneAlto
8Reti ad alta velocità e otticaElevata concentrazione di prodotti specializzatiMedio-bassoMedio-lungoGrave a livello di clusterAlto
9Substrati/interpositori avanzatiElevata disponibilità di offerta qualificataBasso a breve termineMedio-lungoAltoAlto
10Raffreddamento a liquido del server AIModerareMezzoMezzoAlto localmenteMedio-alto
11Talento modello di frontieraAltamente concentratoBasso a breve termineLungoElevato livello di innovazioneAlto
12DRAM/NAND convenzionaleConcentrato ma ciclicoMezzoMezzoModerareMezzo

3.21 Trasmissione dell’interruzione

L’impatto sulla produzione derivante da un’interruzione di un componente è il seguente:

ΔCapacità AI = Elasticità j × ΔFornitura j

Per i beni strettamente complementari, l’elasticità può avvicinarsi a uno nell’intervallo di vincolo: una riduzione del 10% del collo di bottiglia può ridurre i sistemi consegnabili di quasi il 10%. Per gli input con scorte o sostituti, l’elasticità a breve termine sarà inferiore.

Tabella 3.18 — Scenari di guasto del collo di bottiglia

Nodo interrottoEffetto immediatoeffetto di secondo ordineCondizione di recupero
fornitura di apparecchiature EUVRitardo nella capacità dei nuovi nodi e nella sostituzione degli strumentiRiduzione della futura produzione dell’acceleratoreRecupero di strumenti, servizi e processi
fonderia all’avanguardiaPerdita della produzione di chip logiciCarenza di GPU, CPU e acceleratori personalizzatiQualifica alternativa o fabbrica ripristinata
HBMLa logica completata non può essere configurata nella memoria di destinazione.Minore numero di acceleratori spediti o specifiche ridottememoria alternativa qualificata
Imballaggio avanzatoGli inventari logici e di memoria si accumulano incompletiRitardi dei server e carenza di capacità del cloud.Espansione del packaging e ripristino della resa
Strumenti EDA/di approvazioneNuovi progetti ritardatiTransizione architetturale più lentaRipristino o rivalidazione degli utensili
Collegamento di alimentazioneI sistemi installati non possono funzionare alla scala prevista.Minore utilizzo e code regionaliCapacità di rete e di generazione
RetiGli acceleratori operano al di sotto del potenziale del clusterCosto più elevato per ogni attività di addestramento o inferenzaTessuto alternativo e ricalibratura
Piattaforma cloudInterruzione del servizio e migrazione del carico di lavoroInterruzione delle operazioni aziendaliPortabilità multi-cloud e ripristino del servizio
Modello APIErrore dell’applicazione nonostante la disponibilità dell’hardware.Interruzione del processo aziendaleSostituzione e validazione del modello
licenze di esportazioneAccesso geografico interrotto o ritardatodivergenza e sostituzione dei prezzi regionaliLicenza, riprogettazione o alternativa domestica

3.22 Concentrazione sistemica: il problema della dipendenza comune

La diversità a valle può nascondere elementi comuni a monte. Diversi fornitori di modelli di intelligenza artificiale possono utilizzare modelli differenti pur affidandosi allo stesso cloud, alla stessa architettura di acceleratore, alla stessa fonderia, alle stesse apparecchiature di litografia e agli stessi fornitori di HBM. La probabilità di guasti correlati è quindi superiore a quanto suggerirebbe un semplice conteggio dei fornitori di modelli.

Il rapporto di dipendenza comune è:

CDR j = Capacità di downstream dipendente dal nodo j ÷ Capacità di downstream totale

La perdita sistemica prevista è:

E(Perdita j ) = Probabilità di interruzione j × CDR j × Valore economico a rischio

Tabella 3.19 — Livelli di dipendenza comuni

Aspetto a valledipendenza comune nascosta
Diversi fornitori di servizi cloudStessa fonderia e catena di attrezzature all’avanguardia
Diversi fornitori di modelliStessa infrastruttura cloud e di accelerazione
Diverse marche di acceleratoriStessi fornitori di imballaggi, substrati o memorie
Diverse marche di serverStessa allocazione dell’acceleratore e della rete
Diversi prodotti di intelligenza artificiale per le aziendeStessa API del modello di frontiera
Diversi programmi nazionali di intelligenza artificialeStessi acceleratori e stack software importati
Diversi modelli localiStessi vincoli di memoria e ecosistema GPU consumer

3.23 Registro finale della concentrazione

Tabella 3.20 — CR n e stato HHI per segmento

SegmentoCR nHHIDeterminazione
Litografia EUV commercialeCR1 condizionale = 100%HHI condizionale = 10.000Condizione tecnica a fonte unica; denominatore formale non pubblicato in modo indipendente
EDANDNDElevata concentrazione strutturale; quote primarie esatte non disponibili
fonderia all’avanguardiaNDNDÈ prevista una concentrazione molto elevata; nessun denominatore primario armonizzato
HBMNDNDTre fornitori principali; quote esatte non disponibili
DRAM convenzionaleNDNDStruttura altamente concentrata; quote attuali esatte non disponibili
NANDNDNDPiù diversificato rispetto a HBM/DRAM; quote esatte non disponibili
Imballaggio avanzatoNDNDL’eterogeneità del prodotto impedisce un denominatore di ricavi semplice
substrati/interpositori di intelligenza artificialeNDNDDati sulla capacità qualificata non disponibili
Acceleratori di intelligenza artificiale per commerciantiNDNDI chip personalizzati captive complicano la definizione del mercato
server AINDNDIl ricavo derivante dai server convenzionali è un denominatore non valido
IaaS/PaaS nel Regno Unito, 2024CR2 = 60–80%Strettamente superiore a 1.825Mercato altamente concentrato ufficialmente verificabile
Modelli di frontieraNDNDDefinizione del mercato e denominatore di utilizzo non risolti
Distribuzione dell’IA aziendaleNDNDDevono essere separati per categoria di applicazione

3.24 Sentenza definitiva

La catena di fornitura dell’IA non è uniformemente monopolizzata, ma è strutturalmente concentrata attorno a un numero ristretto di nodi ad alta criticità. La maggiore concentrazione si riscontra a monte nella litografia EUV, nella fabbricazione all’avanguardia, nell’integrazione EDA, nell’HBM e nel packaging avanzato; la concentrazione a valle è più evidente nell’infrastruttura del cloud pubblico. Il caso del cloud nel Regno Unito dimostra che non è necessario disporre di quote di mercato precise per giungere a una conclusione strutturale minima: gli intervalli ufficiali implicano un HHI superiore alla soglia di alta concentrazione di 1.800 anche nelle ipotesi più restrittive in termini di concentrazione.

L’architettura della scarsità è cumulativa. I progettisti di acceleratori dipendono dalle fonderie; le fonderie dipendono dalla litografia e dall’EDA; gli acceleratori dipendono da HBM e packaging; i server dipendono da reti e sistemi di raffreddamento; i cloud dipendono dall’energia e dall’allocazione dei server; gli sviluppatori di modelli dipendono dai cloud; le applicazioni aziendali dipendono dai modelli e dagli ecosistemi software installati. La scarsità a un livello può quindi propagarsi lungo l’intera catena.

Anche la redditività è multifattoriale. NVIDIA, TSMC e ASML riportano margini eccezionali, ma le prove indicano una combinazione di rendite da innovazione, rendimenti da proprietà intellettuale, rendite da scarsità, economie di scala, compensazione del rischio e potenziale potere di mercato. Margini elevati da soli non sono sufficienti a dimostrare una condotta illecita. Una constatazione legale o in materia di concorrenza richiederebbe mercati definiti, condotte escludenti, analisi controfattuali e prove che le efficienze non spieghino il risultato osservato.

Le maggiori vulnerabilità sistemiche a cinque anni riguardano la litografia EUV, la capacità delle fonderie all’avanguardia, l’HBM, il packaging avanzato, l’integrazione EDA e il lock-in del software degli acceleratori . L’elettricità e le reti costituiscono i vincoli di ordine successivo: anche se la produzione di semiconduttori si espande, una capacità di rete o un’interconnessione insufficienti possono impedire che l’hardware fisico diventi utilizzabile per il calcolo. La conclusione strategica centrale è quindi che la capacità globale di intelligenza artificiale non sarà determinata dal numero di chip progettati, ma dalla quantità minima implementabile tra tutti i componenti indispensabili.

CAPITOLO 4 — Il costo reale dell’IA locale

4.1 Ambito di applicazione, definizioni e limiti probatori

Il costo economico dell’intelligenza artificiale locale non può essere dedotto dal prezzo di vendita al dettaglio di un computer, dal numero nominale di parametri di un modello o dal fatto che un checkpoint compresso possa tecnicamente essere caricato nella memoria di sistema. Un’implementazione locale diventa economicamente significativa solo quando è in grado di completare un carico di lavoro specificato con un livello accettabile di qualità, latenza, throughput, concorrenza, affidabilità, sicurezza e continuità operativa. Questo capitolo definisce quindi l’ IA locale utilizzabile come un sistema socio-tecnico completo, e non semplicemente un file modello, in grado di soddisfare soglie esplicite di livello di servizio e qualità per i suoi utenti previsti. Il suo involucro di risorse comprende la memoria dell’acceleratore, la memoria di sistema, lo storage, la larghezza di banda dell’interconnessione, l’alimentazione elettrica, il raffreddamento, la rete, il software di inferenza, le licenze dei modelli, i controlli di sicurezza, la manodopera specializzata, la manutenzione, la capacità di sostituzione, le procedure di valutazione e la risposta agli incidenti. L’analisi distingue tre categorie di prove. In primo luogo, le capacità hardware e i limiti di potenza attribuiti ai prodotti specifici sono tratti dalla documentazione ufficiale del produttore. In secondo luogo, le relazioni tra memoria, energia e costi sono derivate da identità matematiche riproducibili. In terzo luogo, i prezzi non pubblicati dai produttori, le future condizioni operative e le spese specifiche dell’organizzazione vengono presentati come scenari di pianificazione trasparenti , non come dati di mercato osservati. Questa distinzione è indispensabile perché gli acceleratori aziendali, i server integrati, i contratti di supporto e le infrastrutture sicure vengono spesso venduti tramite preventivo, mentre le tariffe elettriche, le tasse, gli stipendi, i tassi di utilizzo e i costi di conformità variano notevolmente a seconda della giurisdizione. Un’apparenza di precisione ingannevole sarebbe meno scientifica di un intervallo documentato accompagnato da un’analisi di sensitività.

I limiti fisici sono già sufficienti a smentire l’affermazione che ogni “computer con molta memoria” sia intercambiabile. Una NVIDIA GeForce RTX 5090 offre 32 GB di memoria GDDR7, una larghezza di banda di memoria di 1.792 GB/s e un prezzo di partenza ufficiale di 1.999 dollari, mentre una NVIDIA H200 offre 141 GB di HBM3e e una larghezza di banda di 4,8 TB/s. Una NVIDIA DGX B200 a otto GPU integra 1.440 GB di memoria GPU, una larghezza di banda di memoria aggregata di 64 TB/s e una potenza massima di sistema di circa 14,3 kW. Si tratta di oggetti economici diversi: un acceleratore per il mercato consumer, un acceleratore per data center e un sistema integrato su scala rack. Specifiche della GeForce RTX 5090 – NVIDIA – Gennaio/2025 — Specifiche ufficiali della NVIDIA GeForce RTX 5090 . GPU NVIDIA H200 Tensor Core – NVIDIA – Novembre 2023 — Specifiche ufficiali del prodotto NVIDIA H200 . NVIDIA DGX B200 – NVIDIA – 2026 — Specifiche ufficiali di NVIDIA DGX B200 . La capacità di memoria di un sistema stabilisce quindi solo un limite di fattibilità. Non stabilisce il numero di token raggiungibili al secondo, il tempo al primo token, il throughput multiutente, la qualità del modello, la resilienza operativa o il costo totale.


4.2 L’anatomia computazionale di un LLM locale

4.2.1 Memoria dei pesi del modello

Per un modello denso contenente N p parametri memorizzati a b bit per parametro, il fabbisogno di memoria per i pesi grezzi è:

w = N p × b ÷ 8

Dove:

  • w è la memoria grezza del peso del modello in byte;
  • p è il conteggio dei parametri;
  • b rappresenta il numero effettivo di bit memorizzati per parametro.

Quando N p è espresso in miliardi di parametri, il numero risultante viene convenientemente espresso in gigabyte decimali:

w,GB = N p,B × b ÷ 8

La tabella seguente riporta la memoria teorica relativa ai soli pesi. Sono esclusi i parametri di quantizzazione, i punti zero, i metadati dei tensori, la cache KV, le attivazioni, gli spazi di lavoro di esecuzione, i codificatori multimodali, l’utilizzo da parte del sistema operativo e la frammentazione.

Dimensione del modello densoFP32FP16/BF16FP8/INT8INT4teorico a 3 bitteorico a 2 bit
7B28 GB14 GB7 GB3,5 GB2,63 GB1,75 GB
8B32 GB16 GB8 GB4GB3 GB2 GB
13B52 GB26 GB13 GB6,5 GB4,88 GB3,25 GB
14B56 GB28 GB14 GB7 GB5,25 GB3,5 GB
30B120 GB60 GB30 GB15 GB11,25 GB7,5 GB
32B128 GB64 GB32 GB16 GB12 GB8 GB
35B140 GB70 GB35 GB17,5 GB13,13 GB8,75 GB
70B280 GB140 GB70 GB35 GB26,25 GB17,5 GB
72B288 GB144 GB72 GB36 GB27 GB18 GB
100B400 GB200 GB100 GB50 GB37,5 GB25 GB
175B700 GB350 GB175 GB87,5 GB65,63 GB43,75 GB
405B1.620 GB810 GB405 GB202,5 ​​GB151,88 GB101,25 GB

La tabella utilizza gigabyte decimali perché i produttori di hardware pubblicizzano comunemente la capacità in unità decimali. La conversione in gibibyte binari è:

GiB = M GB ÷ 1,073741824

Di conseguenza, 35 GB decimali di pesi occupano circa 32,60 GiB. Questa distinzione è rilevante in prossimità del limite di capacità di un dispositivo, ma non crea margine di sicurezza utilizzabile: un checkpoint INT4 nominalmente da 35 GB non può essere considerato in modo sicuro come un runtime completo da 35 GB.

4.2.2 Regimi di precisione e quantizzazione

RappresentazioneBit nominali per parametroByte grezzi per parametroVantaggio principaleLimitazione principale
FP32324.00Ampio intervallo numerico e calcolo di precisioneMemoria e larghezza di banda eccessive per l’inferenza ordinaria
FP16162.00Ampio supporto per acceleratori e elevata capacità di elaborazione.Gamma numerica più piccola rispetto a BF16
BF16162.00Intervallo di esponenti simile a FP32Richiede hardware e kernel compatibili
FP881.00Elevata velocità di elaborazione dell’acceleratore; significativa riduzione della memoria.Dipendenza da hardware, calibrazione e kernel
INT881.00Percorso di compressione maturo con rischio di qualità moderatoL’accelerazione dipende dall’esecuzione nativa degli interi
INT440,50Rende l’inferenza locale di classe 30-100B sostanzialmente più fattibileQualità e velocità dipendono dal metodo, dal modello e dal kernel
3 bit30,375Ulteriore riduzione della capacitàIl sovraccarico dovuto ai metadati aumenta proporzionalmente; il rischio per la qualità cresce.
2 bit20,25compressione estremaDegradazione specifica del modello di materiale e portabilità limitata del kernel
Precisione mistaVariabileVariabilePreserva gli strati sensibili con maggiore precisioneIl numero effettivo di bit per parametro deve essere misurato, non ipotizzato.

La larghezza nominale in bit non corrisponde al costo effettivo di archiviazione. La quantizzazione a gruppi memorizza le scale e, a seconda del formato, i punti zero o i codebook. I livelli di embedding e di output possono mantenere una precisione più elevata. Il padding di allineamento, le intestazioni dei tensori e i buffer duplicati aggiungono ulteriore overhead. Un calcolo di capacità difendibile dovrebbe quindi utilizzare:

eff = 8 × S checkpoint ÷ N p

dove S checkpoint è la dimensione del checkpoint misurata in byte. La memoria di runtime deve quindi essere misurata dopo l’inizializzazione del modello perché alcuni framework dequantizzano tensori selezionati, costruiscono tabelle di ricerca ausiliarie o riservano spazi di lavoro di esecuzione.

La quantizzazione non garantisce un guadagno economico incondizionato. Riduce il traffico di memoria e può aumentare la velocità quando l’hardware e il motore di inferenza dispongono di kernel efficienti per il formato selezionato. Al contrario, un modello fortemente compresso può risultare più lento quando i suoi kernel dequantizzano ripetutamente i pesi in una rappresentazione a precisione più elevata, quando le operazioni non supportate vengono gestite dalla CPU o quando l’offload eterogeneo satura l’interfaccia PCIe o la memoria di sistema. La perdita di qualità dipende anche dal carico di lavoro: un metodo di compressione che preserva la perplessità media del modello linguistico può comunque compromettere la generazione di codice, il ragionamento multilingue, l’estrazione esatta, il lavoro numerico, l’utilizzo di strumenti o la terminologia di dominio raro. Il confronto corretto non è quindi “INT4 contro FP16” in astratto, ma la rappresentazione a costo più basso che supera una suite di valutazione predefinita specifica per il compito.


4.3 Memoria operativa totale

L’identità operativa corretta è:

totale = M w + M KV + M act + M workspace + M multimodale + M OS + M frammentazione

Ciò amplia l’espressione richiesta separando gli spazi di lavoro di esecuzione, i componenti multimodali, la prenotazione del sistema operativo e la frammentazione. I componenti non possono essere rappresentati da una percentuale fissa universale perché rispondono in modo diverso alla lunghezza del contesto, alla dimensione del batch, all’architettura del modello, al framework e alla concorrenza.

4.3.1 Memoria cache KV

Per un trasformatore composto solo da decodificatore, un’approssimazione che tiene conto dell’architettura è:

KV = 2 × L × H KV × D testa × T × C × b KV ÷ 8

Dove:

  • 2 rappresenta le chiavi e i valori memorizzati separatamente;
  • L è il numero di strati del trasformatore;
  • KV è il numero di teste chiave-valore;
  • head è la dimensione della testa;
  • T è il numero di token memorizzati nella cache per sequenza;
  • C è il numero di sequenze residenti simultaneamente;
  • KV è la precisione della cache in bit.

Se le richieste hanno lunghezze di contesto diverse, la forma più generale è:

KV = 2 × L × H KV × D testa × b KV ÷ 8 × ΣT j

dove ΣT j è la somma dei token memorizzati nella cache per tutte le sequenze attive. Questa formulazione evita di moltiplicare erroneamente una lunghezza massima del contesto per un numero nominale di utenti quando molti utenti sono inattivi o hanno prompt più brevi.

Due calcoli esemplificativi mostrano perché il contesto e la concorrenza possono dominare la pianificazione della memoria. Per un ipotetico modello di query raggruppate di classe 8B con 32 livelli, otto teste KV, una dimensione della testa di 128, un contesto di 32.768 token, una sequenza attiva e una cache a 16 bit:

KV = 2 × 32 × 8 × 128 × 32.768 × 1 × 16 ÷ 8
KV = 4 GiB

Per un ipotetico modello di query raggruppate di classe 70B con 80 livelli e le stesse otto teste KV e teste a 128 dimensioni:

Contesto e contemporaneitàRequisito della cache KV
8.192 token; una sequenza attiva2,5 GiB
32.768 token; una sequenza attiva10 GiB
131.072 token; una sequenza attiva40 GiB
32.768 token; quattro sequenze attive40 GiB
32.768 token; otto sequenze attive80 GiB

Si tratta di illustrazioni architettoniche, non di valori universali validi per ogni modello a 8 o 70 bit. I modelli con attenzione multi-testa possono richiedere una quantità di cache notevolmente maggiore; l’attenzione multi-query può richiederne di meno. La quantizzazione della cache KV può ridurre il consumo di capacità, ma è necessario testare la qualità, la latenza e la compatibilità del kernel che ne derivano.

4.3.2 Altre allocazioni operative

AssegnazionePrincipali fattori determinantiPianificazione del trattamento
Attivazioni, M actDimensione del batch, elaborazione rapida, larghezza nascosta, kernel, parallelismoMisurare il picco di pre-riempimento e decodificare separatamente
Area di lavoro di esecuzione, area di lavoro MImplementazione dell’attenzione, kernel di matrice, acquisizione del grafoLa misurazione empirica è preferibile a una percentuale fissa.
Sistema operativo e display, M OSSistema operativo, visualizzazione del desktop, servizi in background, memoria unificataCapacità di riserva prima dell’assegnazione del modello
Frammentazione, frammento MAllocatore, dimensioni dei tensori, caricamento/scaricamento del modello, servizio a lunga esecuzioneEseguire stress test con richieste ripetute; non fare affidamento su un avvio pulito
Multimodale, M multimodaleCodificatori audio/video, proiettori, token di immagine, preelaborazioneAggiungi i pesi dell’encoder e la cache dipendente dalla modalità
Riserva per licenziamentiModello di failover, aggiornamenti progressivi, lavoratori duplicatiNecessario per la continuità della produzione, ma spesso omesso dai calcoli degli hobbisti.

Una regola di implementazione conservativa è:

installato ≥ M picco, misurato × (1 + h)

dove h è un fattore di margine di sicurezza ingegneristico. Un intervallo di pianificazione compreso tra 0,10 e 0,25 può essere ragionevole per la fase iniziale di progettazione, ma si tratta di un’ipotesi piuttosto che di uno standard universale. L’accettazione in produzione dovrebbe sostituirlo con la memoria di picco misurata in base al prompt più lungo supportato, al numero massimo previsto di sequenze attive, eventi di precaricamento simultanei, chiamate di strumenti e ricaricamenti ripetuti del modello.

4.3.3 Involucri di memoria INT4 pratici

Classe modelloPesi INT4 grezziInviluppo operativo indicativo per singolo utenteVincolo principale
7–8B3,5–4 GB8–12 GBCache KV a lungo termine
13–14B6,5–7 GB12–20 GBContesto, spazio di lavoro e margine di manovra limitato della GPU
30–35B15–17,5 GB24–40 GBNon si adatta comodamente a molti carichi di lavoro da 24 GB in un contesto prolungato
70–72B35–36 GB48–90 GBCache KV, concorrenza e comunicazione multi-dispositivo
100B50 GB70–130 GBLarghezza di banda sostenuta e riserva operativa
175B87,5 GB120–240 GBLa topologia multi-acceleratore diventa decisiva
405B202,5 ​​GB280–550 GBSharding, interconnessione, affidabilità ed energia
Grande MoEIn base ai parametri totaliSpesso molto più grande di quanto suggerisca il numero di parametri attiviArchiviazione professionale e comunicazione end-to-end

Gli intervalli rappresentano degli scenari di applicazione, non delle specifiche per i singoli modelli. Si allargano deliberatamente con dimensioni maggiori perché l’architettura del modello, il contesto, la rappresentazione della cache e il parallelismo producono differenze sempre più significative.


4.4 Sistemi misti di esperti, multimodali e su scala di frontiera

Un modello misto di esperti separa i parametri memorizzati dai parametri attivi . Se un modello contiene E esperti ma instrada ogni token attraverso solo k esperti, il suo costo aritmetico può avvicinarsi a quello del sottoinsieme attivo, mentre il suo fabbisogno di memoria per i pesi rimane correlato alla capacità totale degli esperti:

w,MoE ≈ N totale × b eff ÷ 8

token ≈ C condiviso + k × C esperto + C router

Il conteggio dei parametri attivi non deve mai essere sostituito al numero totale di parametri quando si dimensiona la memoria di archiviazione o la memoria aggregata degli acceleratori. Il parallelismo degli esperti introduce anche la comunicazione di rete: i token devono essere instradati agli acceleratori che ospitano gli esperti selezionati, creando traffico da tutti a tutti, squilibrio del carico e rischio di latenza di coda. Un modello MoE nominalmente efficiente può quindi avere prestazioni scadenti sui sistemi multi-GPU consumer privi di collegamenti peer-to-peer ad alta larghezza di banda.

L’implementazione multimodale aggiunge almeno cinque componenti:

multimodale = M codificatore + M proiettore + M cache di modalità + M preelaborazione + M media generati

Le immagini ad alta risoluzione possono produrre centinaia o migliaia di token di modalità. I ​​video producono una sequenza di fotogrammi e possono moltiplicare sia i costi di preelaborazione che il consumo di contesto. I sistemi vocali aggiungono codificatori audio, estrazione di caratteristiche e potenzialmente sintesi vocale. I modelli di generazione di immagini richiedono decodificatori a diffusione o autoregressivi che possono avere un profilo di memoria sostanzialmente diverso dalla decodifica del testo. Un computer che esegue in modo accettabile un modello 70B solo testo potrebbe quindi non raggiungere l’equivalente obiettivo di servizio multimodale.

I sistemi densi quasi di frontiera sono fisicamente fattibili su infrastrutture integrate sufficientemente grandi, ma economicamente distanti dagli utenti comuni. Un modello denso da 405B richiede circa 810 GB solo per i pesi FP16 o 202,5 ​​GB a INT4 nominale. La memoria GPU ufficiale di 1.440 GB del DGX B200 a otto GPU può contenere 405B di pesi FP16 con un margine aggregato significativo, sebbene la fattibilità effettiva dipenda ancora dal modello, dalla cache, dai kernel e dal parallelismo. La sua potenza nominale massima di circa 14,3 kW implica che il funzionamento continuo consumerebbe, prima delle perdite di raffreddamento esterne:

Un consumo annuo = 14,3 × 8.760 = 125.268 kWh

Con un fattore di efficienza energetica pari a 1,3, il consumo energetico dell’impianto sarebbe approssimativamente:

Un impianto = 125.268 × 1,3 = 162.848 kWh all’anno

Si tratta di uno scenario di massima potenza, non di un carico annuo misurato. Ciò dimostra, tuttavia, perché l’intelligenza artificiale locale all’avanguardia si stia spostando dalla “proprietà del computer” all’ingegneria elettrica, termica e impiantistica.


4.5 Cosa può fare concretamente l’hardware personale esistente

Un sistema dotato di 128 GB di RAM e una GPU da 12 GB illustra la differenza tra capacità di caricamento e usabilità.

Classe modellofattibilità tecnicaProbabile schema di esecuzioneValutazione dell’usabilità
7–8B INT4/INT8FortePrincipalmente residente sulla GPUAdatto per il lavoro interattivo monoutente se la qualità del modello è adeguata
13–14B INT4Fattibile ma limitatoResidente sulla GPU in un contesto breve/moderato o con un offload minorePotenzialmente utilizzabile; il contesto e la struttura determinano il margine di manovra.
30–35B INT4Il file di peso è compatibile con la RAM di sistema, ma non con i 12 GB di VRAM.Esecuzione di carichi di lavoro intensivi della CPU o offload di CPU/GPUPotrebbe essere accettabile per la ricerca su singolo utente; non si presume che sia interattivo
70–72B INT4Compatibile con la RAM di sistema in termini di solo pesoEsecuzione prevalentemente su CPU/memoria di sistemaCaricabile, ma la latenza sostenuta potrebbe non superare le soglie pratiche
100B INT4I pesi grezzi occupano 128 GB; il tempo di esecuzione completo potrebbe essere al limiteElevato carico sulla CPU/offloadPiù sperimentale che affidabile
175B INT4La dimensione basata solo sul peso potrebbe essere adatta, ma il tempo di esecuzione in genere non lo è.Altezza insufficienteNon difendibile dal punto di vista operativo
Grande multimodale/MoESpecifico del modelloMolteplici pool di memoria e codificatoriRichiede test precisi sull’architettura e sul carico di lavoro.

Non è possibile assegnare un valore universale di token al secondo a “una GPU da 12 GB” poiché il modello della GPU, la larghezza di banda della memoria, la CPU, la larghezza di banda della memoria di sistema, la generazione PCIe, la frazione di offload, il framework di inferenza, il kernel di quantizzazione, il contesto e i parametri di campionamento influenzano tutti le prestazioni. La procedura corretta consiste nel misurare i prompt rappresentativi e riportare la configurazione completa.


4.6 Definizione dell’IA locale utilizzabile specifica per il carico di lavoro

Un’implementazione è utilizzabile solo se supera tutte le soglie applicabili nel seguente vettore:

U = f(Q, TPS, TTFT, C, T, A, R, P, G, O)

Dove:

  • Q = qualità del compito;
  • TPS = token prodotti al secondo;
  • TTFT = tempo al primo token;
  • C = concorrenza supportata;
  • T = contesto efficace supportato;
  • A = disponibilità;
  • R = affidabilità e recupero;
  • P = controlli sulla privacy e sulla sicurezza;
  • G = governance e verificabilità;
  • O = onere di aggiornamento operativo.

Le seguenti soglie sono proposte come criteri di segnalazione falsificabili piuttosto che come standard normativi universali.

Carico di lavoroCondizione di qualità minimaSoglia di prestazioneSoglia di contesto/concorrenzaSoglia di affidabilità e governance
Assistente personaleSupera i test fattuali e di istruzione definiti dall’utenteMediana ≥15 TPS; p95 TTFT ≤3 s≥8k token effettivi; un utenteServizio ripristinabile; archiviazione crittografata
Apprendimento degli studentiTest di soggetti verificati; fedeltà delle citazioni misurataMediana ≥12 TPS; p95 TTFT ≤4 s≥16k; un utente attivoChiarezza dell’incertezza e verifica della fonte
Assistente alla programmazioneSuite di test specifica per il repository; tasso di patch accettate misuratoMediana ≥20 TPS; p95 TTFT ≤3 s≥16k; uno o due utentiEsecuzione in ambiente sandbox; rollback
Analisi di documenti lunghiPrecisione nel richiamo dell’estrazione e nell’individuazione della posizione della citazione.Mediana ≥8 TPS; p95 TTFT ≤8 s≥32k o pipeline di recupero convalidataIngestione riproducibile dei documenti
Ricerca indipendenteTest di benchmark del dominio e di provenienzaMediana ≥10 TPS≥32k; da uno a quattro utentiModello, prompt e corpora con versioni.
Studio professionaleSoglie di errore e di astensione validate≥12 TPS/utente; p95 TTFT ≤4 sQuattro o più sessioni simultaneeControllo degli accessi, registro di controllo, backup
Supporto alle decisioni clinicheValidazione locale prospettica; revisione umana obbligatoriaLatenza impostata dal flusso di lavoro clinicoCapacità in condizioni di picco di carico clinicoElevata disponibilità, tracciabilità, risposta agli incidenti
Servizio di conoscenza aziendaleSuccesso nell’esecuzione del compito e tasso di risposte fondate≥10 TPS/utente; p95 TTFT ≤5 sOltre 50 sessioni simultanee o SLA della coda misuratoSSO, controllo dei ruoli, monitoraggio, failover
Analisi batchAccuratezza del lotto convalidataCompletamento entro i tempi di elaborazione previsti.Basato sul flusso di lavoroCheckpointing e ripristino del lavoro
Uso sensibile a livello governativoValidazione specifica della missioneLatenza nel caso peggiore definita dalla missioneCapacità di risposta rapida documentataSegmentazione, revisione della catena di fornitura, piena tracciabilità

La dicitura “Si adatta alla memoria” non soddisfa nessuno di questi criteri, a parte la semplice capacità di caricamento fisico.


4.7 Architetture di capitale per classe di utente

4.7.1 Livelli di distribuzione di riferimento

LivelloArchitettura indicativaBusta modello credibileUtenti appropriati
T1 — Ingresso localeGPU da 12–16 GB; RAM da 64–128 GB7–14B interattivo; modelli più grandi tramite offload più lentoStudente, professionista individuale
T2 — Postazione di lavoro avanzataGPU da 24–32 GB; RAM da 128–256 GB14–35 miliardi forti; 70 miliardi scaricati o vincolatiRicercatore, piccolo studio
T3 — Workstation di grandi dimensioni con memoria unificata o doppio acceleratore64–192 GB di spazio utilizzabile per acceleratore/pool unificato35–100B quantizzati, a seconda del contestoGruppo di ricerca, startup
T4 — Server multi-GPUMemoria acceleratrice aggregata da 192 a 640 GB70–405B quantizzato; modelli più piccoli a maggiore concorrenzaPMI, laboratorio, ospedale
T5 — Sistema aziendale integratoMemoria acceleratore aggregata di oltre 1 TBInferenza densa in prossimità della frontiera e sistemi MoE di grandi dimensioniImpresa, governo
T6 — ClusterSistemi multipli integrati con tessuto ad alta velocitàServizio su larga scala, messa a punto e resilienzaGrande impresa, laboratorio statale o di frontiera

La memoria aggregata non è equivalente a un singolo pool di memoria coerente. I pesi del modello devono essere suddivisi; la comunicazione può dominare la latenza; le schede consumer potrebbero non disporre di una topologia peer-to-peer adeguata; la probabilità di guasto aumenta con il numero di dispositivi; e gli aggiornamenti progressivi possono richiedere capacità duplicata.

4.7.2 Intervalli di pianificazione per istituzione

Tutte le fasce monetarie riportate di seguito si riferiscono a scenari di pianificazione in dollari USA per il 2026. Non si tratta di preventivi dei fornitori. Includono ampi intervalli di implementazione poiché la geografia degli acquisti, le tasse, l’assistenza, la sicurezza e la manodopera variano notevolmente.

Utente o istituzioneScala utile tipicaInvestimento iniziale indicativoCosto totale di proprietà (TCO) in contanti su cinque anni, escluso il costo del lavoro internoCosto totale di proprietà (TCO) economico completo su cinque anni, inclusa la manodopera specializzata.Principale vincolo economico
Studente7–14B; a volte scarico 30BDa 1.500 a 5.000 dollariDa 2.500 a 9.000 dollariDa 4.000 a 20.000 dollariConvenienza e rapida obsolescenza
Ricercatore indipendente14–35B; vincolato 70BDa 4.000 a 15.000 dollariDa 7.000 a 30.000 dollariDa 20.000 a 100.000 dollariTempo impiegato per l’integrazione e la valutazione
Piccolo studio professionale14–70BDa 8.000 a 35.000 dollariDa 15.000 a 80.000 dollariDa 50.000 a 300.000 dollariSicurezza, supporto e tempi di inattività
Startup35–100B; multiutenteDa 25.000 a 200.000 dollari$70.000–$600.000da 250.000 a 2 milioni di dollariGestione del rischio salariale e di utilizzo nel settore ingegneristico
NOI70–405B quantizzato o repliche multiple più piccole$75.000–$750.000Da 250.000 a 3 milioni di dollarida 1 a 10 milioni di dollariAffidabilità, concorrenza e integrazione
Laboratorio universitario70B per esperimenti in zone di frontieraDa 100.000 a 3 milioni di dollarida 400.000 a 10 milioni di dollari2-30 milioni di dollariSovvenzioni, infrastrutture e mantenimento degli specialisti
Ospedale/organizzazione sensibile alla privacyServizi convalidati 35-405Bda 250.000 a 5 milioni di dollariDa 1 a 20 milioni di dollari5-60 milioni di dollariGovernance, validazione e alta disponibilità
Grande impresaMolteplici classi di modelli e unità aziendaliDa 1 a 50 milioni di dollariDa 5 a 200 milioni di dollariDa 20 a 500 milioni di dollariIngegneria e governance della piattaforma
Agenzia governativaSistema dipartimentale sicuro o cluster sovranoDa 2 a oltre 100 milioni di dollariDa 10 a oltre 500 milioni di dollariDa 50 milioni a oltre 1 miliardo di dollariAccreditamento di sicurezza, resilienza e approvvigionamento sovrano

Queste fasce non dovrebbero essere combinate in un’unica media. Le distribuzioni sono fortemente asimmetriche e i requisiti istituzionali creano discontinuità. Un ospedale non può semplicemente acquistare la configurazione per studenti moltiplicata per il numero di medici; sono necessari controllo degli accessi, flussi di lavoro validati, tracciabilità, continuità operativa, backup, gestione delle modifiche e monitoraggio della sicurezza. La norma HIPAA sulla sicurezza, ad esempio, richiede alle entità statunitensi regolamentate di implementare adeguate misure di sicurezza amministrative, fisiche e tecniche per le informazioni sanitarie protette elettronicamente. (Sintesi della norma HIPAA sulla sicurezza – Dipartimento della Salute e dei Servizi Umani degli Stati Uniti – Agosto 2026 — HHS) . Ciò non prescrive un acceleratore specifico, ma modifica il limite economico di un’implementazione accettabile.


4.8 Costo totale di proprietà su cinque anni

4.8.1 Formulazione scontata corretta

Il modello TCO richiesto risulta economicamente coerente quando si attualizza il valore residuo ricevuto nel quinto anno:

TCO 5 = CAPEX + Σ t=1 5 [(E t + C t + M t + S t + L t + D t ) ÷ (1+r) t ] − RV 5 ÷ (1+r) 5

Dove:

  • t = elettricità e raffreddamento;
  • t = connettività e supporto/overflow del cloud;
  • t = manutenzione, ricambi e garanzie;
  • t = software, licenze e monitoraggio;
  • t = lavoro specializzato;
  • t = tempo di inattività, guasto e costo di sostituzione;
  • RV 5 = valore di rivendita o valore residuo dopo cinque anni;
  • r = tasso di sconto reale o nominale coerente con tutti i flussi di cassa.

Se tutti i flussi di cassa sono espressi in dollari nominali, r deve essere nominale e i prezzi dei componenti devono incorporare l’inflazione prevista. Se i flussi di cassa sono valori reali a prezzi costanti, r deve essere reale. Mescolare l’aumento nominale dell’elettricità con un tasso di sconto reale sovrastima i costi.

Per un costo operativo annuo costante O e un tasso di sconto costante r:

PV(O) = O × [1 − (1+r) −5 ] ÷ r

Con un tasso di interesse r = 7%, il fattore di attualizzazione a cinque anni è approssimativamente pari a 4,1002.

4.8.2 Elettricità e raffreddamento

Il consumo energetico annuo dell’impianto è:

Impianto KWh ,t = P IT,t × 8.760 × u t × PUE t

t = kWh impianto,t × p e,t

Dove:

  • IT,t è la potenza media IT durante il funzionamento, in kW;
  • t è il ciclo di lavoro;
  • PUE t è la potenza della struttura divisa per la potenza IT;
  • e,t è il prezzo dell’elettricità per kWh.

Per una postazione di lavoro personale, un valore PUE letterale da data center potrebbe non essere appropriato; il raffreddamento potrebbe essere già integrato nel sistema di riscaldamento o climatizzazione domestico. In tal caso, è necessario stimare separatamente un moltiplicatore di raffreddamento. Per un data center, è preferibile utilizzare un valore PUE misurato.

Nel 2023, i data center statunitensi hanno consumato circa 176 TWh, ovvero il 4,4% dell’elettricità statunitense; la valutazione federale ufficiale prevedeva un consumo compreso tra 325 e 580 TWh, pari al 6,7-12% dell’elettricità statunitense, entro il 2028. Si tratta di una proiezione a livello di sistema, non di una previsione tariffaria, ma identifica la disponibilità di energia e la connessione alla rete come rischi significativi in ​​termini di costi. Il Dipartimento dell’Energia degli Stati Uniti pubblica un nuovo rapporto che valuta l’aumento della domanda di elettricità da parte dei data center – Dipartimento dell’Energia degli Stati Uniti – Dicembre 2024 — Valutazione del consumo di elettricità dei data center del Dipartimento dell’Energia degli Stati Uniti .

4.8.3 Costo totale di proprietà (TCO) di una postazione di lavoro a titolo esemplificativo

Assumere:

  • CAPEX = $ 5.500;
  • Potenza media attiva dei sistemi IT = 0,65 kW;
  • utilizzo = 30%;
  • moltiplicatore di raffreddamento = 1,10;
  • elettricità = 0,15 $/kWh;
  • Riserva per manutenzione e sostituzione = 300 dollari all’anno;
  • software e backup = 400 dollari all’anno;
  • connettività/overflow del cloud = 200 dollari all’anno;
  • Indennità per periodi di inattività = 250 dollari all’anno;
  • La manodopera specializzata è esclusa dal costo totale di proprietà (TCO) in contanti;
  • valore residuo al quinto anno = 10% del CAPEX;
  • Tasso di sconto = 7%.

L’elettricità annuale è:

E = 0,65 × 8,760 × 0,30 × 1,10 × 0,15
E ≈ $ 282

Il costo operativo annuo non legato al lavoro è:

O = 282 + 300 + 400 + 200 + 250
O = $ 1.432

Il valore attuale a cinque anni è:

PV(O) = 1.432 × 4,1002
PV(O) ≈ $ 5.871

Il valore attuale del valore residuo è:

PV(RV 5 ) = 550 ÷ 1,07 5
PV(RV 5 ) ≈ $392

Perciò:

TCO 5,cash = 5.500 + 5.871 − 392
TCO 5,cash ≈ $10.979

Se il proprietario dedica 80 ore all’anno all’acquisizione del modello, alla compatibilità della quantizzazione, al benchmarking, alla sicurezza, ai backup e alla risoluzione dei problemi, e il tempo è valutato a 50 dollari l’ora, il costo annuo del lavoro ammonta a 4.000 dollari. Il suo valore attuale su cinque anni è di circa 16.401 dollari, portando il costo totale di proprietà (TCO) a circa 27.380 dollari. L’esempio dimostra che l’elettricità spesso non è la voce di spesa dominante per i privati ​​o le piccole imprese. Il costo del lavoro e il capitale sottoutilizzato possono superarla.

4.8.4 Matrice di sensibilità

Utilizzando la stessa postazione di lavoro, il costo dell’energia elettrica scontato su un periodo di cinque anni varia come segue:

Uso attivo0,10 $/kWh0,20 $/kWh0,40 $/kWh
10%$102$204$408
30%$305$610$1.220
60%$610$1.220$2.440
90%$915$1.830$3.660

Presupposti: potenza attiva di 0,65 kW, moltiplicatore di raffreddamento di 1,10, tasso di sconto del 7% e prezzi reali dell’elettricità costanti. La matrice mostra perché l’economia dell’inferenza del consumatore è spesso dominata dall’hardware e dalla manodopera, mentre l’economia dei server utilizzati in modo continuativo diventa sostanzialmente più sensibile all’energia e al raffreddamento.


4,9 Costo per milione di token

4.9.1 Intensità energetica

Se l’output viene generato continuamente a una velocità di R token tok al secondo:

KWh Mtok = P IT × PUE × 1.000.000 ÷ (R tok × 3.600)

Per una workstation da 0,5 kW che produce 20 token di output al secondo con un moltiplicatore di raffreddamento di 1,10:

KWh Mtok = 0,5 × 1,10 × 1.000.000 ÷ (20 × 3.600)
KWh Mtok ≈ 7,64 kWh

A 0,15 $/kWh:

Costo energetico Mtok ≈ $1,15

Sono esclusi l’energia di precaricamento rapido, l’energia inattiva, le generazioni fallite, gli incorporamenti, il recupero, la preelaborazione e l’amministrazione del sistema. Si presuppone inoltre una decodifica continua, che un sistema personale utilizzato poco raramente raggiunge.

4.9.2 Costo livellato

Una misura livellata più completa è:

LC Mtok = TCO periodo ÷ [Token riusciti,periodo ÷ 1.000.000]

Per “token di successo” si intendono i token appartenenti a carichi di lavoro completati che soddisfano i criteri di qualità e utilità. Il conteggio degli output rifiutati, errati o inutilizzabili sottovaluta il costo economico.

Per una postazione di lavoro di esempio con un costo totale di proprietà (TCO) di 10.979 dollari:

Risultati positivi ottenuti in cinque anniCosto livellato in contanti
100 milioni di token109,79 dollari per milione
500 milioni di token21,96 dollari per milione
1 miliardo di token10,98 dollari per milione
5 miliardi di token2,20 dollari per milione

Includendo il costo del lavoro a titolo esemplificativo e utilizzando il costo totale di proprietà (TCO) economico completo di 27.380 dollari:

Risultati positivi ottenuti in cinque anniCosto economico totale
100 milioni di token273,80 dollari per milione
500 milioni di token54,76 dollari per milione
1 miliardo di token27,38 dollari per milione
5 miliardi di token5,48 dollari per milione

L’intelligenza artificiale locale diventa economicamente competitiva solo quando il tasso di utilizzo è sufficientemente elevato, il modello locale selezionato supera la soglia di qualità richiesta e i vantaggi in termini di privacy o controllo sono apprezzati. Una soluzione locale di bassa qualità non rappresenta un’alternativa più economica a una soluzione di successo basata su modelli all’avanguardia, se richiede ripetizioni, correzioni o una revisione professionale.


4.10 Affidabilità, privacy e requisito di duplicazione nascosta

L’implementazione locale può ridurre la trasmissione di prompt e documenti a un fornitore di inferenza esterno, ma non garantisce automaticamente la privacy. La superficie di attacco comprende la telemetria del sistema operativo, i canali di download dei modelli, gli artefatti dannosi dei modelli, le dipendenze compromesse, i log non crittografati, i prompt memorizzati nella cache, i database vettoriali, gli account amministrativi, gli strumenti di gestione remota, il furto fisico, i supporti di backup e le API del server di inferenza esposte senza un’adeguata autenticazione. Il framework di gestione del rischio dell’IA del NIST considera la gestione del rischio dell’IA come un ciclo di vita organizzativo che comprende governance, mappatura, misurazione e gestione, piuttosto che come una proprietà derivante dalla sola ubicazione dell’hardware. Artificial Intelligence Risk Management Framework 1.0 – National Institute of Standards and Technology – Gennaio/2023 — NIST AI RMF 1.0 .

L’affidabilità della produzione crea un moltiplicatore di capacità nascosto. Se un servizio deve rimanere disponibile durante l’aggiornamento di un modello, potrebbe essere necessaria una seconda copia eseguibile. Se il sistema non può tollerare un guasto alla GPU, necessita di capacità di riserva o di un sistema di fallback esterno. La relazione di disponibilità per un componente riparabile è approssimativamente:

A = MTBF ÷ (MTBF + MTTR)

dove MTBF è il tempo medio tra i guasti e MTTR è il tempo medio di riparazione. La disponibilità end-to-end è inferiore quando tutti i componenti seriali devono funzionare. Per n componenti seriali indipendenti:

Un sistema = ΠA e

Un sistema che comprende acceleratori, storage, switch di rete, sistemi di raffreddamento e servizi software può quindi risultare meno affidabile di qualsiasi singolo componente. La progettazione ad alta disponibilità spesso duplica l’endpoint di inferenza, lo storage, il percorso di rete e l’alimentazione; di conseguenza, il costo di capitale di un servizio affidabile può avvicinarsi a 1,5-2,5 volte quello del sistema minimo in grado di eseguire il modello.


4.11 Protocollo di benchmarking

Ogni sistema locale valutato successivamente nel rapporto dovrebbe divulgare:

CategoriaCampi obbligatori
HardwareAcceleratore esatto, conteggio, memoria, CPU, canali RAM, archiviazione, interconnessione
SoftwareSistema operativo, driver, framework di inferenza, versioni del kernel/libreria
ModelloPunto di controllo esatto, conteggio dei parametri, architettura, licenza, formato di quantizzazione
Carico di lavoroLunghezza del prompt, lunghezza dell’output, occupazione del contesto, impostazioni di campionamento
PrestazionePrefill token/s, decode token/s, mediana e p95 TTFT
ConcorrenzaSequenze attive, profondità della coda, throughput per utente, latenza p95
MemoriaInattivo, modello caricato, pre-riempimento di picco, decodifica di picco, frammentazione dopo la corsa di resistenza
EnergiaConsumo energetico delle prese IT a muro, moltiplicatore di capacità, potenza inattiva e attiva
QualitàBenchmark di dominio, tasso di successo delle attività, astensione e tasso di errore fattuale
AffidabilitàTasso di errore, tempo di riavvio, tempo di inattività dell’aggiornamento, durata del carico sostenuto
EconomiaCAPEX, tasse, elettricità, sostegno, manodopera, valore residuo, utilizzo
PrivacyFlusso di dati, registri, crittografia, controllo degli accessi, telemetria, conservazione
RiproducibilitàSemi, script, versione del corpus di test e data di misurazione

Un confronto valido deve riportare sia le prestazioni di precompilazione che quelle di decodifica. I prompt lunghi possono essere limitati dal calcolo di precompilazione, mentre l’output conversazionale è spesso limitato dalla larghezza di banda della memoria. La latenza media non deve sostituire la latenza p95 nei servizi multiutente perché il batching e la gestione delle code possono nascondere ritardi di coda significativi.


4.12 Matrice decisionale per classe di utente

Classe utenteObiettivo locale minimo difendibileQuando l’implementazione locale è razionaleQuando non è razionale
Studente7–14B quantizzatoApprendimento, appunti offline, supporto alla programmazione, bozze riservateQuando la qualità di frontiera è essenziale e l’utilizzo è basso
Ricercatore indipendente14–35B; scarico opzionale 70BRiproducibilità, corpora riservati, esperimenti prolungatiQuando il tempo di integrazione supera il valore della ricerca
Studio di piccole dimensioni14–70B con sicurezza gestitaFlusso di lavoro di dominio ripetuto con elevato valore di privacyQuando nessun membro dello staff può occuparsi degli aggiornamenti e della valutazione
StartupModelli replicati di piccole dimensioni o server da 35–100BCarico di lavoro stabile, elevato utilizzo, dati proprietariQuando la domanda è incerta e il capitale deve rimanere flessibile
NOIServer multiutente con overflow nel cloudVolume prevedibile e integrazione con i sistemi interniQuando la ridondanza e il personale annullano i risparmi sui costi unitari
Laboratorio universitarioServer di ricerca multi-GPUSperimentazione del modello, set di dati controllati, accesso alla formazioneQuando i finanziamenti coprono l’hardware ma non le operazioni
OspedaleServizio modello validato con ridondanzaDati sensibili e compiti delimitati clinicamente validatiQuando la qualità o la governance del modello locale sono inadeguate
Grande impresaPortafoglio di servizi locali, in cloud privato ed esterniElevato volume, sovranità, flussi di lavoro differenziatiQuando ci si aspetta che un unico appalto risolva esigenze eterogenee
Agenzia governativaInfrastruttura di inferenza sicura segmentataElaborazione riservata, sovrana o di importanza critica per la missioneQuando la catena di approvvigionamento, il personale o il supporto del ciclo di vita non vengono risolti

4.13 Prospettive quinquennali, 2027-2031

Nei prossimi cinque anni, è probabile che l’efficienza aritmetica e la qualità della quantizzazione migliorino, ma questi miglioramenti non elimineranno la disuguaglianza tra IA locali e sistemi di intelligenza artificiale. La risorsa limitante si sta spostando dalla semplice memorizzazione dei parametri verso un insieme di fattori quali larghezza di banda della memoria, capacità di contesto, concorrenza, elaborazione multimodale, ottimizzazione del software, capacità di valutazione e affidabilità operativa. I modelli più piccoli diventeranno sempre più performanti per carichi di lavoro limitati, consentendo agli utenti di ottenere assistenti privati ​​utili senza la necessità di infrastrutture di livello all’avanguardia. Allo stesso tempo, la definizione di capacità competitiva si sposterà verso l’alto, man mano che i sistemi di frontiera remoti acquisiranno maggiore capacità di ragionamento, utilizzo di strumenti, multimodalità e prestazioni a lungo termine. Questo crea un effetto di “bersaglio mobile”: il costo hardware per riprodurre le capacità odierne potrebbe diminuire, mentre il costo per eguagliare l’attuale frontiera rimane elevato.

È necessario testare tre traiettorie:

ScenarioTraiettoria dell’hardwareeffetto di accesso localeconseguenza istituzionale
DiffusioneLa capacità di memoria aumenta; i modelli efficienti migliorano rapidamenteLa capacità di operare secondo il programma 7-70B diventa ampiamente accessibile.L’intelligenza artificiale locale diventa una normale funzione della workstation.
BiforcazioneLa capacità dei consumatori migliora, ma i requisiti di frontiera aumentano più rapidamente.L’accesso di base si amplia; l’accesso alle frontiere rimane concentratoIl mercato delle competenze a due livelli persiste.
costrizioneRimangono gravi i vincoli relativi a memoria, imballaggio, energia ed esportazione.Al di fuori dei mercati più ricchi, i sistemi locali utili rimangono costosi.I programmi di sovranità e l’esclusione regionale si intensificano

La conclusione principale è che l’IA locale non costituisce un unico mercato. Comprende almeno quattro regimi economici: inferenza offline personale, servizio professionale a nodo singolo, implementazione multiutente istituzionale e infrastruttura sovrana su scala di frontiera. Il costo marginale dei token può essere basso in un sistema ad alto utilizzo, ma il costo fisso per entrare in ciascun regime successivo aumenta in modo discontinuo perché i requisiti di memoria, ridondanza, sicurezza e manodopera si presentano in blocchi indivisibili.


4.14 Conclusioni verificabili

  1. La memoria dei pesi è una misura di capacità necessaria ma insufficiente. Un modello denso INT4 a 70 bit ha circa 35 GB di pesi grezzi, ma l’elaborazione a lungo termine o le operazioni concorrenti possono aggiungere decine di gigabyte di cache KV.
  2. La quantizzazione modifica la classe di modelli fattibili, ma non automaticamente la classe di modelli economicamente utilizzabili. Qualità, supporto del kernel e comportamento di offload devono essere confrontati.
  3. Un sistema con 128 GB di RAM e una GPU da 12 GB può caricare modelli molto più grandi della memoria della GPU, ma la capacità di caricamento non determina l’usabilità interattiva. Il limite economicamente sostenibile è generalmente inferiore al limite fisico della RAM.
  4. Per i singoli individui, il capitale e il tempo degli specialisti sono generalmente i fattori che incidono maggiormente sul consumo di energia elettrica. Per i sistemi istituzionali utilizzati in modo continuativo, l’energia, il raffreddamento, la manutenzione e la ridondanza assumono un’importanza crescente.
  5. Il costo per milione di token utili è sensibile al tasso di utilizzo. Un basso utilizzo può rendere l’inferenza locale più costosa dell’accesso esterno a consumo, anche quando il costo marginale dell’elettricità è basso.
  6. L’implementazione di soluzioni che rispettano la privacy comporta costi aggiuntivi anziché una semplice riduzione dei costi del cloud. Sicurezza, registri, controllo degli accessi, tracciabilità dei modelli, backup e gestione degli incidenti rimangono elementi essenziali.
  7. L’inferenza locale in ambienti di frontiera è tecnicamente fattibile solo nel significato istituzionale di “locale”. Può essere eseguita all’interno della struttura di un’organizzazione, ma richiede comunque alimentazione, raffreddamento, rete e operazioni specialistiche a livello di rack.
  8. La definizione scientificamente più valida di IA locale utilizzabile è specifica per il carico di lavoro. Deve includere qualità, latenza p95, throughput, concorrenza, contesto effettivo, affidabilità, sicurezza e manutenzione.
  9. Il divario di accesso quinquennale dovrebbe essere misurato in base al successo di compiti equivalenti a quelli di frontiera, non in base al numero di parametri. I modelli piccoli ed economici possono ampliare l’accesso di base, lasciando però concentrate le capacità di frontiera economicamente rilevanti.
  10. Ogni successivo confronto dei costi deve riportare sia il costo totale di proprietà (TCO) in termini di cassa che il costo totale di proprietà (TCO) economico complessivo. Escludere il lavoro interno è appropriato per l’analisi del budget di cassa, ma sottostima in modo significativo il consumo di risorse sociali e organizzative.

CAPITOLO 5 — L’economia dell’IA nel cloud e il prezzo futuro dei token

5.1 Ambito, obiettivo analitico e limiti probatori

L’IA in cloud trasforma un sistema di produzione eccezionalmente ad alta intensità di capitale in un servizio apparentemente semplice a consumo. Il cliente vede un prezzo API per milione di token di input o output, un abbonamento mensile, un contratto di capacità riservata o una tariffa per il completamento di un’attività. Dietro a questo prezzo si cela una struttura di costi stratificata verticalmente che comprende ricerca del modello, addestramento, post-addestramento, valutazione, acceleratori, memoria ad alta larghezza di banda, server host, rete, archiviazione, costruzione di data center, terreno, elettricità, raffreddamento, acqua, manutenzione, manodopera specializzata, ingegneria del software, acquisizione clienti, finanziamenti e il costo economico della capacità inutilizzata. I prezzi dei token non possono quindi essere interpretati come se rappresentassero solo l’elettricità consumata durante l’inferenza. Né un basso prezzo API pubblico può essere considerato la prova che il modello corrispondente sia economico da produrre. I fornitori possono allocare le spese di addestramento sull’utilizzo futuro, recuperare i costi tramite contratti aziendali, abbinare l’IA a software a margine più elevato, sovvenzionare l’adozione tramite pubblicità o profitti del cloud, accettare un rendimento temporaneo inferiore al costo del capitale o fissare prezzi in modo strategico per creare dipendenza dall’ecosistema. Al contrario, un fornitore può ridurre i prezzi senza sovvenzionare l’utilizzo quando l’efficienza hardware, la quantizzazione, la decodifica speculativa, il batching, la memorizzazione nella cache immediata, il routing dei modelli o l’utilizzo migliorano più rapidamente dell’aumento dei costi di capitale. Il compito empirico non è quindi quello di affermare che tutti gli attuali servizi di IA siano civetta, ma di determinare se i ricavi, i margini, le spese in conto capitale, gli ammortamenti, i livelli di servizio e le differenze di prezzo dichiarati siano coerenti con prezzi di lancio competitivi, sovvenzioni incrociate o una produzione economica sostenibile.

Questo capitolo utilizza tre classi di evidenze. I prezzi osservati sono tratti dalla documentazione ufficiale dei fornitori, verificata il 15 agosto 2026. I dati economici aziendali sono ricavati dalle informative ufficiali per gli investitori, tenendo conto del fatto che le principali società quotate in borsa non pubblicano un conto economico completo e indipendente per l’inferenza dei modelli di frontiera. Le stime e le proiezioni dei costi unitari sono scenari analitici generati da parametri esplicitamente dichiarati. L’assenza di un segmento di inferenza AI sottoposto a revisione contabile separata impedisce qualsiasi affermazione scientificamente valida secondo cui un determinato fornitore stia effettivamente perdendo un importo specificato per token. Il capitolo può verificare se l’ipotesi del prodotto civetta sia supportata, contraddetta o lasciata irrisolta; non può tuttavia inventare dati sui costi mancanti.


5.2 L’IA nel cloud come sistema di produzione

La catena economica di base è:

  1. Ricerca e architettura dei modelli.
  2. Acquisizione, pulizia, concessione di licenze e governance dei dati.
  3. Pre-addestramento.
  4. Post-allenamento e allineamento.
  5. Test di sicurezza, red teaming e valutazione.
  6. Ottimizzazione e compilazione del modello.
  7. Distribuzione su cluster di inferenza.
  8. Orchestrazione della capacità, caching e routing.
  9. API, abbonamento e distribuzione aziendale.
  10. Assistenza clienti, conformità e gestione degli incidenti.
  11. Sostituzione del modello e aggiornamento dell’infrastruttura.

Questa sequenza crea due gruppi di costi distinti ma interagenti:

FC = C ricerca + C formazione + C post + C sicurezza + C software + C struttura fissa + C commerciale fisso

VC = C tempo di accelerazione + C tempo di memoria + C energia + C raffreddamento + C rete + C variabile di archiviazione + C variabile di supporto + C strumenti

La distinzione non è perfettamente netta. L’ammortamento degli acceleratori si comporta come un costo fisso impegnato dopo l’acquisto di un cluster, ma diventa un costo attribuibile all’utilizzo nella contabilità di prodotto. La manodopera specializzata può essere fissa entro un orizzonte di pianificazione, ma scalabile su periodi più lunghi. La capacità del data center può essere di proprietà, finanziata, noleggiata o riservata tramite un altro fornitore di servizi cloud. L’addestramento del modello è irrecuperabile una volta completato, ma il continuo riaddestramento e la sostituzione lo trasformano in una spesa ricorrente di portafoglio. La classificazione appropriata dipende quindi dalla decisione che si sta esaminando:

DecisioneCosto economicamente rilevante
Se soddisfare un’ulteriore richiesta su hardware già inattivoCosto marginale a breve termine
Se applicare sconti sui prezzi delle API per un trimestreCosti operativi evitabili più obiettivo strategico
Se costruire un altro cluster di inferenzaCosto totale incrementale e rendimento richiesto
Se un modello di famiglia sia sostenibile per cinque anniCosto del ciclo di vita completamente allocato
Se un’azienda di IA realizza un profitto economicoRicavi meno tutti i costi operativi e il costo del capitale
Se un cliente dovrebbe utilizzare l’IA in cloud o in localePrezzo finale per il cliente più costi di integrazione, rischio e passaggio a un nuovo sistema.

Un fornitore può razionalmente fissare un prezzo superiore al costo marginale di breve periodo, ma inferiore al costo medio di piena allocazione, finché esiste capacità inutilizzata. Tale politica di prezzi non è necessariamente predatoria o irrazionale; può massimizzare il margine di contribuzione durante la fase di aumento della domanda. Diventa strutturalmente insostenibile se i ricavi rimangono insufficienti per sostituire gli acceleratori che si deprezzano, finanziare gli impianti, sviluppare modelli successivi e compensare il capitale investito.


5.3 La struttura completa dei costi dell’IA nel cloud

5.3.1 Architettura della pila dei costi

Livello dei costiAutista principaleFisso, variabile o mistoBase di allocazione appropriataPrincipale inquinamento
Acquisto AcceleratoreNumero di dispositivi, memoria, interconnessioneRisolto dopo l’acquistoOre di accelerazione o token di successoVita economica e valore residuo
Server hostCPU, RAM, memoria di archiviazione, schede di reteFissoOrari del serverUtilizzo condiviso tra i modelli
Ammortamento acceleratocosto di acquisto, durata, utilizzoContabilità a unità misteAcceleratore produttivo-secondiL’obsolescenza può precedere il guasto fisico.
RetiInfrastruttura, interruttori, ottica, WANMistoByte, richieste, ore di accelerazioneMoE e intensità dell’inferenza distribuita
MagazzinaggioPesi, set di dati, registri, cacheMistoGB-mese, operazioni di lettura/scritturaPolitiche di replica e conservazione
Costruzione di data centerEdifici, impianti elettrici e di raffreddamentoFissoCapacità IT, rack-kW, vita utileTempi di realizzazione e capacità inutilizzata
TerraPosizione e prossimità alla grigliaFissoCapacità del sitoDisponibilità degli allacciamenti e normativa urbanistica
ElettricitàCarico e tariffa ITVariabilekWhTariffe regionali e supplementi per le ore di punta
RaffreddamentoClima, PUE, sistema idricoVariabile/mistoEnergia e calore rimossi dall’impiantoRestrizioni meteorologiche e idriche
AcquaTecnologia di raffreddamento e climaVariabileLitri per kWh o carico di lavoroMisurazione specifica del sito
ManutenzioneTassi di guasto, pezzi di ricambio, garanzieMistoBeni installatiScarsità di componenti
manodopera specializzataIngegneri, ricercatori, personale di sicurezzaPrincipalmente fissoProdotto, cluster o ricavoAllocazione condivisa di ricerca e sviluppo
Pre-addestramentoCalcolo, dati, ricercatoriCosti fissi per modelloUtilizzo fatturabile a vitaDurata del modello e informazioni sulla formazione
Post-allenamentoMessa a punto, dati sulle preferenze, apprendimento per rinforzoRicorrente fissoFamiglia di modelli o utilizzoFrequenza di iterazione
Sicurezza e valutazioneRed team, benchmark, governanceRicorrente fissoModello o rilascioLa portata aumenta con la capacità
software InferenceKernel, compilatori, pianificatoriRicorrente fissoProdotto o flottaGuadagni di efficienza proprietari
Acquisizione clientiVendite, crediti, pubblicitàMistoGruppo di clienti o fatturatoCrediti promozionali e costi di canale
Conformità aziendaleCertificazioni, aspetti legali, residenza dei datiMistoContratto o regioneFrammentazione normativa
FinanziamentoDebito, leasing, capitale proprioRendimento fisso/obbligatorioCapitale investitoCosto medio ponderato del capitale
Capacità inutilizzataInfrastruttura inutilizzata ma installataSpese economiche aggiuntiveUtilizzo fatturabileVolatilità della domanda
Lavoro fallitoErrori, tentativi, output rifiutatiRifiuti variabiliCompiti di successoRaramente visibile negli account dei token

L’elemento più frequentemente omesso è la capacità inutilizzata . L’inferenza cloud deve mantenere una capacità di riserva sufficiente per assorbire le variazioni della domanda, i guasti delle apparecchiature e gli impegni di latenza. Un parco macchine gestito al 100% dell’utilizzo nominale presenterebbe code e latenze di coda inaccettabili. Se solo il 45% del tempo teorico dell’acceleratore produce token fatturabili commercialmente, ogni token fatturato deve assorbire un deprezzamento più che doppio rispetto a quello che si applicherebbe al 100% di utilizzo.


5.3.2 Ammortamento accelerato

Permettere:

  • acc = capitale installato per acceleratori e server;
  • RV n = valore residuo atteso dopo n anni;
  • n = vita economica utile;
  • Anno H = 8.760 ore;
  • produttivo = quota di tempo dedicata alla produzione di lavoro fatturabile.

L’ammortamento annuo a quote costanti è:

annuale = (K acc − RV n ) ÷ n

L’ammortamento per ora di utilizzo dell’acceleratore produttivo è:

ore = D annuale ÷ (8,760 × u produttiva )

Si consideri un cluster analitico del costo di 40 milioni di dollari, con una vita utile di quattro anni e un valore residuo del 10%.

annuale = (40.000.000 − 4.000.000) ÷ 4
annuale = 9.000.000 USD

Uso produttivoOre produttive all’annoAmmortamento per ora di cluster produttivo
25%2.1904.110 USD
40%3.5042.568 USD
60%5.2561.712 USD
75%6.5701.370 USD
90%7.8841.142 USD

L’utilizzo è quindi una variabile economica di primaria importanza. Un miglioramento del 20% nella velocità di accelerazione grezza è economicamente inferiore al raddoppio dell’utilizzo produttivo se il sistema più veloce rimane sottoutilizzato. I fornitori con un bacino di domanda ampio e diversificato godono di un importante vantaggio di scala perché possono instradare il traffico tra clienti, regioni, modelli, richieste interattive e processi batch.

Microsoft ha riportato spese in conto capitale trimestrali pari a 31,9 miliardi di dollari nel terzo trimestre dell’anno fiscale 2026, di cui circa due terzi allocati ad asset a vita breve, principalmente GPU e CPU. L’azienda ha contemporaneamente comunicato che i continui investimenti nelle infrastrutture di intelligenza artificiale e il crescente utilizzo dell’IA hanno ridotto la percentuale del margine lordo del cloud. Microsoft Fiscal Year 2026 Third Quarter Earnings Conference Call – Microsoft – Aprile/2026 — Microsoft FY2026 Q3 investor disclosure . Questa è la prova diretta che l’ammortamento degli acceleratori e l’utilizzo dell’IA sono economicamente rilevanti. Non rivela il costo di alcun modello o token specifico.


5.3.3 Costruzione dei data center, terreni, reti e finanziamenti

La base di capitale complessiva a supporto dell’inferenza è più ampia della sola flotta di acceleratori:

K = K acceleratori + K server + K rete + K archiviazione + K elettricità + K raffreddamento + K edificio + K terreno + K costruzione in corso

Alphabet ha riportato spese in conto capitale per 35,7 miliardi di dollari nel primo trimestre del 2026, la stragrande maggioranza delle quali destinate all’infrastruttura tecnica a supporto delle opportunità legate all’intelligenza artificiale. Circa il 60% di tale investimento in infrastrutture tecniche è stato destinato ai server e il 40% ai data center e alle apparecchiature di rete. (Alphabet 2026 Q1 Earnings Call – Alphabet – Aprile/2026 — Alphabet Q1 2026 investor disclosure ). Nel secondo trimestre del 2026, Alphabet ha riportato spese in conto capitale per 44,9 miliardi di dollari, mantenendo approssimativamente la stessa ripartizione 60:40 tra server e infrastrutture di data center/rete. (Alphabet 2026 Q2 Earnings Call – Alphabet – Luglio/2026 — Alphabet Q2 2026 investor disclosure ).

La divulgazione stabilisce che analizzare solo il costo dell’acceleratore ometterebbe circa il 40% della recente allocazione di infrastrutture tecniche di Alphabet. Dimostra inoltre perché l’onere di cassa di un fornitore può aumentare prima che i ricavi vengano contabilizzati: terreni, sottostazioni, edifici, sistemi di raffreddamento, reti e server devono essere finanziati e costruiti prima che la capacità diventi fatturabile. L’onere finanziario risultante è:

capitale = WACC × K impiegati

dove WACC è il costo medio ponderato del capitale. Il punto di pareggio economico deve includere questo rendimento richiesto anche se l’utile operativo contabile è positivo. Un fornitore che guadagna il 4% su una base infrastrutturale mentre il suo costo del capitale corretto per il rischio è del 9% è contabilemente redditizio ma distrugge valore economico.


5.3.4 Elettricità, raffreddamento e acqua

Il consumo di energia elettrica dell’impianto attribuibile a un carico di lavoro può essere rappresentato come:

carico di lavoro = P IT × t × PUE

energia = E carico di lavoro × p elettricità

dove PUE è il consumo energetico totale dell’impianto diviso per il consumo energetico delle apparecchiature IT. Il consumo idrico deve essere monitorato separatamente:

carico di lavoro = E IT × DUE

dove WUE indica l’efficienza nell’uso dell’acqua, normalmente espressa in litri per kWh di energia IT. Né PUE né WUE dovrebbero essere sostituiti da un valore globale universale. Clima, progettazione del sistema di raffreddamento, fonte idrica, carico, età dell’edificio e limiti di contabilizzazione variano da struttura a struttura.

A livello nazionale, i data center statunitensi hanno consumato circa 176 TWh, ovvero il 4,4% del consumo totale di elettricità negli Stati Uniti, nel 2023; la valutazione ufficiale prevedeva un consumo compreso tra 325 e 580 TWh, pari al 6,7-12% del consumo totale degli Stati Uniti, entro il 2028. Il Dipartimento dell’Energia degli Stati Uniti pubblica un nuovo rapporto che valuta l’aumento della domanda di elettricità da parte dei data center – Dipartimento dell’Energia degli Stati Uniti – dicembre 2024 — Valutazione del consumo di elettricità dei data center del Dipartimento dell’Energia degli Stati Uniti . Ciò non dimostra che i prezzi dei token debbano necessariamente aumentare: l’efficienza, la compressione dei modelli e un maggiore utilizzo possono compensare l’inflazione dell’elettricità. Stabilisce tuttavia che l’accesso alla rete, i contratti di fornitura energetica e la capacità di trasmissione stanno diventando fattori strategici piuttosto che dettagli operativi trascurabili.


5.3.5 Formazione, post-formazione e sicurezza

Il costo del ciclo di vita attribuibile a una famiglia modello può essere scritto come:

ciclo di vita del modello = C ricerca + C dati + C pre-addestramento + C post-addestramento + C sicurezza + C valutazione + C implementazione + C pensionamento

L’allocazione per ogni token commerciale di successo sarebbe la seguente:

Modello C , token = Ciclo di vita del modello C ÷ Durata di vita del modello T riuscito

Il denominatore è altamente incerto al momento del lancio. Un modello di successo con trilioni di token fatturabili può ammortizzare ampiamente le spese di addestramento. Un modello sostituito nel giro di pochi mesi potrebbe non recuperare mai i costi di sviluppo. Di conseguenza, le frequenti release di modelli di frontiera accorciano la vita economica effettiva sia degli investimenti nei modelli che degli stack di inferenza ottimizzati.

La sicurezza e la valutazione non possono essere considerate, da un punto di vista scientifico, come costi aggiuntivi opzionali. Il loro ambito comprende valutazioni delle capacità, test di dominio, revisioni della sicurezza, red teaming, indagini sugli incidenti, monitoraggio degli abusi, analisi del comportamento dei modelli e governance del rilascio. Tuttavia, le pagine dei prezzi dei fornitori pubblici non rivelano quanta parte del prezzo di ciascun token sia allocata a queste attività.


5.4 Costo unitario dell’inferenza

5.4.1 Equazione del costo unitario di base

L’espressione del costo di inferenza richiesto è:

token = [C calcolo + C memoria + C energia + C rete + C struttura + C lavoro + C capitale ] ÷ T fatturabile

Ai fini dell’interpretazione commerciale, ciò dovrebbe essere ampliato come segue:

successful-token = [C inference-direct + C allocated-model + C allocated-platform + C commercial + C risk ] ÷ T successful

dove T successo esclude richieste non riuscite, utilizzo gratuito, crediti promozionali, test interni e output rifiutati dall’applicazione del cliente.

Il prezzo medio ponderato in base al token è:

blend = [P in T in + P cached T cached + P out T out + P reason T reason + C tools ] ÷ T total

Il costo a livello di attività è:

task = P in T in + P out T out + P cache-write T cache-write + P cache-read T cache-read + ΣC tool,j + C storage + C retrieval

Questa formulazione dimostra perché le tariffe pubblicizzate per i token di input non possono prevedere in modo affidabile il costo di un flusso di lavoro gestito da un agente.


5.4.2 Punto di pareggio del fornitore

Il rapporto di pareggio richiesto è:

BE = [FC + VC + R × K] ÷ Q

Dove:

  • FC = costo fisso attribuibile;
  • VC = costo variabile attribuibile;
  • K = capitale investito;
  • R = rendimento richiesto sul capitale investito;
  • Q = utilizzo fatturabile commercialmente.

Se l’utilizzo a fini promozionali o interni consuma capacità produttiva, è preferibile una formulazione adattata alla capacità produttiva:

BE = [FC + VC + R × K] ÷ [Q fisico × u fatturabile × y successo ]

Dove:

  • fatturabile è la quota fatturabile della capacità fisica;
  • Il mio successo è la quota di lavoro che produce risultati commercialmente validi.

Calcolo esemplificativo del punto di pareggio

Si consideri una piattaforma di inferenza con:

ParametroValore dello scenario
Costi fissi annuali240 milioni di dollari
costi variabili annuali310 milioni di dollari
Capitale investito2,5 miliardi di dollari
Restituzione richiesta10%
Utilizzo annuale fatturabile100 trilioni di token

Il fatturato annuo richiesto è:

Ricavi BE = 240 milioni + 310 milioni + 0,10 × 2.500 milioni
Ricavi BE = 800 milioni di dollari USA

Il prezzo di pareggio per milione di token è:

BE,MTok = 800.000.000 ÷ 100.000.000
BE,MTok = 8,00 USD

Il denominatore di 100 trilioni di token equivale a 100 milioni di unità da un milione di token. La sensibilità è sostanziale:

Gettoni annuali a pagamentoPrezzo di pareggio per milione di token
25 trilioni32,00 USD
50 trilioni16,00 USD
100 trilioni8,00 USD
200 trilioni4,00 USD
400 trilioniUSD 2,00

L’esempio non stima alcun fornitore specifico. Stabilisce il significato matematico della scala: a parità di infrastruttura, si possono ottenere prezzi di 32 o 2 dollari per milione di token, a seconda del throughput fatturabile.


5.5 Architettura di tariffazione pubblica verificata al 15 agosto 2026

5.5.1 Prezzi API diretti selezionati

Il seguente confronto riporta i prezzi di listino ufficiali per milione di token. Non si tratta di una tabella di equivalenza qualitativa: i modelli differiscono per funzionalità, tokenizzatore, velocità, contesto, affidabilità e strumenti supportati.

Fornitore e modelloIngresso standardInput memorizzato nella cache o hit nella cacheUscita standardInput batchOutput batchModificatore importante
Soluzione OpenAI GPT-5.65,00 USD0,50 USD30,00 USD2,50 USD15,00 USDContesto esteso: input di 10 USD e output di 45 USD
OpenAI GPT-5.6 TerraUSD 2,000,20 USD12,00 USDUSD 1,006,00 USDContesto esteso: input 4 USD e output 18 USD
OpenAI GPT-5.6 Luna0,20 USD0,02 USD1,20 USD0,10 USD0,60 USDContesto esteso: input 0,40 USD e output 1,80 USD
OpenAI GPT-5.55,00 USD0,50 USD30,00 USDLa tabella del fornitore identifica tariffe batch separateLa tabella del fornitore identifica tariffe batch separateOltre 272k in ingresso: 2× in ingresso e 1,5× in uscita
OpenAI GPT-5.5 Pro30,00 USDNessuno sconto per input memorizzati nella cache180,00 USDSupportatoSupportatoLivello professionale di calcolo avanzato
Anthropic Claude Opus 4.85,00 USDRilevamento cache da 0,50 USD25,00 USD2,50 USD12,50 USDScrittura nella cache per cinque minuti: 6,25 USD
Antropico Claude Sonetto 5USD 2,00Rilevamento cache da 0,20 USD10,00 USDUSD 1,005,00 USDIl prezzo standard rimarrà invariato anche dopo il periodo promozionale.
Antropico Claude Sonetto 4.63,00 USDRilevamento cache da 0,30 USD15,00 USD1,50 USD7,50 USDI terminali regionali possono comportare un supplemento del 10%.
Haiku antropico di Claude 4.5USD 1,00Rilevamento cache da 0,10 USD5,00 USD0,50 USD2,50 USDUn’ora di scrittura nella cache costa più di una scrittura di cinque minuti
Google Gemini 3.6 Flash, standard 20260,75 USD0,075 USD3,75 USD0,375 USD1,875 USDRaddoppio ufficiale previsto a partire dal 1° gennaio 2027
Google Gemini 3.6 Flash, priorità 20261,35 USD0,135 USD6,75 USDNon è la modalità prioritariaNon è la modalità prioritariaPremio per latenza/priorità
Google Gemini 3.5 Flash1,50 USD0,15 USD9,00 USD0,75 USD4,50 USDL’output include token di pensiero

Prezzi – API OpenAI – Agosto/2026 — Prezzi ufficiali dell’API OpenAI .
Modello GPT-5.5 – API OpenAI – Agosto/2026 — Prezzi ufficiali del modello GPT-5.5 .
Modello GPT-5.5 Pro – API OpenAI – Agosto/2026 — Prezzi ufficiali del modello GPT-5.5 Pro .
Prezzi – Documentazione della piattaforma Claude – Agosto/2026 — Prezzi ufficiali di Anthropic Claude .
Prezzi dell’API per sviluppatori Gemini – Google – Agosto/2026 — Prezzi ufficiali dell’API Gemini .

Seguono tre osservazioni empiriche.

Innanzitutto, i token di output sono sistematicamente più costosi dei normali token di input. I rapporti nei livelli standard selezionati variano approssimativamente da 5:1 a 8:1. La decodifica dell’output è sequenziale e meno facilmente parallelizzabile rispetto all’elaborazione immediata; il ragionamento può aggiungere generazione interna; e i fornitori inoltre stabiliscono i prezzi in base al valore e alla domanda, non solo al costo fisico.

In secondo luogo, gli input memorizzati nella cache possono costare circa un decimo degli input non memorizzati nella cache, mentre la scrittura nella cache può costare più di un input ordinario. OpenAI afferma che le scritture nella cache della famiglia GPT-5.6 vengono fatturate a 1,25 volte la tariffa degli input non memorizzati nella cache. Prompt Caching – OpenAI API – Agosto/2026 — Documentazione ufficiale di OpenAI sul prompt-caching . Anche Anthropic distingue in modo simile le scritture nella cache da cinque minuti e da un’ora dai semplici accessi alla cache, che costano meno. La tariffa, quindi, incoraggia l’uso ripetuto di contesti stabili, ma scoraggia la creazione indiscriminata di cache che non vengono mai riutilizzate.

In terzo luogo, l’elaborazione batch riceve comunemente uno sconto del 50%. Anthropic e Google pubblicano tariffe batch a metà prezzo per modelli selezionati, e Amazon Bedrock afferma che alcuni modelli di base ricevono uno sconto del 50% per l’inferenza batch rispetto ai prezzi on-demand. Prezzi di Amazon Bedrock – Amazon Web Services – Agosto/2026 — Prezzi ufficiali di Amazon Bedrock . Uno sconto costante del 50% è economicamente significativo: indica che la flessibilità di pianificazione, un utilizzo più fluido e una latenza ridotta diminuiscono sostanzialmente il costo opportunità del fornitore.


5.5.2 Prezzi nel contesto lungo

La durata del contesto influisce sui costi attraverso almeno quattro meccanismi:

  1. Vengono addebitati più token di input.
  2. Il calcolo del preriempimento aumenta.
  3. La memoria cache KV rimane occupata durante la generazione.
  4. Le richieste di lunga durata possono ridurre l’efficienza di raggruppamento e pianificazione.

Un moltiplicatore di contesto generale può essere rappresentato come:

Contesto P = base P × lunghezza m

dove la lunghezza m può essere continua, a livelli o incorporata in un prezzo specifico del modello.

La tabella ufficiale di OpenAI di agosto 2026 distingue i prezzi per contesto breve e lungo per i modelli GPT-5.6. Per GPT-5.6 Sol, le tariffe per contesto breve indicate sono di 5 USD in input e 30 USD in output per milione di token; le tariffe corrispondenti per contesto lungo sono di 10 USD e 45 USD. Google e Anthropic applicano strutture diverse: Google elenca i prezzi per modello e livello di servizio, mentre Anthropic afferma che i modelli Claude 4.6 e successivi includono l’intera finestra di contesto di un milione di token alle tariffe standard dei token. Queste differenze dimostrano che il “premio per contesto lungo” può apparire come un moltiplicatore esplicito, un livello di modello superiore, costi di archiviazione della cache o semplicemente un numero maggiore di token elaborati.

Esempio di compito di redazione di un documento lungo

Assumere:

  • 500.000 token di input non memorizzati nella cache;
  • 20.000 token di output;
  • nessuna chiamata di strumenti.
Modello/livelloCosto di inputcosto di produzioneTotale
GPT-5.6 Sol contesto lungo5,00 USD0,90 USD5,90 USD
GPT-5.6 Terra contesto lungoUSD 2,000,36 USD2,36 USD
Claude Sonetto 5 standardUSD 1,000,20 USD1,20 USD
Gemini 3.6 Flash 2026 standard0,375 USD0,075 USD0,45 USD

Il confronto non stabilisce una qualità di risposta equivalente. Un modello a basso costo diventa economicamente più oneroso se non riesce a svolgere il compito, richiede chiamate ripetute o produce una risposta che necessita di un’ampia correzione umana.


5.5.3 Abbonamenti rispetto all’accesso API a consumo

Gli abbonamenti per i consumatori trasformano l’utilizzo variabile in un pagamento mensile apparentemente fisso:

ARPU abbonamento = Canone mensile ÷ Utente

Il contributo del fornitore per abbonato è:

Utente CM = Tariffa mensile − C inferenza,utente − C supporto,utente − C acquisizione,utente − C piattaforma allocata,utente

Un abbonamento a prezzo fisso crea una distribuzione del rischio d’uso. Gli utenti con un basso consumo sovvenzionano gli utenti con un consumo elevato all’interno del gruppo di abbonati, a meno che limiti di tariffazione, instradamento tra modelli o crediti di utilizzo non controllino la coda. Di conseguenza, i piani tariffari per i consumatori generalmente includono politiche di utilizzo equo, accesso flessibile, limiti di messaggi, servizio a priorità inferiore in caso di congestione o instradamento automatico tra modelli.

Gli abbonamenti svolgono anche funzioni strategiche che una tariffa API pura non offre:

  • accelerare la formazione di abitudini;
  • aumentare i costi di passaggio;
  • creare ecosistemi di conversazione e di file persistenti;
  • generare dati di utilizzo per il miglioramento del prodotto;
  • fornire entrate ricorrenti prevedibili;
  • raggruppare funzioni ad alto e basso costo;
  • oscurare il prezzo marginale delle singole attività;
  • segmentare i clienti in base alla disponibilità a pagare.

I contratti aziendali includono gestione delle identità, controlli dei dati, funzioni di audit, supporto, impegni contrattuali, elaborazione regionale, livelli di servizio e integrazione degli acquisti. Il loro prezzo unitario effettivo non può essere dedotto dalle tariffe applicate ai consumatori pubblici.


5.5.4 Capacità riservata, prioritaria e a lotti

Modalità commercialeIl cliente riceveIl fornitore riceveeffetto economico
Standard su richiestaFlessibilità senza impegnoDomanda variabile e utilizzo incertoPrezzo di listino standard
LottoPrezzo inferiore; completamento posticipatoLibertà di programmazione e maggiore utilizzoSconto
Flessibile o a bassa prioritàPrezzo inferiore con latenza variabileCapacità di utilizzare la capacità residuaSconto o servizio variabile
Priorità/veloceLatenza di coda ridotta e programmazione preferenzialeMaggiori ricavi per unità di capacità limitatapremi
capacità riservataFlusso di lavoro garantito o prevedibileVisibilità garantita dei ricavi e della domandaPrezzo della capacità contrattualizzata
Elaborazione regionaleControllo geograficoRiduzione della flessibilità di instradamento e duplicazione regionale.premio geografico
Implementazione dedicataIsolamento e controlloImpegno a lungo termine e attenzione al clientePrezzo negoziato
Accesso di emergenzaCapacità immediata in situazioni di scarsitàAffitto di scarsitàPremium dinamico
Spot/interrompibilePrezzo molto basso con rischio di interruzioneMonetizzazione della capacità altrimenti inutilizzataSconto eccezionale

Amazon Bedrock identifica ufficialmente i livelli di servizio Reserved, Priority, Standard e Flex . Livelli di servizio per l’ottimizzazione di prestazioni e costi – Amazon Web Services – agosto 2026 — Documentazione ufficiale sui livelli di servizio di Amazon Bedrock . Ciò rappresenta un’evidente evoluzione da un prezzo unico e uniforme dei token verso un modello di gestione del rendimento simile a quello del cloud computing, delle telecomunicazioni e dei trasporti.


5.6 Costi di messa a punto, recupero, archiviazione e strumenti agentici

5.6.1 Messa a punto

Il costo totale di un modello ottimizzato è:

FT,totale = C token di addestramento + C preparazione dati + C valutazione + C hosting + C inferenza + C manutenzione

La messa a punto può ridurre la lunghezza dei prompt internalizzando istruzioni o modelli di dominio, ma introduce costi di costruzione del dataset, convalida, versioning e test di regressione. La condizione di pareggio è:

Promemoria sui risparmi + Qualità dei risparmi + Revisione umana dei risparmi > C FT, totale

Un modello ottimizzato che riduce ogni richiesta di 10.000 token di input, ma che richiede un costoso riaddestramento dopo ogni aggiornamento del modello di base, potrebbe non raggiungere mai un valore positivo nel suo ciclo di vita.

5.6.2 Recupero e archiviazione

La generazione potenziata dal recupero genera diversi costi oltre alla semplice generazione di testo:

RAG = C embedding + C vector-storage + C indexing + C retrieval + C reranking + C retrieved-input + C generation

Il cliente può ridurre l’illusione del modello e evitare richieste di informazioni troppo lunghe, ma solo se la precisione del recupero è elevata. Un recupero scadente aumenta sia il consumo di token che il tasso di errore.

5.6.3 Utilizzo degli strumenti Agentic

Un agente può richiamare ricerche, eseguire codice, accedere a database, browser, API esterne o altri modelli. Il suo costo è ricorsivo:

Agente C = Σ i=1 Modello C ,i + Σ j=1 m Strumento C ,j + Archiviazione C + Orchestrazione C + Verifica C

Il listino prezzi ufficiale di OpenAI indica un costo di 10 USD per 1.000 chiamate per la ricerca web, oltre alle eventuali commissioni per i token del modello. Prezzi – API OpenAI – Agosto/2026 — Prezzi ufficiali delle API e degli strumenti OpenAI .

Esempio illustrativo di flusso di lavoro dell’agente

Si supponga che un’attività di ricerca utilizzi:

  • 200.000 token di input;
  • 20.000 token di output;
  • 30 chiamate di ricerca web;
  • GPT-5.6 Sol: prezzi standard in contesti brevi.

Costo del modello:

Modello C = 0,2 × 5 + 0,02 × 30 Modello
C = 1,60 USD

Costo della ricerca:

Ricerca in C = 30 × 10 ÷ 1.000 Ricerca
in C = 0,30 USD

Costo totale diretto del fornitore:

Attività C = 1,60 + 0,30 Attività
C = 1,90 USD

Se l’agente entra in un ciclo di errori e ripete la sequenza cinque volte, il costo diretto sale a 9,50 USD, anche se il risultato finale rimane un’unica attività. Pertanto, è probabile che in futuro le politiche di prezzo aziendali si concentrino sui budget per attività completata e sul controllo dell’uso ricorsivo degli strumenti.


5.7 I prezzi attuali dell’IA sono sovvenzionati?

5.7.1 Definizione di sovvenzione

Il termine “sovvenzionato” dovrebbe essere suddiviso in quattro proposizioni distinte:

IpotesiTest
Offerta civetta a breve termineIl prezzo è inferiore al costo marginale evitabile
Recupero insufficiente dei costi totaliIl prezzo copre i costi marginali ma non i costi allocati per la formazione, le infrastrutture e le spese commerciali.
Prezzi al di sotto del tasso di rendimento richiestoL’utile contabile esiste, ma il rendimento del capitale è inferiore al WACC.
sovvenzioni incrociateLe perdite o i bassi rendimenti nell’IA vengono finanziati da un altro prodotto, segmento o capitale degli investitori.

Queste affermazioni richiedono prove diverse. Il prezzo basso da solo non dimostra nessuna di esse.

5.7.2 Prove coerenti con la sovvenzione

Diverse osservazioni sono coerenti con una sottovalutazione introduttiva o strategica:

  1. Le spese in conto capitale sono aumentate prima che si realizzasse l’intero flusso di entrate corrispondente.
  2. Le infrastrutture e l’utilizzo dell’intelligenza artificiale hanno esercitato pressione sui margini lordi del cloud.
  3. I fornitori offrono piani gratuiti, crediti, elaborazione batch scontata e modelli di accesso a basso costo.
  4. I pacchetti in abbonamento possono consentire agli utenti che ne fanno un uso intensivo di utilizzare più funzionalità di inferenza rispetto a quanto acquisterebbero pagando la quota mensile ai prezzi API al dettaglio.
  5. I fornitori di modelli hanno forti incentivi ad acquisire sviluppatori, stabilire API predefinite e creare dipendenza dall’ecosistema.
  6. Le spese relative alla formazione e alla formazione successiva non sono indicate separatamente nei prezzi dei gettoni.
  7. La rapida sostituzione dei modelli può ridurre il periodo di ammortamento della ricerca e dell’ottimizzazione delle infrastrutture.

Microsoft ha riportato un margine lordo del 66% per Microsoft Cloud nel terzo trimestre dell’anno fiscale 2026, in calo rispetto all’anno precedente a causa dei continui investimenti nell’IA, mentre le spese in conto capitale dell’azienda hanno raggiunto i 31,9 miliardi di dollari. Teleconferenza sui risultati del terzo trimestre dell’anno fiscale 2026 di Microsoft – Aprile/2026 – Informativa agli investitori di Microsoft per il terzo trimestre dell’anno fiscale 2026. Ciò supporta l’ipotesi che l’IA sia ad alta intensità di capitale e diluisca i margini al livello del cloud divulgato.

5.7.3 Prove contrarie a una conclusione universale sui prodotti civetta

Le stesse prove non dimostrano che ogni token venga venduto al di sotto del costo:

  1. Microsoft Cloud ha continuato a registrare un elevato margine di profitto lordo a livello aggregato.
  2. Google Cloud ha registrato un utile operativo positivo, pur espandendo la propria infrastruttura di intelligenza artificiale.
  3. Gli sconti per elaborazione batch e per input memorizzati nella cache possono riflettere un effettivo risparmio sui costi derivante dalla pianificazione e dal riutilizzo.
  4. I premi sui token di output possono generare margini di contribuzione elevati su determinati carichi di lavoro.
  5. Il routing dei modelli può indirizzare le attività semplici verso modelli sostanzialmente più economici.
  6. I grandi fornitori possono sfruttare l’aggregazione della domanda per raggiungere livelli di utilizzo inaccessibili alle aziende più piccole.
  7. I contratti aziendali e la capacità riservata possono consentire di recuperare costi non visibili nei prezzi al consumatore.
  8. La pubblicità, i software di produttività e i ricavi delle piattaforme cloud possono monetizzare l’IA indirettamente, senza rendere il servizio di IA economicamente irrazionale.

5.7.4 Risultato del test formale

PropostaRisultati aggiornati ad agosto 2026
L’infrastruttura per l’IA richiede ingenti investimenti di capitale.Fortemente sostenuto
Gli investimenti nell’IA mettono sotto pressione alcuni margini dichiaratiSupportato
Alcuni accessi sono offerti a prezzo scontato o gratuitamente intenzionalmente.Supportato
I prezzi batch/flessibili riflettono le dinamiche di utilizzo.Fortemente sostenuto
Tutti gli abbonamenti all’IA per i consumatori sono in perdita.Non stabilito
Tutti i token API sono venduti al di sotto del costo marginaleNon stabilito
I costi del ciclo di vita del modello di frontiera sono interamente recuperati dagli attuali prezzi dei token.Non verificabile tramite divulgazioni pubbliche.
La sovvenzione incrociata strategica esiste da qualche parte nel mercatoPlausibile e coerente con le strutture aziendali, ma non quantificabile dai bilanci di segmento divulgati.
È possibile una futura revisione dei prezzi dei materiali.Da considerare come un rischio, non come una certezza.

La conclusione scientificamente difendibile è quindi più circoscritta rispetto alla diffusa affermazione secondo cui “le aziende di IA perdono denaro su ogni query”. I documenti pubblici confermano l’intensità di capitale, la pressione sui margini e gli investimenti strategici anticipati rispetto alla domanda . Non divulgano, tuttavia, i dati sui costi a livello di modello necessari per dimostrare la pratica universale di generare perdite.


5.8 Il sistema di prezzi emergente

5.8.1 Prezzo per token di input

La tariffazione basata sui token di input approssima la domanda di elaborazione immediata, ma ignora il valore semantico. Un milione di token ripetitivi e un milione di token altamente specializzati possono costare lo stesso pur producendo risultati aziendali diversi. La memorizzazione nella cache suddividerà sempre più l’input in:

  • input non memorizzato nella cache;
  • input di scrittura nella cache;
  • Input cache-hit;
  • archiviazione del contesto persistente.

5.8.2 Prezzo per token di output

La determinazione del prezzo in base alla produzione riflette la generazione sequenziale e coglie la disponibilità a pagare. Può penalizzare i modelli prolissi e creare incentivi per fornire risposte concise. Il costo effettivo della produzione dovrebbe essere:

output effettivo = C output generato ÷ T output accettato

Un modello che genera il doppio del testo per ottenere lo stesso risultato accettato è economicamente meno efficiente, anche allo stesso prezzo in token indicato.

5.8.3 Prezzo per token di ragionamento

La tariffazione basata sui token di ragionamento monetizza in modo più diretto i calcoli interni. I suoi rischi includono una limitata osservabilità da parte del cliente, incentivi per i fornitori a consentire ragionamenti inefficienti e difficoltà nel confrontare modelli con processi interni diversi. Un sistema difendibile dovrebbe rivelare:

  • token di output visibili;
  • token di ragionamento fatturati;
  • budget massimo di ragionamento;
  • Completamento dell’attività con successo;
  • rimborsi o limiti massimi in caso di motivazione errata.

5.8.4 Prezzo per attività completata

La determinazione del prezzo per singolo compito è probabilmente applicabile a lavori circoscritti e verificabili:

task = Tariffa base + m complessità + m latenza + m rischio + C strumenti

Tra gli esempi figurano la classificazione dei documenti, l’estrazione delle fatture, la riparazione del codice, la traduzione, la verifica della conformità o la risoluzione dei problemi di assistenza clienti. La tariffazione a task trasferisce il rischio di inefficienza dell’esecuzione dal cliente al fornitore: se un agente utilizza un numero eccessivo di token, il fornitore si fa carico della differenza.

5.8.5 Prezzo per unità di calcolo

Una tariffa basata sulla potenza di calcolo potrebbe utilizzare secondi di accelerazione, equivalenti FLOP o consumo di larghezza di banda della memoria:

calcolo = aH acceleratore + bB memoria + cN rete

Questo è trasparente per gli acquirenti di infrastrutture, ma inadatto agli utenti non tecnici, poiché una stessa elaborazione può produrre risultati di qualità radicalmente diversi.

5.8.6 Moltiplicatori di priorità e latenza

Priorità P = Standard P × priorità m

La tabella ufficiale di Google distingue già i prezzi standard, batch, flessibili e prioritari, e Amazon Bedrock identifica i livelli Riservato, Prioritario, Standard e Flessibile. Questa è la prova diretta che la latenza sta diventando un fattore di monetizzazione a sé stante.

5.8.7 Moltiplicatori della lunghezza del contesto

contesto lungo = P base × m contesto

La determinazione dei prezzi nel contesto lungo può essere esplicita o incorporata nei livelli del modello. I sistemi futuri potrebbero stabilire i prezzi in base all’allocazione massima di cache KV residente anziché solo in base ai token effettivamente elaborati.

5.8.8 Livelli di qualità del modello

I fornitori già differenziano i sistemi in base a criteri di economicità, equilibrio, innovazione e ragionamento avanzato. Il mercato potrebbe evolversi verso:

LivelloFunzione economica
merceClassificazione, estrazione, instradamento
ProfessionaleAffari generali e programmazione
FrontieraRagionamento e ricerca complessi
EspertoLavoro regolamentato calibrato sul dominio
SovranoGaranzie geografiche, di sicurezza e di controllo

5.8.9 Contratti di capacità riservata

Un contratto riservato può essere espresso come:

riservato = F capacità + P eccedenza Q eccedenza

Il cliente scambia flessibilità con una produttività garantita; il fornitore riduce l’incertezza della domanda e il rischio di finanziamento.

5.8.10 Prezzi dinamici

surge,t = P base × [1 + λS t ]

dove S t misura la scarsità o la pressione della coda e λ è la sensibilità al prezzo. La tariffazione dinamica potrebbe razionare la scarsa capacità di frontiera durante importanti lanci di prodotti, eventi finanziari, elezioni, incidenti informatici o interruzioni regionali. Migliorerebbe l’efficienza dell’allocazione ma acuirebbe la disuguaglianza consentendo ai clienti più ricchi di acquistare in priorità durante i periodi di scarsità.

5.8.11 Prezzi basati sui risultati

Risultato P = F base + θV verificato

dove V verificato rappresenta il valore misurabile per il cliente e θ è la quota del fornitore. La determinazione del prezzo in base ai risultati è plausibile per i ricavi recuperati, i casi di supporto risolti, i lead di vendita qualificati o le attività software completate. Risulta difficile quando la causalità, l’attribuzione o la qualità sono oggetto di controversia.

5.8.12 Capacità di calcolo messa all’asta

Un’asta potrebbe assegnare un blocco fisso di inferenza di frontiera:

clearing = offerta dell’acquirente marginale accettato

Potrebbero emergere aste per sessioni di addestramento su larga scala, capacità statale, simulazioni urgenti o servizi garantiti per agenti di frontiera. Tuttavia, ciò introdurrebbe volatilità, offerte strategiche e rischi di manipolazione del mercato.


5.9 Scenari di prezzo quinquennali, 2027-2031

5.9.1 Quadro di riferimento dello scenario

ScenarioIntervallo di probabilitàMeccanismo centraleDirezione del prezzo del tokeneffetto di accesso
deflazione dell’efficienza25–35%L’efficienza hardware e software supera la domandaI prezzi del modello delle materie prime calano bruscamenteAccesso di base ampio
Mercato biforcato35–50%I costi dei modelli di piccole dimensioni diminuiscono, mentre la potenza di calcolo di frontiera rimane scarsa.I livelli inferiori calano; i livelli di frontiera rimangono alti o aumentanoLa disuguaglianza di capacità persiste
Ricalcolo dei prezzi delle infrastrutture15–30%Ammortamento, energia e finanziamenti richiedono un recupero più completoAumenti generalizzati dei prezzi o limiti più rigidiLe PMI e gli utenti a basso reddito subiscono pressioni
Shock di capacità5–15%Controllo delle esportazioni, conflitto, carenza di rete o interruzione delle forniturePremi maggiorati e regionaliGrave disuguaglianza geografica
Transizione dell’esito20–40%Gli agenti vengono venduti a progetto anziché a token.I prezzi dei token perdono rilevanzaMaggiore discriminazione di prezzo

Gli intervalli si sovrappongono perché gli scenari possono coesistere tra modelli e regioni diverse.

5.9.2 Struttura più probabile

Il caso centrale quinquennale non prevede un aumento universale del prezzo nominale di ogni token. Si tratta di una biforcazione :

  • I modelli di piccole e medie dimensioni diventano più economici;
  • Il lavoro memorizzato nella cache e asincrono viene fortemente scontato;
  • Il ragionamento di frontiera ad alta priorità rimane costoso;
  • I carichi di lavoro a lungo termine, multimodali e basati su agenti acquisiscono ulteriori indicatori;
  • La residenza dei dati aziendali e la capacità riservata comportano costi aggiuntivi;
  • Gli abbonamenti per i consumatori diventano sempre più esplicitamente limitati nell’utilizzo;
  • I compiti complessi migrano verso una tariffazione basata sui risultati o sul credito;
  • I livelli gratuiti si basano sempre più su modelli di routing a basso costo;
  • La scarsità regionale crea differenze di prezzo geografiche.

L’unità di misura rivolta all’utente potrebbe quindi cambiare da “un milione di token” a un credito composito opaco che rappresenta la qualità del modello, la profondità del ragionamento, gli strumenti, la latenza e il contesto.


5.10 Il calcolo basato sull’intelligenza artificiale sta diventando come Bitcoin?

5.10.1 Quando l’analogia è utile

L’analogia è utile sotto cinque aspetti limitati.

In primo luogo, sia il calcolo basato sull’intelligenza artificiale che le attività legate al Bitcoin dipendono da hardware specializzato, elettricità e accesso alle infrastrutture, tutti beni rari. In secondo luogo, entrambi possono presentare premi di scarsità quando la domanda cresce più velocemente dell’offerta. In terzo luogo, entrambi possono essere concentrati geograficamente in prossimità di fonti di elettricità, normative o catene di approvvigionamento favorevoli. In quarto luogo, le aspettative sul valore futuro possono accelerare gli investimenti presenti e i comportamenti speculativi. In quinto luogo, la capacità può essere rappresentata da contratti negoziabili, prenotazioni, contratti future o crediti finanziari anche quando la risorsa sottostante è fisica.

Un “indice di calcolo AI” potrebbe quindi misurare il prezzo spot o a termine di un pacchetto di capacità standardizzato:

ACI t = P(H standard , M memoria , B larghezza di banda , L latenza , R regione , A disponibilità )

Un indice di questo tipo potrebbe essere utile per la pianificazione del bilancio, la copertura dei rischi e la stipula di contratti infrastrutturali.

5.10.2 Dove l’analogia non funziona

ProprietàBitcoinCalcolo dell’intelligenza artificiale
regola di fornituraEmissione e fornitura massima definite dal protocolloProdotto attraverso la produzione e la costruzione
FungibilitàLe unità sono standardizzate secondo il protocolloGPU, TPU, memoria, modelli e posizioni differiscono
DurataGli asset del registro digitale non si usurano fisicamenteL’hardware si deprezza e diventa obsoleto.
MagazzinaggioPuò essere tenuto senza uso produttivoLe risorse di calcolo inattive continuano a generare ammortamento e costi di gestione.
TrasportabilitàTrasferibile attraverso un registro globaleVincolato a data center, griglie, reti e giurisdizione
riserva di valorePuò essere detenuto come beneIn genere, i dati di calcolo passati non utilizzati non possono essere memorizzati.
QualitàA livello di protocollo, un’unità è equivalente a un’altra.Un’ora di accelerazione può variare radicalmente in termini di capacità
Dipendenza dalla posizioneIl trasferimento di proprietà è in gran parte indipendente dalla posizione geografica.La latenza, la sovranità e le norme sull’esportazione sono sensibili alla posizione geografica.
Risposta alla produzioneL’emissione non può superare il protocolloL’offerta può essere ampliata, sebbene con lunghi tempi di consegna.
ScadenzaL’asset non scade tecnologicamenteLa capacità riservata scade; l’hardware invecchia
In base alla domandaDomanda monetaria/speculativa/di reteDomanda produttiva di calcolo e intelligenza
Standardizzazione delle unitàL’unità nativa esisteNon esiste un equivalente universale tra modelli e carichi di lavoro.

L’informatica è più simile a una combinazione di elettricità, capacità cloud, posti aerei e macchinari industriali che al Bitcoin. Come l’elettricità, deve essere generata e trasmessa attraverso infrastrutture. Come la capacità cloud, è eterogenea e dipendente dal servizio. Come i posti aerei, il tempo non utilizzato scade e la priorità può essere prezzata dinamicamente. Come i macchinari, richiede capitale, manutenzione e sostituzione.

La distinzione più importante è l’impossibilità di memorizzazione nel tempo. Un Bitcoin posseduto oggi rimane un Bitcoin domani. Un secondo di accelerazione inutilizzato alle 14:00 non può essere venduto alle 15:00. I fornitori sono quindi incentivati ​​a offrire sconti sui carichi di lavoro batch e flessibili per riempire la capacità altrimenti inutilizzata. Si tratta di gestione dei rendimenti, non di scarsità monetaria.


5.11 Test empirici per i prossimi cinque anni

ID testPropostaDati richiestiMetodocondizione di falsificazione
C5-T1I prezzi attuali non coprono i costi totali del ciclo di vita.Conti dei costi del fornitore, spese in conto capitale, ammortamento, utilizzoEconomia unitaria completamente allocataIl ricavo per ogni token di successo supera costantemente il costo più il rendimento richiesto.
C5-T2Gli sconti per acquisti in blocco riflettono i vantaggi derivanti dall’utilizzo.Throughput/costo batch e on-demandDifferenza nelle differenzeNessuna riduzione dei costi dei fornitori di materiali grazie alla flessibilità di programmazione.
C5-T3I token di output hanno un costo fisico più elevatoUtilizzo misurato delle risorse di precaricamento/decodificaTelemetria dell’acceleratoreIl premio per la produzione rimane elevato nonostante l’equiparazione dei costi fisici e dei controlli sul potere di mercato.
C5-T4I prezzi di frontiera restano elevati, mentre i prezzi delle materie prime calano.Prezzi storici corretti in base alla qualità del modellomodello a pannello edonicoIl prezzo equivalente di frontiera diminuisce allo stesso ritmo del prezzo del modello base
C5-T5Gli abbonamenti sovvenzionano indirettamente gli utenti che ne fanno un uso intensivo.Utilizzo e tariffe a livello utenteAnalisi del contributo della coorteOgni decile di utilizzo produce un contributo interamente allocato non negativo
C5-T6La residenza dei dati aumenta i costiendpoint regionali rispetto a endpoint globaliConfronto prezziNessun sovrapprezzo dopo i controlli di qualità e SLA
C5-T7I sistemi agenti spostano la fatturazione verso le attivitàCataloghi dei prezzi dei fornitoriAnalisi del panel di prodottiLa fatturazione tramite token rimarrà dominante fino al 2031.
C5-T8La scarsità aumenta la discriminazione di prezzoPrezzi prioritari, maggiorati e riservatiregressione a pannelloLa dispersione tra i livelli diminuisce all’aumentare dell’utilizzo.
C5-T9I costi delle infrastrutture mettono sotto pressione i marginiSpese in conto capitale, ammortamento e margini cloudRegressione a ritardo distribuitoUna maggiore intensità di capitale nell’IA aumenta costantemente i margini immediatamente
C5-T10La disuguaglianza di accesso aumenta alle frontiere.Reddito regionale e utilizzo delle frontiereAnalisi dell’elasticità del redditoLe regioni a basso reddito raggiungono un utilizzo convergente della frontiera pro capite

Un modello di margine a livello di fornitore può essere stimato come segue:

GM j,t = α + β 1 AIK j,t + β 2 U j,t + β 3 E j,t + β 4 D j,t + μ j + τ t + ε j,t

Dove:

  • GM j,t = margine lordo del fornitore j al tempo t;
  • AIK j,t = intensità di capitale relativa all’IA;
  • j,t = utilizzo produttivo;
  • j,t = esposizione ai costi energetici;
  • j,t = onere di ammortamento;
  • μ j = effetti fissi del fornitore;
  • τ t = effetti del periodo.

Poiché le aziende non divulgano sistematicamente le spese in conto capitale destinate esclusivamente all’IA, il modello deve riportare l’incertezza di misurazione ed evitare di interpretare le correlazioni a livello di cloud come pura inferenza economica.


5.12 Implicazioni strategiche per classe di utente

UtentePrincipale vantaggio del cloudPrincipale rischio di nuvoleControllo economico raccomandato
StudenteQualità di frontiera senza investimenti in hardwareAumenti dei costi di abbonamento e limiti di utilizzoStrategia mista, gratuita, in abbonamento e basata su modelli locali di piccole dimensioni.
RicercatoreAccesso a molteplici modelli di frontieraRiproducibilità e volatilità dei prezziRegistra il modello esatto, i token, gli strumenti e il costo per esperimento
StartupCapacità elastica e rapida implementazioneDipendenza dei margini dalle tariffe del fornitoreInstradamento del modello, memorizzazione nella cache e protezione del prezzo contrattuale
NOIEvita infrastrutture specializzateBlocco e spesa incontrollata da parte degli agentiLimiti di budget, astrazione multi-fornitore e calcolo dei costi per attività
UniversitàAccesso ad alta capacitàBudget di sovvenzione soggetti a misurazione dei consumiAssegnazioni riservate alla ricerca e appalti istituzionali
OspedaleControlli aziendali gestitiRischi relativi a dati sensibili e dipendenzaElaborazione regionale, diritti di audit contrattuali e fallback locale
Grande impresaScala e disponibilità globaleCosti di concentrazione e di transizioneCapacità riservata più livello di valutazione portatile
GovernoAccesso immediato ai sistemi di frontieraRischi di sovranità, esportazione e continuitàCapacità sovrana, approvvigionamento diversificato e capacità locale di emergenza

5.13 Valutazione finale

Le prove disponibili supportano una conclusione più articolata. L’IA in cloud non è semplicemente “calcolo a basso costo venduto in perdita”, né un normale servizio software maturo con costi marginali trascurabili. Si tratta di un’attività infrastrutturale ad alta intensità di capitale, combinata con un ciclo di ricerca insolitamente rapido e una strategia di competizione basata sulle piattaforme. I documenti pubblici dimostrano investimenti infrastrutturali straordinari e una pressione sui margini osservabile. I prezzi ufficiali mostrano una forte segmentazione in base alla qualità del modello, alla direzione di input/output, alla cache, al contesto, alla latenza, alla geografia e alla flessibilità di pianificazione. Ciò che le prove pubbliche non dimostrano è che tutte le inferenze attuali siano prezzate al di sotto del costo marginale a breve termine o che ogni abbonamento sia in perdita.

Il rischio maggiore nei prossimi cinque anni non è necessariamente una moltiplicazione uniforme di ogni prezzo del token pubblicato. I fornitori potrebbero continuare a ridurre il costo dell’inferenza di base, spostando al contempo il recupero dei costi verso il ragionamento di frontiera, la generazione di output, il servizio prioritario, il contesto a lungo termine, la residenza dei dati, gli strumenti, l’archiviazione, i cicli agentici e la capacità garantita. Il mercato potrebbe quindi apparire deflazionistico a livello del prezzo per token, pur diventando più costoso per il lavoro completato economicamente rilevante.

Il probabile punto di arrivo è una tariffa multidimensionale:

AI = f(M, T in , T out , T reason , L, C, G, A, R, X, V)

Dove:

  • M = livello di qualità del modello;
  • in = token di input;
  • out = output tokens;
  • ragione = token o sforzo di ragionamento;
  • L = latenza o priorità;
  • C = contesto e allocazione della cache;
  • G = requisito di elaborazione geografica;
  • A = disponibilità garantita;
  • R = capacità riservata;
  • X = strumenti esterni e recupero;
  • V = valore o risultato del compito verificato.

Di conseguenza, l’accesso all’IA assomiglierà più a un servizio strategico a consumo che a un singolo abbonamento software. L’intelligenza di base potrebbe diventare abbondante, mentre l’intelligenza di frontiera affidabile – fornita con contesto a lungo termine, bassa latenza, accesso agli strumenti, privacy, controllo geografico e garanzie contrattuali – rimarrà scarsa e costosa. Questa distinzione, piuttosto che il prezzo nominale di un milione di token generici, determinerà la distribuzione economica e sociale delle capacità di IA tra il 2027 e il 2031.

CAPITOLO 6 — Esposizione aziendale e costo dell’adozione obbligatoria dell’IA

6.1 Ambito analitico e proposizione centrale

L’adozione dell’IA in ambito aziendale sta entrando in una fase in cui la spesa potrebbe diventare necessaria per rimanere competitivi, prima ancora che il suo ritorno finanziario possa essere dimostrato in modo definitivo. Un’azienda potrebbe acquistare licenze, capacità API, infrastrutture cloud, acceleratori locali, servizi di ingegneria dei dati, controlli di sicurezza informatica e personale specializzato non perché un particolare progetto abbia già prodotto un valore attuale netto positivo, ma perché clienti, concorrenti, dipendenti, autorità di regolamentazione e investitori si aspettano sempre più velocità, personalizzazione, analisi e automazione grazie all’IA. Questo genera una nuova categoria di spesa: l’ input competitivo difensivo . Come la sicurezza informatica, la connettività digitale o il software aziendale, l’IA potrebbe diventare difficile da evitare anche quando il suo effettivo guadagno in termini di produttività rimane incerto. Il rischio economico è asimmetrico. Un’azienda che adotta l’IA troppo lentamente rischia di perdere clienti, talenti ed efficienza operativa; un’azienda che adotta troppo rapidamente rischia di accumulare licenze duplicate, progetti pilota frammentati, vincoli proprietari, responsabilità di conformità e infrastrutture il cui utilizzo rimane troppo basso per recuperarne il costo.

L’adozione osservata è in rapida crescita, ma rimane fortemente disomogenea in base alle dimensioni dell’impresa. Nel 2025, il 20,0% delle imprese dell’UE con almeno dieci dipendenti ha dichiarato di utilizzare tecnologie di intelligenza artificiale, rispetto al 13,5% nel 2024, all’8,1% nel 2023 e al 7,7% nel 2021. L’adozione da parte delle grandi imprese ha raggiunto il 55,03%, superando di gran lunga l’adozione tra le imprese più piccole. Utilizzo dell’intelligenza artificiale nelle imprese – Eurostat – dicembre 2025 — Statistiche Eurostat sull’IA nelle imprese . Analogamente, i dati OCSE indicano che l’utilizzo di IA a livello aziendale è aumentato al 20,2% nel 2025, rispetto al 14,2% nel 2024 e all’8,7% nel 2023 nei paesi per i quali sono disponibili i dati. L’utilizzo di IA da parte dei singoli individui aumenta vertiginosamente in tutta l’OCSE mentre l’adozione da parte delle imprese continua ad espandersi – OCSE – gennaio 2026 — Statistiche OCSE sull’adozione di IA a livello aziendale .

Questi dati stabiliscono la diffusione, non la redditività. Una risposta a un sondaggio che indica l’utilizzo di almeno una tecnologia di intelligenza artificiale non rivela la profondità dell’implementazione, la spesa, la produttività, il rendimento corretto per il rischio o se il sistema è integrato in un flusso di lavoro critico. Questo capitolo, pertanto, costruisce archetipi finanziari rappresentativi. Ogni risultato monetario è uno scenario di pianificazione analitica espresso in dollari USA del 2026, salvo diversa indicazione; non si tratta di un dato contabile relativo a una specifica azienda.


6.2 Definizioni e esposizione relative alle dimensioni aziendali

La Commissione europea definisce una PMI in base al numero di dipendenti e al fatturato o al totale di bilancio. Le PMI impiegano meno di 250 persone e di norma hanno un fatturato annuo non superiore a 50 milioni di euro o un totale di bilancio non superiore a 43 milioni di euro. Definizione di PMI – Commissione europea – agosto 2026 — Definizione di PMI della Commissione europea .

Ai fini della modellazione, in questo capitolo vengono utilizzate le seguenti classi operative:

Classe EnterpriseDipendentiRicavo annuo a titolo esemplificativoCaratteristiche di adozione dell’IA
microimpresa1–9Da 0,25 a 2 milioni di dollari USABasato su abbonamento; scarse capacità tecniche interne.
Piccola impresa10–49Da 2 a 15 milioni di dollariAdozione di SaaS e servizi gestiti
Impresa di medie dimensioni50–24915-100 milioni di dollariIntegrazione ibrida; funzione di governance emergente
Grande azienda250+Da 100 milioni a oltre 10 miliardi di dollariAdozione del portfolio, integrazione proprietaria e governance dedicata.
Organizzazione critica a livello sistemico o strategicoVariabileIl budget o le entrate possono superare 1 miliardo di dollariElevati livelli di garanzia, resilienza, sovranità e obblighi normativi.

L’importanza economica delle piccole imprese rende la disomogenea adozione un problema macroeconomico piuttosto che una questione di nicchia tecnologica. Eurostat ha riportato che nel 2022 le micro e piccole imprese rappresentavano il 99% delle imprese dell’UE, impiegavano 77,5 milioni di persone e generavano un fatturato di 11.900 miliardi di euro. Le grandi imprese rappresentavano solo lo 0,2% delle imprese, ma generavano il 51% del fatturato. Micro e piccole imprese costituiscono il 99% delle imprese nell’UE – Eurostat – ottobre 2024 — Statistiche Eurostat sulle dimensioni delle imprese . Se l’IA comporta elevati costi fissi per la governance, la preparazione e l’integrazione dei dati, tali costi assorbiranno una quota maggiore dei ricavi delle piccole imprese, anche laddove i prezzi delle API siano identici.


6.3 Indicatori finanziari aziendali fondamentali

6.3.1 Rapporto costi-benefici dell’IA

Rapporto costi-benefici dell’IA = Spesa annuale per l’IA ÷ Ricavi

Il rapporto misura la quota di entrate assorbita dalle spese per l’IA. Va calcolato sia al lordo che al netto degli investimenti di sviluppo capitalizzati:

Rapporto costi IA in contanti = Spese in contanti IA ÷ Ricavi

Rapporto costi IA P&L = Spese IA riconosciute nel periodo ÷ Ricavi

Un’azienda che acquista infrastrutture può registrare un ingente deflusso di cassa, ma ripartire l’ammortamento su diversi anni. Il rapporto di cassa misura la pressione finanziaria; il rapporto di conto economico misura l’onere contabile corrente.

6.3.2 Onere lavorativo dell’IA

Onere del lavoro legato all’IA = Spesa annuale per l’IA ÷ Costo annuale del lavoro

Questo rapporto confronta la spesa per l’IA con la base di lavoro da cui ci si aspetta generalmente un aumento della produttività. È economicamente rilevante perché un programma di IA che costa il 15% della spesa annuale per il lavoro deve generare un miglioramento molto significativo della produttività del lavoro, dei ricavi o una riduzione del rischio per raggiungere il punto di pareggio.

6.3.3 Valore netto dell’IA

Valore netto dell’IA = Aumento di produttività + Ricavi incrementali − Costi di rischio − Spese per l’IA

Ai fini della precisione finanziaria, i ricavi incrementali devono essere convertiti in margine di contribuzione incrementale, e non trattati interamente come profitto:

Valore netto dell’IA = Risparmi di lavoro + Risparmi non di lavoro + m × Ricavi incrementali + Perdite evitate − Costi di rischio − Spese per l’IA

dove m rappresenta il margine di contribuzione sui ricavi incrementali.

6.3.4 Ritorno sull’investimento

ROI AI = [VAN(Benefici) − VAN(Costi)] ÷ VAN(Costi)

Il valore attuale netto dei benefici è:

VAN(Benefici) = Σ t=0 n B t ÷ (1+r) t

Il valore attuale netto dei costi è:

VAN(Costi) = Σ t=0 n C t ÷ (1+r) t

Il progetto crea valore finanziario solo quando:

Valore attuale netto (benefici) > Valore attuale netto (costi)

E:

ROI dell’IA > 0

Per un obiettivo di investimento adeguato al rischio h, l’accettazione richiede:

ROI dell’IA ≥ h

Un ROI positivo inferiore al tasso di rendimento minimo corretto per il rischio dell’azienda può comunque rappresentare una distruzione di valore rispetto a investimenti alternativi.


6.4 La struttura completa dei costi dell’IA aziendale

6.4.1 Costi diretti e indiretti

categoria di costospese incluseConducente principaleElemento spesso omesso
Licenze utenteAssistenti IA per singolo posto e software integratoNumero di utenti abilitatiPosti a pagamento ma inattivi
consumo di APIInput, output, ragionamento e utilizzo multimodaleVolume del carico di lavoro e livello del modelloChiamate non riuscite e cicli di agenti
Infrastruttura cloudCalcolo, database, archiviazione e retiVolume e disponibilità dei datiPremi di uscita e di elaborazione regionale
infrastrutture localiServer, acceleratori, storage e infrastruttureDimensioni del modello, concorrenza e resilienzaRicambi, sostituzione e raffreddamento
Sicurezza informaticaIdentità, monitoraggio, test e risposta agli incidentiProfilo della minaccia e criticità del sistemaRed teaming specifico per modello
ConformitàValutazione legale, documentazione e lavoro di conformitàSettore, giurisdizione e classificazione del rischioMantenimento continuo delle prove
Miscelazione dei datiPulizia, etichettatura, autorizzazioni e tracciabilitàFrammentazione e qualità dei datiRisarcimento dei diritti
GovernancePolitiche, inventario, comitati e controlliNumero e criticità dei sistemiScoperta dell’IA ombra
Valutazione del modelloTest di benchmark, validazione, bias e robustezzarischio del caso d’usoTest di regressione dopo gli aggiornamenti del modello
supervisione umanaRevisione, escalation e overrideGravità dell’errore ed esposizione normativaAffaticamento da revisore
IntegrazioneAPI, riprogettazione del flusso di lavoro, test e migrazioneComplessità dei sistemi legacyRiprogettazione dei processi
personale specializzatoIngegneri di intelligenza artificiale, data scientist, personale addetto alla sicurezza e agli affari legaliAmbito e garanziaPremio per il reclutamento e la fidelizzazione
Cambio di fornitoreRiprogettazione, migrazione dei dati e valutazioneDipendenza proprietariaFunzionamento parallelo temporaneo
Tempo di inattivitàPerdita di produzione, interruzione del servizio e ripristinoDisponibilità e capacità di riservaAccumulo di code dopo il recupero
Errore del modelloCorrezione, rilavorazione, danni al cliente e responsabilitàprobabilità di errore e portataFallimento sistematico correlato
implementazione che preserva la privacyIsolamento, crittografia, inferenza locale e auditsensibilità dei datiMinore utilizzo della capacità dedicata
FormazioneAlfabetizzazione in materia di IA e competenze specifiche per il ruoloDimensioni della forza lavoroCorsi di aggiornamento successivi agli aggiornamenti
Gestione del cambiamentoRiprogettazione del processo, comunicazione e adozioneComplessità organizzativaCalo di produttività durante la transizione
Utilità-prezzoCapitale e personale dirottati da altri progettiVincoli di portafoglioAlternative abbandonate

La spesa annuale per l’IA dovrebbe quindi essere calcolata come segue:

AIE = L licenza + A API + C cloud + I locale + S sicurezza + C conformità + D dati + G governance + E valutazione + H supervisione + I integrazione + P personale + V commutazione + D tempo di inattività + R errore

Una stima restrittiva che includa solo licenze e costi API può sottostimare la spesa economica totale di diverse volte.


6.4.2 Costi degli errori corretti per il rischio

Il costo annuo previsto degli errori del modello è:

E(Costo del rischio) = Σ j=1 m p j × L j

Dove:

  • j è la probabilità annua di errore di classe j;
  • j rappresenta la sua perdita totale, qualora si realizzasse.

La perdita dovrebbe includere:

j = C correzione + C tempo di inattività + C cliente + C legale + C normativo + C reputazione + C rimedio

Un errore a bassa frequenza può dominare l’economia dell’IA quando le sue conseguenze sono rilevanti. Un sistema di IA che genera 2 milioni di dollari di risparmi annuali sui processi, ma che presenta una probabilità del 2% di subire una perdita di 100 milioni di dollari, ha una perdita attesa di 2 milioni di dollari prima di considerare l’avversione al rischio, i requisiti di capitale o i limiti di rischio estremo.

Per le istituzioni avverse al rischio, il valore atteso non è sufficiente. Una regola decisionale più appropriata è:

Valore netto dell’IA corretto per il rischio = Benefici attesi − Costi attesi − λ × Rischio di coda

dove λ riflette la tolleranza al rischio dell’organizzazione e il rischio di coda può essere misurato attraverso il valore a rischio, la perdita attesa o la perdita di scenario.


6.5 Archetipi aziendali rappresentativi

6.5.1 Scenari annuali di riferimento

La tabella seguente si basa su un modello annuale coerente. I “guadagni di produttività” rappresentano i risparmi di cassa realizzati o la capacità produttiva aggiuntiva a cui viene assegnato un valore monetario difendibile. I ricavi incrementali vengono convertiti in margine di contribuzione utilizzando i margini incorporati in ciascuno scenario. Il costo del rischio include le perdite attese dovute a errori, tempi di inattività, violazione della privacy e responsabilità civile.

Archetipoentrate o bilancio operativoCosto del lavoroSpesa annuale per l’IAAumento della produttivitàContributo incrementalecosto del rischioValore netto dell’IA
Microazienda professionale0,80 milioni di dollari0,32 milioni di dollari0,022 milioni di dollari USA0,018 milioni di dollari USA0,008 milioni di dollari USA0,004 milioni di dollari USAUSD 0,000 milioni
Piccola impresa5 milioni di dollari1,5 milioni di dollari0,150 milioni di dollari0,120 milioni di dollari0,060 milioni di dollari USA0,030 milioni di dollari USAUSD 0,000 milioni
Impresa di medie dimensioni30 milioni di dollari7 milioni di dollari0,600 milioni di dollari0,560 milioni di dollari0,240 milioni di dollari0,100 milioni di dollari USA0,100 milioni di dollari USA
Grande azienda diversificata5 miliardi di dollari1,2 miliardi di dollari65 milioni di dollari75 milioni di dollari40 milioni di dollari15 milioni di dollari35 milioni di dollari
Banca10 miliardi di dollari3 miliardi di dollari180 milioni di dollari200 milioni di dollari90 milioni di dollari70 milioni di dollari40 milioni di dollari
Assicuratore5 miliardi di dollari1 miliardo di dollari90 milioni di dollari100 milioni di dollari50 milioni di dollari45 milioni di dollari15 milioni di dollari
Organizzazione sanitaria2 miliardi di dollari1,1 miliardi di dollari55 milioni di dollari70 milioni di dollari10 milioni di dollari35 milioni di dollari-10 milioni di dollari
Studio legale/professionale100 milioni di dollari55 milioni di dollari4 milioni di dollari5,5 milioni di dollari1,5 milioni di dollari1 milione di dollari2 milioni di dollari
Produttore1 miliardo di dollari180 milioni di dollari18 milioni di dollari20 milioni di dollari12 milioni di dollari6 milioni di dollari8 milioni di dollari
Società di media200 milioni di dollari70 milioni di dollari6 milioni di dollari7 milioni di dollari4 milioni di dollari3 milioni di dollari2 milioni di dollari
Operatore di telecomunicazioni5 miliardi di dollari900 milioni di dollari100 milioni di dollari120 milioni di dollari80 milioni di dollari25 milioni di dollari75 milioni di dollari
Operatore di difesa/infrastrutture critiche3 miliardi di dollari700 milioni di dollari75 milioni di dollari65 milioni di dollari30 milioni di dollari35 milioni di dollari-15 milioni di dollari
amministrazione pubblicabudget di 2 miliardi di dollari900 milioni di dollari60 milioni di dollari70 milioni di dollariUSD 0 milioni30 milioni di dollari−20 milioni di dollari
Sistema universitario/di ricercabudget di 1 miliardo di dollari600 milioni di dollari35 milioni di dollari35 milioni di dollari5 milioni di dollari20 milioni di dollari-15 milioni di dollari

Questi dati non rappresentano medie di settore. Si tratta di archetipi trasparenti, progettati per identificare soglie finanziarie. Risultati negativi non significano che l’IA sia socialmente indesiderabile o strategicamente evitabile. Un ospedale, un’organizzazione di difesa o un ente pubblico possono razionalmente accettare un ritorno contabile negativo per ottenere sicurezza, sovranità, qualità del servizio o capacità strategica. La conclusione corretta è che tali implementazioni richiedono un quadro di riferimento più ampio, basato sul valore pubblico o sul valore della missione, piuttosto che una falsa affermazione di un ritorno sull’investimento commerciale immediato.


6.5.2 Rapporto costi-benefici dell’IA e onere lavorativo dell’IA

ArchetipoRapporto costi-benefici dell’IACarico di lavoro dell’IARendimento annuo della spesa per l’IA prima dell’attualizzazione
Microazienda professionale2,75%6,88%0,0%
Piccola impresa3,00%10,00%0,0%
Impresa di medie dimensioni2,00%8,57%16,7%
Grande azienda diversificata1,30%5,42%53,8%
Banca1,80%6,00%22,2%
Assicuratore1,80%9,00%16,7%
Organizzazione sanitaria2,75%5,00%-18,2%
Studio legale/professionale4,00%7,27%50,0%
Produttore1,80%10,00%44,4%
Società di media3,00%8,57%33,3%
Operatore di telecomunicazioni2,00%11,11%75,0%
Difesa/infrastrutture critiche2,50%10,71%−20,0%
amministrazione pubblica3,00% del budget6,67%−33,3%
Sistema universitario/di ricerca3,50% del budget5,83%−42,9%

Il calcolo dimostra perché la stessa spesa nominale abbia conseguenze diverse a seconda del settore. I servizi legali possono sostenere un rapporto costi-benefici per l’intelligenza artificiale (IA) relativamente elevato perché il lavoro rappresenta una parte consistente dei costi e il lavoro ad alta intensità documentale è potenzialmente incrementabile. Il settore manifatturiero può avere un rapporto costi-benefici per l’IA inferiore, ma comunque un elevato onere del lavoro per l’IA, poiché i ricavi includono costi considerevoli di materiali ed energia. La pubblica amministrazione e l’istruzione possono generare benefici sociali non registrati come ricavi incrementali, rendendo incomplete le formule di ROI del settore privato.


6.6 Struttura dei costi in base alle dimensioni dell’organizzazione

6.6.1 Microimpresa

Un’azienda rappresentativa composta da cinque professionisti può acquistare:

Voce di costoScenario annuale
Cinque abbonamenti all’IA3.000 dollari USA
Funzionalità di intelligenza artificiale per la contabilità, la gestione dei documenti e il CRM2.500 USD
API e automazione1.500 USD
integrazione4.000 dollari USA
Pulizia dei dati e modelli2.000 dollari USA
Controlli di sicurezza informatica e privacy2.500 USD
Formazione e governance2.000 dollari USA
Revisione umana e correzione degli errori2.500 USD
Contingenza e commutazione2.000 dollari USA
Totale22.000 dollari

Il rischio principale non è il consumo di token, bensì i costi fissi di implementazione. Con un fatturato di 0,8 milioni di dollari, la spesa equivale al 2,75% del fatturato. Se il margine operativo netto prima dell’IA è del 10%, l’utile operativo annuo è di 80.000 dollari; l’IA assorbe il 27,5% dell’utile prima dell’IA. Il rapporto rilevante è quindi:

Onere di profitto dell’IA = Spesa annuale per l’IA ÷ Utile operativo pre-IA

Onere del profitto AI = 22.000 ÷ 80.000 = 27,5%

Un costo pari solo al 2,75% del fatturato può essere strategicamente significativo quando i margini sono ridotti.

6.6.2 PMI

Le PMI si trovano ad affrontare un problema intermedio. I loro flussi di lavoro sono sufficientemente complessi da richiedere integrazione e governance, ma le loro dimensioni potrebbero non essere sufficienti a distribuire ampiamente tali costi. L’OCSE ha segnalato che l’adozione dell’IA da parte delle imprese rimane inferiore rispetto all’adozione di altre tecnologie digitali e che persistono divari significativi tra PMI e grandi imprese. Adozione dell’IA da parte delle piccole e medie imprese – OCSE – dicembre 2025 — Rapporto dell’OCSE sull’adozione dell’IA da parte delle PMI .

Una piccola impresa con un fatturato di 5 milioni di dollari e una spesa annua di 150.000 dollari in intelligenza artificiale deve raggiungere uno o più dei seguenti obiettivi:

  • un risparmio lordo del 10% sulla sua spesa per il lavoro di 1,5 milioni di dollari;
  • una riduzione del 3% dei costi operativi totali non legati all’IA, qualora questi ammontino a 5 milioni di dollari;
  • 500.000 dollari di ricavi incrementali con un margine di contribuzione del 30%;
  • ha evitato perdite annuali pari a 150.000 dollari;
  • un portafoglio a benefici misti con valore equivalente.

Se l’azienda realizza solo la metà dell’aumento di produttività previsto, l’IA distrugge valore a meno che la sua adozione non impedisca una perdita di competitività maggiore.

6.6.3 Grande società

Le grandi aziende possiedono diversi vantaggi:

  • I costi fissi di gestione sono ripartiti su una maggiore quantità di entrate;
  • I dati interni e i casi d’uso sono più numerosi;
  • Il potere contrattuale delle imprese può ridurre i prezzi unitari;
  • È possibile assumere personale specializzato internamente;
  • I carichi di lavoro possono essere instradati tra i modelli;
  • Un utilizzo maggiore può giustificare la riserva di capacità;
  • I benefici possono essere diversificati e applicati a numerose funzioni aziendali.

Anche loro si trovano ad affrontare degli svantaggi:

  • integrazione con i sistemi preesistenti;
  • piloti dipartimentali duplicati;
  • superfici di attacco informatico più ampie;
  • complessa esposizione normativa;
  • gestione del cambiamento più lenta;
  • costo elevato degli errori correlati;
  • Concentrazione di fornitori su scala enorme.

Il vantaggio delle grandi aziende non consiste quindi semplicemente nel “di più denaro”. Si tratta piuttosto della capacità di convertire i costi fissi dell’IA in un costo inferiore per dipendente, transazione e unità di ricavo.


6.7 Esposizione settore per settore

6.7.1 Attività bancaria

L’utilizzo dell’intelligenza artificiale è già diffuso tra le principali banche europee. La Banca Centrale Europea ha riferito nel giugno 2026 che oltre l’85% delle banche soggette alla vigilanza bancaria europea utilizzava l’IA. ( Strengthening Operational Resilience for the Age of AI – European Central Bank – June/2026 — ECB assessment of AI and banking resilience ).

Le banche possono implementare l’intelligenza artificiale in:

  • rilevamento delle frodi;
  • monitoraggio delle transazioni;
  • analisi del credito;
  • assistenza clienti;
  • programmazione;
  • elaborazione documenti;
  • rendicontazione normativa;
  • sicurezza informatica;
  • modellazione del rischio;
  • collezioni;
  • gestione della conoscenza.

L’equazione del valore atteso è:

Valore netto dell’IA = Risparmi operativi + Perdite per frode evitate + Perdite di credito evitate + Margine incrementale − Costi di conformità − Rischio del modello − Spese per l’IA

Il settore bancario presenta un elevato potenziale di benefici, ma anche un elevato rischio di eventi estremi. Un errore in un sistema di assistente interno per la redazione di documenti non equivale a un errore sistematico nella valutazione del credito. La governance dei dati, la spiegabilità, la validazione, il monitoraggio e la concentrazione di terze parti devono essere allocati in base al caso d’uso. La BCE ha avvertito che l’intelligenza artificiale può migliorare l’efficienza operativa, ma al contempo aumentare il rischio operativo e la dipendenza da terze parti. L’ascesa dell’intelligenza artificiale: benefici e rischi per la stabilità finanziaria – Banca centrale europea – maggio 2024 — Analisi della stabilità finanziaria della BCE .

6.7.2 Assicurazione

L’intelligenza artificiale nel settore assicurativo può migliorare la sottoscrizione delle polizze, la gestione dei sinistri, l’individuazione delle frodi, la determinazione dei prezzi e l’interazione con i clienti. La sua formula di valore è:

Valore netto dell’assicurazione IA = Risparmio sulle spese + Riduzione delle perdite da sinistri + Miglioramento dei prezzi + Margine di premio incrementale − Rischio di condotta − Rischio del modello − Spesa per l’IA

Il pericolo principale è che i dati storici sui sinistri contengano esclusioni o distorsioni del passato. Un piccolo miglioramento medio del rapporto sinistri/premi può essere economicamente vantaggioso, ma un errore sistematico su migliaia di polizze può generare responsabilità correlate.

6.7.3 Assistenza sanitaria

I benefici in ambito sanitario includono il supporto alla documentazione clinica, la pianificazione, la codifica, l’assistenza per le immagini diagnostiche, la ricerca e la pianificazione operativa. I costi comprendono la convalida, la sicurezza, la supervisione clinica, l’integrazione con le cartelle cliniche elettroniche e l’infrastruttura ad alta disponibilità.

Valore netto dell’IA per la salute = Risparmio amministrativo + Valore della capacità + Errore evitato + Valore del risultato sanitario − Rischio clinico − Rischio per la privacy − Spesa per l’IA

Un calcolo puramente finanziario potrebbe sottovalutare il beneficio pubblico. Al contrario, monetizzare ogni minuto “risparmiato” non ha senso se i medici utilizzano quel tempo per ulteriori verifiche o se i livelli di personale non cambiano. La capacità produttiva si traduce in risparmi economici solo quando riduce gli straordinari, evita nuove assunzioni, aumenta le attività rimborsabili o migliora i risultati in misura sufficiente a produrre un valore misurabile.

6.7.4 Servizi legali e professionali

Gli studi legali e di consulenza presentano flussi di lavoro ad alta intensità di lavoro e ricchi di documenti, il che li espone teoricamente a un forte potenziale di aumento della produttività. Tuttavia, il tempo risparmiato può ridurre le ore fatturabili in caso di tariffazione oraria.

Valore legale netto dell’IA = Risparmio sui costi + Nuove questioni + Maggiore redditività + Valore della capacità − Ore fatturabili perse − Responsabilità − Spese per l’IA

L’effetto del modello di business è decisivo:

Modello di fatturazioneeffetto dell’IA sulla produttività
Fatturazione orariaIl risparmio di tempo può ridurre i ricavi, a meno che non aumenti il ​​volume.
Tariffa fissaL’efficienza aumenta il margine di profitto.
Abbonamento/contratto di mantenimentoL’efficienza può aumentare la capacità
Tariffa di risultatoIl valore dell’IA dipende dalla qualità dei risultati.
Ufficio legale internoL’efficienza riduce i costi o la domanda insoddisfatta

L’azienda potrebbe dover modificare i prezzi prima che la produttività diventi economicamente vantaggiosa.

6.7.5 Produzione

Tra i casi d’uso in ambito manifatturiero figurano la manutenzione predittiva, il controllo qualità, il controllo di processo, la pianificazione della catena di approvvigionamento, il supporto ingegneristico, gli acquisti e la documentazione tecnica.

Valore netto dell’IA nella produzione = Tempi di inattività evitati + Riduzione degli scarti + Miglioramento della resa + Capacità di lavoro + Riduzione delle scorte + Margine incrementale − Rischio per la sicurezza − Costo di integrazione − Spesa per l’IA

Il beneficio dovrebbe essere calcolato a partire da variabili fisiche:

Beneficio derivante dagli scarti = Unità × Riduzione degli scarti × Costo per unità

Beneficio derivante dai tempi di inattività = Ore evitate × Contributo per ora di produzione

Beneficio delle scorte = Riduzione delle scorte × Tasso di costo di mantenimento

L’intelligenza artificiale nel settore manifatturiero può creare valore senza ridurre il personale. Resa, energia, scarti e tempi di attività potrebbero rappresentare le principali fonti di risparmio in termini di produttività degli uffici.

6.7.6 Media

L’intelligenza artificiale applicata ai media può ridurre i costi di trascrizione, traduzione, editing, etichettatura, personalizzazione e produzione. Tuttavia, crea anche rischi legati al diritto d’autore, alla provenienza, alla fiducia e alla sostituzione.

Valore netto dell’IA per i media = Risparmi di produzione + Ricavi da pubblico + Monetizzazione dell’archivio − Rischio diritti − Danni al marchio − Perdita di sostituzione − Spese per l’IA

Gli obblighi di trasparenza previsti dall’articolo 50 dell’UE sono entrati in vigore il 2 agosto 2026 e riguardano la marcatura e l’individuazione di determinati contenuti generati dall’intelligenza artificiale, inclusi i deepfake e le pubblicazioni specificate. Codice di condotta sulla trasparenza dei contenuti generati dall’IA – Commissione europea – luglio 2026 – Quadro di trasparenza dei contenuti generati dall’IA della Commissione europea .

6.7.7 Telecomunicazioni

Gli operatori di telecomunicazioni possono applicare l’intelligenza artificiale all’ottimizzazione della rete, alla manutenzione predittiva, al servizio clienti, alla prevenzione delle frodi, alla riduzione del tasso di abbandono, alle vendite, alla sicurezza informatica e alla pianificazione della capacità. Le loro dimensioni e i flussi di dati ricorrenti li rendono candidati ideali per un’economia positiva dell’IA. Tuttavia, i sistemi di telecomunicazione sono infrastrutture critiche e la dipendenza da modelli esterni può creare rischi per la disponibilità e la sovranità.

Valore netto dell’IA nelle telecomunicazioni = Risparmi di rete + Riduzione del tasso di abbandono + Prevenzione delle frodi + ARPU incrementale + Automazione dei servizi − Rischio di interruzione − Rischio di sicurezza − Spesa per l’IA

Una riduzione di un punto percentuale del tasso di abbandono può valere più di ingenti risparmi amministrativi; l’unità di valore corretta potrebbe essere il valore a vita del cliente fidelizzato, piuttosto che le ore di lavoro.

6.7.8 Difesa e infrastrutture critiche

La difesa e le infrastrutture critiche richiedono livelli di garanzia più elevati, ambienti isolati, controllo sovrano, test, ridondanza e revisione della catena di approvvigionamento. Il ritorno finanziario può apparire negativo perché il valore della missione non viene interamente contabilizzato come ricavo.

Valore dell’IA corretto per la missione = Benefici finanziari + Valore di resilienza + Valore di sovranità + Valore di capacità − Rischio della missione − Spesa per l’IA

Un sistema che migliora l’elaborazione delle informazioni di intelligence ma crea una superficie di attacco avversaria inaccettabile non dovrebbe essere approvato solo perché il suo ritorno finanziario previsto è positivo.

6.7.9 Pubblica amministrazione

La pubblica amministrazione può utilizzare l’intelligenza artificiale per la gestione dei documenti, la traduzione, l’assistenza ai cittadini, l’analisi delle frodi e la ricerca sulle politiche. I vantaggi dovrebbero includere la qualità del servizio e la riduzione dei tempi di attesa.

Valore pubblico dell’IA = Risparmi amministrativi + Tempo risparmiato dai cittadini + Qualità del servizio + Frode evitata − Rischio per i diritti − Costo degli errori − Spesa per l’IA

Gli enti pubblici non possono presumere che il tempo risparmiato dal personale si traduca in un risparmio di bilancio. Se non si riducono posti di lavoro, straordinari o costi di approvvigionamento, il vantaggio consiste in un miglioramento della capacità operativa, non in un risparmio di denaro.

6.7.10 Istruzione e ricerca

Gli istituti di istruzione e ricerca si trovano ad affrontare un duplice onere: acquisire l’accesso all’intelligenza artificiale e al contempo riprogettare la valutazione, l’integrità della ricerca, la governance dei dati e la didattica.

Valore dell’IA nell’istruzione = Capacità didattica + Accelerazione della ricerca + Supporto agli studenti + Accessibilità − Rischio di integrità − Costo della disuguaglianza − Spesa per l’IA

Se le istituzioni più ricche acquistano modelli all’avanguardia mentre quelle più povere si affidano a sistemi con capacità inferiori, l’intelligenza artificiale può amplificare il divario tra ricerca e istruzione descritto nei capitoli precedenti.


6.8 Oneri normativi e di governance

La legge europea sull’intelligenza artificiale (AI Act) è entrata in vigore il 1° agosto 2024 ed è diventata generalmente applicabile il 2 agosto 2026, fatte salve alcune eccezioni graduali. Gli obblighi relativi alla governance e al modello di applicazione generale sono entrati in vigore prima; alcune disposizioni ad alto rischio hanno termini di applicazione estesi a seguito della legge omnibus sull’intelligenza artificiale del 2026. Quadro normativo dell’AI Act – Commissione europea – agosto 2026 — Tempistica ufficiale della Commissione europea sull’AI Act .

I costi di conformità dipendono dal ruolo e dal rischio. Un’azienda può essere:

  • un fornitore;
  • un addetto alla distribuzione;
  • un importatore;
  • un distributore;
  • un produttore di prodotti;
  • un modificatore a valle.

L’onere annuale di conformità può essere rappresentato come:

conformità = C inventario + C classificazione + C documentazione + C test + C monitoraggio + C formazione + C legale + C incidente

La regolamentazione non è l’unico fattore determinante. Anche laddove un sistema non sia legalmente classificato come ad alto rischio, la responsabilità contrattuale, gli standard professionali, la sicurezza informatica e le aspettative dei clienti possono richiedere controlli analoghi.

Il Generative AI Profile del NIST considera la gestione del rischio come un ciclo di vita che comprende governance, mappatura, misurazione e gestione. Questo approccio supporta un modello di governance in cui la valutazione e il monitoraggio rappresentano spese operative ricorrenti, anziché attività di lancio una tantum.


6.9 Confronto dei modelli di implementazione

6.9.1 Confronto strutturale

Modello di implementazioneInvestimento inizialeCosto variabileControllo della privacyCapacità di frontieraCosto di cambiorequisito di competenze interne
Proprietà completamente cloudBassoElevato/basato sull’utilizzoMezzoMolto altoAltoMezzo
Proprietà interamente localeMolto altoModerareAltoLimitato dall’hardware/licenza disponibiliAltoMolto alto
completamente locale a peso apertoAltoModerareMolto altoDipendente dal modelloMezzoMolto alto
IbridoMedio/altoMezzoElevato per carichi di lavoro sensibiliAltoMezzoAlto
Modello piccolo specializzatoBasso/medioBassoAlto se localeElevato per attività limitateBasso/medioMedio/alto
Recupero potenziato proprietarioMezzoMedio/altoMezzoAltoMedio/altoAlto
Peso aperto aumentato dal recuperoMedio/altoBasso/moderatoAltoDipendente dal modelloBasso/medioAlto
Calcolo condiviso/cooperativoSpese in conto capitale condiviseCondivisoPotenzialmente altoMedio/altoDipendente dalla governanceTeam di specialisti condiviso

6.9.2 Valutazione finanziaria

I punteggi vanno da 1, il meno favorevole, a 5, il più favorevole.

ModelloPrevedibilità dei costibasso costo di ingressoPrivacyScalabilitàPortabilitàIdoneità ad alta garanzia
Cloud proprietario352523
Completamente locale415235
Ibrido434445
Locale a peso aperto425354
Modello piccolo specializzato544344
RAG con API di frontiera343533
Calcolo cooperativo434344

Nessun modello prevale su ogni aspetto. L’implementazione ibrida è spesso economicamente vantaggiosa perché instrada localmente i carichi di lavoro sensibili o prevedibili e invia al cloud i carichi di lavoro complessi o i picchi di domanda.


6.10 Punto di pareggio per cloud, locale e ibrido

Permettere:

Nuvola C (Q) = Nuvola F + nuvola p Q

locale (Q) = F locale + p locale Q

I costi del cloud e dell’ambiente locale sono uguali a:

* = [F locale − F cloud ] ÷ [p cloud − p locale ]

Assumere:

  • Costo fisso di integrazione cloud = 100.000 USD;
  • costo fisso annuale locale = 700.000 USD;
  • costo variabile del cloud = 12 USD per milione di token elaborati con successo;
  • Costo variabile locale = 3 USD per milione di token funzionanti.

Poi:

= (700.000 − 100.000) ÷ (12 − ​​3)
Q
 = 66.667 milioni di token
* ≈ 66,7 miliardi di token di successo all’anno

Al di sotto di circa 66,7 miliardi di token validi, lo scenario cloud risulta più economico in base a queste ipotesi. Al di sopra di tale soglia, l’infrastruttura locale diventa più economica se qualità, utilizzo e affidabilità sono equivalenti. Spesso non lo sono, quindi è necessaria una soglia ponderata in base alla qualità:

QA = [F locale − F cloud ] ÷ [p cloud y cloud − p locale y locale ]

dove y rappresenta l’adeguamento dei costi necessario per ottenere un carico di lavoro soddisfacente.


6.11 Adozione competitiva obbligatoria

6.11.1 Il gioco dell’adozione

Consideriamo due aziende concorrenti. Ciascuna può adottare o meno l’intelligenza artificiale.

Azienda A / Azienda BB adottaB non adotta
A adottaEntrambi comportano costi legati all’IA; il vantaggio relativo potrebbe scomparireA può ottenere un vantaggio in termini di velocità, costi o prodotto
A non adottaSi rischia di perdere quote di mercato o talentiNessuno dei due paga; l’equilibrio esistente continua

Se entrambe le aziende adottano e ottengono identici aumenti di produttività che la concorrenza trasferisce ai clienti attraverso prezzi più bassi, nessuna delle due può trattenere il beneficio come profitto. L’IA diventa quindi un investimento “Regina Rossa” : ciascuna azienda deve investire semplicemente per mantenere la propria posizione relativa.

La regola della decisione privata diventa:

Adotta se:

Valore netto dell’IA + Perdita competitiva evitata > 0

Definire:

competitivo = Ricavi o margini persi se l’azienda non adotta

Poi:

Valore strategico netto dell’IA = Valore netto dell’IA + D competitivo

Un progetto con un valore netto diretto dell’IA pari a -2 milioni di dollari può essere razionale se si prevede che la mancata adozione riduca di 5 milioni di dollari il margine di contribuzione. Il suo valore strategico è positivo, pari a 3 milioni di dollari.

6.11.2 Tassa obbligatoria sull’IA

L’onere competitivo di fatto può essere espresso come:

Tassa obbligatoria sull’IA = Spesa minima per l’IA necessaria a mantenere la parità competitiva ÷ Entrate

Tipo di aziendaSpesa di parità minima a titolo esemplificativoRedditoTassa obbligatoria sull’IA
Microazienda professionale10.000 dollari USA0,8 milioni di dollari1,25%
Piccola impresa75.000 dollari5 milioni di dollari1,50%
Impresa di medie dimensioni300.000 dollari USA30 milioni di dollari1,00%
Grande impresa25 milioni di dollari5 miliardi di dollari0,50%
Banca80 milioni di dollari10 miliardi di dollari0,80%
Società di media3 milioni di dollari200 milioni di dollari1,50%

L’onere assoluto è maggiore per le grandi imprese, ma l’onere proporzionale può essere maggiore per le piccole imprese perché la governance, l’integrazione e la sicurezza contengono componenti fisse indivisibili.


6.12 Soglie di distruzione del valore

6.12.1 Aumento minimo della produttività del lavoro

Permettere:

  • A = spesa annuale per l’IA;
  • RC = costo annuo del rischio;
  • L = costo annuo del lavoro;
  • ΔR = ricavo incrementale;
  • m = margine di contribuzione.

Per raggiungere il punto di pareggio è necessario:

L L + mΔR ≥ A + RC

Il guadagno minimo di produttività del lavoro richiesto è:

* = [A + RC − mΔR] ÷ L

Soglie archetipiche

ArchetipoSpese relative all’IA più costi di rischioContributo incrementaleCosto del lavoroGuadagno minimo di produttività del lavoro
Microimpresa26.000 dollari8.000 dollari320.000 dollari5,63%
Piccola impresa180.000 dollari60.000 dollari1,5 milioni di dollari8,00%
Impresa di medie dimensioni700.000 dollari240.000 dollari7 milioni di dollari6,57%
Grande azienda80 milioni di dollari40 milioni di dollari1,2 miliardi di dollari3,33%
Banca250 milioni di dollari90 milioni di dollari3 miliardi di dollari5,33%
Organizzazione sanitaria90 milioni di dollari10 milioni di dollari1,1 miliardi di dollari7,27%
Studio legale5 milioni di dollari1,5 milioni di dollari55 milioni di dollari6,36%
Produttore24 milioni di dollari12 milioni di dollari180 milioni di dollari6,67%
Operatore di telecomunicazioni125 milioni di dollari80 milioni di dollari900 milioni di dollari5,00%
Operatore della difesa110 milioni di dollari30 milioni di dollari700 milioni di dollari11,43%
amministrazione pubblica90 milioni di dollariUSD 0 milioni900 milioni di dollari10,00%
Sistema universitario55 milioni di dollari5 milioni di dollari600 milioni di dollari8,33%

Un “aumento di produttività” deve tradursi in un vantaggio economico tangibile. Se i dipendenti risparmiano l’8% del loro tempo, ma il carico di lavoro, il personale, i ricavi e la qualità dei servizi offerti rimangono invariati, il guadagno finanziario realizzato potrebbe essere prossimo allo zero.

6.12.2 Ricavo incrementale minimo

Se non si verifica alcun risparmio di manodopera:

ΔR * = [A + RC − S] ÷ m

dove S rappresenta altri risparmi sui costi verificati.

Per una piccola impresa con una spesa in IA di 150.000 dollari, costi di rischio di 30.000 dollari, altri risparmi per 50.000 dollari e un margine di contribuzione del 30%:

ΔR = (150.000 + 30.000 − 50.000) ÷ 0,30
ΔR
 = 433.333 USD

L’azienda deve generare oltre 433.333 dollari di entrate annuali aggiuntive solo per raggiungere il pareggio.

6.12.3 Margine operativo minimo

Se la spesa annuale per l’IA è una proporzione a dei ricavi e il margine operativo pre-IA è m 0 :

Margine post-IA prima dei benefici = m 0 − a

Un’azienda con un margine operativo del 4% e costi di intelligenza artificiale pari al 3% del fatturato perde il 75% dell’utile operativo prima dei benefici.

Onere di profitto dell’IA = a ÷ m 0

Margine operativo pre-IARapporto costi-benefici dell’IAQuota di utile operativo consumato
3%1%33,3%
3%2%66,7%
3%3%100,0%
5%2%40,0%
5%3%60,0%
10%2%20,0%
20%2%10,0%
30%2%6,7%

I settori a basso margine sono quindi altamente esposti, anche quando i costi dell’IA appaiono modesti rispetto ai ricavi.


6.13 Scenario del VAN quinquennale

Consideriamo un’impresa di medie dimensioni con:

  • Costo iniziale di integrazione e preparazione dei dati: 1,2 milioni di dollari;
  • Costo ricorrente per il primo anno: 600.000 dollari USA;
  • crescita dei costi ricorrenti: 8% annuo;
  • Beneficio per il primo anno: 700.000 dollari USA;
  • Crescita dei benefici: 15% annuo;
  • Tasso di sconto: 9%;
  • valore terminale escluso;
  • I costi previsti per errori e tempi di inattività sono inclusi nei costi ricorrenti.
AnnoCostoBeneficioflusso di cassa netto
01,2 miliardi di dollariUSD 0−1,200 milioni di dollari
10,600 milioni di dollari0,700 milioni di dollari0,100 milioni di dollari USA
20,648 milioni di dollari0,805 milioni di dollari0,157 milioni di dollari
30,700 milioni di dollari0,926 milioni di dollari0,226 milioni di dollari
40,756 milioni di dollari1,065 milioni di dollari0,309 milioni di dollari
50,816 milioni di dollari1,225 milioni di dollari0,409 milioni di dollari

Valori approssimativi scontati:

MisuraValore
Valore attuale netto dei benefici3,55 milioni di dollari
Valore attuale netto dei costi ricorrenti2,69 milioni di dollari
Costo iniziale1,20 milioni di dollari
Valore attuale netto totale dei costi3,89 milioni di dollari
Valore attuale netto del progetto-0,34 milioni di dollari
ROI dell’IA-8,7%

Sebbene il flusso di cassa netto annuale sia positivo fin dal primo anno, il progetto non riesce a recuperare i costi di integrazione iniziali entro l’orizzonte temporale attualizzato di cinque anni. Ciò dimostra perché i risparmi operativi a livello pilota non si traducono in valore per l’impresa.


6.14 Analisi di sensibilità

Utilizzando come riferimento le medie imprese, il risultato a cinque anni è maggiormente sensibile all’adozione, alla realizzazione dei benefici e al rischio.

Realizzazione dei beneficisforamento dei costiMoltiplicatore del costo-rischioProbabile risultato finanziario
50%25%2,0×Grave distruzione di valore
75%15%1,5×Negativo
100%0%1,0×Quasi in pareggio
125%0%1,0×Positivo
125%-10%0,75×Fortemente positivo
150%-15%0,50×Trasformativo

Il rapporto benefici realizzati è:

BRR = Benefici realizzati ÷ Benefici previsti

Il progetto dovrebbe attivare la fase di bonifica quando:

BRR < BRR minimo

Se i benefici previsti sono pari a 1 milione di dollari e per raggiungere il punto di pareggio sono necessari 750.000 dollari, allora:

BRR minimo = 750.000 ÷ 1.000.000 = 75%


6.15 Alternative a peso aperto, a modello ridotto e cooperative

6.15.1 Sistemi a pesi aperti

I modelli open-weight riducono la dipendenza da un singolo fornitore di inferenza e consentono l’ispezione, la messa a punto e l’implementazione a livello locale. Non eliminano i costi. L’azienda si assume la responsabilità di:

  • infrastrutture;
  • ottimizzazione;
  • sicurezza;
  • valutazione del modello;
  • aggiornamenti;
  • monitoraggio;
  • analisi delle licenze;
  • risposta agli incidenti;
  • Personale specializzato.

Il confronto appropriato è:

Costo totale di proprietà (TCO) aperto rispetto al costo totale di proprietà (TCO) proprietario

Non si tratta di “modello gratuito” contro “API a pagamento”.

6.15.2 Specializzazione in modelli di piccole dimensioni

Un modello più piccolo può creare un valore aziendale superiore quando:

Qualità piccola, compito ≥ Qualità richiesta

E:

TCO piccolo < TCO frontiera

Una valutazione specifica per il compito potrebbe rivelare che un piccolo modello con recupero di informazioni supera un modello di frontiera generale in termini di estrazione controllata, classificazione o terminologia interna, pur costando meno ed esponendo meno dati.

6.15.3 Generazione potenziata dal recupero

RAG è economicamente vantaggioso quando il valore di una migliore messa a terra e di un contesto del modello più breve supera i costi di indicizzazione e recupero:

Valore RAG = Riduzione degli errori + Risparmio immediato + Flessibilità di aggiornamento − Costo di recupero − Costo di integrazione

RAG non risolve i problemi di cattiva gestione dei dati. Può recuperare contenuti errati, obsoleti o non autorizzati con elevata affidabilità.

6.15.4 Calcolo condiviso o cooperativo

Università, ospedali, comuni, associazioni professionali e PMI possono mettere in comune le infrastrutture:

Costo per membro = [Costo fisso condiviso + Costo operativo condiviso] ÷ Membri + Costo specifico per membro

La cooperazione può ridurre la disuguaglianza dei costi fissi, ma solleva questioni di governance:

  • allocazione delle capacità;
  • riservatezza;
  • responsabilità;
  • selezione del modello;
  • responsabilità di manutenzione;
  • ingresso e uscita;
  • priorità in caso di scarsità;
  • distribuzione dei costi;
  • separazione dei dati.

Un modello cooperativo risulta particolarmente interessante quando i membri condividono requisiti di garanzia, ma individualmente non presentano un volume di utilizzo sufficiente a giustificare un’infrastruttura dedicata.


6.16 Quadro decisionale aziendale

Un investimento in IA dovrebbe procedere solo dopo aver risposto alle seguenti domande:

TestDocumentazione richiesta
Necessità strategicaPerdita competitiva quantificata dovuta alla mancata adozione
Idoneità al compitoPrestazioni di base e del modello su lavori rappresentativi
Caso finanziarioValore attuale netto (VAN), ritorno sull’investimento (ROI) e periodo di recupero dell’investimento a cinque anni
convertibilità dei beneficiMeccanismo che trasforma il risparmio di tempo in denaro o in produzione
tolleranza al rischioValutazione delle perdite previste e della coda
Prontezza dei datiDiritti, qualità, provenienza e accesso
Scelta di implementazioneConfronto tra cloud, locale, ibrido o cooperativo
fattibilità dell’uscitaCosto di transizione e livello dati/modello portatile
GovernanceTitolare designato, inventario, monitoraggio e gestione delle segnalazioni.
Controllo umanoRevisione della soglia e del responsabile delle decisioni
ResilienzaPiano di ripiego, procedura di interruzione e obiettivo di ripristino
MisurazioneGruppo di controllo post-implementazione o controfattuale credibile

L’azienda dovrebbe stabilire un controfattuale:

Valore incrementale dell’IA = Risultato con IA − Risultato senza IA

In assenza di un gruppo di controllo, di un’implementazione graduale, di un flusso di lavoro standardizzato o di una base di riferimento credibile, i normali miglioramenti aziendali potrebbero essere erroneamente attribuiti all’intelligenza artificiale.


6.17 Prospettive aziendali quinquennali, 2027-2031

L’esito più probabile non è la sostituzione universale del lavoro umano, bensì la progressiva trasformazione dell’IA in uno strato imprescindibile dell’infrastruttura aziendale. I costi di adozione si sposteranno dagli abbonamenti, che saranno visibili, verso spese meno evidenti relative a integrazione, governance, valutazione e gestione del rischio. Le grandi aziende svilupperanno sempre più piattaforme di instradamento dei modelli, combinando modelli proprietari all’avanguardia, modelli specializzati di piccole dimensioni, sistemi di recupero e infrastrutture locali. Le aziende più piccole rimarranno maggiormente dipendenti da prodotti SaaS preconfezionati, poiché non saranno in grado di internalizzare in modo efficiente la governance e l’ingegneria. Ciò trasferirà il potere contrattuale ai fornitori di software e creerà il rischio persistente che l’IA diventi un sovrapprezzo inevitabile integrato in prodotti di contabilità, produttività, CRM, progettazione, legali, di sicurezza e di comunicazione.

Sono plausibili tre equilibri aziendali:

EquilibrioDescrizioneConseguenza distributiva
Diffusione della produttivitàIndipendentemente dalle dimensioni dell’azienda, i benefici superano i costi.Aumento generalizzato della produzione e prezzi più bassi
impulso competitivoLe imprese si adattano per mantenere la parità; i vantaggi si trasferiscono ai clientiL’IA diventa un costo fisso obbligatorio
Concentrazione delle capacitàLe grandi aziende ottengono economie di scala e modelli miglioriI margini e la quota di mercato delle PMI sono in calo.

Il secondo e il terzo scenario possono coesistere. I clienti potrebbero ricevere servizi più rapidi o più economici, mentre i profitti delle imprese si concentrerebbero maggiormente nelle mani dei fornitori di infrastrutture e piattaforme di intelligenza artificiale.


6.18 Risultati finali

  1. L’adozione dell’IA sta accelerando, ma i tassi di utilizzo non ne determinano la redditività. Nell’UE, l’adozione da parte delle imprese è salita a circa il 20% nel 2025, mentre nelle grandi imprese ha superato il 55%.
  2. Il costo aziendale rilevante è sostanzialmente superiore alla spesa per licenze e API. Occorre includere dati, integrazione, sicurezza informatica, governance, valutazione, supervisione umana e transizione.
  3. Le piccole imprese devono affrontare un onere sproporzionato di costi fissi. Attività di governance identiche assorbono una quota molto maggiore di ricavi e profitti delle piccole imprese.
  4. Anche le aziende con margini ridotti sono esposte a rischi, persino con un rapporto costi/ricavi per l’IA apparentemente basso. Una spesa per l’IA pari al 3% del fatturato annulla l’utile operativo ante investimenti in IA, quando anche il margine di profitto è del 3%.
  5. Il tempo risparmiato non si traduce automaticamente in valore finanziario. Diventa un beneficio economico solo attraverso la riduzione dei costi, l’evitamento di assunzioni, l’aumento della produzione, maggiori entrate o il miglioramento dei servizi pubblici.
  6. I settori ad alto rischio richiedono un’analisi dei rischi estremi. I guadagni di produttività attesi non possono giustificare l’implementazione quando un guasto a bassa probabilità minaccia perdite catastrofiche.
  7. L’implementazione in cloud minimizza il capitale iniziale ma può massimizzare la dipendenza. L’implementazione completamente locale migliora il controllo ma richiede un elevato utilizzo delle risorse e personale specializzato.
  8. È probabile che i sistemi ibridi diventino la norma nelle architetture aziendali mature. I carichi di lavoro sensibili e prevedibili possono rimanere locali, mentre i picchi di domanda e le esigenze emergenti utilizzano capacità esterne.
  9. I modelli a pesi aperti non eliminano né i costi infrastrutturali né quelli di governance. Il loro vantaggio economico risiede nel controllo e nella portabilità, non in un costo totale di proprietà (TCO) pari a zero.
  10. I modelli specializzati di piccole dimensioni possono superare economicamente i sistemi di frontiera in compiti limitati. Il criterio rilevante è il costo del carico di lavoro eseguito con successo, non il numero nominale di parametri.
  11. L’intelligenza artificiale potrebbe trasformarsi in un investimento azzardato. Le aziende potrebbero pagare semplicemente per preservare la parità competitiva, con i guadagni di produttività trasferiti ai clienti anziché essere trattenuti come profitto.
  12. La soglia minima di produttività può essere calcolata in modo esplicito. Essa aumenta con la spesa per l’IA, i costi del rischio e i bassi margini di contribuzione, mentre diminuisce con i ricavi verificabili o i benefici non lavorativi.
  13. Un risparmio annuo positivo non garantisce un VAN (Valore Attuale Netto) positivo a cinque anni. L’integrazione iniziale e l’aumento ricorrente dei costi possono compromettere il valore del progetto.
  14. Difesa, sanità, governo e istruzione richiedono una valutazione adeguata alla missione. Il solo ritorno sull’investimento commerciale non tiene conto di resilienza, sovranità, sicurezza e beneficio pubblico.
  15. Dal 2027 al 2031, la differenza decisiva risiederà nelle capacità organizzative, non nel semplice accesso a un chatbot. Le aziende in grado di gestire i dati, valutare i modelli, instradare i carichi di lavoro e negoziare le infrastrutture otterranno un valore sproporzionato; le aziende che acquisteranno strumenti di intelligenza artificiale frammentari senza misurarne l’efficacia potrebbero trovarsi a sostenere un nuovo costo obbligatorio senza ottenere un ritorno duraturo in termini di produttività.

CAPITOLO 7 — Il divario nelle capacità dell’IA: studenti, ricercatori e mobilità sociale

7.1 Ambito e quesito centrale della ricerca

Il divario emergente nell’ambito dell’IA non è adeguatamente descritto dal semplice fatto che un individuo abbia mai utilizzato un chatbot. Un accesso significativo ha almeno sei dimensioni: disponibilità, convenienza economica, capacità del modello, limiti di utilizzo, hardware e connettività, e la capacità dell’utente di integrare l’IA nel proprio lavoro produttivo. Un servizio nominalmente gratuito può imporre limiti di utilizzo restrittivi, utilizzare un modello con capacità inferiori, non offrire analisi di documenti a lungo termine, non fornire un ambiente di progetto persistente, non includere strumenti avanzati o risultare non disponibile durante i periodi di congestione. L’accesso a pagamento per i consumatori può eliminare alcuni vincoli, pur rimanendo sostanzialmente inferiore all’accesso aziendale in termini di throughput, governance, integrazione dei dati e disponibilità garantita. L’accesso locale ad alte prestazioni può garantire privacy e possibilità di sperimentazione, ma richiede ingenti capitali, energia elettrica, competenze tecniche e manutenzione. La variabile analitica corretta è quindi l’accesso effettivo ponderato per la qualità , non il possesso dell’account.

Questa distinzione è importante perché l’IA può potenziare le attività che accumulano capitale umano e istituzionale: studiare, programmare, tradurre, pubblicare, analizzare documenti, preparare applicazioni, progettare imprese, condurre esperimenti e ricercare letteratura scientifica. Piccole differenze iniziali nell’accesso possono accumularsi. Uno studente che riceve spiegazioni di qualità superiore, feedback più rapidi e un supporto di programmazione più efficace può completare più progetti; questi progetti possono migliorare la sua occupabilità; un reddito più elevato può finanziare un migliore accesso all’IA; un migliore accesso può quindi generare ulteriori vantaggi. La sequenza opposta può colpire studenti e ricercatori limitati ad hardware obsoleto, piani gratuiti instabili o modelli locali con capacità limitate.

L’adozione è già fortemente stratificata. Nel 2025, il 20% delle imprese dell’UE con almeno dieci dipendenti ha dichiarato di utilizzare l’IA, ma la percentuale tra le grandi imprese ha raggiunto il 55,03%. Utilizzo dell’intelligenza artificiale nelle imprese – Eurostat – dicembre 2025 — Statistiche Eurostat sull’IA nelle imprese . Sebbene le statistiche aziendali non misurino direttamente l’accesso degli studenti, rivelano gli ambienti istituzionali in cui i laureati entrano: ricercatori e lavoratori associati a organizzazioni facoltose possono ottenere modelli, dati, strumenti e risorse di calcolo migliori rispetto a individui altrettanto capaci al di fuori di esse.


7.2 Dall’accesso digitale all’accesso alle capacità

7.2.1 Quattro gruppi di accesso

GruppoAccesso tipicoCapacità effettivaLimitazione principale
G0 — Nessun accesso regolare all’IANessun account, dispositivo, connettività o autorizzazione stabili.Nessun aiuto indiretto o aiuto indiretto occasionaleEsclusione completa
G1 — Accesso gratuitoModello gratuito per i consumatori su telefono o computer ordinarioSpiegazione di base, stesura, traduzione e programmazione limitata.Limiti di velocità, instradamento del modello, continuità debole e disponibilità incerta
G2 — Accesso a pagamento per i consumatoriAbbonamento mensile e dispositivo di uso generale adeguatoRagionamento più solido, file, contesto più lungo e più strumentiLimiti di utilizzo equo, nessuna capacità garantita e integrazione istituzionale limitata.
G3 — Accesso aziendale Frontier o accesso locale ad alte prestazioniAPI di frontiera, piani aziendali, agenti specializzati, dati proprietari o hardware locale con elevata capacità di memoriaRicerca continua, codifica, elaborazione di documenti lunghi, automazione e flussi di lavoro riservatiElevati costi monetari, tecnici e organizzativi

I gruppi non devono essere considerati identità permanenti. Una persona può passare da un gruppo all’altro a seconda dell’attività svolta: accesso gratuito per i consumatori per domande di carattere generale, accesso universitario per la ricerca e accesso riservato, non consentito dall’IA, per i dati clinici confidenziali. La misurazione dovrebbe quindi registrare la percentuale di tempo di studio o di lavoro rilevante durante la quale è disponibile ciascuna classe di accesso.

7.2.2 Accesso all’IA con qualità adeguata

Definire l’accesso ponderato in base alla qualità come:

QAA u,t = A disponibilità × Q compito × U indennità × T strumenti × D dati × S competenze

Dove:

  • La disponibilità è la probabilità che il sistema sia accessibile quando necessario;
  • Il compito Q è una qualità specifica del compito;
  • La quota U rappresenta il volume utilizzabile in relazione alla domanda;
  • Gli strumenti T rappresentano l’accesso al recupero, all’esecuzione del codice, all’analisi dei file e agli strumenti esterni;
  • I dati D rappresentano un accesso lecito ai dati pertinenti;
  • Le competenze S rappresentano la competenza dell’utente.

Poiché le variabili interagiscono in modo moltiplicativo, una componente prossima allo zero può neutralizzare le altre. Un modello altamente performante offre un accesso effettivo limitato se l’utente può inviare solo poche richieste, non può caricare i documenti richiesti, non dispone di connettività o non è in grado di valutare output inaffidabili.


7.3 Dimensioni della divisione delle capacità di IA

7.3.1 Livello di istruzione

L’intelligenza artificiale può influenzare il rendimento scolastico attraverso:

  • spiegazioni personalizzate;
  • Feedback ripetuto senza costi aggiuntivi per le lezioni private;
  • pratica adattiva;
  • traduzione;
  • assistenza per l’accessibilità;
  • supporto nella programmazione e nella matematica;
  • Riassunto e generazione di note;
  • preparazione agli esami;
  • orientamento amministrativo;
  • Supporto per le domande di ammissione e per le borse di studio.

La stima causale non è la differenza tra utenti e non utenti di IA, perché gli utenti possono differire per livello di istruzione pregresso, reddito, motivazione e supporto istituzionale. Un modello valido è:

i,t = α + βQAA i,t + γY i,t−1 + δX i,t + μ istituzione + τ t + ε i,t

Dove:

  • i,t è il raggiungimento;
  • QAA i,t è l’accesso all’IA regolato in base alla qualità;
  • i,t contiene controlli relativi a reddito, voti precedenti, lingua, disabilità, dispositivo e connettività;
  • μ l’istituzione cattura le differenze istituzionali;
  • τ t cattura gli effetti del periodo.

Un valore positivo di β supporterebbe l’ipotesi del vantaggio derivante dall’accesso solo se l’accesso all’IA precede il risultato misurato e se i fattori confondenti sono controllati in modo credibile.

7.3.2 Produttività della ricerca

I benefici della ricerca possono includere:

  • scoperta della letteratura;
  • classificazione dei documenti;
  • generazione del codice;
  • pulizia dei dati;
  • traduzione;
  • generazione di ipotesi;
  • supporto alla simulazione;
  • Revisione del manoscritto;
  • preparazione delle domande di finanziamento;
  • automazione amministrativa.

La produttività della ricerca dovrebbe essere misurata attraverso molteplici risultati:

RP i,t = w 1 Pubblicazioni + w 2 Citazioni + w 3 Set di dati + w 4 Software + w 5 Replicazione + w 6 Qualità della ricerca

Il semplice conteggio delle pubblicazioni non è sufficiente, perché l’intelligenza artificiale può aumentare la produzione di testo senza migliorarne la validità scientifica. Ritrattazioni, analisi non riproducibili, riferimenti falsificati e programmi di ricerca omogenei sono risultati negativi, non produttività.

7.3.3 Occupabilità

L’intelligenza artificiale influisce sull’occupabilità attraverso due meccanismi opposti. Può aumentare la capacità di un lavoratore di programmare, comunicare, analizzare e automatizzare. Può anche ridurre il valore di mercato delle competenze di routine. Il vantaggio in termini di occupabilità è quindi:

EA i = Complementarietà della produttività + Alfabetizzazione all’IA + Qualità del portfolio − Sostituzione delle competenze − Fallimento della verifica

Un lavoratore diventa più occupabile quando l’intelligenza artificiale integra competenze settoriali rare. Un lavoratore la cui produttività è facilmente sostituibile potrebbe trovarsi ad affrontare una maggiore concorrenza anche dopo aver acquisito competenze di base in materia di intelligenza artificiale.

7.3.4 Imprenditorialità

Le opportunità imprenditoriali possono espandersi perché l’IA riduce il costo di:

  • ricerche di mercato;
  • traduzione;
  • prototipazione di software;
  • progetto;
  • assistenza clienti;
  • preparazione di documenti legali;
  • marketing;
  • analisi dei dati;
  • pianificazione aziendale.

Tuttavia, l’accesso alle frontiere può creare una nuova scala minima efficiente. Se i concorrenti utilizzano agenti integrati, dati proprietari e capacità di inferenza riservata, gli utenti del livello gratuito potrebbero essere in grado di creare prototipi, ma non sistemi di produzione affidabili.

7.3.5 Sviluppo del software

La programmazione è uno dei settori più misurabili perché le prestazioni possono essere valutate tramite test, risoluzione dei problemi, tasso di difetti e codice accettato. I risultati appropriati includono:

  • tempo di accettazione della pull request;
  • percentuale di problemi risolti;
  • Tasso di superamento dei test unitari;
  • difetti di sicurezza;
  • manutenibilità;
  • tempo di revisione umana;
  • costo per ogni problema risolto con successo.

Anthropic ha riportato un risultato del 72,5% per Claude Opus 4 su SWE-bench nella configurazione di valutazione dichiarata. Presentazione di Claude 4 – Anthropic – Maggio/2025 — Divulgazione della valutazione di Anthropic Claude 4. Ciò dimostra che i sistemi all’avanguardia possono risolvere una quota sostanziale di attività di ingegneria del software sottoposte a benchmark in condizioni specificate. Non è una prova che ogni codebase aziendale otterrà lo stesso risultato.

7.3.6 Accesso linguistico

L’intelligenza artificiale multilingue può ridurre lo svantaggio di chi lavora al di fuori delle lingue scientifiche e commerciali dominanti. Può tradurre istruzioni, ricerche, documentazione tecnica e corrispondenza professionale. Le sue capacità, tuttavia, rimangono disomogenee a seconda delle lingue, dei dialetti e della terminologia specialistica.

Il vantaggio derivante dall’accesso linguistico può essere rappresentato come:

LA l = Q traduzione,l × Q ragionamento,l × Copertura l − Costo errore l

Un sistema che traduce in modo fluido ma ragiona in modo meno affidabile nella lingua di destinazione può generare inclusioni errate. La scheda di valutazione del sistema Sonnet 4.6 di Anthropic riporta i risultati di una valutazione su 57 discipline accademiche e 14 lingue diverse dall’inglese e pubblica la metodologia MMMLU del modello e i relativi risultati. Claude Sonnet 4.6 System Card – Anthropic – Febbraio/2026 — Anthropic Claude Sonnet 4.6 System Card . Tali risultati rimangono di competenza del fornitore e dovrebbero essere riprodotti in modo indipendente prima di essere utilizzati per trarre conclusioni politiche.


7.4 Indice di accessibilità economica dell’IA

7.4.1 Definizione

AAI c,t = Costo annuale di un accesso adeguato all’IA c,t ÷ Reddito disponibile mediano c,t

Il numeratore deve rappresentare un accesso adeguato, non meramente nominale. Dovrebbe includere:

Costo adeguato = Abbonamento + API + Annualizzazione del dispositivo + Connettività + Archiviazione + Software + Manutenzione + Tasse

Un indice di accessibilità economica basato esclusivamente su un abbonamento mensile di 20 dollari sottovaluta il costo per gli utenti che necessitano di un computer performante, di una connessione a banda larga, di spazio di archiviazione o di capacità API aggiuntive.

7.4.2 Interpretazione proposta

Valore AAIInterpretazione
Inferiore all’1%Ampiamente accessibile agli utenti con reddito medio
1–3%Percettibile ma generalmente gestibile
3–5%Decisione familiare rilevante
5–10%Restrittivo
10–20%Estremamente restrittivo
Oltre il 20%Economicamente escludente senza sussidi

Queste soglie sono classificazioni analitiche, non standard internazionali.

7.4.3 Cesti ad accesso adeguato

CestinoIngegneriaCosto annuale dello scenario
B0 — Accesso nominale gratuitoDispositivo esistente, livello gratuito, connettività esistenteIncremento di 0 USD, ma nessuna garanzia di adeguatezza
B1 — Accesso base a pagamentoAbbonamento del consumatore, annualizzazione del dispositivo ordinario, connettività incrementale660 USD
B2 — Accesso professionale alla frontieraUtilizzo più elevato, abbonamento/API di frontiera, archiviazione e dispositivo compatibile2.400 USD
B3 — Accesso alla ricerca avanzataElevato utilizzo di API, strumenti, archiviazione e annualizzazione delle workstation4.000 dollari USA
B4 — Accesso privato ad alte prestazioniPostazione di lavoro/server locale, manutenzione, elettricità e funzionamento del modelloDa 8.000 a 25.000 dollari USA

I panieri rappresentano scenari analitici standardizzati. Tasse, tassi di cambio e prezzi locali dell’hardware devono essere applicati separatamente.


7.4.4 Scenari di accessibilità economica in base al livello di reddito

risorse disponibili annuali medianeB1: 660 USDB2: 2.400 USDB3: 4.000 USDB4 basso: 8.000 USD
3.000 dollari USA22,0%80,0%133,3%266,7%
6.000 dollari USA11,0%40,0%66,7%133,3%
12.000 dollari USA5,5%20,0%33,3%66,7%
24.000 dollari USA2,75%10,0%16,7%33,3%
45.000 dollari1,47%5,33%8,89%17,78%
75.000 dollari0,88%3,20%5,33%10,67%

Eurostat ha riportato un reddito disponibile annuo mediano di 21.245 unità di potere d’acquisto per abitante dell’UE nel 2024. Condizioni di vita in Europa: distribuzione del reddito e disuguaglianza di reddito – Eurostat – 2026 — Statistiche Eurostat sul reddito disponibile mediano . Con un reddito esemplificativo di 21.245 unità, i panieri standardizzati B1, B2 e B3 assorbirebbero rispettivamente circa il 3,1%, l’11,3% e il 18,8% se le unità del paniere fossero comparabili a livello di prezzo. Una tabella di conversione rigorosa per paese deve convertire il paniere in prezzi locali anziché equiparare meccanicamente un’unità di potere d’acquisto a un dollaro statunitense.


7,5 Indice di accessibilità all’IA per gli studenti

7.5.1 Definizione

SAI c,t = Costo annuale dell’IA e dell’hardware c,t ÷ Risorse annuali disponibili per gli studenti c,t

Le risorse degli studenti dovrebbero includere il reddito effettivamente disponibile dopo aver pagato le tasse universitarie e le spese essenziali per l’alloggio:

Risorse per gli studenti = Borse di studio + Sovvenzioni + Sostegno familiare + Reddito netto da lavoro − Tasse universitarie − Alloggio essenziale − Costi essenziali di sostentamento

Utilizzare il reddito mediano delle famiglie come denominatore può sottostimare gravemente le difficoltà degli studenti.

7.5.2 Scenari di accessibilità economica per gli studenti

Risorse annuali monouso per studentiAccesso base a pagamento: 660 USDAccesso professionale: 2.400 USDRicerca avanzata: 4.000 USD
1.500 USD44,0%160,0%266,7%
3.000 dollari USA22,0%80,0%133,3%
6.000 dollari USA11,0%40,0%66,7%
12.000 dollari USA5,5%20,0%33,3%
24.000 dollari USA2,75%10,0%16,7%

Questo spiega perché un servizio che appare economico a un professionista può risultare inaccessibile per uno studente. Un abbonamento mensile di 20 dollari equivale a 240 dollari all’anno, prima ancora di considerare hardware e connettività. Per uno studente con soli 1.500 dollari di risorse effettivamente disponibili, il solo abbonamento ne assorbe il 16%.


7.6 Convenienza delle postazioni di lavoro

7.6.1 Postazione di lavoro standardizzata

Per la modellazione transnazionale, definire una workstation AI di riferimento come:

  • CPU multi-core moderna;
  • 128 GB di memoria di sistema;
  • Memoria acceleratrice da 24 a 32 GB;
  • Archiviazione a stato solido da 2 a 4 TB;
  • adeguata alimentazione elettrica e sistema di raffreddamento;
  • vita economica di cinque anni.

Il prezzo di riferimento per la pianificazione è fissato a:

Prezzo di riferimento P = 4.000 USD prima di imposte locali, dazi doganali e adeguamento valutario.

Si tratta di un paniere analitico piuttosto che di un prodotto destinato alla vendita al dettaglio. Come punto di riferimento hardware ufficiale, NVIDIA elenca la GeForce RTX 5090 con 32 GB di memoria GDDR7 e un prezzo di partenza di 1.999 dollari prima del resto della workstation. Specifiche della GeForce RTX 5090 – NVIDIA – Gennaio/2025 — Specifiche ufficiali della NVIDIA GeForce RTX 5090 .

7.6.2 Formula per il calcolo della retribuzione mensile

Salario mensile c = Prezzo locale della postazione di lavoro c ÷ Salario mensile mediano c

Il rapporto deve utilizzare i salari locali al netto delle imposte per uno studio di accessibilità economica. Il reddito lordo può essere riportato come indicatore secondario, ma non deve essere confuso con il reddito disponibile.

7.6.3 Calcoli verificati e indicativi

PaeseDati ufficiali sugli utiliCestello per postazione di lavoroMesi di stipendioQualifica probatoria
Stati UnitiMediana: 1.251 USD a settimana; circa 5.421 USD al mese4.000 dollari USA0,74Retribuzione lorda mediana a tempo pieno, secondo trimestre 2026
GermaniaMediana implicita di 21,48 euro/ora dalla soglia ufficiale di basso salario; circa 3.723 euro/mese per 173,3 ore4.000 euro1.07Mediana mensile stimata dalla mediana oraria ufficiale
ItaliaSecondo l’indagine sulla struttura occupazionale del 2022, la retribuzione oraria media si aggira intorno ai 16,35 euro; pari a circa 2.834 euro al mese per 173,3 ore lavorative.4.000 euro1.41Media, non mediana; solo indicativa
IndiaGuadagno medio mensile per dipendente nel 2025: 22.220 INR.paniere locale analitico da 350.000 INR15,75Media, non mediana; il prezzo del carrello richiede la verifica locale.
SudafricaSecondo l’ultima osservazione dell’ILO sul profilo dei dipendenti, risalente al 2020, la retribuzione media mensile per dipendente è di 7.980 ZAR.paniere analitico da 80.000 ZAR10.03Media obsoleta; inadatta alla classifica attuale

Negli Stati Uniti, la retribuzione mediana a tempo pieno era di 1.251 dollari a settimana nel secondo trimestre del 2026. (Usual Weekly Earnings of Wage and Salary Workers – US Bureau of Labor Statistics – July/2026 — BLS Q2 2026 median earnings) . L’Ufficio federale di statistica tedesco ha riportato un benchmark di retribuzione oraria mediana di 21,48 euro per aprile 2025 attraverso la sua tabella ufficiale delle soglie salariali minime. ( Low-Wage Thresholds in Germany – Destatis – May/2025 — Destatis German wage thresholds ). L’ILOSTAT riporta una retribuzione media mensile per dipendente di 22.220 rupie indiane per l’India nel 2025. (India Country Profile – ILOSTAT – 2026 — ILOSTAT India labour profile ).

La tabella non deve essere interpretata come una classifica transnazionale definitiva, poiché i concetti salariali, le date, le tasse e i prezzi delle postazioni di lavoro non sono perfettamente armonizzati. Il suo risultato più significativo è di tipo ordinale: l’hardware che rappresenta meno di un mese di stipendio mediano a tempo pieno negli Stati Uniti può rappresentare molti mesi di reddito di un dipendente nei mercati a basso reddito.


7.7 Misurazione della differenza di capacità tra i gruppi di accesso

7.7.1 Matrice dei risultati

CapacitàG0: nessun accessoG1: livello gratuitoG2: consumatore a pagamentoG3: prestazioni elevate di frontiera/aziendali/locali
Spiegazione di baseNessunoModerareAltoAlto
Ragionamento complessoNessunoLimitato/variabileAltoIl più alto disponibile
ProgrammazioneNessunoDa base a moderatoForteOttima dimestichezza con gli strumenti e capacità di gestire carichi di lavoro prolungati.
Ricerca fattualeSolo manualeVariabileStrumenti e contesto miglioriRecupero, API, database e verificabilità
Documenti lunghiManualeLimitatoModerato/altoProgetti ad alta produttività e persistenti
Supporto multilingueutensili manualiAmpio ma variabileQualità superioreIntegrato nel dominio e scalabile
flusso di lavoro scientificoManualeLimitatoModerareCodice, strumenti, dati privati ​​e automazione
Opera riservataNessuna IASpesso inadattoDipendente dal contrattoControlli aziendali o privacy locale
ConcorrenzaNessunoBassoModerareAlto
RiproducibilitàManualeDeboleModerareSnapshot delle API, registrazione e distribuzione controllata
AdattamentoNessunoMinimoLivello utenteRAG, messa a punto, agenti e modelli locali

La tabella esprime l’accesso strutturale previsto, non le prestazioni di un modello fisso. I livelli gratuiti possono esporre temporaneamente modelli di frontiera, mentre gli utenti a pagamento possono selezionare modelli meno performanti. La classificazione deve pertanto essere registrata a livello del modello effettivo, del livello di servizio e dell’attività.


7.8 Benchmark di capacità riproducibile

7.8.1 Principio di prova

Il conteggio dei parametri non deve essere utilizzato come indicatore di utilità. Le prestazioni dipendono da:

  • architettura;
  • parametri totali e attivi;
  • dati di addestramento;
  • post-allenamento;
  • quantizzazione;
  • contesto;
  • recupero;
  • utensili;
  • quadro inferenziale;
  • formato del prompt;
  • campionamento;
  • lingua;
  • specializzazione dei compiti;
  • calcolare il budget.

L’unità di riferimento dovrebbe essere:

Carichi di lavoro completati con successo ÷ Costo totale

piuttosto che basarsi esclusivamente sul punteggio di riferimento grezzo.

7.8.2 Suite di benchmark richiesta

DimensioneCostruzione di provaIndicatore primariometrica di fallimento
RagionamentoNuovi problemi a più fasi relativi al controllo della contaminazioneTasso di successo esattoRichieste di risarcimento intermedie non supportate da prove
ProgrammazioneProblemi del repository con i testTasso di risoluzione dei problemiNuovi difetti e codice non sicuro
Affidabilità dei fattiDomande con timestamp e corpus verificatoPrecisione delle affermazioni supportateTasso di allucinazioni
MultilingueAttività di dominio parallele in diversi linguaggirapporto di parità di qualitàDegrado delle prestazioni dovuto alla lingua
Contesto lungoMolteplici passaggi rilevanti e contraddittoriAccuratezza del recupero e della sintesiErrore di posizione del contesto
Elaborazione dei documentiTabelle, scansioni, note a piè di pagina e passaggi contraddittoriEstrazione F1 e accuratezza delle citazioniCampi inventati
Compiti scientificiCalcoli riproducibili e analisi della letteraturaRisultato e provenienza correttiRiferimenti inventati
Energiaenergia della presa a muro o dell’impiantoJoule per operazione riuscitaEnergia per uscita non riuscita
CostoFornitore completo o TCO localeCosto per operazione completata con successoCosto per token generato senza qualità
PrivacyAudit del flusso di dati e della conservazioneTasso di conformitàTrasmissione non autorizzata

7.8.3 Configurazione sperimentale controllata

Ogni esecuzione deve rivelare:

  • modello e versione esatti;
  • quantizzazione;
  • hardware;
  • quadro inferenziale;
  • richiesta;
  • temperatura;
  • sforzo di ragionamento;
  • accesso agli strumenti;
  • corpus di recupero;
  • lunghezza del contesto;
  • massima potenza;
  • numero di prove;
  • intervallo di confidenza;
  • data;
  • costo totale;
  • misurazione dell’energia.

Le linee guida ufficiali di OpenAI per la valutazione dei modelli raccomandano di confrontare le configurazioni su compiti rappresentativi anziché presumere che il massimo sforzo di ragionamento offra sempre il miglior compromesso. Linee guida per la valutazione dei modelli – API OpenAI – Agosto/2026 — Linee guida ufficiali di OpenAI per la valutazione dei modelli .

7.8.4 Analisi statistica

Per il modello m e il compito k:

Successo m,k ∈ {0,1}

Il successo medio è:

p̂ m = ΣSuccesso m,k ÷ n

Il costo corretto per la qualità è:

QAC m = Costo totale m ÷ ΣSuccesso m,k

L’energia consumata per ogni operazione completata con successo è:

successo,m = Energia totale m ÷ ΣSuccesso m,k

La frequenza delle allucinazioni è:

HR m = Affermazioni fattuali non supportate m ÷ Tutte le affermazioni fattuali m

La parità multilingue per la lingua l è:

MP m,l = Punteggio m,l ÷ Punteggio m,riferimento

Valori inferiori a uno indicano prestazioni inferiori rispetto al linguaggio di riferimento.


7.9 I modelli locali di dimensioni ridotte creano uno svantaggio misurabile?

L’ipotesi è:

H7.1: Dopo aver tenuto conto di strumenti, specializzazione del compito, quantizzazione, contesto e costi, i modelli locali più piccoli producono un tasso di successo del carico di lavoro inferiore su compiti generali complessi rispetto ai modelli cloud di frontiera.

L’ipotesi contraria è:

H7.2: Per compiti circoscritti e specializzati, un modello locale più piccolo combinato con il recupero può eguagliare o superare un modello di frontiera generale a costi inferiori e con maggiore privacy.

Entrambe le affermazioni possono essere vere.

7.9.1 Schema previsto delle attività

CompitoProbabile vantaggio di frontieraPotenziale vantaggio dei modelli di piccole dimensioni
Nuovo ragionamento a più fasiAltoLimitato
Codifica di repository complessiAltoIl modello di codice specializzato può competere
Classificazione di routineBassoForte vantaggio in termini di costi e latenza
Estrazione strutturataBasso/moderatoOttima conoscenza di schemi e validazione
Lavoro specialistico multilingueDipendente dalla linguaForte solo dopo un adattamento mirato
Sintesi di documenti lunghiAlto senza recuperoRAG può ridurre il divario
Elaborazione di documenti riservatiLa qualità delle nuvole potrebbe essere superiorePrivacy e controllo locali
Ragionamento scientificoAltoIl modello ottimizzato per il dominio può competere in modo ristretto
Automazione ad alta concorrenzaDipendente dalle infrastruttureI modelli più piccoli possono essere scalati in modo più economico

La scheda modello Gemini 3.1 Pro di Google riporta una valutazione su attività di ragionamento, multimodali, multilingue, agentiche e a lungo termine. Scheda modello Gemini 3.1 Pro – Google DeepMind – Febbraio/2026 — Scheda modello Gemini 3.1 Pro di Google DeepMind . Tali schede modello dimostrano che la capacità è multidimensionale. Non sostituiscono un esperimento indipendente in locale rispetto al cloud.

7.9.2 Controlli di quantizzazione

Un confronto locale valido dovrebbe testare almeno:

  • BF16 o FP16;
  • INT8;
  • INT4;
  • se documentato, selezionare il metodo a bit inferiori.

La penalità di quantizzazione è:

QP m,q,k = Punteggio m,riferimento,k − Punteggio m,q,k

Un modello a bit inferiore dovrebbe essere considerato economicamente superiore solo quando:

QAC m,q < QAC m,riferimento

E:

Punteggio m, q, k ≥ Punteggio minimo accettabile k

Un modello che diventa più economico ma non raggiunge la soglia minima di qualità richiesta per il compito non è un sostituto adeguato.


7.10 La divisione tra pubblicazioni scientifiche e ricerca

Gli istituti di ricerca con accesso all’IA aziendale possono fornire:

  • Acquisizione di documenti in blocco;
  • banche dati con licenza;
  • esecuzione sicura del codice;
  • set di dati privati;
  • modelli a lungo termine;
  • librerie di prompt condivise;
  • supporto alla valutazione;
  • risorse di calcolo locali dedicate;
  • Linee guida legali e sull’integrità della ricerca.

Un ricercatore indipendente potrebbe disporre solo di un abbonamento a un servizio per utenti privati ​​e di un computer personale. La differenza non riguarda solo la qualità del modello, ma anche i diritti sui dati, la concorrenza, la riproducibilità, l’archiviazione, la collaborazione e la possibilità di elaborare materiale sensibile.

Definire l’indice delle risorse di ricerca sull’IA:

RARI i = w 1 Compute + w 2 ModelQuality + w 3 DataAccess + w 4 ToolAccess + w 5 Support + w 6 UsageAllowance

Un modello di pubblicazione può essere stimato come segue:

Pubblicazioni i,t+1 = α + βRARI i,t + γPubblicazioniPrecedenti i,t + δFinanziamento i,t + μ campo + ε i,t

Le misure di citazione e di qualità dovrebbero essere analizzate separatamente per verificare se l’IA aumenta la quantità senza conferire validità.


7.11 Vantaggio cumulativo

7.11.1 Modello richiesto

t+1 = A t + αQ t − βC t

Dove:

  • t = vantaggio umano o istituzionale accumulato;
  • t = accesso all’IA corretto in base alla qualità;
  • t = vincoli di accesso e adattamento;
  • α = conversione dell’accesso all’IA in vantaggio;
  • β = danno causato dai vincoli.

Dopo n periodi:

n = A 0 + Σ t=0 n−1 [αQ t − βC t ]

La soglia di accesso necessaria per evitare semplicemente un calo del vantaggio relativo è:

* = βC t ÷ α

Se Q t < Q * , il vantaggio accumulato diminuisce rispetto al contesto competitivo.

7.11.2 Simulazione a due utenti

Assumere:

  • α = 0,8;
  • β = 0,5;
  • utente ad alto accesso: Q = 1,0 e C = 0,2;
  • utente vincolato: Q = 0,3 e C = 0,8;
  • entrambi iniziano con A 0 = 10.

Gli incrementi annuali sono:

ΔA alto = 0,8 × 1,0 − 0,5 × 0,2 = 0,70

ΔA vincolato = 0,8 × 0,3 − 0,5 × 0,8 = −0,16

Annovantaggio dell’elevata accessibilitàVantaggio dell’utente vincolatoSpacco
010.0010.000,00
110.709,840,86
211.409,681,72
312.109.522,58
412,809.363.44
513.509.204.30

Anche a parità di capacità iniziali, le persistenti differenze di accesso creano divergenze.

7.11.3 Meccanismo di feedback

In realtà, il vantaggio accumulato può finanziare l’accesso futuro:

t+1 = q 0 + λA t − φP t

Dove:

  • λ rappresenta il grado in cui il vantaggio migliora l’accesso futuro;
  • t è il prezzo effettivo;
  • φ indica la sensibilità al prezzo.

La sostituzione produce:

t+1 = A t + α[q 0 + λA t − φP t ] − βC t

t+1 = (1 + αl)A t + αq 0 − αfP t − βC t

Quando αλ è positivo, il vantaggio si moltiplica anziché accumularsi linearmente.


7.12 La trappola della povertà intellettuale

Si crea una trappola della povertà informativa quando un basso reddito o scarse risorse istituzionali comportano un accesso limitato all’intelligenza artificiale, un accesso limitato sopprime la produttività e le opportunità, e la riduzione delle opportunità impedisce di investire in un accesso migliore.

Il ciclo è:

Risorse scarse → Accesso di bassa qualità → Produttività inferiore → Reddito o finanziamenti inferiori → Risorse scarse

La condizione di trappola può essere formalizzata come segue:

Ritorno dall’accesso all’IA a basse risorse < Costo di un accesso adeguato

Mentre:

Ritorno dall’accesso all’IA ad alte risorse > Costo di un accesso adeguato

Ciò può verificarsi anche quando lo stesso prezzo nominale di abbonamento si applica a entrambi i gruppi perché:

  • il prezzo assorbe una quota maggiore del reddito;
  • Gli utenti meno abbienti dispongono di hardware meno potente;
  • La connettività è meno affidabile;
  • Il tempo libero per l’adattamento è limitato;
  • scuole e aziende forniscono meno supporto;
  • Gli utenti non sono in grado di sopportare i fallimenti sperimentali;
  • Le prestazioni nella lingua locale potrebbero essere inferiori;
  • L’accesso potrebbe essere limitato dai sistemi di pagamento o dalla disponibilità regionale.

7.12.1 Soglia di trappola

Supponiamo che il reddito si evolva come segue:

t+1 = Y t + θA t

e l’accesso può essere:

t = max[0, q − P ÷ Y t ]

Si verifica un equilibrio a basso reddito quando P ÷ Y t è sufficientemente grande da sopprimere Q, impedendo ad A e Y di aumentare. Un sussidio che riduce P, un’università che fornisce accesso condiviso o un modello specializzato a basso costo che aumenta q possono far salire l’utente al di sopra della soglia.


7.13 Gli interventi e la loro logica economica

InterventoMeccanismoRischio principale
Voucher per studenti sull’intelligenza artificialeRiduce il costo dell’abbonamentoVantaggi per il fornitore senza garantire la qualità
Accesso aziendale universitarioApprovvigionamento e gestione delle piscineBlocco istituzionale
Centri di calcolo pubbliciFornisce capacità a livello localeSottoutilizzo e manutenzione
Infrastruttura di ricerca cooperativacosti fissi delle azioniAssegnazione complessa e riservatezza
supporto modello a pesi apertiRiduce la dipendenza dai fornitorionere di competenze tecniche
Il dispositivo garantisceRiduce la barriera hardwareObsolescenza rapida
Valutazione multilingueMette in luce le lacune linguisticheIl benchmark potrebbe non rispecchiare l’utilizzo reale
programmi di alfabetizzazione sull’IAMotivi del coefficiente di conversione αLa formazione senza accesso continuativo ha scarso valore.
Crediti API per la ricercaSupporta la sperimentazione riproducibileI crediti scadono o favoriscono determinati fornitori
Instradamento basato sul modello di interesse pubblicoScegli il modello più economico e adeguatoRichiede una valutazione indipendente
Sistemi offline e a bassa larghezza di bandaRiduce le barriere di connettivitàLa capacità potrebbe rimanere al di sotto della frontiera
Sovvenzioni basate sui risultatiI fondi hanno dimostrato il valore della ricercaPuò svantaggiare il lavoro esplorativo

La politica ottimale non assegna a ogni utente il modello di frontiera più costoso per ogni attività. Garantisce invece l’accesso al sistema meno costoso che soddisfi la soglia di qualità dell’attività , prevedendo al contempo un incremento delle risorse verso la capacità di frontiera in caso di guasto dei sistemi più piccoli.


7.14 Progettazione della ricerca per la misurazione causale

7.14.1 Studio di accesso randomizzato

I partecipanti devono essere assegnati in modo casuale a:

  • nessuna intelligenza artificiale;
  • IA di livello gratuito;
  • Intelligenza artificiale a pagamento per i consumatori;
  • Intelligenza artificiale aziendale all’avanguardia.

Tutti i gruppi ricevono gli stessi compiti, le stesse finestre temporali e la stessa formazione iniziale, tranne nei casi in cui la formazione stessa faccia parte del trattamento. I risultati includono:

  • punteggio del test;
  • tempo di completamento;
  • ritenzione dopo quattro settimane;
  • tasso di errore;
  • trasferimento a nuovi compiti;
  • calibrazione della fiducia;
  • dipendenza;
  • costo;
  • energia.

L’effetto del trattamento è:

ATE = E[Y|Accesso = j] − E[Y|Accesso = 0]

7.14.2 Studio longitudinale

Un pannello longitudinale dovrebbe monitorare:

  • precedenti risultati;
  • status socioeconomico;
  • Cronologia degli accessi all’IA;
  • livello del modello;
  • utilizzo effettivo;
  • voti;
  • pubblicazioni;
  • occupazione;
  • reddito;
  • imprenditorialità;
  • competenze.

Una specifica a effetti fissi è:

i,t = βQAA i,t + γX i,t + μ i + τ t + ε i,t

Gli effetti fissi individuali μ i controllano le differenze stabili non osservate.

7.14.3 Esperimenti naturali istituzionali

Possibili quasi-esperimenti includono:

  • introduzione graduale delle licenze universitarie;
  • programmi temporanei di credito gratuito;
  • cambiamenti nella connettività regionale;
  • sovvenzioni per attrezzature da laboratorio;
  • modifiche al livello di servizio;
  • ritiro del modello;
  • aumenti di prezzo.

Uno stimatore differenza-in-differenze è:

Effetto = [Y trattato,dopo − Y trattato,prima ] − [Y controllo,dopo − Y controllo,prima ]

È necessario testare le tendenze parallele del pretrattamento.


7.15 Scenari quinquennali, 2027-2031

ScenarioSviluppo dell’accessoEffetti educativi e sociali
Ampia diffusioneModelli di piccole dimensioni performanti e accesso istituzionale si espandonoDividere si restringe per le attività di routine
Intelligenza a livelliI modelli liberi migliorano, ma i modelli di frontiera avanzano più velocemente.L’accesso nominale si amplia, mentre il divario di competenze persiste.
Aumento dell’abbonamentoL’accesso di fascia alta diventa più costoso e a consumo.Studenti e ricercatori indipendenti perdono l’accesso relativo
Risposta delle infrastrutture pubblicheUniversità e governi mettono a disposizione capacità condiviseIl divario geografico si riduce laddove le istituzioni sono efficaci.
Frammentazione sovranaIl modello e l’accesso all’hardware variano a seconda della regione.La nazionalità e la posizione geografica diventano fattori determinanti per le capacità.
Concentrazione dell’agenteGli agenti avanzati richiedono dati e strumenti aziendaliL’appartenenza a un’organizzazione prevale sul talento individuale.

Lo scenario centrale è quello di un’intelligenza stratificata . L’IA di base diventa onnipresente, ma il ragionamento di livello avanzato, l’analisi a lungo termine, l’integrazione di dati privati, il lavoro attivo e continuativo e l’utilizzo intensivo rimangono concentrati tra individui e istituzioni facoltose. La divisione che ne deriva è meno visibile rispetto all’esclusione totale, perché sia ​​gli utenti ricchi che quelli poveri possono affermare di “avere accesso all’IA”, sebbene la qualità e la capacità produttiva di tale accesso differiscano sostanzialmente.


7.16 Ipotesi falsificabili

IpotesiProposizione verificabileDocumentazione richiesta
H7.1L’accesso a pagamento all’IA migliora il completamento delle attività rispetto alla mancanza di accesso.Studio randomizzato sugli utenti
H7.2L’accesso Frontier produce maggiori vantaggi rispetto all’accesso gratuito per le attività complesseEsperimento multi-trattamento
H7.3I modelli locali di dimensioni ridotte hanno prestazioni inferiori rispetto ai modelli di frontiera in compiti complessi generali.benchmark controllato
H7.4I modelli di piccole dimensioni specializzati possono eguagliare i sistemi di frontiera in compiti limitatiStudio dei costi ponderati per la qualità, specifico per l’attività
H7.5L’accesso all’intelligenza artificiale aumenta la produzione di ricerca.Gruppo di ricercatori longitudinali
H7.6L’accesso all’intelligenza artificiale aumenta la quantità delle pubblicazioni più che la loro qualità.Analisi di pubblicazioni, citazioni e replicazioni
H7.7Le lacune nelle competenze multilingue riducono i progressi al di fuori delle lingue dominanti.Esperimento multilingue parallelo
H7.8L’accessibilità economica dell’IA è correlata negativamente al reddito nazionale.Panel AAI a livello nazionale
H7.9Gli effetti dell’accesso si accumulano nel tempoModello longitudinale del vantaggio cumulativo
H7.10L’accesso istituzionale media l’effetto del reddito personaleModello multilivello per studenti e ricercatori
H7.11I prezzi elevati dell’IA riducono l’ingresso di impreseStudio regionale o di coorte
H7.12L’accesso gratuito non elimina il divario di capacità di frontieraConfronto dell’accesso corretto per la qualità

7.17 Risultati finali

  1. L’accesso all’IA non è binario. Nessun accesso, accesso gratuito, accesso a pagamento per i consumatori e accesso istituzionale di frontiera rappresentano ambienti produttivi sostanzialmente diversi.
  2. L’accessibilità economica deve includere hardware, connettività, spazio di archiviazione e utilizzo. Il solo prezzo dell’abbonamento sottovaluta notevolmente il costo di un accesso adeguato.
  3. Le possibilità economiche degli studenti sono strutturalmente peggiori rispetto a quelle delle famiglie. Gli studenti spesso dispongono di un reddito disponibile di gran lunga inferiore alla media nazionale.
  4. Una postazione di lavoro dotata di intelligenza artificiale può costare meno di un salario mensile medio in un paese ad alto reddito, ma molti mesi di stipendio nei mercati a basso reddito. Tariffe e scarsità locale possono ampliare ulteriormente la differenza.
  5. I modelli locali di dimensioni ridotte non rappresentano sempre uno svantaggio. Possono essere economicamente più vantaggiosi per attività circoscritte, specializzate e che richiedono la massima riservatezza.
  6. I modelli di frontiera mantengono probabili vantaggi nel ragionamento innovativo, nella codifica complessa, nella sintesi a lungo termine e nel lavoro scientifico multidisciplinare.
  7. Il conteggio dei parametri non è una misura di utilità adeguata. Architettura, post-addestramento, quantizzazione, strumenti, recupero, contesto e progettazione del compito devono essere controllati.
  8. Il costo di riferimento deve essere diviso per i carichi di lavoro completati con successo, non per i token generati. Un output errato a basso costo non è un’informazione accessibile.
  9. L’intelligenza artificiale può migliorare l’accesso al linguaggio preservando al contempo le disparità qualitative latenti. La fluidità non garantisce un ragionamento equivalente o un’affidabilità fattuale.
  10. L’affiliazione istituzionale sta diventando un fattore determinante per l’efficacia della ricerca. I ricercatori che lavorano all’interno di università o aziende ricche possono accedere a dati, strumenti, risorse di calcolo e supporto non disponibili ai colleghi indipendenti.
  11. Il vantaggio cumulativo è matematicamente plausibile. Le differenze persistenti nell’accesso, ponderato in base alla qualità, generano divari sempre maggiori in termini di capitale umano e istituzioni, anche a parità di capacità di partenza.
  12. È possibile che si instauri una trappola della povertà informativa che si autoalimenta. La scarsità di risorse riduce l’accesso; un accesso limitato riduce la produttività e le opportunità; la riduzione delle opportunità impedisce investimenti futuri.
  13. L’accesso universale e gratuito potrebbe non eliminare il divario. Se i sistemi di frontiera migliorano più rapidamente dei sistemi liberi, l’inclusione nominale può coesistere con una crescente disuguaglianza di capacità.
  14. L’obiettivo politico corretto è un accesso adeguato e specifico per le attività. Il sostegno pubblico dovrebbe garantire il sistema meno costoso che soddisfi soglie di qualità validate, con un eventuale ricorso alle capacità più avanzate laddove necessario.
  15. Tra il 2027 e il 2031, la mobilità sociale potrebbe dipendere sempre più non solo dall’accesso all’intelligenza artificiale, ma anche da un’intelligenza artificiale sufficientemente performante, sostenibile, verificabile ed economicamente sostenibile.

CAPITOLO 8 — Paesi, sviluppo e disuguaglianza globale nell’IA

8.1 Ambito di applicazione, finalità e limiti probatori

La disuguaglianza globale nell’ambito dell’IA non può essere misurata unicamente in base al numero di account di chatbot, alle strategie nazionali per l’IA o ai data center. Un accesso effettivo dipende da un sistema interconnesso che comprende il potere d’acquisto delle famiglie, l’accessibilità economica dell’hardware, l’elettricità, la banda larga, le infrastrutture cloud, i semiconduttori avanzati, la disponibilità di valuta estera, le competenze digitali, la conoscenza delle lingue locali, gli istituti di ricerca, la regolamentazione e il consenso geopolitico per l’acquisizione di tecnologie. Un Paese può disporre di una solida connettività mobile ma di scarse risorse di calcolo per la ricerca; di elettricità a basso costo ma di una rete inaffidabile; di accesso al cloud ma di una regione nazionale inesistente; di ingegneri competenti ma di gravi limitazioni in termini di valuta estera; o di infrastrutture estese i cui benefici rimangono concentrati nelle mani di una piccola élite urbana. Un indice multidimensionale deve cogliere queste complementarità senza nasconderle all’interno di una classifica opaca.

Il quadro di riferimento della Banca Mondiale per il 2025 individua quattro pilastri per lo sviluppo dell’IA: connettività, potenza di calcolo, contesto e competenze . Il rapporto conclude che i paesi ad alto reddito continuano a dominare l’innovazione nell’IA, le infrastrutture di calcolo e i finanziamenti per le startup, mentre le economie a basso e medio reddito si trovano ad affrontare persistenti carenze in termini di connettività, dati localmente rilevanti, competenze e potenza di calcolo. Il rapporto identifica inoltre la “Small AI” – sistemi a basso costo e specifici per determinate attività, in grado di funzionare su dispositivi comuni – come una potenziale via per una maggiore diffusione. Digital Progress and Trends Report 2025: Strengthening AI Foundations – World Bank – November/2025 — World Bank AI foundations report .

Questo capitolo elabora un Indice Globale di Accesso all’IA (GAI) e lo applica a un set pilota di 25 casi nazionali e regionali. I punteggi numerici sono stime analitiche trasparenti, elaborate per l’analisi di scenario; non rappresentano una classifica ufficiale della Banca Mondiale, dell’ITU o dei governi nazionali. L’indice deve essere ricalcolato a partire da un set di dati paese-anno consolidato prima della pubblicazione come tabella statistica definitiva. Tale precisazione è necessaria perché diverse variabili richieste, in particolare la qualità dei modelli in lingua locale, la latenza verso la capacità cloud per l’IA, la disponibilità di risorse di calcolo per la ricerca e i prezzi di mercato dell’hardware, non sono ancora disponibili attraverso un unico set di dati internazionale armonizzato.


8.2 Connettività globale e parametri di riferimento per il calcolo

Nel 2025, quasi tre quarti della popolazione mondiale era online, ma circa 2,2 miliardi di persone rimanevano offline. L’utilizzo di Internet ha raggiunto il 94% nelle economie ad alto reddito, ma solo il 23% in quelle a basso reddito. Circa il 96% delle persone offline viveva in paesi a basso e medio reddito. L’utilizzo di Internet nelle aree urbane ha raggiunto l’85%, rispetto al 58% nelle aree rurali, mentre un utente tipico in un paese ad alto reddito ha generato quasi otto volte più dati mobili rispetto a un utente in un’economia a basso reddito. (Measuring Digital Development: Facts and Figures 2025 – International Telecommunication Union – November/2025 — ITU Facts and Figures 2025 ).

Queste differenze sono importanti perché una copertura nominale non garantisce una connettività AI utilizzabile. L’utilizzo dell’IA può richiedere:

  • un servizio continuativo anziché intermittente;
  • latenza sufficientemente bassa;
  • capacità di caricamento adeguata per documenti e immagini;
  • volume di dati a prezzi accessibili;
  • accesso sicuro;
  • dispositivi compatibili;
  • meccanismi di pagamento affidabili;
  • Servizi cloud disponibili nella giurisdizione;
  • elettricità continua.

Il concetto di connettività universale e significativa dell’ITU include qualità, disponibilità, accessibilità economica, dispositivi, competenze e sicurezza. Rapporto sulla connettività globale 2025 – Unione internazionale delle telecomunicazioni – 2025 — Rapporto sulla connettività globale dell’ITU 2025. Questo è più appropriato per l’analisi dell’accesso tramite intelligenza artificiale rispetto a una variabile binaria connesso/non connesso.


8.3 Confronto tra paesi e regioni

8.3.1 Confronto strutturale

Paese o gruppoPunti di forza principaliVincoli principaliPinza strategica
Stati UnitiFornitori di frontiera, cloud hyperscale, acceleratori, capitali, universitàdisuguaglianze regionali, elevata concentrazione di imprese, colli di bottiglia energeticiProduttore di frontiera e giurisdizione dominante sulla piattaforma
CanadaIstituti di ricerca, accesso al cloud, competenze, elettricitàMercato interno più piccolo e dipendenza da piattaforme estereUtente avanzato con competenze di ricerca specifiche
Unione EuropeaBase industriale, ricerca, regolamentazione, molteplici regioni cloudFrammentazione, proprietà limitata delle piattaforme di frontiera, costo energeticoMercato di grandi dimensioni e regolamentato, con sovranità computazionale incompleta.
Regno UnitoVantaggio significativo in termini di ricerca, finanza, accesso al cloud e competenze linguistiche.Dipendenza da hardware importato e fornitori esteriCentro di servizi e ricerca all’avanguardia
CinaMercato di grandi dimensioni, centri dati, modelli nazionali e politica industrialeControlli sulle esportazioni, limitazioni hardware all’avanguardiaEcosistema parallelo di notevole portata
GiapponeReddito elevato, industria avanzata, fornitura stabile di energia elettrica e ricerca.Invecchiamento della forza lavoro, dipendenza da acceleranti importatiAdozione avanzata e potenza dell’IA industriale
Corea del SudSemiconduttori, banda larga, cloud, competenze digitaliAcceleratori di frontiera importati ed esposizione geopoliticaProduttore di tecnologie ad alta prontezza operativa
IsraeleRicerca avanzata, sicurezza informatica, startup e investimenti nel cloud.Mercato di piccole dimensioni, rischio geopolitico e dipendenza dalle importazioniEcosistema di specialisti ad alta capacità
IndiaAmpia forza lavoro tecnica, regioni cloud, settore del software e scalabilitàDisuguaglianze di reddito, accesso all’elettricità e connettività nelle aree rurali.Adotta rapidamente con un’ampia divisione interna
BrasileAmpio mercato, regione cloud, ricerca e scalabilità in lingua portogheseCosto dell’hardware, tassazione, disuguaglianza di reddito e rischio valutarioResponsabile regionale con vincoli di budget
MessicoIntegrazione della produzione, vicinanza agli Stati Uniti, accesso al cloud in continua espansioneDisuguaglianza tra ricerca, calcolo e competenzeAdottatore di IA in paesi vicini
CroaziaAdesione all’UE, connettività e integrazione normativaMercato di piccole dimensioni e capacità di calcolo limitate per la ricerca.Adottante balcanico con maggiore predisposizione
Serbiaforza lavoro specializzata e connettività regionalePosizione extra-UE, base di calcolo più piccola ed esposizione valutariaPolo regionale emergente
AlbaniaMigliorare la pubblica amministrazione digitale e la connettivitàCapacità di ricerca e risorse finanziarie limitateAdottante emergente orientato ai servizi
Bosnia ed ErzegovinaDiaspora istruita e accesso regionaleFrammentazione istituzionale e investimenti limitatiAdottante con capacità limitata
MaroccoPotenziale di investimento nel cloud e nei data center, forza lavoro multilingueAccessibilità economica dell’hardware e scala della ricercaPiattaforma leader di servizi in Nord Africa
TunisiaFormazione tecnica e potenziale delle zone costiereVincoli di finanziamento, valuta e infrastruttureRicca di talenti ma con capitali limitati
EgittoAmpio mercato, cavi, domanda di lingua arabaPressione su reddito, valuta e infrastrutturePotenziale piattaforma regionale con barriere di accessibilità economica.
SudafricaLa più solida presenza e base di ricerca nel settore del cloud computing nell’Africa subsahariana.affidabilità dell’energia elettrica, disuguaglianza e costi elevati dell’hardwareLeader continentale nel settore delle infrastrutture con divisioni interne
KenyaServizi digitali, imprenditorialità e connettività regionaleVincoli relativi a risorse di calcolo, elettricità e reddito per la ricercaPolo dei servizi digitali dell’Africa orientale
NigeriaPopolazione numerosa e spirito imprenditorialeAffidabilità dell’energia elettrica, valuta estera e infrastruttureAmpia base di utenti con gravi limitazioni di accesso.
GhanaStabilità istituzionale e potenziale dei servizi digitali regionaliBase di calcolo ridotta e convenienzaUtente emergente dei servizi pubblici
RuandaOrientamento al governo digitale e coordinamento delle politicheMercato di piccole dimensioni e infrastrutture importate.Istituzionalmente agile, con risorse di calcolo limitate
EtiopiaAmpia popolazione e potenziale di sviluppoLimiti di connettività, elettricità, valuta estera e competenzeAmbiente di accesso all’IA in fase iniziale
BangladeshAmpia forza lavoro e potenziale nei servizi digitaliLimitazioni in termini di energia, accessibilità economica dell’hardware e risorse di calcolo per la ricerca.Adottante su larga scala con infrastrutture limitate

8.4 Specifiche dell’indice globale di accesso all’IA

8.4.1 Equazione centrale

GAI i = Σ j=1 m w j z ij

Dove:

  • GAI i è l’indice globale di accesso all’intelligenza artificiale per il paese i;
  • ij è il valore normalizzato dell’indicatore j;
  • j è il peso dell’indicatore;
  • Σw j = 1.

L’indice è scalato da 0 a 100:

GAI i,100 = 100 × GAI i

Un punteggio elevato indica un maggiore accesso a prezzi accessibili, una migliore predisposizione delle infrastrutture e maggiori capacità.


8.2 Architettura degli indicatori

IndicatoreSimboloMisura empirica preferitaDirezione
reddito familiareINCReddito disponibile mediano pro capite, corretto per la parità di potere d’acquistoPositivo
Convenienza dell’hardwareHWACosto della postazione di lavoro di riferimento diviso per il reddito medianoNegativo
dazi di importazioneIO HOTariffa effettiva e onere fiscale sull’hardware di riferimentoNegativo
affidabilità dell’elettricitàRELFrequenza/durata delle interruzioni o misura di accesso affidabilePositivo
costo dell’elettricitàEPCPrezzo commerciale/domestico per kWhNegativo
Disponibilità della banda largaBBAmisura di connettività significativa fissa/mobilePositivo
Latenza del data centerANNILatenza mediana verso la regione cloud più vicina dotata di intelligenza artificialeNegativo
Disponibilità della regione nuvolosaCRANumero e capacità delle regioni hyperscale nazionali/vicinePositivo
Qualità della lingua localeLLQParità di qualità del modello riproducibile tra le lingue nazionaliPositivo
Competenze digitaliDSKLivello di competenza ICT avanzata o parametro equivalente armonizzatoPositivo
Calcolo di ricercaRCOCapacità di accelerazione della ricerca pubblica ponderata per la qualitàPositivo
Accesso in valuta esteraFXAConvertibilità e capacità di finanziare le importazioni tecnologichePositivo
Esposizione a sanzioni/esportazioniVEDERERestrizioni legali e pratiche sull’hardware/servizi avanzatiNegativo
Capacità del data center localeDCCCapacità operativa IT pro capite o PILPositivo
contesto normativoREGPrevedibilità, governance dei dati ed equilibrio della concorrenzaPositivo

L’ITU rileva che i dati comparabili sulle competenze ICT rimangono scarsi: solo 90 paesi hanno presentato dati pertinenti dal 2020 e solo circa 40 hanno fornito informazioni sul livello di competenza ampiamente comparabili. Indicatori ICT per gli Obiettivi di Sviluppo Sostenibile – Unione Internazionale delle Telecomunicazioni – 2026 – Limitazioni dei dati ICT sulle competenze . I dati mancanti devono pertanto essere resi noti e non sostituiti silenziosamente da ipotesi soggettive.


8.5 Normalizzazione

8.5.1 Normalizzazione min-max

Per un indicatore positivo:

ij = [x ij − min(x j )] ÷ [max(x j ) − min(x j )]

Per un indicatore negativo:

ij = [max(x j ) − x ij ] ÷ [max(x j ) − min(x j )]

La normalizzazione min-max è intuitiva ma sensibile ai valori anomali.

8.5.2 Min-max winsorizzato

I valori inferiori al quinto percentile vengono sostituiti con il valore del quinto percentile; quelli superiori al novantacinquesimo percentile vengono sostituiti con il valore del novantacinquesimo percentile:

ij W = min[max(x ij , P 5,j ), P 95, j

Il calcolo min-max viene quindi applicato a x ij W .

8.5.3 Normalizzazione del punteggio Z

ij = [x ij − μ j ] ÷ σ j

I punteggi Z preservano la distanza dalla media, ma possono produrre componenti di indice negative. Una trasformazione normale cumulativa può mapparle in valori compresi tra 0 e 1.

8.5.4 Normalizzazione del rango

ij = [rango(x ij ) − 1] ÷ (n − 1)

La normalizzazione del rango riduce l’influenza dei valori anomali ma elimina le differenze cardinali. Un paese che si trova di poco sopra un altro riceve lo stesso intervallo di rango di un paese separato da un divario assoluto molto ampio.


8.6 Sistemi di ponderazione

8.6.1 Pesi uguali

Con 15 indicatori:

j = 1 ÷ 15 = 0,0667

L’assegnazione di pesi uguali è trasparente, ma implica che ogni indicatore abbia la stessa importanza concettuale.

8.6.2 Pesi esperti

IndicatorePeso esperto
reddito familiare7%
Convenienza dell’hardware9%
dazi di importazione4%
affidabilità dell’elettricità8%
costo dell’elettricità5%
Disponibilità della banda larga8%
Latenza del data center5%
Disponibilità della regione nuvolosa8%
Qualità della lingua locale7%
Competenze digitali8%
Calcolo di ricerca10%
Accesso in valuta estera4%
Esposizione a sanzioni/esportazioni7%
Capacità del data center locale7%
contesto normativo3%
Totale100%

La maggiore importanza attribuita all’hardware, al calcolo per la ricerca, alla banda larga e all’affidabilità dell’energia elettrica riflette il loro ruolo di elementi complementari e vincolanti. La regolamentazione riceve un peso diretto inferiore perché la qualità della regolamentazione non dovrebbe compensare aritmeticamente l’assenza di energia elettrica o di risorse di calcolo.

8.6.3 Pesi derivati ​​dalle componenti principali

I pesi PCA dovrebbero essere derivati ​​dalle prime componenti che spiegano una quota predeterminata, ad esempio il 70%, della varianza standardizzata. Se il caricamento a jk rappresenta l’indicatore j sulla componente k e λ k il suo autovalore:

j,PCA = Σ k=1 K |a jk |λ k ÷ Σ j=1 m Σ k=1 K |a jk |λ k

L’analisi delle componenti principali (PCA) identifica la covarianza empirica, non l’importanza morale o evolutiva. Può assegnare un peso basso a una variabile essenziale se tale variabile presenta una scarsa varianza tra i paesi.


8.7 Protocollo per dati mancanti

Un Paese non dovrebbe ricevere un punteggio favorevole per mancanza di dati. Il protocollo dovrebbe essere:

  1. Segnala l’indicatore mancante.
  2. Utilizzare l’imputazione multipla solo laddove le relazioni tra i predittori siano credibili.
  3. Calcolare un intervallo di incertezza per i set di dati imputati.
  4. Escludi i paesi che non dispongono di più del 30% degli indicatori ponderati.
  5. Pubblica un punteggio di completezza:

Completezza i = Σw j I(x ij osservato)

  1. Rapporto:

GAI regolato,i = GAI i × Completezza κ

dove κ è un parametro di penalità reso pubblico.

Sia i punteggi non penalizzati che quelli corretti dovrebbero essere pubblicati.


8.8 Indice pilota provvisorio

I seguenti punteggi preliminari utilizzano il quadro di riferimento basato sul parere degli esperti e una scala da 0 a 100. Rappresentano una sintesi analitica derivante dalle evidenze strutturali ufficiali esaminate in questo rapporto, non un insieme di dati statistici definitivi e immutabili.

Caso nazionale o regionaleGAI provvisorioLivello di accessoVincolo di legame principale
Stati Uniti89FrontieraAccessibilità economica interna e disuguaglianza geografica
Corea del Sud84AvanzatoEsposizione importata agli acceleratori di frontiera
Israele83AvanzatoScala ed esposizione geopolitica
Canada82AvanzatoDipendenza da piattaforme straniere
Regno Unito82AvanzatoDipendenza da hardware importato e dalla piattaforma
Unione europea aggregato80AvanzatoFrammentazione interna e carenza di fornitori di servizi sanitari nelle zone di frontiera
Giappone80AvanzatoDipendenza da acceleratori importati
Cina78Avanzato/paralleloControlli sulle esportazioni e hardware all’avanguardia
India58scala emergenteDisuguaglianza di reddito e di infrastrutture interne
Croazia58Emergente/avanzatoPiccola base di calcolo per la ricerca
Brasile55scala emergenteAccessibilità economica dell’hardware e tassazione
Sudafrica52Polo regionale emergenteAffidabilità e disuguaglianza nell’erogazione di energia elettrica
Messico51EmergentiRicerca, calcolo e dispersione delle competenze
Marocco50Polo regionale emergenteScala della ricerca e accessibilità economica dell’hardware
Serbia49Emergentiprofondità delle nuvole, dimensioni del mercato ed esposizione valutaria
Egitto45Scala vincolataPressione su valuta, reddito e infrastrutture
Tunisia43Polo di talenti con risorse limitateFinanziamenti e accesso alle valute estere
Kenya43Polo digitale emergenteRicerca informatica e accessibilità economica per le famiglie
Albania42EmergentiMercato di piccole dimensioni e capacità di calcolo limitate
Ruanda40emergente guidato dalle politicheScala e infrastrutture importate
Bosnia ed Erzegovina38CostrettoFrammentazione istituzionale e investimenti
Ghana38Emergenza vincolataCalcolo e accessibilità economica
Nigeria35Limitato ad alto potenzialeElettricità, valuta e infrastrutture
Bangladesh32Scala vincolataCalcolo, energia e accessibilità economica
Etiopia22Fortemente vincolatoConnettività, elettricità e valuta estera

Il punteggio aggregato dell’UE nasconde notevoli differenze interne. I Paesi con regioni cloud nazionali, redditi elevati e solidi sistemi di ricerca otterranno punteggi significativamente superiori rispetto agli Stati membri a basso reddito con ecosistemi di calcolo più piccoli. Lo stesso vale per Stati Uniti, Cina, India, Brasile, Sudafrica e Nigeria: le medie nazionali celano profonde divergenze tra aree urbane e rurali e in base al reddito.


8.9 Analisi di sensibilità

8.9.1 Effetti di ponderazione alternativi

gruppo di paesiPesi ugualiPesi da espertiEffetto PCA previsto
Stati Uniti, Canada, Regno UnitoRimanere altoRimanere altoLa forte componente di entrate derivanti dalle infrastrutture mantiene la posizione in classifica.
aggregato UEAltoAltoLa componente regolatoria potrebbe avere meno importanza nell’ambito del PCA.
CinaAltoModeratamente ridotto dall’esposizione alle esportazioniLa scala industriale potrebbe migliorare la posizione in classifica dell’analisi delle componenti principali (PCA).
Corea del Sud e GiapponeAltoAltoRafforzamento della capacità di semiconduttori e connettività
IsraeleAltoAltoUn mercato di piccole dimensioni può ridurre il punteggio PCA basato sulla scala
IndiaMezzoMezzoLa diffusione digitale fa salire di livello; il reddito la fa scendere.
Brasile e MessicoMezzoMezzoCloud e scala di mercato compensano l’accessibilità economica
BalcaniMedio/inferioreAltamente specifico per ogni paeseL’appartenenza all’UE e la connettività sono fattori distintivi
Nord Africamedio-bassomedio-bassoValuta e calcolo di ricerca riducono il punteggio degli esperti
Africa subsaharianaInferioreInferioreLa connettività e la covarianza del reddito rafforzano la penalizzazione PCA

8.9.2 Standard di robustezza del rango

Per ciascun paese:

RankRange i = [min Rango i,s , max Rango i,s ]

dove s copre:

  • pesi uguali;
  • pesi esperti;
  • Pesi PCA;
  • min-max;
  • min-max winsorizzato;
  • punteggio z;
  • normalizzazione del rango;
  • trattamenti alternativi per i dati mancanti.

Un Paese dovrebbe essere assegnato a una categoria di sicurezza elevata solo se mantiene tale categoria in almeno il 75% dei parametri di valutazione.

8.9.3 Sensibilità di Monte Carlo

I pesi possono essere estratti da una distribuzione di Dirichlet centrata sui pesi degli esperti:

(b) ∼ Dirichlet(κw esperto )

Per ciascuna delle B simulazioni:

GAI (b) = Σw (b) z ij

Il rapporto dovrebbe essere pubblicato:

  • punteggio mediano;
  • quinto e novantacinquesimo percentile;
  • probabilità di appartenenza a ciascun livello;
  • probabilità di superare in classifica i pari selezionati.

8.10 Misurazione della disuguaglianza

8.10.1 Coefficiente di Gini

Per accedere ai valori x i :

G = [Σ i=1 n Σ j=1 n |x i − x j |] ÷ [2n 2 x̄]

Utilizzando i 25 punteggi GAI provvisori:

  • n = 25;
  • GAI medio = 56,36;
  • Coefficiente di Gini = 0,193.

Il valore indica una dispersione sostanziale, ma non estrema, tra le medie dei paesi. Sottostima la disuguaglianza perché:

  • Le medie nazionali attribuiscono lo stesso peso all’Etiopia e agli Stati Uniti, anziché alla popolazione;
  • La disuguaglianza interna al paese viene omessa;
  • un punteggio pari a zero è limitato;
  • La qualità dell’accesso può avere rendimenti economici non lineari.

8.10.2 Indice delle parti

L’indice T di Theil è:

T = (1 ÷ n)Σ i=1 n (x i ÷ x̄)ln(x i ÷ x̄)

Per la distribuzione provvisoria dei punteggi:

T = 0,0597

L’indice di Theil è scomponibile:

T = T tra + T all’interno

La suddivisione dei casi pilota in gruppi avanzati, emergenti e con vincoli produce:

ComponenteIl contributo diCondividere
disuguaglianza tra gruppi0,054691,4%
Disuguaglianza all’interno del gruppo0,00518,6%
Totale0,0597100%

Questo risultato riflette il raggruppamento pilota costruito e non dovrebbe essere generalizzato alla popolazione mondiale. Dimostra tuttavia che le differenze tra i livelli di sviluppo dominano questa distribuzione media per paese a scopo illustrativo.

8.10.3 Rapporti percentili

MisuraValore pilota
P90/P102.28
P80/P202.03
Massimo/minimo4.05

Il punteggio massimo per un pilota, 89, è leggermente superiore a quattro volte il punteggio minimo, 22.

8.10.4 Rapporto Palma

L’indice di Palma convenzionale è dato dalla quota detenuta dal 10% più ricco della popolazione divisa per quella detenuta dal 40% più povero:

Palma = Quota top10 ÷ Quota bottom40

Applicato meccanicamente alla distribuzione dei punteggi dei paesi con uguale ponderazione, il rapporto Palma pilota è approssimativamente 0,57. Un valore inferiore a uno è possibile perché il 40% inferiore contiene quattro volte più osservazioni di paesi rispetto al 10% superiore, mentre i punteggi GAI sono limitati e molto meno concentrati rispetto al reddito. Per l’analisi dell’IA, un rapporto Palma ponderato per la popolazione e un rapporto Palma ponderato per la capacità di calcolo sarebbero più informativi.


8.11 Ponderazione della popolazione e disuguaglianza all’interno del paese

Un indice a livello nazionale può nascondere più disuguaglianze di quante ne riveli. L’accesso ponderato per la popolazione dovrebbe utilizzare:

popolazione x̄ = ΣP i x i ÷ ΣP i

All’interno di un paese, l’accesso può essere modellato in base al decile di reddito familiare, alla regione, al genere, al grado di ruralità, al livello di istruzione e all’affiliazione istituzionale:

GAI i,h = f(Reddito h , Dispositivo h , Connettività h , Competenze h , Accesso istituzionale h )

Il punteggio nazionale è:

GAI i = Σ h=1 H p h GAI i,h

Una media nazionale elevata può coesistere con una grave esclusione tra le famiglie rurali, i lavoratori informali, le comunità di lingua minoritaria e le istituzioni sottofinanziate.


8.12 Geografia delle nuvole e disuguaglianza di latenza

La geografia del cloud è importante perché le regioni locali possono ridurre la latenza, supportare la residenza dei dati, migliorare la disponibilità e ridurre la dipendenza dalla larghezza di banda internazionale. L’impronta globale rimane geograficamente concentrata.

AWS ha segnalato 123 zone di disponibilità in 39 regioni geografiche, con regioni aggiuntive in programma. Infrastruttura globale AWS – Amazon Web Services – agosto 2026 — Infrastruttura globale AWS . Microsoft ha segnalato più di 80 regioni Azure e più di 500 data center nella sua pagina attuale sull’infrastruttura globale. Infrastruttura globale Azure – Microsoft – agosto 2026 — Infrastruttura globale Microsoft Azure . Google Cloud ha segnalato 43 regioni e 130 zone in sei continenti. Posizioni globali: regioni e zone – Google Cloud – agosto 2026 — Posizioni globali di Google Cloud .

Una regione nazionale non dovrebbe essere codificata semplicemente come tale. L’indicatore della regione cloud dovrebbe misurare:

CRA i = Disponibilità × Profondità del servizio AI × Disponibilità dell’acceleratore × Ridondanza × Residenza

Una regione priva di acceleratori di frontiera o del servizio di intelligenza artificiale gestito necessario non è equivalente a una regione statunitense completamente attrezzata.

La latenza dovrebbe essere misurata tramite test attivi ripetuti:

LAT i = RTT mediano dai nodi della popolazione rappresentativa al più vicino endpoint AI idoneo

I requisiti di ammissibilità devono includere:

  • disponibilità del modello;
  • accesso legale;
  • Conformità in materia di residenza dei dati;
  • capacità sufficiente;
  • disponibilità di pagamento.

8.13 Controlli sulle esportazioni e accesso geopolitico

L’accesso al calcolo avanzato è in parte una variabile legale e geopolitica. I controlli statunitensi si applicano a specifici semiconduttori per il calcolo avanzato, apparecchiature per la produzione di semiconduttori, memorie ad alta larghezza di banda ed entità e destinazioni associate. Il Dipartimento del Commercio rafforza le restrizioni sui semiconduttori per il calcolo avanzato e sulle apparecchiature per la produzione di semiconduttori – Bureau of Industry and Security – dicembre 2024 — Controlli sui semiconduttori avanzati del BIS statunitense .

Nel gennaio 2026, il BIS è passato a una revisione caso per caso per le esportazioni verso la Cina di semiconduttori di classe H200, MI325X e simili, soggette a determinate condizioni. Dipartimento del Commercio rivede la politica di revisione delle licenze per i semiconduttori esportati in Cina – Bureau of Industry and Security – gennaio 2026 — Politica di licenza per i semiconduttori in Cina del BIS statunitense .

L’indicatore sanzioni/esportazioni dovrebbe distinguere:

Componente del punteggioDomanda
ammissibilità legaleIl Paese può importare legalmente l’hardware?
Idoneità dell’entitàLe aziende principali o le università sono soggette a restrizioni?
Probabilità di licenzaLe licenze vengono approvate di routine, condizionate o negate in via presuntiva?
sostituibilità delle nuvoleÈ possibile accedere da remoto a una capacità equivalente?
Accesso ai pagamentiI clienti possono pagare legalmente e concretamente?
Rischio di deviazioneLe preoccupazioni relative alla conformità scoraggiano i fornitori?
Alternativa domesticaÈ possibile sostituire la tecnologia locale?

La Cina si differenzia fondamentalmente da un’economia a basso reddito soggetta a sanzioni: possiede un ampio ecosistema industriale, di cloud e di modelli interni, in grado di effettuare una sostituzione parziale. Non si dovrebbe applicare la stessa penalità numerica senza una compensazione basata sulle capacità interne.


8.14 Disuguaglianza nell’accesso all’elettricità

La predisposizione all’intelligenza artificiale dipende sia dall’accesso all’elettricità che dalla sua qualità:

Prontezza energetica i = Accesso × Affidabilità × Capacità × Convenienza × Espansibilità

Un Paese potrebbe dichiarare un accesso quasi universale all’elettricità pur subendo interruzioni che rendono inaffidabile l’inferenza locale continua. Un altro potrebbe offrire tariffe economiche ma non disporre di capacità di generazione o di rete sufficienti per nuovi data center. Un terzo Paese potrebbe avere un’elettricità affidabile, ma il cui prezzo rende l’informatica nazionale non competitiva.

Per l’IA locale:

Costo dell’energia = P IT × 8.760 × u × PUE × p elettricità

Per le infrastrutture nazionali di intelligenza artificiale, i tempi di connessione e la disponibilità di energia elettrica stabile potrebbero essere più importanti della tariffa media.


8.15 Rappresentazione della lingua e della cultura locale

8.15.1 Indicatore di qualità linguistica

La qualità del modello in lingua locale dovrebbe essere misurata come segue:

LLQ i = Σ l=1 L s l [Punteggio l ÷ Riferimento punteggio ]

dove s l è la quota di popolazione che utilizza la lingua l.

I test dovrebbero riguardare:

  • domande fattuali;
  • terminologia del servizio pubblico;
  • linguaggio giuridico e medico;
  • contenuti didattici;
  • dialetti;
  • ragionamenti culturalmente specifici;
  • tossicità e rifiuto;
  • riconoscimento vocale;
  • OCR del documento;
  • traduzione.

Un modello può supportare una lingua a livello di conversazione, pur avendo prestazioni scadenti in compiti tecnici, scientifici o amministrativi. I paesi con ampi mercati linguistici – cinese, giapponese, coreano, arabo, portoghese e hindi – hanno incentivi commerciali più forti per la localizzazione rispetto alle comunità linguistiche minoritarie.

8.15.2 Dipendenza culturale

La dipendenza da piattaforme straniere può influenzare:

  • quali fonti vengono recuperate;
  • quali dialetti sono riconosciuti;
  • limiti di moderazione;
  • rappresentazione storica;
  • terminologia del servizio pubblico;
  • presupposti politici e culturali;
  • dati conservati al di fuori del paese.

La sovranità scientifica include quindi la capacità di valutare, adattare e governare i modelli, non solo di ospitarli.


8.16 Conseguenze dello sviluppo

8.16.1 Sviluppo economico

L’intelligenza artificiale può supportare lo sviluppo riducendo il costo dei servizi ad alta intensità di conoscenza, consentendo alle piccole imprese di raggiungere i mercati internazionali e migliorando la logistica, l’agricoltura, la finanza e l’amministrazione. Il contributo allo sviluppo può essere rappresentato come:

ΔY i = αA i + βK i + γS i + δD i − λM i

Dove:

  • IA = adozione dell’IA;
  • i = capitale complementare;
  • i = competenze;
  • i = qualità dei dati e istituzionale;
  • i = importazione e perdita di monopolio.

Se i servizi di intelligenza artificiale vengono importati mentre si crea poco valore a livello nazionale, la produttività potrebbe aumentare senza generare un’importante industria nazionale dell’IA.

8.16.2 Convergenza della produttività

L’intelligenza artificiale promuove la convergenza se i paesi a basso reddito acquisiscono tali capacità a un costo inferiore rispetto allo sviluppo interno di competenze equivalenti:

L’effetto di convergenza è maggiore di 0 quando:

Aumento di produttività derivante dall’IA importata > Perdita di abbonamenti + Sostituzione + Costi di adattamento

L’intelligenza artificiale promuove la divergenza quando i paesi leader combinano modelli migliori con maggiori capitali, competenze e dati:

Effetto di divergenza > 0 quando:

Frontiera di complementarità × Capitale esistente ricco > Guadagno di recupero povero

Il risultato probabile è eterogeneo. Le attività amministrative di base e di traduzione potrebbero convergere, mentre la ricerca scientifica di frontiera e il design industriale avanzato potrebbero divergere.

8.16.3 Istruzione

L’intelligenza artificiale a basso costo può diffondere servizi di tutoraggio e traduzione nelle regioni meno servite. Tuttavia, può anche creare una nuova disuguaglianza tra gli studenti che utilizzano sistemi generici gratuiti e quelli che hanno accesso a risorse all’avanguardia, dati istituzionali, dispositivi ad alte prestazioni e supervisione di esperti.

8.16.4 Servizi pubblici

I governi possono impiegare l’intelligenza artificiale per:

  • elaborazione documenti;
  • rilevamento delle frodi;
  • amministrazione fiscale;
  • sostegno dei cittadini;
  • traduzione;
  • allocazione delle risorse;
  • triage sanitario.

L’indice di maturità GovTech 2025 della Banca Mondiale copre 198 economie e riporta un aumento medio globale da 0,552 nel 2022 a 0,589 nel 2025, con differenze crescenti tra i gruppi con il livello di maturità più elevato e quelli con il livello più basso. Indice di maturità GovTech 2025 – Banca Mondiale – Dicembre/2025 — Indice di maturità GovTech della Banca Mondiale .

8.16.5 Assistenza sanitaria

L’intelligenza artificiale può ampliare le scarse capacità specialistiche attraverso il supporto alle decisioni, l’assistenza nella diagnostica per immagini, la traduzione e l’automazione amministrativa. I rischi sorgono quando i modelli importati non vengono validati su popolazioni, malattie, lingue o pratiche cliniche locali.

8.16.6 Imprenditorialità

Le API cloud riducono i costi di ingresso ma espongono le startup a:

  • deprezzamento della valuta;
  • restrizioni sui pagamenti esteri;
  • improvviso cambio di prezzo;
  • ritiro del modello;
  • limiti di residenza dei dati;
  • Blocco API;
  • accesso ineguale agli sconti aziendali.

Una startup che paga i costi dell’IA in dollari pur guadagnando in valuta locale si trova a fronteggiare uno squilibrio intrinseco dovuto al tasso di cambio.

8.16.7 Migrazione qualificata

I talenti potrebbero spostarsi verso paesi e istituzioni che offrono:

  • calcolo di frontiera;
  • stipendi più alti;
  • set di dati di ricerca;
  • laboratori solidi;
  • capitale iniziale;
  • capacità cloud.

Il feedback sulla migrazione è il seguente:

Ricerca e calcolo → Attrazione di talenti → Pubblicazioni e startup → Finanziamenti → Altro su Ricerca e calcolo

Il contrario può trasformarsi in una trappola per le capacità scientifiche.

8.16.8 Sicurezza nazionale

La dipendenza da piattaforme di intelligenza artificiale straniere ha le seguenti conseguenze:

  • analisi dell’intelligence;
  • catene di approvvigionamento della difesa;
  • operazioni relative alle infrastrutture critiche;
  • difesa informatica;
  • dati governativi;
  • continuità durante la crisi geopolitica.

La sovranità non richiede la produzione nazionale di ogni singolo chip. Richiede opzioni di continuità credibili, fornitori diversificati, sistemi portatili, valutazione locale e accesso prioritario durante le crisi.


8.17 Prove che l’IA può ridurre i divari di sviluppo

Meccanismo di equalizzazioneNota sullo sviluppo
Piccola intelligenza artificiale su dispositivi comuniRiduce i requisiti hardware
Accesso al cloudElimina l’investimento minimo in data center locali
TraduzioneAmplia l’accesso alla conoscenza globale
Modelli a peso apertoRiduce la dipendenza da licenze e piattaforme
risorse di calcolo pubbliche condivisecosti fissi degli spread
Distribuzione mobileRaggiunge gli utenti sprovvisti di personal computer
Specializzazione in agricoltura e sanitàSi concentra su problemi locali di grande rilevanza
Assistenza alla programmazioneAmplia le capacità di produzione del software
Infrastruttura pubblica digitaleConsente servizi governativi scalabili
crediti di ricerca internazionaliFornisce accesso temporaneo alla frontiera

Secondo la Banca Mondiale, entro la metà del 2025 i paesi a reddito medio rappresentavano oltre il 40% del traffico globale di ChatGPT, guidati da paesi come Brasile, India, Indonesia e Vietnam. Si segnala inoltre una rapida crescita delle posizioni lavorative nel campo dell’intelligenza artificiale generativa nelle economie a reddito medio. ( Strengthening AI Foundations: Emerging Opportunities for Developing Countries – World Bank – November/2025 — World Bank developing-country AI factsheet ).


8.18 Prove che l’IA può ampliare i divari di sviluppo

Meccanismo di divergenzaConseguenza
Acceleratori e memorie costosiLa capacità ad alta intensità di capitale rimane concentrata
tasse di importazione e deprezzamento della valutaI costi dell’hardware aumentano in proporzione al reddito locale.
Inaffidabilità dell’elettricitàI centri di inferenza e di dati locali diventano costosi
Assenza di regioni nuvoloseLatenza più elevata e sovranità più debole
controlli sulle esportazioniLa capacità avanzata varia a seconda dell’allineamento geopolitico.
Abbonamenti denominati in dollariGli shock valutari influenzano l’accesso
Scarsa performance nella lingua localeGuadagno di produttività inferiore
Concentrazione di ricerca e calcoloLa scienza di frontiera rimane geograficamente concentrata
Blocco della piattaformaIl valore aggiunto nazionale si trasferisce a fornitori esteri
migrazione utilizzataGli ecosistemi deboli perdono i loro ricercatori più capaci.
Scarsità di datiI modelli hanno prestazioni peggiori nelle condizioni locali
Incertezza normativaGli investimenti e l’implementazione sono in ritardo
Classificazione tra zone libere e zone di frontieraL’inclusione nominale maschera la disuguaglianza di capacità

Secondo un rapporto dell’UNCTAD, nel 2025 i data center hanno rappresentato oltre un quinto degli investimenti globali in nuove infrastrutture, a dimostrazione della crescente intensità di capitale necessaria per le infrastrutture digitali. ( Data Centres Are Reshaping the Global Investment Landscape – UN Trade and Development – ​​January/2026 — UNCTAD data-center investment analysis ).


8.19 Risultati regionali

8.19.1 Nord America

Gli Stati Uniti restano il principale produttore di tecnologie all’avanguardia. Il Canada beneficia dell’integrazione geografica, della ricerca e dell’accesso al cloud, ma rimane dipendente da piattaforme e forniture hardware estere. La disuguaglianza interna rappresenta il rischio principale: l’abbondanza nazionale non garantisce un accesso economicamente vantaggioso alle tecnologie all’avanguardia per ogni studente, famiglia o piccola impresa.

8.19.2 Unione Europea e Regno Unito

L’Europa possiede solide capacità di ricerca e industriali, connettività e istituzioni normative, ma non detiene un controllo equivalente sulle piattaforme di frontiera dominanti e sull’ecosistema di progettazione di acceleratori avanzati. Il quadro complessivo dell’UE nasconde importanti differenze tra gli Stati membri del nord e dell’ovest e tra gli Stati membri a basso reddito o di dimensioni minori. Il Regno Unito mantiene una forte domanda da parte del settore della ricerca e finanziario, ma condivide la dipendenza europea dall’hardware importato e dai fornitori di servizi cloud stranieri.

8.19.3 Asia orientale

Cina, Giappone e Corea del Sud possiedono tutti elevate capacità, ma presentano vincoli diversi. La Cina ha una dimensione di mercato e piattaforme interne, ma deve affrontare controlli sulle esportazioni. Il Giappone ha una forte capacità industriale e di ricerca, ma dipende da acceleratori all’avanguardia importati. La Corea del Sud combina capacità leader a livello mondiale nel settore delle memorie e dei semiconduttori con un’elevata connettività, sebbene l’accesso agli acceleratori di frontiera rimanga esposto a fattori geopolitici.

8.19.4 Israele

I punti di forza di Israele nella ricerca, nella sicurezza informatica, nei semiconduttori e nelle startup gli conferiscono un elevato livello di preparazione. I suoi limiti sono rappresentati dalle dimensioni del mercato, dalla sicurezza regionale, dalla concentrazione delle infrastrutture e dalla dipendenza da hardware all’avanguardia importato.

8.19.5 India

L’India dimostra la differenza tra capacità nazionale e accesso a livello familiare. Possiede talenti nel settore del software di livello mondiale, regioni cloud nazionali e un mercato dell’intelligenza artificiale in espansione, mentre le disuguaglianze di reddito, lingua, connettività rurale e istruzione producono una distribuzione interna molto ampia.

8.19.6 America Latina

Brasile e Messico possiedono ampi mercati e accesso al cloud, ma devono affrontare limitazioni legate all’accessibilità economica dell’hardware, alla tassazione, al tasso di cambio e alla disponibilità di risorse di calcolo per la ricerca. Il Brasile beneficia delle economie di scala derivanti dalla lingua portoghese; il Messico trae vantaggio dalla vicinanza geografica e dall’integrazione industriale con gli Stati Uniti.

8.19.7 Balcani

La Croazia beneficia dell’integrazione europea. La Serbia possiede talenti tecnici e un potenziale di importanza regionale, ma una base di calcolo interna più limitata. L’Albania ha compiuto progressi nella pubblica amministrazione digitale, mentre la Bosnia-Erzegovina si trova ad affrontare una frammentazione istituzionale. La cooperazione regionale nel calcolo potrebbe risultare economicamente più vantaggiosa rispetto alla duplicazione di piccoli cluster nazionali.

8.19.8 Nord Africa

Il Marocco possiede un forte potenziale in termini di infrastrutture nearshore e servizi multilingue; la Tunisia vanta un notevole talento tecnico, ma deve affrontare vincoli di capitale e valutari; l’Egitto combina dimensioni demografiche, una fitta rete di cavi sottomarini e una forte domanda di servizi in lingua araba con notevoli pressioni sui costi. Questi paesi potrebbero diventare hub di localizzazione e servizi se i settori dell’elettricità, del cloud e del calcolo per la ricerca si espandessero.

8.19.9 Africa sub-sahariana

Il Sudafrica vanta la posizione più forte nella regione per quanto riguarda le infrastrutture hyperscale e la ricerca, ma soffre di disuguaglianze in termini di accesso all’elettricità e di reddito. Il Kenya è un polo di servizi digitali dell’Africa orientale. La Nigeria ha un enorme potenziale di mercato, ma gravi limitazioni in termini di energia e valuta. Ghana e Ruanda eccellono nelle politiche e nella pubblica amministrazione digitale, ma dispongono di risorse informatiche limitate. L’Etiopia rimane penalizzata in diversi ambiti complementari.


8.20 Architettura delle politiche

Obiettivo politicoStrumentoRisultato misurabile
Ridurre il carico hardwareAgevolazioni tariffarie e appalti collettiviRapporto salario mensile per postazione di lavoro
Migliorare l’affidabilità dell’alimentazione elettricaInvestimenti in reti elettriche e in infrastrutture dedicate alla ricerca.disponibilità di calcolo corretta per le interruzioni
Ampliare l’accesso al cloudPolitica regionale in materia di investimenti e concorrenzaLatenza e profondità del servizio idoneo
Proteggere l’accessibilità economicaCrediti per studenti, PMI e ricercatoriRiduzione di AAI e SAI
Costruire la sovranità scientificaGruppi di ricerca nazionali o regionaliOre di accelerazione della ricerca per ricercatore
Migliorare l’inclusione linguisticaInsiemi di dati e valutazioni in lingua localepunteggio di parità LLQ
Ridurre il vincoloRegole di portabilità e interoperabilitàTempo e costi di cambio
Affrontare il rischio valutarioServizi di fatturazione e copertura in valuta localevolatilità dei prezzi dell’IA
Ampliare le competenzeFormazione in intelligenza artificiale applicata e verificaProduttività del compito portato a termine con successo
Supporto per smallAISovvenzioni per sistemi locali specifici per determinate attivitàCosto per carico di lavoro locale convalidato
Promuovere la cooperazione regionaleInfrastrutture di calcolo e dati condiviseUtilizzo e accesso dei membri
Proteggere la sicurezzaDiversificazione dell’offerta e capacità di riservaTempo di recupero durante l’interruzione del fornitore

8.21 Scenari quinquennali, 2027–2031

ScenarioSviluppo del nucleoRisultato di disuguaglianza
Diffusione inclusivaIntelligenza artificiale su piccola scala, modelli aperti e infrastrutture pubblicheIl divario globale si riduce
Dipendenza dalla piattaformaL’accesso al cloud si espande senza capacità interneI consumi aumentano; il divario di sovranità si allarga.
biforcazione di frontieraL’intelligenza artificiale di base diventa economica, mentre la potenza di calcolo all’avanguardia rimane scarsa.L’accesso nominale converge; la capacità produttiva diverge.
Frammentazione geopoliticaI controlli sulle esportazioni e gli ecosistemi sovrani si espandonoL’accesso segue alleanze e giurisdizione
Salto infrastrutturaleAlcune economie emergenti costruiscono hub per l’energia e il cloud.Emergono nuovi leader regionali
Shock valutario e del debitoLa convenienza delle importazioni e degli abbonamenti peggioracontratti di accesso per persone a basso reddito
cooperazione regionaleCresce la capacità condivisa tra Balcani, Africa o America Latina.Lo svantaggio legato alle dimensioni dei piccoli paesi diminuisce

Lo scenario centrale più plausibile è la biforcazione di frontiera . L’IA a basso costo si diffonde attraverso servizi mobili, modelli più piccoli e API cloud, generando benefici concreti in settori come l’istruzione, la traduzione, l’agricoltura, la pubblica amministrazione e l’imprenditoria. Allo stesso tempo, la ricerca di frontiera, i sistemi aziendali ad alta affidabilità, gli agenti multimodali avanzati e l’implementazione locale sovrana rimangono concentrati nei paesi che dispongono di abbondanti capitali, energia elettrica affidabile, hardware all’avanguardia, regioni cloud e istituti di ricerca.


8.22 Ipotesi falsificabili

IpotesiTest
H8.1Un GAI più elevato prevede una maggiore adozione dell’IA a livello aziendale dopo aver tenuto conto del reddito
H8.2I rapporti salariali mensili per l’hardware prevedono l’adozione del modello locale
H8.3Le regioni cloud nazionali aumentano l’adozione dell’IA da parte delle imprese e riducono la latenza
H8.4L’inaffidabilità dell’energia elettrica riduce gli investimenti locali in infrastrutture di calcolo.
H8.5Le restrizioni all’esportazione riducono la crescita della ricerca e del calcolo nelle giurisdizioni interessate.
H8.6La qualità della lingua locale è un fattore predittivo dell’adozione da parte del pubblico e delle PMI.
H8.7Gli shock valutari riducono il consumo di API nelle economie in via di sviluppo
H8.8Il calcolo distribuito per la ricerca pubblica riduce la migrazione qualificata
H8.9Le piccole IA producono guadagni proporzionalmente maggiori in contesti a basso reddito per compiti limitati
H8.10Le capacità di frontiera rimangono più concentrate rispetto all’utilizzo di base dell’IA
H8.11La disuguaglianza tra paesi è inferiore alla somma della disuguaglianza tra paesi e all’interno dei paesi.
H8.12Le infrastrutture cooperative regionali migliorano l’accesso nelle piccole economie

8.23 Risultati finali

  1. La predisposizione all’IA è un sistema di elementi complementari. La connettività senza elettricità, le competenze senza capacità di calcolo o l’accesso al cloud senza valuta estera non possono garantire la piena capacità.
  2. Il divario digitale globale rimane ampio. Nel 2025, circa 2,2 miliardi di persone risultavano ancora offline, prevalentemente nei paesi a basso e medio reddito.
  3. Le medie nazionali nascondono gravi disuguaglianze interne. India, Brasile, Cina, Stati Uniti, Sudafrica e Nigeria ospitano sia centri altamente competitivi a livello globale, sia comunità fortemente svantaggiate.
  4. La geografia del cloud è una variabile di sviluppo. Le regioni nazionali e limitrofe influenzano la latenza, la disponibilità, la residenza e il potere contrattuale.
  5. L’accesso ad hardware avanzato è una questione geopolitica. I controlli sulle esportazioni e le sanzioni possono alterare la capacità di calcolo nazionale indipendentemente dal reddito o dalle competenze tecniche.
  6. L’accessibilità economica dell’hardware dovrebbe essere misurata in termini di mensilità di stipendio, non in dollari nominali. La stessa attrezzatura può rappresentare meno di un mese di stipendio in un Paese e molti mesi in un altro.
  7. La qualità dell’apprendimento nelle lingue locali è parte integrante dell’infrastruttura. Un Paese non può considerarsi pienamente pronto per l’intelligenza artificiale se la sua popolazione ottiene risultati significativamente inferiori nell’utilizzo delle lingue nazionali.
  8. La potenza di calcolo per la ricerca è un bene sovrano. La sua mancanza può causare lacune nella pubblicazione dei risultati, dipendenza da piattaforme straniere e migrazione di personale qualificato.
  9. L’intelligenza artificiale può ridurre i divari di sviluppo. Modelli di piccole dimensioni, accesso da dispositivi mobili, traduzione automatica, API cloud e infrastrutture condivise possono distribuire funzionalità utili a costi marginali contenuti.
  10. L’intelligenza artificiale può al contempo ampliare i divari di frontiera. Acceleratori avanzati, energia, data center, finanziamenti per la ricerca e strumenti aziendali rimangono altamente concentrati.
  11. Il valore provvisorio dell’indice di Gini, pari a 0,193, sottostima la disuguaglianza complessiva. Non tiene conto della ponderazione in base alla popolazione e delle disparità di accesso all’interno dei singoli paesi.
  12. La decomposizione di Theil preliminare attribuisce il 91,4% della dispersione misurata alle differenze tra ampi gruppi di prontezza operativa. Questo risultato è esemplificativo e dipende dal campione e dal raggruppamento utilizzati.
  13. L’obiettivo politico corretto non è la proprietà nazionale di ogni tecnologia. Piuttosto, mira all’accesso a prezzi accessibili, alla continuità, alla capacità di valutazione, alla portabilità e alla capacità di adattare l’IA alle esigenze locali.
  14. Il calcolo cooperativo regionale è particolarmente importante per i paesi di piccole dimensioni. Può ripartire i costi fissi e ridurre la dipendenza, a condizione che la governance e l’allocazione delle risorse siano credibili.
  15. Il rischio principale fino al 2031 è un mondo in cui l’intelligenza artificiale di base diventi quasi universale, mentre l’IA di punta, privata, affidabile e scientificamente utile rimanga concentrata in un unico territorio. Un sistema di questo tipo ridurrebbe alcuni divari di sviluppo, istituzionalizzando al contempo una gerarchia globale più profonda delle capacità di intelligenza.

CAPITOLO 9 — Previsioni quinquennali e scenari quantitativi, 2026-2031

9.1 Obiettivo della previsione, anno base e stato delle prove

Prevedere l’andamento di un’infrastruttura di intelligenza artificiale è diverso dal prevedere l’andamento di un prodotto maturo. Il sistema è soggetto a cambiamenti strutturali simultanei nell’architettura dei modelli, nella progettazione degli acceleratori, nell’intensità di memoria, nel packaging avanzato, nella costruzione dei data center, nell’approvvigionamento energetico, nell’ottimizzazione dell’inferenza, nella definizione dei prezzi dei servizi, nella regolamentazione e nell’accesso geopolitico. Le serie storiche sono brevi, le generazioni di prodotti non sono equivalenti in termini di qualità, i prezzi dichiarati spesso differiscono da quelli negoziati e diverse variabili, in particolare i token di inferenza a pagamento e l’output del packaging avanzato, non sono divulgate attraverso set di dati globali completi. Pertanto, una singola tendenza estrapolata creerebbe una falsa sicurezza.

Questo capitolo utilizza un insieme di modelli . Laddove esiste una base di riferimento fisica ufficiale, come ad esempio il consumo di elettricità dei data center statunitensi, la previsione riporta unità fisiche. Laddove il livello globale di riferimento non viene osservato in modo coerente, viene riportato un indice con 2026=100. Le previsioni dei prezzi nominali sono separate dai prezzi corretti per la qualità. Le traiettorie centrale, bassa e alta rappresentano scenari alternativi, non affermazioni di risultati deterministici. Gli intervalli dell’80% e del 95% sono intervalli di simulazione probabilistici solo laddove sia stata specificata una distribuzione dei parametri; non vengono presentati come intervalli di confidenza classici per serie temporali quando il campione storico è insufficiente.

I dati ufficiali indicano un punto di partenza caratterizzato da un’elevata crescita, ma con capacità limitate:

  • Il consumo di elettricità dei data center statunitensi è aumentato da 58 TWh nel 2014 a 176 TWh nel 2023, con una proiezione ufficiale tra 325 e 580 TWh entro il 2028. Il Dipartimento dell’Energia degli Stati Uniti pubblica un nuovo rapporto che valuta l’aumento della domanda di elettricità da parte dei data center – Dicembre 2024 — Previsioni del Dipartimento dell’Energia degli Stati Uniti sul consumo di elettricità dei data center .
  • TSMC ha dichiarato nell’aprile 2025 di essere al lavoro per raddoppiare la capacità di CoWoS nel corso del 2025. Conferenza sugli utili del primo trimestre 2025 di TSMC – TSMC – Aprile/2025 — Trascrizione per gli investitori del primo trimestre 2025 di TSMC .
  • Nel marzo 2026 Micron ha dichiarato che si prevedeva che le condizioni di domanda e offerta di DRAM e NAND sarebbero rimaste tese anche dopo il 2026. Teleconferenza sugli utili del secondo trimestre fiscale 2026 di Micron – Marzo/2026 — Informativa agli investitori di Micron per il secondo trimestre dell’anno fiscale 2026 .
  • Microsoft ha reso note spese in conto capitale per 31,9 miliardi di dollari nel terzo trimestre dell’anno fiscale 2026, di cui circa due terzi destinati ad asset a vita breve, principalmente GPU e CPU. Teleconferenza sui risultati del terzo trimestre dell’anno fiscale 2026 di Microsoft – Aprile 2026 – Informativa agli investitori di Microsoft per il terzo trimestre dell’anno fiscale 2026 .
  • Alphabet ha reso note spese in conto capitale per 44,9 miliardi di dollari nel secondo trimestre del 2026, la stragrande maggioranza delle quali destinate all’infrastruttura tecnica a supporto dell’IA; circa il 60% degli investimenti in infrastrutture tecniche è stato destinato ai server e il 40% ai data center e alle reti. Alphabet 2026 Q2 Earnings Call – Alphabet – July/2026 — Alphabet Q2 2026 investor disclosure .

9.2 Variabili di previsione e unità di misura

Variabileunità di previsioneInterpretazione dell’anno base
Prezzo delle GPU per consumatori e professionistiIndice dei prezzi nominali, 2026=100Cesto hardware comparabile con capacità di intelligenza artificiale
Prezzo dell’acceleratore corretto per la qualitàCosto per indice di carico di lavoro completato con successoControlli per memoria, velocità di elaborazione e qualità
Prezzo HBMIndice del prezzo per GBGenerazione di memoria ad alta larghezza di banda combinata
Prezzo della DRAMIndice del prezzo per GBDRAM ibrida per server e workstation
Imballaggio avanzatoIndice di capacitàCapacità equivalente CoWoS corretta per la qualità
Spese in conto capitale per i data centerIndice nominale degli investimenti globaliIntelligenza artificiale e infrastrutture tecniche cloud
domanda di elettricitàIndice globale TWh più dati dei data center statunitensiAncoraggio fisico statunitense
richiesta di inferenza dell’IAIndice di successo delle attività corretto per la qualitàNon solo i token generati grezzi
Prezzo dell’APICosto per indice di carico di lavoro completato con successoRegolato in base al modello, agli strumenti e alla qualità
Spesa aziendale per l’IAIndice di spesa realeLicenze, calcolo, integrazione e governance
Convenienza dell’IA localeIndice costi-redditoValori più bassi indicano una maggiore convenienza
Disuguaglianza globale nell’accessoPilota Gai GiniAccesso medio nazionale corretto per la qualità
Costo di adozione settorialeIndice reale del costo totalePiena implementazione e oneri di governance

9.3 Metodi di previsione

9.3.1 Modello di tendenza e CAGR

Per una variabile X:

CAGR = (X T ÷ X 0 ) 1/T − 1

E:

X̂ t = X 0 (1 + CAGR) t

Il CAGR viene utilizzato solo come parametro descrittivo di riferimento. Risulta inaffidabile quando vincoli di offerta, cicli di prodotto o shock normativi modificano il regime di crescita.

9.3.2 Livellamento esponenziale

La semplice levigatura esponenziale è:

t = αX t + (1−α)L ​​t−1

Un’estensione di tendenza smorzata è:

X̂ t+h = L t + (φ + φ 2 + … + φ h )B t

dove φ inferiore a uno impedisce una crescita esponenziale persistentemente improbabile.

9.3.3 ARIMA

Un modello ARIMA(p,d,q) è:

φ(B)(1−B) d X t = c + θ(B)ε t

Il modello ARIMA dovrebbe essere utilizzato solo per serie temporali mensili o trimestrali sufficientemente lunghe e coerenti, come i prezzi spot delle memorie o la domanda di energia elettrica. Non è adatto per serie annuali a cinque punti di prodotti acceleratori non comparabili.

9.3.4 Regressione dinamica

Per i prezzi di memorie o acceleratori:

ΔlnP t = α + β 1 ΔlnDomanda t − β 2 ΔlnCapacità t + β 3 Energia t + β 4 FX t + β 5 Restrizione t + ε t

Ciò consente a variabili quali offerta, domanda, energia, valuta e fattori geopolitici di influenzare i prezzi.

9.3.5 Modello di dati panel

Per il paese i e l’anno t:

GAI i,t = α + β 1 Reddito i,t + β 2 Banda larga i,t + β 3 Energia i,t + β 4 Cloud i,t + β 5 Competenze i,t + μ i + τ t + ε i,t

Gli effetti fissi per paese μ i tengono conto delle caratteristiche strutturali invarianti nel tempo; gli effetti di periodo τ t tengono conto dei cambiamenti globali.

9.3.6 Modello stock-flusso

La capacità di intelligenza artificiale installata si evolve come segue:

t+1 = K t + I t − δK t − R t

Dove:

  • t è la capacità produttiva;
  • Si tratta di una nuova installazione;
  • δ rappresenta il pensionamento fisico;
  • t rappresenta l’obsolescenza economica o la capacità inaccessibile.

La capacità effettiva è:

efficace,t = K t × U t × A t × E t

dove U rappresenta l’utilizzo, A la disponibilità ed E l’efficienza del software.


9.4 Curve di apprendimento

La relazione di apprendimento richiesta è:

t = C 0 (Q t ÷ Q 0 ) −b

Il tasso di apprendimento implicito è:

LR = 1 − 2 −b

Se la produzione cumulativa di inferenze aumenta di dieci volte e il costo corretto per la qualità scende da 100 a 32:

0,32 = 10 −b

b = −ln(0,32) ÷ ln(10)
b ≈ 0,495

Perciò:

LR = 1 − 2 −0,495
LR ≈ 29,0%

In questo scenario centrale, ogni raddoppio della produzione cumulativa riduce i costi corretti per la qualità di circa il 29%.

9.4.1 Sensibilità al tasso di apprendimento

Esponente di apprendimento bTasso di apprendimento implicitoCosto dopo quattro raddoppi
0,106,7%75,8
0,2012,9%57.4
0,3018,8%43,5
0,4024,2%33.0
0,5029,3%25.0
0,6034,0%18.9

Gli effetti dell’apprendimento possono essere compensati dall’aumento delle capacità. Se gli utenti migrano da modelli di base economici a sistemi di ragionamento e agenti più intensivi dal punto di vista computazionale, il costo di un’attività fissa nel 2026 potrebbe diminuire, mentre la spesa media per utente aumenta.


9.5 Previsioni annuali centrali, 2026–2031

9.5.1 Tecnologia e infrastrutture

Tutti gli indici utilizzano 2026=100, salvo diversa indicazione.

Variabile202620272028202920302031CAGR 2026–2031
Prezzo nominale della GPU/acceleratore1001011031041051051,0%
Prezzo dell’acceleratore corretto per la qualità1008268574841−16,4%
Prezzo HBM per GB1009488837873−6,1%
Prezzo convenzionale della DRAM per GB1009590868278-4,9%
Capacità di confezionamento avanzato10013016520524528523,3%
Spese in conto capitale per i data center10012214516618419914,8%
richiesta di inferenza dell’IA1001803105007601.10061,6%
Prezzo dell’API corretto in base alla qualità1007558463832-20,4%
Spesa aziendale per l’IA10013016520525030024,6%
Rapporto costi-ricavi dell’IA locale1009589848076-5,3%

Il risultato centrale non è contraddittorio: i prezzi delle API e i costi dell’hardware, ponderati in base alla qualità, possono diminuire mentre la spesa totale dell’azienda aumenta. La domanda, la profondità dell’integrazione, la capacità dei modelli, la multimodalità, gli strumenti agentici e la governance possono espandersi più rapidamente di quanto diminuiscano i costi unitari.


9.5.2 Elettricità dei data center statunitensi

AnnoPrevisioni del centroTraiettoria bassatraiettoria elevata
2026330 TWh280 TWh380 TWh
2027390 TWh310 TWh480 TWh
2028450 TWh325 TWh580 TWh
2029515 TWh350 TWh690 TWh
2030585 TWh380 TWh810 TWh
2031660 TWh410 TWh930 TWh

L’intervallo ufficiale del Dipartimento dell’Energia (DOE) si riferisce al 2028; i valori successivi al 2028 sono estensioni di scenario, non proiezioni federali ufficiali. Il valore centrale per il 2028, pari a 450 TWh, rientra nell’intervallo ufficiale compreso tra 325 e 580 TWh.


9.6 Previsioni sui prezzi

9.6.1 Prezzi di GPU e acceleratori

Si prevede che i prezzi nominali degli acceleratori saranno sostanzialmente più rigidi rispetto ai prezzi ponderati in base alla qualità. I ​​prodotti successivi potrebbero offrire maggiore memoria e velocità di elaborazione, mantenendo o addirittura aumentando i prezzi di listino.

Previsione202620272028202920302031
Basso nominale1009591878480
Centrale nominale100101103104105105
Valore nominale massimo100110121133146161
Qualità corretta centrale1008268574841

Il percorso nominale elevato corrisponde a scarsità persistente, migrazione verso prodotti di fascia alta, colli di bottiglia nella memoria, dazi doganali e concorrenza limitata. Il percorso basso presuppone una forte concorrenza, la normalizzazione delle scorte e alternative migliori.

9.6.2 HBM

La traiettoria del prezzo di HBM dipende da due forze opposte:

  • I miglioramenti generazionali e l’espansione della capacità riducono il prezzo per bit;
  • La domanda elevata, la complessità degli impilamenti, il compromesso tra rendimento e capacità mantengono i prezzi elevati.

Micron ha dichiarato che l’espansione dell’HBM crea un significativo rapporto di scambio rispetto alla capacità DRAM convenzionale e ha continuato a descrivere le condizioni di domanda e offerta come tese. Teleconferenza sugli utili del primo trimestre fiscale 2026 di Micron – Micron – dicembre 2025 — Informativa sull’offerta di HBM e DRAM di Micron .

Indice HBM prezzo per GB202620272028202920302031
Basso1008269585043
Centrale1009488837873
Alto100112120125128130

9.6.3 DRAM

Indice del prezzo per GB delle memorie DRAM202620272028202920302031
Basso1008574665953
Centrale1009590868278
Alto100108113116118120

Il caso più elevato riflette l’allocazione dei wafer verso HBM e prodotti avanzati, limitando l’offerta di memorie convenzionali nonostante i progressi tecnologici.


9.7 Previsioni sugli imballaggi avanzati

Il rapporto annuale 2025 di TSMC descrive il continuo sviluppo di CoWoS, InFO, SoIC e delle relative tecnologie di integrazione tridimensionale in risposta alla domanda di intelligenza artificiale. Rapporto annuale TSMC 2025 – TSMC – 2026 — Rapporto annuale TSMC 2025 .

Indice di capacità di confezionamento avanzato202620272028202920302031
Basso100115135155175195
Centrale100130165205245285
Alto100150215300400515

L’aumento della capacità non garantisce una crescita equivalente dei sistemi di accelerazione completati. HBM, substrati, interposer, reti ottiche, apparecchiature di alimentazione e integrazione del server finale devono espandersi simultaneamente.


9.8 Investimenti in conto capitale (CAPEX) per i data center

9.8.1 Traiettoria centrale

Indice CAPEX dei data center202620272028202920302031
Basso100108116122126128
Centrale100122145166184199
Alto100145195255325400

Il percorso centrale presuppone una continua espansione, ma con una crescita annua decrescente a causa dei vincoli imposti dalla rete, dalla costruzione, dalle autorizzazioni e dai finanziamenti. Il percorso più ottimistico presuppone una corsa agli armamenti infrastrutturali sostenuta, programmi di potenziamento delle capacità statali e una rapida domanda da parte degli enti preposti.

9.8.2 Relazione stock-flusso CAPEX

DC,t+1 = K DC,t + CAPEX t − Ammortamento t − Svalutazione t

Un aumento della spesa in conto capitale non si traduce immediatamente in capacità produttiva per i seguenti motivi:

  • tempi di realizzazione;
  • connessione alla rete;
  • Consegna dell’acceleratore;
  • messa in servizio dell’impianto di raffreddamento;
  • integrazione software;
  • rampa per i clienti;
  • risorse bloccate o sottoutilizzate.

9.9 Richiesta di inferenza AI

La richiesta di inferenza dovrebbe essere misurata in compiti di qualità corretti e portati a termine con successo, piuttosto che in token grezzi. Sia:

Inferenza D ,t = Utenti t × Attività per utente t × Calcolo per attività t ÷ Efficienza t

Indice di richiesta di inferenza202620272028202920302031
Basso100140200280380500
Centrale1001803105007601.100
Alto1002505501.1002.0003.400

L’efficienza può aumentare la domanda attraverso un meccanismo di rimbalzo:

Calcolo totale = Costo per attività × Numero di attività

Se il costo per singola attività diminuisce del 70% mentre il volume delle attività decuplica, la spesa totale e la potenza di calcolo fisica possono comunque aumentare considerevolmente.


9.10 Previsioni sui prezzi API

9.10.1 Costo per attività completata con successo, corretto per la qualità

Indice dei prezzi API202620272028202920302031
Percorso a basso costo1006543302217
Centrale1007558463832
percorso ad alto prezzo100100103108115125

Il percorso centrale presuppone apprendimento, instradamento, caching e competizione. Il percorso superiore riflette la migrazione di frontiera premium, la fatturazione basata su token di ragionamento, i costi di priorità, i moltiplicatori a lungo termine e la capacità limitata.

9.10.2 Scomposizione tariffaria

AI,t = P base,t × M modello,t × M latenza,t × M contesto,t × M regione,t + C strumenti,t

Un prezzo base in calo può coesistere con un costo per attività completata in aumento se i moltiplicatori crescono.


9.11 Spese aziendali

Indice di spesa per l’IA aziendale202620272028202920302031
Basso100115132150168185
Centrale100130165205250300
Alto100155225320440590

Le previsioni centrali indicano una crescita annua del 24,6%. La spesa comprende:

  • licenze;
  • Utilizzo delle API;
  • infrastruttura locale e cloud;
  • preparazione dei dati;
  • integrazione;
  • sicurezza informatica;
  • governance;
  • conformità;
  • supervisione umana;
  • valutazione;
  • commutazione e ridondanza.

La deflazione dei prezzi unitari non implica quindi una deflazione di bilancio.


9.12 Previsioni sui costi di adozione settoriale

La tabella riporta gli indici reali del costo totale di adozione.

Settore202620272028202920302031
Microimprese100117135153170185
Strade100122148176205235
Grandi aziende100130164202243285
Bancario100135170207245285
Assicurazione100130160195230265
Assistenza sanitaria100138180225272320
Legale/professionale100120140160178195
Produzione100128158190222255
Media100125150176200225
Telecomunicazioni100135172212255300
Difesa/infrastrutture critiche100142188238290345
amministrazione pubblica100126155188220250
Istruzione/ricerca100125150178205230

I settori ad alta affidabilità crescono più rapidamente perché la profondità di implementazione, la sicurezza, la convalida e la ridondanza si espandono più velocemente di quanto diminuiscano i prezzi delle singole unità di prodotto.


9.13 Accessibilità economica dell’IA locale

Il rapporto di accessibilità economica dell’IA locale è:

LAA c,t = Costo totale di proprietà (TCO) annuale dell’IA locale c,t ÷ Reddito disponibile mediano c,t

Indice di accessibilità economica dell’IA locale202620272028202920302031
Percorso di miglioramento1008877675850
Centrale1009589848076
Percorso in peggioramento100108116125133140

Il caso centrale migliora lentamente perché i costi dell’hardware, corretti per la qualità, diminuiscono, mentre aumentano i requisiti del modello adeguato, la memoria, l’energia elettrica e le aspettative in termini di capacità.


9.14 Previsione della disuguaglianza nell’accesso globale

Utilizzando l’indice di Gini GAI provvisorio del Capitolo 8, pari a 0,193, come base di riferimento analitica per il 2026:

GAI Gini202620272028202920302031
Percorso di convergenza0,1930,1850,1780,1710,1650,160
Percorso di accesso centrale a più livelli0,1930,1980,2030,2080,2120,215
Deviazione0,1930,2100,2280,2470,2680,290

Il caso centrale presuppone che l’accesso di base sia diffuso, ma che le infrastrutture di frontiera rimangano concentrate.


9.15 Quadro di riferimento Monte Carlo

Per ciascuna simulazione b:

  1. Trarre inferenze sulla crescita della domanda.
  2. Attrarre crescita di capacità.
  3. Disegna l’esponente di apprendimento.
  4. Visualizza il prezzo dell’energia e il ritardo di connessione alla rete.
  5. Disegna i vincoli di memoria e di incapsulamento.
  6. Tracciare un regime geopolitico.
  7. Calcola capacità, prezzo, spesa e accesso.
  8. Ripetere almeno 50.000 volte.

Distribuzioni dei parametri a titolo esemplificativo:

ParametroDistribuzioneParametro centrale
Crescita annuale dell’inferenzaLognormal55%
crescita degli imballaggi avanzatiTriangolare15%, 25%, 45%
Esponente di apprendimento APINormale, positivo troncato0,50
Acceleratore della vita economicaTriangolare3, 4, 6 anni
Ritardo di alimentazione del data centerDiscreto0-4 anni
Shock da controllo delle esportazioniBernoulliDipendente dallo scenario
shock dell’offerta HBMBernoulliDipendente dallo scenario
crescita del prezzo dell’elettricitàLognormal3%
Adozione aziendaleDiffusione logisticaDipendente dal settore

9.16 Intervalli di previsione 2031

Questi intervalli sono intervalli di simulazione basati su modelli, non intervalli di confidenza classici derivati ​​da lunghe serie storiche stazionarie.

Variabile2031 centraleintervallo dell’80%intervallo del 95%
Indice dei prezzi nominali delle GPU10582–14565–190
Prezzo dell’acceleratore corretto per la qualità4125–6515–100
Indice HBM prezzo per GB7350–11035–150
Indice del prezzo per GB delle memorie DRAM7855–11040–145
Capacità di confezionamento avanzato285220–360170–470
Spese in conto capitale per i data center199155–270120–380
elettricità dei data center statunitensi660 TWh480–800 TWh390–930 TWh
richiesta di inferenza dell’IA1.100600–1.900350–3.200
Prezzo dell’API corretto in base alla qualità3220–5012–80
Spesa aziendale per l’IA300220–410160–600
Indice di accessibilità economica dell’IA locale7655–10540–140
GAI Gini0,2150,185–0,2500,160–0,300

9.17 Probabilità degli scenari

Le probabilità degli scenari sono giudizi strutturati derivati ​​da:

  • impegni di investimento attuali;
  • concentrazione documentata nei capitoli precedenti;
  • Dichiarazioni ufficiali relative alla confezione e ai ricordi;
  • previsioni di potenza;
  • Sviluppi in materia di controllo delle esportazioni;
  • segmentazione dei prezzi osservata;
  • andamenti dell’efficienza del modello;
  • ciclicità storica dei semiconduttori.

Non si tratta di frequenze oggettive. Gli scenari si sovrappongono in parte: la determinazione dei prezzi tramite finanziarizzazione può coesistere con oligopolio, frammentazione o scarsità.

ScenarioGiudizio centraleIntervallo plausibile
A — Calcolo abbondante20%15–25%
B — Oligopolio gestito35%30–40%
C — Scarsità persistente18%15–25%
D — Un mondo dell’IA frammentato17%15–25%
E — Utilità dell’IA e accesso finanziarizzato10% come regime dominante10–20%

La somma delle stime del punto centrale è pari al 100% solo per costruire una base di riferimento ponderata per la decisione. Gli intervalli plausibili non devono necessariamente sommare al 100%.


9.18 Scenario A — Risorse di calcolo abbondanti

9.18.1 Presupposti

  • La capacità di confezionamento avanzato si espande rapidamente;
  • HBM4 e le generazioni successive raggiungono rese elevate;
  • La concorrenza tra fonderie e produttori di memorie aumenta;
  • I progetti relativi alla rete elettrica e alla generazione di energia vengono completati nei tempi previsti;
  • I modelli a peso aperto rimangono competitivi;
  • Il software di inferenza produce forti effetti di apprendimento;
  • Le restrizioni all’esportazione rimangono limitate;
  • I fornitori di servizi cloud competono in modo aggressivo;
  • I modelli piccoli e specializzati assorbono la domanda di routine.

9.18.2 Traiettoria annuale

Indicatore202620272028202920302031
prezzo di calcolo ponderato in base alla qualità1007558453528
Prezzo HBM per GB1008269585043
Capacità di imballaggio100150215300400515
prezzo dell’attività API completata con successo1006543302217
Spese aziendali100125155185215245
GAImedia globale56.46064687276
GAI Gini0,1930,1850,1780,1710,1650,160

9.18.3 Conseguenze

  • Le aziende ottengono un ROI positivo grazie a un maggior numero di casi d’uso.
  • Le PMI possono accedere a funzionalità avanzate senza dover investire ingenti somme di denaro.
  • Migliora la capacità di spesa delle famiglie e degli studenti.
  • I paesi a basso e medio reddito traggono vantaggio dalla diffusione di dispositivi mobili e modelli di piccole dimensioni.
  • I fornitori di servizi di frontiera subiscono pressioni sui margini di profitto.
  • La domanda totale di elettricità può ancora aumentare perché i prezzi più bassi generano un maggiore consumo.

9.18.4 Indicatori di allerta precoce

  • I tempi di consegna per l’imballaggio sono inferiori ai normali cicli di approvvigionamento;
  • I premi dei contratti HBM diminuiscono;
  • Le scorte di acceleratori aumentano;
  • Senza limiti più stringenti, i prezzi delle API diminuiscono;
  • I modelli locali colmano le lacune in termini di capacità;
  • Le code per la connessione alla rete si accorciano.

9.18.5 Eventi di invalidazione

  • una grave crisi nel settore dei semiconduttori;
  • carenze prolungate di HBM;
  • gravi limitazioni di potenza;
  • ampliamento dei controlli sulle esportazioni;
  • I carichi di lavoro di frontiera diventano molto più intensivi dal punto di vista computazionale rispetto ai guadagni di efficienza.

9.19 Scenario B — Oligopolio gestito

9.19.1 Presupposti

  • l’offerta fisica si espande;
  • Le attività di fonderia avanzata, HBM, confezionamento e controllo cloud rimangono concentrate;
  • I fornitori mantengono livelli di modello differenziati;
  • La concorrenza riduce alcuni prezzi ma preserva gli affitti;
  • Aumentano i contratti aziendali e la dipendenza dall’ecosistema;
  • l’interoperabilità rimane incompleta;
  • I modelli base diventano economici, mentre l’accesso alle frontiere rimane un lusso.

9.19.2 Traiettoria annuale

Indicatore202620272028202920302031
prezzo di calcolo ponderato in base alla qualità1008878706459
Prezzo HBM per GB1009894908682
Capacità di imballaggio100128160195230265
prezzo dell’attività API completata con successo1008270615550
Spese aziendali100132170215265320
GAImedia globale56.45860626466
GAI Gini0,1930,1970,2020,2070,2110,215

9.19.3 Conseguenze

  • Le grandi aziende ottengono sconti per quantità e capacità riservata.
  • Le PMI continuano a dipendere dagli abbonamenti combinati.
  • I livelli di gratuità per i consumatori migliorano, ma restano al di sotto delle capacità di frontiera.
  • I fornitori di piattaforme si accaparrano una quota crescente dei budget tecnologici aziendali.
  • I paesi privi di regioni nuvolose o di potere contrattuale rimangono soggetti al prezzo di mercato.

9.19.4 Indicatori di allerta precoce

  • I margini lordi rimangono elevati nonostante l’espansione della capacità produttiva;
  • Predominano i contratti di fornitura pluriennali;
  • I prezzi aziendali rimangono opachi;
  • Gli strumenti specifici del fornitore aumentano i costi di cambio;
  • I premi per la priorità e il lungo termine si espandono.

9.19.5 Eventi di invalidazione

  • Gli standard aperti di successo riducono significativamente il passaggio da una modalità all’altra;
  • I nuovi concorrenti nel settore delle fonderie o degli acceleratori conquistano quote di mercato considerevoli;
  • Gli enti regolatori impongono l’interoperabilità strutturale;
  • L’eccesso di offerta provoca una forte concorrenza sui prezzi.

9.20 Scenario C — Scarsità persistente

9.20.1 Presupposti

  • La domanda di inferenze supera le previsioni;
  • HBM, packaging, substrati e potenza rimangono limitati;
  • Le connessioni alla rete dei data center sono in ritardo;
  • Il modello di frontiera calcola per attività in aumento;
  • I prezzi delle attrezzature e i costi di finanziamento rimangono elevati;
  • L’espansione dell’offerta avviene più lentamente rispetto alla domanda.

9.20.2 Traiettoria annuale

Indicatore202620272028202920302031
Prezzo nominale dell’acceleratore100110121133146161
Prezzo HBM per GB100112120125128130
Capacità di imballaggio100115135155175195
prezzo dell’attività API completata con successo100105110115120125
Spese aziendali100150215300410540
GAImedia globale56.455,554,553,552,551
GAI Gini0,1930,2050,2180,2300,2400,250

9.20.3 Conseguenze

  • Le aziende razionano l’uso dell’IA e danno priorità alle attività con i margini di profitto più elevati.
  • I flussi di lavoro complessi basati su agenti diventano proibitivamente costosi per le PMI.
  • Studenti e ricercatori si affidano sempre più a livelli inferiori.
  • I paesi ricchi si assicurano la capacità produttiva attraverso contratti a lungo termine.
  • L’hardware locale usato mantiene un elevato valore di rivendita.
  • L’accesso alla rete elettrica e alla rete stessa diventa un fattore di differenziazione competitivo.

9.20.4 Indicatori di allerta precoce

  • HBM rimane esaurito per i prossimi dodici mesi;
  • I tempi di consegna per il confezionamento smettono di migliorare;
  • I progetti relativi ai data center subiscono ritardi a causa di problemi di alimentazione;
  • Si inaspriscono i limiti tariffari per i fornitori;
  • I premi per la capacità riservata aumentano;
  • I prezzi degli acceleratori usati rimangono al di sopra dei valori di riferimento.

9.20.5 Eventi di invalidazione

  • Un importante progresso in termini di efficienza dell’inferenza;
  • La crescita della domanda rallenta in modo significativo;
  • molteplici nuove fonti di capacità raggiungono rese elevate;
  • I modelli di piccole dimensioni sostituiscono i sistemi di frontiera nella maggior parte dei carichi di lavoro.

9.21 Scenario D — Un mondo dell’IA frammentato

9.21.1 Presupposti

  • I controlli sulle esportazioni si ampliano;
  • I paesi impongono norme sulla localizzazione dei dati e sulla sovranità;
  • i blocchi tecnologici adottano acceleratori e software incompatibili;
  • I servizi cloud transfrontalieri diventano politicamente condizionati;
  • Le sanzioni e le restrizioni sulle valute estere si intensificano;
  • I sussidi nazionali duplicano le infrastrutture.

9.21.2 Traiettoria annuale

Indicatore202620272028202920302031
prezzo medio globale di calcolo100105112118125132
dispersione dei prezzi tra i blocchi100130165205250300
Spese in conto capitale per infrastrutture duplicate100140190245305370
Interoperabilità API globale1009078675850
GAImedia globale56.455,855.254,854.354
GAI Gini0,1930,2100,2300,2500,2700,290

9.21.3 Conseguenze

  • I paesi alleati ricevono hardware e accesso al cloud differenti.
  • Le aziende globali utilizzano stack di intelligenza artificiale duplicati.
  • Aumentano i costi di conformità e di transizione.
  • I paesi con ecosistemi interni acquisiscono sovranità ma sacrificano parte dell’efficienza di scala.
  • Declino della collaborazione scientifica e della riproducibilità dei modelli.
  • I paesi più piccoli subiscono pressioni per allinearsi a un blocco tecnologico.

9.21.4 Indicatori di allerta precoce

  • nuove restrizioni sui semiconduttori basate sulla destinazione;
  • norme regionali in materia di licenze modello;
  • Mandati sovrani per il cloud;
  • standard nazionali di IA incompatibili;
  • Ritiro del modello transfrontaliero;
  • Aumento della duplicazione dei cluster di calcolo nazionali.

9.21.5 Eventi di invalidazione

  • accordi tecnologici multilaterali;
  • standard interoperabili efficaci;
  • Allentamento dei controlli sulle esportazioni;
  • ampia disponibilità di hardware competitivo proveniente da diverse giurisdizioni.

9.22 Scenario E — Utilità dell’IA e accesso finanziarizzato

9.22.1 Presupposti

  • la capacità di calcolo è considerata un servizio strategico prenotabile;
  • I prezzi variano in base alla latenza, al modello, al contesto, alla geografia e alla scarsità;
  • I mercati riservati, prioritari, a lotti e flessibili si rafforzano;
  • i fornitori vendono la capacità in anticipo;
  • I grandi utenti si tutelano dai futuri costi di elaborazione;
  • La capacità spot viene prezzata dinamicamente;
  • Espansione dei prezzi basati sul completamento delle attività e sui risultati ottenuti.

9.22.2 Traiettoria annuale

Indicatore202620272028202920302031
Indice standard dei prezzi di calcolo1009288858382
Moltiplicatore del prezzo prioritario1,5×1,7×2,0×2,3×2,6×3,0×
Sconto per acquisto in blocco50%52%55%58%60%62%
Quota di capacità riservata100135180230285350
Spese aziendali100140185235290350
GAImedia globale56.457585959,560
GAI Gini0,1930,2000,2080,2180,2270,235

9.22.3 Conseguenze

  • Le grandi aziende si tutelano contro i rischi legati alla capacità produttiva e ottengono un servizio prevedibile.
  • Le PMI pagano prezzi volatili a richiesta.
  • I settori sensibili alla latenza pagano premi considerevoli.
  • Le ricerche in batch e le attività di back-office diventano più economiche.
  • Le famiglie ricevono un servizio standard a basso costo, ma una priorità più elevata per le zone di frontiera.
  • I prodotti finanziari informatici creano rischi di controparte e di concentrazione.

9.22.4 Indicatori di allerta precoce

  • ampliamento dei livelli riservati e prioritari;
  • mercati della capacità di calcolo;
  • contratti a termine e impegni di spesa minima;
  • Prezzi dinamici per la congestione del traffico;
  • Fatturazione per attività e risultati;
  • istituzioni finanziarie che offrono copertura computazionale.

9.22.5 Eventi di invalidazione

  • L’abbondante capacità produttiva elimina i costi aggiuntivi dovuti alla scarsità;
  • La normativa vieta la discriminazione dinamica;
  • L’efficienza del modello rende superflua la prenotazione;
  • Il calcolo diventa troppo eterogeneo per i contratti standard.

9.23 Conseguenze a livello aziendale per scenario

Tipo di aziendaUNBCDE
microimpresaMiglioramento significativo dell’accessoDipendenza dall’abbonamentoRischio di esclusioneLacune nei servizi regionaliBollette di consumo variabili
NOICosto di ingresso inferioreVincolo del fornitorePressione sui marginiConformità duplicataNecessità di una pianificazione della capacità
Grande aziendaAmpia diffusionevantaggio contrattualegara a capacità riservataMultipli stack regionaliCopertura e ottimizzazione del portafoglio
Banca/assicuratoreMinori costi di analisiRischio concentrato da parte del fornitorePremi ad alta prioritàonere di localizzazione dei datiContratti di capacità finanziati
Assistenza sanitariaUso più ampio e convalidatoDipendenza dal fornitore aziendaleScarsità ad alta garanziaDivergenza del sistema nazionaleIl servizio prioritario diventa essenziale
ProduttoreIntelligenza artificiale di fascia bassa a basso costoIntegrazione della piattaformaRazionamento dell’hardwareframmentazione della catena di approvvigionamentoApprovvigionamento di risorse di calcolo a lungo termine
Istituto di ricercaSperimentazione più ampiaAccesso di frontiera a più livellidisuguaglianza nella pubblicazioneCollaborazione limitataSconti per acquisti in blocco ma priorità svantaggiata
GovernoServizi pubblici più ampipreoccupazione per la sovranitàRazionamento della capacitàpile nazionaliriserva di calcolo strategica

9.24 Conseguenze a livello familiare e distributivo

ScenarioEffetto domesticoeffetto studente/ricercatoreeffetto di disuguaglianza
UNPrezzi effettivi in ​​caloAmpio accesso avanzatoConvergenza
BAccesso base economico, frontiera premiumTiering persistenteDivergenza graduale
CPrezzi più alti e limiti più rigidiEsclusione graveForte divergenza
DL’accesso dipende dalla nazionalità e dal bloccoLa collaborazione internazionale è in declinodivergenza geografica
EAccesso base economico; accesso prioritario costoso.Gli utenti con esigenze di tempo limitato sono svantaggiatiLa discriminazione di prezzo aumenta

9.25 Cruscotto di allerta precoce

IndicatoreSegnale di abbondanzaSegnale di scarsità/frammentazione
tempi di consegna HBMScendendo sotto i sei mesiOltre dodici mesi
Utilizzo degli imballagginormalizzareCostantemente vicino al massimo effettivo
GPU street premiumInferiore al 5%Oltre il 25%
premio del mercato dell’usatoAmmortamento negativo/normalePremio positivo persistente
Listino prezzi APIAmpio declinoAumento della frontiera e della priorità
Sconto per acquisto in bloccoSi espandeContratti
coda di alimentazione del data centerAccorciaritardo pluriennale
Margini dei produttori di memorieNormalizzareRimanere eccezionalmente alto
Espansione della regione nuvolosaAmpia diffusione geograficaConcentrazione specifica del blocco
controlli sulle esportazioniStabile/strettoAmpliare per destinazione e capacità
RPO aziendaleStabilePrenotazione rapida a lungo termine
Lacuna di qualità del modello localeStrettoSi allarga
GAI GiniDeclinoAumenti
Distribuzione di calcolo per la ricercaSi allargaComplesso

9.26 Validazione del modello e aggiornamento annuale

Le previsioni dovrebbero essere aggiornate trimestralmente per le variabili di mercato e annualmente per le variabili nazionali e sociali.

L’errore di previsione è:

t = X t − X̂ t

Le metriche consigliate sono:

MAE = (1 ÷ n)Σ|e t |

RMSE = √[(1 ÷ n)Σe 2 ]

MAP = (100 ÷ n)Σ|e t ÷ X t

L’intervallo di copertura è:

Copertura = Numero di osservazioni all’interno dell’intervallo ÷ Numero totale di osservazioni

Se un intervallo dell’80% contiene un numero di osservazioni successive significativamente inferiore all’80%, il modello è eccessivamente sicuro di sé e le sue ipotesi sulla varianza devono essere riviste.


9.27 Conclusioni finali sulle previsioni

  1. È probabile che i prezzi nominali degli acceleranti diminuiscano molto più lentamente rispetto ai prezzi corretti in base alla qualità.
  2. HBM e packaging avanzato rimangono i principali colli di bottiglia nel settore dei semiconduttori almeno per il periodo iniziale delle previsioni.
  3. Nello scenario centrale, la capacità di confezionamento avanzato potrebbe quasi triplicare entro il 2031, ma la domanda potrebbe comunque superare l’offerta.
  4. Nello scenario centrale, la domanda di elettricità dei data center statunitensi potrebbe raggiungere circa 660 TWh entro il 2031, con un’ampia variabilità a seconda del modello utilizzato.
  5. È probabile che la domanda di servizi di inferenza cresca a un ritmo notevolmente più rapido rispetto alla capacità fisica, poiché i prezzi più bassi generano nuovi utilizzi.
  6. I costi delle API, al netto della qualità, possono diminuire di circa due terzi, mentre la spesa totale delle aziende per l’IA triplica.
  7. La spesa aziendale si sposterà sempre più dalle licenze sperimentali all’integrazione, alla governance, alla sicurezza, agli agenti e alla capacità riservata.
  8. Nel caso centrale, l’accessibilità economica dell’IA locale migliora solo lentamente perché la soglia di capacità adeguata continua ad aumentare.
  9. Anche se l’intelligenza artificiale di base diventasse ampiamente disponibile, è più probabile che la disuguaglianza globale nell’accesso all’IA aumenti modestamente piuttosto che crollare.
  10. Lo scenario A produce un’ampia convergenza ma richiede un successo simultaneo in termini di capacità, concorrenza, energia ed efficienza del modello.
  11. Lo scenario B rappresenta il caso strutturale centrale: l’offerta si espande mentre il potere contrattuale e l’accesso alle frontiere rimangono concentrati.
  12. Lo scenario C rimane plausibile perché la domanda può espandersi più rapidamente rispetto a quella di memoria, imballaggi, energia e costruzioni.
  13. Lo scenario D renderebbe la geografia e l’allineamento geopolitico fattori determinanti diretti per le capacità dell’IA.
  14. Lo scenario E è già parzialmente visibile nei livelli di servizio riservati, prioritari, a lotti e flessibili, sebbene un mercato completamente finanziarizzato non sia inevitabile.
  15. Gli intervalli di previsione sono necessariamente ampi perché tecnologia, domanda e politiche sono endogene. Intervalli ristretti sarebbero statisticamente fuorvianti.
  16. In pratica, i cinque scenari non si escludono a vicenda. Il mondo può presentare contemporaneamente abbondanza nei modelli di piccole dimensioni, oligopolio nei sistemi di frontiera, scarsità nell’HBM, frammentazione tra blocchi geopolitici e prezzi finanziarizzati per la capacità prioritaria.
  17. La variabile di monitoraggio decisiva non è il prezzo di listino di una GPU o di un milione di token. È il costo, ponderato in base alla qualità, di un carico di lavoro completato con successo, disponibile con la latenza, la privacy, l’affidabilità e la posizione geografica richieste.
  18. Il rischio dominante nei prossimi cinque anni è rappresentato dalla disponibilità a livelli differenziati: grandi quantità di informazioni di base a basso costo coesistono con capacità di frontiera scarse, costose e concentrate.

CAPITOLO 10 — Risposte politiche, opzioni strategiche e conclusioni finali

10.1 Tesi politica finale

Le prove raccolte in questo rapporto non supportano né il fatalismo tecnologico né l’affermazione più forte secondo cui tutto l’hardware per l’IA sarebbe diventato uniformemente più costoso, una volta tenuto conto delle prestazioni. La conclusione più plausibile è più specifica. La capacità di calcolo pura continua a migliorare rapidamente e i prezzi, corretti per la qualità, possono diminuire quando i carichi di lavoro si adattano ai vincoli di memoria, software e affidabilità dei sistemi più recenti. Allo stesso tempo, l’accesso economicamente vantaggioso all’IA dipende da più della semplice velocità di elaborazione aritmetica. La memoria degli acceleratori, la larghezza di banda della memoria, il packaging avanzato, la disponibilità di energia, la capacità dei data center, la qualità del modello, la lunghezza del contesto, la compatibilità del software, la privacy, la concorrenza e l’accesso a competenze complementari costituiscono un sistema di produzione congiunto. Pertanto, una diminuzione del prezzo per operazione teorica non garantisce una diminuzione del costo di completamento di un carico di lavoro reale. Gli utenti che necessitano di un’ampia capacità di memoria, inferenza sostenuta, elevata affidabilità, implementazione privata o qualità del modello all’avanguardia possono trovarsi ad affrontare un aumento della spesa assoluta anche se il prezzo per TFLOP diminuisce. Questa distinzione spiega perché famiglie, studenti e piccole organizzazioni possono subire una reale esclusione senza che ciò contraddica le curve di apprendimento dei semiconduttori. Il problema politico centrale non è una carenza universale di ogni singolo chip. Si tratta della concentrazione di capacità strategicamente complementari in un numero limitato di aziende, giurisdizioni, processi di fabbricazione, impianti di confezionamento, fornitori di memorie, regioni cloud ed ecosistemi software.

L’obiettivo politico appropriato non è quindi quello di rendere ogni organizzazione proprietaria di infrastrutture all’avanguardia. Ciò comporterebbe uno spreco di capitale, energia elettrica e manodopera specializzata. L’obiettivo dovrebbe essere quello di garantire un accesso competitivo, resiliente e conveniente a una capacità minima adeguata al carico di lavoro. L’intervento pubblico è giustificato quando una combinazione di indivisibilità, elevati costi fissi, esternalità positive della conoscenza, concentrazione del mercato, costi di switching, requisiti di privacy legati all’interesse pubblico e potere d’acquisto ineguale fa sì che gli utenti socialmente rilevanti ricevano meno risorse di calcolo di quelle che producono il massimo ritorno sociale. L’intervento deve tuttavia evitare di trasformare la scarsità in una dipendenza permanente dai sussidi o di proteggere i fornitori nazionali inefficienti dalla concorrenza. L’architettura raccomandata combina infrastrutture condivise, sussidi mirati alla domanda, interoperabilità, misurazione trasparente, appalti competitivi, riparazione e ristrutturazione, ricerca open-weight, investimenti nella rete e sostegno industriale strettamente condizionato. I sussidi all’offerta dovrebbero essere basati sul raggiungimento di traguardi, tecnologicamente neutri ove possibile, assegnati in modo competitivo e soggetti a clausole di recupero. I sussidi all’accesso dovrebbero essere rivolti a studenti, ricercatori, PMI e istituzioni di interesse pubblico, piuttosto che ridurre indiscriminatamente i prezzi per i maggiori acquirenti. L’applicazione delle norme sulla concorrenza dovrebbe basarsi su prove concrete: un’elevata concentrazione o margini elevati giustificano un’indagine, ma non sono sufficienti a dimostrare, di per sé, una condotta escludente, un coordinamento illecito o prezzi eccessivi.

La politica europea fornisce già le basi. La Commissione dichiara l’ambizione di mobilitare 200 miliardi di euro per l’IA, di cui 20 miliardi destinati a un massimo di cinque gigafactory per l’IA, mentre una rete in espansione di AI Factory è pensata per servire la ricerca, l’industria, le start-up e le PMI. AI Continent – ​​Commissione europea – 2026 — pagina ufficiale del programma . EuroHPC ha descritto separatamente investimenti che si avvicinano ai 2 miliardi di euro nelle AI Factory; i singoli progetti dimostrano la portata dell’iniziativa, incluso il sistema IT4LIA da 290 milioni di euro , finanziato in parti uguali da EuroHPC e dall’Italia. EuroHPC JU firma un contratto per potenziare le capacità di IA presso l’IT4LIA AI Factory – EuroHPC Joint Undertaking – aprile 2026 — annuncio di progetto verificato . Questi programmi dovrebbero essere considerati piattaforme infrastrutturali piuttosto che acquisti una tantum di macchinari. Le loro prestazioni economiche devono essere misurate attraverso l’utilizzo, i tempi di attesa, il completamento dei carichi di lavoro, la distribuzione geografica, la produzione di ricerca, la sopravvivenza delle PMI e la quota di capacità che raggiunge gli utenti che altrimenti non potrebbero acquistare un servizio equivalente.


10.2 Principi guida

Una politica di accesso difendibile dovrebbe superare sette test:

  1. Addizionalità: la spesa pubblica deve aggiungere capacità, concorrenza, resilienza o accesso che il mercato non sarebbe in grado di fornire a condizioni comparabili.
  2. Definizione delle capacità: l’idoneità deve dipendere dai requisiti di carico di lavoro, non dal numero di parametri o dalle etichette di marketing.
  3. Competibilità: le infrastrutture finanziate devono supportare molteplici framework, modelli e fornitori.
  4. Portabilità: gli utenti devono essere in grado di esportare dati, prompt, embedding, record di valutazione, artefatti di fine-tuning e metadati operativi in ​​formati documentati.
  5. Trasparenza dei costi: la misurazione deve separare l’inferenza del modello, l’archiviazione, il recupero, la rete, l’utilizzo degli strumenti, la capacità riservata e i premi di priorità.
  6. Responsabilità distributiva: i programmi devono segnalare chi riceve le risorse di calcolo, non solo l’utilizzo aggregato.
  7. Scadenza e revisione: i sussidi prevedono date di scadenza, valutazioni controfattuali e disposizioni di recupero nel caso in cui i beneficiari non rispettino gli obblighi di investimento, accesso o determinazione dei prezzi.

Il Data Act fornisce una base europea esistente per il passaggio al cloud e l’interoperabilità ed è in vigore dal 12 settembre 2025. Data Act Explained – Commissione europea – dicembre 2025 — spiegazione ufficiale . Il Digital Markets Act integra il diritto della concorrenza imponendo obblighi e divieti ai gatekeeper designati, ma la sua applicazione all’auto-preferenza relativa all’IA deve seguire l’ambito di applicazione e i criteri legali definiti dalla legge, anziché presumere che ogni fornitore di IA integrato verticalmente sia automaticamente coperto. Digital Markets Act – Commissione europea – 2026 — portale ufficiale del DMA .


10.3 Matrice di progettazione delle politiche: mandato, destinatari, costi e tempistiche

Tutti gli importi riportati di seguito sono stime di pianificazione , non stanziamenti approvati, a meno che non siano espressamente indicati come cifre ufficiali del programma.

Strumento politicoProblema affrontatobase giuridica o istituzionaleAutorità attuativaObiettivo principaleCosto pubblico stimatoPeriodo di implementazione
Infrastruttura di calcolo pubblicaCosti di capitale indivisibili; sottofinanziamento privato per la ricerca e carichi di lavoro di interesse pubblicoStatuti nazionali in materia di ricerca, industria e infrastrutture digitali; nell’UE, EuroHPC, Europa digitale e competenze di ricercaMinistero del digitale, Ministero della scienza, ente nazionale per il calcolo ad alte prestazioni, EuroHPCUniversità, enti di ricerca pubblici, PMI, ospedali, pubblica amministrazioneDa 100 milioni a 1 miliardo di euro per nodo nazionale; da 2 a 10 miliardi di euro per un sistema multi-nodo.2–5 anni
Cloud e gigafactory europee per l’intelligenza artificialeDipendenza dalle capacità dei paesi di frontiera extraeuropei; scala insufficienteRegolamento EuroHPC, Europa Digitale, Horizon Europe, finanziamenti compatibili con InvestAI, norme applicabili in materia di aiuti di StatoCommissione, EuroHPC JU, BEI, Stati membriRicerca europea, industria, start-up e carichi di lavoro sovraniTra i 10 e i 25 miliardi di euro di capitale pubblico e di condivisione del rischio aggiuntivo in cinque anni; l’ambizione ufficiale più ampia prevede 20 miliardi di euro per un massimo di cinque gigafactory.3–6 anni
risorse di calcolo universitarie condiviseApprovvigionamento frammentato e scarso utilizzo dei sistemi dipartimentali.Mandati di finanziamento universitario e della ricercaConsigli di ricerca e consorzi universitariStudenti, dottorandi e ricercatoriDa 25 a 300 milioni di euro per consorzio, più spese operative annuali pari a circa il 10-20% del CAPEX.1–4 anni
Buoni per l’accesso al computer per studentiEsclusione basata sul reddito dall’intelligenza artificiale avanzataLegislazione in materia di istruzione e pari opportunitàministeri dell’istruzione, università, agenzie di finanziamentoStudenti a basso reddito; persone con disabilità e con difficoltà linguisticheDa 250 a 1.000 euro per studente idoneo/anno6–18 mesi
Sovvenzioni per il calcolo scientificoI ricercatori all’inizio della carriera e quelli indipendenti non hanno potere d’acquistoAutorità pubblica per le sovvenzioni alla ricercaConsigli di ricerca e fondazioniRicercatori senza gruppi istituzionaliDa 2.000 a 20.000 euro per ricercatore all’anno ; finanziamenti più consistenti previsti da bandi competitivi per progetti ad alta intensità di calcolo.6–18 mesi
crediti d’imposta sugli investimentiLa capacità socialmente utile può essere ritardata da vincoli di finanziamentoCodice tributario; compatibilità con gli aiuti di Stato dell’UE, ove applicabile.Autorità del Tesoro e delle imposteCentri dati, packaging, memoria, elaborazione a basso consumo energeticoCredito pari al 10-25% dell’investimento incrementale ammissibile, con un limite fiscale giurisdizionale.1–3 anni
Acquisto cooperativoLe PMI e le università si trovano ad affrontare uno scarso potere contrattuale e procedure di appalto duplicate.Statuti in materia di appalti e cooperazioneOrganismi centrali di acquisto o consorzi di settorePMI, scuole, comuni, universitàDa 1 a 10 milioni di euro per l’amministrazione nazionale; da 20 a 50 milioni di euro per una piattaforma su scala europea.6–24 mesi
Programma modello a peso apertoDipendenza da servizi chiusi; scarsa copertura in lingua locale.Mandati di ricerca, cultura e innovazione digitaleenti di ricerca, laboratori pubblici, universitàRicercatori, PMI, servizi pubblici, comunità di lingua minoritariaDa 25 a 250 milioni di euro a livello nazionale o da 500 a 2 miliardi di euro a livello UE in cinque anni2–5 anni
Regole di interoperabilità e portabilitàBlocco di cloud, dati e flussi di lavoroLegge europea sulla protezione dei dati; legislazione nazionale in materia di dati e concorrenzaCommissione, autorità nazionali competenti, organismi di normazioneTutti i clienti aziendali e del settore pubblicoAmministrazione pubblica: da 20 a 100 milioni di euro a livello UE; costi di conformità privati ​​aggiuntivi.1–3 anni
Comunicazione standardizzata dei prezzi dell’IATariffe complesse nascondono i prezzi effettivi e i costi di cambio fornitore.Diritto dei consumatori, dei contratti, degli appalti e della trasparenza settorialeAutorità per la tutela dei consumatori, ente regolatore del settore digitale, agenzie di appaltoConsumatori, PMI e acquirenti pubbliciDa 5 a 20 milioni di euro per ciascuna giurisdizione principale, più i costi di conformità del fornitore.12–24 mesi
Unità di controllo della concorrenzaAsimmetria informativa e condotta verticale tecnicamente complessaArticoli 101 e 102 del TFUE; equivalenti nazionaliDG Concorrenza e autorità nazionali garanti della concorrenzaMercati per acceleratori, cloud, modelli e distribuzioneDa 50 a 200 milioni di euro in cinque anni, distribuiti su una rete di importanti autorità regionali.Immediato; permanente
Controllo rafforzato delle fusioniLe acquisizioni possono eliminare i concorrenti emergenti o chiudere gli input complementariRegolamento UE in materia di fusioni e legislazione nazionale in materia di fusioniCommissione e autorità nazionaliTransazioni relative a semiconduttori, cloud, intelligenza artificiale e dati.Incluso nel personale addetto all’applicazione della legge; analisi specialistica da 5 a 30 milioni di euro all’annoImmediato
Limitazione dell’auto-preferenza comprovataLe piattaforme integrate verticalmente possono svantaggiare i concorrentiDMA laddove legalmente applicabile; diritto della concorrenza altroveCommissione e autorità di regolamentazione digitaleUtenti aziendali e servizi di intelligenza artificiale concorrentiCosti di applicazione della legge inclusi sopraDa 1 a 3 anni per procedimento
Appalti pubblici basati sull’intelligenza artificialeGli appalti pubblici possono creare vincoli o premiare prezzi poco trasparenti.Direttive in materia di appalti e legislazione nazionale in materia di appalti pubblici.Organismi centrali di acquisto e autorità appaltantiAmministrazioni pubbliche, scuole, ospedaliRiforma amministrativa da 10 a 100 milioni di euro ; gli acquisti sottostanti rimangono spese di programma.1–3 anni
Investimenti nella rete elettrica e nella produzione di energia a basse emissioni di carbonio.L’alimentazione elettrica e l’interconnessione limitano l’espansione dei data center.Diritto dell’energia, delle reti e della pianificazioneMinistero dell’energia, autorità di regolamentazione e gestori della reteUtenti dell’intera economia, compresi i centri dati.Da 5 a 50 miliardi di euro a livello nazionale o da 50 a 250 miliardi di euro a livello regionale in cinque anni; solo una frazione attribuibile all’IA3–10 anni
Supporto per semiconduttori e packagingLa fabbricazione e il confezionamento avanzati sono concentrati geograficamenteLegge europea sui chip; legislazione industriale nazionaleCommissione, Stati membri, banche di sviluppofonderie, imballaggi, attrezzature, substratiDa 5 a 40 miliardi di euro per ciascun programma giurisdizionale principale4–10 anni
Diversificazione HBMOfferta limitata di prodotti qualificati e cicli di produzione lunghiQuadri normativi in ​​materia di industria, ricerca e sviluppo e aiuti di StatoMinistero dell’Industria, enti di ricerca, banche di sviluppoFabbricazione, confezionamento e materiali per la memoriaDa 2 a 15 miliardi di euro per programma4–8 anni
Diritto alla riparazione e a un supporto più lungoLa breve durata dell’hardware aumenta i costi effettivi di accesso e i rifiuti elettronici.Legislazione in materia di tutela dei consumatori, ecodesign e riparazioneAutorità a tutela dei consumatori e organismi di regolamentazione dei prodottiFamiglie, scuole, PMI e imprese di ristrutturazioneSpese amministrative comprese tra 20 e 100 milioni di euro ; costi di transizione del produttore aggiuntivi.2–5 anni
Mercato dei prodotti ricondizionati verificatiL’incertezza sulla qualità, le frodi e l’assenza di garanzie indeboliscono l’offerta secondariaDiritto in materia di sicurezza dei consumatori, garanzia e certificazioneente di normazione, autorità a tutela dei consumatori, enti di certificazione accreditatiUtenti a basso reddito, scuole, PMICosti di installazione, test di rete e riserva di garanzia facoltativa: da 25 a 150 milioni di euro.1–3 anni
Diritto all’utilizzo dell’IA a fini didattici e di ricercaUn’intelligenza artificiale adeguata potrebbe diventare un input educativo necessarioDiritto dell’istruzione e della ricerca; legislazione sul bilancio annualeministeri dell’istruzione e consigli di ricercaStudenti, insegnanti e ricercatori accreditatiDa 0,5 a 3 miliardi di euro all’anno per una giurisdizione di grandi dimensioni, a seconda della copertura.1–3 anni
Fondo internazionale per lo sviluppo dell’informaticaI paesi con reti deboli, limitazioni sui cambi o assenza di regioni cloud non possono finanziare l’accessoMandati della BIRS, dell’IDA e delle banche regionali di sviluppo; accordi con i donatoriBanca Mondiale, banche regionali di sviluppo, partner affiliati all’ITU e governi nazionalieconomie a basso e medio-basso redditoDa 10 a 30 miliardi di dollari in cinque anni2–7 anni

Metadati della tabella: Unità: spesa del programma o livello di beneficio. Valuta: EUR 2026, salvo diversa indicazione esplicita in USD. Base di prezzo: costo di pianificazione reale, escluso il cofinanziamento privato, salvo diversa indicazione. Anno di riferimento: 2026. Ambito geografico: UE e programmi nazionali o internazionali rappresentativi. Fonti: documenti ufficiali del programma citati in questo capitolo, oltre alle stime dell’autore. Metodo: scalatura di riferimento da progetti di calcolo ufficiali, progettazione del programma e conteggio dei beneficiari. Incertezza: generalmente ±50–100% poiché la configurazione degli impianti, le opere energetiche, la struttura di finanziamento e la copertura dei beneficiari non sono specificate.


10.4 Prestazioni, garanzie e fattibilità della politica

StrumentoBeneficio attesoKPI obbligatorioPrincipale conseguenza indesiderataMeccanismo di controllo della distorsioneFattibilità
Calcolo pubblicoAccesso a carichi di lavoro troppo grandi o sensibili per gli utenti ordinariLavori completati con successo; tempo di attesa; utilizzo; costo per carico di lavoro completato; quota assegnata agli utenti svantaggiatiAssegnazione politica, basso utilizzo, rapida obsolescenzaAsta di capacità indipendente; quote di accesso; valutazione esterna; riserva di ammortamentoElevato , se collegato alle istituzioni HPC esistenti
Cloud di intelligenza artificiale dell’UECapacità strategica e portata transfrontalieraOre di accelerazione erogate; portabilità del carico di lavoro; latenza regionale; quota PMI/ricercaDuplicazione, cattura nazionale, corsa ai sussidiSelezione competitiva dei siti; accesso transfrontaliero; interfacce aperte; clausole di recuperoMedio-alto
Condivisione universitariaMaggiore utilizzo e costi unitari inferioriIstituzioni attive; successo professionale; pubblicazioni; costo per risultato della ricercaDominio delle grandi universitàCapacità riservata e regole di coda trasparentiAlto
BuoniMiglioramento immediato dell’accessibilità economicaRiscatto; distribuzione del reddito degli utenti; risultati di apprendimento o di ricerca.I fornitori ottengono sussidi attraverso prezzi più altiIdoneità a più fornitori; tetti di prezzo; valutazione randomizzata o a fasiAlto
crediti d’impostaInvestimento acceleratoCapacità incrementale e addizionalità degli investimenti verificataGuadagni inattesi per progetti già pianificatiTest di base, limiti, scadenza e recuperoMezzo
Acquisto cooperativoPrezzi più bassi e minore complessità contrattualeSconto rispetto a contratti individuali comparabili; tariffa di cambioEccessiva standardizzazione attorno a un unico fornitoreApprovvigionamento multi-lotto e quadri di riferimento multi-fornitoreAlto
Supporto a peso liberoControllo locale, ricadute della ricerca e inclusione linguisticaParametri di riferimento riproducibili; adozione; copertura linguistica; test di sicurezza documentatiFinanziamento di modelli a basso utilizzo; uso improprio legato al rilascioTraguardi, schede modello, revisione della sicurezza e valutazione dell’utilizzoAlto
PortabilitàCosti di passaggio inferiori e concorrenza più agguerritaTempo di migrazione, costi di uscita e tasso di successo dell’esportazioneConformità formale superficialeTest di conformità e standard di esportazione leggibili da macchinaAlto
Informativa sui prezzicosti effettivi comparabiliPercentuale di offerte che riportano i prezzi standard per i carichi di lavoroCarichi di lavoro di benchmark per il gamingCarichi di lavoro e diritti di audit multipli per i rappresentantiAlto
Unità di competizioneMigliore capacità di identificare il pignoramento e l’esclusioneIndagini completate; soluzioni adottate; risparmi misurati per i clienti.Eccessiva deterrenza all’integrazione e agli investimentiValutazione basata sugli effetti e controllo giurisdizionaleAlto
Esame delle fusioniPreservare la concorrenza futura e l’accesso ai fattori produttiviCasi esaminati; rimedi monitorati; risultati in termini di prezzi e innovazione post-fusione.Transazioni efficienti ritardateScadenze, teorie trasparenti sul danno e rimedi mirati.Alto
controlli di auto-preferenzaAccesso neutrale laddove sia accertata la discriminazione.Parità di classificazione/accesso; differenze di rifiuto e latenzaEquivalenza forzata tra servizi non equivalentiTest di equivalenza tecnica ed eccezioni di sicurezzaMedio-alto
Riforma degli appaltiMinore vincolo e costi del ciclo di vita ridottiConformità alle interfacce aperte; costo totale di transizione; diversità dei fornitoriLe gare d’appalto complesse svantaggiano le PMIClausole standard, assegnazione dei lotti e assistenza agli appaltiAlto
Base di grigliaElimina i vincoli fisici e limita gli shock di prezzoTempi di connessione; capacità garantita; emissioni e affidabilitàI costi vengono socializzati mentre i benefici si concentranoCosti di connessione e segnali di localizzazione dei beneficiariMedio , a causa dei lunghi tempi di consegna
Supporto per semiconduttoriMaggiore resilienza e capacità tecnologicaProduzione qualificata, rendimento, co-investimenti privati ​​e diversificazione della clientelaCorsa internazionale ai sussidi e impianti bloccatiErogazione a tappe, accesso aperto e recupero dei fondiMezzo
Diversificazione HBMRiduzione della dipendenza da un singolo puntoCapacità, rendimento e numero di fornitori HBM qualificatiLa tecnologia diventa obsoleta prima che la scalabilitàFinanziamento a fasi, vincolato alla qualificazione del cliente.Medio-basso
diritti di riparazioneMinori costi totali di gestione e riduzione dei rifiuti elettronici.Punteggio di riparabilità; disponibilità dei pezzi di ricambio; durata del dispositivoRischi per la sicurezza o la sicurezza informatica derivanti da componenti non supportatiNorme di riparazione qualificate e obblighi di sicurezza del firmwareAlto
Certificazione ricondizionataFornitura affidabile a basso costoTasso di guasto, richieste di garanzia, prezzo di rivendita e durata del dispositivoLa certificazione grava sulle piccole imprese di ristrutturazioneTariffe a scaglioni e sostegno ai test pubbliciAlto
Diritto all’intelligenza artificialeCapacità minime di istruzione e ricercaAccesso degli utenti idonei, successo nell’attività e divario di rendimentoDipendenza dal fornitore; spostamento dell’insegnamentoPlurialità dei fornitori, requisiti in materia di privacy e valutazione della pedagogiaMedio-alto
Fondo internazionaleInfrastrutture e capacità nei paesi svantaggiatiUlteriori risorse di calcolo affidabili, utenti qualificati, copertura in lingua locale e risultati a beneficio del pubblico.Peso del debito, sistemi importati senza capacità localiFinanziamenti in gran parte a fondo perduto, riserve di manutenzione e formazione localeMezzo

Metadati della tabella: Unità: fattibilità qualitativa più KPI specifici del programma. Valuta e base di prezzo: non applicabile; i costi sono nella tabella precedente. Anno di riferimento: valutazione ad agosto 2026. Ambito: attuazione internazionale, UE e nazionale. Fonte: fonti legali e programmatiche ufficiali citate nel presente documento; valutazione analitica del presente rapporto. Metodo: screening di fattibilità istituzionale e fallimento del mercato. Incertezza: qualitativa, circa una categoria di fattibilità in entrambe le direzioni.

10.4.1 Calcolo pubblico e condiviso

Il calcolo pubblico dovrebbe funzionare come un grossista di capacità con obblighi di interesse pubblico, non come un cloud privato permanentemente gratuito. Università, ricercatori accreditati, start-up e istituzioni pubbliche sensibili alla privacy dovrebbero ricevere un’assegnazione iniziale basata sul merito del progetto e sull’impossibilità di acquisire risorse equivalenti. Gli utenti commerciali più grandi dovrebbero normalmente pagare una tariffa trasparente che copra i costi. L’assegnazione dovrebbe combinare capacità riservata all’interesse pubblico, sovvenzioni competitive e accesso spot a risorse altrimenti inutilizzate. Il sistema contabile deve pubblicare il costo totale per ora di accelerazione e per carico di lavoro di riferimento completato, inclusi energia, manutenzione, personale e ammortamento. Un sistema pubblico apparentemente economico potrebbe altrimenti nascondere un basso utilizzo o passività di sostituzione non finanziate.

Il bando EuroHPC AI Factory fornisce un utile dato empirico. L’Unione ha messo a disposizione fino a 400 milioni di euro per supercomputer nuovi o aggiornati ottimizzati per l’IA, supportando costi totali di acquisizione fino a 800 milioni di euro , con ulteriore supporto da parte di Horizon Europe per i servizi AI Factory. EuroHPC Joint Undertaking lancia i bandi AI Factory – EuroHPC Joint Undertaking – Settembre 2024 — annuncio ufficiale del bando . Questi importi dimostrano perché l’acquisto condiviso sia economicamente preferibile alla duplicazione di cluster dipartimentali sottoutilizzati. Non dimostrano, tuttavia, che ogni installazione finanziata generi un beneficio sociale netto. La pubblicazione delle distribuzioni delle code, dei tassi di fallimento dei job, dei risultati dei carichi di lavoro e dell’allocazione della capacità è essenziale.

10.4.2 Voucher e diritti di accesso

I voucher per l’informatica dovrebbero essere denominati in unità di servizio ponderate per la qualità, anziché essere vincolati a un fornitore specifico. Il diritto degli studenti a usufruire di un pacchetto base protetto di servizi di inferenza, analisi documentale, codifica e accessibilità, con stanziamenti maggiori per corsi tecnici o per esigenze di supporto legate alla disabilità. I ​​finanziamenti per la ricerca dovrebbero sostenere carichi di lavoro verificati, inclusa l’implementazione locale laddove la privacy, la proprietà intellettuale o la riproducibilità della ricerca lo giustifichino. La progettazione dei voucher dovrebbe evitare una semplice percentuale di rimborso, che favorisce gli utenti che possono prima finanziare la spesa rimanente. Crediti prepagati, intermediazione istituzionale e compartecipazione alla spesa in base al reddito sono soluzioni più inclusive.

Un programma di voucher dovrebbe essere sospeso o riprogettato quando oltre il 25% del suo valore è assorbito da aumenti di prezzo rispetto ai clienti non trattati, quando meno di tre fornitori alternativi soddisfano lo standard o quando i risultati misurati in ambito educativo o di ricerca non migliorano dopo due cicli di valutazione. L’accesso all’IA dovrebbe diventare un diritto solo a una capacità minima adeguata, non un diritto illimitato al modello di frontiera più costoso. Tale diritto deve rimanere tecnologicamente neutrale e suscettibile di essere soddisfatto tramite sistemi pubblici condivisi, servizi cloud competitivi, implementazioni open-weight approvate o modalità di erogazione ibride.

10.4.3 Concorrenza, portabilità e trasparenza dei prezzi

Le autorità garanti della concorrenza devono distinguere il controllo dei colli di bottiglia dal successo competitivo. Le autorità dovrebbero raccogliere prove a livello di transazione su sconti, prenotazioni di capacità, rifiuti di fornitura, crediti cloud, tariffe di uscita, guasti di interoperabilità, classificazione, bundling e discriminazione tra servizi a valle affiliati e indipendenti. Un elevato indice HHI o un margine elevato possono giustificare un’indagine, ma non possono stabilire un’infrazione senza un mercato definito, una teoria del danno e prove degli effetti.

La valutazione delle fusioni dovrebbe esaminare le attività complementari piuttosto che limitarsi alla sovrapposizione orizzontale. Una piccola acquisizione può incidere significativamente sulla concorrenza quando l’azienda target controlla un compilatore, un livello di ottimizzazione dei modelli, un set di dati, una tecnologia di interconnessione, un intermediario di capacità o un canale di distribuzione necessari ai fornitori concorrenti. La Commissione sta rivedendo le proprie linee guida in materia di fusioni per mantenere un quadro basato su dati concreti e adattato alle mutevoli condizioni competitive. Revisione delle linee guida in materia di fusioni – Commissione europea, DG Concorrenza – 2026 — pagina ufficiale della revisione .

La divulgazione standardizzata dei prezzi dovrebbe richiedere ai fornitori di segnalare:

  • prezzo effettivo per milione di token di input e output;
  • trattamento degli input memorizzati nella cache;
  • Premi legati alla lunghezza del contesto e al ragionamento;
  • Costi di stoccaggio, recupero e utilizzo degli strumenti;
  • impegni di capacità riservata;
  • garanzie di livello di servizio;
  • costi di uscita e migrazione;
  • prezzi per una serie di carichi di lavoro di riferimento verificati;
  • regole di conservazione della versione del modello;
  • periodi di preavviso per le modifiche unilaterali dei prezzi.

Lo standard di trasparenza non dovrebbe imporre un prezzo regolamentato. Il suo scopo è quello di rendere visibile il prezzo totale effettivo e ridurre la dipendenza da informazioni privilegiate.

10.4.4 Riparazione, ristrutturazione e durata delle apparecchiature

La riparazione e il ricondizionamento certificato sono politiche di distribuzione oltre che misure ambientali. Ampliano l’offerta di hardware di seconda mano performante, riducono il costo annuale di proprietà e consentono a scuole o piccole organizzazioni di ottenere sistemi con maggiore capacità di memoria rispetto a quanto consentito dai budget per i nuovi dispositivi. La certificazione dovrebbe testare la memoria, la stabilità termica, l’integrità dello storage, l’alimentazione, l’integrità del firmware e le prestazioni sostenute con carichi di lavoro di intelligenza artificiale. I dispositivi certificati dovrebbero essere coperti da una garanzia minima e indicare l’eventuale utilizzo precedente in ambito aziendale o con cicli di lavoro intensivi.

La direttiva UE sulla riparazione è stata adottata nel giugno 2024 e si applica a livello nazionale a partire dal 31 luglio 2026. Direttiva sulla riparazione dei beni – Commissione europea – giugno 2024 — portale ufficiale della direttiva . I computer e i componenti rilevanti per l’intelligenza artificiale dovrebbero essere integrati attraverso norme specifiche di riparabilità del prodotto, relative ai pezzi di ricambio e al supporto del firmware, laddove la portata legale lo consenta. I requisiti non devono obbligare i produttori a supportare configurazioni non sicure a tempo indeterminato, ma il ritiro del firmware non deve diventare un metodo artificiale per abbreviare la vita utile.

10.4.5 Politiche relative a semiconduttori, imballaggi, memorie ed energia

I sussidi industriali dovrebbero concentrarsi sui colli di bottiglia che, con ogni probabilità, rimangono critici anche dopo aver considerato l’incertezza della domanda e della tecnologia. Il packaging avanzato, la qualificazione HBM, i substrati, gli interposer, l’elettronica di potenza e la capacità di test possono generare una maggiore resilienza a breve termine per euro pubblico investito rispetto al tentativo di replicare ogni singolo livello della fabbricazione all’avanguardia. L’European Chips Act è entrato in vigore nel settembre 2023 e si concentra espressamente sulla capacità di progettazione, produzione e packaging avanzato, sulla resilienza e sulla riduzione delle dipendenze. European Chips Act – Commissione europea – settembre 2023 — pagina ufficiale della politica .

I sussidi devono includere:

  • capacità misurabile e traguardi di rendimento;
  • co-investimento privato;
  • accesso non discriminatorio ai clienti;
  • obblighi di continuità dell’approvvigionamento durante i periodi di carenza;
  • restrizioni sul trasferimento di beni sovvenzionati;
  • rimborso per mancata consegna;
  • impegni in materia di sviluppo della forza lavoro;
  • divulgazione di altri aiuti pubblici;
  • condizioni ambientali e di connessione alla rete.

Investire nella rete elettrica è un prerequisito, non un sussidio per l’intelligenza artificiale. I data center dovrebbero pagare tariffe di connessione che riflettano i costi effettivi e dover affrontare segnali di localizzazione laddove la capacità è scarsa. Le autorità pubbliche non dovrebbero riservare l’elettricità sovvenzionata a carichi di lavoro di basso valore o facilmente trasferibili, mentre le famiglie e le industrie produttive sopportano i costi della congestione. La nuova capacità dovrebbe quindi essere valutata in base al valore sociale per megawatt disponibile, ai requisiti di affidabilità, alla flessibilità e al calore recuperabile o ai servizi ancillari di rete.

10.4.6 Paesi a basso reddito e sviluppo internazionale

Il fondo internazionale raccomandato dovrebbe finanziare non solo acceleratori importati, ma anche soluzioni che vadano oltre l’importazione. Un pacchetto valido dovrebbe includere fornitura affidabile di energia elettrica, raffreddamento, connettività, sicurezza informatica, personale tecnico locale, protezione dal rischio di cambio, accesso a fini formativi e manutenzione a lungo termine. I Paesi che non presentano una domanda sufficiente a giustificare l’utilizzo di un cluster nazionale dovrebbero ricevere un accesso federato ai sistemi regionali, capacità cloud negoziata e infrastrutture edge a bassa latenza. Il finanziamento tramite sovvenzioni è preferibile per l’istruzione, la ricerca e i servizi pubblici essenziali; le strutture commerciali che generano reddito possono utilizzare prestiti agevolati o garanzie.

Il quadro di sviluppo della Banca Mondiale considera la potenza di calcolo, la connettività, i dati e le competenze come elementi complementari, piuttosto che come input intercambiabili. (Digital Progress and Trends Report 2025: Strengthening AI Foundations – World Bank – 2025 — pubblicazione ufficiale ). Anche l’ITU documenta persistenti differenze in termini di connettività e adozione digitale. (Facts and Figures 2025 – International Telecommunication Union – 2025 — portale ufficiale delle statistiche ). Finanziare acceleratori senza questi elementi complementari può portare alla creazione di installazioni costose e sottoutilizzate e a una rinnovata dipendenza da manutenzione e software esteri.


10.5 Portafoglio di politiche per stakeholder

Portatore di interesseazione prioritariaAzione di seconda prioritàAzione da evitare
governi nazionaliCalcolo condiviso per l’interesse pubblico più pianificazione della grigliaBuoni mirati e standard di riparazione/ristrutturazioneSovvenzioni hardware non mirate senza obblighi di accesso
istituzioni europeeRete interoperabile EuroHPC/AI FactoryAllocazione transfrontaliera delle capacità e investimenti per strozzatureCloud nazionali frammentati, incapaci di scambiare i carichi di lavoro.
Concorrenza internaCapacità specialistica di indagine tecnica ed economicaRevisione della fusione di asset complementari e analisi dei costi di transizioneConsiderare la sola concentrazione come prova di illegalità
UniversitàApprovvigionamento federato, pianificazione del carico di lavoro e contabilità dei costiAssegnazione minima di accesso per studenti/ricercatoriNumerosi gruppi dipartimentali a basso utilizzo
Organizzazioni di ricercaParametri di riferimento riproducibili e artefatti di ricerca apertiinfrastruttura ibrida attenta alla privacySelezione dei modelli basata esclusivamente sul numero di parametri
Grandi aziendeCriteri di ritorno sull’investimento (ROI) a livello di carico di lavoro e architettura multi-providerTest di portabilità e misurazione internaImplementazione generalizzata dell’IA basata sulla moda strategica
StradeAcquisto cooperativo e specializzazione in modellismo/RAG (Rapid Action Group)Massimi di spesa contrattuali e piani di uscitaModelli di frontiera per compiti che i sistemi delimitati completano adeguatamente
ScuoleDiritto di accesso gestito dagli insegnantiPrivacy, accessibilità e valutazione dei risultati di apprendimentoSostituire le istruzioni con un utilizzo incontrollato dei chatbot
Scelta civileAudit di accesso indipendenti e monitoraggio dei prezziSostegno ai gruppi vulnerabili e alle lingue minoritariePresupponendo che i livelli gratuiti forniscano un’equivalenza di funzionalità
Paesi a basso redditoInfrastrutture regionali e pool di capacità negoziatiCompetenze locali, risorse linguistiche e riserve per la manutenzioneCluster di prestigio finanziati tramite debito senza domanda di utilizzo
istituzioni di sviluppoinfrastrutture di base fortemente dipendenti da sovvenzioniAppalti pubblici aperti ed erogazione dei fondi basata sui risultati.Finanziamenti vincolati al fornitore che riproducono il lock-in

Metadati della tabella: Unità e valuta: non applicabile. Anno di riferimento: 2026. Ambito: strategia istituzionale. Fonte: sintesi dei capitoli 1-9 e fonti ufficiali citate nel capitolo 10. Metodo: prioritizzazione in base al beneficio atteso in termini di accesso, velocità di implementazione e rischio di distorsione. Incertezza: qualitativa.


10.6 Regole decisionali quantitative

Le politiche dovrebbero essere innescate da condizioni osservabili piuttosto che da preoccupazioni generali. Sia:

AAI g,t = Costo annuale di un accesso adeguato all’IA per il gruppo g al tempo t / Risorse disponibili mediane del gruppo g al tempo t

CapabilityGap g,t = SuccessRate frontier,t − SuccessRate accessible,g,t

QueueStress t = Tempo di attesa mediano per il carico di lavoro di interesse pubblico ammissibile / Tempo di attesa massimo accettabile dal punto di vista operativo

PortabilitàFallimento t = Migrazioni fallite o materialmente incomplete / Migrazioni controllate tentate

Le soglie di intervento dovrebbero includere:

  • Studenti o persone a basso reddito con reddito medio superiore al 5% : revisione mirata dei voucher;
  • AAI superiore al 10% : presuntiva idoneità al supporto all’accesso;
  • Divario di competenze verificato superiore a 20 punti percentuali in compiti essenziali di istruzione o ricerca: intervento per ridurre il livello minimo di competenze;
  • Se il livello di stress della coda di ricerca pubblica supera 1,5 per due trimestri consecutivi: è necessaria una riforma in materia di acquisizione o allocazione delle capacità;
  • Guasti di portabilità superiori al 10% : indagine sulla conformità;
  • Costi di cambio fornitore superiori al 20% della spesa annuale per l’IA : revisione dei contratti e dell’interoperabilità;
  • un aumento effettivo del prezzo verificato superiore all’inflazione al consumo di 15 punti percentuali senza miglioramenti documentati del modello o del servizio: maggiore trasparenza e indagine di mercato;
  • Tempi di consegna degli input critici superiori a 12 mesi combinati con un utilizzo della capacità superiore al 90% : valutazione degli investimenti in resilienza.

Queste soglie sono regole decisionali, non affermazioni secondo cui un intervento genererà automaticamente un beneficio netto. Ogni programma richiede comunque un’analisi controfattuale e un’analisi costi-benefici.


10.7 Risposte esplicite alle domande centrali del rapporto

1. L’hardware rilevante per l’intelligenza artificiale è davvero diventato meno accessibile?

Per gruppi di utenti e configurazioni importanti, sì; per l’hardware inteso come categoria omogenea, le evidenze non supportano una risposta universale. I prezzi di ingresso nominali, gli elevati requisiti di memoria, i costi dei sistemi complementari e le differenze di reddito possono ridurre l’accessibilità economica anche quando le prestazioni per unità di calcolo migliorano. Un’implementazione locale equivalente a quella di Frontier è sostanzialmente meno conveniente rispetto alla semplice esecuzione di un piccolo modello quantizzato.

2. L’aumento è nominale, corretto per la qualità o entrambi?

L’aumento è chiaramente nominale in determinate categorie e periodi ad alta domanda . È inoltre adeguato alla qualità laddove i costi di memoria, larghezza di banda, affidabilità o carico di lavoro completato peggiorano rispetto al requisito. In genere non è adeguato alla qualità quando il denominatore è solo il throughput teorico. La conclusione cambia a seconda della misura della qualità, motivo per cui il prezzo per carico di lavoro completato con successo è preferibile al solo prezzo di listino o al TFLOP.

3. L’inflazione del mercato dell’usato è sistematica?

Le prove a disposizione confermano una scarsità episodica e specifica per determinati prodotti , in particolare per i dispositivi legacy con elevata memoria, a basso consumo energetico o con funzionalità eccezionali. Non dimostrano, tuttavia, che l’hardware AI usato venga generalmente scambiato a prezzi doppi o tripli rispetto al prezzo di listino originale, indipendentemente dal paese e dall’anno di produzione. Tali rapporti dovrebbero essere riportati come osservazioni verificate, non come la condizione media del mercato, finché i dati a livello di singola transazione non ne stabiliranno la rappresentatività.

4. Quali sono i colli di bottiglia più critici?

La massima importanza sistemica risiede nelle tecnologie di fabbricazione all’avanguardia, nella litografia avanzata, nell’HBM, nel packaging avanzato, nei substrati e negli interposer, nelle interconnessioni ad alta velocità, nelle apparecchiature di alimentazione, nelle connessioni di rete e negli ecosistemi software specializzati . La loro criticità riflette sia la concentrazione che la limitata possibilità di sostituzione a breve termine.

5. La concentrazione genera un potere di determinazione dei prezzi dimostrabile?

Crea la capacità e l’incentivo per il potere di determinazione dei prezzi , ma la concentrazione e la redditività da sole non ne dimostrano l’esercizio o l’illegalità. La dimostrazione richiede prove di margini persistentemente superiori a uno scenario controfattuale difendibile, discriminazione nei confronti dei clienti, limitazione della capacità produttiva, preclusione, barriere al passaggio a fornitori diversi da quelli di costo o risposte di prezzo incoerenti con l’innovazione e il rischio.

6. I prezzi attuali dei servizi di intelligenza artificiale sono economicamente sostenibili?

I servizi di inferenza di base e ampiamente utilizzati potrebbero essere sostenibili. Gli abbonamenti di frontiera, il ragionamento a lungo termine e i servizi promozionali a prezzi aggressivi rimangono incerti perché i documenti pubblici generalmente non isolano completamente gli aspetti economici a livello di modello. Gli investimenti e gli ammortamenti a livello di fornitore implicano che i prezzi dei token attualmente pubblicati non possono essere automaticamente considerati prezzi di equilibrio a lungo termine.

7. Di quanto potrebbe aumentare la spesa aziendale per l’intelligenza artificiale entro il 2031?

Utilizzando gli scenari indicizzati del Capitolo 9, la spesa aggregata per l’IA aziendale aumenta da 100 nel 2026 a circa:

  • 185 nel caso minimo: +85% ;
  • 300 nel caso centrale: +200% ;
  • 590 nel caso più elevato: +490% .

Si tratta di previsioni di spesa, non di pure previsioni di prezzo unitario. Esse combinano adozione, intensità di utilizzo, mix di modelli, governance, infrastrutture e costi del lavoro.

8. L’intelligenza artificiale locale può rimanere realistica?

Sì, per carichi di lavoro circoscritti, sensibili alla privacy e ripetibili. È meno realistico come sostituto universale per servizi di frontiera continuamente aggiornati, soprattutto laddove sono richiesti molti utenti simultanei, contesti molto lunghi o multimodalità prossima alla frontiera.

9. Cosa si intende per intelligenza artificiale locale realmente utilizzabile?

Un sistema è utilizzabile solo quando soddisfa una soglia specifica per il carico di lavoro per:

  • successo del compito e affidabilità fattuale;
  • contesto sufficiente e memoria utilizzabile;
  • token accettabili al secondo;
  • tempo limitato per il primo token;
  • concorrenza richiesta;
  • tempo di attività operativa;
  • privacy e tracciabilità;
  • costi energetici gestibili;
  • Aggiornamenti software e di modello gestibili.

Caricare i pesi in memoria è necessario ma non sufficiente.

10. Gli studenti e i ricercatori che non hanno accesso alle aree di frontiera sono svantaggiati?

Le prove supportano uno svantaggio credibile e verificabile , in particolare nella codifica, nel lavoro multilingue, nella sintesi di documenti, nel ragionamento avanzato e nell’iterazione rapida. L’entità di tale svantaggio non è ancora universalmente stabilita poiché gli studi causali longitudinali rimangono limitati. La conclusione appropriata è che si tratta di uno svantaggio misurabile a livello di singola attività, con prove incomplete sugli effetti a lungo termine sull’apprendimento.

11. Quali paesi e gruppi sono maggiormente esposti al rischio?

Coloro che hanno un basso reddito disponibile, valute deboli, dazi doganali, elettricità inaffidabile, banda larga limitata, latenza elevata, assenza di una regione cloud nelle vicinanze, restrizioni all’esportazione e scarso supporto nelle lingue locali. All’interno dei singoli paesi, l’esposizione è maggiore per studenti a basso reddito, ricercatori indipendenti, utenti rurali, piccole organizzazioni, comunità di lingua minoritaria e istituzioni che pongono la privacy al centro e non dispongono di budget per le infrastrutture.

12. L’intelligenza artificiale potrebbe aggravare la disuguaglianza globale?

Sì. L’IA integra manodopera qualificata, dati, capitale e capacità organizzativa, consentendo agli utenti inizialmente avvantaggiati di moltiplicare i propri benefici. Lo scenario centrale del Capitolo 9 ha aumentato l’indice di Gini illustrativo per l’accesso all’IA da 0,193 nel 2026 a 0,215 nel 2031 ; il caso di divergenza ha raggiunto circa 0,290 . Al contrario, modelli a basso costo e accesso condiviso possono ridurre le disuguaglianze se i livelli minimi di capacità migliorano più rapidamente di quanto aumentino i costi di frontiera.

13. L’analogia tra “intelligenza artificiale e Bitcoin” è difendibile?

Solo in senso stretto. La potenza di calcolo può essere scarsa, misurata, riservata e soggetta a prezzi dipendenti dalla domanda. A differenza del Bitcoin, tuttavia, la potenza di calcolo è eterogenea, deprezzabile, dipendente dalla posizione, deperibile quando inattiva, prodotta in modo continuo e inseparabile da memoria, energia, rete e software. È quindi più corretto intenderla come un servizio di capacità differenziato o un input industriale simile all’elettricità, piuttosto che come una riserva di valore standard.

14. Quali interventi ampliano l’accesso senza soffocare l’innovazione?

Il portafoglio più solido combina:

  • risorse di calcolo condivise per l’interesse pubblico;
  • voucher mirati per studenti e ricercatori;
  • acquisti cooperativi;
  • portabilità e interfacce aperte;
  • Informativa standard sui prezzi;
  • ricerca aperta e in lingua locale;
  • riparazione e ristrutturazione verificata;
  • applicazione delle norme sulla concorrenza basata su dati concreti;
  • Investimenti nella rete e nella risoluzione dei colli di bottiglia;
  • Supporto industriale assegnato tramite concorso e basato sul raggiungimento di obiettivi.

Queste misure aumentano la domanda e la contendibilità senza imporre controlli generali sui prezzi.

15. In quali condizioni l’avvertimento contenuto nel rapporto si rivelerebbe errato?

L’avvertimento principale risulterebbe sostanzialmente smentito se, entro il 2031:

  • Il costo per carico di lavoro rappresentativo completato, corretto per la qualità, è diminuito di almeno il 70% a partire dal 2026;
  • L’indice di Gini globale per l’accesso all’IA è sceso a 0,15 o al di sotto ;
  • Nei paesi a basso reddito e tra la popolazione studentesca, il costo per garantire un accesso adeguato è sceso al di sotto del 3% delle risorse disponibili mediane;
  • il divario tra le capacità di frontiera e quelle di base è sceso al di sotto dei 15 punti percentuali per quanto riguarda i compiti essenziali;
  • Il tempo medio di consegna per acceleratori critici, HBM e packaging è sceso sotto i sei mesi ;
  • La migrazione del fornitore, sottoposta a verifica, ha avuto successo in almeno il 95% dei casi senza perdite funzionali significative;
  • nessun livello strategicamente essenziale ha mantenuto sia l’indice HHI al di sopra di 2.500 sia margini persistentemente superiori alla norma non supportati da innovazione, rischio o recupero di capitale;
  • Almeno il 90% degli studenti e dei ricercatori accreditati ha ottenuto un accesso adeguato e affidabile all’intelligenza artificiale.

10.8 Quadro di classificazione finale del rischio

ClassificazioneGini con accesso all’IAL’onere economico di un accesso adeguato per i gruppi espostidivario nelle capacità relative ai compiti essenzialicondizione di fornitura strutturale
LimitatoInferiore a 0,10Inferiore al 3%Meno di 10 punti percentualiTempi di consegna critici inferiori a 6 mesi; ampia possibilità di sostituzione
Moderare0,10–0,153–5%10–20 puntiColli di bottiglia occasionali; nessuna scarsità multilivello persistente
AltoOltre 0,15–0,22Oltre il 5-10%Oltre 20–35 puntiConcentrazione persistente o tempi di preavviso di 9-12 mesi negli strati critici
AcutoOltre 0,22–0,30Oltre il 10-20%Oltre 35–50 puntiCR4 superiore all’80% o HHI superiore a 2.500 su almeno tre livelli complementari, con tempi di consegna superiori a 12 mesi
SistemicoOltre 0,30Oltre il 20%Oltre 50 puntiInterruzione dell’accesso in più regioni, razionamento prolungato o esclusione di oltre il 25% degli utenti qualificati dai carichi di lavoro essenziali

Metadati della tabella: Unità: rapporti, percentuale di risorse disponibili, divario di riferimento in punti percentuali e indicatori della struttura del mercato. Valuta: non applicabile. Base di prezzo: costo di accesso annuo adeguato al potere d’acquisto reale del 2026. Anno di riferimento: baseline 2026, orizzonte di valutazione 2031. Ambito: popolazione globale e popolazione di utenti esposti. Fonte: soglie definite dal presente rapporto utilizzando i risultati dei capitoli 3, 7, 8 e 9. Metodo: regola di classificazione del rischio multidimensionale; la dimensione persistente più elevata determina la classificazione provvisoria, soggetta a conferma da parte di almeno un’ulteriore dimensione. Incertezza: incertezza di classificazione di circa una categoria poiché i set di dati di accesso e di riferimento rimangono incompleti.

Classificazione finale: ALTA, con un rischio significativo di aumento verso GRAVE

Le prove attuali superano le soglie di alto rischio attraverso l’indice di Gini di accesso stimato, gli oneri di accessibilità economica per le popolazioni esposte, le sostanziali differenze di capacità tra l’accesso illimitato alle frontiere e l’accesso limitato a livello locale o gratuito, e la concentrazione su diversi livelli complementari della catena di approvvigionamento. Non giustificano ancora una classificazione globale di rischio grave o sistemico perché la diminuzione dei costi corretti per la qualità, l’espansione della capacità, l’innovazione a peso aperto e le infrastrutture pubbliche rimangono forze di contrasto credibili; l’esclusione universale non è stata dimostrata; e diversi indicatori critici si basano su stime piuttosto che su dati armonizzati sulle transazioni. Nello scenario centrale di oligopolio gestito, il rischio rimane elevato fino al 2031. In caso di scarsità persistente o frammentazione geopolitica, l’indice di Gini di accesso e il divario di capacità possono entrare nella fascia di rischio grave. L’implicazione politica è preventiva piuttosto che punitiva: l’intervento dovrebbe creare capacità, contendibilità e un livello minimo di capacità prima che la deprivazione diventi strutturalmente autoalimentante.


10.9 Completamento obbligatorio delle tabelle e registro di controllo

Tabella richiestaCapitolo principaleRequisito di pubblicazione
Mappa globale della catena del valore dell’IA1 e 3Consolidare imprese, livelli, dipendenze e geografia
Storico dei prezzi delle GPU2Conservare le osservazioni a livello di prodotto e le date esatte
Database storico dei prezzi delle memorie2Separare HBM, DRAM e NAND
Prezzi ufficiali, di strada e dell’usato2Conservare la data e le condizioni dell’osservazione
Confronto hardware ponderato in base alla qualità2Pubblicare ogni denominatore e versione di riferimento
quote di mercato della catena di approvvigionamento3Definizione del mercato statale e anno di quota
CR4 e HHI per segmento3Preservare l’interpretazione specifica dell’autorità
Costo totale di proprietà (TCO) del sistema locale su base quinquennale4Includi il tasso di sconto e il valore residuo
Matrice delle dimensioni del modello e della memoria4Pesi separati, cache KV, attivazioni e overhead
Token al secondo e costo per milione di token4 e 5Struttura del report, quantificazione e carico di lavoro
Prezzi dei fornitori di servizi cloud5Apporre un timestamp a ogni tariffa
Struttura dei costi del fornitore5Separare i valori osservati dalle allocazioni dedotte
Costo aziendale in base alla dimensione dell’impresa6Pubblicare le ipotesi archetipiche
Matrice di esposizione settoriale6Includi regolamentazione, privacy e costi di fallimento
Accessibilità economica per studenti e ricercatori7Denominatore del reddito e delle risorse statali
Salari mensili per l’hardware locale7Utilizzare in modo coerente il salario netto o disponibile
Tabella di accessibilità economica per paese8Applicare separatamente i tassi di cambio PPP e di mercato.
Indice globale di accesso all’intelligenza artificiale8Pubblicare gli indicatori grezzi, i pesi e la normalizzazione
Presupposti e risultati dello scenario9Separare la logica degli scenari dalle previsioni.
Previsioni annuali, 2026-20319Includi intervalli bassi, centrali, alti e
Analisi di sensibilità8 e 9Ponderazione dei report e modelli alternativi
cruscotto di allerta precoce9 e 10Assegnare il trigger, la frequenza e l’autorità responsabile
Matrice costi-benefici delle politiche10Incluso sopra; richiede un affinamento specifico per la giurisdizione
Fatti, stime e proiezioniTutti i capitoliTabella di classificazione finale riportata di seguito
Lacune nei dati non risolteTutti i capitoliMantenere un registro di controllo dinamico

Metadati obbligatori per ogni tabella della pubblicazione finale: unità di misura; valuta; base di prezzo nominale o reale; anno di riferimento; data di osservazione; ambito geografico; fonte primaria; metodo di calcolo; dimensione del campione, ove pertinente; intervallo di incertezza o classificazione di confidenza. Le tabelle analitiche presenti nei singoli capitoli devono essere ripubblicate in un’appendice statistica consolidata, in modo che i metadati non vadano persi durante la formattazione della pubblicazione.


10.10 Registro dello stato delle prove

RitrovamentoStatoFiduciaRequisito principale non risolto
La capacità dell’IA richiede hardware, energia, software e competenze complementari.Fatto strutturale confermatoAltoDati migliorati sulla capacità tra strati
I sistemi selezionati ad alta memoria e di frontiera mostrano costi nominali elevatiConfermato per i prodotti citatiAltoStorico armonizzato dei prezzi di vendita al dettaglio a livello mondiale
Tutti i dispositivi hardware per l’intelligenza artificiale sono diventati più costosi in base alla qualità.Non confermatoBassoPannello edonico a carico di lavoro costante
I dispositivi usati vengono generalmente venduti a un prezzo doppio o triplo rispetto al prezzo di listino.Non confermato come rappresentanteBassoDati di mercato a livello di transazione
L’offerta è altamente concentrata in diversi strati criticiConfermatoAltoDefinizioni di mercato globali coerenti
La sola concentrazione dimostra la presenza di prezzi abusivi.Inferenza respintaAltoProve di condotta e di prezzo controfattuale
L’intelligenza artificiale locale è una soluzione valida per carichi di lavoro limitati.Confermato in via condizionaleMedio-altoTest standardizzati di compito e affidabilità
L’intelligenza artificiale locale sostituisce universalmente i servizi cloud di frontieraNon confermatoElevata fiducia nel rifiutoUn rapido cambiamento nell’efficienza del modello potrebbe alterare il risultato
I prezzi attuali dei servizi di frontiera riflettono pienamente i costiIrrisoltoBassoConti di costi e ricavi a livello di modello del fornitore
La spesa aziendale per l’intelligenza artificiale potrebbe triplicare entro il 2031.Proiezione centraleMedio-bassoOsservazioni su utilizzo, prezzo e costi di gestione.
L’accesso differenziato può amplificare il vantaggio educativoMeccanismo supportatoMezzoStudi causali longitudinali
Nello scenario centrale, la disuguaglianza globale nell’accesso aumenta.ProiezioneMedio-bassoOsservazioni annuali dell’Indice globale di accesso all’intelligenza artificiale
Il calcolo pubblico/condiviso può migliorare l’accessoStima della politica supportataMezzoValutazione controfattuale a livello di programma
I voucher mirati sono più efficaci dei sussidi universali.Inferenza politicaMezzoEvidenze derivanti da programmi randomizzati o a fasi
L’informatica diventerà una moneta simile al Bitcoin.Senza sostegno economicoAltoNon è stato identificato alcun meccanismo plausibile di fungibilità o di riserva di valore.

Metadati della tabella: Unità: classificazione delle evidenze. Valuta e base di prezzo: non applicabile. Data di riferimento: agosto 2026. Ambito geografico: globale. Fonte: Capitoli 1-10 e fonti primarie verificate in tempo reale. Metodo: separazione dei fatti osservati direttamente, delle stime del modello, delle previsioni e delle proposizioni irrisolte. Incertezza: livello di confidenza categorico indicato nella tabella.

Sentenza definitiva

Il divario emergente nell’ambito dell’IA non è principalmente una carenza di intelligenza espressa da un singolo prezzo. Si tratta piuttosto di una disuguaglianza stratificata nella capacità di finanziare, localizzare, alimentare, gestire e applicare in modo produttivo sistemi di diversa qualità. L’apprendimento hardware può continuare anche se l’accesso diventa più ineguale; un’abbondante potenza di calcolo aggregata può coesistere con una scarsità per utenti specifici, regioni, configurazioni di memoria e requisiti di privacy. Sulla base delle evidenze e delle soglie stabilite in questo rapporto, il rischio attuale è ELEVATO . Senza una più rapida diffusione della capacità condivisa, un’efficace portabilità, un’offerta ampliata di energia e imballaggi, mercati hardware secondari affidabili e un accesso mirato a fini educativi, il rischio si avvicina a GRAVE in condizioni di scarsità persistente o di mondo frammentato. Diventa SISTEMICO solo se la disuguaglianza di accesso supera le soglie definite e le capacità essenziali di IA cessano di essere realisticamente ottenibili da una quota sostanziale di studenti, ricercatori, aziende o paesi qualificati.


Copyright di debugliesintel.com.
È vietata anche la riproduzione parziale dei contenuti senza previa autorizzazione. Tutti i diritti riservati.

latest articles

explore more

spot_img

LEAVE A REPLY

Please enter your comment!
Please enter your name here

Questo sito utilizza Akismet per ridurre lo spam. Scopri come vengono elaborati i dati derivati dai commenti.