Les principales prévisions du cabinet sont les suivantes :
De nouveaux produits devraient également soutenir cette dynamique. Les racks Rubin de Nvidia et Helios d’AMD sont tous deux attendus à partir du quatrième trimestre 2026 .
Une estimation distincte de Goldman Sachs, publiée en juin 2026, table sur un marché mondial des serveurs de 1 100 milliards de dollars en 2028. Les revenus des racks de serveurs IA progresseraient alors à un rythme annuel moyen de 118 %, pour atteindre 561,4 milliards de dollars, soit 51 % du marché total .
Cette demande en serveurs repose sur un vaste programme de construction et d’équipement. Bernstein estime à environ 1 200 milliards de dollars la valeur totale des investissements dans les data centers déjà annoncés ou en cours de construction .
Les dépenses d’investissement — ou capex, pour capital expenditures — des principaux fournisseurs de cloud suivent la même trajectoire :
D’autres estimations dressent un tableau comparable. Goldman Sachs prévoit que les dépenses d’investissement cumulées des grandes entreprises technologiques atteindront 750 milliards de dollars fin 2026, avant de s’approcher de 1 200 milliards en 2027 .
De son côté, Morgan Stanley estimait au premier trimestre 2026 que les cinq principaux hyperscalers — Microsoft, Amazon, Google, Meta et Oracle — pourraient investir environ 800 milliards de dollars en 2026, puis 1 200 milliards en 2027 . Bank of America anticipait déjà une hausse des dépenses mondiales des hyperscalers de 67 % en 2025, puis de 31 % en 2026, pour atteindre 611 milliards de dollars .
Ces chiffres ne mesurent pas tous exactement la même chose : certains incluent l’ensemble des dépenses d’infrastructure, tandis que d’autres se concentrent sur le capex des fournisseurs cloud ou sur l’écosystème IA complet. Ils convergent néanmoins sur un point : les investissements restent orientés fortement à la hausse. Gartner prévoit ainsi 2 590 milliards de dollars de dépenses mondiales liées à l’IA en 2026, soit 47 % de plus qu’un an auparavant .
La tendance la plus structurante du rapport concerne peut-être la progression des ASIC (Application-Specific Integrated Circuits), des circuits intégrés conçus pour des tâches précises. Contrairement aux GPU généralistes, ces puces peuvent être optimisées pour les besoins spécifiques d’un fournisseur de cloud, notamment l’entraînement ou l’inférence des modèles d’IA.
Les hyperscalers cherchent ainsi à réduire leur dépendance aux GPU disponibles sur le marché et à améliorer le coût, la consommation énergétique ou les performances de certaines charges de travail .
Broadcom s’est imposé comme le principal partenaire de conception de l’écosystème des ASIC IA. L’entreprise a conclu avec Google un accord de long terme pour co-développer plusieurs générations de TPU, les processeurs spécialisés de Google . Broadcom conçoit déjà les TPU de Google ainsi que la puce personnalisée d’OpenAI .
Les estimations citées par Bernstein et d’autres études attribuent à Broadcom environ 60 % du marché des partenaires de conception d’ASIC IA .
Sur le plan financier, le chiffre d’affaires de Broadcom lié aux semi-conducteurs IA a atteint 10,8 milliards de dollars au deuxième trimestre de son exercice 2026, soit une hausse de 143 % sur un an. Le groupe a maintenu son objectif de 100 milliards de dollars de revenus issus des semi-conducteurs IA pour l’exercice 2027. Ses réservations de puces IA au deuxième trimestre ont dépassé 30 milliards de dollars .
Marvell augmente pour sa part sa production d’ASIC pour les quatre grands fournisseurs de services cloud mentionnés dans le tracker, notamment AWS, Microsoft et Google . L’entreprise conçoit les puces Trainium d’AWS et Maia de Microsoft . Elle prévoit jusqu’à environ 11 milliards de dollars de revenus liés aux ASIC IA en 2026 .
Broadcom et Marvell représenteraient ensemble environ 95 % du marché de la conception des ASIC IA personnalisés .
Bernstein prévoit que les ASIC pèseront environ 45 % des expéditions totales de puces IA utilisant le procédé d’encapsulation CoWoS. Les expéditions de TPU devraient quant à elles progresser d’environ 90 % sur un an en 2026 . CoWoS est une technologie d’assemblage avancée particulièrement utilisée pour les puces de calcul IA associées à de la mémoire à large bande passante.
Les données de TrendForce et de Counterpoint Research vont dans le même sens : les expéditions d’ASIC de calcul pour serveurs IA pourraient tripler entre 2024 et 2027, tandis que Broadcom conserverait environ 60 % du marché des partenaires de conception . TrendForce estime aussi que les serveurs IA reposant sur des ASIC représenteraient 27,8 % du marché en 2026, leur part la plus élevée depuis 2023 .
Les GPU restent toutefois majoritaires. TrendForce prévoit qu’ils représenteront 69,7 % des expéditions de serveurs IA en 2026 . La transformation en cours ne correspond donc pas à un remplacement immédiat des GPU, mais à l’émergence d’un modèle hybride : les GPU continuent de dominer les systèmes les plus flexibles, tandis que les ASIC gagnent du terrain dans les déploiements à grande échelle et les tâches plus standardisées.
Le rapport décrit une infrastructure IA encore en phase d’expansion rapide. Nvidia et AMD devraient alimenter la demande en systèmes à base de GPU, tandis que Broadcom et Marvell profitent de la volonté croissante des hyperscalers de maîtriser leur propre silicium.
À court terme, Bernstein ne relève pas de signe clair d’un ralentissement des dépenses d’investissement des plus grands fournisseurs cloud. L’enjeu ne se résume donc plus à savoir quelle entreprise vend le meilleur accélérateur : il concerne aussi la capacité à construire les data centers, fournir l’énergie et déployer des architectures combinant GPU, ASIC, mémoire et interconnexion réseau.