Cela marquerait un pivot stratégique fondamental. Historiquement, Amazon ne faisait que « louer » la puissance de calcul de ses puces via les instances cloud AWS ; vendre des puces directement transformerait l'entreprise d'un consommateur de puces en un marchand direct de silicium .
La trajectoire financière de la division puces explique pourquoi Amazon envisage ce mouvement :
La demande est si intense que deux gros clients AWS ont demandé s'ils pouvaient acheter toute la capacité des instances Graviton d'Amazon en 2026 — une demande qu'Amazon a refusée afin de préserver la disponibilité du service pour l'ensemble de sa clientèle .
Amazon a publié des données de performance spécifiques pour deux générations de Trainium :
Amazon a obtenu des engagements de la part de certaines des plus grandes entreprises d'IA au monde :
Entre décembre 2025 et janvier 2026, Amazon a créé une organisation unifiée IA et Silicium sous la direction de Peter DeSantis, vétéran de 27 ans chez Amazon, qui supervise désormais les modèles d'IA (Nova), le silicium sur mesure (Trainium/Inferentia) et l'informatique quantique .
La philosophie de DeSantis est explicite : il a décrit le contrôle « jusqu'au silicium » comme un moyen d'optimiser AWS d'une manière unique pour servir les clients, arguant que l'intégration étroite de la conception des puces, de l'architecture des modèles et de l'infrastructure génère des avantages cumulatifs . Dans une interview de juin 2026, il a déclaré que l'IA a besoin de « quelques ordres de grandeur supplémentaires » d'amélioration et que de nouvelles architectures de modèles au-delà des transformateurs actuels émergeront, nécessitant une co-conception profonde du matériel et du logiciel
.
Le pari central est que l'intégration verticale — concevoir des puces sur mesure en tandem avec les modèles d'IA Nova et l'infrastructure cloud — crée un fossé de performance-coût que des rivaux comme Nvidia (qui vend une puce standard à tout le monde) ne peuvent pas facilement reproduire .
Jassy a directement comparé Trainium aux GPU de Nvidia. Dans sa lettre aux actionnaires, il a déclaré que « presque tout le développement de l'IA à ce jour a utilisé Nvidia, mais les clients réalisent qu'il existe une meilleure option en termes de rapport performance-prix » . Il a également noté que Trainium permettra à Amazon d'économiser « des dizaines de milliards de dollars de dépenses d'investissement par an » et de fournir « plusieurs centaines de points de base d'avantage de marge opérationnelle par rapport à la dépendance aux puces d'autrui pour l'inférence »
.
Amazon continue d'entretenir un partenariat solide avec Nvidia — les GPU Nvidia restent largement disponibles sur AWS — mais Trainium est de plus en plus positionné comme le différenciateur stratégique de l'entreprise pour le long terme .
Le carnet de commandes de 225 milliards de dollars et le rythme de revenus de plus de 20 milliards de dollars de l'entreprise représentent le défi concurrentiel le plus crédible jamais lancé contre le quasi-monopole de Nvidia dans les accélérateurs d'IA par une seule entreprise à ce jour .