Le Nemotron 3 Ultra est le sommet d'une gamme de trois modèles partageant la même architecture hybride Mamba-Transformer MoE .
Tous trois supportent une fenêtre de contexte allant jusqu'à 1 million de tokens. Les variantes Super et Ultra intègrent l'entraînement NVFP4, LatentMoE et les couches de prédiction multi-token .
Présentés pour la première fois à la GTC 2026 en mars et remis en avant au Computex, NemoClaw et OpenShell forment la pile logicielle de Nvidia pour les agents en entreprise .
Le CPU Nvidia Vera est un processeur sur mesure basé sur l'architecture Arm, conçu spécialement pour orchestrer les charges de travail d'IA dans les centres de données .
Le CPU Vera sert de processeur hôte à l'intérieur des systèmes à l'échelle du rack Vera Rubin NVL72, où il travaille aux côtés des GPU de nouvelle génération pour alimenter les usines à IA .
RTX Spark est le premier système sur puce (SoC) dédié de Nvidia pour les PC Windows grand public, co-développé avec MediaTek et gravé selon le procédé 3 nm de TSMC . Jensen Huang l'a décrit comme « tout ce que nous avons appris en 33 ans, distillé dans une seule puce »
.
Nvidia positionne la RTX Spark comme « les premiers PC Windows au monde conçus pour les agents personnels » .
Nvidia a confirmé que la plateforme Vera Rubin est entrée en production de masse, les systèmes devant parvenir aux partenaires au second semestre 2026 .
Lors de la keynote du Computex, Nvidia a décrit Vera Rubin comme la fondation de la prochaine génération d'usines à IA .
Avec le recul, le Computex 2026 a été la démonstration la plus claire à ce jour de la stratégie d'intégration verticale de Nvidia :
Le message de la keynote de Jensen Huang était sans équivoque : Nvidia fournit désormais chaque couche de la pile IA, du silicium et des modèles ouverts jusqu'aux environnements d'exécution d'agents et à l'infrastructure de déploiement à l'échelle d'une usine.