Grâce à cette configuration monumentale, les développeurs peuvent exécuter localement des modèles de langage allant jusqu'à 120 milliards de paramètres . L'intérêt est majeur : finis la latence et les coûts souvent prohibitifs des allers-retours vers le cloud pour les phases de prototypage et de test. Cette machine inaugure une promesse essentielle pour l'avenir : un continuum de calcul accéléré, de la station de travail locale jusqu'aux fermes de serveurs dans le cloud. Ce chemin de mise à l'échelle est complété par les stations Nvidia DGX pour Windows, qui permettent d'étendre sans friction les mêmes charges de travail agentiques vers des configurations toujours plus puissantes
.
La pile unifiée est, par construction, ouverte à plusieurs familles de modèles. La Build 2026 a ainsi été le théâtre d'annonces majeures de la part des deux géants.
L'équipe Microsoft AI Superintelligence a dévoilé une famille de sept nouveaux modèles "maison", avec en fer de lance MAI-Thinking-1. C'est le tout premier modèle de raisonnement de Microsoft, et les premiers chiffres sont prometteurs : lors de tests à l'aveugle, des évaluateurs indépendants l'ont préféré à Sonnet 4.6, et il égale Opus 4.6 sur le banc d'essai de programmation SWE Bench Pro . Ces modèles MAI sont co-conçus avec la puce maison de Microsoft, nommée Maia 200, une optimisation logicielle et matérielle qui offre un gain d'efficacité de 40 %
. Microsoft a également officialisé Project Polaris, son propre modèle de codage IA, destiné à remplacer GPT-4 au sein de GitHub Copilot d'ici août 2026
.
Nvidia n'est pas en reste et a présenté une offre de modèles en "poids ouverts" (open-weights). La star s'appelle Nemotron 3 Ultra, un modèle de 550 milliards de paramètres basé sur une architecture de mélange d'experts (MoE). Désormais, la famille complète des modèles ouverts de Nvidia est directement accessible via la plateforme Microsoft Foundry pour le développement et le déploiement .
Le défi le plus critique pour un assistant IA personnel, c'est la confiance. Un agent assez puissant pour agir en votre nom, manipuler vos fichiers et vos applications, doit être régi par des contrôles de sécurité tout aussi puissants. Les annonces de la Build 2026 s'attaquent à ce problème directement au niveau du système d'exploitation .
Microsoft a introduit de nouvelles primitives de sécurité Windows spécialement conçues pour le confinement des agents, la gestion de leur identité et leur pilotage. Ce sont des capacités fondamentales greffées au cœur de l'OS, pas de simples rustines après-coup. La pièce maîtresse s'appelle Microsoft eXecution Containers (MXC), une couche de politique logicielle qui définit et instrumente l'isolation et le confinement des processus des agents .
Par-dessus cette fondation, Nvidia a présenté OpenShell, un environnement d'exécution Windows sécurisé et natif. OpenShell applique des contrôles au niveau du noyau du système pour isoler les processus des agents et limiter leurs permissions en fonction du contexte précis de la tâche qu'ils exécutent. C'est l'application d'un modèle de confiance zéro à ces agents autonomes toujours actifs .
Ce dispositif est complété par des outils de gouvernance pour le marché professionnel. Microsoft a publié l'Agent Control Specification (ACS), un nouveau standard open-source qui permet aux équipes de sécurité de définir des fichiers de politique très granulaires : ce qu'un agent peut faire, ce qu'il ne peut absolument pas faire, et quand une intervention humaine est obligatoire . Pour les entreprises, le kit de développement Agent 365 SDK est désormais disponible, intégrant directement dans le cycle de vie des agents la supervision, les contrôles d'accès et l'application de la conformité
.
Le matériel, les modèles et les couches de sécurité sont unifiés par une suite d'outils et de plateformes nouvelles ou mises à jour.
Dans l'ensemble, les annonces de la Build 2026 marquent un tournant décisif. La pile unifiée co-conçue par Microsoft et Nvidia n'est pas une simple boîte à outils : c'est un système d'exploitation sécurisé, évolutif et agnostique en matière de modèles, pensé pour accueillir la future « ère de l'agent » .