Cette insistance sur la « lignée propre » est essentielle. Selon les informations disponibles, MAI‑Thinking‑1 a été entraîné sur des données d’entreprise sous licence commerciale, sans aucune distillation de modèles tiers, y compris les séries GPT d’OpenAI . Cette indépendance légale et technique donne à Microsoft la capacité de proposer à ses clients entreprises un modèle qu’ils peuvent pleinement posséder et personnaliser, sans les complexités de propriété intellectuelle d’un fournisseur externe. Nadella a d’ailleurs reconnu que Microsoft « renforce son contrôle fondamental dans l’ère de l’IA grâce à son grand modèle auto-développé MAI, tout en conservant le double avantage de son partenariat avec OpenAI »
.
Mustafa Suleyman, le patron de Microsoft AI, s’est chargé de l’argument commercial pour l’entreprise. Il a expliqué qu’après avoir ajusté les modèles MAI pour un client comme McKinsey, ils ont non seulement égalé, mais dépassé GPT‑5.5 d’OpenAI en qualité, tout en projetant une rentabilité jusqu’à dix fois supérieure, sur la base des grilles tarifaires publiques . Faire tourner ces modèles sur Maia 200, la puce IA maison de Microsoft, amplifie encore l’avantage économique, créant une pile intégrée à haute efficacité qui réduit la dépendance aux fournisseurs extérieurs
. Cette stratégie multi-modèles permet à Microsoft d’utiliser le meilleur modèle pour chaque tâche – qu’il vienne d’OpenAI, d’Anthropic ou de sa propre famille MAI – à l’intérieur d’un « harnais » unifié comme celui qui propulse GitHub Copilot
.
Au‑delà du développement des modèles, Nadella a révélé une discipline opérationnelle draconienne concernant la ressource clé de l’ère IA : les unités de traitement graphique (GPU). Avec une capacité de calcul sous tension dans toute l’industrie, Microsoft a délibérément refusé de céder à la tentation du profit à court terme. Des informations de juin 2026 confirment que Microsoft a décliné la vente de sa capacité GPU à des laboratoires d’IA extérieurs et à d’autres clients potentiels .
À la place, l’entreprise thésaurise ces précieuses ressources pour ses propres priorités stratégiques. Lors de la conférence Build 2026, Nadella a évoqué la possibilité d’exploiter « le parc installé complet de GPU » en étendant Windows ML et Windows AI, transformant de fait chaque appareil Windows compatible en un nœud de calcul local capable de faire tourner des modèles d’IA . Cette stratégie d’affectation vise exclusivement à bâtir le meilleur portefeuille en valeur vie client (LTV). Lors d’une conférence téléphonique sur les résultats plus tôt en 2026, Nadella avait déjà cadré cette approche : « Nous voulons être en mesure d’allouer de la capacité, alors que nous sommes limités par l’offre, de manière à nous permettre de construire le meilleur portefeuille en valeur vie client, » ajoutant qu’une bonne part de l’accélération produit récente venait justement du fait d’avoir dirigé ces GPU vers les équipes IA internes de Microsoft
.
Un autre pan plus naissant mais crucial des commentaires publics de Nadella dessine l’avenir de la manière dont Microsoft va faire payer l’IA. Dans un échange avec Dwarkesh Patel, il a expliqué que les grands leviers économiques – la publicité, les transactions, l’abonnement, le paiement à la consommation – resteront les mêmes, mais que leur assemblage va changer. Il a décrit un futur où les abonnements par paliers fonctionneront comme des droits ouvrant à un certain niveau de consommation d’IA, aidant les clients à budgéter tandis que Microsoft profitera du compteur qui tourne .
Ce modèle hybride est déjà partiellement en place. L'activité de codage de Microsoft, via GitHub Copilot, combine déjà facturation par utilisateur et facturation à l’usage à grande échelle . Lors de la présentation des résultats du troisième trimestre fiscal 2026, Nadella et la directrice financière Amy Hood ont évoqué un glissement supplémentaire vers une facturation au résultat (« outcome-based »), où les clients paieront pour la valeur créée par les agents IA agissant de manière autonome pour leur compte. « Vous facturerez simplement à l’usage, » a résumé Hood. « Si cet usage a une grande valeur pour les clients… alors ils continueront de faire tourner [le compteur], et ils continueront à utiliser le service »
. Une source indique qu’à compter du 1ᵉʳ juin 2026, les offres Copilot basculeraient vers une facturation à l’usage via les crédits IA de GitHub, même si le déploiement plus large de ces modèles au sein de Microsoft 365 et Azure reste un chantier en cours dont les contours précis ne sont pas encore totalement détaillés dans les sources disponibles
.
Le lancement des modèles MAI et la stratégie d’allocation des GPU sont solidement étayés par plusieurs rapports de juin 2026. Les détails concernant le calendrier et l’ampleur exacts du modèle de tarification hybride restent à ce stade une orientation donnée par la direction de Microsoft plutôt qu’une politique entièrement spécifiée et documentée entreprise par entreprise.