Les deux modèles sont entrés en aperçu public via Microsoft Foundry le 24 juillet .
Microsoft intègre immédiatement ces nouveaux modèles dans plusieurs de ses produits phares :
Microsoft indique que les modèles MAI sont désormais déployés dans plus de la moitié de ses produits, avec des remplacements supplémentaires en cours dans Excel et Outlook .
Microsoft a fourni des pourcentages précis de réduction des coûts de calcul GPU. Il s'agit d'économies au niveau de l'infrastructure d'inférence lors de l'utilisation de ses propres modèles, par rapport à la location ou l'hébergement des équivalents d'OpenAI. Il ne s'agit pas de différences de prix d'API, mais d'économies matérielles réelles :
| Modèle | Cas d'usage | Réduction du coût GPU vs. OpenAI | Source |
|---|---|---|---|
| MAI-Image-2.5-Pro | PowerPoint (vs. GPT-Image-2) | Jusqu'à 84 % | |
| MAI-Voice-2-Flash | Dynamics 365 Contact Center | Jusqu'à 89 % | |
| MAI-Voice-2-Flash | Général (vs. MAI-Voice-2) | 32 % plus rentable (et 2x plus rapide) |
Ces réductions sont suffisamment importantes pour modifier les coûts unitaires des fonctionnalités d'IA de Microsoft dans sa suite Office et cloud.
Les versions du 24 juillet sont des variantes spécialisées au sein d'une famille MAI plus large de sept modèles, annoncée à la conférence Microsoft Build en juin 2026 :
MAI-Image-2.5-Pro ajoute un niveau premium pour une qualité d'image maximale, tandis que MAI-Voice-2-Flash ajoute un niveau optimisé pour la vitesse dans les applications vocales à grand volume et faible latence . Toute la famille est entraînée sur les propres accélérateurs AI Maia 200 de Microsoft, sans distillation à partir de modèles tiers, avec un avantage d'efficacité revendiqué de 1,4x grâce à la co-conception matériel-logiciel .
Microsoft exécute une stratégie délibérée en plusieurs phases pour parvenir à l'autosuffisance en IA sur toute la chaîne :