Oba modele trafiły do publicznej wersji preview 24 lipca za pośrednictwem platformy Microsoft Foundry .
Microsoft niezwłocznie integruje nowe modele z kilkoma flagowymi produktami :
Microsoft podaje, że modele MAI są już wdrożone w ponad połowie jego produktów, a kolejne wymiany trwają w Excelu i Outlooku .
Microsoft podał konkretne wartości procentowe redukcji kosztów obliczeniowych GPU – chodzi o oszczędności na samej infrastrukturze inferencyjnej (sprzęt), a nie o różnice w cenach API .
| Model | Zastosowanie | Redukcja kosztów GPU vs. OpenAI | Źródło |
|---|---|---|---|
| MAI-Image-2.5-Pro | PowerPoint (vs. GPT-Image-2) | Do 84% | |
| MAI-Voice-2-Flash | Dynamics 365 Contact Center | Do 89% | |
| MAI-Voice-2-Flash | Ogólnie (vs. MAI-Voice-2) | 32% bardziej opłacalny (i 2x szybszy) |
Te redukcje są na tyle znaczące, że zmieniają jednostkową ekonomikę funkcji AI w pakiecie Office i chmurze Microsoftu.
Premiery z 24 lipca to wyspecjalizowane warianty w ramach szerszej, składającej się z siedmiu modeli rodziny MAI, ogłoszonej na konferencji Microsoft Build w czerwcu 2026 r. :
MAI-Image-2.5-Pro dodaje najwyższą półkę jakości obrazu, a MAI-Voice-2-Flash – wariant zoptymalizowany pod kątem szybkości dla zastosowań o dużym wolumenie i niskim opóźnieniu . Cała rodzina modeli jest trenowana na własnych akceleratorach AI Microsoftu – chipach Maia 200, bez destylacji z modeli firm trzecich, z deklarowaną 1,4-krotną przewagą efektywności dzięki współprojektowaniu sprzętu i oprogramowania .
Microsoft realizuje przemyślaną, wieloetapową strategię budowy pełnej samodzielności w zakresie AI :