Oba modely vstoupily do veřejného náhledu (public preview) prostřednictvím Microsoft Foundry 24. července .
Microsoft zavádí nové modely do několika klíčových produktů okamžitě :
Microsoft uvádí, že modely MAI jsou nyní nasazeny ve více než polovině jeho produktů, přičemž další náhrady probíhají v Excelu a Outlooku .
Microsoft poskytl konkrétní procentuální úspory nákladů na GPU, což znamená úspory na inferenční infrastruktuře při provozování vlastních modelů oproti licencování nebo hostování ekvivalentů od OpenAI :
| Model | Případ použití | Snížení nákladů na GPU oproti OpenAI | Zdroj |
|---|---|---|---|
| MAI-Image-2.5-Pro | PowerPoint (vs. GPT-Image-2) | Až 84 % | |
| MAI-Voice-2-Flash | Dynamics 365 Contact Center | Až 89 % | |
| MAI-Voice-2-Flash | Obecně (vs. MAI-Voice-2) | O 32 % nákladově efektivnější (a 2× rychlejší) |
Tyto úspory jsou natolik výrazné, že mění jednotkovou ekonomiku AI funkcí napříč kancelářským a cloudovým balíkem Microsoftu.
Vydání z 24. července jsou specializované varianty v rámci širší sedmičlenné rodiny MAI, kterou Microsoft představil na konferenci Build v červnu 2026 :
MAI-Image-2.5-Pro přidává prémiovou úroveň pro maximální kvalitu obrazu, zatímco MAI-Voice-2-Flash přidává úroveň optimalizovanou pro rychlost a vysoký objem hlasových transakcí . Celá rodina je trénována na vlastních akcelerátorech Maia 200 bez destilace z modelů třetích stran, s deklarovanou 1,4násobnou účinností díky společnému návrhu hardwaru a softwaru .
Microsoft realizuje promyšlenou strategii budování plné vertikální soběstačnosti v AI :