Oba modely vstoupily do veřejného náhledu (public preview) prostřednictvím Microsoft Foundry 24. července .
Microsoft uvádí, že modely MAI jsou nyní nasazeny ve více než polovině jeho produktů, přičemž další náhrady probíhají v Excelu a Outlooku .
Microsoft poskytl konkrétní procentuální úspory nákladů na GPU, což znamená úspory na inferenční infrastruktuře při provozování vlastních modelů oproti licencování nebo hostování ekvivalentů od OpenAI :
Tyto úspory jsou natolik výrazné, že mění jednotkovou ekonomiku AI funkcí napříč kancelářským a cloudovým balíkem Microsoftu.
Vydání z 24. července jsou specializované varianty v rámci širší sedmičlenné rodiny MAI, kterou Microsoft představil na konferenci Build v červnu 2026 :
MAI-Image-2.5-Pro přidává prémiovou úroveň pro maximální kvalitu obrazu, zatímco MAI-Voice-2-Flash přidává úroveň optimalizovanou pro rychlost a vysoký objem hlasových transakcí . Celá rodina je trénována na vlastních akcelerátorech Maia 200 bez destilace z modelů třetích stran, s deklarovanou 1,4násobnou účinností díky společnému návrhu hardwaru a softwaru
.