Beide modelen zijn op 24 juli in publieke preview gegaan via Microsoft Foundry .
Microsoft rolt de nieuwe modellen direct uit in verschillende vlaggenschipproducten :
Microsoft stelt dat MAI-modellen nu in meer dan de helft van zijn producten zijn ingezet, met verdere vervangingen gaande in Excel en Outlook .
Microsoft heeft specifieke percentages gegeven voor de besparing op GPU-rekenkracht — dat wil zeggen de besparing op de inferentie-infrastructuur bij het draaien van eigen modellen versus het licentiëren of hosten van OpenAI's equivalenten. Dit zijn geen API-prijsverschillen, maar daadwerkelijke besparingen op hardwareniveau :
| Model | Gebruiksscenario | GPU-kostenbesparing vs. OpenAI | Bron |
|---|---|---|---|
| MAI-Image-2.5-Pro | PowerPoint (vs. GPT-Image-2) | Tot 84% | |
| MAI-Voice-2-Flash | Dynamics 365 Contact Center | Tot 89% | |
| MAI-Voice-2-Flash | Algemeen (vs. MAI-Voice-2) | 32% kostenefficiënter (plus 2x sneller) |
Deze besparingen zijn groot genoeg om de kosten per gebruiker voor AI-functies in Microsofts Office- en cloudpakket significant te veranderen.
De releases van 24 juli zijn gespecialiseerde varianten binnen een bredere MAI-familie van zeven modellen, aangekondigd op Microsoft Build in juni 2026 :
MAI-Image-2.5-Pro voegt een premiumlaag toe voor maximale beeldkwaliteit, terwijl MAI-Voice-2-Flash een snelheidsgeoptimaliseerde laag toevoegt voor hoog-volume, lage-latentie spraak . De hele familie is getraind op Microsofts eigen Maia 200 AI-versnellers, zonder distillatie van modellen van derden, met een beweerde 1,4x efficiëntievoordeel door de hardware-software co-design .
Microsoft voert een bewuste meerfasenstrategie uit om volledige AI-zelfvoorziening te bereiken :