Beide Modelle sind seit dem 24. Juli in der öffentlichen Vorschau über Microsoft Foundry verfügbar .
Microsoft rollt die neuen Modelle umgehend in mehrere seiner Flaggschiff-Produkte aus :
Microsoft gibt an, dass MAI-Modelle mittlerweile in mehr als der Hälfte aller Produkte des Konzerns eingesetzt werden. Weitere Ablösungen in Excel und Outlook sind in Vorbereitung .
Microsoft hat konkrete Zahlen zu den GPU-Computing-Kosten genannt – gemeint sind die Einsparungen auf der Infrastrukturebene, wenn das Unternehmen seine eigenen Modelle betreibt, statt die von OpenAI zu lizenzieren oder zu hosten :
| Modell | Anwendungsszenario | GPU-Kostensenkung vs. OpenAI | Quelle |
|---|---|---|---|
| MAI-Image-2.5-Pro | PowerPoint (vs. GPT-Image-2) | Bis zu 84 % | |
| MAI-Voice-2-Flash | Dynamics 365 Contact Center | Bis zu 89 % | |
| MAI-Voice-2-Flash | Allgemein (vs. MAI-Voice-2) | 32 % kostengünstiger (und 2x schneller) |
Diese Einsparungen sind so signifikant, dass sie die Economic-Einheit von KI-Funktionen in der Office- und Cloud-Suite grundlegend verändern.
Die Neuveröffentlichungen vom 24. Juli sind spezialisierte Varianten innerhalb einer sieben Modelle umfassenden MAI-Familie, die Microsoft auf der Build 2026 im Juni vorgestellt hatte :
MAI-Image-2.5-Pro bietet eine Premium-Stufe für maximale Bildqualität, während MAI-Voice-2-Flash eine auf Geschwindigkeit optimierte Variante für hochvolumige Sprachsysteme ist . Die gesamte Familie wird auf Microsofts eigenen Maia-200-Beschleunigern trainiert – ohne Destillation aus Drittmodellen – mit einem behaupteten Effizienzvorteil von 1,4x durch das abgestimmte Hardware-Software-Design .
Microsoft verfolgt eine bewusste Mehr-Phasen-Strategie, um bei KI vollständig autark zu werden :