Questa mossa completa una strategia iniziata mesi fa per sostituire i modelli OpenAI nei prodotti consumer e enterprise di maggior volume con modelli costruiti da zero sui chip Maia 200 di Microsoft. Ecco cosa c'è da sapere.
Entrambi i modelli sono entrati in public preview tramite Microsoft Foundry il 24 luglio .
Microsoft sta implementando i nuovi modelli in diversi prodotti di punta :
Microsoft afferma che i modelli MAI sono ora implementati in oltre la metà dei suoi prodotti, con ulteriori sostituzioni in corso in Excel e Outlook .
Microsoft ha fornito percentuali specifiche di riduzione dei costi di elaborazione GPU — ovvero il risparmio sull'infrastruttura di inferenza quando esegue i propri modelli invece di licenziare o ospitare quelli di OpenAI. Non si tratta di differenze nei prezzi delle API, ma di risparmi a livello hardware :
| Modello | Caso d'uso | Riduzione costo GPU vs. OpenAI | Fonte |
|---|---|---|---|
| MAI-Image-2.5-Pro | PowerPoint (vs. GPT-Image-2) | Fino all'84% | |
| MAI-Voice-2-Flash | Dynamics 365 Contact Center | Fino all'89% | |
| MAI-Voice-2-Flash | Generale (vs. MAI-Voice-2) | 32% più conveniente (più 2x velocità) |
Queste riduzioni sono così significative da cambiare l'economia unitaria delle funzionalità AI per Microsoft in tutta la suite Office e cloud.
I rilasci del 24 luglio sono varianti specializzate all'interno di una più ampia famiglia di sette modelli MAI annunciata al Microsoft Build nel giugno 2026 :
MAI-Image-2.5-Pro aggiunge un livello premium per la massima qualità delle immagini, mentre MAI-Voice-2-Flash aggiunge un livello ottimizzato per la velocità in scenari ad alto volume e bassa latenza . L'intera famiglia è addestrata sui chip acceleratori AI personalizzati Maia 200 di Microsoft, senza distillazione da modelli di terze parti, con un vantaggio di efficienza dichiarato di 1.4x grazie alla co-progettazione hardware-software .
Microsoft sta eseguendo una strategia deliberata in più fasi per costruire l'autosufficienza AI a tutto tondo :