Cả hai mô hình đã bước vào giai đoạn xem trước công khai (public preview) thông qua Microsoft Foundry vào ngày 24 tháng 7 .
Microsoft đang đưa các mô hình mới vào một số sản phẩm chủ lực ngay lập tức :
Microsoft tuyên bố rằng các mô hình MAI hiện đã được triển khai trên hơn một nửa số sản phẩm của họ, và việc thay thế tiếp theo đang được tiến hành ở Excel và Outlook .
Microsoft đã cung cấp tỷ lệ phần trăm giảm chi phí tính toán GPU cụ thể — nghĩa là khoản tiết kiệm trên cơ sở hạ tầng suy luận khi chạy các mô hình của riêng mình so với việc cấp phép hoặc lưu trữ các mô hình tương đương của OpenAI. Đây không phải là sự khác biệt về giá API mà là khoản tiết kiệm ở cấp độ phần cứng thực tế :
| Mô hình | Trường hợp sử dụng | Giảm chi phí GPU so với OpenAI | Nguồn |
|---|---|---|---|
| MAI-Image-2.5-Pro | PowerPoint (so với GPT-Image-2) | Lên tới 84% | |
| MAI-Voice-2-Flash | Dynamics 365 Contact Center | Lên tới 89% | |
| MAI-Voice-2-Flash | Tổng quát (so với MAI-Voice-2) | Tiết kiệm hơn 32% (và nhanh gấp 2 lần) |
Những khoản giảm này đủ lớn để thay đổi cơ cấu chi phí đơn vị (unit economics) của Microsoft cho các tính năng AI trong bộ ứng dụng Office và đám mây.
Các bản phát hành ngày 24 tháng 7 là các biến thể chuyên biệt trong một đại gia đình MAI bảy mô hình rộng lớn hơn đã được công bố tại Microsoft Build vào tháng 6 năm 2026 :
MAI-Image-2.5-Pro bổ sung một tầng cao cấp cho chất lượng hình ảnh tối đa, trong khi MAI-Voice-2-Flash bổ sung một tầng tối ưu hóa tốc độ cho các tác vụ giọng nói khối lượng lớn, độ trễ thấp . Toàn bộ đại gia đình được huấn luyện trên các bộ tăng tốc AI tùy chỉnh Maia 200 của Microsoft mà không cần chưng cất (distillation) từ các mô hình của bên thứ ba, với lợi thế hiệu quả 1,4 lần nhờ sự đồng thiết kế phần cứng-phần mềm .
Microsoft đang thực hiện một chiến lược đa giai đoạn có chủ đích để xây dựng khả năng tự chủ AI toàn diện :