마이크로소프트가 공개한 GPU 컴퓨팅 비용 절감률은 API 가격 차이가 아닌, 자체 모델을 운영할 때와 오픈AI 모델을 라이선스하거나 호스팅할 때의 실제 하드웨어 수준 절감액입니다.
| 모델 | 적용 제품/시나리오 | 오픈AI 대비 GPU 비용 절감율 | 출처 |
|---|---|---|---|
| MAI-Image-2.5-Pro | 파워포인트 (vs. GPT-Image-2) | 최대 84% | |
| MAI-Voice-2-Flash | Dynamics 365 컨택센터 | 최대 89% | |
| MAI-Voice-2-Flash | 일반 (vs. MAI-Voice-2) | 32% 비용 효율 개선 + 2배 속도 향상 |
이러한 절감 효과는 마이크로소프트 오피스(Office) 및 클라우드 제품군 전반의 AI 기능 단위 경제성(unit economics)을 근본적으로 바꿀 수준입니다.
MAI-Image-2.5-Pro는 최고 이미지 품질을 위한 프리미엄 등급이고, MAI-Voice-2-Flash는 대용량·저지연 음성 처리를 위한 속도 최적화 등급입니다. 전체 모델군은 타사 모델 증류(distillation) 없이 마이크로소프트의 자체 Maia 200 AI 가속기에서 훈련됐으며, 하드웨어-소프트웨어 공동 설계를 통해 1.4배 효율성 우위를 확보했다고 회사 측은 설명합니다
.