Microsofts reis met eigen AI-silicium begon publiekelijk in november 2023. Hier is hoe de generaties zich verhouden:
Het Maia-programma kreeg te maken met problemen bij de 200-generatie. De massaproductie van de 'Braga'-chip liep minstens zes maanden vertraging op, van 2025 naar 2026 . Meerdere rapporten, oorspronkelijk van The Information, wijzen op verschillende oorzaken:
De tegenslag dwong Microsoft zijn bredere chipperoutekaart aan te passen, inclusief het uitstellen van het ambitieuzere 'Braga-R'-ontwerp en de 'Cleato'-chip tot 2028 of later .
De Maia 300 betekent een grote omslag van intern experimenteren naar externe beschikbaarheid. Belangrijke details zijn:
Microsoft moet een inhaalslag maken. Zowel Google als Amazon hebben al volwassen eigen chipprogramma's die verder gevorderd zijn in beschikbaarheid en schaal:
Google (TPU) — Het meest volwassen programma. TPU Trillium (v6e) is breed beschikbaar op Google Cloud, en TPU v7 'Ironwood' is de nieuwste generatie. Googles TPU v5p wordt gebruikt voor Gemini-training op zeer grote schaal (pods met 8.960 chips) . Google zou naar verluidt een ~4× betere prijs-prestatieverhouding behalen dan H100-instanties voor LLM-workloads en heeft de Cloud-marges naar 36% gedreven door efficiënt silicium .
Amazon (Trainium/Inferentia) — Trainium2 en Trainium3 zijn productieklaar op AWS via EC2 Trn-instanties. Trainium3 werd algemeen beschikbaar op re:Invent in december 2025. Amazon wint door distributie — het verhuurt Trainium-capaciteit aan zowel Anthropic als OpenAI, en drijft daarmee 37% AWS-groei .
Belangrijk verschil voor Microsoft: Googles en Amazons eigen chips zijn al direct beschikbaar voor cloudklanten als te huur rekenkracht. Microsofts Maia 100 en 200 waren grotendeels 'gevangen' — alleen gebruikt voor Microsofts eigen interne workloads . Met de Maia 300 wil Microsoft deze kloof dichten door de chip een openbaar Azure-aanbod te maken, niet alleen een private infrastructuur .
De Maia 300 komt er na een moeizame start — de vertragingen bij de Maia 200 legden zwakke plekken bloot op het gebied van ontwerp, personeel en uitvoering. Microsoft gokt erop dat de derde generatie eindelijk de schaal en openheid bereikt van Googles TPU's en Amazons Trainium. Als de chip de beoogde 300.000+ eenheden haalt en de geclaimde efficiëntiewinsten waarmaakt, kan dat de AI-infrastructuur-economie van Microsoft aanzienlijk veranderen en Azure-klanten een echt Nvidia-alternatief bieden. Maar het blijft de nieuwkomer in een race waarin Google en Amazon al bewezen, breed beschikbare eigen chipprogramma's hebben.