Het platform maakt gebruik van een gelaagde benadering van inferentie. AMD's EPYC CPU's en Instinct GPU's (in de Helios-racks) verzorgen de front-end fasen: promptvoorverwerking, tokenisatie en verwerking van grote contextvensters. Cerebras' WSE neemt het vervolgens over voor de meest rekenintensieve fase: snelle token-generatie, die een enorme geheugenbandbreedte en parallelle doorvoer vereist .
Dit gedisaggregeerde ontwerp zorgt ervoor dat elke inferentie-subtaak kan draaien op de silicium die er het beste voor is. AMD levert low-latency CPU/GPU-logica voor de algemene stadia, terwijl Cerebras' wafer-schaal-chip de enorme parallelle rekenkracht levert voor de uitvoering van de kernmodellen . AMD-CEO Lisa Su beschreef het partnerschap als onderdeel van een bredere verschuiving naar het gebruik van verschillende chips voor verschillende stadia van de inferentiepijplijn .
De bedrijven claimen dat het gezamenlijke platform aanzienlijk lagere responstijden oplevert voor complexe AI-toepassingen in vergelijking met monolithische GPU-gebaseerde inferentie. De officiële taal beschrijft het als het leveren van "industrieleidende ultra-low-latency en high-throughput AI-inferentie" . Specifieke benchmarkcijfers – zoals tokens per seconde of latentie in milliseconden – werden tijdens het evenement niet in detail gepubliceerd. Het aandeel Cerebras steeg op de dag van de aankondiging met ongeveer 6% .
Het gezamenlijke aanbod wordt naar verwachting later in 2026 beschikbaar via de Cerebras Cloud. Cerebras is van plan om AMD Helios-systemen in zijn eigen datacenters te implementeren om de dienst te hosten .
AMD lanceerde tijdens het evenement ook officieel Helios, zijn eerste rackschaal-AI-systeem. CEO Lisa Su noemde het "de krachtigste AI-rack ter wereld" en bevestigde dat het in volledige productie is . Belangrijke specificaties zijn onder meer:
Helios wordt gepositioneerd als een directe concurrent van Nvidia's DGX- en HGX-racksystemen, waarbij AMD superieure prestaties claimt voor zowel AI-training als inferentie-workloads .
De overkoepelende boodschap van Advancing AI 2026 was dat de AI-inferentiemarkt afstapt van het vertrouwen op één enkel GPU-type voor elke fase van een workload. In plaats daarvan verschuift de industrie naar gedisaggregeerde, workload-geoptimaliseerde architecturen die voorverwerking, inferentie-uitvoering en nabehandeling splitsen over gespecialiseerd silicium van verschillende leveranciers. AMD positioneerde Helios en het Cerebras-partnerschap als een multi-leverancier, open-ecosysteem alternatief voor Nvidia's verticaal geïntegreerde aanpak .
Naast het Cerebras-partnerschap en de Helios-lancering deed AMD nog een aantal andere belangrijke aankondigingen:
AMD onthulde dat het aan het begin van dezelfde week, voorafgaand aan het Advancing AI-evenement, een klantdeal had gesloten met Anthropic. Anthropic voegde zich bij de lijst van grote AI-labs die beloofden AMD-hardware (waaronder Helios-systemen) op grote schaal in te zetten, als onderdeel van een bredere trend van top-AI-bedrijven die zich diversifiëren weg van Nvidia's GPU-monopolie .
Cerebras heeft onafhankelijk van zijn partnerschap met AMD een groot jaar achter de rug. Het bedrijf ging op 14 mei 2026 naar de beurs op de Nasdaq onder de ticker CBRS. Het plaatste 30 miljoen aandelen tegen $185,00 per stuk, ruim boven de aanvankelijk verwachte bandbreedte van $115–$125, en haalde daarmee $5,55 miljard op in de grootste Amerikaanse tech-beursgang van 2026. Het aandeel steeg op de eerste handelsdag met 68% en sloot op $311,07 .
In januari 2026 kondigden OpenAI en Cerebras een meerjarige deal aan voor maximaal 750 megawatt aan rekenkracht. De initiële toezegging werd gerapporteerd op ruwweg $10 miljard, later uitgebreid tot meer dan $20 miljard (met een potentiële cap van $30 miljard). OpenAI zou ook een aandelenbelang van maximaal 10% in Cerebras hebben ontvangen als onderdeel van de deal .