La plateforme utilise une approche à plusieurs niveaux pour l'inférence. Les CPU EPYC et les GPU Instinct d'AMD (au sein des racks Helios) gèrent les étapes initiales : le pré-traitement des prompts, la tokenisation et le traitement des grandes fenêtres de contexte. Le WSE de Cerebras prend ensuite le relais pour la phase la plus intensive en calcul — la génération rapide de tokens, qui nécessite une bande passante mémoire et un parallélisme massifs .
Cette conception désagrégée permet à chaque sous-tâche d'inférence de s'exécuter sur le silicium le mieux adapté. AMD fournit la logique CPU/GPU à faible latence pour les étapes à usage général, tandis que la puce à l'échelle de la tranche de Cerebras offre la puissance de feu parallèle massive pour l'exécution du modèle principal . La PDG d'AMD, Lisa Su, a décrit ce partenariat comme s'inscrivant dans une évolution plus large vers l'utilisation de différentes puces pour différentes étapes du pipeline d'inférence .
Les entreprises affirment que la plateforme conjointe offre des temps de réponse considérablement réduits pour les applications d'IA complexes par rapport à l'inférence monolithique basée sur GPU. Le langage officiel la décrit comme offrant une « inférence IA à ultra-faible latence et à haut débit, leader du secteur » . Aucun chiffre de référence spécifique — comme les tokens par seconde ou la latence en millisecondes — n'a été publié en détail lors de l'événement. L'action de Cerebras a augmenté d'environ 6 % le jour de l'annonce .
L'offre conjointe devrait être disponible via Cerebras Cloud dans le courant de l'année 2026. Cerebras prévoit de déployer les systèmes AMD Helios dans ses propres centres de données pour héberger le service .
AMD a également officiellement lancé Helios, son premier système d'IA à l'échelle d'un rack, lors de l'événement. La PDG Lisa Su l'a qualifié de « rack d'IA le plus puissant du monde » et a confirmé qu'il était en production complète . Ses spécifications clés incluent :
Helios est positionné comme un concurrent direct des systèmes rack DGX et HGX de Nvidia, AMD revendiquant des performances supérieures pour les charges de travail d'entraînement et d'inférence de l'IA .
Le message phare d'Advancing AI 2026 était que le marché de l'inférence IA s'éloigne de l'utilisation d'un seul type de GPU pour chaque étape d'une charge de travail. Au lieu de cela, l'industrie évolue vers des architectures désagrégées et optimisées pour la charge de travail qui répartissent le pré-traitement, l'exécution de l'inférence et le post-traitement sur des puces spécialisées de différents fournisseurs. AMD a présenté Helios et le partenariat avec Cerebras comme une alternative multi-fournisseurs et à écosystème ouvert à l'approche verticalement intégrée de Nvidia .
Au-delà du partenariat avec Cerebras et du lancement d'Helios, AMD a fait plusieurs autres annonces importantes :
AMD a révélé qu'elle avait conclu un accord client avec Anthropic au début de la même semaine, avant l'événement Advancing AI. Anthropic rejoint la liste des grands laboratoires d'IA s'engageant à déployer du matériel AMD (y compris les systèmes Helios) à grande échelle, s'inscrivant dans une tendance plus large des entreprises d'IA de premier plan à se diversifier loin du monopole des GPU de Nvidia .
Cerebras a eu une année charnière, indépendamment de son partenariat avec AMD. L'entreprise est entrée en bourse le 14 mai 2026 sur le Nasdaq sous le ticker CBRS. Elle a fixé le prix de 30 millions d'actions à 185,00 $ l'unité, bien au-dessus de la fourchette initialement attendue de 115 à 125 $, levant ainsi 5,55 milliards de dollars, soit la plus importante introduction en bourse technologique américaine de 2026. L'action a grimpé de 68 % lors de son premier jour de cotation, clôturant à 311,07 $ .
En janvier 2026, OpenAI et Cerebras ont annoncé un accord pluriannuel pour une capacité de calcul allant jusqu'à 750 mégawatts. L'engagement initial a été estimé à environ 10 milliards de dollars, puis porté à plus de 20 milliards de dollars (avec un plafond potentiel de 30 milliards de dollars). OpenAI aurait également reçu une participation au capital pouvant atteindre 10 % dans Cerebras dans le cadre de l'accord .