AMD y Cerebras anunciaron en el Advancing AI 2026, celebrado el 23 de julio en San Francisco, una alianza técnica para crear una plataforma conjunta de inferencia de IA que divide las fases del proceso entre el hardwa... La arquitectura desagregada asigna a los procesadores AMD EPYC y GPUs Instinct (dentro del siste...

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What did AMD and Cerebras announce at AMD's Advancing AI 2026 event regarding a joint AI inferenc. Article summary: Here is a comprehensive, sourced breakdown of what was announced at AMD's Advancing AI 2026 event on July 23, 2026 in San Francisco.. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it usefu
En el evento Advancing AI 2026 de AMD, celebrado el 23 de julio en San Francisco, AMD y Cerebras anunciaron una alianza técnica para construir un nuevo tipo de plataforma de inferencia de IA. En lugar de depender de una única arquitectura de GPU para todo el proceso, la solución conjunta combina el sistema en rack Helios, recién lanzado por AMD, con el Wafer-Scale Engine (WSE) de Cerebras en un diseño desagregado y optimizado por carga de trabajo .
La plataforma utiliza un enfoque por capas para la inferencia. Los procesadores EPYC y las GPUs Instinct de AMD (dentro de los racks Helios) se encargan de las etapas frontales: preprocesamiento de prompts, tokenización y manejo de grandes ventanas de contexto. El WSE de Cerebras toma entonces el relevo para la fase más intensiva en cómputo: la generación rápida de tokens, que exige un gran ancho de banda de memoria y un alto rendimiento en paralelo .
Este diseño desagregado permite que cada subtarea de inferencia se ejecute en el silicio más adecuado. AMD aporta la lógica de CPU/GPU de baja latencia para las etapas de propósito general, mientras que el chip de oblea de Cerebras ofrece la potencia paralela masiva para la ejecución central del modelo . La directora ejecutiva de AMD, Lisa Su, describió la alianza como parte de un cambio más amplio hacia el uso de diferentes chips para distintas fases del proceso de inferencia
.
Las empresas afirman que la plataforma conjunta ofrece tiempos de respuesta significativamente más bajos para aplicaciones complejas de IA en comparación con la inferencia basada en GPU monolítica. El lenguaje oficial la describe como una solución que ofrece "inferencia de IA de alto rendimiento y latencia ultrabaja líder en la industria" . No se publicaron cifras concretas de rendimiento (como tokens por segundo o latencia en milisegundos) en el evento. Las acciones de Cerebras subieron aproximadamente un 6% el día del anuncio
.
Se espera que la oferta conjunta esté disponible a través de Cerebras Cloud a finales de 2026. Cerebras tiene previsto instalar sistemas AMD Helios en sus propios centros de datos para alojar el servicio .
AMD también lanzó oficialmente Helios, su primer sistema de IA en rack, en el evento. La directora ejecutiva, Lisa Su, lo calificó como "el rack de IA más potente del mundo" y confirmó que está en plena producción . Las especificaciones clave incluyen:
Helios se posiciona como un competidor directo de los sistemas en rack DGX y HGX de Nvidia, afirmando AMD un rendimiento superior tanto en cargas de trabajo de entrenamiento como de inferencia de IA .
El mensaje principal del Advancing AI 2026 fue que el mercado de la inferencia de IA se está alejando de la dependencia de un solo tipo de GPU para cada etapa de una carga de trabajo. En su lugar, el sector está adoptando arquitecturas desagregadas y optimizadas por carga de trabajo que dividen el preprocesamiento, la ejecución de la inferencia y el posprocesamiento entre silicios especializados de diferentes proveedores. AMD presentó Helios y la alianza con Cerebras como una alternativa multi-proveedor y de ecosistema abierto al enfoque verticalmente integrado de Nvidia .
Además de la alianza con Cerebras y el lanzamiento de Helios, AMD realizó varios anuncios significativos más:
AMD reveló que había conseguido un cliente importante, Anthropic, a principios de esa misma semana, antes del evento Advancing AI. Anthropic se sumó a la lista de grandes laboratorios de IA que se comprometen a implementar hardware de AMD (incluyendo los sistemas Helios) a gran escala, como parte de una tendencia más amplia de las principales empresas de IA a diversificarse del monopolio de las GPU de Nvidia .
Cerebras ha tenido un año excepcional, independientemente de su alianza con AMD. La empresa salió a bolsa el 14 de mayo de 2026 en el Nasdaq con el ticker CBRS. Fijó un precio de 185,00 dólares por acción para 30 millones de títulos, muy por encima del rango previsto inicialmente de 115-125 dólares, y recaudó 5.550 millones de dólares en la mayor OPV tecnológica de EE. UU. en 2026. Las acciones se dispararon un 68% en su primer día de cotización, cerrando a 311,07 dólares .
En enero de 2026, OpenAI y Cerebras anunciaron un acuerdo plurianual de hasta 750 megavatios de capacidad de cómputo. El compromiso inicial se situó en torno a los 10.000 millones de dólares, que posteriormente se amplió a más de 20.000 millones (con un tope potencial de 30.000 millones). Como parte del acuerdo, OpenAI también recibió una participación accionarial de hasta el 10% en Cerebras .
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
AMD y Cerebras anunciaron en el Advancing AI 2026, celebrado el 23 de julio en San Francisco, una alianza técnica para crear una plataforma conjunta de inferencia de IA que divide las fases del proceso entre el hardwa...
AMD y Cerebras anunciaron en el Advancing AI 2026, celebrado el 23 de julio en San Francisco, una alianza técnica para crear una plataforma conjunta de inferencia de IA que divide las fases del proceso entre el hardwa... La arquitectura desagregada asigna a los procesadores AMD EPYC y GPUs Instinct (dentro del sistema Helios) las fases iniciales como el preprocesamiento de prompts y el manejo de grandes ventanas de contexto, mientras...
El sistema combinado promete una latencia de respuesta 'líder en la industria' para aplicaciones complejas de IA, aunque no se publicaron cifras concretas de rendimiento.