Desarrollado conjuntamente por AMD, Supermicro y Spectro Cloud, este sistema fue anunciado el 5 de agosto de 2026 en la conferencia Ai4 2026 en Las Vegas . Aquí te explicamos cómo funciona, qué incluye y para quién está pensado.
El diferenciador clave de AMD Instinct Coder es su enrutamiento inteligente de modelos basado en políticas . Las solicitudes de programación rutinarias (generación de código, resúmenes, refactorización) se atienden de forma local mediante un modelo GLM-5.2 de mezcla de expertos optimizado por AMD (744 mil millones de parámetros en total, con aproximadamente 40 mil millones activados por token) . Las consultas complejas que requieren razonamiento avanzado se pueden reenviar a modelos de frontera como OpenAI GPT, Anthropic Claude o Google Gemini cuando el modelo local no puede manejarlas . Este diseño de inferencia por niveles es el mecanismo que permite los ahorros de costos que se prometen .
El sistema de referencia es un dispositivo prevalidado e integrado en rack que se vende como un solo SKU :
| Componente | Especificación |
|---|---|
| CPUs | 2 procesadores AMD EPYC 9575F (64 núcleos cada uno, 3.3 GHz) |
| GPUs | 8 aceleradores AMD Instinct MI325X (256 GB de memoria HBM3E cada uno, 6 TB/s de ancho de banda máximo), disponibles en versiones refrigeradas por aire o líquido |
| Redes | 2 SmartNICs AMD Pensando Pollara de 400 Gb/s |
| Chasis | Supermicro AS-8126GS-TNMR, completamente validado e integrado en rack |
El sistema está diseñado como un "aparato que se enchufa, se enciende y funciona", disponible como un solo SKU para el final del trimestre de su lanzamiento .
PaletteAI Inference Launchpad de Spectro Cloud es la capa de software que hace útil el hardware. Proporciona :
AMD y Spectro Cloud afirman que la plataforma puede reducir los costos de tokens de IA para programación hasta en un 70% en comparación con enviar todas las solicitudes a las APIs de modelos de frontera en la nube . Los materiales de AMD citan un período de recuperación de la inversión de tan solo seis meses . Estas afirmaciones no han sido verificadas de forma independiente, y el ahorro real dependerá de la combinación de cargas de trabajo, los patrones de uso y los precios de las APIs en la nube de cada organización .
Dan McNamara (Vicepresidente sénior y gerente general de Compute & Enterprise AI en AMD):
"Las organizaciones necesitan controlar dónde se procesa el código, qué modelos se utilizan y cuánto cuesta ese uso. AMD Instinct Coder combina la computación de alto rendimiento de AMD y un ecosistema de software abierto con las tecnologías de Supermicro y Spectro Cloud, ofreciendo a los clientes una forma sencilla de ejecutar más cargas de trabajo localmente, usar modelos de frontera de forma selectiva y operar la infraestructura ellos mismos."
Tenry Fu (Cofundador y director ejecutivo de Spectro Cloud):
"Las organizaciones no deberían tener que elegir entre las capacidades de los modelos de frontera y la economía y el control de la inferencia local."
Vik Malyala (Vicepresidente sénior de IA y Empresa en Supermicro):
La contribución de Supermicro incluye la prevalidación, la integración en rack y la calificación del sistema para reducir la complejidad de la implementación y acortar el camino desde el hardware entregado hasta la inferencia en producción .
La plataforma se presentó en Ai4 2026 (del 4 al 6 de agosto en Las Vegas) . El lanzamiento responde a un problema empresarial claro: a medida que las organizaciones escalan los agentes de codificación de IA en equipos de desarrollo y flujos de trabajo automatizados, los costos de los tokens aumentan rápidamente. El primer cliente en adoptarla, BMC, ya ha implementado la plataforma para su trabajo de Ingeniería Agentic Helix .
AMD Instinct Coder se posiciona como una alternativa local, gobernada y lista para usar frente a los asistentes de codificación puramente en la nube, equilibrando capacidad, costo y control para empresas que no pueden o no quieren enviar su código fuente propietario a APIs de terceros.