Especificações principais (por rack Helios) — com base na página oficial e no material de divulgação da AMD :
| Componente | Especificação |
|---|---|
| GPUs | 72x AMD Instinct MI455X (CDNA 5, TSMC N2) |
| CPUs | AMD EPYC "Venice" (Zen 6, 6ª geração) |
| Memória consolidada | 31 TB HBM4 |
| Largura de banda agregada | 1,4 PB/s |
| Memória por GPU | 432 GB HBM4, 19,6 TB/s de banda |
| Computação por GPU | 40 FP4 PFLOPS / 20 FP8 PFLOPS |
| Computação total do rack | 2,9 FP4 exaFLOPS (inferência), 1,4 FP8 exaFLOPS (treinamento) |
| Rede | AMD Pensando "Vulcano" com UALink |
| Formato | 18 bandejas de computação (4 GPUs + 1 EPYC Venice por bandeja), rack duplo |
| Preço estimado | ~US$ 5,25 milhões por rack |
A MI455X oferece aproximadamente o dobro da capacidade de computação FP4 em relação à série MI350 anterior . O sistema Helios é a principal aposta da AMD para competir com a plataforma Vera Rubin, da Nvidia, e já tem clientes como Microsoft, Meta, OpenAI, Oracle e Anthropic .
Anunciada no palco do Advancing AI 2026 (23 de julho), a AMD e a Cerebras estão construindo uma plataforma de inferência dissociada que divide o processo em duas fases :
Os dois sistemas operam como uma única solução dissociada por meio de uma interconexão de alta velocidade .
Desempenho declarado: Até 5x mais tokens por segundo por watt em comparação com arquiteturas convencionais (com base em modelagem de julho de 2026 usando o modelo Kimi 2.6 1T) .
Disponibilidade: A solução conjunta de inferência AMD-Cerebras deve estar disponível por meio de provedores de nuvem no segundo semestre de 2026 . A Cerebras vai implantar sistemas Helios em seus próprios data centers, e a solução estará disponível primeiro através do Cerebras Cloud .
O CEO da Cerebras, Andrew Feldman, disse no evento que a arquitetura mira diretamente as Groq LPUs da Nvidia e é posicionada para cargas de trabalho de IA agêntica, onde a inferência de baixa latência é essencial .
Anunciada em 22 de julho de 2026, via comunicado oficial da AMD :
Termos do acordo:
Isso coloca a Anthropic na crescente lista de grandes clientes de IA da AMD, ao lado de OpenAI, Meta, Oracle e Microsoft . A série MI450 mencionada neste acordo é a geração de GPU que alimenta os racks Helios — a MI455X é o SKU específico usado nas primeiras unidades de produção do Helios .
| Produto / Programa | Disponibilidade |
|---|---|
| Rack Helios (MI455X + EPYC Venice) | Em plena produção; envios no final do 3º trimestre de 2026 |
| Inferência dissociada AMD-Cerebras | Disponibilidade em nuvem no 2º semestre de 2026 |
| Implantação Anthropic MI450 (1º GW) | Começa no 1º semestre de 2027 |
| Amostras de engenharia MI455X | 2º semestre de 2026; produção em massa no 2º trimestre de 2027 |
Todos os números de desempenho são fornecidos pela AMD e ainda não foram verificados de forma independente . O preço do Helios de ~US$ 5,25 milhões/rack e a alegação de 5x mais taxa de transferência por watt da Cerebras são baseados em modelagens dos fornecedores.