O rack Helios integra 18 CPUs AMD EPYC "Venice" de sexta geração — uma para cada quatro GPUs em 18 bandejas de computação — conectadas via hardware de rede AMD Pensando para comunicação em cluster de IA de alta taxa de transferência e sem perdas . Esta abordagem de silício co-otimizado, combinando GPUs, CPUs, rede e software em um único sistema integrado, é a primeira plataforma verdadeira em escala de rack da AMD e sua resposta mais direta ao Nvidia Vera Rubin NVL72
.
Amostras de engenharia e produção em volume limitado do Helios serão enviadas no segundo semestre de 2026, com a produção em massa total e os primeiros tokens de IA de produção esperados apenas para o 2º trimestre de 2027, de acordo com os prazos do setor .
Os clientes também podem usar o Vultr Clusters (autoatendimento) com um agendador de cargas de trabalho Slurm ou Kubernetes e um conjunto de observabilidade para monitoramento da saúde da GPU . A Vultr está posicionando os novos sistemas para treinamento de modelos, inferência, ajuste fino e IA agêntica, à medida que as empresas passam de projetos piloto para produção
.
Em 20 de julho de 2026 — três dias antes do anúncio da Vultr — a Microsoft anunciou que implantará a solução em rack AMD Helios em escala no Azure para inferência de modelos de fronteira, aplicativos de clientes e seus próprios serviços de IA . As implantações em volume estão planejadas para o segundo semestre de 2026
. A parceria expandida abrange GPUs Instinct, CPUs EPYC, rede Pensando e software ROCm
. O blog oficial da Microsoft observou três novas famílias de VMs do Azure: HDv2, HXv2 e ND MI455X v7
.
As evidências disponíveis não confirmam diretamente um acordo da HPE em dezembro de 2025 ou sua disponibilidade em 2026. Nenhuma fonte específica para essa afirmação foi encontrada.
O AMD Helios compete diretamente com o Nvidia Vera Rubin NVL72 . Elementos diferenciadores principais: