Il rack Helios integra 18 CPU AMD EPYC "Venice" di sesta generazione — una ogni quattro GPU su 18 vassoi di elaborazione — collegate tramite hardware di rete AMD Pensando per una comunicazione cluster AI ad alta velocità e senza perdite . Questo approccio al silicio co-ottimizzato, che combina GPU, CPU, networking e software in un unico sistema integrato, è la prima vera piattaforma rack-scale di AMD e la sua risposta più diretta a Nvidia Vera Rubin NVL72
.
I campioni ingegneristici e la produzione in volumi limitati di Helios sono previsti per la seconda metà del 2026, mentre la produzione di massa completa e i primi token AI di produzione non sono attesi prima del Q2 2027, secondo le tempistiche del settore .
I clienti possono anche utilizzare Vultr Clusters (self-service) con un workload scheduler Slurm o Kubernetes e una suite di osservabilità per il monitoraggio della salute delle GPU . Vultr posiziona i nuovi sistemi per l'addestramento di modelli, l'inferenza, il fine-tuning e l'AI agentica, mentre le aziende passano da progetti pilota alla produzione
.
Il 20 luglio 2026 — tre giorni prima dell'annuncio di Vultr — Microsoft ha annunciato che distribuirà su larga scala la soluzione rack AMD Helios su Azure per l'inferenza AI di modelli frontier, applicazioni clienti e i propri servizi AI . Le distribuzioni in volumi sono previste per la seconda metà del 2026
. La partnership estesa copre GPU Instinct, CPU EPYC, networking Pensando e software ROCm
. Il blog ufficiale di Microsoft ha annunciato tre nuove famiglie di VM Azure: HDv2, HXv2 e ND MI455X v7
.
Le prove disponibili non confermano direttamente un accordo HPE del dicembre 2025 o la sua tempistica di disponibilità nel 2026. Non è stata trovata alcuna fonte specifica per questa affermazione.