Das Rack ist eine 7.000 Pfund schwere Doppelbreit-Einheit mit einer Leistungsaufnahme von bis zu 245 kW .
Das Helios-Rack integriert 18 AMD EPYC-‚Venice‘-CPUs der sechsten Generation – eine pro vier GPUs auf 18 Compute-Trays – verbunden über AMD-Pensando-Netzwerkhardware für verlustfreie, leistungsstarke KI-Cluster-Kommunikation . Dieser co-optimierte Siliziumansatz, der GPUs, CPUs, Netzwerk und Software in einem einzigen integrierten System vereint, ist AMDs erste echte Rack-Scale-KI-Plattform und die direkteste Antwort auf Nvidias Vera Rubin NVL72
.
Engineering-Muster und Helios-Produktion in begrenzter Stückzahl werden in der zweiten Jahreshälfte 2026 ausgeliefert; mit dem vollen Produktionshochlauf und den ersten produktiven KI-Tokens wird laut Branchenzeitplänen nicht vor Q2 2027 gerechnet .
Kunden können auch Vultr-Cluster (Self-Service) mit einem Slurm- oder Kubernetes-Workload-Scheduler und einer Observability-Suite zur GPU-Gesundheitsüberwachung nutzen . Vultr positioniert die neuen Systeme für Modelltraining, Inferenz, Feintuning und agentische KI, während Unternehmen von Pilotprojekten zur Produktion übergehen
.
Am 20. Juli 2026 – drei Tage vor Vultrs Ankündigung – gab Microsoft bekannt, dass es die AMD-Helios-Rack-Scale-Lösung in großem Umfang auf Azure für KI-Inferenz auf Frontend-Modellen, Kundenanwendungen und Microsofts eigene KI-Dienste einsetzen wird . Volumenbereitstellungen sind für die zweite Jahreshälfte 2026 geplant
. Die erweiterte Partnerschaft umfasst Instinct-GPUs, EPYC-CPUs, Pensando-Netzwerk und ROCm-Software
. Microsofts offizieller Blog kündigte drei neue Azure-VM-Familien an: HDv2, HXv2 und ND MI455X v7
.
Die verfügbaren Quellen bestätigen weder eine HPE-Vereinbarung vom Dezember 2025 noch deren Verfügbarkeit im Jahr 2026 direkt. Es wurde keine spezifische Quelle für diese Behauptung gefunden.