Entwickelt wurde die Plattform von AMD, Supermicro und Spectro Cloud; die Ankündigung erfolgte am 5. August 2026 auf der Ai4 2026 in Las Vegas . Hier erfahren Sie, wie sie funktioniert, was sie kostet und für wen sie gedacht ist.
Das Kernstück von AMD Instinct Coder ist ein Policy-basiertes, intelligentes Modell-Routing. Einfache Coding-Anfragen – Code-Generierung, Zusammenfassungen, Refactoring – werden lokal von einem AMD-optimierten GLM-5.2-Mixture-of-Experts-Modell (744B Parameter, wobei pro Token etwa 40B aktiv sind) bedient . Wenn das lokale Modell an seine Grenzen stößt, können komplexe Reasoning-Anfragen an Frontier-Modelle wie OpenAI GPT, Anthropic Claude oder Google Gemini weitergeleitet werden . Dieser mehrstufige Inferenz-Ansatz ist der eigentliche Hebel für die beworbenen Kosteneinsparungen .
Das Referenzsystem ist eine vorvalidierte, rack-integrierte Appliance, die als eine einzige SKU ausgeliefert wird :
| Komponente | Spezifikation |
|---|---|
| CPUs | 2x AMD EPYC 9575F (64 Kerne, 3,3 GHz) |
| GPUs | 8x AMD Instinct MI325X (je 256 GB HBM3E, 6 TB/s Spitzenbandbreite), in luft- oder flüssigkeitsgekühlter Version |
| Netzwerk | 2x AMD Pensando Pollara 400 Gb/s SmartNICs |
| Gehäuse | Supermicro AS-8126GS-TNMR, vollständig validiert und rack-integriert |
Laut AMD ist das System als „Plug-and-Play“-Appliance konzipiert: „Einstecken, einschalten, es funktioniert“ .
Das PaletteAI Inference Launchpad von Spectro Cloud ist die Software, die die Hardware nutzbar macht. Es bietet :
AMD und Spectro Cloud geben an, dass die Plattform die Token-Kosten für KI-Coding um bis zu 70 % senken kann, im Vergleich zu einem Ansatz, der alle Anfragen an Cloud-APIs schickt . AMDs eigenen Materialien zufolge soll sich die Investition bereits nach sechs Monaten amortisieren . Diese Angaben sind jedoch nicht unabhängig überprüft; die tatsächlichen Einsparungen hängen stark von der spezifischen Workload-Mischung, den Nutzungsmustern und den Cloud-API-Preisen des jeweiligen Unternehmens ab .
Dan McNamara (SVP & GM, Compute & Enterprise AI, AMD):
„Unternehmen brauchen Kontrolle darüber, wo Code verarbeitet wird, welche Modelle verwendet werden und was das kostet. AMD Instinct Coder kombiniert leistungsstarke AMD-Compute-Ressourcen und ein offenes Software-Ökosystem mit den Technologien von Supermicro und Spectro Cloud und gibt Kunden so einen einfachen Weg, mehr Workloads lokal zu betreiben, Frontier-Modelle gezielt einzusetzen und die Infrastruktur selbst zu betreiben.“
Tenry Fu (Mitgründer & CEO, Spectro Cloud):
„Unternehmen sollten nicht zwischen den Fähigkeiten von Frontier-Modellen und der Wirtschaftlichkeit und Kontrolle lokaler Inferenz wählen müssen.“
Vik Malyala (SVP, AI and Enterprise, Supermicro):
Supermicros Beitrag umfasst Vorvalidierung, Rack-Integration und Systemqualifikation, um die Bereitstellungskomplexität zu reduzieren und den Weg von der gelieferten Hardware zur Produktionsinferenz zu verkürzen .
Die Plattform wurde auf der Ai4 2026 (4.–6. August in Las Vegas) vorgestellt . Die Markteinführung reagiert auf einen klaren Bedarf: Während Unternehmen KI-Coding-Agenten in Entwicklungsteams und automatisierten Workflows skalieren, steigen die Token-Kosten rasant. Der frühe Anwender BMC hat die Plattform bereits für seine Helix Agentic Engineering-Prozesse im Einsatz .
AMD Instinct Coder positioniert sich als kontrollierte, lokale Alternative zu reinen Cloud-basierten Coding-Assistenten und verspricht eine ausgewogene Mischung aus Leistungsfähigkeit, Kostenkontrolle und Datensouveränität für Unternehmen, die proprietären Quellcode nicht an Drittanbieter-APIs übergeben können oder wollen.