Das Nemotron 3 Ultra steht an der Spitze einer dreistufigen Modellfamilie, die alle dieselbe hybride Mamba-Transformer-MoE-Architektur teilen .
| Modell | Parameter gesamt | Aktiv pro Token | Highlights |
|---|---|---|---|
| Nemotron 3 Nano | ~4 Milliarden | Am kleinsten | Optimiert für lokale Inferenz auf RTX-PCs und DGX Spark |
| Nemotron 3 Super | 120 Milliarden | 12 Milliarden | Am 11. März 2026 veröffentlicht; erreichte 85,6 % im PinchBench-Test – das führende offene Modell für agentische Aufgaben |
| Nemotron 3 Ultra | 550 Milliarden | 55 Milliarden | Größtes Modell; höchste Intelligenz-Bewertung für ein US-Open-Weight-Modell zum Start |
Alle drei unterstützen ein Kontextfenster von bis zu 1 Million Token. Die Super- und Ultra-Varianten umfassen NVFP4-Training, LatentMoE und Multi-Token-Prediction-Schichten .
Erstmals im März auf der GTC 2026 vorgestellt und auf der Computex erneut als Teil des Nvidia Agent Toolkit beworben, bilden NemoClaw und OpenShell Nvidias Angebot für sichere Unternehmensagenten .
Die Nvidia Vera CPU ist ein maßgeschneiderter, Arm-basierter Prozessor, der speziell für die Orchestrierung von KI-Workloads in Rechenzentren entwickelt wurde .
Die Vera CPU dient als Host-Prozessor in den Vera Rubin NVL72 Rack-Scale-Systemen, wo sie zusammen mit den GPUs der nächsten Generation die Grundlage für sogenannte KI-Fabriken bildet .
Der RTX Spark ist Nvidias erstes dezidiertes System-on-a-Chip für Consumer-Windows-PCs, gemeinsam entwickelt mit MediaTek und gefertigt im 3-nm-Verfahren von TSMC . Jensen Huang bezeichnete ihn als „alles, was wir in 33 Jahren gelernt haben, destilliert in einen einzigen Chip" .
Nvidia positioniert den RTX Spark als „den weltweit ersten Windows-PC, der von Grund auf für persönliche Agenten entwickelt wurde" .
Nvidia bestätigte, dass die Vera Rubin Plattform in die Serienproduktion übergegangen ist. Die Auslieferung der Systeme an Partner wird in der zweiten Hälfte des Jahres 2026 erwartet .
In seiner Computex-Keynote bezeichnete Nvidia Vera Rubin als das Fundament der nächsten Generation von KI-Fabriken .
In der Gesamtbetrachtung war die Computex 2026 die bislang deutlichste Demonstration von Nvidias vertikaler Integrationsstrategie:
Jensen Huangs zentrale Botschaft war unmissverständlich: Nvidia liefert nun jede einzelne Schicht des KI-Stacks – vom Silizium über offene Modelle und Agentenlaufzeitumgebungen bis hin zur Infrastruktur für den Einsatz in Fabrikdimensionen.