Nemotron 3 Ultra — флагман линейки из трех моделей с общей гибридной архитектурой Mamba-Transformer MoE .
| Модель | Общие параметры | Активных на токен | Особенности |
|---|---|---|---|
| Nemotron 3 Nano | ~4 млрд | Минимум | Оптимизирована для локального инференса на RTX-ПК и DGX Spark |
| Nemotron 3 Super | 120 млрд | 12 млрд | Выпущена 11 марта 2026 года; набрала 85,6% в PinchBench — лучшая открытая модель для агентных задач |
| Nemotron 3 Ultra | 550 млрд | 55 млрд | Крупнейшая модель; самый высокий показатель интеллекта среди открытых моделей США на момент запуска |
Все три поддерживают контекстное окно до 1 млн токенов. Версии Super и Ultra используют обучение в NVFP4, LatentMoE и предсказание нескольких токенов .
Впервые представленные на GTC 2026 в марте и вновь упомянутые на Computex, NemoClaw и OpenShell образуют корпоративный агентный стек Nvidia .
Nvidia Vera — это кастомный Arm-процессор, созданный для оркестрации ИИ-нагрузок в дата-центрах .
Процессор Vera выполняет роль хостового CPU в стоечных системах Vera Rubin NVL72, работая совместно с GPU следующего поколения для построения «фабрик ИИ» .
RTX Spark — первая специализированная система-на-чипе от Nvidia для пользовательских ПК на Windows, разработанная совместно с MediaTek и построенная на 3-нм техпроцессе TSMC . Дженсен Хуанг назвал её «квинтэссенцией всего, чему мы научились за 33 года» .
Nvidia позиционирует RTX Spark как «первые в мире ПК на Windows, целенаправленно созданные для персональных агентов» .
Nvidia подтвердила, что платформа Vera Rubin запущена в серийное производство, а поставки партнерам начнутся во второй половине 2026 года .
На Computex Nvidia назвала Vera Rubin фундаментом следующего поколения «фабрик ИИ» .
В совокупности Computex 2026 стал самой наглядной демонстрацией вертикальной интеграции Nvidia:
Главный посыл презентации Дженсена Хуанга: теперь Nvidia поставляет каждый уровень стека ИИ — от кремния и открытых моделей до среды выполнения агентов и готовой инфраструктуры масштаба целого завода.