O Nemotron 3 Ultra é o topo de uma linha de três modelos que compartilham a mesma arquitetura híbrida Mamba-Transformer MoE .
| Modelo | Parâmetros Totais | Ativos por Token | Destaque |
|---|---|---|---|
| Nemotron 3 Nano | ~4 bilhões | Menor da família | Otimizado para rodar localmente em PCs com RTX e no desktop DGX Spark |
| Nemotron 3 Super | 120 bilhões | 12 bilhões | Lançado em 11 de março de 2026; pontuou 85,6% no PinchBench, o melhor modelo aberto para tarefas de agentes autônomos |
| Nemotron 3 Ultra | 550 bilhões | 55 bilhões | Maior e mais inteligente modelo aberto dos EUA no lançamento |
Todos os três suportam uma janela de contexto de até 1 milhão de tokens. As variantes Super e Ultra incluem treinamento com NVFP4, LatentMoE e camadas de predição de múltiplos tokens .
Apresentadas inicialmente na GTC 2026 em março e reiteradas na Computex, o NemoClaw e o OpenShell formam a pilha de agentes empresariais da Nvidia, que ela chama de "Agent Toolkit" .
A CPU Nvidia Vera é um processador personalizado baseado na arquitetura Arm, criado para orquestrar as massivas cargas de trabalho de IA nos data centers .
Essa CPU atua como o processador anfitrião dentro dos sistemas em rack Vera Rubin NVL72, trabalhando ao lado das GPUs de última geração para alimentar o que a empresa chama de "fábricas de IA" .
O RTX Spark é o primeiro sistema-em-um-chip (SoC) dedicado da Nvidia para PCs Windows com foco no consumidor. Desenvolvido em parceria com a MediaTek e fabricado no processo de 3 nanômetros da TSMC, Jensen Huang o descreveu como "tudo o que aprendemos em 33 anos destilado em um único chip" .
A Nvidia classifica o RTX Spark como “os primeiros PCs Windows do mundo criados especificamente para agentes pessoais de IA” .
A Nvidia confirmou que a plataforma Vera Rubin entrou em produção em massa, com sistemas previstos para chegar aos parceiros no segundo semestre de 2026 .
Na apresentação da Computex, a Nvidia descreveu o Vera Rubin como a base para a próxima geração de fábricas de IA .
Olhando para o conjunto da obra, a Computex 2026 foi a demonstração mais clara da estratégia de integração vertical da Nvidia. A empresa agora atua em todas as frentes essenciais:
A mensagem central da palestra de Jensen Huang foi única e direta: a Nvidia agora é a fornecedora de cada camada da pilha de IA, dos chips e modelos abertos até o ambiente de execução de agentes e a infraestrutura completa de implantação em escala de data center.