O Nemotron 3 Ultra é o topo de uma linha de três modelos que compartilham a mesma arquitetura híbrida Mamba-Transformer MoE .
Todos os três suportam uma janela de contexto de até 1 milhão de tokens. As variantes Super e Ultra incluem treinamento com NVFP4, LatentMoE e camadas de predição de múltiplos tokens .
Apresentadas inicialmente na GTC 2026 em março e reiteradas na Computex, o NemoClaw e o OpenShell formam a pilha de agentes empresariais da Nvidia, que ela chama de "Agent Toolkit" .
A CPU Nvidia Vera é um processador personalizado baseado na arquitetura Arm, criado para orquestrar as massivas cargas de trabalho de IA nos data centers .
Essa CPU atua como o processador anfitrião dentro dos sistemas em rack Vera Rubin NVL72, trabalhando ao lado das GPUs de última geração para alimentar o que a empresa chama de "fábricas de IA" .
O RTX Spark é o primeiro sistema-em-um-chip (SoC) dedicado da Nvidia para PCs Windows com foco no consumidor. Desenvolvido em parceria com a MediaTek e fabricado no processo de 3 nanômetros da TSMC, Jensen Huang o descreveu como "tudo o que aprendemos em 33 anos destilado em um único chip" .
A Nvidia classifica o RTX Spark como “os primeiros PCs Windows do mundo criados especificamente para agentes pessoais de IA” .
A Nvidia confirmou que a plataforma Vera Rubin entrou em produção em massa, com sistemas previstos para chegar aos parceiros no segundo semestre de 2026 .
Na apresentação da Computex, a Nvidia descreveu o Vera Rubin como a base para a próxima geração de fábricas de IA .
Olhando para o conjunto da obra, a Computex 2026 foi a demonstração mais clara da estratégia de integração vertical da Nvidia. A empresa agora atua em todas as frentes essenciais:
A mensagem central da palestra de Jensen Huang foi única e direta: a Nvidia agora é a fornecedora de cada camada da pilha de IA, dos chips e modelos abertos até o ambiente de execução de agentes e a infraestrutura completa de implantação em escala de data center.