A Nvidia anunciou em 24 de agosto, na Hot Chips, que o acelerador de inferência Groq 3 LPX entrou em produção plena como componente da plataforma Vera Rubin. O produto foi desenvolvido para gerar tokens com baixa latência em sistemas de IA agêntica e trabalhar em conjunto com os sistemas Vera Rubin NVL72, não substi...
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What did Nvidia announce at Hot Chips 2026 about the full production launch of its Groq 3 LPX dedicated AI inference accelerator—acquired th. Article summary: At Hot Chips on August 24, Nvidia said its Groq 3 LPX rack scale accelerator had entered full production as the low latency, long context inference component of the Vera Rubin platform.. Topic tags: general web, openai, agents, ai, workflow. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnai
A Nvidia anunciou em 24 de agosto, durante a Hot Chips 2026, que o Groq 3 LPX entrou em produção plena. O acelerador foi projetado para a etapa de inferência em que o sistema gera a resposta — ou seja, produz um token após o outro — com baixa latência e comportamento previsível em contextos muito longos. 36
O LPX integra a plataforma Nvidia Vera Rubin como um componente especializado para aplicações de IA agêntica, nas quais a velocidade de resposta é essencial para que agentes executem tarefas em várias etapas, como programação e uso de ferramentas. Ele não substitui as GPUs nem os sistemas Vera Rubin NVL72: a proposta é dividir o trabalho entre diferentes componentes, de acordo com a carga de processamento. 36
Em um benchmark da Artificial Analysis, um sistema Groq 3 LPX executou o modelo aberto Gemma 4 31B com contexto de 100 mil tokens e atingiu 3.431 tokens de saída por segundo. A Nvidia arredondou o resultado para 3.400 tokens por segundo em seu anúncio. 16
A empresa afirmou que o desempenho tornou o LPX quatro vezes mais rápido em responsividade do que a plataforma alternativa mais próxima para cargas de trabalho com contexto longo e alta sensibilidade à latência. 6
O principal foco do acelerador é o estágio de decodificação, responsável por gerar rapidamente os próximos tokens. A plataforma Vera Rubin NVL72 continua encarregada de tarefas mais amplas, como treinamento, processamento do contexto e inferência de uso geral em grande escala. 36
A Nvidia passou a apresentar o LPX como o sétimo grande chip da plataforma Vera Rubin. Ele se junta, entre outros componentes, ao processador Vera, que conta com 88 núcleos Olympus personalizados. 2
A Nebius foi anunciada como a primeira provedora de nuvem de IA a adotar o acelerador. A empresa planeja incorporá-lo à sua plataforma de inferência em produção Token Factory. 6
A própria Groq também afirmou que estará entre as primeiras adotantes, implantando o LPX em conjunto com sistemas Vera Rubin NVL72 em sua nuvem de IA voltada especificamente para inferência. 4
A Nvidia está defendendo uma arquitetura de “fábrica de IA” otimizada por tipo de tarefa. Nessa visão, GPUs e sistemas Rubin permanecem responsáveis pelo processamento flexível e de grande escala, enquanto o LPX se concentra no gargalo que mais afeta a percepção de velocidade pelo usuário: a geração interativa de tokens. 36
Na prática, a separação pode permitir que um sistema processe um contexto extenso com os componentes Vera Rubin e, em seguida, use o LPX para produzir a resposta com mais rapidez. O objetivo é tornar agentes capazes de responder de forma mais imediata durante sequências longas de raciocínio e execução.
Não exatamente. Embora a operação seja frequentemente descrita como uma aposta de US$ 20 bilhões na Groq, os relatos disponíveis indicam um acordo de licenciamento não exclusivo da tecnologia da empresa, acompanhado da contratação do fundador e CEO Jonathan Ross, do presidente Sunny Madra e de outros executivos importantes — e não uma aquisição integral da Groq. 5
A Groq continuou operando como empresa independente e posteriormente anunciou uma nova rodada de financiamento. Por isso, é mais preciso dizer que a Nvidia incorporou a tecnologia e parte da liderança da Groq à sua estratégia de infraestrutura de IA, em vez de afirmar que comprou a companhia inteira. 5
As evidências fornecidas não sustentam de forma suficiente algumas especificações e comparações que circulam sobre o produto, incluindo a alegação de 256 chips por rack, 500 MB de SRAM on-chip por chip, fabricação pela Samsung em contraste com a produção de GPUs da Nvidia pela TSMC e supostas reações de AMD, Cerebras ou OpenAI.
Também há evidências de que a SpaceXAI planeja usar processadores Vera em aplicações de IA agêntica, mas elas não confirmam detalhes sobre execução de ferramentas, simulações entre satélites em órbita nem o alcance e o cronograma exatos dessa implantação. 7
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
A Nvidia anunciou em 24 de agosto, na Hot Chips, que o acelerador de inferência Groq 3 LPX entrou em produção plena como componente da plataforma Vera Rubin.
A Nvidia anunciou em 24 de agosto, na Hot Chips, que o acelerador de inferência Groq 3 LPX entrou em produção plena como componente da plataforma Vera Rubin. O produto foi desenvolvido para gerar tokens com baixa latência em sistemas de IA agêntica e trabalhar em conjunto com os sistemas Vera Rubin NVL72, não substituí los.
Em um benchmark da Artificial Analysis, o LPX alcançou 3.431 tokens de saída por segundo com o modelo aberto Gemma 4 31B e contexto de 100 mil tokens.