24 августа на конференции Hot Chips 2026 Nvidia объявила, что стоечный ускоритель Groq 3 LPX вышел в полноценное производство. LPX предназначен для низколатентной генерации токенов в агентных ИИ системах и работает вместе с Vera Rubin NVL72, а не заменяет графические процессоры.
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What did Nvidia announce at Hot Chips 2026 about the full production launch of its Groq 3 LPX dedicated AI inference accelerator—acquired th. Article summary: At Hot Chips on August 24, Nvidia said its Groq 3 LPX rack scale accelerator had entered full production as the low latency, long context inference component of the Vera Rubin platform.. Topic tags: general web, openai, agents, ai, workflow. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnai
24 августа 2026 года на конференции Hot Chips Nvidia объявила о переходе стоечного ускорителя Groq 3 LPX в полноценное производство. Компания позиционирует его как специализированный компонент платформы Vera Rubin для быстрых и предсказуемых ответов агентных ИИ-систем. 36
Groq 3 LPX отвечает прежде всего за decode-фазу инференса — последующую генерацию ответа, когда модель шаг за шагом выдаёт новые токены. Чем быстрее проходит этот этап, тем меньше пользователь ждёт ответа и тем оперативнее ИИ-агент выполняет многошаговые задачи.
При этом LPX не должен заменить универсальные GPU. Nvidia описывает связку так: системы Vera Rubin NVL72 выполняют широкий спектр вычислений, включая обучение, обработку контекста и другие задачи инференса, а LPX берёт на себя чувствительную к задержкам генерацию токенов. 36
В бенчмарке Artificial Analysis на открытой модели Gemma 4 31B с контекстом длиной 100 000 токенов система на базе Groq 3 LPX выдала 3 431 токен в секунду. В официальном сообщении Nvidia результат округлён до 3 400 токенов в секунду. 16
По утверждению Nvidia, в подобных длинноконтекстных и чувствительных к задержкам сценариях LPX обеспечивает примерно в четыре раза более высокую отзывчивость, чем ближайшая альтернативная платформа. 6
Nvidia включила LPX в состав платформы Vera Rubin как её седьмой крупный чиповый компонент. В эту архитектуру также входит процессор Vera с 88 специально разработанными ядрами Olympus, а также другие компоненты для построения масштабных ИИ-инфраструктур. 2
Идея компании — разделить работу между специализированными элементами «ИИ-фабрики». Универсальные ускорители должны обеспечивать гибкость и общую вычислительную мощность, тогда как LPX оптимизирован под узкое, но критически важное место в работе современных агентных систем: быструю выдачу результата после обработки большого контекста.
Первым облачным провайдером, объявившим о принятии LPX, стала Nebius. Компания планирует добавить ускоритель в свою платформу Token Factory для промышленного инференса. 6
Groq также сообщила, что войдёт в число первых пользователей и развернёт Groq 3 LPX вместе с Vera Rubin NVL72 в собственном облаке, ориентированном на ИИ-инференс. 4
Формулировка о том, что Nvidia «купила Groq за 20 миллиардов долларов», требует уточнения. Доступные сообщения описывают сделку как соглашение о лицензировании технологии Groq и найме ключевых руководителей, а не как полное приобретение компании. В Nvidia перешли основатель Groq Джонатан Росс, президент Санни Мадра и другие руководители, при этом сама Groq продолжила работу и позднее привлекла новое финансирование. 5
Поэтому Groq 3 LPX — это результат интеграции технологии Groq в экосистему Nvidia, но не доказательство того, что Groq как компания была полностью поглощена.
Предоставленные источники не дают достаточных оснований для утверждений о конфигурации в 256 чипов на стойку, объёме SRAM на одном чипе, производстве Samsung вместо выпуска GPU на мощностях TSMC, а также о конкретных ответных продуктах AMD и Cerebras или режиме OpenAI на 750 токенов в секунду.
Отдельно сообщалось, что SpaceXAI планирует использовать процессоры Vera для агентных ИИ-приложений, однако имеющиеся данные не подтверждают более подробные заявления о выполнении инструментальных операций, моделировании спутниковой группировки или точных сроках и масштабах такого развёртывания. 7
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
24 августа на конференции Hot Chips 2026 Nvidia объявила, что стоечный ускоритель Groq 3 LPX вышел в полноценное производство.
24 августа на конференции Hot Chips 2026 Nvidia объявила, что стоечный ускоритель Groq 3 LPX вышел в полноценное производство. LPX предназначен для низколатентной генерации токенов в агентных ИИ системах и работает вместе с Vera Rubin NVL72, а не заменяет графические процессоры.
В тесте Artificial Analysis на модели Gemma 4 31B с контекстом в 100 000 токенов ускоритель показал 3 431 выходной токен в секунду — Nvidia округляет результат до 3 400.