Nvidia mengumumkan pada 24 Ogos bahawa pemecut berskala rak Groq 3 LPX telah memasuki pengeluaran penuh sebagai komponen inferens kependaman rendah dan konteks panjang untuk platform Vera Rubin. Dalam penanda aras Artificial Analysis, Groq 3 LPX menghasilkan 3,431 token keluaran sesaat menggunakan model sumber terbu...
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Nvidia announce at Hot Chips 2026 about the full production launch of its Groq 3 LPX dedicated AI inference accelerator—acquired th. Article summary: At Hot Chips on August 24, Nvidia said its Groq 3 LPX rack scale accelerator had entered full production as the low latency, long context inference component of the Vera Rubin platform.. Topic tags: general web, openai, agents, ai, workflow. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnai
Nvidia mengumumkan pada acara Hot Chips pada 24 Ogos 2026 bahawa pemecut inferens berskala rak Groq 3 LPX telah memasuki pengeluaran penuh. Peranti ini menjadi komponen kependaman rendah dan konteks panjang bagi platform Vera Rubin, dengan fokus khusus untuk menjana token dengan pantas dalam aplikasi AI berasaskan ejen. 36
Dalam penanda aras Artificial Analysis, Groq 3 LPX menghasilkan 3,431 token keluaran sesaat ketika menjalankan model sumber terbuka Gemma 4 31B dengan konteks sepanjang 100,000 token. Nvidia membundarkan angka itu kepada 3,400 token sesaat dalam pengumumannya. 16
Nvidia mendakwa prestasi tersebut menjadikan LPX sehingga empat kali lebih pantas dari segi respons berbanding platform alternatif terdekat bagi beban kerja yang menggunakan konteks panjang dan memerlukan kependaman rendah. 6
Fungsi utama LPX ialah bahagian decode atau penjanaan dalam proses inferens—iaitu menghasilkan token seterusnya dengan pantas dan konsisten. Sistem Vera Rubin pula terus mengendalikan latihan, pemprosesan konteks dan tugasan pengkomputeran AI yang lebih luas. Oleh itu, LPX bukan pengganti GPU, sebaliknya pemecut khusus yang bekerja bersama GPU serta sistem Vera Rubin NVL72. 36
Nvidia turut meletakkan LPX sebagai cip utama ketujuh dalam platform Vera Rubin, bersama-sama CPU Vera dan cip lain dalam platform itu. CPU Vera mempunyai 88 teras Olympus yang direka khusus oleh Nvidia. 2
Nebius diumumkan sebagai penyedia awan AI pertama yang menerima pakai Groq 3 LPX. Syarikat itu merancang untuk menambah LPX pada platform inferens pengeluaran Token Factory. 6
Groq juga akan menjadi antara pengguna awal, dengan rancangan menggunakan LPX bersama sistem Vera Rubin NVL72 dalam awan AI inferens khusus miliknya. 4
Dalam sistem AI berasaskan ejen, kelajuan menghasilkan token memberi kesan terus kepada tempoh pengguna menunggu jawapan atau tindakan seterusnya. Sistem sedemikian lazimnya perlu membaca konteks yang panjang, membuat keputusan dalam beberapa langkah dan memberi respons secara interaktif.
Pendekatan Nvidia ialah membahagikan tugasan mengikut jenis beban kerja: GPU dan sistem Rubin digunakan untuk pengkomputeran AI berskala besar serta fleksibel, manakala LPX dikhususkan untuk bahagian penjanaan token yang menjadi penentu utama kepada rasa responsif sesuatu ejen. 36
Walaupun sering digambarkan sebagai pembelian Groq bernilai AS$20 bilion, laporan yang tersedia menunjukkan bahawa perjanjian itu lebih tepat digambarkan sebagai pelesenan teknologi Groq secara tidak eksklusif serta pengambilan beberapa tokoh utama syarikat, termasuk pengasas Jonathan Ross dan Presiden Sunny Madra. Groq kemudiannya terus beroperasi dan mengumpul dana baharu. 5
Bahan yang tersedia tidak mencukupi untuk mengesahkan beberapa dakwaan khusus, termasuk angka 256 cip bagi setiap rak, 500 MB SRAM pada setiap cip, dakwaan bahawa LPX dibuat oleh Samsung berbanding pengeluaran GPU Nvidia oleh TSMC, serta dakwaan tentang tindak balas kompetitif AMD, Cerebras atau mod 750 token sesaat OpenAI.
Begitu juga, bukti yang ada hanya menyokong bahawa SpaceXAI merancang menggunakan CPU Vera untuk aplikasi AI berasaskan ejen. Ia belum mengesahkan secara terperinci dakwaan berkaitan pelaksanaan alat, simulasi merentasi satelit orbit atau skop dan jadual sebenar penggunaannya. 7
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Nvidia mengumumkan pada 24 Ogos bahawa pemecut berskala rak Groq 3 LPX telah memasuki pengeluaran penuh sebagai komponen inferens kependaman rendah dan konteks panjang untuk platform Vera Rubin.
Nvidia mengumumkan pada 24 Ogos bahawa pemecut berskala rak Groq 3 LPX telah memasuki pengeluaran penuh sebagai komponen inferens kependaman rendah dan konteks panjang untuk platform Vera Rubin. Dalam penanda aras Artificial Analysis, Groq 3 LPX menghasilkan 3,431 token keluaran sesaat menggunakan model sumber terbuka Gemma 4 31B dengan konteks 100,000 token.
Nvidia mendakwa LPX memberikan respons sehingga empat kali lebih pantas berbanding platform alternatif terdekat untuk beban kerja yang sensitif terhadap kependaman.