Nvidia ระบุเมื่อ 24 สิงหาคมที่งาน Hot Chips ว่า Groq 3 LPX ซึ่งเป็นตัวเร่งการอนุมานแบบติดตั้งระดับแร็ก เข้าสู่การผลิตเต็มรูปแบบแล้ว ในฐานะส่วนประมวลผลที่เน้นความหน่วงต่ำและบริบทยาวของแพลตฟอร์ม Vera Rubin [3][6] LPX ออกแบบมาเพื่อเร่งการสร้างโทเคนสำหรับ AI แบบเอเจนต์ ทำงานเสริมกับระบบ Vera Rubin NVL72 ไม่ได้เข้ามาแทนท...
คำตอบการวิจัย

Create a landscape editorial hero image for this Studio Global article: What did Nvidia announce at Hot Chips 2026 about the full production launch of its Groq 3 LPX dedicated AI inference accelerator—acquired th. Article summary: At Hot Chips on August 24, Nvidia said its Groq 3 LPX rack scale accelerator had entered full production as the low latency, long context inference component of the Vera Rubin platform.. Topic tags: general web, openai, agents, ai, workflow. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnai
Nvidia ประกาศเมื่อวันที่ 24 สิงหาคม 2026 ที่งาน Hot Chips ว่า Nvidia Groq 3 LPX เข้าสู่การผลิตเต็มรูปแบบแล้ว โดยวางตำแหน่งให้เป็นตัวเร่งการอนุมาน AI ที่เน้นการตอบสนองรวดเร็วและรองรับบริบทขนาดยาวสำหรับระบบ AI แบบเอเจนต์ 36
แหล่งข้อมูลที่ให้มาไม่ได้ระบุสถานที่จัดงาน Hot Chips ในครั้งนี้อย่างชัดเจน แต่ยืนยันช่วงเวลาและเวทีการประกาศว่าเกิดขึ้นในวันที่ 24 สิงหาคมที่งานดังกล่าว
LPX ถูกออกแบบให้ทำงานร่วมกับระบบ Vera Rubin NVL72 โดยรับหน้าที่หลักในขั้นตอน decode หรือการสร้างคำตอบทีละโทเคน ซึ่งเป็นช่วงที่ผู้ใช้รับรู้ได้โดยตรงว่า AI ตอบเร็วหรือช้า ขณะที่ Vera Rubin NVL72 ยังคงทำหน้าที่เป็นระบบอเนกประสงค์สำหรับการฝึกโมเดล การอ่านและประมวลผลบริบท รวมถึงงานอนุมานในภาพรวม 36
ในการทดสอบของ Artificial Analysis ด้วยโมเดลโอเพนซอร์ส Gemma 4 31B และบริบทขนาด 100,000 โทเคน ระบบ Groq 3 LPX ที่ Nvidia ติดตั้งในศูนย์ข้อมูลของตนเองทำความเร็วได้ 3,431 โทเคนผลลัพธ์ต่อวินาที Nvidia ปัดตัวเลขดังกล่าวเป็น 3,400 โทเคนต่อวินาทีในการประกาศ 16
Nvidia ระบุว่าผลลัพธ์นี้ทำให้ LPX มีความเร็วในการตอบสนองมากกว่าแพลตฟอร์มทางเลือกที่ใกล้เคียงที่สุดประมาณ 4 เท่า สำหรับงานบริบทยาวและงานที่ต้องการความหน่วงต่ำ เช่น การเขียนโค้ดแบบมีเอเจนต์และการทำงานหลายขั้นตอน 6
Nvidia มองว่า LPX เป็นชิปลำดับที่ 7 ของแพลตฟอร์ม Vera Rubin โดยทำงานร่วมกับชิปรุ่นอื่น ๆ รวมถึง Vera CPU ซึ่งมีคอร์ Olympus ที่ Nvidia ออกแบบเอง 88 คอร์ 2
แนวคิดสำคัญคือการแบ่งงานตามลักษณะการใช้งาน แทนที่จะใช้ GPU ทำทุกขั้นตอน ระบบ Vera Rubin จะรองรับงานประมวลผล AI ที่ยืดหยุ่นและมีขนาดใหญ่ ส่วน LPX จะโฟกัสที่คอขวดด้านการสร้างโทเคน เพื่อให้ AI แบบเอเจนต์ตอบกลับได้เร็วและสม่ำเสมอมากขึ้น 36
คำกล่าวที่ว่า Nvidia “ซื้อ Groq” มูลค่า 20,000 ล้านดอลลาร์อาจไม่ตรงกับข้อมูลที่มีอยู่ทั้งหมด รายงานที่ให้มาระบุว่า Nvidia ทำข้อตกลง อนุญาตใช้เทคโนโลยีของ Groq แบบไม่ผูกขาด พร้อมว่าจ้างผู้ก่อตั้ง Jonathan Ross ประธาน Sunny Madra และบุคลากรสำคัญบางส่วน แทนการเข้าซื้อกิจการ Groq ทั้งบริษัท 5
หลังจากนั้น Groq ยังคงดำเนินงานในฐานะบริษัทแยกต่างหากและระดมทุนรอบใหม่ จึงควรอธิบายดีลดังกล่าวว่าเป็นการนำเทคโนโลยีและบุคลากรหลักของ Groq เข้ามาเสริม Nvidia มากกว่าจะเรียกว่าเป็นการซื้อกิจการโดยสมบูรณ์ 5
หลักฐานที่มีอยู่ยังไม่เพียงพอสำหรับยืนยันรายละเอียดบางประการ เช่น การติดตั้งชิป 256 ตัวต่อแร็ก ปริมาณ SRAM บนชิป การผลิตโดย Samsung เมื่อเทียบกับ GPU ของ Nvidia ที่ผลิตโดย TSMC รวมถึงคำกล่าวเกี่ยวกับปฏิกิริยาของ AMD, Cerebras หรือโหมด 750 โทเคนต่อวินาทีของ OpenAI
นอกจากนี้ หลักฐานสนับสนุนเพียงว่า SpaceXAI มีแผนใช้งาน Vera CPU กับแอปพลิเคชัน AI แบบเอเจนต์ แต่ยังไม่ยืนยันรายละเอียดเรื่องการสั่งงานเครื่องมือ การจำลองระบบผ่านดาวเทียมวงโคจร หรือขอบเขตและกำหนดเวลาของการนำไปใช้งานดังกล่าว 7
Studio Global AI
หน้านี้รวมคำตอบที่ได้รับการสนับสนุนจากแหล่งที่มาซึ่งคุณสามารถดำเนินการต่อภายใน Studio Global
Nvidia ระบุเมื่อ 24 สิงหาคมที่งาน Hot Chips ว่า Groq 3 LPX ซึ่งเป็นตัวเร่งการอนุมานแบบติดตั้งระดับแร็ก เข้าสู่การผลิตเต็มรูปแบบแล้ว ในฐานะส่วนประมวลผลที่เน้นความหน่วงต่ำและบริบทยาวของแพลตฟอร์ม Vera Rubin [3][6]
Nvidia ระบุเมื่อ 24 สิงหาคมที่งาน Hot Chips ว่า Groq 3 LPX ซึ่งเป็นตัวเร่งการอนุมานแบบติดตั้งระดับแร็ก เข้าสู่การผลิตเต็มรูปแบบแล้ว ในฐานะส่วนประมวลผลที่เน้นความหน่วงต่ำและบริบทยาวของแพลตฟอร์ม Vera Rubin [3][6] LPX ออกแบบมาเพื่อเร่งการสร้างโทเคนสำหรับ AI แบบเอเจนต์ ทำงานเสริมกับระบบ Vera Rubin NVL72 ไม่ได้เข้ามาแทนที่ GPU สำหรับการฝึกโมเดลหรือการอนุมานทั่วไป [3][6]
ผลทดสอบ Artificial Analysis บนโมเดล Gemma 4 31B ของ Google ด้วยบริบท 100,000 โทเคนวัดได้ 3,431 โทเคนผลลัพธ์ต่อวินาที หรือราว 3,400 โทเคนต่อวินาทีตามตัวเลขที่ Nvidia ใช้ในการประกาศ [1][6]