Inspur เปิดตัว SD200 Ultra ที่งาน AICC2026 โดยระบุว่ารวมชิป AI 128 ตัว และรัน Kimi K3 ขนาด 2.8 ล้านล้านพารามิเตอร์ได้ ด้วยเวลา生成โทเคนต่ำกว่า 5.85 มิลลิวินาทีต่อโทเคน ทั้งหมดเป็นตัวเลขจากบริษัท [1][3] HC2000 เน้นปริมาณโทเคนที่ผลิตได้ต่อเงินลงทุน ไม่ใช่ความเร็วตอบสนองของผู้ใช้รายเดียวแบบที่ SD200 Ultra ชูเป็นจุดขาย คำ...
เผยแพร่โดยแก้ไขด้วย GPT-6 Solรูปภาพสร้างด้วย GPT Image 2
คำตอบการวิจัย

Create a landscape editorial hero image for this Studio Global article: What did Inspur Information announce about the MetaBrain SD200 Ultra at AICC2026, including its intended workloads, 128-chip and memory conf. Article summary: Inspur Information announced the MetaBrain SD200 Ultra at AICC2026 as a tightly coupled supernode for large frontier models and latency-sensitive AI-agent workloads. It also introduced the MetaBrain HC2000 as a separate,. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Inspur Information เปิดตัว MetaBrain SD200 Ultra ในงานประชุมด้านการประมวลผล AI AICC2026 โดยวางตำแหน่งเป็นซูเปอร์โหนดสำหรับโมเดลขนาดใหญ่มากและงาน AI agent ที่ต้องการความหน่วงต่ำ พร้อมเปิดตัว MetaBrain HC2000 สำหรับโจทย์อีกแบบหนึ่ง คือเพิ่มปริมาณโทเคนที่ผลิตได้ในการประมวลผลโมเดล ตัวเลขประสิทธิภาพของทั้งสองระบบเป็นคำกล่าวอ้างของผู้ผลิต ยังไม่ใช่ผลทดสอบอิสระ 3
18
20
SD200 Ultra ใช้สถาปัตยกรรม 3D Hyper Mesh เชื่อมชิปเร่งความเร็ว AI ที่ผลิตในประเทศจีน 128 ตัว เข้าด้วยกัน Inspur ระบุว่าระบบมีหน่วยความจำบนชิปเร่งความเร็วแบบเข้าถึงผ่านที่อยู่ร่วมกัน 8 TB และหน่วยความจำระบบ 64 TB บริษัทบอกว่าเครื่องเดียวรัน Kimi K3 ขนาด 2.8 ล้านล้านพารามิเตอร์ ได้ และรองรับโมเดลขนาดสูงสุด 10 ล้านล้านพารามิเตอร์ ตัวเลขหลังบอกถึงขนาดโมเดลที่อ้างว่ารองรับ ไม่ได้บอกว่ารันโมเดลขนาดนั้นได้เร็วเพียงใด 3
17
สำหรับ Kimi K3 บริษัทระบุว่าใช้เวลา ต่ำกว่า 5.85 มิลลิวินาทีในการสร้างหนึ่งโทเคน หรือประมาณ 170 โทเคนต่อวินาทีสำหรับผู้ใช้หนึ่งราย และอ้างว่าเร็วกว่าค่าเฉลี่ยอุตสาหกรรม 5 เท่า แต่ข้อมูลการทดสอบที่เผยแพร่ยังไม่เพียงพอจะยืนยันว่าเป็นการเปรียบเทียบภายใต้เงื่อนไขเดียวกัน อีกทั้งเวลาสร้างโทเคนแต่ละตัวไม่ใช่เวลาเริ่มแสดงโทเคนแรก หรือเวลาที่ผู้ใช้รอจนได้คำตอบครบ 1
3
Inspur ระบุว่าการกำหนดที่อยู่หน่วยความจำร่วมกันและการสื่อสารที่เข้าถึงหน่วยความจำโดยตรงช่วยลดการย้ายข้อมูลระหว่างชิป เทคโนโลยีหน่วยความจำแบบสมมาตรทำให้ชิปเร่งความเร็วเข้าถึงหน่วยความจำของชิปอีกตัวได้โดยตรง บริษัทรายงานความหน่วงการสื่อสารต่ำสุด 0.69 ไมโครวินาที และเวลาในการสื่อสารแบบ AllReduce ลดลง 3.5 เท่า ทั้งสองตัวเลขวัดการสื่อสารภายในระบบ ไม่ใช่เวลาตอบกลับของแอปพลิเคชัน 2
17
สำหรับ Kimi K3 โดยเฉพาะ Inspur ระบุว่าได้รวมงานประมวลผลของ KDA, Gated MLA และ MoE ให้เป็นตัวดำเนินการขนาดใหญ่ที่จัดการทั้งการคำนวณและการสื่อสาร บริษัทอ้างว่าลดจำนวนตัวดำเนินการได้ราว 10 เท่า และเพิ่มประสิทธิภาพการรันโมเดลเพื่อสร้างคำตอบได้มากกว่า 3 เท่า ผลดังกล่าวผูกกับงานที่ทดสอบ ไม่ควรนำไปคาดว่าจะได้ความเร็วเพิ่มเท่ากันกับทุกโมเดล 17
19
HC2000 มุ่งเพิ่มปริมาณงานประมวลผลโมเดลโดยใช้แร็กระบายความร้อนด้วยของเหลว สถาปัตยกรรม DirectCom 2.0 และซอฟต์แวร์ MCIS Inspur อ้างว่าให้ ปริมาณโทเคนมากขึ้น 10 เท่าภายใต้เงินลงทุนเท่ากัน นี่เป็นการชูเรื่องผลผลิตต่อเงินลงทุน ไม่ใช่คำยืนยันว่า HC2000 ทำเวลา生成โทเคนสำหรับผู้ใช้รายเดียวได้เท่า SD200 Ultra การประเมินคำกล่าวอ้างนี้ต้องรู้ว่าเทียบกับระบบใด ใช้งานแบบไหน และนับต้นทุนส่วนใดบ้าง 18
20
รายงานที่เผยแพร่ระบุเพียงว่าชิปเร่งความเร็วของ SD200 Ultra ผลิตในประเทศจีน แต่ไม่ได้บอกชื่อผู้ผลิตชิป ก่อนจัดซื้อ ผู้ซื้อจึงควรขอข้อมูลชิปและการรองรับของซอฟต์แวร์ พร้อมทดสอบซ้ำด้วยโมเดลที่จะใช้งานจริง โดยกำหนดความละเอียดของข้อมูลที่ใช้คำนวณ ความยาวบริบท และจำนวนคำขอที่ประมวลผลพร้อมกันให้ชัดเจน แล้ววัดทั้งเวลารอโทเคนแรก อัตราผลิตโทเคนต่อเนื่อง การใช้พลังงาน และต้นทุนรวม หากไม่มีเงื่อนไขเหล่านี้ ตัวเลขในวันเปิดตัวก็ยังบอกประสิทธิภาพในการใช้งานจริงของผู้ซื้อได้ไม่แน่นอน 1
3
18
Studio Global AI
หน้านี้รวมคำตอบที่ได้รับการสนับสนุนจากแหล่งที่มาซึ่งคุณสามารถดำเนินการต่อภายใน Studio Global
Inspur เปิดตัว SD200 Ultra ที่งาน AICC2026 โดยระบุว่ารวมชิป AI 128 ตัว และรัน Kimi K3 ขนาด 2.8 ล้านล้านพารามิเตอร์ได้ ด้วยเวลา生成โทเคนต่ำกว่า 5.85 มิลลิวินาทีต่อโทเคน ทั้งหมดเป็นตัวเลขจากบริษัท [1][3]
Inspur เปิดตัว SD200 Ultra ที่งาน AICC2026 โดยระบุว่ารวมชิป AI 128 ตัว และรัน Kimi K3 ขนาด 2.8 ล้านล้านพารามิเตอร์ได้ ด้วยเวลา生成โทเคนต่ำกว่า 5.85 มิลลิวินาทีต่อโทเคน ทั้งหมดเป็นตัวเลขจากบริษัท [1][3] HC2000 เน้นปริมาณโทเคนที่ผลิตได้ต่อเงินลงทุน ไม่ใช่ความเร็วตอบสนองของผู้ใช้รายเดียวแบบที่ SD200 Ultra ชูเป็นจุดขาย คำกล่าวอ้างว่าผลิตโทเคนได้ 10 เท่าจึงต้องตรวจสอบฐานเปรียบเทียบ [18][20]