SD200 Ultra propojuje 128 AI akcelerátorů; Inspur uvádí 8 TB adresovatelné paměti akcelerátorů a 64 TB operační paměti. Při běhu Kimi K3 výrobce hlásí méně než 5,85 ms na vygenerovaný token.
PublikovalUpraveno pomocí GPT-6 SolObrázky vytvořeny pomocí GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Inspur Information announce about the MetaBrain SD200 Ultra at AICC2026, including its intended workloads, 128-chip and memory conf. Article summary: Inspur Information announced the MetaBrain SD200 Ultra at AICC2026 as a tightly coupled supernode for large frontier models and latency-sensitive AI-agent workloads. It also introduced the MetaBrain HC2000 as a separate,. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Společnost Inspur Information představila 21. září 2026 na konferenci AICC2026 superuzel MetaBrain SD200 Ultra pro provoz mimořádně velkých AI modelů a úlohy, u nichž záleží na rychlosti odezvy. Současně uvedla MetaBrain HC2000, který naopak staví do popředí množství tokenů vyprodukovaných při inferenci. Výkonnostní čísla u obou systémů pocházejí od výrobce, nikoli z nezávislých srovnávacích testů. 3
18
20
SD200 Ultra podle Inspuru propojuje 128 AI akcelerátorů čínské výroby architekturou 3D Hyper Mesh. Nabízí 8 TB paměti akcelerátorů se sjednoceným adresováním a 64 TB operační paměti. Výrobce tvrdí, že jeden systém dokáže provozovat model Kimi K3 s 2,8 bilionu parametrů a podporuje modely o velikosti až 10 bilionů parametrů. Druhý údaj vypovídá o deklarované kapacitě, nikoli o rychlosti inference na tak velkém modelu. 3
17
Pro Kimi K3 uvádí Inspur méně než 5,85 milisekundy na vygenerovaný token, což vyjadřuje jako přibližně 170 tokenů za sekundu pro jednoho uživatele. Podle firmy jde o pětinásobek oborového průměru, dostupné podklady však nepopisují test natolik podrobně, aby šlo o srovnání za stejných podmínek. Čas na jeden další token navíc není totéž co čekání na první token ani doba do dokončení celé odpovědi. 1
3
Sjednocené adresování a přímý přístup akcelerátorů k paměti ostatních čipů mají omezit přesuny dat. Inspur uvádí komunikační latenci až 0,69 mikrosekundy a 3,5krát kratší dobu komunikační operace AllReduce. Jde o údaje o komunikaci mezi čipy, nikoli o čas odezvy aplikace. 2
17
Pro inferenci Kimi K3 firma popisuje také slučování operací souvisejících s KDA, Gated MLA a MoE do větších výpočetních a komunikačních celků. Podle Inspuru tím počet operátorů klesá přibližně desetkrát a výkon inference roste více než trojnásobně. Tento údaj se vztahuje ke konkrétní optimalizaci a není příslibem stejného zrychlení pro jiné modely. 17
19
HC2000 má řešit jinou potřebu: zvýšit celkovou produkci tokenů. Kombinuje kapalinou chlazený rack, architekturu DirectCom 2.0 a inferenční software MCIS. Inspur mu připisuje desetinásobný objem vyprodukovaných tokenů při stejné investici. Bez uvedení srovnávacího systému, zátěže a zahrnutých nákladů však nelze posoudit, co tento poměr znamená v konkrétním nasazení. Nejde ani o tvrzení, že HC2000 dosahuje latence SD200 Ultra pro jednoho uživatele. 18
20
Dostupné zprávy označují akcelerátory SD200 Ultra za domácí, jejich dodavatele ale nejmenují. Zájemci by si proto měli vyžádat přesný typ čipů a informace o softwarové podpoře. Rozhodující bude opakovatelný test na vlastních modelech, s uvedenou numerickou přesností, délkou kontextu a počtem současných požadavků. Vedle rychlosti generování je vhodné měřit čekání na první token, dlouhodobou propustnost, spotřebu energie a celkové náklady. Bez těchto podmínek nelze z čísel při uvedení produktu spolehlivě předpovědět výkon v provozu. 1
3
18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
SD200 Ultra propojuje 128 AI akcelerátorů; Inspur uvádí 8 TB adresovatelné paměti akcelerátorů a 64 TB operační paměti.
SD200 Ultra propojuje 128 AI akcelerátorů; Inspur uvádí 8 TB adresovatelné paměti akcelerátorů a 64 TB operační paměti. Při běhu Kimi K3 výrobce hlásí méně než 5,85 ms na vygenerovaný token. Bez podmínek testu z toho nelze vyvozovat dobu čekání na celou odpověď.
HC2000 míří na objem vyprodukovaných tokenů. Jeho údajný desetinásobný výkon při stejné investici vyžaduje jasně určené srovnání.