Huawei tvrdí, že OceanStor M900 zpřístupní v jednom klastru až 64 PB sdílené kapacity pro KV cache. Terabajty dostupné jednotlivému NPU znamenají přístup ke sdílenému úložišti, nikoli terabajty nové paměti přímo v čipu.
PublikovalUpraveno pomocí GPT-6 SolObrázky vytvořeny pomocí GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How does Huawei’s OceanStor M900 AI memory storage address the KV Cache memory wall in hyperscale, long-context and agentic inference SuperP. Article summary: Huawei positions OceanStor M900 as a shared, SSD-backed **KV-cache tier** for SuperPoD inference, not as a replacement for the NPU’s fast memory. Its aim is to keep and reuse more context across long-running and agentic . Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
Když AI pracuje s dlouhým zadáním nebo průběžně plní více úkolů, ukládá si mezivýsledky do takzvané KV cache. Díky ní nemusí při dalším kroku znovu zpracovávat celý předchozí kontext. Problém nastává, když se tato mezipaměť nevejde do rychlé paměti u akcelerátorů. Huawei proto u systému OceanStor M900 přidává další, sdílenou vrstvu na discích SSD. Nemá nahradit paměť přímo v čipu ani operační paměť DRAM, ale umožnit uchovat a znovu využít více kontextu. 8
10
12
Propojení Lingqu, označované také jako UnifiedBus, má podle Huawei zpřístupnit KV cache napříč systémem SuperPoD a rozdělovat ji mezi paměť v čipu, DRAM a SSD. Firma uvádí až 64 PB kapacity na klastr a tvrdí, že každému NPU, tedy procesoru určenému pro výpočty AI, bude místo gigabajtů dostupná kapacita v terabajtech. To však neznamená, že jednotlivý procesor dostane terabajty nové rychlé paměti: jde o přístup ke sdílenému, víceúrovňovému úložišti. 8
10
M900 je tak úložná součást infrastruktury pro inferenci, tedy provozování již natrénovaných modelů, nikoli nový výpočetní čip. Doplňuje akcelerátory a při sdílení dat spoléhá na propojení Lingqu. Huawei jej zaměřuje na delší kontext a úlohy vykonávané AI agenty; oborové zpravodajství jako cílové prostředí uvádí systémy Atlas 960 SuperPoD. 12
6
Huawei popisuje architekturu, která integruje funkce CPU, síťového řadiče a řadiče pamětí NAND. NPU se podle firmy díky tomu dostane k SSD jedním síťovým skokem, bez předávání požadavku přes CPU a převodu protokolů. Huawei uvádí zkrácení přístupové latence o 90 % na 60 mikrosekund a souhrnnou propustnost 40 TB/s na klastr, údajně 1,5násobek srovnávacího řešení. Propustnost celého klastru ovšem není rychlost zaručená každému NPU. 8
Při „typické“ úloze programování s AI firma uvádí dvojnásobnou propustnost tokenů celého inferenčního klastru a poloviční dobu do prvního tokenu odpovědi. Z tohoto scénáře nelze vyvozovat stejné zrychlení pro každou práci s dlouhým kontextem či AI agentem. 8
14
Technologie KV-Aware má podle Huawei odhadovat, jak dlouho budou uložená data užitečná, a podle toho řídit jejich umístění. Firma uvádí až 24 přepisů kapacity disku za den (DWPD), 16násobně delší životnost SSD médií a tři roky stabilního provozu. Méně výměn disků a údržby by podle ní mělo snížit náklady na inferenci. Citované podklady ale neobsahují doloženou úsporu nákladů na jeden token. 8
Podstatný rozdíl je mezi tím, že AI má na dosah větší kapacitu KV cache, a tím, že díky ní bude v praxi prokazatelně rychlejší a levnější. Nezávislé testy by musely ukázat využitelnou kapacitu a četnost nalezení potřebných dat v cache při skutečné zátěži, latenci a trvalou propustnost při souběžných požadavcích, výkon proti jasně určenému výchozímu řešení i opotřebení SSD a celkové náklady v čase. Dostupné zpravodajské články čísla Huawei přebírají, nikoli nezávisle ověřují. 6
14
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Huawei tvrdí, že OceanStor M900 zpřístupní v jednom klastru až 64 PB sdílené kapacity pro KV cache.
Huawei tvrdí, že OceanStor M900 zpřístupní v jednom klastru až 64 PB sdílené kapacity pro KV cache. Terabajty dostupné jednotlivému NPU znamenají přístup ke sdílenému úložišti, nikoli terabajty nové paměti přímo v čipu.
Údaje o rychlosti, životnosti SSD a nižších nákladech pocházejí od Huawei; nezávislé testy je zatím nepotvrzují.