OceanStor M900 utökar SuperPoD systemens KV cache från chipminne och DRAM till delade SSD enheter. Huawei uppger cirka 60 mikrosekunders åtkomstfördröjning och 40 TB/s i sammanlagd bandbredd per kluster.
Publicerad avRedigerad med GPT-6 SolBilder genererade med GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is Huawei’s OceanStor M900 Context Memory Storage, introduced at HUAWEI CONNECT 2026 for AI inference SuperPoDs, and how does its Unifi. Article summary: Huawei’s OceanStor M900 is a storage system for SuperPoD AI inference, introduced at HUAWEI CONNECT 2026. It uses UnifiedBus to make the key–value (KV) cache—a reusable record of attention calculations—available across a. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
Huawei presenterade OceanStor M900 på HUAWEI CONNECT 2026. Systemet är byggt för inferens – när en AI-modell genererar svar – i företagets SuperPoD-kluster. Tanken är att fler acceleratorer ska kunna dela och återanvända tidigare beräknat sammanhang när instruktioner, konversationer och arbetsflöden med AI-agenter blir längre. 1
9
En KV-cache, eller nyckel–värde-cache, sparar mellanresultat från modellens bearbetning av en instruktion. Om en ny förfrågan har en del som redan finns i cachen kan systemet i vissa fall slippa räkna om just den delen. Det blir särskilt intressant vid långa sammanhang och upprepade interaktioner, men cachen kan också bli för stor för minnet nära varje AI-accelerator, eller NPU. 1
3
6
OceanStor M900 använder Huaweis nätverk UnifiedBus för att göra KV-cachen till en delad pool över flera lagringsnivåer: minne på chipet, arbetsminne (DRAM) och SSD-enheter. Enligt Huawei kan ett kluster rymma 64 PB KV-cache, samtidigt som mängden cache som en enskild NPU kan komma åt ökar från gigabyte- till terabytenivå. 64 PB avser alltså klustrets delade kapacitet, inte minnet inuti en NPU. Hur mycket detta hjälper beror på om inkommande förfrågningar faktiskt kan återanvända sparat innehåll. 3
6
17
För att SSD-lagret ska vara användbart under inferens beskriver Huawei en åtkomstväg med ett enda hopp mellan NPU och SSD. Konstruktionen samlar funktioner för processor, nätverksstyrenhet och NAND-styrenhet för att undvika vissa steg där data annars skulle behöva skickas vidare via en processor eller byta protokoll. Huawei uppger en åtkomstfördröjning på omkring 60 mikrosekunder och en sammanlagd bandbredd på 40 TB/s per kluster. Det är angivna systemvärden, inte löften om hastigheten för varje cacheuppslag. 3
6
28
32
När en förfrågan kan återanvända cachat arbete kan tiden till det första genererade textfragmentet, en token, minska. Mindre omräkning kan också frigöra kapacitet för att generera fler token. Huawei säger att arkitekturen i ett typiskt scenario för AI-assisterad kodning fördubblade inferensklustrets tokengenomströmning och halverade tiden till första token. Resultatet gäller det angivna scenariot och kan inte förutsättas för andra arbetslaster. 28
33
Huawei beskriver också KV-medveten placering som styr hur länge cachedata ligger kvar på olika lagringsmedier. Företaget anger SSD-uthållighet på upp till 24 fullständiga enhetsskrivningar per dag, en 16-faldig förbättring av livslängden och ett mål om stabil drift i tre år. Tanken är att mindre omräkning och färre byten av lagringsenheter ska sänka kostnaden per genererad token. Det tillgängliga underlaget visar däremot inte att prestandan, livslängden eller kostnadsbesparingarna har bekräftats oberoende i SuperPoD-kluster i drift. 6
8
33
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
OceanStor M900 utökar SuperPoD systemens KV cache från chipminne och DRAM till delade SSD enheter.
OceanStor M900 utökar SuperPoD systemens KV cache från chipminne och DRAM till delade SSD enheter. Huawei uppger cirka 60 mikrosekunders åtkomstfördröjning och 40 TB/s i sammanlagd bandbredd per kluster.