Huawei के मुताबिक, OceanStor M900 एक क्लस्टर में 64 PB तक की साझा KV कैश क्षमता उपलब्ध करा सकता है। [8] हर NPU को टेराबाइट स्तर की कैश उपलब्ध होने का मतलब उसकी चिप में उतनी नई मेमोरी जुड़ना नहीं, बल्कि साझा स्टोरेज तक पहुँच मिलना है। [8][10] लेटेंसी, टोकन प्रदर्शन और SSD की उम्र के आँकड़े Huawei के दावे हैं; स्वतंत्...
प्रकाशितकर्ताGPT-6 Sol से संपादितGPT Image 2 से चित्र बनाए गए
शोध उत्तर

Create a landscape editorial hero image for this Studio Global article: How does Huawei’s OceanStor M900 AI memory storage address the KV Cache memory wall in hyperscale, long-context and agentic inference SuperP. Article summary: Huawei positions OceanStor M900 as a shared, SSD-backed **KV-cache tier** for SuperPoD inference, not as a replacement for the NPU’s fast memory. Its aim is to keep and reuse more context across long-running and agentic . Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
लंबे दस्तावेज़ पर काम करने वाले या कई चरणों में निर्णय लेने वाले AI एजेंट, जवाब तैयार करते समय बड़ी मात्रा में KV कैश बना सकते हैं। इसमें वह मध्यवर्ती संदर्भ रहता है जिसे दोबारा इस्तेमाल करना उपयोगी हो सकता है। मुश्किल यह है कि चिप और मुख्य मेमोरी के पास इसकी जगह सीमित होती है। Huawei का OceanStor M900 इसी कमी के लिए SuperPoD में SSD-आधारित, साझा कैश की एक अतिरिक्त परत जोड़ता है। इसका उद्देश्य तेज़ ऑन-चिप मेमोरी की जगह लेना नहीं, बल्कि अधिक संदर्भ को संभालकर दोबारा उपयोग के लिए उपलब्ध रखना है। 8
10
12
Huawei के अनुसार, उसका Lingqu (UnifiedBus) इंटरकनेक्ट SuperPoD में KV कैश को साझा करता है और उसे ऑन-चिप मेमोरी, DRAM तथा SSD के बीच अलग-अलग स्तरों पर रखता है। कंपनी एक क्लस्टर में 64 PB तक क्षमता और प्रत्येक NPU—यानी AI गणना करने वाली इकाई—के लिए उपलब्ध KV कैश का दायरा गीगाबाइट से टेराबाइट स्तर तक पहुँचने का दावा करती है। यह NPU की अपनी चिप पर टेराबाइट मेमोरी जुड़ने का दावा नहीं है; NPU को साझा, कई स्तरों में रखी कैश तक पहुँच मिलती है। 8
10
इसी वजह से M900 को नया कंप्यूट चिप समझने के बजाय इन्फ़रेंस के लिए संदर्भ सँभालने वाला स्टोरेज सिस्टम समझना बेहतर है। इन्फ़रेंस वह चरण है जिसमें प्रशिक्षित AI मॉडल जवाब बनाता है। M900 गणना करने वाले NPU और साझा पहुँच देने वाले इंटरकनेक्ट, दोनों का पूरक है। Huawei इसे AI एजेंट और लंबे संदर्भ वाले कामों के लिए पेश करता है; उद्योग की रिपोर्टिंग Atlas 960 SuperPoD को इसके लक्षित परिवेश के रूप में पहचानती है। 12
6
Huawei का कहना है कि CPU, नेटवर्क कंट्रोलर और NAND कंट्रोलर के कार्यों को एकीकृत करने से NPU से SSD तक ‘एक हॉप’ का रास्ता बनता है। उसके अनुसार, CPU के ज़रिये डेटा आगे भेजने और प्रोटोकॉल बदलने की ज़रूरत घटने से एक्सेस लेटेंसी 90% कम होकर 60 माइक्रोसेकंड रह जाती है। कंपनी पूरे क्लस्टर के लिए कुल 40 TB/s बैंडविड्थ का दावा भी करती है—अपने बताए तुलनात्मक समाधान से 1.5 गुना। यह हर NPU के लिए सुनिश्चित बैंडविड्थ नहीं है। 8
कंपनी के एक ‘सामान्य AI प्रोग्रामिंग’ परिदृश्य में इन्फ़रेंस क्लस्टर से निकलने वाले टोकन की दर दोगुनी और पहला टोकन आने का समय आधा बताया गया है। इसे हर लंबे संदर्भ या एजेंट-आधारित अनुरोध पर मिलने वाली बढ़त नहीं मानना चाहिए। 8
14
Huawei के अनुसार, M900 की KV-Aware तकनीक कैश डेटा के उपयोगी रहने की अवधि का अनुमान लगाकर उसे अलग-अलग स्टोरेज माध्यमों में रखती है। कंपनी प्रतिदिन प्रति ड्राइव 24 पूर्ण लिखाई तक सहने की क्षमता, SSD माध्यम की 16 गुना लंबी उम्र और तीन साल स्थिर संचालन का दावा करती है। उसका तर्क है कि ड्राइव बदलने और रखरखाव की कम ज़रूरत से खर्च घट सकता है, लेकिन उपलब्ध सामग्री प्रति टोकन लागत में मापी गई बचत नहीं दिखाती। 8
असल फ़र्क अधिक कैश तक पहुँच और बड़े पैमाने पर तेज़ व सस्ती इन्फ़रेंस साबित होने के बीच है। स्वतंत्र परीक्षणों में वास्तविक कामों पर उपयोगी क्षमता और कैश-हिट दर, एक साथ अधिक माँग होने पर लेटेंसी और टिकाऊ बैंडविड्थ, स्पष्ट तुलनात्मक आधार पर टोकन प्रदर्शन, तथा समय के साथ SSD घिसावट और कुल लागत जाँचना ज़रूरी होगा। उपलब्ध बाहरी कवरेज Huawei के आँकड़ों को रिपोर्ट करती है; उनका स्वतंत्र सत्यापन नहीं करती। 6
14
Studio Global AI
इस पृष्ठ में एक स्रोत-समर्थित उत्तर शामिल है जिसे आप Studio Global के अंदर जारी रख सकते हैं।
Huawei के मुताबिक, OceanStor M900 एक क्लस्टर में 64 PB तक की साझा KV कैश क्षमता उपलब्ध करा सकता है। [8]
Huawei के मुताबिक, OceanStor M900 एक क्लस्टर में 64 PB तक की साझा KV कैश क्षमता उपलब्ध करा सकता है। [8] हर NPU को टेराबाइट स्तर की कैश उपलब्ध होने का मतलब उसकी चिप में उतनी नई मेमोरी जुड़ना नहीं, बल्कि साझा स्टोरेज तक पहुँच मिलना है। [8][10]
लेटेंसी, टोकन प्रदर्शन और SSD की उम्र के आँकड़े Huawei के दावे हैं; स्वतंत्र परीक्षण अभी ज़रूरी हैं। [8][14]