تقول هواوي إن OceanStor M900 يوسّع ذاكرة KV المؤقتة إلى طبقة SSD مشتركة، بسعة تصل إلى 64 بيتابايت لكل مجموعة. وصول كل وحدة معالجة عصبية إلى سعة بمستوى التيرابايت يعني استخدام مخزون مشترك متعدد الطبقات، لا إضافة هذه السعة إلى ذاكرتها داخل الشريحة.
نشر بواسطةتم التحرير باستخدام GPT-6 Solتم إنشاء الصور باستخدام GPT Image 2
إجابة البحث

Create a landscape editorial hero image for this Studio Global article: How does Huawei’s OceanStor M900 AI memory storage address the KV Cache memory wall in hyperscale, long-context and agentic inference SuperP. Article summary: Huawei positions OceanStor M900 as a shared, SSD-backed **KV-cache tier** for SuperPoD inference, not as a replacement for the NPU’s fast memory. Its aim is to keep and reuse more context across long-running and agentic . Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
حين يتعامل نموذج ذكاء اصطناعي مع سياق طويل أو ينفّذ مهاماً متتابعة، تتراكم بيانات ذاكرة KV المؤقتة التي يمكن إعادة استخدامها أثناء الاستدلال، أي توليد الإجابات. وقد تتجاوز هذه البيانات ما تستطيع ذاكرة المسرّعات السريعة الاحتفاظ به. هنا تضع هواوي OceanStor M900: طبقة تخزين مشتركة تعتمد على أقراص الحالة الصلبة SSD، تتيح الاحتفاظ بمزيد من السياق وإعادة استخدامه، من دون أن تحل محل الذاكرة الأسرع داخل وحدة المعالجة العصبية NPU أو ذاكرة DRAM. 8
10
12
تقول هواوي إن شبكة الربط Lingqu، المعروفة أيضاً باسم UnifiedBus، تجمع ذاكرة KV المؤقتة عبر منظومة SuperPoD وتوزّعها بين الذاكرة داخل الشريحة وذاكرة DRAM وأقراص SSD. وتعلن سعة تصل إلى 64 بيتابايت لكل مجموعة، مع ارتفاع سعة ذاكرة KV المتاحة لكل وحدة NPU من مستوى الغيغابايت إلى مستوى التيرابايت. المقصود هنا الوصول إلى مخزون مشترك متعدد الطبقات، وليس امتلاك كل وحدة تيرابايتات من الذاكرة داخل شريحتها. 8
10
لذلك يُقدَّم M900 بوصفه نظاماً لتخزين سياق الاستدلال، لا شريحة حوسبة جديدة ولا بديلاً عن شبكة الربط. وتربط هواوي استخدامه بالأحمال التي تتضمن وكلاء ذكاء اصطناعي وسياقات أطول، فيما تشير تغطية متخصصة إلى أن منظومات Atlas 960 SuperPoD من بيئات تشغيله المستهدفة. 12
6
تُنسب إلى تصميم يدمج وظائف المعالج المركزي ومتحكم الشبكة ومتحكم أقراص NAND إمكانية وصول وحدة NPU إلى SSD بخطوة واحدة، من دون تمرير الطلب عبر المعالج المركزي أو تحويل البروتوكولات. وتقول هواوي إن ذلك يخفض زمن الوصول بنسبة 90% إلى 60 ميكروثانية. كما تعلن نطاق نقل بيانات إجمالياً يبلغ 40 تيرابايت في الثانية للمجموعة، أي 1.5 مرة مقارنة بالحل الذي تستخدمه مرجعاً للمقارنة؛ وهذا الرقم ليس حصة مضمونة لكل وحدة NPU. 8
وفي سيناريو تصفه بأنه «برمجة نموذجية بالذكاء الاصطناعي»، تقول الشركة إن إنتاجية الرموز النصية لمجموعة الاستدلال تتضاعف، بينما ينخفض الوقت حتى ظهور أول رمز إلى النصف. لا يعني ذلك أن كل طلب طويل السياق سيشهد المكسب نفسه. 8
14
تقول هواوي إن تقنية KV-Aware تتنبأ بمدة الحاجة إلى بيانات الذاكرة المؤقتة وتدير توزيعها بين وسائط التخزين. وتعلن دعماً لما يصل إلى 24 عملية كتابة لكامل سعة القرص يومياً، وعمراً أطول لوسائط SSD بمقدار 16 ضعفاً، وتشغيلاً مستقراً لثلاث سنوات. وترى أن تقليل تبديل الأقراص وأعمال الصيانة قد يخفض تكاليف الاستدلال، لكن المواد المتاحة لا تقدم قياساً موثقاً لمقدار الوفر في تكلفة الرمز النصي الواحد. 8
الخلاصة: يوضح M900 كيف يمكن إتاحة مساحة أكبر لذاكرة KV دون اشتراط بقائها كلها قرب المعالج. أما إثبات أن ذلك يجعل الاستدلال أسرع وأقل تكلفة على نطاق واسع، فيتطلب اختبارات مستقلة تقيس السعة القابلة للاستخدام ومعدلات العثور على البيانات في الذاكرة المؤقتة، وزمن الوصول ونطاق النقل عند تزاحم الطلبات، ومكاسب إنتاج الرموز مقابل خط أساس محدد، وتآكل الأقراص والتكلفة بمرور الوقت. التغطية الخارجية المتاحة تنقل أرقام هواوي، ولا تقدم تحققاً مستقلاً منها. 6
14
Studio Global AI
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
تقول هواوي إن OceanStor M900 يوسّع ذاكرة KV المؤقتة إلى طبقة SSD مشتركة، بسعة تصل إلى 64 بيتابايت لكل مجموعة.
تقول هواوي إن OceanStor M900 يوسّع ذاكرة KV المؤقتة إلى طبقة SSD مشتركة، بسعة تصل إلى 64 بيتابايت لكل مجموعة. وصول كل وحدة معالجة عصبية إلى سعة بمستوى التيرابايت يعني استخدام مخزون مشترك متعدد الطبقات، لا إضافة هذه السعة إلى ذاكرتها داخل الشريحة.
أرقام زمن الوصول وتسريع الاستدلال وتحمّل الأقراص صادرة عن هواوي، ولم تتحقق منها التغطية المستقلة المذكورة باختبارات منشورة.