Huawei מציגה את OceanStor M900 כשכבת מטמון KV משותפת המבוססת על כונני SSD, עם קיבולת מוצהרת של עד 64 פטה־בייט לאשכול. הבטחת הטרה־בייט לכל NPU מתייחסת לגישה לאחסון משותף ורב־שכבתי, לא לתוספת זיכרון מהיר בתוך השבב.
פורסם על ידינערך באמצעות GPT-6 Solהתמונות נוצרו באמצעות GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How does Huawei’s OceanStor M900 AI memory storage address the KV Cache memory wall in hyperscale, long-context and agentic inference SuperP. Article summary: Huawei positions OceanStor M900 as a shared, SSD-backed **KV-cache tier** for SuperPoD inference, not as a replacement for the NPU’s fast memory. Its aim is to keep and reuse more context across long-running and agentic . Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
כשמערכת בינה מלאכותית עובדת עם הקשר ארוך או מפעילה סוכנים לאורך כמה שלבים, היא עשויה לצבור מטמון KV — נתונים שכבר חושבו ויכולים לשמש שוב בהמשך ההסקה. הזיכרון המהיר הקרוב למעבדים מוגבל בנפחו. OceanStor M900 של Huawei נועד להוסיף מתחתיו שכבת מטמון משותפת על גבי כונני SSD, כדי לשמור יותר הקשר זמין לשימוש חוזר. הוא אינו מציג כונני SSD כתחליף לזיכרון המהיר ביותר של המעבד. 8
10
12
לפי Huawei, רשת הקישוריות Lingqu, המכונה גם UnifiedBus, מאפשרת לאגד מטמון KV ברחבי מערכת SuperPoD ולנהל אותו בין זיכרון על גבי השבב, זיכרון DRAM וכונני SSD. החברה מצהירה על קיבולת של עד 64 פטה־בייט לאשכול, ועל מעבר מקיבולת מטמון זמינה של גיגה־בייטים לטרה־בייטים לכל NPU — יחידת העיבוד שמריצה את חישובי הבינה המלאכותית. ההבחנה החשובה: מדובר בגישה לקיבולת משותפת בכמה שכבות, לא בתוספת של טרה־בייטים לזיכרון הפיזי שעל כל שבב. 8
10
לכן M900 הוא מערך אחסון להקשר המשמש בשלב ההסקה, ולא שבב חישוב חדש או תחליף לרשת הקישוריות. Huawei מייעדת אותו לעומסים של סוכני AI ולהקשרים ארוכים; דיווח בענף מציין את מערכות Atlas 960 SuperPoD כסביבת יעד. 12
6
Huawei אומרת ששילוב פונקציות של CPU, בקר רשת ובקר NAND מאפשר מעבר אחד מה־NPU לכונן SSD, בלי העברת הבקשה דרך ה־CPU ובלי המרת פרוטוקולים. לטענתה, כך זמן הגישה מתקצר ב־90% ל־60 מיקרו־שניות. החברה מצהירה גם על רוחב פס מצטבר של 40 טרה־בייט לשנייה לאשכול, פי 1.5 מפתרון ההשוואה שלה. זהו נתון לאשכול כולו, לא קצב שמובטח לכל NPU בנפרד. 8
בעומס עבודה שהיא מגדירה כ״תכנות AI טיפוסי״, Huawei מדווחת על קצב הפקת טוקנים כפול לאשכול ההסקה ועל קיצור בחצי של הזמן עד לטוקן הראשון. אין בכך הוכחה שכל בקשה עם הקשר ארוך או כל משימה של סוכן AI תואץ באותה מידה. 8
14
לפי Huawei, מנגנון KV-Aware חוזה כמה זמן נתוני המטמון יישארו שימושיים ומתזמן את מיקומם בין שכבות האחסון. החברה טוענת לתמיכה בעד 24 כתיבות מלאות של הכונן ביום, להארכת חיי מדיית ה־SSD פי 16 ולשלוש שנות פעילות יציבה. לשיטתה, פחות החלפות כוננים ופחות תחזוקה עשויות להוזיל את ההסקה; החומר המצוטט אינו מציג מדידה של החיסכון בפועל בעלות לטוקן. 8
השורה התחתונה: קיבולת מטמון גדולה יותר שנמצאת בהישג יד אינה זהה להוכחה שההסקה תהיה מהירה וזולה יותר בקנה מידה גדול. בדיקות עצמאיות יצטרכו למדוד כמה מהקיבולת שימושית וכמה בקשות אכן מוצאות נתונים במטמון; לבדוק זמני גישה ורוחב פס לאורך זמן כשיש עומס מתחרה; להשוות את קצב הטוקנים לנקודת ייחוס מוגדרת; ולעקוב אחר שחיקת הכוננים והעלות הכוללת. הסיקור החיצוני הזמין מדווח על נתוני Huawei, אך אינו מאמת אותם בבדיקות עצמאיות. 6
14
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Huawei מציגה את OceanStor M900 כשכבת מטמון KV משותפת המבוססת על כונני SSD, עם קיבולת מוצהרת של עד 64 פטה־בייט לאשכול.
Huawei מציגה את OceanStor M900 כשכבת מטמון KV משותפת המבוססת על כונני SSD, עם קיבולת מוצהרת של עד 64 פטה־בייט לאשכול. הבטחת הטרה־בייט לכל NPU מתייחסת לגישה לאחסון משותף ורב־שכבתי, לא לתוספת זיכרון מהיר בתוך השבב.
Huawei מדווחת על שיפור בהשהיה ובקצב הפקת הטוקנים, אך הנתונים עדיין זקוקים לאימות עצמאי בעומסי עבודה אמיתיים.