לפי TrendForce ודיווחים נוספים, Nvidia בוחנת תצורות זיכרון מופחתות עבור מאיץ Rubin Ultra העתידי, ובמקביל דווח כי כבר צמצמה את קיבולת זיכרון המערכת בגרסת Vera Rubin NVL72. Nvidia מציגה את המהלכים האלה כתכנון מוצר רגיל עבור פלחי לקוחות שונים — ולא כקיצוץ שנכפה עליה בגלל קשיי אספקה. כך או כך, הזמינות והמחיר של HBM4 מתחילים להשפיע ישירות על מפת הדרכים של תשתיות ה-AI.
החל מהרבעון השלישי של 2026 הרחיבה Nvidia את בדיקות תצורת ה-HBM של Rubin Ultra. במקום להתמקד רק בתכנון המקורי, שכלל זיכרון 12-Hi HBM4e, החברה בוחנת במקביל ארבע אפשרויות :
המונחים 8-Hi ו-12-Hi מתייחסים למספר שכבות שבבי הזיכרון שנערמות זו על גבי זו. ככלל, תצורה גבוהה יותר יכולה לספק קיבולת וביצועים גדולים יותר, אך היא גם מורכבת ויקרה יותר לייצור.
חשוב להדגיש: Nvidia עדיין לא קבעה מפרט סופי ל-Rubin Ultra . לפי הדיווחים, ההחלטה קשורה הן למחסור הצפוי בכושר ייצור של פרוסות סיליקון עבור HBM והן לאי-ודאות סביב לוחות הזמנים להסמכת HBM4e אצל שלוש יצרניות הזיכרון הגדולות .
בפלטפורמת Vera Rubin השינוי שדווח קונקרטי יותר. Nvidia צפויה להשתמש במודולי SOCAMM בנפח של 96 גיגה-בייט, לעומת 192 גיגה-בייט שתוכננו קודם לכן — כלומר, הפחתה של 50% בקיבולת למודול .
לפי ניתוחים שצוטטו בידי TrendForce ו-GF Securities, המשמעות היא שסך זיכרון המעבדים של Vera בכל ארון NVL72 יירד מכ-55 טרה-בייט לכ-28 טרה-בייט. מנגד, קיבולת זיכרון ה-HBM4 של המעבדים הגרפיים תישאר ללא שינוי, ברמה של 20.7 טרה-בייט לארון .
המהלך נועד, לפי הדיווחים, להפחית עלויות ולהקל על מגבלות האספקה. הזיכרון — שילוב של HBM ו-SOCAMM — מהווה כ-29% מעלות החומרים הכוללת, או BOM, של פלטפורמת Vera Rubin .
יש גם פרשנות אחרת לדיווחים: ייתכן שמה שנראה כמו הפחתת מפרט הוא למעשה בדיקה של כמה מק"טים (SKU) — גרסאות מוצר עם רמות זיכרון שונות, המותאמות ללקוחות ולעומסי עבודה שונים . תצורה עתירת זיכרון יכולה להתאים לאימון מודלים גדולים, בעוד שגרסה חסכונית יותר עשויה להספיק למשימות אחרות.
בפוסט שפורסם ב-7 באוגוסט 2026 דחתה Nvidia את הטענה ש-Vera או Rubin עברו קיצוץ בגלל מחסור ב-HBM. החברה מסרה כי מדובר בגרסאות מוצר שונות ובהתאמה ייעודית ללקוחות, ולא בשדרוג לאחור שנכפה בגלל מגבלות אספקה . Nvidia הוסיפה שהיא מתאימה באופן שוטף את משאבי החישוב, הרשת והזיכרון כדי לספק ללקוחות את האיזון הטוב ביותר בין ביצועים ליעילות .
גם המנכ"ל ג'נסן הואנג סיפק מסרים מרגיעים יותר. ביוני 2026 הוא אישר כי Samsung, SK Hynix ו-Micron — שלוש יצרניות הזיכרון הגדולות — הוסמכו לספק HBM4 לפלטפורמת Vera Rubin. לדבריו, Vera Rubin נמצאת בייצור מלא, בעוד שרתי Rubin, Rubin Ultra ו-Kyber נמצאים במסלול המתוכנן .
ביולי דחה הואנג דיווחים על עיכובים ואמר שייצור Vera Rubin מתקדם בהיקפים "עצומים" .
לכן נוצר פער ברור בין המסרים: TrendForce ואנליסטים אחרים רואים בריבוי התצורות תוכנית גיבוי שנועדה להתמודד עם מחסור, ואילו Nvidia מתארת את המהלך כחלק מתכנון רגיל של מגוון מוצרים.
לפי הדיווחים, כל מלאי ה-HBM4 לשנת 2026 כבר נמכר, ומחסור ה-DRAM צפוי להימשך עד 2027 . עבור Nvidia, מדובר בבעיה מבנית: גם אם המעבדים הגרפיים עצמם מוכנים, אין ודאות שתהיה די קיבולת זיכרון כדי לייצר את המערכות בקצב הרצוי.
כאשר זיכרון מהווה כ-29% מעלות החומרים של מערכת Vera Rubin NVL72, הוא הופך לאחד ממנועי העלות המרכזיים של המוצר . הדבר עשוי להשפיע על גובה ערימות הזיכרון, על הקיבולת הכוללת, על תמחור המערכות ועל חלוקת המוצרים בין לקוחות שונים.
Nvidia ו-SK Group הכריזו על יוזמה אסטרטגית בהיקף של יותר מ-500 מיליארד דולר, הכוללת שיתוף פעולה ארוך טווח עם SK Hynix לאספקת HBM4 עבור דור Vera Rubin . ימים ספורים לאחר מכן הודיעו Samsung Electronics ו-Broadcom על שיתוף פעולה נפרד בהיקף של 200 מיליארד דולר .
ביחד, מדובר בכ-700 מיליארד דולר בהסכמים שדווחו סביב הבטחת אספקה. הסכומים האלה ממחישים עד כמה הפך הזיכרון — שבעבר נתפס כרכיב בתוך המערכת — לנכס אסטרטגי בכל תעשיית תשתיות ה-AI.
במקום להסתמך על תצורת דגל אחת של 12-Hi HBM4e, Nvidia נראית כמי שמכינה מגוון רחב יותר של מק"טים, עם הבדלים בגובה ערימות הזיכרון ובנפח הכולל .
היתרון הוא תפעולי ומסחרי: אם תצורות HBM4e המתקדמות יהיו נדירות או יתעכבו בתהליך ההסמכה, החברה תוכל להמשיך לספק מערכות המבוססות על 8-Hi HBM4e או על HBM4. ייתכן שהביצועים של חלק מהגרסאות יהיו נמוכים יותר, אך Nvidia תוכל לשמור על קצב אספקה ולאפשר ללקוחות לבחור לפי הצורך והתקציב.
הפרטים הסופיים עדיין לא הוכרזו, ולכן מוקדם לקבוע ש-Rubin Ultra אכן יושק עם מפרט מופחת. עם זאת, הדיווחים מצביעים על לחץ אמיתי מצד המחיר והאספקה: Nvidia בוחנת כמה תצורות HBM עבור Rubin Ultra, ובמערכת Vera Rubin דווחה הפחתה בקיבולת ה-SOCAMM.
Nvidia מצדה מכחישה שמדובר בשדרוג לאחור שנכפה בגלל מחסור, ומדגישה שמדובר בהתאמת מק"טים ללקוחות. אבל עסקאות האספקה בהיקפים חריגים והנתח הגדל של הזיכרון מעלות המערכת מבהירים את התמונה: בעידן Rubin, הביצועים לא ייקבעו רק לפי עוצמת המעבד הגרפי. הם ייקבעו גם לפי כמות הזיכרון המהיר שאפשר להשיג — ובאיזה מחיר.