אינטל הציגה בכנס Hot Chips 2026 פרטים חדשים על Diamond Rapids — פלטפורמת שרתים מהדור הבא של Xeon 7, שאמורה להגיע במהלך 2027. בתצורה החזקה ביותר, המעבד יציע עד 256 ליבות ביצועים מסוג Panther Cove, מטמון משותף בנפח של עד 1.28GB וחבילה מודולרית הכוללת 22 אריחי סיליקון.
1
2
3
המספר המרשים מגיע עם הסתייגות חשובה: Diamond Rapids לא יתמוך בריבוי נימים סימולטני (SMT), המוכר באינטל בשם Hyper-Threading. לכן 256 הליבות יהיו גם 256 נימים חומרתיים — ולא 512. לפי אינטל, התמיכה ב־SMT צפויה לחזור בדור הבא, Coral Rapids.
7
8
כך בנויה חבילת Diamond Rapids
Diamond Rapids אינו מעבד מונוליתי מסורתי, אלא מערכת של רכיבי Chiplet נפרדים, שכל אחד מהם מטפל בחלק אחר של המשימה:
- 16 שבבי חישוב בתהליך Intel 18A-P
- 16 ליבות Panther Cove בכל שבב, ובסך הכול 256 ליבות
- ארבעה אריחי בסיס Intel 3-T
- שני אריחי Intel 3 Fabric Hub לטיפול בזיכרון ובקישוריות חיצונית
- 22 אריחים בסך הכול
1
3
שבבי החישוב מוערמים על אריחי הבסיס באמצעות טכנולוגיית האריזה התלת־ממדית Foveros Direct. הגישה המודולרית מאפשרת לאינטל להפריד בין חישוב, מטמון, בקרי זיכרון ו־I/O, במקום לרכז את כל הרכיבים בשבב יחיד.
3
5
מארג חדש במקום EMIB
אחד השינויים המרכזיים הוא הדרך שבה הרכיבים מתקשרים זה עם זה. Diamond Rapids משתמש ב־UCIe-S — חיבור נחושת המבוסס על תקן לקישור בין שבבים — ובארכיטקטורת Fan-out Fabric. כך מחוברים שבבי החישוב אל שני ה־Fabric Hubs, במקום להשתמש בפתרון EMIB שאינטל שילבה בדורות Xeon קודמים.
3
11
המטרה המוצהרת היא ליצור מודל גישה אחיד יותר לזיכרון לאורך החבילה. אם התכנון אכן יעבוד כמתוכנן, תוכנות ומנהלי מערכות יצטרכו להתמודד פחות עם פערים חדים בין אזורי זיכרון מקומיים ומרוחקים בתצורות מרובות־אריחים.
עם זאת, מדובר בשלב זה ביעד ארכיטקטוני. רק מערכות מסחריות ומבחני ביצועים בלתי תלויים יוכלו להראות עד כמה הגישה האחידה מתורגמת לביצועים עקביים בעומסי עבודה אמיתיים.
ארבעת אריחי הבסיס מספקים גם את המטמון המשותף הגדול. אינטל והדיווחים על המצגת מתארים עד 1.28GB של מטמון ברמה האחרונה (LLC). חשוב להיזהר מהגדרתו כ־L3 בכללותו: החומרים שפורסמו עדיין אינם מפרטים את כל היררכיית המטמון או את אופן הגישה לכל רמה.
1
2
16 ערוצי זיכרון ו־128 נתיבי PCIe 6.0
במעבדים בעלי מספר ליבות גבוה, כוח העיבוד לבדו אינו מספיק. אם הזיכרון והקישוריות אינם עומדים בקצב, הליבות עלולות להמתין לנתונים. לכן Diamond Rapids מתמקד גם ברוחב הפס של הפלטפורמה.
המערכת תתמוך ב־16 ערוצי זיכרון DDR5, במהירויות של עד DDR5-8000, או בזיכרון MRDIMM-12,800, בהתאם לסוג הזיכרון ולתצורה.
3
4
בנוסף, היא תציע עד 128 נתיבי PCIe Gen 6. מערך ה־I/O ניתן להגדרה עבור PCIe, CXL 3.0 ו־UPI 3.0 — שילוב שמאפשר לחבר מאיצים, התקני אחסון, רכיבי הרחבת זיכרון, ציוד תקשורת ומעבדים נוספים במערכות מרובות־שקעים.
3
14
המשמעות היא שאינטל מתחרה לא רק במספר הליבות, אלא בפלטפורמה כולה. רוחב פס גבוה לזיכרון ול־I/O חשוב במיוחד בניתוח נתונים, וירטואליזציה, מחשוב־על ותזמור עומסי AI.
הרחבות הוראות עבור AI וקוד כללי
בחומרי המפתחים של אינטל מצוינת תמיכה ב־Intel APX, ב־AVX10.2 וביכולות AMX נוספות.
5
6
APX מגדילה את מספר האוגרים הכלליים הזמינים לקוד x86 מ־16 ל־32. כך המהדר יכול להשאיר יותר נתונים קרוב לליבות ולהפחית את הצורך בטעינות ובכתיבות לזיכרון.
9
AMX מיועדת בעיקר לחישובי מטריצות בעומסי AI, ואילו AVX10.2 מרחיבה את יכולות העיבוד הווקטורי. אינטל מציגה את השילוב הזה ככלי הן לתוכנות שרת כלליות והן לחישובי AI, אך התועלת בפועל תהיה תלויה בתמיכת המהדרים, באופטימיזציה של התוכנה ובסוג ההוראות שהעומס משתמש בהן.
בלי Hyper-Threading: החיסרון המרכזי
Diamond Rapids יהיה מעבד Xeon המבוסס כולו על ליבות ביצועים, אך ללא SMT. אינטל כבר הודתה שהוויתור על ריבוי נימים עלול להציב אותה בעמדת נחיתות בעומסים שמרוויחים מהרצת שני נימים על כל ליבה פיזית. החברה אמרה שהתכונה צפויה לחזור ב־Coral Rapids, דור Xeon הבא המבוסס על ליבות P.
7
8
היעדר SMT אינו אומר בהכרח שכל יישום יהיה איטי יותר. תוכנות חישוב צפופות, מקביליות ומותאמות היטב לווקטורים — למשל עומסים מסוג HPL — עשויות להפיק תועלת מוגבלת בלבד מנימה נוספת, משום שהן כבר מנצלות היטב את משאבי הליבה.
מנגד, עומסים שנעצרים לעיתים קרובות בהמתנה לזיכרון, או כאלה שמכוונים לתפוקת נימים גבוהה, עשויים להיפגע יותר מהיעדר התכונה. לכן מספר הליבות לבדו אינו מדד מספק. רוכשים יצטרכו לבדוק ביצועים בעומסים שלהם, לצד תדרים, צריכת חשמל, כללי אכלוס הזיכרון ועלויות רישוי.
מול AMD והדור הבא של שרתי x86
על הנייר, Diamond Rapids מקרב את אינטל לצמרת של מעבדי השרתים בעלי צפיפות הליבות הגבוהה. תצורת 256 הליבות תואמת למספר הליבות המרבי המדווח עבור דור Venice של מעבדי AMD EPYC, בעוד ש־16 ערוצי הזיכרון, המטמון הגדול וקישוריות PCIe Gen 6 ממקמים את שתי הפלטפורמות באותה קטגוריה רחבה של מערכות מרכזי נתונים עתירות רוחב פס.
2
14
36
הדמיון במפרט אינו מכריע את התחרות. אינטל עדיין לא פרסמה את כל נתוני המוצרים הסופיים, המחירים או מבחני הביצועים הבלתי תלויים שיאפשרו השוואה ישירה. מספר הליבות גם אינו מספר את כל הסיפור: תדרי העבודה, זמן האחזור של הזיכרון, צריכת החשמל לאורך זמן, יעילות התוכנה וזמינות המערכות עשויים להשפיע לא פחות.
השאלה העסקית תהיה פשוטה: האם אינטל תוכל לספק מספיק ביצועים לוואט ועלות כוללת אטרקטיבית כדי להצדיק מעבר ל־Diamond Rapids כשהמערכות יגיעו ב־2027? הארכיטקטורה מטפלת בכמה נקודות לחץ מרכזיות — צפיפות ליבות, רוחב פס לזיכרון, הרחבת I/O וגישה אחידה יותר בין אריחים — אך המחיר ומבחני העולם האמיתי יקבעו אם היתרונות יתורגמו לפריסות בהיקף רחב.