Raptor לא מיועד לפעול ככרטיס PCIe נפרד בלבד, אלא כמאיץ XPU משולב במערכות מדף בקנה מידה גדול של NVIDIA. NVLink מספקת קישוריות scale up מהירה בתוך המערכת, ואילו Spectrum X מיועדת לרשת scale out אל מחוץ למדף.
פורסם על ידיהתמונות נוצרו באמצעות GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How does d Matrix’s adoption of Nvidia’s NVLink Fusion for its next generation Raptor inference processors enable the startup to plug its me. Article summary: d Matrix is using NVLink Fusion to make Raptor a native, rack scale participant in Nvidia’s AI factory design rather than a separate PCIe inference card.. Topic tags: general web, llm, ai, code, benchmarks. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layou
המהלך של d-Matrix נועד להפוך את Raptor לחלק מובנה מארכיטקטורת ה״מפעל ל-AI״ של NVIDIA, ולא לכרטיס האצה נפרד שמתחבר בעיקר דרך PCIe. החברה תיישם את ממשק NVLink Fusion, כך שמאיצי ההסקה מסוג XPU שלה יוכלו להשתלב בתכנון הייחוס מקורר-הנוזל של NVIDIA, MGX/NVL144. 3
5
בפועל, NVLink מספקת את מארג ה-scale-up — קישור מהיר ובעל השהיה נמוכה בין רכיבים בתוך המערכת — ואילו Spectrum-X מיועדת לקישוריות scale-out בין מערכות ומדפים. כך d-Matrix יכולה להוסיף שבב המתמקד בזיכרון ובשלב ההסקה, בלי שהלקוח יצטרך לוותר על תשתית המדף הרחבה של NVIDIA. 3
5
במדף המבוסס על Raptor, d-Matrix מספקת את ה-XPU, אך חלק ניכר מ״הצנרת״ של המערכת נשאר של NVIDIA. תכנון הייחוס כולל, בין השאר:
המשמעות היא אינטגרציה עם שכבות הקלט/פלט, הרשת, הניהול ותכנון המדף של NVIDIA. לפי NVIDIA, החיבור ל-MGX — אקוסיסטם של תכנוני מדף מאומתים ומודולריים — אמור לקצר ולהפחית סיכונים בדרך של שבב מותאם אישית לפריסה רחבת היקף. 4
d-Matrix מכוונת במיוחד לשלב ה-decode בהפעלת מודלים יוצרים: השלב שבו המודל מפיק טוקנים בזה אחר זה. בתהליך זה נדרשת קריאה חוזרת של משקלי המודל, ולכן קיבולת הזיכרון ורוחב הפס שלו הופכים חשובים במיוחד להשהיית הטוקנים.
הטענה אינה ש-Raptor מחליף בהכרח GPUs בכל משימת AI. GPUs עדיין מתאימים, למשל, לשלב ה-prefill ולעיבוד כללי יותר. הכיוון המוצהר הוא צינור עבודה משלים של GPU ו-XPU: ה-GPU יכול לבצע חלקים מסוימים של העבודה, בעוד מאיץ d-Matrix מתמקד בפענוח רגיש להשהיה. 3
10
לפי היעד של d-Matrix, מדף יוכל לכלול עד 144 מאיצי Raptor המחוברים במארג NVLink אחד מסוג all-to-all. החברה מציגה יעד של כ-2.3 טרה-בייט זיכרון DRAM תלת-ממדי וכ-7.2 פטה-בייט לשנייה של רוחב פס זיכרון מצטבר במדף. 3
d-Matrix מציגה את הקיבולת ככזו שעשויה להספיק, עקרונית, למודלים שמעל ארבעה טריליון פרמטרים בדיוק של 4 ביט. אולם הגודל המעשי של מודל שניתן לפרוס תלוי גם במטא-נתונים, מצב זמן ריצה, פורמט המודל ותוכנת המערכת. 3
Raptor מתואר כשילוב של die חישוב ב-4 ננומטר עם DRAM מותאם אישית. d-Matrix מצפה לבצע tape-out — השלב שבו תכנון השבב נשלח לייצור — עד סוף 2026, ולספק מערכות ראשונות המשולבות במדף ברבעון הרביעי של 2027. 10
4
תנאי העסקה הכספיים לא פורסמו. 1
מבחינה אסטרטגית, NVLink Fusion מאפשרת ל-NVIDIA לשמור את ארכיטקטורת המדף ואת שכבות הקישוריות גם כאשר הלקוח בוחר מאיץ ייעודי של צד שלישי. כלומר, d-Matrix עשויה לספק את סיליקון ההסקה, בעוד NVIDIA מספקת מארג, מתגים, מעבדים, DPUs, כרטיסי רשת, Ethernet ותכנון מדף. זו מסקנה מהארכיטקטורה וממודל האקוסיסטם, ולא הצהרה של החברות על חלוקת הכנסות או על תנאי מסחר. 3
5
d-Matrix מצטרפת בכך למאמץ הרחב יותר סביב NVLink Fusion, שבו נקשרו פומבית גם AWS, Arm, Intel, Fujitsu, MediaTek ו-Marvell. המטרה הרחבה היא להפוך את NVLink לממשק פלטפורמה לחומרת AI הטרוגנית, ולהרחיב את נוכחותה של NVIDIA מן המאיצים עצמם אל שכבת המערכת שסביבם. 3
d-Matrix השיקה את מאיץ ההסקה Corsair בנובמבר 2024. בהמשך השתתפה קרן M12 של מיקרוסופט במימונה; לפי דיווחים, סבב C בהיקף 275 מיליון דולר העניק לחברה שווי של 2 מיליארד דולר, בעוד שסך המימון המצטבר שלה תואר בכ-450 מיליון דולר. אלה אינם נתונים על סבב יחיד של 450 מיליון דולר. 2
6
חברת ParaSail דיווחה על שיפור של עד פי עשרה במהירות ההסקה משילוב Corsair עם GPUs של NVIDIA, אך מדובר בטענת ביצועים של חברה או לקוח ולא במדד בלתי תלוי. 12
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Raptor לא מיועד לפעול ככרטיס PCIe נפרד בלבד, אלא כמאיץ XPU משולב במערכות מדף בקנה מידה גדול של NVIDIA.
Raptor לא מיועד לפעול ככרטיס PCIe נפרד בלבד, אלא כמאיץ XPU משולב במערכות מדף בקנה מידה גדול של NVIDIA. NVLink מספקת קישוריות scale up מהירה בתוך המערכת, ואילו Spectrum X מיועדת לרשת scale out אל מחוץ למדף.
המערכת יכולה לכלול מעבדי Vera, מתגי NVLink, רכיבי BlueField 4, כרטיסי ConnectX 9 ורשת Spectrum X של NVIDIA.