Nvidia ו d Matrix מתכננות מערכת הסקה היברידית: ה GPU יבצעו את שלב ה prefill עתיר החישוב, ומאיצי Raptor של d Matrix יתמקדו ב decode — יצירת טוקנים אחד אחד. NVLink Fusion, ארכיטקטורת המדף MGX ורשתות Nvidia נועדו להפחית את מורכבות האינטגרציה של מאיץ ייעודי בקנה מידה של מדף, ולא להחליף את ה GPU של Nvidia.
פורסם על ידינערך באמצעות GPT-5.6 Terraהתמונות נוצרו באמצעות GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How is AI-chip startup d-Matrix’s September 2026 partnership with Nvidia—integrating Nvidia’s NVLink Fusion into its next-generation Raptor. Article summary: The partnership makes d-Matrix’s specialized inference silicon a first-class component of Nvidia-style AI factories rather than a separate appliance. The intended architecture is heterogeneous: Nvidia GPUs handle compute. Topic tags: general, news, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers,
שירותי בינה מלאכותית יוצרת נמדדים יותר ויותר לפי המהירות שבה הם מתחילים להחזיר תשובה וממשיכים לייצר אותה. שיתוף הפעולה שעליו הודיעו Nvidia ו-d-Matrix בספטמבר 2026 מכוון בדיוק לנקודת הכאב הזאת: חיבור ישיר של מעבדי ההסקה העתידיים Raptor של d-Matrix לתשתיות AI בתכנון Nvidia, כך שכל שלב בבקשה למודל שפה גדול (LLM) יועבר למעבד המתאים לו. 1
3
4
העיקר הוא השלמה הדדית, לא החלפה. Raptor אינו מוצג כתחליף ל-GPU של Nvidia, אלא כחלק ממערכת הטרוגנית: ה-GPU יטפלו בשלב ה-prefill עתיר החישוב, ואילו מאיצי d-Matrix יתמקדו בשלב ה-decode החוזר והרגיש לזמן השהיה, שבו נוצרים טוקני הפלט אחד-אחד. 4
5
לבקשה למודל שפה יש דרישות ביצועים שונות לאורך הדרך. שלב ה-prefill מעבד את ההנחיה ואת ההקשר; שלב ה-decode מייצר שוב ושוב את הטוקן הבא. d-Matrix ממקמת את ארכיטקטורת ההסקה שלה, ובה גם מוצר Corsair הנוכחי, עבור עבודת decode לצד GPU — שלדבריה מתאימים במיוחד לעומסי עבודה עתירי חישוב. 26
החלוקה הזו עשויה להיות שימושית במוצרים אינטראקטיביים שבהם זמן ההמתנה לטוקן הבא הוא קריטי: עוזרי תכנות, צ'אט ויישומים קוליים. פלטפורמת Raptor מיועדת למה ש-d-Matrix מכנה שירותי טוקנים פרימיום עם זמן השהיה נמוך במיוחד. 4
8
אלא שפיצול שלבי העבודה גם יוצר אתגר מערכתי: המעבדים חייבים להחליף נתונים במהירות גבוהה מספיק, אחרת עלות התקשורת עלולה למחוק את יתרון ההתמחות. בחירות התשתית בשיתוף הפעולה נועדו להתמודד עם המגבלה הזו.
Raptor מתוכננת להשתמש ב-NVLink Fusion כדי להתחבר למתחם ההרחבה האנכי (scale-up) של NVLink, בעוד Spectrum-X תספק את רשת ההרחבה האופקית (scale-out) בין מערכות. לפי Nvidia, זה מעניק ל-d-Matrix דרך לחבר סיליקון מותאם אישית לפלטפורמת תשתיות ה-AI הרחבה שלה. 3
המדף המתוכנן של d-Matrix יתבסס על ארכיטקטורת הייחוס MGX של Nvidia, וצפוי לכלול מעבדי Vera, מתגי NVLink, מעבדי נתונים BlueField-4 DPU, כרטיסי רשת ConnectX-9 SuperNIC ו-Ethernet מסוג Spectrum-X של Nvidia. 4
8
עבור d-Matrix, המשמעות אינה מסתכמת בממשק התקשורת. במקום לאמת באופן עצמאי כל רכיב — שרתים, רשת, חשמל, קירור ושרשרת אספקה — סביב מעבד חדש, החברה יכולה לבנות על סביבת מדף שכבר עברה תיקוף. Nvidia מציגה במפורש את MGX ואת הפלטפורמה הרחבה שלה כמסלול מהיר ובסיכון נמוך יותר מסיליקון מותאם לפריסה רחבת היקף. 3
במונחים מעשיים, המטרה היא לאפשר את פריסת Raptor כחלק מ"מפעל AI" בסגנון Nvidia, ולא כמכשיר הסקה מבודד.
d-Matrix הציגה תצורת מדף שאפתנית עבור Raptor: עד 144 XPU בכל מדף, 2.3 טרה-בייט של DRAM מוערם בתלת-ממד ורוחב פס זיכרון מצרפי של 7.2 פטה-בייט לשנייה. החברה אומרת שהתכנון נועד לתמוך במודלים הגדולים מ-4 טריליון פרמטרים ברמת דיוק של 4 ביט. אלה מפרטי יעד, ולא תוצאות של מוצר מסחרי שאומתו באופן עצמאי. 4
הארכיטקטורה משקפת את עמדת החברה שלפיה decode במודלי שפה גדולים מושפע במידה רבה מהעברת נתונים בזיכרון ומרוחב הפס הזמין. המארז התלת-ממדי המוצע ל-Raptor משלב שבב זיכרון DRAM עם שבב חישוב SRAM, ומרחיב את הגישה ממוקדת-הזיכרון של d-Matrix. 4
d-Matrix מסרה כי Raptor צפויה להגיע לשלב tape-out — השלמת תכנון השבב לקראת ייצור — עד סוף 2026, וכי זמינות ראשונית במדף MGX צפויה ברבעון הרביעי של 2027. עד אז נותרת עבודה מהותית: ייצור, מארוז, אימות מערכת ופריסה בקנה מידה של מדף צריכים כולם להצליח לפני שלקוחות יוכלו לבחון את הביצועים בפועל. 4
8
התפקיד של Nvidia בשיתוף הפעולה בולט מבחינה אסטרטגית. החברה מאפשרת ל-XPU ייעודי חיצוני להתחבר לארכיטקטורת המדף ולמרקם הרשת שלה, במקום לדרוש שכל שלב בהסקה ירוץ על GPU מתוצרתה.
Nvidia מתארת את פלטפורמת ה-AI שלה כ"משולבת אנכית ופתוחה אופקית": היא יכולה לשמור את הערך של מארג ההרחבה, רשת ההרחבה, תכנוני המדף והאקוסיסטם שלה, ובמקביל לאפשר למעבדים אחרים להשתתף. 3
כך גדל מגוון עומסי העבודה שהפלטפורמה מסוגלת לשרת. לקוחות המחפשים מאיץ המתמקד ב-decode עשויים להעדיף להישאר בתשתית תואמת Nvidia, אם המאיץ יכול להשתמש ב-NVLink Fusion, ב-MGX וב-Spectrum-X. לכן נכון יותר לראות במהלך השלמה מבוקרת מאשר נסיגה ממעמד ה-GPU: ה-GPU של Nvidia נשארים מרכזיים לאימון, להסקה כללית ולשלב ה-prefill עתיר החישוב, בעוד התקן ייעודי ממוקם עבור decode. 1
4
5
Raptor מגיעה אחרי מאיץ ההסקה Corsair של d-Matrix. החברה אומרת ש-Corsair נבנה במיוחד עבור decode בהסקה מפוצלת, ופועל עם GPU במקום להחליף אותם. 26
d-Matrix פרסמה טענות לביצועים, עלות וצריכת אנרגיה של מערכות היברידיות מבוססות Corsair, אך יש להתייחס אליהן כאל טענות חברה כל עוד אין פרטי מדדים עצמאיים הניתנים לשחזור. החומר הזמין סביב ההכרזה אינו מוכיח שיפור ביצועים גורף בכל מודל, גודל אצווה או תצורת פריסה. 25
28
החברה גייסה 275 מיליון דולר בסבב C לפי שווי מדווח של 2 מיליארד דולר, והעמידה את סך הגיוסים המדווח שלה על 450 מיליון דולר; בסבב השתתפה, בין היתר, M12 — קרן ההון סיכון של Microsoft. 21
30 רויטרס דיווחה גם כי Microsoft תמכה ב-d-Matrix בסבב מימון ב-2023, וכי החברה שלחה את שבב ה-AI הראשון שלה בנובמבר 2024.
1
אבני הדרך האלה מצביעות על מעבר אפשרי ממוצר הסקה יחיד לתוכנית רחבה יותר בקנה מידה של מדף. האינטגרציה עם Nvidia עשויה לחזק את אמינותה מול לקוחות שכבר רוכשים או מפעילים תשתית מבוססת Nvidia.
התנאים הפיננסיים של ההסכם עם Nvidia לא פורסמו. 1 לכן אי אפשר להסיק מההודעה הציבורית אם ההסדר כולל דמי רישוי, התחייבויות הנדסיות משותפות, רכישות בהיקף מסוים, חלוקת הכנסות או השקעה של Nvidia.
המסקנה הרחבה ברורה יותר מהפרטים המסחריים: שתי החברות מתכננות שוק הסקה שבו סוג מעבד אחד לא חייב לבצע כל שלב בבקשה למודל שפה. d-Matrix מקבלת נתיב למפעלי AI תואמי Nvidia; Nvidia מקבלת אפשרות decode ייעודית שאפשר לשלב עם הרשת ועם פלטפורמת המדף שלה. השאלה אם האסטרטגיה תספק בפועל זמן השהיה נמוך יותר או כלכלה טובה יותר בקנה מידה גדול תתברר רק עם החומרה, תזמור התוכנה ומדדי הלקוחות של Raptor לאחר הזמינות המתוכננת ב-2027. 3
4
8
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Nvidia ו d Matrix מתכננות מערכת הסקה היברידית: ה GPU יבצעו את שלב ה prefill עתיר החישוב, ומאיצי Raptor של d Matrix יתמקדו ב decode — יצירת טוקנים אחד אחד.
Nvidia ו d Matrix מתכננות מערכת הסקה היברידית: ה GPU יבצעו את שלב ה prefill עתיר החישוב, ומאיצי Raptor של d Matrix יתמקדו ב decode — יצירת טוקנים אחד אחד. NVLink Fusion, ארכיטקטורת המדף MGX ורשתות Nvidia נועדו להפחית את מורכבות האינטגרציה של מאיץ ייעודי בקנה מידה של מדף, ולא להחליף את ה GPU של Nvidia.
המהלך מצביע על רצונה של Nvidia לפתוח את תשתית ה AI שלה לשבבים ייעודיים של צד שלישי, תוך שמירה על NVLink, הרשת והמערכות בקנה מידה של מדף במרכז הפריסה.