Yhtiöt suunnittelevat hybridi inferenssiä: Nvidia GPU:t käsittelevät laskentaintensiivisen esitäyttövaiheen, kun d Matrixin Raptor XPU:t tuottavat vastauksen tokeneita yksi kerrallaan. NVLink Fusion, MGX viitearkkitehtuuri ja Nvidian verkotus on tarkoitettu helpottamaan erikoistuneen kiihdyttimen käyttöönottoa räkki...
JulkaisijaMuokattu mallilla GPT-5.6 TerraKuvat luotu mallilla GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How is AI-chip startup d-Matrix’s September 2026 partnership with Nvidia—integrating Nvidia’s NVLink Fusion into its next-generation Raptor. Article summary: The partnership makes d-Matrix’s specialized inference silicon a first-class component of Nvidia-style AI factories rather than a separate appliance. The intended architecture is heterogeneous: Nvidia GPUs handle compute. Topic tags: general, news, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers,
Generatiivisten tekoälypalvelujen laatua mitataan yhä useammin myös siinä, kuinka pian vastaus alkaa ilmestyä ja kuinka tasaisesti se jatkuu. Nvidian ja d-Matrixin syyskuussa 2026 julkistama yhteistyö kohdistuu juuri tähän: d-Matrixin tulevat Raptor-inferenssi-XPU:t on tarkoitus liittää suoraan Nvidian suunnittelemaan tekoälyinfrastruktuuriin. Näin saman kielimallipyynnön eri vaiheet voidaan antaa niille suorittimille, joille ne sopivat parhaiten. 1
3
4
Olennaista on työnjako, ei korvaaminen. Raptorin ei ole tarkoitus syrjäyttää Nvidia-GPU:ita, vaan toimia osana heterogeenistä järjestelmää: GPU:t käsittelevät laskentaintensiivisen esitäytön (prefill) ja d-Matrixin kiihdyttimet viiveherkän dekoodauksen (decode), jossa vastaus syntyy tokeni kerrallaan. 4
5
Kielimallin pyyntö sisältää eri tavoin kuormittavia vaiheita. Esitäyttö käsittelee käyttäjän kehotteen ja keskustelukontekstin. Dekoodauksessa malli tuottaa seuraavan tokenin toistuvasti, kunnes vastaus valmistuu. d-Matrix asemoi nykyisen Corsair-tuotteensa ja tulevan arkkitehtuurinsa dekoodaukseen, kun taas GPU:t sopivat sen mukaan hyvin laskentaintensiivisiin tehtäviin. 26
Työnjako voi olla hyödyllinen etenkin interaktiivisissa palveluissa, joissa seuraavan tokenin viive on näkyvä osa käyttökokemusta: ohjelmointiavustajissa, keskustelusovelluksissa ja puhepohjaisissa palveluissa. d-Matrix kuvaa suunniteltua Raptor-alustaa korkealuokkaisiin, erittäin pienen viiveen tokenipalveluihin. 4
8
Erikoistuminen tuo kuitenkin uuden pullonkaulan: suorittimien on vaihdettava dataa riittävän nopeasti. Muussa tapauksessa tiedonsiirron viive voi syödä hyödyn, joka työnjaolla tavoitellaan. Yhteistyön keskeiset infrastruktuurivalinnat on tehty tämän ongelman ratkaisemiseksi.
Raptorin on määrä hyödyntää NVLink Fusionia liittyäkseen Nvidian NVLink-skaalausalueeseen räkin sisällä. Järjestelmien välistä laajennusta varten käytetään Spectrum-X-verkotusta. Nvidian mukaan ratkaisu tarjoaa d-Matrixille väylän yhdistää oma erikoissirunsa sen laajempaan tekoälyinfrastruktuurialustaan. 3
Suunnitteilla oleva d-Matrix-räkki perustuu Nvidian MGX-viitearkkitehtuuriin. Sen odotetaan sisältävän Nvidia Vera -suorittimia, NVLink-kytkimiä, BlueField-4-DPU:ita, ConnectX-9 SuperNIC -verkkokortteja ja Spectrum-X Ethernet -verkotuksen. 4
8
d-Matrixille merkityksellistä ei ole vain sirujen välinen liitäntä. Valmiiksi validoitu räkkiekosysteemi voi vähentää tarvetta hyväksyttää erikseen jokainen palvelin-, verkko-, virransyöttö-, jäähdytys- ja toimitusketjukomponentti uuden prosessorin ympärille. Nvidia kuvaa MGX:ää ja laajempaa alustaansa nopeammaksi ja pieniriskisemmäksi reitiksi omasta sirusta suuren mittakaavan käyttöönottoon. 3
Käytännössä tavoitteena on tehdä Raptorista osa Nvidia-tyyppistä AI-tehdasta, ei erillinen inferenssilaite.
d-Matrix on esitellyt Raptorille kunnianhimoisen räkkitason kokoonpanon: enintään 144 XPU:ta räkkia kohden, 2,3 teratavua 3D-pinottua DRAM-muistia ja yhteensä 7,2 petatavua sekunnissa muistikaistaa. Yhtiön mukaan rakenne on suunniteltu tukemaan yli neljän biljoonan parametrin malleja 4 bitin tarkkuudella. Kyse on suunnitelluista teknisistä tiedoista, ei riippumattomasti varmennetuista toimituslaitteiden tuloksista. 4
Arkkitehtuuri kuvastaa d-Matrixin näkemystä siitä, että kielimallien dekoodauksessa ratkaisevaa on pitkälti datan liikuttaminen ja käytettävissä oleva muistikaista. Raptorin ehdotettu 3D-pakkaus yhdistää DRAM-muistisirun ja SRAM-laskentasirun, mikä jatkaa yhtiön muistikeskeistä lähestymistapaa. 4
d-Matrix arvioi Raptorin nauhoitusvaiheen (tape-out) tapahtuvan vuoden 2026 loppuun mennessä. Raptor-XPU:iden ensimmäistä saatavuutta MGX-räkissä odotetaan vuoden 2027 viimeisellä neljänneksellä. Sitä ennen on vielä paljon toteutettavaa: sirun valmistus, pakkaus, järjestelmävalidointi ja räkkitason käyttöönotto on saatava onnistumaan, ennen kuin asiakkaat voivat arvioida suorituskykyä käytännössä. 4
8
Nvidian rooli on strategisesti kiinnostava. Yhtiö sallii erikoistuneen ulkopuolisen XPU:n liittyä räkkiratkaisuunsa ja verkkokankaaseensa sen sijaan, että inferenssin jokainen vaihe suoritettaisiin Nvidia-GPU:lla.
Nvidia kuvaa AI-alustaansa mallilla, joka on ”vertikaalisesti integroitu ja horisontaalisesti avoin”. Yhtiö voi tällöin säilyttää NVLink-skaalauskankaan, skaalautuvan verkotuksen, räkkisuunnitelmien ja ekosysteemin arvon samalla, kun muut prosessorit voivat osallistua järjestelmään. 3
Tämä laajentaa työkuormien joukkoa, jota alusta voi palvella. Asiakas, joka haluaa dekoodaukseen erikoistuneen kiihdyttimen, voi todennäköisemmin pysyä Nvidia-yhteensopivassa infrastruktuurissa, jos kiihdytin hyödyntää NVLink Fusionia, MGX:ää ja Spectrum-X:ää. Kyse on siis hallitusta täydentävyydestä, ei vetäytymisestä GPU:ista: Nvidia-GPU:t pysyvät keskeisinä koulutuksessa, yleiskäyttöisessä inferenssissä ja laskentapainotteisessa esitäyttövaiheessa, kun erikoislaite kohdistetaan dekoodaukseen. 1
4
5
Raptoria edeltää d-Matrixin Corsair-inferenssikiihdytin. Yhtiön mukaan Corsair on suunniteltu eriytetyn inferenssin dekoodausvaiheeseen ja toimimaan GPU:iden rinnalla, ei niiden korvaajana. 26
d-Matrix on esittänyt Corsairiin perustuvalle hybridijärjestelmälle suorituskyky-, kustannus- ja energiankulutusväitteitä. Niitä on kuitenkin pidettävä yhtiön omiin ilmoituksiin perustuvina, ellei saatavilla ole riippumattomasti toistettavia vertailutuloksia. Saatavilla oleva aineisto ei osoita yleispätevää suorituskykyhyötyä kaikilla malleilla, eräko'oilla tai käyttöönottotavoilla. 25
28
Yhtiö keräsi 275 miljoonan dollarin C-rahoituskierroksen noin 2 miljardin dollarin arvostuksella. Sen ilmoitettu kokonaisrahoitus nousi 450 miljoonaan dollariin, ja sijoittajiin kuului muun muassa Microsoftin pääomasijoitusrahasto M12. 21
30 Reutersin mukaan Microsoft sijoitti d-Matrixiin jo vuoden 2023 rahoituskierroksella, ja yhtiö toimitti ensimmäisen tekoälysirunsa marraskuussa 2024.
1
Nämä virstanpylväät viittaavat siihen, että d-Matrix pyrkii siirtymään yksittäisen inferenssituotteen tarjoajasta kohti laajempaa räkkitason tiekarttaa. Nvidia-integraatio voi tehdä suunnitelmasta uskottavamman asiakkaille, joilla on jo Nvidiaan perustuvaa infrastruktuuria.
Nvidian ja d-Matrixin sopimuksen taloudellisia ehtoja ei julkistettu. 1 Julkisten tietojen perusteella ei siksi voi päätellä, sisältyykö järjestelyyn lisenssimaksuja, yhteisiä tuotekehityssitoumuksia, volyymiostoja, tulonjakoa tai Nvidian sijoitusta.
Yleislinja on silti selvä: yhtiöt valmistautuvat inferenssimarkkinaan, jossa yhdenlainen prosessori ei välttämättä suorita kielimallipyynnön kaikkia vaiheita. d-Matrix saa reitin Nvidia-yhteensopiviin AI-tehtaisiin, ja Nvidia saa alustalleen dekoodaukseen erikoistuneen vaihtoehdon. Se, tuoko ratkaisu todellisuudessa pienemmän viiveen tai paremmat kustannukset suuressa mittakaavassa, riippuu lopulta Raptor-laitteistosta, ohjelmiston työnjaosta ja asiakaskohtaisista mittauksista vuoden 2027 suunnitellun saatavuuden jälkeen. 3
4
8
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Yhtiöt suunnittelevat hybridi inferenssiä: Nvidia GPU:t käsittelevät laskentaintensiivisen esitäyttövaiheen, kun d Matrixin Raptor XPU:t tuottavat vastauksen tokeneita yksi kerrallaan.
Yhtiöt suunnittelevat hybridi inferenssiä: Nvidia GPU:t käsittelevät laskentaintensiivisen esitäyttövaiheen, kun d Matrixin Raptor XPU:t tuottavat vastauksen tokeneita yksi kerrallaan. NVLink Fusion, MGX viitearkkitehtuuri ja Nvidian verkotus on tarkoitettu helpottamaan erikoistuneen kiihdyttimen käyttöönottoa räkkitasolla – ei korvaamaan Nvidia GPU:ita.
Järjestely kertoo Nvidian halusta avata AI tehdasalustansa kolmannen osapuolen erikoissiruille samalla, kun NVLink, verkotus ja räkkitason infrastruktuuri pysyvät keskeisessä asemassa.