A mesterséges intelligencia inferencia-chipek piacán aktív d-Matrix bejelentette, hogy következő generációs Raptor XPU-it az NVIDIA NVLink Fusion technológia segítségével köti majd be az NVIDIA AI-infrastruktúra-platformjába. A lépéssel a vállalat csatlakozik ahhoz a növekvő partnerkörhöz, amely az NVIDIA AI-platformra építi saját megoldásait — és egyúttal egy jóval rövidebb, kisebb kockázatú utat választ a sajátos szilícium nagyvállalati szintre emeléséhez.
Miért a NVLink Fusion? Az inferencia-piac kihívásai
Egy egyedi XPU-chip megtervezése és legyártása önmagában is komoly feladat, ám a valódi kihívás az AI-gyári léptékű telepítés: ehhez hálózatkezelés, rack-architektúra, áramellátás, hűtés, szoftver és egy bevált ellátási lánc egyidejű megléte szükséges. Minden egyes lépés — a chipek beszerzésétől a nagy sebességű interfészek integrálásán át a rack-architektúra tanúsításáig — időt, pénzt és kockázatot jelent.
Sid Sheth, a d-Matrix társalapítója és vezérigazgatója sajtótájékoztatón fogalmazta meg a döntés mögötti logikát:
„Az inferencia iránti kereslet szárnyalni kezdett, de a tőke, az idő és az energia véges erőforrások. Az NVLink Fusion és az MGX segítségével a Raptor XPU-inkat egy széles körben bevezetett, folyadékhűtéses architektúrába illeszthetjük, és ezzel gyorsabb, kisebb kockázatú utat kínálunk az ügyfeleknek az ultraalacsony késleltetésű inferencia bevezetéséhez és skálázásához.”
Az NVIDIA AI-platformja vertikálisan integrált, ugyanakkor horizontálisan nyitott. A NVLink Fusion ezt a nyitottságot terjeszti ki az XPU-k és CPU-k irányába: a szilíciumcégek így saját processzor-innovációikra koncentrálhatnak, miközben az NVIDIA infrastruktúráját használják az AI-gyári szintű bevetéshez. Ez a modell az NVIDIA nyitott platform-stratégiájának újabb bizonyítéka, amelynek keretében egyre több partner illeszkedik a közös ökoszisztémába.
Hogyan épül fel a d-Matrix Raptor XPU integrációja?
A d-Matrix tervei szerint a Raptor XPU-k NVLink segítségével egyetlen, nagy sávszélességű és alacsony késleltetésű scale-up tartományban kapcsolódnak egymáshoz. A rackek ugyanakkor képesek lesznek az NVIDIA GPU-alapú rendszerek — például az NVIDIA Vera Rubin NVL72 — mellett is működni, disaggregált inferencia-munkaterhelések esetén.
A tervezett integráció további elemei:
- NVIDIA Vera CPU-k — általános számítási kapacitáshoz
- NVIDIA ConnectX-9 SuperNIC-ek — nagy teljesítményű hálózati csatlakozáshoz
- NVIDIA BlueField-4 DPU-k — adatközponti infrastruktúra-kezeléshez
- NVIDIA Spectrum-X Ethernet hálózat — scale-out összekapcsoláshoz
Az NVIDIA MGX rack-architektúra kulcsszerepe abban rejlik, hogy egy közös, validált rack-kialakítást nyújt, amelybe GPU-k, CPU-k és XPU-k egyaránt beilleszthetők — külön rack-infrastruktúra nélkül. Adatközpontok így egyszer épülnek meg, és több különböző processzortípust képesek kiszolgálni.
NVLink Fusion az NVIDIA teljes AI-gyári platformján belül
Az NVIDIA teljes veremen alapuló AI-gyári platformja jelenleg a következő komponenseket foglalja magában: Vera Rubin NVL72, Groq 3 LPX, Vera CPU rack, Vera BlueField-4 STX tárolórendszer, valamint Spectrum-6 SPX Ethernet hálózat. A platform tervezési célja a teljes fungibilitás: képesnek kell lennie minden AI-munkaterhelés, modell és modellarchitektúra futtatására, a legjobb wattankénti teljesítmény és a legalacsonyabb tokenköltsége mellett.
A NVLink Fusion ebben a kontextusban azt teszi lehetővé, hogy az ügyfelek a megfelelő számítási erőforrást rendeljék az egyes munkaterhelésekhez — mindezt egyetlen, egységes AI-gyári platformon belül. A szilíciumgyártók, mint a d-Matrix, ezáltal növelhetik a teljesítményt, felgyorsíthatják a piacra kerülést és csökkenthetik az egyedi AI-gyárak bevetésének kockázatát. Az NVIDIA hasonló nyitott megközelítéseit más területeken is tetten érhetjük: az NVIDIA és CrowdStrike agentic kiberbiztonság területén folyó együttműködése, vagy az NVIDIA AI for Media platform szintén partnerökoszisztémára épít.
Gyakori kérdések
Mi az a NVLink Fusion, és miben különbözik a hagyományos NVLink-kapcsolattól?
A NVLink Fusion az NVIDIA NVLink technológiájának olyan kiterjesztése, amely nemcsak NVIDIA GPU-k, hanem külső gyártók XPU-i és CPU-i számára is lehetővé teszi a csatlakozást az NVIDIA AI-infrastruktúra-platformjához. Célja, hogy a szilíciumgyártók saját processzoraikat az NVIDIA hálózati, rack- és szoftverkörnyezetébe integrálhassák.
Mi az a Raptor XPU, amelyet a d-Matrix fejleszt?
A Raptor a d-Matrix következő generációs XPU-ja (gyorsított processzora), amelyet kifejezetten AI-inferencia-munkaterhelésekhez terveznek. Az NVLink Fusion elfogadásával a d-Matrix ezt a chipet az NVIDIA MGX rack-architektúrájába és Spectrum-X hálózatába kívánja integrálni.
Milyen előnyt jelent az MGX rack-architektúra a d-Matrix számára?
Az MGX egy közös, már validált rack-kialakítást kínál, amelybe GPU-k, CPU-k és XPU-k egyaránt illeszthetők. Ez azt jelenti, hogy a d-Matrix elkerülheti az önálló rack-architektúra tervezésének, tanúsításának és ellátási lánc-felépítésének időigényes és költséges folyamatát.
Milyen NVIDIA-komponenseket tervez a d-Matrix integrálni a saját rendszerébe?
A bejelentett tervek szerint a d-Matrix a Raptor XPU-k mellé NVIDIA Vera CPU-kat, ConnectX-9 SuperNIC-eket, BlueField-4 DPU-kat és Spectrum-X Ethernet hálózatot is alkalmaz majd, és a rackek kompatibilisek lesznek az NVIDIA Vera Rubin NVL72 GPU-alapú rendszerekkel is.
Forrás: NVIDIA Blog











