d-Matrix, 랙 스케일 XPU 배포 위해 NVIDIA NVLink Fusion 도입

d-Matrix가 NVLink Fusion으로 차세대 Raptor XPU를 NVIDIA AI 인프라 플랫폼에 연결합니다. NVIDIA의 랙 스케일 아키텍처로 출시 기간을 앞당기는 파트너 생태계에 합류하는 것입니다.
by

AI 추론 칩 기업 d-Matrix가 차세대 Raptor XPU를 NVIDIA AI 인프라 플랫폼에 연결하는 데 NVLink Fusion을 사용한다고 발표했습니다. NVIDIA AI 플랫폼 위에서 제품을 만드는, 점점 늘어나는 파트너 대열에 합류하는 것이죠.

Raptor를 NVIDIA NVLink 스케일업 네트워킹과 Spectrum-X 스케일아웃 네트워킹, NVIDIA MGX 랙 아키텍처, 그리고 NVIDIA AI 플랫폼 전반에 연결함으로써, NVLink Fusion은 맞춤형 실리콘에서 대규모 배포로 가는 더 빠르고 위험이 적은 길을 d-Matrix에 열어 줍니다.

d-Matrix 공동 창업자 겸 CEO Sid Sheth는 기자 브리핑을 통해 “추론 수요는 치솟고 있지만 자본과 시간, 에너지는 여전히 유한합니다. NVLink Fusion과 MGX를 활용하면 저희의 Raptor XPU를 이미 널리 배포된 액체 냉각 아키텍처에 통합할 수 있고, 고객은 초저지연 추론을 더 빠르고 위험이 적은 경로로 배포하고 확장할 수 있습니다”라고 말했습니다.

NVIDIA AI 플랫폼은 수직적으로 통합돼 있으면서 수평적으로는 개방돼 있습니다. NVLink Fusion은 이 개방성을 XPU와 CPU로 확장하는데요. 덕분에 반도체 기업은 자사 프로세서 혁신에 집중하면서도, 이를 AI 팩토리 규모로 배포할 때는 NVIDIA 인프라를 활용할 수 있습니다.

맞춤형 실리콘에서 랙 스케일 배포까지

XPU를 만드는 것은 첫 단계에 불과합니다. 이를 AI 팩토리 규모로 배포하려면 네트워킹과 랙 아키텍처, 전력, 냉각, 소프트웨어, 그리고 검증된 공급망까지 아우르는 완전한 플랫폼이 필요하죠. 칩을 조달하고, 고속 인터페이스를 통합하고, 스케일업 네트워킹 솔루션을 검증하고, 랙 아키텍처를 설계·인증하는 단계 하나하나가 시간과 비용, 리스크를 더합니다.

NVLink Fusion은 반도체 혁신 기업이 NVIDIA의 검증된 플랫폼에 곧바로 연결할 수 있게 해 줍니다. 맞춤형 XPU와 CPU를 NVIDIA 기술 스택에 잇는 고대역폭·저지연 기술이죠.

NVLink Fusion을 도입하면서 d-Matrix는 NVIDIA MGX 생태계의 성숙하고 검증된 랙 설계와 공급망, 전력·냉각 인프라를 그대로 활용할 수 있게 됐습니다. 또한 공통 랙으로 표준화하면 데이터센터를 한 번만 구축해도 GPU와 CPU, XPU를 모두 지원할 수 있어서, 프로세서 종류마다 별도의 랙 아키텍처를 마련할 필요가 없습니다.

d-Matrix XPU를 AI 팩토리에 통합하는 NVLink Fusion

d-Matrix는 NVIDIA NVLink를 활용해 자사 XPU를 하나의 고대역폭·저지연 스케일업 도메인으로 연결할 계획입니다. 이 랙은 분리형 추론을 위해 NVIDIA Vera Rubin NVL72 같은 NVIDIA GPU 기반 시스템과 나란히 동작할 수도 있죠.

여기에 더해 d-Matrix는 NVIDIA Vera CPU와 NVIDIA ConnectX-9 SuperNIC, NVIDIA BlueField-4 DPU, NVIDIA Spectrum-X 이더넷 네트워킹도 함께 통합할 계획입니다. NVLink·MGX와 결합된 이들 기술은 유연하고 통합된 AI 팩토리 안에서 특화 추론을 NVIDIA 시스템과 나란히 배포할 수 있는 검증된 기반이 돼 줍니다.

특화 XPU 아키텍처에 NVIDIA AI 팩토리를 열어 주는 NVLink Fusion

NVIDIA 풀스택 AI 팩토리 플랫폼은 NVIDIA Vera Rubin NVL72와 Groq 3 LPX, Vera CPU 랙, Vera BlueField-4 STX 스토리지, Spectrum-6 SPX 이더넷 네트워킹으로 구성됩니다. 이 플랫폼은 모든 AI 워크로드와 모델, 모델 아키텍처를 가리지 않고 실행하는 완벽한 범용성을 갖추도록 설계됐고, 와트당 최고 성능과 토큰당 최저 비용을 목표로 합니다.

NVLink Fusion은 공통 AI 팩토리 플랫폼 안에서 각 워크로드에 가장 알맞은 컴퓨팅을 짝지을 수 있는 유연성을 고객에게 제공하며, NVIDIA의 네트워킹과 시스템, 소프트웨어, 글로벌 공급망까지 열어 줍니다. 덕분에 d-Matrix 같은 반도체 혁신 기업은 NVLink Fusion으로 성능을 높이고 출시 기간을 앞당기는 한편, 세미 커스텀 AI 팩토리 배포에 따르는 리스크를 줄일 수 있습니다.