슈퍼마이크로가 엔비디아의 차세대 인공지능(AI) 가속기 '베라 루빈'을 탑재한 대규모 AI 인프라 공급에 본격 나선다. 서버부터 직접 수냉식 냉각, 전력·네트워크까지 통합한 데이터센터 구축 방식을 앞세워 5메가와트(MW)급부터 기가와트(GW)급 AI 데이터센터 수요에 대응한다는 전략이다.
슈퍼마이크로는 데이터센터 빌딩 블록 솔루션(DCBBS)과 직접 수냉식 냉각 기술 'DLC-2'를 통합한 엔비디아 베라 루빈 NVL72 랙의 출하를 시작했다고 29일 밝혔다.
베라 루빈 플랫폼은 엔비디아가 차세대 AI 인프라를 겨냥해 개발한 시스템으로 직접 수냉식 냉각 기술을 기반으로 설계됐다. AI 연산 성능이 높아질수록 GPU에서 발생하는 열도 증가하는 만큼 고밀도 AI 인프라에서는 냉각 성능이 주요 과제로 꼽힌다.
슈퍼마이크로는 콜드플레이트와 매니폴드에서 냉각분배장치(CDU), 냉각탑까지 이어지는 수냉식 냉각 기술을 통합해 제공할 계획이다. 전체 냉각수 순환 계통을 활용해 서버에서 발생하는 열을 외부로 이동시키는 방식이다.
회사는 전체 수냉식 냉각 시스템을 통합한 상태에서 각 랙을 테스트하고 검증해 데이터센터 현장 구축부터 운영 개시까지 걸리는 시간을 줄인다는 목표다.
베라 루빈 NVL72 랙은 단일 수냉식 랙에 엔비디아 루빈 그래픽처리장치(GPU) 72개와 베라 중앙처리장치(CPU) 36개를 탑재한다. 루빈 GPU 4개와 베라 CPU 2개를 탑재한 1U 컴퓨팅 트레이 18개와 6세대 엔비디아 NV링크 스위치 트레이 9개로 구성된다.
랙 하나에서 216테라바이트(TB)/s의 스케일업 대역폭을 제공하며 20.7TB의 HBM4 메모리와 최대 54TB의 LPDDR5X 메모리를 지원한다.
대규모 AI 데이터센터 구축을 위한 DCBBS 블루프린트도 제공한다. 5MW부터 GW급까지 데이터센터 전력 규모에 맞춰 냉각과 전력 공급, 고성능 스토리지, 네트워크 등을 구성할 수 있도록 지원한다.
단일 베라 루빈 NVL72 확장형 유닛은 16개 컴퓨팅 랙에 루빈 GPU 1152개와 331TB의 HBM4 메모리를 제공한다. AI 인프라 규모가 커지더라도 같은 구조를 기반으로 데이터센터를 단계적으로 확장할 수 있도록 설계했다.
냉각 인프라도 고밀도 AI 시스템에 맞췄다. 슈퍼마이크로의 인로우 CDU는 장치당 1.8MW의 냉각 용량을 지원하며 N+1 이중화 구성으로 배치할 수 있다. 후면 도어 열교환기를 추가해 남아 있는 열부하를 처리하는 구성도 지원한다.
AI 컴퓨팅 패브릭과 컨버지드 패브릭, 대역 외 관리(OOB) 케이블링을 포함한 네트워킹 통합 서비스도 제공한다. 엔비디아 레퍼런스 아키텍처를 기반으로 서버와 냉각뿐 아니라 네트워크까지 하나의 AI 인프라로 구축하는 방식이다.
슈퍼마이크로는 현장 시설 조사와 프로젝트 설계부터 솔루션 통합, 테스트, 납품, 현장 구축 및 사후 지원까지 전 과정을 전담팀이 통합 관리할 방침이다. 개별 서버 공급을 넘어 AI 데이터센터 구축 전반을 지원하는 사업을 확대한다는 목표다.
관련기사
찰스 리앙 슈퍼마이크로 사장 겸 최고경영자(CEO)는 "우리는 이번 순간을 위해 수년간 수냉식 냉각 기술 스택과 제조 역량, 구축 전문팀을 구축해왔다"며 "콜드플레이트부터 냉각탑까지 모든 구성 요소를 설계·구축하기에 고객은 확장형 유닛을 주문하고 엔드투엔드 통합이 완료된 상용 환경에 바로 적용할 수 있는 시스템을 공급받을 수 있다"고 말했다.
이어 "우리가 개발한 DLC-2 기술은 이러한 차별화된 역량의 핵심으로, 엔비디아 베라 루빈 플랫폼을 위한 완성도 높은 통합 솔루션을 제공할 수 있도록 한다"고 덧붙였다.








