NVIDIA DGX SuperPOD, Rubin 기반 AI 팩토리 청사진 공개
NVIDIA는 DGX SuperPOD를 Rubin 플랫폼 중심으로 확장하는 로드맵을 공개하며, 추론 토큰 비용 최대 10배 절감 목표를 제시했다. NVL72/NVL8 구성, 800Gb/s 네트워킹, Mission Control 연계가 핵심 축이다.
원문: NVIDIA DGX SuperPOD Sets the Stage for Rubin-Based Systems 원문 보기 →
Rubin 시대를 겨냥한 DGX SuperPOD 확장 전략
NVIDIA는 NVIDIA DGX SuperPOD Sets the Stage for Rubin-Based Systems에서 Rubin 기반 대규모 AI 인프라 설계를 제시했다. 회사 설명에 따르면 Rubin 플랫폼은 Vera CPU, Rubin GPU, NVLink 6 Switch, ConnectX-9 SuperNIC, BlueField-4 DPU, Spectrum-6 Ethernet Switch 등 6개 핵심 컴포넌트를 코드설계로 통합해 학습과 추론 효율을 동시에 높이는 구조다.
발표의 메시지는 단순 칩 소개가 아니라 시스템 레벨 최적화다. NVIDIA는 Rubin 세대 DGX가 Blackwell 대비 추론 토큰 비용을 최대 10배 낮출 수 있다고 주장하며, 장문맥 추론과 MoE 워크로드 확산에 맞춘 인프라 전환을 강조했다.
규모 지표: NVL72/NVL8와 네트워크 패브릭
DGX SuperPOD with DGX Vera Rubin NVL72 구성은 14개 NVL72 시스템, 총 1,008 Rubin GPU, FP4 기준 50.4 exaflops, 1,046TB 메모리 구성을 제시한다. 또한 랙 단위 NVLink 대역폭 260TB/s로 모델 분할 부담을 줄이고 랙 전체를 일관된 AI 엔진처럼 동작시키는 것을 목표로 한다.
동시에 DGX Rubin NVL8 경로도 제공된다. 64개 NVL8 시스템(512 Rubin GPU) 구성과 액체 냉각 form factor를 통해, x86 중심 환경에서 Rubin 세대로 이전하려는 조직의 온램프를 제시한다. 각 NVL8 시스템은 Blackwell 대비 5.5배 NVFP4 FLOPS를 강조한다.
운영 소프트웨어와 배포 시점
네트워킹 측면에서는 Quantum-X800 InfiniBand와 Spectrum-X Ethernet을 800Gb/s급 end-to-end 패브릭으로 제시해 대규모 AI 클러스터의 혼잡 제어와 확장성을 강조했다. 운영 계층에서는 Mission Control을 Rubin 기반 DGX에도 확장해 배포·클러스터 운영·시설 연계 자동화를 제공하겠다고 밝혔다.
회사 발표 기준으로 DGX SuperPOD with DGX Vera Rubin NVL72 또는 DGX Rubin NVL8 시스템은 2026년 하반기 공급이 예정돼 있다. 이 로드맵은 AI 인프라 경쟁이 단일 GPU 성능에서 시스템 통합, 운영 자동화, 네트워크 아키텍처로 빠르게 이동하고 있음을 보여준다.
관련 기사
NVIDIA, Q2 매출 $962억 신기록 — 블랙웰 울트라가 이끄는 AI 인프라 폭발 성장
NVIDIA가 2027 회계연도 2분기 매출로 $962억을 기록하며 전년 대비 106% 성장했다. 데이터센터 부문이 $890억으로 전체 매출의 92%를 차지하며 블랙웰 울트라 인프라의 폭발적 수요를 확인시켰다.
Emerald AI, 전력망 유연 AI 데이터센터로 $1.5억 시리즈 A 유치
Emerald AI가 기업 가치 $10.5억에 $1.5억 시리즈 A 투자를 유치했다. AI 데이터센터를 전력망 유연 자산으로 전환하는 소프트웨어로 미국 기존 전력망에서 100GW 이상의 AI 인프라 용량 확보를 목표로 한다.
NVIDIA 젠슨 황, GPT-6 Astra에 Blackwell 10만개 투입·40만개 추가 가동
프런티어 모델 경쟁의 규모가 10만 GPU 훈련에서 40만 GPU 증설 단계로 커지고 있다. NVIDIA CEO 젠슨 황은 GPT-6 Astra가 약 10만개 이상의 Grace Blackwell NVLink72에서 훈련됐으며, 다음으로 40만개 GPU가 가동될 것이라고 밝혔다.