CoreWeave, Rubin GPU 72개·Vera CPU 36개 묶은 첫 NVL72 생산 랙 가동
CoreWeave가 72개 Rubin GPU와 36개 Vera CPU를 묶은 첫 양산형 NVL72 랙의 가동 준비에 들어갔다. 랙당 HBM4 20.7TB와 NVLink 대역폭 260TB/s를 제공해 Rubin이 사양표에서 실제 클라우드 인프라로 넘어가는 신호이며 상용 인스턴스 일정은 아직 공개되지 않았다.
Insights
기사 6개
CoreWeave가 72개 Rubin GPU와 36개 Vera CPU를 묶은 첫 양산형 NVL72 랙의 가동 준비에 들어갔다. 랙당 HBM4 20.7TB와 NVLink 대역폭 260TB/s를 제공해 Rubin이 사양표에서 실제 클라우드 인프라로 넘어가는 신호이며 상용 인스턴스 일정은 아직 공개되지 않았다.
Figure가 Nscale과 손잡고 2027년 하반기부터 NVIDIA Vera Rubin GPU 최대 10만개를 배치하며, 초기 35억달러에서 60억달러 이상으로 투자를 늘린다. 초당 35분 분량의 로봇 데이터를 만드는 Index와 대규모 연산을 결합해 Helix의 물리 지능 훈련을 확장한다.
NVIDIA가 Vera Rubin 플랫폼 확장형 추론 가속기 Groq 3 LPX의 양산을 8월 24일 선언했다. Gemma 4 31B 모델 기준 초당 3,400 토큰으로 역대 최고 추론 속도를 기록하며 에이전트 AI 인프라의 새 기준을 제시한다.
NVIDIADC는 2026년 3월 17일 X에서 Groq 3 LPX를 Vera Rubin platform용 rack-scale low-latency inference accelerator로 소개했다. NVIDIA의 3월 16일 press release와 technical blog는 LPX가 256개의 LPU, 128GB on-chip SRAM, 640 TB/s scale-up bandwidth를 갖추고 Vera Rubin NVL72와 함께 agentic AI용 heterogeneous inference path를 형성한다고 설명한다.
Thinking Machines Lab은 NVIDIA와 다년간 전략적 파트너십을 맺고 차세대 Vera Rubin 시스템을 최소 1GW 규모로 배치하겠다고 밝혔다. 양사는 training·serving 시스템 공동 설계와 함께 enterprise, research institution, scientific community로 frontier AI 및 open model 접근을 넓히는 계획도 제시했다.
NVIDIA와 Thinking Machines Lab은 2026년 3월 10일 최소 1 gigawatt 규모의 차세대 NVIDIA Vera Rubin 시스템을 배치하는 장기 파트너십을 발표했다. 양사는 training·serving system 공동 설계와 함께 NVIDIA의 전략적 투자도 포함한다고 밝혔다.