Meta와 NVIDIA, 수백만 GPU 대규모 AI 인프라 파트너십 체결
NVIDIA가 2월 17일 Meta와 멀티이어·멀티세대 전략적 파트너십을 발표했다. 수백만 개의 Blackwell·Rubin GPU와 최초 대규모 Grace CPU 단독 배포, WhatsApp 프라이버시 컴퓨팅이 핵심이다.
NVIDIA는 2026년 2월 17일 Meta와의 멀티이어·멀티세대 전략적 파트너십 체결을 공식 발표했다. 이번 협약은 Meta의 하이퍼스케일 데이터센터 전반에 NVIDIA CPU, GPU, 네트워킹을 통합 배포하는 내용으로, 온프레미스·클라우드·AI 인프라를 모두 포괄한다.
수백만 개의 GPU 배포
파트너십의 핵심은 훈련·추론 워크로드 모두에 최적화된 Meta 데이터센터에 수백만 개의 NVIDIA Blackwell 및 Rubin GPU를 배포하는 것이다. Rubin 플랫폼은 Blackwell 대비 추론 토큰 비용을 최대 10분의 1로, MoE 모델 훈련에 필요한 GPU 수를 4분의 1로 줄이는 성능을 제공한다.
최초 Grace CPU 대규모 단독 배포
Meta는 NVIDIA의 Arm 기반 Grace CPU를 데이터센터에 독립적으로 대규모 배포하는 첫 번째 사례가 됐다. 에너지 효율 향상을 목표로 하며, 2027년에는 차세대 NVIDIA Vera CPU로의 전환도 계획하고 있다.
AI 네트워킹 및 프라이버시 컴퓨팅
Meta는 NVIDIA Spectrum-X 이더넷 스위치로 AI 규모의 저지연 네트워킹을 구축한다. WhatsApp 프라이빗 처리에는 NVIDIA Confidential Computing을 채택해 사용자 데이터 기밀성을 보장하면서 AI 기능을 구현한다.
원문: NVIDIA 공식 보도자료
관련 기사
NVIDIA Groq 3 LPX 양산 개시 — 에이전트 추론 속도 경쟁 플랫폼 대비 4배
NVIDIA가 Vera Rubin 플랫폼 확장형 추론 가속기 Groq 3 LPX의 양산을 8월 24일 선언했다. Gemma 4 31B 모델 기준 초당 3,400 토큰으로 역대 최고 추론 속도를 기록하며 에이전트 AI 인프라의 새 기준을 제시한다.
NVIDIA 젠슨 황, GPT-6 Astra에 Blackwell 10만개 투입·40만개 추가 가동
프런티어 모델 경쟁의 규모가 10만 GPU 훈련에서 40만 GPU 증설 단계로 커지고 있다. NVIDIA CEO 젠슨 황은 GPT-6 Astra가 약 10만개 이상의 Grace Blackwell NVLink72에서 훈련됐으며, 다음으로 40만개 GPU가 가동될 것이라고 밝혔다.
CoreWeave, Rubin GPU 72개·Vera CPU 36개 묶은 첫 NVL72 생산 랙 가동
CoreWeave가 72개 Rubin GPU와 36개 Vera CPU를 묶은 첫 양산형 NVL72 랙의 가동 준비에 들어갔다. 랙당 HBM4 20.7TB와 NVLink 대역폭 260TB/s를 제공해 Rubin이 사양표에서 실제 클라우드 인프라로 넘어가는 신호이며 상용 인스턴스 일정은 아직 공개되지 않았다.