NVIDIA 젠슨 황, GPT-6 Astra에 Blackwell 10만개 투입·40만개 추가 가동
프런티어 모델 경쟁의 규모가 10만 GPU 훈련에서 40만 GPU 증설 단계로 커지고 있다. NVIDIA CEO 젠슨 황은 GPT-6 Astra가 약 10만개 이상의 Grace Blackwell NVLink72에서 훈련됐으며, 다음으로 40만개 GPU가 가동될 것이라고 밝혔다.
원문: Jensen Huang says GPT-6 Astra trained on 100K Blackwell GPUs with 400K more coming 원문 보기 →
10만개 훈련 뒤 40만개 추가 가동
GPT-6 Astra의 훈련 인프라 규모를 보여주는 첫 구체적 숫자가 NVIDIA 최고경영자 젠슨 황의 게시물에서 나왔다. 황은 Astra가 약 10만개 이상의 NVIDIA Grace Blackwell NVLink72를 사용해 훈련됐고, 이어 40만개 GPU가 가동될 것이라고 적었다. ChatGPT에서 o1, Astra까지 4년이 걸렸다는 비교도 덧붙였다. 정확한 집계 범위와 가동 시점은 공개하지 않았지만, 공급사 최고경영자가 직접 제시한 숫자라는 점에서 데이터센터 투자 규모를 가늠할 단서다.
“GPT-6 Astra, trained on ~100K+ NVIDIA Grace Blackwell NVLink72.”
Grace Blackwell NVLink72는 다수의 Blackwell GPU와 Grace CPU를 고속 연결해 하나의 대형 연산 도메인처럼 쓰도록 설계된 랙 단위 시스템이다. 모델 훈련에서 GPU 개수만큼 중요한 요소는 네트워크 대역폭, 메모리, 전력, 냉각, 그리고 실제로 동시에 유효하게 사용한 시간이다. 따라서 10만개라는 표현을 단일 훈련 실행에 모두 투입한 GPU 수로 볼지, 전체 훈련 기간에 사용된 클러스터 용량으로 볼지는 추가 설명이 필요하다.
성능 경쟁이 전력·공급망 경쟁으로 확장
40만개 추가 가동 계획은 한 모델의 성능 수치보다 더 넓은 파급을 갖는다. GPU 조달, 고대역폭 메모리, 랙 간 네트워킹, 발전 용량과 냉각 설비가 모델 개발 속도를 제한할 수 있기 때문이다. 동시에 대형 연구소와 소규모 개발사 사이의 자본 격차도 확대된다. 황은 이를 AGI 도달로 규정했지만, 그 표현은 독립적으로 합의된 기술 판정이 아니라 경영자의 평가로 구분해야 한다.
숫자의 단위도 검증 대상이다. NVLink72는 랙 시스템 이름이므로 게시물의 10만개가 개별 GPU를 뜻하는지, 랙 또는 다른 집계 단위를 뜻하는지 문장만으로 완전히 확정하기 어렵다. 40만개 역시 이미 설치된 장비인지 계약된 물량인지, 어느 고객과 지역에 배분되는지 제시되지 않았다. 투자자와 공급망 기업은 이 숫자를 수요 전망으로 바로 환산하기보다 출하, 설치, 실제 가동을 나눠 봐야 한다.
게시물은 특정 사용자에게 답하는 형식이지만 훈련 자원과 증설 계획이라는 새로운 정보를 담고 있어 독립적인 뉴스 가치가 있다. 다음 확인 지점은 OpenAI 또는 NVIDIA가 10만개 수치의 산정 방식, 훈련 기간, 총 전력 소비와 40만개 가동 일정을 공식 문서로 보완하는지다. Astra 성능 향상이 연산량 증가에 비례했는지, 알고리즘과 데이터 개선이 어느 정도 기여했는지도 핵심이다. 원문은 젠슨 황의 X 게시물에서 확인할 수 있다.
관련 기사
NVIDIA, Q2 매출 $962억 신기록 — 블랙웰 울트라가 이끄는 AI 인프라 폭발 성장
NVIDIA가 2027 회계연도 2분기 매출로 $962억을 기록하며 전년 대비 106% 성장했다. 데이터센터 부문이 $890억으로 전체 매출의 92%를 차지하며 블랙웰 울트라 인프라의 폭발적 수요를 확인시켰다.
CoreWeave, Rubin GPU 72개·Vera CPU 36개 묶은 첫 NVL72 생산 랙 가동
CoreWeave가 72개 Rubin GPU와 36개 Vera CPU를 묶은 첫 양산형 NVL72 랙의 가동 준비에 들어갔다. 랙당 HBM4 20.7TB와 NVLink 대역폭 260TB/s를 제공해 Rubin이 사양표에서 실제 클라우드 인프라로 넘어가는 신호이며 상용 인스턴스 일정은 아직 공개되지 않았다.
Meta, NVIDIA와 차세대 AI 인프라 협력 확대
NVIDIA는 2026년 2월 17일 Meta가 GB300 NVL72, RTX PRO 서버, Spectrum-X, Mission Control을 포함한 스택으로 AI 인프라를 확장한다고 발표했다. 대규모 Hopper 배치 경험 위에 Blackwell 기반 전환을 본격화하는 흐름이다.