CUDA 커널도 Rust로 직접 작성…NVIDIA, 메모리 안전성 갖춘 오픈소스 경로 2종 공개
Rust 코드가 래퍼를 거치지 않고 GPU용 PTX로 직접 향하는 두 경로가 열렸다. NVIDIA의 cuda-oxide와 cutile-rs는 각각 SIMT 제어와 타일 추상화를 택해, AI 인프라의 Rust 전환에서 마지막으로 남았던 커널 경계를 겨냥한다.
Insights
기사 182개
Rust 코드가 래퍼를 거치지 않고 GPU용 PTX로 직접 향하는 두 경로가 열렸다. NVIDIA의 cuda-oxide와 cutile-rs는 각각 SIMT 제어와 타일 추상화를 택해, AI 인프라의 Rust 전환에서 마지막으로 남았던 커널 경계를 겨냥한다.
프런티어 모델 경쟁의 규모가 10만 GPU 훈련에서 40만 GPU 증설 단계로 커지고 있다. NVIDIA CEO 젠슨 황은 GPT-6 Astra가 약 10만개 이상의 Grace Blackwell NVLink72에서 훈련됐으며, 다음으로 40만개 GPU가 가동될 것이라고 밝혔다.
CoreWeave가 72개 Rubin GPU와 36개 Vera CPU를 묶은 첫 양산형 NVL72 랙의 가동 준비에 들어갔다. 랙당 HBM4 20.7TB와 NVLink 대역폭 260TB/s를 제공해 Rubin이 사양표에서 실제 클라우드 인프라로 넘어가는 신호이며 상용 인스턴스 일정은 아직 공개되지 않았다.
Figure가 Nscale과 손잡고 2027년 하반기부터 NVIDIA Vera Rubin GPU 최대 10만개를 배치하며, 초기 35억달러에서 60억달러 이상으로 투자를 늘린다. 초당 35분 분량의 로봇 데이터를 만드는 Index와 대규모 연산을 결합해 Helix의 물리 지능 훈련을 확장한다.
NVIDIA가 Hugging Face를 129억3030만달러에 인수하기로 합의하며 1,800만 개발자와 300만개 모델이 모인 오픈 AI 생태계를 품는다. 양사는 NVIDIA 하드웨어를 강제하지 않고 멀티클라우드·멀티가속기 중립성을 유지하겠다고 약속했으며, 규제 심사가 다음 변수다.
CrowdStrike와 NVIDIA가 SafeMind를 공개했다. 15년치 사고 대응 데이터로 훈련한 공격형 Red Tempest와 방어형 Blue Solano가 폐쇄 루프로 협력해 기업 인프라를 자율 방어한다.
Anthropic이 Nvidia 지원 클라우드 기업 Lambda와 6년간 350억 달러 규모 컴퓨팅 계약을 체결했다. 텍사스 Nueces County에 350MW급 데이터센터를 구축해 Claude 모델의 급증하는 추론 수요를 뒷받침한다.
NVIDIA의 차세대 AI 업스케일링 기술 DLSS 5의 필터가 유출되면서, 게이머들이 이를 다양한 게임에 비공식으로 삽입하기 시작했다. 개발자 의도를 무시한 AI 화질 변환에 대한 우려가 커지고 있다.
NVIDIA가 Vera Rubin 플랫폼 확장형 추론 가속기 Groq 3 LPX의 양산을 8월 24일 선언했다. Gemma 4 31B 모델 기준 초당 3,400 토큰으로 역대 최고 추론 속도를 기록하며 에이전트 AI 인프라의 새 기준을 제시한다.
Nvidia의 HuggingFace 인수가 2026년 2월 HF에 합류한 llama.cpp 핵심 개발팀까지 사실상 흡수할 수 있다는 분석이 LocalLLaMA 커뮤니티에서 나왔다.
OpenAI가 Broadcom과 공동 개발한 첫 자체 추론 칩 '할라페뇨'를 공개했다. Nvidia GB200·GB300 대비 처리량 최대 1.9배, 응답 지연 최대 3.6배 단축을 달성했으며 2026년 말 배포 예정이다.
GPU 클라우드 스타트업 Lambda가 120억 달러 이상의 기업 가치를 목표로 최대 30억 달러의 사전 IPO 투자를 협상 중이라고 Bloomberg가 8월 24일 보도했다. 올해 매출 15억 달러 이상을 전망하며 2027년 상장을 준비 중이다.