본문으로 건너뛰기

태그

#nvidia

#nvidia 태그가 달린 기사

RSS 피드
LLM X/Twitter

NVIDIA, Nemotron Nano 12B v2 VL을 온프레미스 영상 이해용 경량 오픈 모델로 전면 배치

NVIDIA는 2026년 3월 25일 Nemotron Nano 12B v2 VL이 온프레미스 video understanding을 지원하며, 자사 설명 기준으로 MediaPerf benchmark에서 30B급 대안에 가까운 성능을 더 작은 footprint로 낸다고 밝혔다. NVIDIA 모델 카드는 이를 multi-image reasoning, video understanding, visual Q&A, summarization을 위한 상용 가능 멀티모달 모델로 소개한다.

2분 소요 44 조회
AI

NVIDIA, GPU DRA Driver를 Kubernetes community에 기증

NVIDIA는 KubeCon Europe에서 GPU Dynamic Resource Allocation driver를 CNCF와 upstream Kubernetes ecosystem으로 넘긴다고 밝혔다. 이번 발표는 confidential containers, KAI Scheduler, Grove API까지 묶어 대규모 AI cluster 운영 표준을 넓히려는 시도로 읽힌다.

2분 소요 30 조회
AI

NVIDIA·Emerald AI, power-flexible AI factory 추진… grid asset형 data center 모델 제시

NVIDIA와 Emerald AI가 2026년 3월 23일 AES, Constellation, Invenergy, NextEra Energy, Nscale Energy & Power, Vistra와 함께 power-flexible AI factory 구상을 발표했다. Vera Rubin DSX와 DSX Flex를 기반으로 AI data center를 grid asset처럼 운영해 더 빠른 interconnection과 전력 유연성을 동시에 노린다.

2분 소요 53 조회
AI

Microsoft, NVIDIA GTC에서 Foundry agent·Vera Rubin·Physical AI 동시 확대

Microsoft는 March 16, 2026 NVIDIA GTC에서 Foundry Agent Service와 observability 일반 공개, NVIDIA Nemotron model 제공, Vera Rubin NVL72 기반 Azure AI infrastructure 확장, 그리고 Azure Physical AI Toolchain 공개를 발표했다. agent platform, inference infrastructure, physical AI를 한 흐름으로 묶었다는 점이 핵심이다.

3분 소요 50 조회
LLM 레딧

r/LocalLLaMA가 재조명한 Nemotron Cascade, 작은 activated params로도 강한 coding 성능

r/LocalLLaMA의 새 스레드는 NVIDIA의 Nemotron-Cascade-2-30B-A3B가 중형 Qwen 3.5 계열보다 더 강한 coding 결과를 낼 수 있다고 주장하며 주목을 끌었다. community benchmark와 NVIDIA의 model card를 함께 보면, local inference 비용과 reasoning 성능 사이의 새로운 균형점을 찾으려는 흐름이 읽힌다.

1분 소요 50 조회