Meta·NVIDIA, AI data center 확장을 위한 장기 인프라 파트너십 체결
Meta는 NVIDIA와의 multi-year 계약이 training, inference, 핵심 업무 처리를 위한 AI 최적화 data center 구축을 뒷받침할 것이라고 밝혔다. 이번 발표는 privacy, networking, Vera Rubin cluster 계획까지 하나의 인프라 로드맵으로 묶는다.
태그
#nvidia 태그가 달린 기사
Meta는 NVIDIA와의 multi-year 계약이 training, inference, 핵심 업무 처리를 위한 AI 최적화 data center 구축을 뒷받침할 것이라고 밝혔다. 이번 발표는 privacy, networking, Vera Rubin cluster 계획까지 하나의 인프라 로드맵으로 묶는다.
GamesRadar는 2026-03-24 Lex Fridman 인터뷰를 인용해 Nvidia CEO Jensen Huang이 DLSS 5 데모를 둘러싼 비판을 이해한다며 "I don't love AI slop myself"라고 말했다고 전했다.
NVIDIA는 2026년 3월 25일 Nemotron Nano 12B v2 VL이 온프레미스 video understanding을 지원하며, 자사 설명 기준으로 MediaPerf benchmark에서 30B급 대안에 가까운 성능을 더 작은 footprint로 낸다고 밝혔다. NVIDIA 모델 카드는 이를 multi-image reasoning, video understanding, visual Q&A, summarization을 위한 상용 가능 멀티모달 모델로 소개한다.
NVIDIA는 KubeCon Europe에서 GPU Dynamic Resource Allocation driver를 CNCF와 upstream Kubernetes ecosystem으로 넘긴다고 밝혔다. 이번 발표는 confidential containers, KAI Scheduler, Grove API까지 묶어 대규모 AI cluster 운영 표준을 넓히려는 시도로 읽힌다.
NVIDIA가 2026년 3월 23일 OpenShell을 공개했다. 회사는 autonomous agent마다 sandbox를 분리하고 security policy를 infrastructure layer에 두는 방식으로, agentic workflow를 더 안전하게 운영할 수 있다고 설명했다.
NVIDIA와 Emerald AI가 2026년 3월 23일 AES, Constellation, Invenergy, NextEra Energy, Nscale Energy & Power, Vistra와 함께 power-flexible AI factory 구상을 발표했다. Vera Rubin DSX와 DSX Flex를 기반으로 AI data center를 grid asset처럼 운영해 더 빠른 interconnection과 전력 유연성을 동시에 노린다.
NVIDIA가 2026년 3월 23일 Vera CPU를 공개했다. 회사는 이를 agentic AI와 reinforcement learning 시대를 위해 설계한 첫 전용 CPU로 설명하며, 기존 rack-scale CPU 대비 50% 빠르고 효율은 2배라고 주장했다.
NVIDIA는 2026년 3월 16일 Nemotron Coalition을 발표했다. Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection AI, Sarvam, Thinking Machines Lab이 참여하며, 첫 모델은 NVIDIA DGX Cloud에서 학습돼 향후 Nemotron 4 family의 기반이 된다.
Microsoft는 March 16, 2026 NVIDIA GTC에서 Foundry Agent Service와 observability 일반 공개, NVIDIA Nemotron model 제공, Vera Rubin NVL72 기반 Azure AI infrastructure 확장, 그리고 Azure Physical AI Toolchain 공개를 발표했다. agent platform, inference infrastructure, physical AI를 한 흐름으로 묶었다는 점이 핵심이다.
r/LocalLLaMA의 새 스레드는 NVIDIA의 Nemotron-Cascade-2-30B-A3B가 중형 Qwen 3.5 계열보다 더 강한 coding 결과를 낼 수 있다고 주장하며 주목을 끌었다. community benchmark와 NVIDIA의 model card를 함께 보면, local inference 비용과 reasoning 성능 사이의 새로운 균형점을 찾으려는 흐름이 읽힌다.
NVIDIA와 Oracle은 2026년 3월 16일 Argonne National Laboratory에 미국 Department of Energy(DOE) 최대 규모의 AI 슈퍼컴퓨터를 구축하겠다고 밝혔다. Solstice와 Equinox는 합산 110,000개의 Blackwell GPU와 2,200 exaflops의 AI 성능을 목표로 한다.
NVIDIA는 2026년 3월 12일 TensorRT Edge-LLM이 Jetson과 DRIVE에서 MoE, Nemotron 2 Nano, Qwen3-TTS/ASR, Cosmos Reason 2를 지원한다고 밝혔다. 회사는 이를 robotics와 autonomous vehicle용 low-latency edge reasoning runtime으로 포지셔닝하고 있다.