Meta와 Arm, AI data center용 차세대 CPU 공동 개발
Meta와 Arm은 AI 중심 data center에 맞춘 CPU를 여러 세대에 걸쳐 공동 개발한다고 밝혔다. 첫 제품인 Arm AGI CPU는 rack당 성능과 효율을 높이는 것이 목표이며, Meta는 accelerator를 넘어 custom silicon stack 전반을 더 깊게 통제하려는 방향을 드러냈다.
태그
#infrastructure 태그가 달린 기사
Meta와 Arm은 AI 중심 data center에 맞춘 CPU를 여러 세대에 걸쳐 공동 개발한다고 밝혔다. 첫 제품인 Arm AGI CPU는 rack당 성능과 효율을 높이는 것이 목표이며, Meta는 accelerator를 넘어 custom silicon stack 전반을 더 깊게 통제하려는 방향을 드러냈다.
Meta는 2026년 1월 9일 Vistra, TerraPower, Oklo와의 계약을 발표하며 최대 6.6 GW 규모의 신규·기존 clean power를 2035년까지 지원하겠다고 밝혔다. Prometheus supercluster를 포함한 AI infrastructure 전력 확보가 핵심이다.
NVIDIA가 2026년 3월 23일 Vera CPU를 공개했다. 회사는 이를 agentic AI와 reinforcement learning 시대를 위해 설계한 첫 전용 CPU로 설명하며, 기존 rack-scale CPU 대비 50% 빠르고 효율은 2배라고 주장했다.
Anthropic가 2026년 2월 12일 Series G로 300억 달러를 조달하고 post-money valuation 3,800억 달러를 기록했다고 밝혔다. 회사는 이 자금을 frontier research, product development, infrastructure expansion에 투입하겠다고 설명했다.
Hugging Face가 Hub에 mutable·non-versioned object storage인 Storage Buckets를 추가했다. Xet 기반 deduplication과 AWS·GCP pre-warming을 결합해 checkpoint, processed shard, agent trace 같은 ML artifact를 더 효율적으로 다루겠다는 구상이다.
Meta는 March 11, 2026 향후 2년 안에 MTIA custom chip 4세대를 개발·배치하겠다고 밝혔다. 회사는 ranking, recommendation, GenAI inference를 위한 AI infrastructure 전략의 중심에 MTIA를 두고 있다.
OpenAI와 Pacific Northwest National Laboratory는 DraftNEPABench를 공개하고, document-heavy한 NEPA 업무에서 coding agents의 효과를 평가했다. 18개 federal agencies 기준 작업에서 전문가들은 subsection당 1 to 5 hours, 즉 최대 약 15%의 drafting time 절감 가능성을 확인했다고 밝혔다.
Meta는 2026년 3월 11일 MTIA 300부터 MTIA 500까지 이어지는 in-house AI chip 로드맵을 공개했다. 회사는 custom silicon을 통해 ranking, recommendation, 그리고 특히 GenAI inference의 비용 구조를 Meta 규모에 맞게 최적화하려 하고 있다.
OpenAI는 2026년 3월 6일 Sachin Katti의 메시지를 repost하며 위스콘신 Port Washington 사이트 공사가 시작됐다고 밝혔다. 이는 Stargate와 파트너 기반 compute 전략이 실제 건설 단계로 넘어갔다는 신호에 가깝다.
Together AI는 March 12, 2026에 real-time voice agent용 one-cloud stack을 공개한다고 밝혔다. 공개 자료에는 under-500ms latency, 25+ region 확장, 그리고 voice-agent deployment에서 time-to-first-64-tokens를 77ms까지 낮춘 kernel 최적화 사례가 포함돼 있다.
Anthropic은 2026년 3월 10일 시드니가 아시아태평양 네 번째 거점이 될 것이라고 밝혔다. 회사는 ANZ 지역 수요 증가를 이유로 enterprise·startup·research 고객 지원과 data residency 수요에 맞춘 현지 compute 검토를 병행하겠다고 했다.
Meta는 next-gen AI 확장에 custom silicon이 필수라며 Meta Training and Inference Accelerator(MTIA) 로드맵을 공개했다. 회사는 전통적인 chip cycle과 빠른 model architecture 변화의 간격을 줄이기 위해 2년 만에 4세대를 출시했다고 설명했다.