Arm Neoverse CSS N4, 128코어·PCIe 7 탑재…성능 2배로 AI 데이터센터 공략
Arm의 Neoverse CSS N4가 다이당 최대 128코어, LPDDR6, PCIe 7을 한 설계에 담고 이전 N3 대비 성능을 최대 2배로 높였다. GPU만 늘리는 AI 데이터센터에서 에이전트의 도구 호출과 데이터 이동을 맡는 CPU 효율이 새 경쟁축으로 올라왔다.
원문: Arm expands AI infrastructure for the agentic era with AGI CPU and Neoverse CSS N4 원문 보기 →
AI 데이터센터의 병목이 모델 추론용 가속기만의 문제가 아니게 됐다. 에이전트가 검색하고 데이터베이스를 읽고 도구를 호출할수록 CPU가 처리할 동시 작업과 데이터 이동이 늘어난다. Arm이 2026년 9월 8일 공개한 Neoverse CSS N4는 이 주변 연산을 겨냥해 다이당 최대 128코어와 LPDDR6 메모리, PCIe 7 연결을 묶었다.
전 세대 Neoverse CSS N3와 비교한 Arm의 수치는 성능 최대 2배, 와트당 성능 최대 1.25배, 메모리 대역폭 최대 1.75배다. GPU와 다른 가속기를 더 촘촘하게 조율해야 하는 시스템에서 코어 수만 늘린 것이 아니라 메모리와 입출력 경로를 함께 확장한 구성이다. 네트워크 처리나 DPU, 특정 서비스용 칩처럼 목적이 다른 고객이 같은 기반을 조정할 수 있도록 CSS N4를 Arm의 가장 구성 자유도가 높은 컴퓨팅 서브시스템으로 설계했다.
CSS는 반도체 기업이 자체 칩을 만드는 경로다. 검증된 CPU와 시스템 구성요소를 받아 기능을 더하면 처음부터 통합하는 데 드는 공학 작업과 출시 위험을 줄일 수 있다. 완성된 CPU가 필요한 사업자에는 별도 제품인 Arm AGI CPU가 대응한다. 두 선택지는 Neoverse 소프트웨어 기반을 공유하기 때문에 자체 실리콘과 범용 서버를 섞어도 개발 환경을 맞추기 쉽다는 것이 Arm의 설명이다. Arm Total Design 생태계는 초기 IP 검증과 소프트웨어 개발을 앞당겨 고객 칩이 생산 단계에 도달하는 시간을 줄이는 역할을 맡는다.
채택 명단은 이 설계가 노리는 범위를 보여준다. OpenAI, Meta, Cloudflare, Oracle, SAP, Lenovo, Supermicro, Verda가 AGI CPU 기반 솔루션을 개발하고 있다. Google Cloud는 Axion 기반 GKE에서 에이전트 샌드박스를 운영하고, Microsoft Azure는 Cobalt 200으로 샌드박스 도구 실행을 가속한다. NVIDIA의 Vera도 에이전트 작업용으로 설계됐다. ByteDance의 클라우드 부문 Volcano Engine은 Arm AGI CPU 기반 에이전트 샌드박스를 처음 시장에 내놓을 계획이다.
Arm은 IDC 자료를 인용해 랙 규모 가속 컴퓨팅 플랫폼에서 Arm 서버가 x86을 앞섰다고 주장한다. 이번 N4는 그 흐름을 CPU가 가속기의 보조 부품이 아니라 전력과 랙 밀도, 동시 실행 비용을 좌우하는 축으로 넓히려는 제품이다. 다만 최대 성능과 효율 수치는 Arm 기준이며 고객 실리콘과 실제 서비스에서의 결과는 아직 확인해야 한다. 앞으로는 CSS N4 기반 칩의 첫 양산 일정, LPDDR6와 PCIe 7 생태계의 준비 속도, 동일한 에이전트 작업에서 x86 서버 대비 총소유비용이 관건이다.
관련 기사
NVIDIA, Q2 매출 $962억 신기록 — 블랙웰 울트라가 이끄는 AI 인프라 폭발 성장
NVIDIA가 2027 회계연도 2분기 매출로 $962억을 기록하며 전년 대비 106% 성장했다. 데이터센터 부문이 $890억으로 전체 매출의 92%를 차지하며 블랙웰 울트라 인프라의 폭발적 수요를 확인시켰다.
Emerald AI, 전력망 유연 AI 데이터센터로 $1.5억 시리즈 A 유치
Emerald AI가 기업 가치 $10.5억에 $1.5억 시리즈 A 투자를 유치했다. AI 데이터센터를 전력망 유연 자산으로 전환하는 소프트웨어로 미국 기존 전력망에서 100GW 이상의 AI 인프라 용량 확보를 목표로 한다.
CoreWeave, Rubin GPU 72개·Vera CPU 36개 묶은 첫 NVL72 생산 랙 가동
CoreWeave가 72개 Rubin GPU와 36개 Vera CPU를 묶은 첫 양산형 NVL72 랙의 가동 준비에 들어갔다. 랙당 HBM4 20.7TB와 NVLink 대역폭 260TB/s를 제공해 Rubin이 사양표에서 실제 클라우드 인프라로 넘어가는 신호이며 상용 인스턴스 일정은 아직 공개되지 않았다.