Arm C2-Ultra, 모바일 AI 성능 1.7배…전력 38% 낮춘 CSS for Mobile 2
스마트폰 CPU에서 AI 성능을 전 세대의 최대 1.7배로 높이면서 같은 성능의 전력은 최대 38% 줄인 Arm CSS for Mobile 2가 나왔다. 에이전트 실행과 신경망 그래픽을 CPU·GPU·시스템 IP 하나로 묶은 모바일 설계다.
원문: Arm introduces new AI-native compute platform built for agentic AI and mobile graphics 원문 보기 →
스마트폰 안에서 에이전트가 여러 앱과 모델을 오가려면 단일 AI 가속기의 최고 속도보다 전력, 메모리 이동, 작업 조율이 함께 맞아야 한다. Arm이 2026년 9월 8일 내놓은 CSS for Mobile 2는 이 병목을 플랫폼 단위로 다룬다. C2-Ultra와 C2-Pro CPU, 두 개의 SME2 유닛, 전용 신경망 가속기를 넣은 Mali G2-Ultra NX GPU, 시스템 IP와 개발 도구를 하나의 모바일 컴퓨팅 설계로 묶었다.
CPU 쪽 변화가 에이전트 작업의 기반이다. Arm 자체 측정에서 C2-Ultra는 이전 C1-Ultra보다 AI 성능이 최대 1.7배 높고 단일 스레드 성능은 15% 향상됐다. 같은 성능을 낼 때 소비 전력은 최대 38% 적다. C2 CPU 클러스터의 SME2 처리 능력을 두 배로 늘리면서 최신 소형 언어 모델 실행 속도는 70% 빨라졌다는 수치도 제시했다. 스마트폰에서 문맥을 유지하고 앱을 호출하며 여러 작업을 예약하는 흐름은 CPU가 중심에서 조정하기 때문에, 이 수치는 단순 추론 벤치마크보다 실제 온디바이스 에이전트의 반응성과 배터리 부담에 더 직접적으로 닿는다.
그래픽에는 Mali G2-Ultra NX가 들어간다. 셰이더 코어 내부에 신경망 가속기를 배치하고 새 실행 엔진과 3세대 레이 트레이싱 유닛을 결합했다. Arm Neural Technology를 적용한 신경망 그래픽은 와트당 성능이 최대 4배로 늘었고, 기존 게임 콘텐츠에서도 전 세대보다 최대 14% 높은 성능을 기록했다. 세부 묘사 복원이나 중간 프레임 생성처럼 AI가 렌더링 일부를 맡는 방식으로 모바일의 전력·발열 한계 안에서 더 복잡한 화면을 노린다.
소프트웨어가 곧바로 하드웨어에 닿도록 한 점도 중요하다. KleidiAI와 주요 AI 프레임워크 통합, Arm Neural Graphics Development Kit, 새 AI Portal이 같은 플랫폼을 받친다. 개발자는 검증된 모델과 정확도·성능 자료, 코드 예제, 배포 경로를 확인할 수 있다. Alipay, Google AI Edge Gallery, OPPO, vivo가 SME2 생태계에 참여하고 있으며, Unity China와 Unreal Engine도 개발 흐름에 Arm Neural Technology를 연결한다.
실제 게임 적용 일정도 잡혔다. NetEase의 Where Winds Meet는 NSS 적용 버전을 2026년 안에 선보일 계획이며, Tencent Games의 Arena Breakout Infinite는 NSSD 기술 시연에 쓰인다. 다만 ‘최대’ 성능 수치는 Arm이 제시한 특정 조건의 결과이므로 완제품의 속도와 배터리 지속 시간은 칩 설계와 냉각, 메모리 구성에 따라 달라진다. 다음 관전 지점은 스마트폰 제조사가 CSS for Mobile 2를 어떤 구성으로 채택하는지, 그리고 에이전트 작업이 네트워크 연결 없이 얼마나 오래 지속될 수 있는지다.
관련 기사
Arm Neoverse CSS N4, 128코어·PCIe 7 탑재…성능 2배로 AI 데이터센터 공략
Arm의 Neoverse CSS N4가 다이당 최대 128코어, LPDDR6, PCIe 7을 한 설계에 담고 이전 N3 대비 성능을 최대 2배로 높였다. GPU만 늘리는 AI 데이터센터에서 에이전트의 도구 호출과 데이터 이동을 맡는 CPU 효율이 새 경쟁축으로 올라왔다.
264KB diffusion model, FPGA를 붙이자 3배 느려진 이유
가속기가 계산을 빠르게 해도 data가 도착하지 않으면 전체는 느려진다. r/MachineLearning의 이 작은 실험은 264KB SRAM에서 32×32 이미지를 만들며 memory wall을 숫자로 드러냈다.
NVIDIA, Hugging Face 129억3030만달러 인수…오픈 모델 플랫폼 독립성 유지
NVIDIA가 Hugging Face를 129억3030만달러에 인수하기로 합의하며 1,800만 개발자와 300만개 모델이 모인 오픈 AI 생태계를 품는다. 양사는 NVIDIA 하드웨어를 강제하지 않고 멀티클라우드·멀티가속기 중립성을 유지하겠다고 약속했으며, 규제 심사가 다음 변수다.