요약:
Arm은 클라우드 컴퓨팅 및 인공지능 인프라 시장에서의 입지를 더욱 강화하기 위해 차세대 Neoverse CSS N4 'Ranger' 컴퓨팅 하위 시스템 플랫폼을 공식 출시했습니다. Arm의 세미 커스텀 칩 전략의 중요한 부분인 Neoverse CSS N4는 TSMC의 N3P 프로세스를 기반으로 구축되었습니다. 단일 칩은 최대 128개의 Neoverse N4 코어를 통합할 수 있어 Arm Neoverse 제품군에서 가장 유연하고 가장 큰 컴퓨팅 하위 시스템 중 하나입니다.

Neoverse CSS에서 CSS의 전체 이름은 Compute Subsystem이며, Arm이 대규모 클라우드 서비스 제공업체와 칩 설계 회사를 위해 출시한 반맞춤형 솔루션입니다. 고객은 Arm이 제공하는 기본 IP 프레임워크에서 코어 수, 캐시 용량, 메모리 시스템, I/O 인터페이스, 칩 상호 연결 구조를 자유롭게 구성할 수 있어 고객의 요구 사항에 맞는 맞춤형 프로세서를 빠르게 만들 수 있습니다. 지난 몇 년 동안 이 플랫폼은 마이크로소프트 애저(Microsoft Azure), 구글 클라우드(Google Cloud) 등 여러 기업에서 서버 프로세서 개발을 위해 사용해 왔으며, 엔비디아(Nvidia)와 인텔(Intel)의 데이터 처리 장치(DPU) 제품에도 널리 사용됐다.
Arm이 발표한 정보에 따르면 Neoverse CSS N4는 최대 3.8GHz의 주파수로 8코어부터 128코어까지 유연한 구성을 지원합니다. Arm은 다양한 코어 크기에서의 구체적인 주파수 성능을 공개하지는 않았지만 일반적으로 코어 수가 증가함에 따라 실제 작동 주파수는 그에 따라 감소할 수 있다고 믿어집니다.
시스템 확장 기능 측면에서 플랫폼은 단일 칩 128코어 구성을 지원할 뿐만 아니라 멀티 코어 및 멀티 슬롯 솔루션을 통해 규모를 더욱 확장할 수도 있습니다. 이 플랫폼은 UCIe 코어-칩 상호 연결 표준을 지원하며 파트너가 맞춤형 상호 연결 기술을 사용하여 미래 초대형 데이터 센터 및 인공 지능 인프라의 요구 사항을 충족하는 대규모 컴퓨팅 시스템을 구축할 수 있도록 합니다.

캐시 및 메모리 하위 시스템도 이전 세대에 비해 크게 향상되었습니다. 단일 Neoverse CSS N4 칩은 최대 256MB의 레벨 3 캐시를 지원하며 각 코어에는 최대 2MB의 레벨 2 캐시를 장착할 수 있습니다. 또한 64KB 레벨 1 명령어 캐시와 64KB 레벨 1 데이터 캐시가 내장되어 있습니다. 메모리 측면에서는 DDR5를 지원할 뿐만 아니라 다양한 애플리케이션 시나리오의 전력 소비 및 대역폭 요구 사항을 충족하기 위해 처음으로 LPDDR6 지원도 도입했습니다.
I/O 기능도 크게 향상되었습니다. 새로운 플랫폼은 최대 128개의 PCIe 7.0 또는 PCIe 6.0 레인을 지원하고 CXL 4.0 표준과 호환되어 고성능 스토리지 장치, AI 가속기 및 고속 네트워크 인터페이스를 위한 더 큰 확장 공간을 제공합니다.
이전 세대 Neoverse CSS N2에 비해 새 플랫폼은 거의 완전히 업그레이드되었습니다. 이전 세대 제품은 최대 64개의 코어, 코어당 1MB L2 캐시, 64MB L3 캐시를 지원하며 64개의 PCIe 5.0 및 CXL 레인만 지원합니다. 이에 비해 Neoverse CSS N4는 코어 수, 캐시 크기, I/O 대역폭 및 메모리 지원 측면에서 상당한 개선을 이루었습니다.
Arm은 128개 코어, 3GHz 작동 주파수 및 코어당 2MB L2 캐시 구성에서 Neoverse CSS N4의 단일 소켓 성능이 Neoverse N3 플랫폼의 두 배에 달할 수 있으며, 와트당 성능은 약 25%, 메모리 대역폭은 약 75% 증가했다고 밝혔습니다. 이러한 개선 사항은 주로 인공 지능 시대의 데이터 센터 요구 사항, 특히 대규모 추론, KV 캐시 관리, 네트워크 처리 및 가속기 오케스트레이션과 같은 시나리오에서 더 높은 컴퓨팅 밀도와 처리량 기능을 제공할 수 있는 것을 목표로 합니다.
암은 네오버스 N 시리즈의 핵심 포지셔닝도 V 시리즈와 다르다고 강조했다. N 시리즈는 주로 에너지 효율성과 고밀도 배치를 목표로 하고, V 시리즈는 최고의 성능을 추구합니다. 현재 NVIDIA의 이전 세대 Grace 프로세서는 Neoverse V2 코어를 사용하고 있으며, AWS의 Graviton 시리즈와 Google Cloud의 Axion 프로젝트도 Neoverse 아키텍처를 많이 사용하고 있습니다. 이와 대조적으로 N 시리즈는 제어 평면 작업, 네트워크 처리 및 전력에 민감한 컴퓨팅 시나리오에 더 많이 사용됩니다.

Arm은 Neoverse CSS N4 출시와 함께 AGI CPU 프로젝트의 최신 진행 상황도 발표했습니다. 이 제품은 Neoverse V3 아키텍처를 기반으로 구축되었으며 Oracle, ByteDance, Meta, OpenAI, Cloudflare 및 SAP를 포함한 기업으로부터 배포 지원을 받았습니다. Arm은 AGI CPU와 Neoverse CSS N4를 통해 이중 경로 레이아웃을 형성할 예정이다. 한편으로는 고객에게 고도로 맞춤화된 칩 개발 플랫폼을 제공하고, 다른 한편으로는 인공지능 시대를 위한 레퍼런스급 서버 프로세서 솔루션을 출시할 예정이다.
생성 AI 및 에이전트 애플리케이션이 계속해서 데이터 센터 업그레이드를 추진함에 따라 점점 더 많은 클라우드 서비스 제공업체가 특정 워크로드에 최적화된 맞춤형 칩을 찾고 있습니다. Arm의 Neoverse CSS N4 출시는 데이터센터 시장 점유율을 더욱 확대하는 중요한 단계로 간주됩니다. 최대 128코어 규모, LPDDR6 지원, PCIe 7.0 연결 및 고급 3나노미터 제조 프로세스를 갖춘 이 플랫폼은 향후 몇 년 내에 AI 인프라 및 클라우드 컴퓨팅 프로세서를 위한 중요한 인프라 중 하나가 될 것으로 예상됩니다.
댓글