Apple M6 및 M5 Ultra 공개: 2nm 공정 첫 도입, AI 성능 대폭 향상

Apple이 M6와 M5 Ultra 칩을 공개했다. M6는 Apple 최초의 2나노미터 공정 칩이며, M5 Ultra는 쿼드 다이 구성을 채택했다. 두 칩 모두 AI 연산 성능이 대폭 향상되었다.

💡 핵심 요약

  • Apple M6 칩 공개: Apple 최초 2나노미터 공정, 12코어 CPU, 12코어 GPU, 16코어 Neural Engine 2개 탑재, 최대 170GB/s 메모리 대역폭 제공.
  • Apple M5 Ultra 칩 공개: Apple 실리콘 최초 쿼드 다이 구성, 최대 36코어 CPU, 최대 80코어 GPU 탑재, 최대 1.2TB/s 메모리 대역폭 제공.
  • AI 성능 대폭 향상: M6는 Neural Engine 성능 최대 2배, M5 Ultra는 GPU AI 연산 성능 최대 4.5배 향상.
  • 개발자 지원 강화: Core AI, Core ML 등 프레임워크 통해 Mac에서 대규모 AI 모델 실행 및 온디바이스 AI 워크로드 구축 가능.

Apple은 새로운 Mac mini에 탑재될 M6 칩과 새로운 Mac Studio에 탑재될 M5 Ultra 칩을 발표했다. M6는 Apple 최초의 2나노미터 공정을 채택한 칩이며, M5 Ultra는 M 시리즈 시스템 온 칩(SoC) 최초로 쿼드 다이(Quad-Die) 구성을 채택했다.

M6는 CPU, GPU, Neural Engine 등 각 연산 블록을 강화하여 처리 성능을 향상시켰다. 12코어 CPU와 각 코어에 Neural Accelerator를 갖춘 12코어 GPU, 16코어 Neural Engine 2개를 탑재하며, 최대 170GB/s의 통합 메모리 대역폭을 제공한다. Apple은 M6의 CPU가 세계에서 가장 빠른 CPU 코어를 갖추고 있다고 밝혔다.

M5 Ultra는 차세대 UltraFusion 기술을 사용하여 M 시리즈 SoC 최초로 쿼드 다이 아키텍처를 채택했다. 최대 36코어 CPU와 최대 80코어 GPU를 탑재하며, M3 Ultra 대비 50% 빨라진 최대 1.2TB/s의 통합 메모리 대역폭을 제공한다.

Apple 실리콘 엔지니어링 그룹 부사장인 스리 산타남(Sri Santhanam)은 다음과 같이 언급했다.

M6: 최적화된 설계와 강화된 성능

M6는 일반 사용자, 학생, 개발자, AI 관련 용도, 기업 워크플로우 등을 염두에 두고 성능, 전력 효율, 온디바이스 AI 처리를 강화했다.

최첨단 2나노미터 공정 기술을 채택하여 더 작은 다이에 고밀도로 트랜지스터를 집적함으로써 성능과 전력 효율을 향상시켰다. 또한 16코어 Neural Engine 2개를 탑재하여 이전 세대 대비 최대 2배 높은 피크 연산 성능을 발휘한다. 시스템 프레임워크가 두 엔진을 동시에 활용하여 AI 모델 실행을 가속화한다.

260826_Apple-M6-M5-Ultra_01h0GEntJq
2나노미터 공정을 채택한 M6를 탑재하는 Mac mini는 Adobe Photoshop 등을 사용한 크리에이티브 작업에도 대응한다

M6는 M5보다 2코어 많은 12코어 CPU를 탑재하며, 2개의 슈퍼 코어, 4개의 고성능 코어, 6개의 고효율 코어로 구성된다. Apple에 따르면 세계 최상의 싱글 스레드 성능을 구현했으며, 멀티 스레드 성능은 M5 대비 최대 1.2배, M1 대비 최대 2.4배 빠르다.

슈퍼 코어는 싱글 스레드 처리를 담당하며, 고성능 코어는 슈퍼 코어와 협력하여 고부하 멀티 스레드 처리를 실행한다. 고효율 코어는 백그라운드 작업을 담당한다. 이미지 편집, 코드 컴파일, 파일 인덱싱, 에이전트형 AI 워크로드 등 고부하 CPU 처리의 속도를 높인다.

고속화된 GPU 및 메모리 대역폭

M6는 M5보다 2코어 많은 12코어 GPU를 탑재하며, 각 코어에 Neural Accelerator를 갖춘다. AI 처리에서의 GPU 피크 연산 성능은 M5 대비 약 30%, M1 대비 8배 이상 향상되었다. 이를 통해 온디바이스 LLM 활용 시 프롬프트 처리 등을 가속화한다.

260826_Apple-M6-M5-Ultra_02Lj7goXVt
M6는 12코어 GPU를 탑재하며, 지오메트리 레이트 향상 및 업데이트된 Dynamic Caching 등을 통해 게임에서의 그래픽 성능을 강화했다

더불어 셰이더 코어 아키텍처 업데이트, Dynamic Caching, 하드웨어 가속 레이 트레이싱 등의 그래픽 기능을 탑재했다. 렌더링 성능 및 프레임 레이트 향상을 목표로 한다. 복잡한 그래픽 처리에서의 지오메트리 레이트는 50% 향상되었다.

M6는 최대 32GB의 통합 메모리를 지원하며, 여러 고부하 앱을 동시에 사용하는 멀티태스킹이나 LLM을 온디바이스에서 실행하는 에이전트형 AI 워크플로우에도 대응한다. 통합 메모리 대역폭은 최대 170GB/s로, M5 대비 10%, M1 대비 2.5배 향상되었다.

260826_Apple-M6-M5-Ultra_03pCXEeegA
16코어 Neural Engine x2, Neural Accelerator를 갖춘 GPU, 최대 170GB/s의 통합 메모리 대역폭을 갖춘 M6

M5 Ultra: 프로용 워크로드 및 AI 처리 강화

M5 Ultra는 복잡한 3D 렌더링, 비주얼 이펙트, 과학적 분석, 고부하 AI 모델의 온디바이스 실행 등 높은 CPU/GPU 성능과 메모리 대역폭을 요구하는 프로용 워크로드를 위해 설계된 칩이다.

260826_Apple-M6-M5-Ultra_04TfYdehKC
M5 Ultra 탑재 Mac Studio는 높은 처리 성능과 메모리 대역폭을 활용하여 Adobe Premiere Pro에서 여러 고해상도 비디오 스트림 및 이펙트를 포함한 타임라인 편집에 대응한다

M5 Ultra는 듀얼 다이 구성의 M5 Max 두 개를 차세대 UltraFusion으로 연결하여 Apple 실리콘 최초의 쿼드 다이 구성을 구현했다. UltraFusion은 다이 간 대역폭을 4.4TB/s 이상으로 높이고 연결 밀도를 기존 대비 6배 이상 향상시켰다. 이 저지연 고속 상호 연결을 통해 4개의 다이를 하나의 통합된 프로세서처럼 작동시킨다.

M5 Ultra는 12개의 슈퍼 코어와 24개의 고성능 코어로 구성된 최대 36코어 CPU를 탑재했다. M3 Ultra 대비 싱글 스레드 성능은 최대 1.25배, 멀티 스레드 성능은 최대 1.3배 빨라졌다.

AI, 그래픽, 메모리 성능 강화

M5 Ultra는 최대 80코어의 차세대 GPU를 탑재하며, 각 코어에 Neural Accelerator를 내장했다. AI 처리에서의 GPU 피크 연산 성능은 M3 Ultra 대비 최대 4.5배, M1 Ultra 대비 6배 이상 향상되었다.

GPU에는 2세대 Dynamic Caching을 갖춘 셰이더 코어 외에 하드웨어 가속 메시 셰이딩, 3세대 레이 트레이싱을 탑재했다. 그래픽 성능은 M3 Ultra 대비 최대 40% 빨라졌다.

260826_Apple-M6-M5-Ultra_05pHNUKu08
Neural Accelerator를 갖춘 최대 80코어 GPU를 통해 M5 Ultra 탑재 Mac Studio에서는 Draw Things 등을 활용한 AI 이미지의 로컬 생성이 가능하다

M5 Ultra는 더욱 강력한 미디어 엔진도 탑재했다. H.264, HEVC, 4개의 ProRes 인코딩/디코딩 엔진, 하드웨어 가속 AV1 디코딩을 지원하여 고해상도 영상 편집 처리를 가속화한다. 또한 32코어 Neural Engine을 탑재하여 AI 처리 및 Apple Intelligence 기능을 온디바이스에서 실행할 수 있다.

260826_Apple-M6-M5-Ultra_06YxQIdf6E
최대 512GB 통합 메모리와 1.2TB/s의 메모리 대역폭을 갖춘 M5 Ultra 탑재 Mac Studio에서는 LM Studio Bionic의 로컬 AI 모델을 활용하여 MATLAB에서 복잡한 시뮬레이션을 실행할 수 있다

더불어 M5 Ultra는 최대 512GB의 통합 메모리와 M3 Ultra 대비 50% 빨라진 최대 1.2TB/s의 통합 메모리 대역폭을 제공한다. 대규모 데이터셋을 로컬 메모리에서 처리할 수 있으며, 토큰 처리 속도 향상 및 수천억 파라미터 규모의 LLM 온디바이스 실행에도 대응한다.

개발자용 프레임워크 및 도구

Core AI, Core ML, Metal, Xcode 등 Apple의 개발자용 프레임워크와 도구는 M6와 M5 Ultra의 하드웨어 기능을 활용할 수 있다. M6의 16코어 Neural Engine x2, M5 Ultra의 최대 512GB 통합 메모리, 최대 1.2TB/s의 메모리 대역폭, GPU에 내장된 Neural Accelerator 등을 AI 처리에 활용할 수 있다.

이러한 프레임워크와 새로운 칩을 통해 Mac에서 대규모 AI 모델의 실행 및 파인튜닝이 가능해진다. Apple의 개발자 도구와 프레임워크는 CPU, GPU, Neural Engine 전반에 걸쳐 처리를 최적화하며, Apple Foundation Models 및 App Intents를 활용한 Apple Intelligence 기능 통합, 자체 AI 모델을 사용한 온디바이스 AI 워크로드 구축 및 실행에 대응한다.



관련 글


원문: Apple、パフォーマンスとAI演算に大幅な向上をもたらすM6とM5 Ultraを発表。M6はApple初の2nmチップ