개요

AMD CDNA™ 아키텍처는 AMD Instinct™ GPU 및 APU의 기반이 되는 전용 컴퓨팅 아키텍처입니다. 이 제품은 AMD 칩렛 기술과 처리율이 높은 Infinity 아키텍처 패브릭인 HBM(고대역폭 메모리)을 통합하는 고급 패키징을 갖추고 있으며, 데이터 이동 오버헤드를 줄이고 전력 효율을 높이기 위해 설계된 포괄적인 AI 및 HPC 데이터 형식을 지원하는 고급 Matrix Core 기술을 제공합니다.

세대 간 비교표:

CDNA CDNA 2 CDNA 3 CDNA 4 CDNA 5
처리 기술 7nm FinFET 6nm FinFET 5nm + 6nm FinFET 3nm + 6nm FinFET 2nm + 3nm 핀펫
트랜지스터 256억 개 최대 580억 개 최대 1460억 개 최대 1850억 개 최대 3,200억 개
CU | Matrix Core 120 | 440 최대 220 | 880 최대 304 | 1216 256 | 1024 256(WGP)**
메모리 유형 32GB HBM2 최대 128GB HBM2E 최대 256GB HBM3 | HBM3E 288GB HBM3E 432GB HBM4
메모리 대역폭(최고치) 1.2TB/s 최대 3.2TB/초 최대 6TB/초 8TB/s 23.3TB/s
AMD Infinity Cache™ 해당 없음 해당 없음 256MB 256MB 해당 없음
GPU 일관성 해당 없음 캐시 캐시 및 HBM 캐시 및 HBM 캐시 및 HBM
데이터 형식 지원 INT4, INT8, BF16, FP16, FP32, FP64 INT4, INT8, BF16, FP16, FP32, FP64 Matrix: INT8, FP8, BF16, FP16, TF32, FP32, FP64
Vector: FP16, FP32, FP64
Sparsity: INT8, FP8, BF16, FP16
Matrix: MXFP4, MXFP6, INT8, MXFP8, OCP FP8, BF16, FP16, TF32*, FP32, FP64
Vector: FP16, FP32, FP64
Sparsity: OCP-FP8, INT8, FP16, BF16
OCP: MXFP4, MXFP6, MXFP8, FP8
Matrix: INT8, BF16, FP16, FP32, FP64
Vector: FP16, FP32, FP64
Sparsity: INT8, FP16, BF16
제품 AMD Instinct™ MI100 시리즈 AMD Instinct™ MI200 시리즈 AMD Instinct™ MI300 시리즈 AMD Instinct™ MI350 시리즈 AMD Instinct™ MI400 시리즈

*TF32는 소프트웨어 에뮬레이션에 의해 지원됩니다.
**AMD CDNA™ 5 아키텍처는 고급 WGP(Work Group Processors)를 사용합니다.

short top curved fade divider

AMD CDNA™ 5 아키텍처 소개

AMD CDNA™ 5는 AMD Instinct™ MI400 시리즈 GPU의 기반이 되는 전용 컴퓨팅 아키텍처입니다. 데이터 이동 오버헤드를 줄이고 전력 효율을 높이도록 설계된 칩렛 기술을 사용한 고급 패키징을 특징으로 합니다.

새로운 72 GPU AMD Helios™ 랙스케일 솔루션을 위해 특별히 설계된 AMD Instinct™ MI455X GPU는 AMD CDNA 5 아키텍처를 기반으로 출시된 최초의 제품으로, 프런티어 AI 배포에서 오늘날의 AI 확장을 위한 향상된 기능을 갖추었습니다. 소버린 AI 및 고성능 컴퓨팅을 위한 AMD Instinct MI430X GPU는 2027년 출시될 예정이며, 활성화되는 AMD CDNA 5 기능이 다를 수 있습니다.

AMD Instinct™ MI455X GPU

AMD Instinct™ MI455 Series GPU

첨단 패키징

AMD CDNA 5는 컴퓨팅, 메모리, 캐시, I/O 기능을 전용 다이 전반에 분할하여 성능과 전력 측면에서 각 기능을 개별적으로 최적화하는 고급 칩렛 아키텍처를 제공합니다.

3D 하이브리드 본딩 컴퓨팅 다이는 고밀도 다이 간 인터커넥트를 통해 적층되고 연결되어 컴퓨팅 밀도와 효율성을 향상합니다. AMD CDNA 5는 23.3TB/s 대역폭을 갖춘 12개 스택의 차세대 HBM4 메모리 432GB를 통합하고 CoWoS-L 고급 패키지에서 컴퓨팅, 메모리, I/O 다이 간의 고대역폭 저지연 온패키지 통신을 위해 AMD Infinity Fabric™ 인터커넥트를 사용하여 최신 AI 확장에 필요한 메모리 및 대역폭 규모를 구현합니다.

향상된 컴퓨팅

AMD CDNA 5는 AMD Instinct™ MI400 시리즈 GPU에 클록당 더 높은 처리율을 제공하는 새로운 WGP(Work Group Processor) 아키텍처를 제공합니다. 이 새로운 아키텍처는 Wave32 실행을 지원하여 동기화 오버헤드를 줄이고 SIMD 활용성을 개선하며, 새로운 tanh 명령어와 향상된 초월 함수 처리율을 갖춘 고급 AI 수학 엔진을 제공합니다.

블록 스케일 16/32 및 부분 스케일링을 지원하는 고급 저정밀도 AI 데이터 유형 MXFP8, MXFP6, MXFP4는 이전 세대 AMD Instinct GPU 대비 최대 4배의 처리율을 제공합니다.1

AMD Instinct™ MI455 Series GPU
AMD Instinct™ MI455 Series GPU

업그레이드된 메모리 시스템

AMD Instinct MI400 시리즈 GPU는 GPU당 23.3TB/s 대역폭을 갖춘 업계 최고 수준의 432GB HBM4를 제공하여 메모리 성능의 기준을 높이며, 점점 커지는 모델, 컨텍스트 윈도우, KV 캐시를 위한 개선된 캐시 및 메모리 계층을 제공합니다.

AMD Helios 랙스케일 솔루션의 AMD Instinct MI455X GPU는 72개의 GPU, 모든 GPU 간 통신, UALoE 패브릭 기반 싱글 홉을 갖춘 31TB HBM4 공유 포드 메모리 시스템을 제공하여 대규모 AI 모델 워크로드를 지원합니다.

통합형 패브릭 및 I/O

AMD Infinity 아키텍처는 AMD Infinity Fabric™ 기술과 함께 단일 디바이스 내에서 그리고 멀티 디바이스 플랫폼 전반에서 AMD GPU 칩렛 기술, 적층 HBM4 메모리, L2 캐시, I/O 다이 간의 일관된 고처리율 온패키지 통신을 지원합니다.

72 GPU AMD Helios 랙스케일 솔루션을 위해 설계된 각 AMD Instinct MI455X GPU EAM에는 PCIe® 6 호환 NIC 2개 또는 AMD AI-NIC 3개를 갖춘 2개의 향상된 I/O 다이가 포함됩니다. 각 GPU EAM에는 AMD Helios 랙스케일 솔루션에서 고대역폭 스케일 업을 위한 36개의 (양방향) UALoE 링크(x2)도 포함됩니다.

AMD Instinct™ MI455 Series GPU
Abstract background

향상된 효율성

AMD CDNA 5 아키텍처는 메모리 트래픽과 유휴 사이클을 줄여 실제 성능을 높임으로써 GPU 효율성도 향상합니다. 몇 가지 주요 혁신으로는 레지스터 스테이징 없이 전송되는 직접 비동기 글로벌-LDS 전송을 위한 TDM(Tensor Data Mover), 하나의 메모리 페치로 여러 WGP를 지원하여 중복 메모리 트래픽을 제거하는 L2 멀티캐스트 기능, 더 효율적인 동기화를 위한 분할 명명 배리어, Matrix 연산에서 여러 WGP의 협력을 위한 WGP 클러스터링 등이 있습니다.

short bottom curved fade divider

AMD CDNA™ 4

AMD CDNA™ 4는 AMD Instinct™ MI350 시리즈 GPU의 기반이 되는 전용 컴퓨팅 아키텍처입니다. 데이터 이동 오버헤드를 줄이고 전력 효율을 높이도록 설계된 칩렛 기술을 사용한 고급 패키징을 특징으로 합니다.

AMD Instinct MI350 Series

AMD Instinct MI350 시리즈 GPU

AMD CDNA 3

AMD CDNA 3는 AMD Instinct™ MI300 시리즈 GPU의 기반이 되는 전용 컴퓨팅 아키텍처입니다. 데이터 이동 오버헤드를 줄이고 전력 효율을 높이도록 설계된 칩렛 기술을 사용한 고급 패키징을 특징으로 합니다.

AMD Instinct MI300A APU

AMD Instinct MI325X GPU

대체 텍스트 추가

AMD CDNA 2

AMD CDNA 2 아키텍처는 가장 까다로운 과학 컴퓨팅 워크로드 및 머신러닝 애플리케이션도 가속화하도록 설계되었습니다. 이 아키텍처는 AMD Instinct MI200 시리즈 GPU의 기반이 됩니다.

AMD CDNA

AMD CDNA 아키텍처는 엑사스케일급 컴퓨팅 시대를 열도록 설계된 GPU 기반 컴퓨팅 전용 아키텍처입니다. 이 아키텍처는 AMD Instinct MI100 시리즈 GPU의 기반이 됩니다.

대체 텍스트 추가

AMD Instinct 가속기

AMD Instinct GPU가 어떻게 생성형 AI, 학습, HPC에 대한 새로운 표준을 수립하고 있는지 알아보세요.

AMD ROCm™ 소프트웨어

AMD CDNA 아키텍처는 AMD Instinct GPU를 대상으로 하는 AI 및 HPC 솔루션 개발을 위한 광범위한 프로그래밍 모델, 도구, 컴파일러, 라이브러리, 런타임 세트가 포함된 개방형 소프트웨어 스택인 AMD ROCm™ 소프트웨어에서 지원됩니다.

각주

*위에서 설명한 일부 기능은 모든 AMD Instinct™ MI400 시리즈 GPU에서 제공되지 않을 수 있습니다.

1. AMD Instinct™ MI455X GPU를 사용한 AMD 퍼포먼스 랩의 계산(2026년 6월)을 토대로 이론상 최대 정밀도 성능(FP32, FP16, BF16, MXFP6, MXFP8, FP8, MXFP4 Matrix/Vector)을 AMD Instinct™ MI355X, MI350X, MI325X, MI300X, MI250X, MI100 GPU의 공개된 사양과 비교했습니다. 결과는 시스템 구성 및 데이터 유형에 따라 달라질 수 있습니다. MI400-006