AMD Instinct™ MI400 시리즈 GPU

탁월한 프런티어 AI, 소버린 AI, 고성능 컴퓨팅

AMD Instinct™ MI400 시리즈 GPU는 개방형 AMD ROCm™ 소프트웨어 기반 파운데이션을 제공하여 하이퍼스케일 배포부터 고성능 컴퓨팅, 소버린, 연구 환경까지 확장됩니다. 개방형 표준과 함께 리소스 할당을 위한 가상화 및 파티셔닝을 기반으로 구축된 AMD Instinct MI400 시리즈 GPU는 대규모 환경에서 모델, 도구, 운영을 일관되게 유지합니다.

이 포트폴리오는 프런티어 AI를 위해 72개의 72 AMD Instinct MI455X GPU로 구동되는 AMD Helios™ 랙스케일 솔루션부터 소버린 AI 및 고성능 컴퓨팅을 위한 AMD Instinct MI430X GPU까지 아우르며, 고객이 일관성, 유연성, 확장성을 희생하지 않고 필요에 맞는 적합한 플랫폼을 선택할 수 있도록 지원합니다.

short top curved fade divider
AMD Instinct™ MI430X, MI440X, MI455X die

후드 밑

AMD Instinct GPU는 AMD CDNA™ 아키텍처를 기반으로 구축되며, 이 아키텍처는 AMD Instinct GPU에 고급 칩렛, HBM 메모리 및 캐시, AMD Infinity Fabric™ 기술을 제공합니다. AMD CDNA 아키텍처는 매트릭스 및 벡터 코어 기술을 제공하여 매우 효율적인 OCP MXFP 8/6/4(AI를 위한 INT8 및 FP16/BF16 희소성 지원 포함)부터 고성능 컴퓨팅을 위한 가장 까다로운 FP64에 이르기까지 광범위한 데이터 유형 역량을 지원합니다.

short bottom curved fade divider

혜택

랙 디자인

확장을 위한 완전 통합형 AI 인프라 솔루션

AMD Helios 랙스케일 솔루션 디자인은 최신 AMD Instinct™ GPU, AMD EPYC™ 서버 CPU, AMD Pensando™ 네트워킹을 결합한 완전 통합형 AI 인프라이며, 대규모 추론, 프런티어 모델 학습 및 미세 조정을 지원하는 개방형 산업 표준을 사용하여 설계되었습니다.

업계 최고 성능

탁월한 GPU 및 랙 성능

AMD Helios 랙스케일 솔루션은 막대한 규모의 하이퍼스케일 추론, 학습, 미세 조정을 위해 설계된 엑사플롭급 성능으로 엄청난 랙 수준 AI 팩토리 출력을 제공합니다. 랙스케일에서 AMD Helios는 최대 2.9엑사플롭스의 최대 OCP MXFP4, 1.4엑사플롭스의 최대 OCP MXFP8, 31TB HBM4 메모리, 1.67PB/s 메모리 대역폭을 제공합니다.

GPU 발전

첨단 GPU 패키징으로 차세대 AI 확장 실현

AMD Instinct™ MI455X GPU는 차세대 AI 확장을 실현하는 핵심 혁신을 제공합니다. 칩렛 아키텍처는 성능, 전력, 제조 개선을 위해 컴퓨팅, 메모리, 캐시, I/O 기능을 개별적으로 최적화합니다. AMD Instinct MI455X GPU의 적층된 3D 하이브리드 본딩 컴퓨팅 다이는 고밀도 인터커넥트를 사용하여 더 높은 컴퓨팅 밀도와 향상된 성능을 제공합니다.

23.3TB/s 대역폭을 갖춘 통합 432GB(12개 스택) 차세대 HBM4 메모리는 더 큰 모델, KV 캐시, 활성화 값이 로컬 메모리에 상주할 수 있도록 지원합니다.

이 모든 요소는 첨단 CoWoS-L 패키지에서 저지연 통신을 위한 고대역폭 AMD Infinity Fabric™ 인터커넥트로 연결되어 차세대 AI 확장을 실현합니다.

소프트웨어 및 에코시스템

개방형 소프트웨어의 자유, 확장을 위한 설계

AMD ROCm™ 소프트웨어는 AMD Instinct MI455X 플랫폼과 함께 AMD Helios 랙스케일 솔루션을 구현하며, 커널 수준의 GPU 혁신을 추론, 학습, 미세 조정을 위한 안정적인 프로덕션 결과로 전환합니다. ROCm 소프트웨어는 통신 프리미티브(RCCL), KV 캐시 최적화, 엑사플롭급 규모에 맞춰 조정된 컴퓨팅/통신 오버랩을 통해 예측 가능한 분산 실행을 지원합니다.

엑사스케일에서 검증되고 운영 지원이 준비된 AMD ROCm 소프트웨어는 고객이 더 빠르게 배포하고, 랙에서 엑사스케일급 시스템까지 안정적으로 확장하며, AMD Instinct MI455X 및 MI430X GPU와 플랫폼 배포를 아우르는 AMD Helios 랙스케일 솔루션 전반에서 이식성을 유지하도록 지원합니다.

short top curved fade divider
AMD Helios Rackscale

가장 강력한 랙스케일 AI 인프라1

하이퍼스케일 AI를 위한 탁월한 랙 성능

AMD Helios 랙스케일 솔루션 디자인은 최신 AMD Instinct™ GPU, AMD EPYC™ 서버 CPU, AMD Pensando™ 네트워킹을 결합한 완전 통합형 AI 인프라이며, 대규모 추론, 프런티어 모델 학습 및 미세 조정을 지원하는 개방형 산업 표준을 사용하여 설계되었습니다.

프런티어 AI를 위한 탁월한 성능

최대
2.9 엑사플롭스
2.9엑사플롭스 OCP MXFP4 AI 컴퓨팅
최대
260 TB/s
GPU당 스케일 업 대역폭
최대
31 TB
최대 1.7PB/s의 이론상 최대 메모리 대역폭을 갖춘 31TB HBM4 메모리
short bottom curved fade divider
short top curved fade divider

AMD Instinct™ MI400 시리즈 GPU 만나보기

AMD Instinct™ MI455X GPU

5세대 AMD CDNA™ 아키텍처를 기반으로 구축된 AMD Instinct™ MI455X GPU는 AMD Helios 랙스케일 솔루션을 위해 특별히 설계되어 프런티어 AI를 위한 탁월한 AI 성능을 제공하며 추론, 학습, 미세 조정을 위한 최신 AI 역량을 지원합니다.

AMD Instinct™ MI455X die
최대
256 WGP
Wave32 실행을 지원하는 256개의 WGP(Work Group Processors)
최대
3.6 TB/s
GPU당 스케일 업 대역폭
최대
432 GB
최대 23.3TB/s의 이론상 최대 메모리 대역폭을 갖춘 432GB 통합 HBM4 메모리

AMD Instinct MI455X GPU 사양 비교

경쟁사 GPU 대비 최대 26% 향상된 AI 성능2

AI 성능

(최대 PFLOPS)

FP4
40
35
FP4/OCP MXFP4
FP4 Tensor
FP8 | FP6
20
18
MI455X 432GB
FP8/FP6 Tensor
FP16 | BF16
5
4
FP16/BF16 Matrix
FP16/BF16 Matrix

AMD Instinct MI455X

NVIDIA Vera Rubin

메모리

메모리 용량
432GB
288GB
MI455X 432GB
Vera Rubin 288GB
메모리 대역폭
23.3TB/s
22.0 TB/s
MI455X 432GB
Vera Rubin 288GB

AMD Instinct MI455X

NVIDIA Vera Rubin

short bottom curved fade divider

AMD Instinct™ MI430X GPU

과학 및 고성능 컴퓨팅을 위한 AI 강화

AMD Instinct™ MI430X GPU는 과학 고성능 컴퓨팅 및 소버린 AI를 위해 설계되어 시뮬레이션 및 모델링을 위한 FP64 정확도와 추론, 학습, 미세 조정을 위한 최신 AI 역량을 결합합니다.

AMD Instinct™ MI430X GPU
short top curved fade divider

개방형 소프트웨어 에코시스템을 기반으로 구축

AMD ROCm™ 소프트웨어

AMD ROCm™ 소프트웨어에는 AMD Instinct GPU를 대상으로 하는 AI 모델 및 HPC 워크로드를 위한 광범위한 프로그래밍 모델, 도구, 컴파일러, 라이브러리, 런타임 세트가 포함되어 있습니다.

AMD Enterprise AI Suite

AMD Enterprise AI Reference Stack

주요 오픈 소스 AI 프레임워크와 생성형 AI 모델을 엔터프라이즈급 Kubernetes 플랫폼과 연결하면 기업은 베어 메탈 컴퓨팅에서 프로덕션 등급 AI로 단 몇 분 만에 전환하여 AMD 컴퓨팅 플랫폼에서 AI 실험부터 대규모 프로덕션까지 이르는 시간을 최소화할 수 있습니다.

short bottom curved fade divider

사례 연구

AMD Instinct 배포 옵션

자주 묻는 질문

AMD Helios 랙스케일 솔루션

AMD Helios 랙스케일 솔루션은 AMD 최초의 랙스케일 AI 레퍼런스 디자인으로, 전적으로 OCP(Open Compute Project)에 제출된 Meta의 새로운 ORW(Open Rack Wide) 표준을 기반으로 구축되었습니다. 오늘날의 AI 규모 데이터센터를 위해 설계된 개방형 더블 와이드 ORW 랙에 72개의 AMD Instinct MI455X GPU, AMD EPYC™ CPU, AMD Pensando™ DPU를 비롯한 주요 구성 요소를 결합합니다.

OCP Global Summit에서 Meta는 ORW 폼 팩터를 갖춘 새로운 AI용 Open Rack을 선보였습니다. AMD는 AMD Helios 랙스케일 솔루션을 통해 이 개방형 디자인에 발맞추어 ORW 표준을 기반으로 구축된 최초의 완전한 랙을 선보입니다. 이는 실리콘에서 시스템, 랙, 대규모 클러스터에 이르기까지 개방성에 대한 AMD의 노력을 보여줍니다.

이전 OCP 랙은 싱글 와이드 방식으로 범용 서버에 중점을 두었습니다. ORW는 고밀도 AI 시스템에 최적화된 더블 와이드 랙을 도입하여 대형 가속기 노드를 수용할 수 있도록 더 높은 전력, 수냉식 냉각, 더 넓은 트레이를 제공합니다. AMD Helios 랙스케일 솔루션은 ORW를 활용하여 GPU, CPU, DPU 등 여러 구성 요소를 통합되고 서비스가 용이하며 손쉽게 배포할 수 있는 AI 시스템으로 결합합니다.

완전한 AMD Helios 랙스케일 솔루션은 최대 1.4엑사플롭스의 FP8 컴퓨팅, 2.9엑사플롭스의 FP4 컴퓨팅, 31TB의 HBM4 메모리를 제공하여 조 단위 파라미터 AI 학습과 대규모 AI 추론을 지원합니다.

각 AMD Instinct MI455X GPU는 차세대 AMD CDNA™ 아키텍처를 사용하며, 432GB HBM4 메모리와 최대 23.3TB/s 대역폭을 제공하여 프런티어급 AI 모델의 추론과 학습에 이상적입니다. 각 GPU는 최대 40PFLOPS FP4를 제공하며, AMD Helios 랙스케일 솔루션당 2.9EF FP4를 제공합니다.

AMD Helios 랙스케일 솔루션은 실제 운영 환경을 위해 구축된 최초의 더블 와이드 ORW 랙 솔루션으로, 모듈식 트레이와 뛰어난 서비스 편의성을 전력이 제한된 데이터 센터에서의 지속적인 성능과 결합합니다. 독점적인 일회성 디자인을 OCP, UALink, UEC 등 개방형 표준으로 대체함으로써 파편화를 줄여 대규모의 효율적인 고성능 AI 클러스터를 구현합니다.

이는 판매용 제품이 아니라 레퍼런스 디자인입니다. AMD Helios 랙스케일 솔루션은 OEM(Original Equipment Manufacturer) 및 ODM 파트너가 개방형 ORW 표준을 기반으로 자체 브랜드 시스템을 구축할 수 있는 청사진입니다.

이 플랫폼은 PyTorch, TensorFlow, JAX, ONNX Runtime, vLLM, Triton을 Day 0에 지원하는 오픈 소스 AI 및 고성능 컴퓨팅 소프트웨어 스택인 AMD ROCm™으로 구동됩니다. 단일 GPU에서 멀티 랙 슈퍼클러스터까지 확장되며, 벤더 종속을 방지합니다.

AMD Helios 랙스케일 솔루션 레퍼런스 디자인은 현재 파트너와 공유되고 있으며, 대량 배포는 2026년 하반기로 예상됩니다.

AMD Instinct MI455X GPU

AMD Instinct™ MI455X GPU는 AMD Helios 랙스케일 솔루션을 구동하며, 반복 가능한 4-GPU 트레이를 통해 72-GPU AMD Helios로 통합되는 탁월한 디바이스 단위 역량을 제공하여 예측 가능하고 서비스가 용이한 엑사플롭급 결과를 실현합니다.

AMD Instinct™ MI455X GPU는 다음을 제공합니다.

  • 최대 40PFLOPs 4비트 성능
  • 최대 20PFLOPs 8비트 성능
  • 432GB HBM4
  • 23.3TB/s 메모리 대역폭

이러한 역량은 반복 가능한 4-GPU 트레이를 통해 72-GPU AMD Helios 랙스케일 솔루션으로 통합됩니다.

모델의 크기와 복잡성이 계속 증가함에 따라 메모리는 AI 인프라에서 가장 중요한 고려 사항 중 하나가 되었습니다. 각 AMD Instinct MI455X GPU는 432GB HBM4 메모리를 제공하며, 완전한 Helios 랙은 31TB HBM4 메모리를 제공합니다. 이는 높은 메모리 대역폭과 결합되어 고객이 더 큰 모델을 지원하고, 인프라 복잡성을 줄이며, 메모리 집약적 추론 및 학습 워크로드를 효율적으로 확장할 수 있도록 지원합니다.

AMD Instinct MI430X GPU

AMD Instinct™ MI430X GPU는 소버린 AI, 과학 컴퓨팅, 고성능 컴퓨팅(HPC)을 위해 특별히 설계된 새로운 GPU입니다. AMD Instinct MI430X GPU는 업계 최고 수준의 HBM4 메모리, 고성능 FP64 컴퓨팅, 개방형 AMD ROCm™ 소프트웨어 플랫폼을 결합하여 융합된 AI 및 고성능 컴퓨팅 워크로드를 지원하도록 설계되었습니다. AMD Instinct MI430X는 288 TFLOPS의 최대 하드웨어 기반 FP64 성능을 제공하여 정부, 연구 기관, 국립 연구소가 세계에서 가장 까다로운 시뮬레이션과 AI 애플리케이션을 처리하는 것을 지원하도록 구축되었습니다.

과학 컴퓨팅과 소버린 AI는 기존 고성능 컴퓨팅과 최신 AI를 모두 지원할 수 있는 인프라를 점점 더 필요로 하고 있습니다. 조직은 AMD Instinct MI430X를 통해 효율성을 높이고 인프라를 간소화하며 국가 규모 배포에 필요한 개방성과 유연성을 유지하면서 이러한 워크로드를 단일 플랫폼으로 통합할 수 있습니다.

AMD Instinct MI430X는 AI 기가팩토리 및 고성능 컴퓨팅 센터를 위해 가장 까다로운 워크로드에 필요한 수치 정확도와 처리율을 제공하도록 설계되었습니다. 차세대 AI 모델이 고정밀 시뮬레이션에서 생성된 학습 데이터에 점점 더 의존함에 따라 AMD Instinct MI430X는 연구자와 기관이 정확한 과학 데이터를 기반으로 AI 시스템을 구축하도록 지원하여 기후 과학, 소재 연구, 원자력 공학, 유체 역학 등 여러 분야에서 AI 기반 발견에 대한 신뢰를 높입니다.

AMD Instinct™ MI430X GPU는 융합된 고성능 컴퓨팅 및 AI 워크플로 전반에서 타협 없는 정확도와 처리율을 제공하며, 과학 컴퓨팅을 위한 288 TFLOPS 하드웨어 기반 FP64와 함께 최신 AI 데이터 유형 및 소프트웨어 역량을 지원합니다. AMD Instinct MI430X는 업계 최고 수준의 432GB HBM4와 2.3TB/s 메모리 대역폭을 갖춤으로써 대규모 시뮬레이션과 메모리 집약적 모델을 위해 구축되었으며, 방대한 데이터 세트를 확장할 때 서버 수를 줄이고 인프라 복잡성을 낮추며 효율성을 개선합니다.

네, 차기 미국 US DOE/ORNL Discovery 시스템과 유럽의 두 시스템인 Alice Recoque 및 Herder 시스템이 AMD Instinct MI430X GPU로 구축될 예정입니다.

AMD ROCm™ 소프트웨어로 구동되는 AMD Instinct MI430X는 고성능 컴퓨팅과 AI 모두를 위한 프로그래밍 모델, 컴파일러, 라이브러리, 런타임, 배포 도구를 갖춘 개방형 파운데이션을 제공합니다. 이러한 개방형 표준에 대한 노력은 소프트웨어, 시스템, 네트워킹 선택 전반에서 상호 운용성과 장기적인 이식성을 지원하여 소버린 운영 주체가 종속 없이 혁신할 수 있도록 돕습니다.

AMD Instinct MI430X는 Nvidia Vera Rubin 대비 하드웨어 기반 FP64 최대 FLOP 성능이 8.7배 더 뛰어날 것으로 추정됩니다.

각주: AMD Instinct MI400-001A - 2026년 7월 AMD 퍼포먼스 랩의 엔지니어링 예측을 토대로, FP64(Vector) 데이터 유형을 사용하는 AMD Instinct™ MI430X GPU의 이론상 최대 정밀도를 MD Instinct MI300X GPU 및. Nvidia Rubin GPU와 비교하여 추정했습니다. 제품이 시장에 출시되면 결과가 변경될 수 있습니다.

AMD Instinct MI430X GPU는 2027년 출시될 예정입니다. 자세한 내용은 추후 제공될 예정입니다.

리소스

블로그

AMD Instinct 가속기에 대한 최신 블로그를 읽어보세요.

새로운 정보를 놓치지 마세요

최신 데이터 센터 소식과 서버 관련 콘텐츠를 받으려면 등록하세요.

각주
  1. 2026년 6월 AMD 퍼포먼스 랩의 계산을 토대로, 최대 Matrix FP16, BF16, INT8 데이터 유형 및 최대 Open Compute Project MXFP6, MXFP8, FP8, MXFP4 데이터 유형을 사용하는 AMD Helios 랙스케일 솔루션을 NVFP4 Dense 데이터 유형 및 FP8/FP6 데이터 유형을 사용하는 NVIDIA Vera Rubin NVL72와 비교해 AMD Helios 랙스케일 솔루션의 이론상 최대 정밀도 성능을 확인했습니다. 시스템 제조업체별 구성에 따라 다른 결과가 나올 수 있습니다. MI400-005
  2. 2026년 6월 AMD 퍼포먼스 랩의 계산을 토대로, 최대 Matrix FP16, BF16, INT8 데이터 유형 및 최대 Open Compute Project MXFP6, MXFP8, FP8, MXFP4 데이터 유형을 사용하는 AMD Instinct™ MI455X GPU를 NVFP4 Dense 데이터 유형을 사용하는 NVIDIA Vera Rubin GPU의 공개된 예비 사양과 비교해 AMD Instinct™ MI455X GPU의 이론상 최대 정밀도 성능을 확인했습니다. 시스템 제조업체별 구성에 따라 다른 결과가 나올 수 있습니다. MI400-003
  3. 2026년 6월 AMD 퍼포먼스 랩의 계산으로, AMD Instinct™ MI455X 및 MI430X GPU의 공개된 메모리 용량과 메모리 대역폭을 NVIDIA Vera Rubin GPU의 공개된 메모리 용량 및 메모리 대역폭 사양과 비교한 결과입니다. 시스템 제조업체별 구성에 따라 다른 결과가 나올 수 있습니다. MI400-004
  4. AMD Instinct™ MI455X GPU를 사용한 AMD 퍼포먼스 랩의 계산(2026년 6월)을 토대로 이론상 최대 정밀도 성능(FP32, FP16, BF16, MXFP6, MXFP8, FP8, MXFP4 Matrix/Vector)을 AMD Instinct™ MI355X, MI350X, MI325X, MI300X, MI250X, MI100 GPU의 공개된 사양과 비교했습니다. 결과는 시스템 구성 및 데이터 유형에 따라 달라질 수 있습니다. MI400-006