개요

최적화된 GPU 소프트웨어 스택

AMD ROCm™은 데이터 센터 팀이 여러 GPU와 노드에서 AI 및 HPC 워크로드를 빠르게 구성하고 배포하고 확장할 수 있도록 지원하는 개방형 소프트웨어 플랫폼입니다. 개발자는 익숙한 프레임워크로 작업하고, 성능에 직결되는 코드를 튜닝하고, HIP를 사용해 기존 GPU 애플리케이션과 프레임워크를 지원되는 AMD 하드웨어에 맞게 조정할 수 있습니다.

이미지 확대
ROCm AI stack diagram showing Silo AI, Primus, ROCm Inference, open ecosystem tools, Core SDK, expansions, and deployment.

← 동영상 시청하기

ROCm.AI: 개발 속도와 성능 최적화 가속

ROCm 개발을 가속하고, AI 워크로드의 개발과 최적화를 간소화하며, AMD 하드웨어의 성능을 극대화하는 AI 네이티브 개발자 경험

개발

AMD ROCm 소프트웨어와 함께하는 대규모 AI 구축, 학습, 배포

AMD ROCm™ 소프트웨어는 개방형 프레임워크, 최적화된 라이브러리, 모델 도구, 스케일 아웃 인프라를 한데 모아 실험 단계부터 프로덕션까지 AI 개발을 지원합니다.

구축

간소화된 모델 개발

Hugging Face의 300만 개가 넘는 모델을 비롯해 널리 쓰이는 개방형 모델에 맞춘 AMD 최적화 컨테이너와 워크플로로 PyTorch, TensorFlow, JAX에서 개발하세요.

학습

AMD Primus - 대규모 AI 모델 학습

AMD Primus와 ROCm 통신 라이브러리를 사용해 여러 AMD Instinct™ GPU에서 사전 학습, 미세 조정, 분산 학습을 진행하세요.

최적화

AI 모델을 최적화하고 서비스로 제공

AMD Quark, AITER, vLLM, SGLang으로 모델을 최적화하고 핵심 연산을 가속하며 처리율 높은 추론을 배포하세요.

배포

AI 인프라 전반에 배포

컨테이너, Kubernetes, Slurm, 텔레메트리, 수명 주기 관리 도구를 활용해 개별 GPU에서 다중 노드 환경까지 확장하세요.

AMD ROCm과 함께하는 고성능 컴퓨팅 구축, 최적화, 확장, 실행

AMD ROCm™ 소프트웨어는 HPC 개발자가 과학 애플리케이션을 구축하거나 이식하고, 성능을 프로파일링하고 튜닝하며, 단일 GPU에서 다중 노드 실행으로 넘어가도록 지원합니다.

구축

과학 애플리케이션 구축과 이식

HIP 또는 OpenMP® 오프로드로 GPU 가속 코드를 개발하고, Kokkos 및 RAJA 같은 HPC 프레임워크를 활용하며, HIPIFY로 기존 CUDA® 코드 변환을 지원받으세요.

최적화

성능 프로파일링과 튜닝

ROCm 도구로 커널과 데이터 이동을 프로파일링한 다음, 선형대수, FFT, 솔버, 희소 연산에 최적화된 라이브러리를 사용하세요. 튜닝하면서 결과를 검증하세요.

확장 시작.

여러 GPU와 노드로 확장

분산 애플리케이션에는 GPU 인식 MPI를, GPU가 시작하는 통신에는 rocSHMEM을 사용한 다음 GPU와 노드 수를 늘려 가며 성능을 측정하세요.

실행

HPC 인프라에서 실행

애플리케이션을 HPC 컨테이너로 패키징하고 Slurm으로 클러스터 작업을 제출하세요. ROCm은 El Capitan, Frontier, LUMI를 비롯한 최상위 슈퍼컴퓨터 시스템에서 사용되고 있습니다.

새로워진 사항

ROCm 10.0: 에이전틱 AI 시대를 위한 설계

Icon
AMD의 전문성으로 구축

AMD Skills는 엄선된 AMD 지식과 검증된 워크플로를 AI 코딩 에이전트에 제공해 개발자가 이미 사용 중인 도구 안에서 안내를 받으며 AMD에 최적화된 애플리케이션을 구축할 수 있도록 지원합니다.

Icon
더 간단한 워크플로로 실행

ROCm CLI는 AMD 하드웨어에서 AI 워크로드를 구성하고 관리하고 운영할 수 있는 통합 인터페이스를 제공합니다.

Icon
과정에 걸친 추론 최적화

ROCm Hyperloom은 에이전틱 AI를 활용해 워크로드를 프로파일링하고, 병목을 찾아내고, 최적화를 적용하며, 호스트 코드와 GPU 커널 전반의 성능을 검증합니다.

Icon
모듈형 ROCm 코어 SDK를 기반으로 구축

ROCm 코어 SDK는 AMD 플랫폼 전반에서 AI 워크로드를 구축하고 배포하고 최적화할 수 있는 모듈형 기반을 제공합니다.

생태계와 파트너

선도적인 프레임워크와 기술 파트너, 개발자가 함께 만들어 가는 폭넓은 개방형 AI 생태계로, 혁신을 가속하고 이식성을 확보하며 개발에서 프로덕션까지 AI를 확장합니다.

지원 하드웨어

개발자 리소스

ROCm Developer screen shot

자주 묻는 질문

AMD ROCm™은 지원되는 AMD GPU에서 AI 및 고성능 컴퓨팅 애플리케이션을 개발하기 위한 개방형 소프트웨어 스택입니다. 팀은 ROCm을 활용해 AI 모델을 학습시키고 서비스로 제공하며, GPU 가속 소프트웨어를 구축하고, 여러 GPU와 노드에서 과학 워크로드를 실행합니다.

ROCm과 CUDA는 서로 별개의 GPU 컴퓨팅 플랫폼입니다. ROCm은 지원되는 AMD GPU를 위한 개방형 소프트웨어 스택을 제공하며, HIP 프로그래밍 모델은 CUDA 소스 코드를 이식할 수 있는 경로를 제공합니다. 도구와 API를 그대로 맞바꿔 쓸 수는 없으므로 마이그레이션에 드는 노력은 애플리케이션과 그 종속성에 따라 달라집니다.

항상 그렇지는 않습니다. 지원되는 AI 프레임워크로 만든 애플리케이션은 해당 프레임워크의 ROCm 지원 버전으로 바로 시작할 수 있는 경우가 있습니다. CUDA API를 호출하거나 CUDA 전용 라이브러리에 의존하는 코드는 수정이 필요할 수 있습니다. HIPIFY는 지원되는 CUDA 코드를 HIP로 변환하는 데 도움을 주며, 변환 후에는 개발자가 정확성을 테스트하고 필요에 따라 성능을 튜닝해야 합니다.

ROCm은 AI 개발에는 PyTorch, TensorFlow, JAX를, 모델을 서비스로 제공하는 데는 vLLM과 SGLang을 지원합니다. 지원 버전은 ROCm 릴리스와 시스템 구성에 따라 달라집니다. 프레임워크 버전을 선택하기 전에 최신 호환성 매트릭스를 확인하세요.

먼저 사용 중인 GPU와 운영 체제에 맞는 호환성 매트릭스를 확인하세요. 그런 다음 해당 구성에 맞는 AMD 설치 가이드를 따르세요. AMD Infinity Hub에서는 사전 구성된 컨테이너를 제공하며, ROCm CLI는 지원되는 시스템에서 설정과 진단을 지원합니다. 규모를 확장하기 전에 샘플 워크로드를 실행해 환경을 확인하세요.

ROCm 뉴스레터

최신 ROCm 소식을 받아 보세요.

각주

©2024 Advanced Micro Devices, Inc. All rights reserved. AMD, AMD Arrow 로고, AMD ROCm, AMD Instinct, EPYC, Radeon Instinct 및 그 조합은 Advanced Micro Devices, Inc.의 상표입니다. PyTorch는 PyTorch의 상표 또는 등록 상표입니다. 본 발행물에 사용된 기타 제품 명칭은 참조용으로만 사용되며, 각 회사의 상표일 수 있습니다.

  1. ROCm이 지원하는 Radeon 부품의 전체 목록은 https://rocm.docs.amd.com/en/latest/reference/gpu-arch-specs.html에서 확인할 수 있습니다.