ROCm 코어 SDK
AMD 하드웨어에서 GPU 가속 애플리케이션을 개발하는 데 필요한 모든 것을 제공합니다. ROCm 코어 SDK(Software Development Kit)에는 ROCm 소프트웨어 스택의 기반을 형성하는 필수 라이브러리, 런타임, 컴파일러, 도구가 포함되어 있습니다.
ROCm 7.14의 새로운 기능
더 빠른 모듈식 ROCm 개발을 위한 프로덕션 지원 TheRock
AMD Instinct™ GPU, Radeon™ 및 Ryzen™ AI를 아우르는 폭넓은 AI 하드웨어 지원
업계 최고의 오픈 소스 AI 프레임워크 및 추론 엔진에 최적화된 지원
클라우드 네이티브 오케스트레이션 및 개발자 툴링을 통한 엔터프라이즈용 AI 배포
분산된 AI, 프로파일링, 확장형 배포를 위한 향상된 성능
수년에 걸친 ROCm 진화
주요 기업과 연구 기관은 거의 10년 동안 ROCm을 활용해 왔습니다. ROCm 역사의 일부인 다양한 이정표를 살펴보세요.
ROCm 코어 SDK 구성 요소
ROCm 코어 SDK를 지원하는 주요 구성 요소 살펴보기
HPC용 GPU 가속 AI, 수학, 통신 라이브러리입니다. 기본 roc* 라이브러리는 AMD GPU의 성능을 최적화하고 hip* 래퍼는 CUDA 이식성을 단순화합니다. 고성능 멀티 GPU 및 멀티 노드 통신 라이브러리를 통해 분산된 AI 및 HPC 워크로드를 확장할 수 있습니다.
AMD 컴파일러 툴체인 및 런타임으로 GPU 애플리케이션을 효율적으로 구축 및 실행합니다. AI, HPC, 가속화된 컴퓨팅 애플리케이션을 최적화하기 위해 프로파일링 및 디버깅 도구를 사용하여 성능을 측정하고, GPU 활용성을 분석하고, 병목 현상을 파악합니다.
런타임, 드라이버, 운영 체제 도구로 온도, 전력, 메모리, 리소스 할당을 포함한 GPU 하드웨어를 모니터링 및 관리합니다.
온도, 전력, 리소스 할당을 비롯한 GPU 하드웨어 상태를 모니터링하고 관리합니다.
AI 추론
ROCm을 통한 프로덕션 AI 추론
완전한 오픈 소스 추론 스택을 사용하여 AMD GPU에 주요 개방형 모델을 배포합니다. 사전 구축된 컨테이너와 업스트림 프레임워크 지원으로 빠르게 실행하세요.
바로 사용 가능한 개방형 추론
워크플로 변경 없이 미세 조정에서 프로덕션까지
AMD ROCm은 업스트림 프레임워크 지원(PyTorch 포함)과 vLLM 및 SGLang에 대해 검증된 컨테이너가 포함된 오픈 소스 엔드 투 엔드 추론 스택을 제공하므로 팀은 AMD Instinct™ GPU에서 미세 조정 및 벤치마킹부터 프로덕션까지 일관된 워크플로를 진행할 수 있습니다.
효율적인 추론, 최적화된 기본값
모델별 조정 오버헤드 없이도 높은 처리율
ROCm은 네이티브 저정밀도 실행 및 최적화된 트랜스포머 핫패스 커널과 양자화된 모델 패키지를 조합하여 조정 작업을 줄이고 실제 서비스를 위한 처리율과 효율성을 최대화합니다.
최신 서비스를 위한 분산 추론
프리필, 디코딩, 스케일 아웃 워크로드를 위한 제작
ROCm은 프리필/디코딩 분해 및 최적화된 멀티 GPU, 멀티 노드 통신을 통해 분산 추론을 지원하므로 추론이 확장되어도 응답성과 활용성을 유지할 수 있습니다.
AI를 적용한 Kubernetes로 프로덕션 준비 완료
대규모 환경에서의 안정적인 추론 운영
ROCm은 AMD GPU Operator, 빌트인 텔레메트리, 모듈식 드라이버 아키텍처를 통해 Kubernetes와 통합되며 안전한 에어갭 환경에서 자동화된 롤아웃, 관측성, 예측 가능한 수명 주기 관리를 지원합니다.
AI 훈련
AMD GPU의 포괄적인 AI 학습
개방형 엔드 투 엔드 소프트웨어 플랫폼을 통해 AMD GPU에서 AI 모델을 학습시키고 미세 조정합니다. 최적화된 프레임워크, 효율적인 GPU 가속을 활용하고, 단일 GPU에서 다중 노드 클러스터까지 원활하게 확장할 수 있습니다.
최적화된 AI 학습 성능
컴퓨팅 및 최적화로 모델 학습 가속화
ROCm은 AMD GPU의 병렬 처리 기능을 활용하여 학습 시간을 단축하고 AI 워크로드의 전반적인 성능을 향상합니다. 최적화된 라이브러리, 효율적인 리소스 관리, 최신 AI 프레임워크 지원을 통해 개발자들은 GPU 활용성을 극대화하면서 더 큰 규모의 모델을 더 빠르게 훈련시킬 수 있습니다.
전문 AI를 위한 효율적인 미세 조정
ROCm을 통한 도메인별 작업에 대한 기반 모델 조정
ROCm은 최적화된 라이브러리, 광범위한 프레임워크 호환성, 효율적인 리소스 관리를 통해 AMD GPU의 대규모 언어 모델 및 기타 기반 모델의 미세 조정을 가속화합니다. 모델을 더 빠르게 미세 조정하고 오픈 소스 프레임워크, 모델 및 도구와 원활하게 통합해 보세요.
확장형 분산 학습
AMD GPU 클러스터에서 실행하는 안정적인 다중 노드 학습
Primus는 분산된 실행, 토폴로지 인식 스케줄링, 내결함성 운영을 통해 AMD GPU 클러스터 전반으로 학습을 확장할 수 있도록 지원합니다. 이를 통해 워크로드와 클러스터의 증가에 맞춰 더욱 일관된 학습을 지원할 수 있습니다.
엔터프라이즈 지원 학습 운영
장기 실행 작업의 텔레메트리, 검증, 빠른 복구
Primus는 텔레메트리, 대시보드, 노드 상태 벤치마킹을 제공하여 팀이 학습 성과와 클러스터 상태를 파악할 수 있도록 지원합니다. 이를 통해 조직은 더 높은 안정성과 빠른 문제 해결을 통해 대규모 학습 워크로드를 운영할 수 있습니다.
HPC 및 슈퍼컴퓨팅을 위한 ROCm
ROCm과 함께 HPC 애플리케이션을 구축하고 확장하세요
최적화된 라이브러리부터 주요 슈퍼컴퓨터까지, ROCm은 AMD GPU에서 고성능 컴퓨팅을 지원합니다.
HPC 혁신의 가속화
과학, 엔지니어링, 연구 분야의 획기적인 발전 지원
AMD ROCm은™ 에너지, 분자 역학, 물리학, 계산 화학, 기후 과학, 기타 연구 분야에서 고성능 컴퓨팅(HPC) 및 슈퍼컴퓨팅 워크로드를 지원하며, 세계에서 가장 복잡한 컴퓨팅 문제를 해결할 수 있는 개방형 소프트웨어 플랫폼을 제공합니다.
유연한 HPC 프로그래밍
애플리케이션에 가장 적합한 도구를 활용한 개발
ROCm은 OpenMP®, HIP, OpenCL™, Python™을 포함한 여러 HPC 프로그래밍 모델을 지원하므로, 개발자가 워크로드에 가장 적합한 언어와 프레임워크를 사용하여 애플리케이션을 구축, 최적화, 확장할 수 있습니다.
최적화된 HPC 라이브러리
최적화된 라이브러리로 애플리케이션 가속화
ROCm에는 HPC 개발을 단순화하는 동시에 AMD 컴퓨팅 플랫폼 전체의 애플리케이션 성능, 확장성, 효율성을 개선하도록 설계된 포괄적인 수학 및 통신 라이브러리가 포함되어 있습니다.
슈퍼컴퓨팅에서 검증된 성능
세계 최고의 슈퍼컴퓨터를 구동하는 규모
AMD는 Frontier, LUMI, El Capitan 시스템을 포함한 500대 슈퍼컴퓨터 중 177대를 지원합니다. ROCm은 엑사스케일 및 그 이상에서 세계 최대 규모의 가장 까다로운 HPC 애플리케이션을 실행할 수 있는 소프트웨어 기반을 제공합니다.
파트너 사례 연구
파트너십 및 검증된 성공
기업과 선도적인 연구 기관이 AMD와 어떻게 협력했는지 알아보세요.
주요 블로그
지원 하드웨어
개발자 리소스
ROCm 뉴스레터
최신 ROCm 소식을 받아 보세요.
각주
©2024 Advanced Micro Devices, Inc. All rights reserved. AMD, AMD Arrow 로고, AMD ROCm, AMD Instinct, EPYC, Radeon Instinct 및 그 조합은 Advanced Micro Devices, Inc.의 상표입니다. PyTorch는 PyTorch의 상표 또는 등록 상표입니다. 본 발행물에 사용된 기타 제품 명칭은 참조용으로만 사용되며, 각 회사의 상표일 수 있습니다.
- ROCm이 지원하는 Radeon 부품의 전체 목록은 https://rocm.docs.amd.com/en/latest/reference/gpu-arch-specs.html에서 확인할 수 있습니다.
©2024 Advanced Micro Devices, Inc. All rights reserved. AMD, AMD Arrow 로고, AMD ROCm, AMD Instinct, EPYC, Radeon Instinct 및 그 조합은 Advanced Micro Devices, Inc.의 상표입니다. PyTorch는 PyTorch의 상표 또는 등록 상표입니다. 본 발행물에 사용된 기타 제품 명칭은 참조용으로만 사용되며, 각 회사의 상표일 수 있습니다.
- ROCm이 지원하는 Radeon 부품의 전체 목록은 https://rocm.docs.amd.com/en/latest/reference/gpu-arch-specs.html에서 확인할 수 있습니다.