SDK de ROCm Core

Todo lo que necesitas para desarrollar aplicaciones aceleradas por GPU en hardware AMD. El SDK de ROCm Core incluye bibliotecas, entornos de ejecución, compiladores y herramientas esenciales que forman la base de la pila de software ROCm.

Diagram of the ROCm Core SDK showing math, communication, media, storage, runtime, profiling, debugging, and monitoring libraries, including Composable Kernel, MIOpen, rocWMMA, hipBLAS, rocBLAS, RCCL, rocDecode, hipFile, HIP, LLVM, ROCm Compute Profiler, ROCgdb, AMD SMI, and RDC.

Novedades de ROCm 7.14

TheRock listo para producción para un desarrollo de ROCm más rápido y modular

Amplia compatibilidad con hardware de IA en GPU AMD Instinct™, Radeon™ y Ryzen™ AI

Compatibilidad optimizada para los principales marcos de trabajo de IA de código abierto y motores de inferencia

Implementación de IA lista para empresas con orquestación nativa de la nube y herramientas para desarrolladores

Rendimiento mejorado para IA distribuida, generación de perfiles e implementación escalable

AMD ROCm Lockup White

Evolución histórica de ROCm a lo largo de los años

Los principales institutos y empresas de investigación llevan casi una década utilizando ROCm. Explora los diversos hitos que forman parte de la historia de ROCm.

Componentes del SDK de ROCm Core

Explora los componentes clave que impulsan el SDK de ROCm Core

AMD ROCm Lockup White

Bibliotecas de IA, matemáticas y comunicaciones aceleradas por GPU para computación de alto rendimiento. Las bibliotecas nativas roc* optimizan el rendimiento en las GPU de AMD, mientras que los contenedores hip* simplifican la portabilidad de CUDA. Escala cargas de trabajo distribuidas de IA y computación de alto rendimiento con bibliotecas de comunicación multinodo y multiGPU de alto rendimiento.

Compila y ejecuta aplicaciones de GPU de manera eficiente con las cadenas de herramientas de compiladores y entornos de ejecución de AMD. Mide el rendimiento, analiza la utilización de la GPU e identifica cuellos de botella con herramientas de creación de perfiles y depuración para optimizar las aplicaciones de IA, HPC e informática acelerada.

Monitorea y administra el hardware de la GPU, incluida la temperatura, el consumo de energía, la memoria y la asignación de recursos, con herramientas de entorno de ejecución, controladores y sistema operativo.

Monitorea y administra el estado del hardware de la GPU, incluida la temperatura, el consumo de energía y la asignación de recursos.

Inferencia de IA

Inferencia de IA lista para producción con ROCm

Implementa los principales modelos abiertos en GPU de AMD con una pila de inferencia de código totalmente abierto. Empieza a trabajar rápidamente con contenedores preconfigurados y compatibilidad con marcos integrados.

Inferencia abierta y sin complicaciones

Desde el perfeccionamiento hasta la implementación en producción, sin cambiar de flujo de trabajo

AMD ROCm ofrece una pila de inferencia de código abierto de extremo a extremo con compatibilidad con marcos de trabajo ascendentes (incluido PyTorch) y contenedores validados para vLLM y SGLang, de modo que los equipos puedan pasar del perfeccionamiento y la evaluación comparativa a la producción en GPU AMD Instinct™ con un flujo de trabajo coherente.

Inferencia eficiente, optimizada de forma predeterminada

Alto rendimiento sin la sobrecarga de ajustar cada modelo

ROCm combina paquetes de modelos cuantificados con ejecución nativa de baja precisión y núcleos de ruta crítica de transformadores optimizados, lo que reduce el esfuerzo de ajuste al tiempo que maximiza el rendimiento y la eficiencia para el servicio en el mundo real.

Inferencia distribuida para la implementación moderna

Diseñado para cargas de trabajo de prellenado, decodificación y escalabilidad horizontal

ROCm admite la inferencia distribuida con desagregación de prellenado/decodificación y comunicación de multiGPU y multinodo optimizada, lo que ayuda a mantener la capacidad de respuesta y la utilización a medida que aumenta la escala de la inferencia.

Listo para producción en Kubernetes con IA

Opera la inferencia de manera confiable a escala de equipamiento

ROCm se integra en Kubernetes a través del operador de GPU de AMD, telemetría integrada y una arquitectura modular de controladores, lo que admite la implementación automatizada, la observabilidad y una gestión del ciclo de vida predecible en entornos seguros y aislados.

Entrenamiento de IA

Entrenamiento de IA de principio a fin a escala en GPU de AMD

Entrena y perfecciona modelos de IA en GPU de AMD con una plataforma de software abierta de principio a fin. Aprovecha marcos de trabajo optimizados, una aceleración por GPU eficiente y un escalado fluido desde una sola GPU hasta clústeres de múltiples nodos.

Rendimiento de entrenamiento de IA optimizado

Acelera el entrenamiento de modelos con procesamiento y optimizaciones

ROCm aprovecha las capacidades de procesamiento en paralelo de las GPU de AMD para reducir el tiempo de entrenamiento y mejorar el rendimiento general de las cargas de trabajo de IA. Con bibliotecas optimizadas, una capacidad de administración y compatibilidad eficientes para marcos de trabajo de IA modernos, los desarrolladores pueden entrenar modelos más grandes con mayor rapidez mientras maximizan la utilización de la GPU.

Perfeccionamiento eficiente para IA especializada

Adapta modelos base para tareas específicas de cada dominio con ROCm

ROCm acelera el perfeccionamiento de modelos de lenguaje de gran tamaño y otros modelos base en GPU de AMD con bibliotecas optimizadas, amplia compatibilidad con marcos de trabajo y una gestión eficiente de recursos. Ajusta modelos con mayor rapidez e intégralos sin problemas en marcos de trabajo, modelos y herramientas de código abierto.

Entrenamiento distribuido y escalable

Ejecuta el entrenamiento multinodo de manera confiable en clústeres de GPU de AMD

Primus ayuda a los equipos a escalar el entrenamiento en clústeres de GPU de AMD con ejecución distribuida, programación consciente de la topología y funcionamiento con tolerancia a errores. Esto permite un entrenamiento más constante a medida que crecen las cargas de trabajo y los clústeres.

Operaciones de entrenamiento listas para la empresa

Telemetría, validación y recuperación más rápida para tareas de larga duración

Primus proporciona telemetría, paneles de control y pruebas de rendimiento del estado de los nodos, lo que ofrece a los equipos visibilidad sobre el rendimiento del entrenamiento y el estado del clúster. Esto ayuda a las organizaciones a operar grandes cargas de trabajo de entrenamiento con mayor confiabilidad y una resolución de problemas más rápida.

ROCm para HPC y supercomputación

Crea y escala aplicaciones de HPC con ROCm

Desde bibliotecas optimizadas hasta supercomputadoras líderes: ROCm permite la computación de alto rendimiento en GPU de AMD.

Aceleración de la innovación en HPC

Impulsar avances en el área de la ciencia, la ingeniería y la investigación

AMD ROCm™ permite cargas de trabajo de computación de alto rendimiento (HPC) y supercomputación en sectores como energía, dinámica molecular, física, química computacional, ciencia del clima y otros dominios de investigación, lo que proporciona una plataforma de software abierta para ayudar a abordar algunos de los desafíos computacionales más complejos del mundo.

Programación flexible para HPC

Desarrolla con las herramientas que mejor se adapten a tu aplicación

ROCm admite múltiples modelos de programación de HPC, incluidos OpenMP®, HIP, OpenCL™ y Python™, lo que proporciona a los desarrolladores la flexibilidad para crear, optimizar y escalar aplicaciones mediante los lenguajes y marcos de trabajo que mejor se adapten a sus cargas de trabajo.

Bibliotecas optimizadas para computación de alto rendimiento

Acelera las aplicaciones con bibliotecas optimizadas

ROCm incluye un conjunto integral de bibliotecas matemáticas y de comunicación diseñadas para simplificar el desarrollo de HPC, al tiempo que mejora el rendimiento de las aplicaciones, la escalabilidad y la eficiencia en todas las plataformas de procesamiento de AMD.

Demostrado a escala de supercomputación

Escala que impulsa las supercomputadoras líderes del mundo

AMD impulsa 177 de las supercomputadoras de la lista Top500, incluidas Frontier, LUMI y el próximo sistema El Capitan. ROCm proporciona la base de software para ejecutar algunas de las aplicaciones de HPC más grandes y exigentes del mundo a exaescala y mucho más.

Casos de estudio de socios

Asociaciones y éxito comprobado

Descubre cómo las empresas y los institutos de investigación líderes se han asociado con AMD.

Blogs destacados

Presentación de ROCprofiler

Explora el nuevo SDK de ROCprofiler y descubre cómo su infraestructura unificada de generación de perfiles agiliza la optimización del rendimiento para aplicaciones de IA y HPC en GPU de AMD.

Herramientas de generación de perfiles de AMD

Descubre cómo las herramientas de generación de perfiles de AMD brindan información detallada sobre el rendimiento para ayudar a los desarrolladores a realizar evaluaciones comparativas, generar perfiles y optimizar aplicaciones heterogéneas que se ejecutan en CPU y GPU.

Hardware compatible

AMD Radeon Graphics

Tarjetas gráficas AMD Radeon

Algunas funciones de ROCm son compatibles con tarjetas gráficas AMD Radeon específicas¹. Descubre tarjetas gráficas profesionales de última generación.

Recursos para desarrolladores

ROCm Developer screen shot

Centro de desarrolladores de ROCm

Comienza a desarrollar aplicaciones aceleradas por GPU de AMD. Visita el Centro de desarrolladores de ROCm para obtener acceso a lo más reciente en guías de usuario, contenedores, videos de capacitación, webinars y más.

Newsletter de ROCm

Recibe las últimas noticias de ROCm.

Notas al pie

©2024 Advanced Micro Devices, Inc. Todos los derechos reservados. AMD, el logotipo de la flecha de AMD, AMD ROCm, AMD Instinct, EPYC, Radeon Instinct y sus combinaciones son marcas registradas de Advanced Micro Devices, Inc. PyTorch es una marca comercial o marca comercial registrada de PyTorch. Los otros nombres de productos utilizados en esta publicación se presentan solo con fines de identificación y pueden ser marcas comerciales de sus respectivas empresas.

  1. Para obtener una lista completa de las piezas Radeon compatibles con ROCm, visita https://rocm.docs.amd.com/en/latest/reference/gpu-arch-specs.html