SDK de ROCm Core
Todo lo que necesitas para desarrollar aplicaciones aceleradas por GPU en hardware AMD. El SDK de ROCm Core incluye bibliotecas, entornos de ejecución, compiladores y herramientas esenciales que forman la base de la pila de software ROCm.
Novedades de ROCm 7.14
TheRock listo para producción para un desarrollo de ROCm más rápido y modular
Amplia compatibilidad con hardware de IA en GPU AMD Instinct™, Radeon™ y Ryzen™ AI
Compatibilidad optimizada para los principales marcos de trabajo de IA de código abierto y motores de inferencia
Implementación de IA lista para empresas con orquestación nativa de la nube y herramientas para desarrolladores
Rendimiento mejorado para IA distribuida, generación de perfiles e implementación escalable
Evolución histórica de ROCm a lo largo de los años
Los principales institutos y empresas de investigación llevan casi una década utilizando ROCm. Explora los diversos hitos que forman parte de la historia de ROCm.
Componentes del SDK de ROCm Core
Explora los componentes clave que impulsan el SDK de ROCm Core
Bibliotecas de IA, matemáticas y comunicaciones aceleradas por GPU para computación de alto rendimiento. Las bibliotecas nativas roc* optimizan el rendimiento en las GPU de AMD, mientras que los contenedores hip* simplifican la portabilidad de CUDA. Escala cargas de trabajo distribuidas de IA y computación de alto rendimiento con bibliotecas de comunicación multinodo y multiGPU de alto rendimiento.
Compila y ejecuta aplicaciones de GPU de manera eficiente con las cadenas de herramientas de compiladores y entornos de ejecución de AMD. Mide el rendimiento, analiza la utilización de la GPU e identifica cuellos de botella con herramientas de creación de perfiles y depuración para optimizar las aplicaciones de IA, HPC e informática acelerada.
Monitorea y administra el hardware de la GPU, incluida la temperatura, el consumo de energía, la memoria y la asignación de recursos, con herramientas de entorno de ejecución, controladores y sistema operativo.
Monitorea y administra el estado del hardware de la GPU, incluida la temperatura, el consumo de energía y la asignación de recursos.
Inferencia de IA
Inferencia de IA lista para producción con ROCm
Implementa los principales modelos abiertos en GPU de AMD con una pila de inferencia de código totalmente abierto. Empieza a trabajar rápidamente con contenedores preconfigurados y compatibilidad con marcos integrados.
Inferencia abierta y sin complicaciones
Desde el perfeccionamiento hasta la implementación en producción, sin cambiar de flujo de trabajo
AMD ROCm ofrece una pila de inferencia de código abierto de extremo a extremo con compatibilidad con marcos de trabajo ascendentes (incluido PyTorch) y contenedores validados para vLLM y SGLang, de modo que los equipos puedan pasar del perfeccionamiento y la evaluación comparativa a la producción en GPU AMD Instinct™ con un flujo de trabajo coherente.
Inferencia eficiente, optimizada de forma predeterminada
Alto rendimiento sin la sobrecarga de ajustar cada modelo
ROCm combina paquetes de modelos cuantificados con ejecución nativa de baja precisión y núcleos de ruta crítica de transformadores optimizados, lo que reduce el esfuerzo de ajuste al tiempo que maximiza el rendimiento y la eficiencia para el servicio en el mundo real.
Inferencia distribuida para la implementación moderna
Diseñado para cargas de trabajo de prellenado, decodificación y escalabilidad horizontal
ROCm admite la inferencia distribuida con desagregación de prellenado/decodificación y comunicación de multiGPU y multinodo optimizada, lo que ayuda a mantener la capacidad de respuesta y la utilización a medida que aumenta la escala de la inferencia.
Listo para producción en Kubernetes con IA
Opera la inferencia de manera confiable a escala de equipamiento
ROCm se integra en Kubernetes a través del operador de GPU de AMD, telemetría integrada y una arquitectura modular de controladores, lo que admite la implementación automatizada, la observabilidad y una gestión del ciclo de vida predecible en entornos seguros y aislados.
Entrenamiento de IA
Entrenamiento de IA de principio a fin a escala en GPU de AMD
Entrena y perfecciona modelos de IA en GPU de AMD con una plataforma de software abierta de principio a fin. Aprovecha marcos de trabajo optimizados, una aceleración por GPU eficiente y un escalado fluido desde una sola GPU hasta clústeres de múltiples nodos.
Rendimiento de entrenamiento de IA optimizado
Acelera el entrenamiento de modelos con procesamiento y optimizaciones
ROCm aprovecha las capacidades de procesamiento en paralelo de las GPU de AMD para reducir el tiempo de entrenamiento y mejorar el rendimiento general de las cargas de trabajo de IA. Con bibliotecas optimizadas, una capacidad de administración y compatibilidad eficientes para marcos de trabajo de IA modernos, los desarrolladores pueden entrenar modelos más grandes con mayor rapidez mientras maximizan la utilización de la GPU.
Perfeccionamiento eficiente para IA especializada
Adapta modelos base para tareas específicas de cada dominio con ROCm
ROCm acelera el perfeccionamiento de modelos de lenguaje de gran tamaño y otros modelos base en GPU de AMD con bibliotecas optimizadas, amplia compatibilidad con marcos de trabajo y una gestión eficiente de recursos. Ajusta modelos con mayor rapidez e intégralos sin problemas en marcos de trabajo, modelos y herramientas de código abierto.
Entrenamiento distribuido y escalable
Ejecuta el entrenamiento multinodo de manera confiable en clústeres de GPU de AMD
Primus ayuda a los equipos a escalar el entrenamiento en clústeres de GPU de AMD con ejecución distribuida, programación consciente de la topología y funcionamiento con tolerancia a errores. Esto permite un entrenamiento más constante a medida que crecen las cargas de trabajo y los clústeres.
Operaciones de entrenamiento listas para la empresa
Telemetría, validación y recuperación más rápida para tareas de larga duración
Primus proporciona telemetría, paneles de control y pruebas de rendimiento del estado de los nodos, lo que ofrece a los equipos visibilidad sobre el rendimiento del entrenamiento y el estado del clúster. Esto ayuda a las organizaciones a operar grandes cargas de trabajo de entrenamiento con mayor confiabilidad y una resolución de problemas más rápida.
ROCm para HPC y supercomputación
Crea y escala aplicaciones de HPC con ROCm
Desde bibliotecas optimizadas hasta supercomputadoras líderes: ROCm permite la computación de alto rendimiento en GPU de AMD.
Aceleración de la innovación en HPC
Impulsar avances en el área de la ciencia, la ingeniería y la investigación
AMD ROCm™ permite cargas de trabajo de computación de alto rendimiento (HPC) y supercomputación en sectores como energía, dinámica molecular, física, química computacional, ciencia del clima y otros dominios de investigación, lo que proporciona una plataforma de software abierta para ayudar a abordar algunos de los desafíos computacionales más complejos del mundo.
Programación flexible para HPC
Desarrolla con las herramientas que mejor se adapten a tu aplicación
ROCm admite múltiples modelos de programación de HPC, incluidos OpenMP®, HIP, OpenCL™ y Python™, lo que proporciona a los desarrolladores la flexibilidad para crear, optimizar y escalar aplicaciones mediante los lenguajes y marcos de trabajo que mejor se adapten a sus cargas de trabajo.
Bibliotecas optimizadas para computación de alto rendimiento
Acelera las aplicaciones con bibliotecas optimizadas
ROCm incluye un conjunto integral de bibliotecas matemáticas y de comunicación diseñadas para simplificar el desarrollo de HPC, al tiempo que mejora el rendimiento de las aplicaciones, la escalabilidad y la eficiencia en todas las plataformas de procesamiento de AMD.
Demostrado a escala de supercomputación
Escala que impulsa las supercomputadoras líderes del mundo
AMD impulsa 177 de las supercomputadoras de la lista Top500, incluidas Frontier, LUMI y el próximo sistema El Capitan. ROCm proporciona la base de software para ejecutar algunas de las aplicaciones de HPC más grandes y exigentes del mundo a exaescala y mucho más.
Casos de estudio de socios
Asociaciones y éxito comprobado
Descubre cómo las empresas y los institutos de investigación líderes se han asociado con AMD.
Blogs destacados
Hardware compatible
Recursos para desarrolladores
Newsletter de ROCm
Recibe las últimas noticias de ROCm.
Notas al pie
©2024 Advanced Micro Devices, Inc. Todos los derechos reservados. AMD, el logotipo de la flecha de AMD, AMD ROCm, AMD Instinct, EPYC, Radeon Instinct y sus combinaciones son marcas registradas de Advanced Micro Devices, Inc. PyTorch es una marca comercial o marca comercial registrada de PyTorch. Los otros nombres de productos utilizados en esta publicación se presentan solo con fines de identificación y pueden ser marcas comerciales de sus respectivas empresas.
- Para obtener una lista completa de las piezas Radeon compatibles con ROCm, visita https://rocm.docs.amd.com/en/latest/reference/gpu-arch-specs.html
©2024 Advanced Micro Devices, Inc. Todos los derechos reservados. AMD, el logotipo de la flecha de AMD, AMD ROCm, AMD Instinct, EPYC, Radeon Instinct y sus combinaciones son marcas registradas de Advanced Micro Devices, Inc. PyTorch es una marca comercial o marca comercial registrada de PyTorch. Los otros nombres de productos utilizados en esta publicación se presentan solo con fines de identificación y pueden ser marcas comerciales de sus respectivas empresas.
- Para obtener una lista completa de las piezas Radeon compatibles con ROCm, visita https://rocm.docs.amd.com/en/latest/reference/gpu-arch-specs.html