SDK de base ROCm
Tout ce dont vous avez besoin pour développer des applications accélérées par GPU sur du hardware AMD. Le SDK ROCm Core comprend les bibliothèques, les environnements d'exécution, les compilateurs et les outils essentiels qui constituent la base de la pile software ROCm.
Nouveautés de ROCm 7.14
TheRock, prêt pour la production, pour un développement ROCm plus rapide et modulaire
Prise en charge étendue du hardware d'IA sur les GPU AMD Instinct™, Radeon™ et Ryzen™ AI
Prise en charge optimisée des principaux frameworks d'IA open source et des moteurs d'inférence
Déploiement d'IA adapté aux entreprises avec orchestration et outils de développement natifs du cloud
Amélioration des performances pour l'IA distribuée, le profilage et le déploiement évolutif
Évolution de ROCm au fil des années
Des entreprises et instituts de recherche de pointe utilisent ROCm depuis près de dix ans. Découvrez les grands jalons de l'histoire de ROCm.
Composants du SDK de base ROCm
Découvrez le composant clé qui alimente le SDK ROCm Core
Bibliothèques d'IA, de mathématiques et de communication accélérées par GPU pour les calculs hautes performances. Les bibliothèques natives roc* optimisent les performances sur les GPU AMD, tandis que les wrappers hip* simplifient la portabilité CUDA. Faites évoluer vos charges de travail distribuées d'IA et de calculs hautes performances grâce à des bibliothèques de communication multi-GPU et multi-nœuds hautes performances.
Développez et exécutez efficacement des applications GPU grâce aux chaînes d'outils de compilation et aux environnements d'exécution AMD. Mesurez les performances, analysez l'utilisation du GPU et identifiez les goulets d'étranglement à l'aide d'outils de profilage et de débogage afin d'optimiser les applications d'IA, de calculs hautes performances et de calcul accéléré.
Surveillez et gérez le hardware GPU, y compris la température, l'alimentation, la mémoire et l'allocation des ressources, avec des outils d'exécution, de pilote et de système d'exploitation.
Surveillez et gérez l'état du hardware du GPU, y compris la température, l'alimentation et l'allocation des ressources.
Inférence d'IA
Inférence d'IA de production avec ROCm
Déployez les meilleurs modèles ouverts sur les GPU AMD à l'aide d'une pile d'inférence entièrement open source. Soyez opérationnel rapidement grâce à des conteneurs préconfigurés et à la prise en charge des frameworks en amont.
Inférence ouverte et prête à l'emploi
Du réglage fin au déploiement en production, sans modifier les flux de travail
AMD ROCm fournit une pile d'inférence open source de bout en bout avec prise en charge des frameworks en amont (y compris PyTorch) et des conteneurs validés pour vLLM et SGLang. Les équipes peuvent ainsi passer du réglage fin et des benchmarks de performance au déploiement en production sur les GPU AMD Instinct™ avec un flux de travail cohérent.
Inférence efficace, optimisée par défaut
Débit élevé sans surcoût de réglage par modèle
ROCm associe des paquets de modèles quantifiés à une exécution native en basse précision et à des noyaux de chemin critique optimisés pour les transformateurs. Il réduit ainsi l'effort de réglage tout en maximisant le débit et l'efficacité pour un déploiement en conditions réelles.
Inférence distribuée pour un déploiement moderne
Conçu pour les charges de travail de préremplissage, de décodage et de scale-out
ROCm prend en charge l'inférence distribuée avec désagrégation du préremplissage et du décodage, ainsi qu'une communication multi-GPU et multi-nœuds optimisée, ce qui permet de maintenir la réactivité et le taux d'utilisation à mesure que l'inférence évolue.
Prêt pour la production pour Kubernetes avec l'IA
Exécutez l'inférence de manière fiable à l'échelle d'un parc de serveurs
ROCm s'intègre à Kubernetes via AMD GPU Operator, la télémétrie intégrée et une architecture de pilotes modulaire, prenant en charge le déploiement automatisé, l'observabilité et la gestion prévisible du cycle de vie dans des environnements sécurisés et isolés physiquement.
Entraînement de l'IA
Entraînement de l'IA de bout en bout à grande échelle sur les GPU AMD
Entraînez et affinez les modèles d'IA sur les GPU AMD grâce à une plateforme software ouverte et complète. Tirez parti de frameworks optimisés, d'une accélération GPU efficace et d'une évolutivité fluide, d'un seul GPU à des clusters à plusieurs nœuds.
Performances d'entraînement IA optimisées
Accélérez l'entraînement des modèles grâce à des calculs et des optimisations
ROCm tire parti des capacités de traitement parallèle des GPU AMD pour réduire le temps d'entraînement et améliorer les performances globales des charges de travail d'IA. Grâce à des bibliothèques optimisées, une gestion efficace des ressources et la prise en charge des frameworks d'IA modernes, les développeurs peuvent entraîner plus rapidement des modèles plus volumineux tout en optimisant l'utilisation du GPU.
Réglage précis et efficace pour l'IA spécialisée
Adaptez les modèles de base pour les tâches spécifiques à un domaine avec ROCm
ROCm accélère le processus de réglage précis des grands modèles de langage et d'autres modèles de base sur les GPU AMD grâce à des bibliothèques optimisées, une compatibilité étendue et une gestion efficace des ressources. Affinez vos modèles plus rapidement tout en bénéficiant d'une intégration fluide aux frameworks, modèles et outils open source.
Entraînement distribué évolutif
Exécutez l'entraînement multi-nœuds de manière fiable sur les clusters GPU AMD
Primus aide les équipes à faire évoluer leurs entraînements sur des clusters de GPU AMD grâce à une exécution distribuée, une planification tenant compte de la topologie et un fonctionnement tolérant aux pannes. Cela permet un entraînement plus cohérent à mesure que les charges de travail et les clusters augmentent.
Opérations d'entraînement prêtes pour l'entreprise
Télémétrie, validation et reprise plus rapide pour les tâches de longue durée
Primus fournit des données de télémétrie, des tableaux de bord et des benchmarks de l'état des nœuds, offrant ainsi aux équipes une visibilité sur les performances d'entraînement et l'état du cluster. Cela permet aux entreprises de gérer de grands volumes d'entraînement avec une plus grande fiabilité et un dépannage plus rapide.
ROCm pour le HPC et le supercalcul
Développez et faites évoluer des applications de calculs hautes performances avec ROCm
Des bibliothèques optimisées aux supercalculateurs de pointe, ROCm permet les calculs hautes performances sur les GPU AMD.
Accélérez l'innovation dans le domaine des calculs hautes performances
Des avancées majeures dans les domaines de la science, de l'ingénierie et de la recherche
AMD ROCm™ prend en charge les charges de travail de calculs hautes performances et de supercalcul dans les domaines de l'énergie, de la dynamique moléculaire, de la physique, de la chimie computationnelle, des sciences du climat et d'autres domaines de recherche. Il offre une plateforme software ouverte permettant de relever certains des défis computationnels les plus complexes au monde.
Programmation flexible des calculs hautes performances
Développez avec les outils qui s'adaptent le mieux à votre application
ROCm prend en charge plusieurs modèles de programmation des calculs hautes performances, tels que OpenMP®, HIP, OpenCL™et Python™, offrant aux développeurs la flexibilité de créer, d'optimiser et d'adapter des applications en utilisant les langages et les frameworks les plus adaptés à leurs besoins.
Bibliothèques HPC optimisées
Accélérez vos applications grâce à des bibliothèques optimisées
ROCm comprend un ensemble complet de bibliothèques mathématiques et de communication conçues pour simplifier le développement des calculs hautes performances tout en améliorant les performances, l'évolutivité et l'efficacité des applications sur l'ensemble des plateformes de calcul AMD.
Éprouvé dans le domaine du supercalcul
Une puissance à l'échelle des supercalculateurs leaders mondiaux
AMD équipe 177 des supercalculateurs du classement Top500, notamment Frontier, LUMI et le futur système El Capitan. ROCm fournit la base software nécessaire à l'exécution de certaines des applications de calculs hautes performances les plus volumineuses et les plus exigeantes au monde, à l'exascale et au-delà.
Études de cas partenaires
Partenariats et preuves d'efficacité
Découvrez comment les entreprises et les principaux instituts de recherche se sont associés à AMD.
Blogs à la une
Hardware pris en charge
Ressources pour les développeurs
Newsletter dédiée à ROCm
Recevez les dernières actualités concernant ROCm.
Notes de bas de page
©2024 Advanced Micro Devices, Inc. Tous droits réservés. AMD, le logo AMD avec la flèche, AMD ROCm, AMD Instinct, EPYC, Radeon Instinct et leurs combinaisons sont des marques commerciales d'Advanced Micro Devices, Inc. PyTorch est une marque commerciale ou une marque déposée de PyTorch. Les autres noms de produits cités dans cette publication ne sont mentionnés qu'à des fins d'identification et peuvent être des marques déposées de leurs sociétés respectives.
- Pour une liste complète des pièces Radeon prises en charge par ROCm, rendez-vous sur : https://rocm.docs.amd.com/en/latest/reference/gpu-arch-specs.html.
©2024 Advanced Micro Devices, Inc. Tous droits réservés. AMD, le logo AMD avec la flèche, AMD ROCm, AMD Instinct, EPYC, Radeon Instinct et leurs combinaisons sont des marques commerciales d'Advanced Micro Devices, Inc. PyTorch est une marque commerciale ou une marque déposée de PyTorch. Les autres noms de produits cités dans cette publication ne sont mentionnés qu'à des fins d'identification et peuvent être des marques déposées de leurs sociétés respectives.
- Pour une liste complète des pièces Radeon prises en charge par ROCm, rendez-vous sur : https://rocm.docs.amd.com/en/latest/reference/gpu-arch-specs.html.