ROCm AI 开发者中心:云端和数据中心 AI
基于 AMD Instinct GPU 实现大规模训练和推理优化
试用 AMD ROCm,通过 PyTorch 等主流框架进行开源 GPU 编程。查找练习示例、教程、开源项目、文档等资源。
运行示例 AI 工作负载
体验适用于云端和数据中心 AI 应用场景的 ROCm 软件栈。
精选工作负载
获取 AMD GPU 资源
想要立即在 AMD Instinct GPU 上试用 ROCm 吗?
加入 AMD AI 开发者计划,即可免费获得价值 100 美元的 AMD Developer Cloud 信用值;该计算平台功能强大,配备 AMD Instinct GPU,预装 Docker 容器,无需配置即可上手使用。
学习资源
探索更多主题及相关学习资源,及时掌握 AMD 最新技术进展。
社区与支持
其他论坛
常见问题解答
ROCm 支持十余种 Linux 发行版,适用于特定 AMD Instinct 和 AMD Radeon GPU 上的计算工作负载。如需了解 ROCm 当前支持的 Linux 发行版,请查阅系统要求文档。
ROCm 在不断迭代,每一个新版本都在性能上实现了显著提升。查看性能测试结果页面,即可获取参考基准,然后以此来评估搭配 ROCm 软件的 AMD Instinct GPU 在运行主流 AI 模型推理框架(例如 vLLM、xDiT)和训练框架(例如 PyTorch、Megatron-LM 和 JAX MaxText)时的性能表现。
AMD 会随新版 ROCm 的发布,定期同步推出官方 ROCm PyTorch Docker 镜像。这些镜像都经过 AMD 的全面测试。请参阅 PyTorch 兼容性说明文档,了解概要情况、支持的模块和关键库;同时,请参阅 ROCm 平台 PyTorch 安装指南,了解 Docker 镜像或 wheel 包的相关说明和下载地址。
您可以根据自己的工作负载对 AMD GPU 进行调优以充分释放其全部潜能,从而优化系统。
您还可以使用 ROCm 工具来提高 AI 模型性能,并加快 AI 工作负载运行过程中的推理阶段。优化推理的常用方法包括:对预训练模型进行量化和剪枝、优化计算内核以及使用加速库等。查看 ROCm 推理优化文档,获取快速上手指南。
加入 AI 开发人员计划
获取 AMD Developer Cloud 免费额度、专属培训课程、每月 AMD GPU 抽奖活动以及社区支持,旨在助您顺利开展 AI 开发工作。
订阅接收 ROCm 资讯
订阅接收 ROCm 新闻资讯,及时掌握最新版本发布动态及相关实用技巧。