全新AI基础设施融合了领先的计算能力、网络和开放软件,为大规模AI提供机架级性能。
关键要点:
- AMD推出AMD Helios机架级解决方案,这一全新机架级AI基础设施旨在为前沿AI、大规模推理和基础模型训练而设计。
- 该平台将AMD Instinct MI455X GPU、第六代AMD EPYC服务器CPU、AMD Pensando网络和AMD ROCm软件整合到统一的机架级架构中。
- AMD Helios可提供百亿亿次级AI性能、业界领先的内存容量和带宽和从单个机架到吉瓦级AI集群的可扩展性。
- AMD Helios支持开放式AI基础架构,具备UALink™ over Ethernet (UALoE)、基于标准的以太网、AMD ROCm软件和内置的机架级安全功能。
内容概要:
AMD推出了AMD Helios机架级解决方案,这一开放式AI基础设施平台集成了AMD Instinct MI455X GPU、第六代AMD EPYC服务器CPU、AMD Pensando网络和AMD ROCm软件,以支持前沿AI、大规模推理和基础模型训练。该平台还可提供百亿亿次级AI性能,可从单个机架扩展至吉瓦级AI集群,同时获得更多AI计算、内存容量、内存带宽和每美元token。
常见问题解答
何为AMD Helios机架级解决方案?
AMD Helios是专为前沿AI、大规模推理和基础模型训练而设计的机架级AI基础设施平台。
AMD Helios都包含哪些技术?
AMD Helios将AMD Instinct MI455X GPU、第六代AMD EPYC服务器CPU、AMD ROCm软件和AMD Pensando网络整合到统一的机架级架构中。
AMD为何推出AMD Helios?
AMD推出AMD Helios旨在帮助客户部署开放且可扩展的AI基础设施,并能够在机架和集群规模上提供高性能、高效率且高性价比的AI。
AMD Helios的部署规模能扩展至多大?
AMD Helios可从单个机架扩展至吉瓦级AI集群。
有哪些值得关注的新动态?
今日在Advancing AI 2026峰会上,AMD推出了AMD Helios机架级解决方案,这一全新机架级AI基础设施旨在为前沿AI、大规模推理和基础模型训练而设计。AMD Helios将AMD Instinct MI455X GPU、第六代AMD EPYC服务器CPU、AMD ROCm软件和AMD Pensando网络整合到统一的机架级架构中,可提供百亿亿次级(exaflop-class)AI性能、业界领先的内存容量和带宽和卓越的可扩展性。
为什么这项进展值得关注?
随着对AI工厂和前沿AI的需求不断增长,客户需要能够从单一机架高效扩展至大型吉瓦级(gigawatt-scale)AI集群,同时还能最大化性能、每瓦性能和每token成本的基础设施。AMD Helios则提供了集成式的机架构建模块,既能简化部署,又可以为下一代AI基础设施提供所需的计算、网络和开放软件基础。AMD Helios机架级AI解决方案在低、中、高三种交互水平下均展现出更高的token吞吐性能,且从设计之初就采用了开放式架构。该解决方案旨在帮助客户在部署的每台机架上都能获得更多输出。
AMD在其中发挥了怎样的作用?
“前沿AI基础设施正在快速演进,客户需要既能提供卓越性能,同时又能随着工作负载的增长实现高效扩展的平台。AMD Helios将领先的计算能力、高性能网络和开放软件整合到统一的机架级平台中。这些技术的结合,为客户提供了灵活性,以加速大规模推理、前沿模型训练和下一代AI基础设施。”
-- AMD人工智能事业部高级副总裁Vamsi Boppana
何为AMD Helios机架级解决方案?
AMD Helios通过提供开放式机架级架构扩展了AMD AI产品组合,旨在支持从单个机架到多机架集群的大规模推理、前沿模型训练和微调。AMD推出AMD Helios之际,正值AI正在重塑现代基础设施,其需要能够将高性能计算、机架级架构和开放软件紧密集成的平台。
- 专为前沿AI而打造:AMD Helios是AMD专为前沿AI和AI工厂部署而打造机架级AI基础设施平台。它将第五代AMD Instinct GPU、第六代AMD EPYC服务器CPU、AMD Pensando网络和AMD ROCm软件整合到一个基于开放标准的统一平台中,为大规模推理、前沿模型训练和微调提供可扩展基础。
- 领先的机架性能:AMD Helios采用针对大规模推理和前沿模型开发进行过优化的统一架构,可提供百亿亿次级AI性能。其单个架构可提供最高可达2.9 exaflops的峰值FP4性能、1.4 exaflops的峰值FP8性能、31TB HBM4内存和每秒1.7PB的内存带宽。
- 可扩展AI:AMD Helios旨在实现从单个机架到吉瓦级AI集群的扩展,其每个机架集成了18个符合Open Rack Wide标准的四颗GPU计算托盘(共计72颗GPU),可为集群部署和扩展提供统一的构建模块。在集群规模下,AMD Pensando Vulcano 800 AI NIC也可提供支持分布式推理、前沿模型训练和超大规模快速扩展所需的高带宽和低延迟连接。
- 开放式基础设施:AMD Helios将用于纵向高性能扩展的UALink over Ethernet (UALoE),与符合超以太网联盟(Ultra Ethernet Consortium)标准且用于横向扩展的以太网技术相结合,使客户能够利用开放且基于标准的技术构建AI基础设施。该平台还集成了多层防御的机架级安全功能。AMD ROCm软件可在机架和集群部署中实现高吞吐量推理和统一的分布式训练。
前瞻性声明
本博文可能包含有关Advanced Micro Devices, Inc(AMD)的前瞻性声明,均依据《1995 年美国私人证券诉讼改革法案》(Private Securities Litigation Reform Act of 1995)中的“安全港”条款(Safe Harbor)作出。前瞻性声明通常可通过“将(would)”“可能(may)”“预计(expects)”“相信(believes)”“计划(plans)”“打算(intends)”“预测(projects)”以及其他具有类似含义的词语加以识别。敬请投资者注意,本博文中的前瞻性声明均基于当前的判断、假设和预期,仅代表截至本新闻稿发布之日的观点,仅代表截至本博文发布之日的观点,并涉及可能导致实际结果与当前预期存在重大差异的风险和不确定性。上述声明受到多项已知及未知风险和不确定性的影响,其中许多因素难以预测,且通常超出 AMD 的控制范围。这些因素可能导致实际结果及其他未来事件与前瞻性声明中明示、暗示或预测的内容存在重大差异。建议投资者详细查阅 AMD 向美国证券交易委员会(SEC)提交的相关文件中披露的风险因素及不确定性,包括但不限于 AMD 最近提交的 Form 10-K 年度报告及 Form 10-Q 季度报告。
除法律要求外,AMD不承担且特此声明不承担更新本博文中所作前瞻性声明的任何义务。
关于AMD
AMD(纳斯达克代码:AMD)致力于推动高性能和人工智能计算创新,助力应对全球重大挑战。如今,AMD的技术驱动数十亿应用体验,广泛用于云和人工智能基础设施、嵌入式系统、AI PC及游戏领域。凭借一系列面向人工智能优化的CPU、GPU、网络技术及软件的丰富产品组合,AMD提供全栈式人工智能解决方案,为智能计算新时代带来所需的卓越性能与可扩展性。更多信息,敬请访问AMD公司官网www.amd.com。
媒体库
查找并下载最新的 AMD 公司和产品标识、图像和幕后花絮素材。