AI 部署

企业面临的挑战

各行业对 AI 的需求都在持续加速增长。尽管 AI 具备显著优势并且可大幅提升生产力,但如何构建适配自身需求的基础设施是企业面临的一大难题。由于工作负载在不断变化,需求也会随之波动。此外,工具持续迭代,新的可能性层出不穷。企业可能难以跟上 AI 发展步伐,甚至连起步都困难重重。

多数企业客户都面临以下挑战:

碎片化工具:不可预测的运行环境和碎片化工具,导致企业无法清晰掌握资源情况并有效利用资源,这致使客户对资源状况一无所知,难以优化工作流程。

纷繁复杂的基础设施:封闭型平台、多种配置下的复杂工作负载、缺乏针对性的性能优化,这些问题会拖慢企业 AI 部署进度,造成性能瓶颈。

投资回报 (ROI) 不明确:企业经常会问:“AI 究竟有多大的价值潜力?应投入多少成本,才能达到预期成果?”如果没有团队专门负责推进 AI 落地,企业无法清晰判断 AI 能能带来什么。

因此,要实现 AI 长期落地应用,关键在于确保 AI 能够切实满足企业客户的需求。当前 AI 软硬件环境相互割裂,企业只能自行集成各种解决方案。而 AMD 企业级 AI 参考技术栈可以解决这一困境。

该技术栈基于开源技术而构建,是兼具一体化和模块化优势的卓越平台,可帮助企业跨越 AI 实验阶段,并利用 AI 创造切实业务价值。AMD 企业级 AI 参考技术栈可加快 AI 部署速度、优化现有运营流程、充分提高投资回报,同时充分释放您向客户提供的硬件的巨大潜力,并拓展企业 AI 的应用边界。

携手值得信赖的生态合作伙伴,赋能企业 AI 发展

AMD 与 VMware、Nutanix、Red Hat、Canonical、SUSE 等各大 OSV 厂商深度合作,推出适配 AMD 硬件、经过深度优化的企业级 AI 解决方案。得益于 AMD 及其合作伙伴的支持,企业能够在混合云环境、虚拟化环境、本地环境中部署可灵活扩展、安全可靠且可互操作的 AI 应用;与此同时,依托经过验证的软件栈以及经过性能优化的 AMD Instinct GPU 和基于 AMD 技术的基础设施,企业可加快 AI 部署速度。

快速实现 AI 就绪

AMD 企业级 AI 参考技术栈深度解析

AMD 企业级 AI 参考技术栈包含四大独立组件,这些组件成套交付,但同时也支持模块化自由组合,以便企业客户能够根据自身应用场景仅选择所需的组件。该技术栈也非常容易上手。客户可在短短数分钟内就基于裸机硬件完成生产级 AI 部署。

AMD 资源管理器
AMD 资源管理器通过提供多种视图与功能,帮助客户全面掌控并管理基础设施;例如,通过资源仪表板,可深度了解集群、GPU 节点等资源的整体运行状况。此外,资源管理器支持智能工作负载调度、资源配额管控,以及基于 Ray 集成的分布式调度,可帮助客户优化 GPU 利用率和加强成本控制;与此同时,通过提供具有实用价值的遥测数据,可提升吞吐量、保障多团队资源分配公平性和合理资源规划。

AMD AI 工作台
AMD AI 工作台不仅提供动态工作空间、预构建的基础模型微调流水线,还支持推理部署,可简化从原型设计到正式投产的全流程,从而助力企业加快 AI 开发进度并提升协作效率。
AMD AI 工作台内置针对 AMD 计算技术深度优化的开源模型库,同时支持便捷部署 Visual Studio Code、JupyterLab 等交互式工具,让企业开发者可以在熟悉的集成开发环境 (IDE) 中快速完成 AI 应用原型设计与开发。

AMD 推理微服务 (AIM)
AIM 提供预构建、经过优化的容器,其中包含 AI 模型、推理引擎以及在 AMD 平台上运行所需的特定配置,从而实现更快速、更高效的部署。AIM 支持各类开源模型与 OpenAI 兼容 API,同时具备智能硬件识别与调谐能力,可帮助充分优化性能和成本效益。

AMD 解决方案蓝图
AMD 解决方案蓝图提供预构建、经过验证的设计,可助力企业加快项目进程、降低工程成本,并实施可复用的生产就绪型解决方案。这些蓝图可填补原始 AI 模型与可用业务工具之间的落地鸿沟,为构建常用企业级 AI 应用提供开箱即用的开发起点。

核心优势,一目了然

四大组件协同配合,消除落地阻力,助力企业客户解决当前面临的各种瓶颈与资源缺口,从而充分释放 AI 的无限潜力。如今,AMD 合作伙伴不再只是提供硬件,而是可向企业客户交付可直接投入生产使用的完整 AI 解决方案。

轻松迁移:AMD 推理微服务提供采用 OpenAI 兼容 API 的硬件感知型容器,可支持当前使用其他平台的客户实现无缝迁移。借助企业级 AI 参考技术栈,客户能够快速完成上线部署并开始使用 AI,进一步简化迁移流程。

充分提高投资回报:AMD 资源管理器可帮助客户杜绝 GPU 闲置和资源浪费,充分释放硬件投资价值,同时在多个团队之间高效分配计算资源。

提高生产力:AMD AI 工作台支持团队快速完成模型测试和微调并直接将模型部署至硬件,从而缩短投产周期,并确保全新基础设施从第一天开始就能充分释放投资价值。

简化部署:依托 AMD 解决方案蓝图,企业客户无需配备大批 AI 工程师。提供的参考设计开箱即用,可满足文档检索、自动化编码助手等常见企业需求。所有参考设计均经 AMD 预先验证且适配 AMD 硬件,可助力企业客户快速完成部署并运行 AI 工作负载。

全面开放的 AI 技术栈

不同于专有解决方案,AMD 企业级 AI 参考技术栈基于开放式技术而构建,支持客户自主掌控技术栈并自行控制安装部署。

如需深入了解企业级 AI 参考技术栈,以及它能为企业客户带来的无限可能,请联系 AMD 代表。

AMD Arena


参与关于 AMD 产品的培训,深入了解 AMD AI 解决方案、AMD EPYC(霄龙)服务器 CPU、AMD Instinct GPU 及更多其他产品,有效精进专业能力。