智能体 AI 革新 CPU/GPU 算力格局
May 08, 2026
如今,在许多基础设施规划会议中,都会出现类似这样的讨论:“智能体 AI 将会改变 CPU 与 GPU 的算力配比。那我们只需给 GPU 服务器加装更多 CPU 就行了,是吧?”
这个思路似乎合乎逻辑,但恰恰是很多人走入误区的地方。
从聊天机器人式 AI 向智能体 AI 的转变,绝非只是在原本以 GPU 为核心的机架设计中多加几颗 CPU 那么简单。它的意义远不止于此,而是数据中心架构层面的结构性变革。智能体 AI 正在催生对全新机架级 CPU 服务器的需求。这些服务器将与 GPU 基础设施并排部署,为所有智能体的工作提供算力支持。
对于企业 IT 领导者而言,这带来了一个重要启示:智能体 AI 正在重写 AI 基础设施的算力格局。
在 AMD,我们一直在密切关注这场变革。我们此前预测服务器 CPU 市场将以每年 18% 的速度增长,但智能体带来的结构性算力需求增长,彻底改变了这一测算。我们目前预计,服务器 CPU 的总潜在市场规模年增长率将超过 35%,到 2030 年市场规模将超过 1200 亿美元。
第一波浪潮:聊天机器人 AI 主要依赖模型响应
生成式 AI 的第一波浪潮建立在一个相当简单的模式之上:用户提问;应用向模型发送提示;模型生成响应;应用返回结果。
这种架构自然而然催生了以 GPU 为核心的设计。在这些部署中,CPU 充当包含 4 到 8 个 GPU 的服务器的“头节点”。这个头节点 CPU 负责调度、I/O 和系统管理,而繁重的数学计算则交由 GPU 处理。
智能体 AI 绝非“聊天加工具”
我们现在正处于智能体 AI 时代的早期阶段。在这个时代,工作负载的形态发生了根本性的改变。智能体不再只是针对单个提示给出回答,而是能将一个目标拆解为多个步骤、决定下一步行动、调用多个模型、查询数据库、连接 API、运行企业级应用、检查权限、检索记忆、验证输出,然后再次循环这一过程。因此,智能体的基础设施需求与“输入提示、输出答案”的聊天机器人 AI 截然不同。
GPU 在模型执行方面依然至关重要,但实际的生产工作负载如今高度依赖 CPU。CPU 需要负责以下工作:
- 编排:管理拆解复杂任务的引擎。
- 智能体执行与工具调用:触发 API 和传统企业软件。
- 策略与安全:针对每一项自主操作进行实质性的合规检查。
面对 CPU 与 GPU 算力格局变革,不能只靠“增加更多 CPU”来应对
在聊天机器人 AI 时代,CPU 与 GPU 的算力配比通常是 1:4 到 1:8。而现在,智能体 AI 正在推动这一比例向 1:1 迈进,在某些情况下,CPU 的比重甚至更高。
关键在于:无法简单地通过在搭载多个 GPU 的机箱内增加 CPU 来实现这一点,而是必须引入一个全新设计的 CPU 算力层。
对于企业 IT 领导者来说,这正是基础设施规划需要演进的方向。
未来几年的首选 AI 系统将不再是一个单一的“AI Box”,而更像是一个分布式系统。您需要 GPU 机架来支持高密度模型计算、高速网络,以及能让一切保持可观测、安全和高效的软件栈。与此同时,您还需要智能体 CPU 机架来负责编排、数据处理和工具执行。
在这一阶段,均衡的架构比以往任何时候都更加重要。如果 CPU 层配置不足,GPU 便会闲置等待。如果网络在后期才做规划,智能体运行将陷入停滞。如果数据路径混乱,延迟就会增加。如果编排层未针对并发场景优化,成本与复杂度都会大幅增加。
AMD 如何满足需求
AMD EPYC(霄龙)处理器为客户提供了一系列针对 AI 流水线中不同环节优化的 CPU 选择:既有面向延迟敏感型工作负载的高频 CPU,也有满足横向扩展高吞吐需求的高密度多核心 CPU。我们将依托当前产品路线图不断巩固技术领先优势,其中代号为“Venice”的产品将进一步扩充我们的 AI 优化型 CPU 产品阵容。总而言之,我们提供的专用芯片可精准满足您数据中心的每个机架(以及云环境中的每个计算实例)的算力需求。
面向 IT 领导者的实用建议:
我重申一遍,智能体 AI 正在改变基础设施的算力格局。
在此,我想向企业 IT 决策者们发出以下呼吁:当智能体 AI 从试点阶段迈入生产落地时,切勿沿用向企业部署聊天机器人的思路来规划基础设施配置。您应将智能体当作一种“全新类别的数字劳动力”来规划资源:这类智能体会全天候自主规划、执行操作、校验结果、检索数据、调用工具以及运行工作流程。
这意味着所需的 CPU 算力规模要高于此前传统 AI 部署场景的测算值。这还意味着,不能只着眼 GPU 服务器本身,还要统筹考量机架、网络互联、配套软件以及运行负载均衡。步入智能体 AI 时代,单一处理器包揽全部任务的模式无法实现高性能。高性能来源于合理的架构:CPU 与 GPU 协同工作,推动 AI 从“给出答案”真正迈向“采取行动”。
前瞻性声明
本博客包含有关 AMD 的前瞻性声明,例如服务器 CPU 总潜在市场规模的预期增速。这些声明根据美国 1995 年《私人证券诉讼改革法》的“安全港”条款作出。前瞻性声明通常带有如“将”、“应该”、“预期”、“相信”、“计划”、“打算”、“预计”及其他具有相似含义的词语。投资者应注意,本文稿中的前瞻性陈述基于当前的看法、假设和预期,仅代表本文发表当日的观点,并且涉及许多风险和不确定性,可能导致实际结果与当前预期之间存在重大差异。这些前瞻性陈述关系到许多已知和未知的风险和不确定性,许多因素很难预测并且基本不在 AMD 的可控范围之内,可能导致实际结果和未来进展与这些前瞻性信息和陈述所陈述、暗示或预计的情况存在重大差异。我们强烈建议投资者查阅 AMD 在美国证券交易委员会备案的相关文件,详细了解有关的风险和不确定性,包括但不限于 AMD 最近提交的 10-K 和 10-Q 表报告。
除非法律要求,否则 AMD 无义务并且不负责随时更新本文稿中的前瞻性声明。