Descripción general
AMD CDNA™ es la arquitectura de procesamiento dedicada que subyace a las GPU y APU AMD Instinct™. Cuenta con un embalaje avanzado que unifica las tecnologías de chiplet AMD y HBM (High Bandwidth Memory, memoria de alto ancho de banda), una estructura de arquitectura Infinity de alto rendimiento, y ofrece tecnología avanzada Matrix Core que admite un conjunto completo de formatos de datos de IA y HPC, diseñado para reducir el movimiento excesivo de datos y mejorar el ahorro de energía.
Tabla de comparación entre generaciones:
| CDNA | CDNA 2 | CDNA 3 | CDNA 4 | CDNA 5 | |
| Tecnología de procesos | FinFET de 7 nm | FinFET de 6 nm | FinFET de 5 nm + 6 nm | FinFET de 3 nm + 6 nm | FinFET de 2 nm + 3 nm |
| Transistores | 25 600 millones | Hasta 58 000 millones | Hasta 146 000 millones | Hasta 185 000 millones | Hasta 320 000 millones |
| CU | Núcleos de matriz | 120 | 440 | Hasta 220 | 880 | Hasta 304 | 1216 | 256 | 1024 | 256 (WGP)** |
| Tipo de memoria | 32 GB de HBM2 | Hasta 128 GB de HBM2E | Hasta 256 GB de HBM3 | HBM3E | 288 GB de HBM3E | 432 GB de HBM4 |
| Ancho de banda de memoria (máximo) | 1,2 TB/s | Hasta 3,2 TB/s | Hasta 6 TB/s | 8 TB/s | 23,3 TB/s |
| AMD Infinity Cache™ | N/D | N/D | 256 MB | 256 MB | N/D |
| Coherencia de la GPU | N/D | Caché | Caché y HBM | Caché y HBM | Caché y HBM |
| Compatibilidad con tipos de datos | INT4, INT8, BF16, FP16, FP32 y FP64 | INT4, INT8, BF16, FP16, FP32 y FP64 | Matriz: INT8, FP8, BF16, FP16, TF32, FP32, FP64 Vector: FP16, FP32, FP64 Sparsity: INT8, FP8, BF16, FP16 |
Matriz: MXFP4, MXFP6, INT8, MXFP8, OCP FP8, BF16, FP16, TF32*, FP32, FP64 Vector: FP16, FP32, FP64 Sparsity: OCP-FP8, INT8, FP16, BF16 |
OCP: MXFP4, MXFP6, MXFP8, FP8 Matriz: INT8, BF16, FP16, FP32, FP64 Vector: FP16, FP32, FP64 Sparsity: INT8, FP16 y BF16 |
| Productos | AMD Instinct™ Serie MI100 | AMD Instinct™ Serie MI200 | AMD Instinct™ Serie MI300 | AMD Instinct™ Serie MI350 | AMD Instinct™ Serie MI400 |
* TF32 es compatible con la emulación de software.
** La arquitectura AMD CDNA™ 5 utiliza procesadores de grupos de trabajo (WGP) avanzados.
Presentamos la Arquitectura AMD CDNA™ 5
AMD CDNA™ 5 es la arquitectura de procesamiento dedicada que subyace a las GPU AMD Instinct™ Serie MI400. Cuenta con un empaque avanzado con tecnologías de chiplet, diseñado para reducir el movimiento excesivo de datos y mejorar el ahorro de energía.
La GPU AMD Instinct™ MI455X, diseñada específicamente para la nueva solución a escala de rack de 72 GPU AMD Helios™, es el primer producto presentado basado en la arquitectura AMD CDNA 5 con funciones mejoradas para el escalado de IA moderno en implementaciones de IA de frontera. El lanzamiento de la GPU AMD Instinct MI430X para IA soberana y HPC está planificado para el 2027 y podría contar con diferentes funciones habilitadas de AMD CDNA 5.
GPU AMD Instinct™ MI455X
Empaque avanzado
AMD CDNA 5 ofrece una arquitectura de chiplets avanzada que distribuye las funciones de procesamiento, memoria, caché y E/S entre chips especializados para optimizar cada función de forma independiente en términos de rendimiento y consumo energético.
Los chips de procesamiento con unión híbrida 3D están apilados y conectados mediante interconexiones de chip a chip de alta densidad para mejorar la densidad de procesamiento y las eficiencias. AMD CDNA 5 integra 432 GB de memoria HBM4 de última generación en 12 pilas con un ancho de banda de 23,3 TB/s y utiliza la interconexión AMD Infinity Fabric™ para comunicaciones en paquete de baja latencia y alto ancho de banda entre el procesamiento, la memoria y los chips de E/S en el paquete avanzado CoWoS-L para permitir la memoria y la escala de ancho de banda necesarios para el escalamiento moderno de IA.
Procesamiento mejorado
AMD CDNA 5 ofrece una nueva arquitectura de procesadores de grupo de trabajo (WGP) con un mayor rendimiento por reloj para las GPU AMD Instinct™ Serie MI400. La nueva arquitectura permite la ejecución de Wave32 para reducir la sobrecarga de sincronización y mejorar la utilización de SIMD, e incorpora un motor avanzado de operaciones matemáticas para IA con nuevas instrucciones de tanh y un mayor rendimiento de operaciones trascendentales.
Tipos de datos de IA avanzados de baja precisión MXFP8, MXFP6 y MXFP4 con escala de bloque 16/32 y escalamiento fraccional de hasta 4 veces el rendimiento en comparación con las GPU AMD Instinct de la generación anterior1.
Sistema de memoria mejorado
Las GPU AMD Instinct Serie MI400 elevan el estándar en capacidades de memoria, ya que ofrecen 432 GB de HBM4, líderes en la industria, con un ancho de banda de 23,3 TB/s por GPU, y mejoran la caché y la jerarquía de memoria para modelos cada vez más grandes, ventanas de contexto y cachés KV.
Las GPU AMD Instinct MI455X en la solución a escala de rack de AMD Helios ofrecen un sistema de memoria de pod compartido HBM4 de 31 TB con 72 GPU, comunicaciones integrales, un solo salto mediante una Fabric UALoE para grandes cargas de trabajo de modelo de IA.
Fabric y E/S unificadas
AMD Infinity Architecture, junto con la tecnología AMD Infinity Fabric™, permite la comunicación coherente y de alto rendimiento en el encapsulado entre la tecnología de chiplets de las GPU AMD, la memoria HBM4 apilada, las cachés L2 y los chips de E/S en dispositivos individuales y en plataformas multidispositivo.
Cada EAM de GPU AMD Instinct MI455X, diseñada para la solución a escala de rack de 72 GPU AMD Helios, incluye dos chips de E/S mejorados con 2 NIC compatibles con PCIe® 6 o 3 AMD AI NIC. Cada EAM de GPU también incluye 36 enlaces UALoE (x2) (bidireccionales) para una ampliación de alto ancho de banda en soluciones a nivel de rack AMD Helios.
Eficiencias mejoradas
La arquitectura AMD CDNA 5 también aporta eficiencias de GPU mejoradas reduciendo el tráfico de memoria y los ciclos de inactividad para aumentar el rendimiento entregado. Algunas de las principales innovaciones incluyen un Tensor Data Mover (TDM) para realizar transferencias globales asíncronas directas a LDS sin almacenamiento intermedio en registros, una función de multidifusión de L2 que permite que una captura de memoria sirva a varios WGP para eliminar el tráfico de memoria redundante, barreras con nombres divididos para una sincronización más eficiente y agrupación WGP para la cooperación entre varios WGP en operaciones de matriz.
AMD CDNA™ 4
AMD CDNA™ 4 es la arquitectura de procesamiento dedicada que subyace a las GPU AMD Instinct™ Serie MI350. Cuenta con un empaque avanzado con tecnologías de chiplet, diseñado para reducir el movimiento excesivo de datos y mejorar el ahorro de energía.
GPU AMD Instinct Serie MI350
AMD CDNA 3
AMD CDNA 3 es la arquitectura de procesamiento dedicada que subyace a las GPU AMD Instinct™ Serie MI300. Cuenta con un empaque avanzado con tecnologías de chiplet, diseñado para reducir el movimiento excesivo de datos y mejorar el ahorro de energía.
APU AMD Instinct MI300A
GPU AMD Instinct MI325X
AMD CDNA 2
La arquitectura AMD CDNA 2 está diseñada para acelerar las cargas de trabajo informáticas científicas y las aplicaciones de aprendizaje automático más exigentes que existen. Subyace a las GPU AMD Instinct Serie MI200.
AMD CDNA
La arquitectura de AMD CDNA es una arquitectura dedicada para el procesamiento basado en GPU que fue diseñada para ser pionera en la informática de clase de exaescala. Subyace a las GPU AMD Instinct Serie MI100.
Aceleradores AMD Instinct
Descubre cómo las GPU AMD Instinct establecen nuevos estándares para la IA generativa, el entrenamiento y la HPC.
Software AMD ROCm™
La arquitectura de AMD CDNA es compatible con el software AMD ROCm™, una pila de software abierto que incluye un amplio conjunto de modelos de programación, herramientas, compiladores, bibliotecas y tiempos de ejecución para el desarrollo de soluciones de IA y HPC dirigidas a las GPU AMD Instinct.
Notas al pie
* Es posible que algunas de las funciones descritas anteriormente no estén disponibles para todas las GPU AMD Instinct™ Serie MI400.
1. Basado en los cálculos de los laboratorios de rendimiento de AMD (junio del 2026) con una GPU AMD Instinct™ MI455X, rendimiento de precisión teórico máximo (matriz/vector FP32, FP16, BF16, MXFP6, MXFP8, FP8 y MXFP4), en comparación con las especificaciones publicadas para las GPU AMD Instinct™ MI355X, MI350X, MI325X, MI300X, MI250X y MI100. Los resultados pueden variar según la configuración del sistema y el tipo de datos. MI400-006
* Es posible que algunas de las funciones descritas anteriormente no estén disponibles para todas las GPU AMD Instinct™ Serie MI400.
1. Basado en los cálculos de los laboratorios de rendimiento de AMD (junio del 2026) con una GPU AMD Instinct™ MI455X, rendimiento de precisión teórico máximo (matriz/vector FP32, FP16, BF16, MXFP6, MXFP8, FP8 y MXFP4), en comparación con las especificaciones publicadas para las GPU AMD Instinct™ MI355X, MI350X, MI325X, MI300X, MI250X y MI100. Los resultados pueden variar según la configuración del sistema y el tipo de datos. MI400-006