GPU AMD Instinct™ Serie MI400
IA de frontera líder, IA soberana y HPC
Las GPU AMD Instinct™ Serie MI400 ofrecen una base abierta impulsada por el software AMD ROCm™, capaz de escalar desde implementaciones a hiperescala hasta entornos de HPC, de IA soberana y de investigación. Creadas con base en estándares abiertos, además de virtualización y particionamiento para la asignación de recursos, las GPU AMD Instinct Serie MI400 mantienen la coherencia en modelos, herramientas y operaciones a gran escala.
La cartera abarca desde la solución a escala de rack AMD Helios™ con tecnología de 72 GPU AMD Instinct MI455X para la IA de frontera, hasta la GPU AMD Instinct MI430X para la IA soberana y HPC, lo que permite a los clientes seleccionar la plataforma adecuada para sus necesidades sin sacrificar la coherencia, la flexibilidad ni la escalabilidad.
En segundo plano
Las GPU AMD Instinct se basan en la arquitectura de AMD CDNA™, que ofrece chiplet avanzado, memoria de HBM y caché, y tecnologías AMD Infinity Fabric™ para las GPU AMD Instinct. La arquitectura AMD CDNA ofrece tecnologías de núcleos matriciales y vectoriales para admitir una amplia gama de tipos de datos, desde los altamente eficientes OCP MXFP 8/6/4 (incluida la compatibilidad con dispersión de INT8 y FP16/BF16 para IA) hasta el más exigente FP64 para HPC.
Beneficios
- Diseño de rack
- Rendimiento líder
- Avances de GPU
- Software y ecosistema
Diseño de rack
Solución de infraestructura de IA totalmente integrada a escala
El diseño de la solución a escala de rack AMD Helios es una infraestructura de IA totalmente integrada que combina las últimas GPU AMD Instinct™, CPU para servidores AMD EPYC™ y redes AMD Pensando™, desarrollada a partir de estándares abiertos de la industria para permitir la inferencia a gran escala, el entrenamiento de modelos de frontera y el ajuste fino.
Rendimiento líder
Rendimiento de GPU y rack líder
La solución a escala de rack AMD Helios ofrece una enorme salida de tecnología de IA integrada a nivel de rack: rendimiento de clase exaFLOP diseñado para la inferencia a hiperescala, el entrenamiento y el ajuste fino a gran escala. A escala de rack, AMD Helios ofrece hasta 2,9 exaFLOPS de rendimiento máximo en OCP MXFP4, 1,4 exaFLOPS de rendimiento máximo en OCP MXFP8, 31 TB de memoria HBM4 y 1,67 PB/s de ancho de banda de memoria.
Avances de GPU
El empaque avanzado de GPU permite escalar la IA de próxima generación
La GPU AMD Instinct™ MI455X aporta innovaciones clave para posibilitar el escalado de la IA de próxima generación. La arquitectura de chiplet optimiza las funciones de procesamiento, memoria, caché y E/S independientemente para mejorar el rendimiento, la potencia y la fabricación. Los troqueles de procesamiento unidos por híbridos 3D apilados de la GPU AMD Instinct MI455X utilizan interconexiones de alta densidad para ofrecer una mayor densidad de procesamiento y un rendimiento mejorado.
Los 432 GB integrados (12 pilas) de memoria HBM4 de próxima generación con 23,3 TB/s de ancho de banda permiten que los modelos más grandes, las cachés de KV y las activaciones permanezcan en la memoria local.
Todo integrado mediante nuestra interconexión AMD Infinity Fabric™ de alto ancho de banda, que ofrece comunicaciones de baja latencia en un paquete CoWoS-L avanzado para permitir la próxima generación de escalamiento de IA.
Software y ecosistema
Libertad de software abierto, diseñado para escalar
El software AMD ROCm™ potencia la solución a escala de rack AMD Helios con plataformas AMD Instinct MI455X, al transformar las innovaciones de las GPU a nivel de kernel en resultados de producción confiables para la inferencia, el entrenamiento y el ajuste fino. El software ROCm posibilita una ejecución distribuida predecible con primitivas de comunicación (RCCL), optimizaciones de caché de KV y superposición de procesamiento y comunicación adaptadas para escalas de nivel exaFLOP.
Probado a exaescala y listo para operadores, el software AMD ROCm ayuda a los clientes a realizar implementaciones más rápidas, escalar de forma confiable desde racks hasta sistemas de clase exascala y mantener la portabilidad en las implementaciones de plataformas y la solución a escala de rack AMD Helios con GPU AMD Instinct MI455X y MI430X.
La infraestructura de IA a escala de rack más potente1
Rendimiento del rack líder en la industria para IA a hiperescala
El diseño de la solución a escala de rack AMD Helios es una infraestructura de IA totalmente integrada que combina las últimas GPU AMD Instinct™, CPU para servidores AMD EPYC™ y redes AMD Pensando™, desarrollada a partir de estándares abiertos de la industria para permitir la inferencia a gran escala, el entrenamiento de modelos de frontera y el ajuste fino.
Rendimiento de liderazgo para IA de frontera
Conoce las GPU AMD Instinct™ Serie MI400
GPU AMD Instinct™ MI455X
Basada en la arquitectura AMD CDNA™ de 5.ª generación, la GPU AMD Instinct™ MI455X está diseñada específicamente para la solución a escala de rack de AMD Helios, que ofrece un rendimiento de IA líder para brindar compatibilidad de IA de frontera con la capacidad de IA moderna para inferencia, entrenamiento y ajuste fino.
Comparaciones de especificaciones de la GPU AMD Instinct MI455X
Hasta un 26 % del rendimiento de IA en comparación con las GPU de la competencia2
- Rendimiento de IA
- Memoria
Rendimiento de IA
(PFLOPS máximos)
FP4.
FP8 | FP6
FP16 | BF16
AMD Instinct MI455X
Vera Rubin de NVIDIA
Memoria
Capacidad de memoria
Ancho de banda de memoria
AMD Instinct MI455X
Vera Rubin de NVIDIA
GPU AMD Instinct™ MI430X
Potencia al máximo la IA para la ciencia y la HPC
La GPU AMD Instinct™ MI430X está diseñada para la HPC científica y la IA soberana, combinando la exactitud de FP64 para simulación y modelado con una capacidad de IA moderna para inferencia, entrenamiento y ajuste fino.
Diseñado sobre un ecosistema de software abierto
Casos de estudio
Opciones de implementación de AMD Instinct
Preguntas frecuentes
- Solución a escala de rack AMD Helios
- GPU AMD Instinct MI455X
- GPU AMD Instinct MI430X
Solución a escala de rack AMD Helios
La solución a escala de rack AMD Helios es el primer diseño de referencia de IA a escala de rack AMD, creado íntegramente conforme al nuevo estándar Open Rack Wide (ORW) de Meta presentado al Open Compute Project (OCP). Combina 72 GPU AMD Instinct MI455X, CPU AMD EPYC™ y DPU AMD Pensando™, junto con otros componentes líderes, en un rack ORW de doble ancho y abierto, diseñado para los centros de datos de escala de IA actuales.
En la Cumbre Global de OCP, Meta presentó un nuevo Open Rack para IA con el formato ORW. AMD se alinea con este diseño abierto mediante la solución a escala de rack AMD Helios, que presenta el primer rack completo basado en los estándares ORW. Demuestra el compromiso de AMD con la apertura, desde el chip hasta el sistema, el rack y los clústeres a gran escala.
Los racks OCP anteriores eran de ancho simple y se centraban en servidores de uso general. ORW introduce un rack de doble ancho optimizado para sistemas de IA de alta densidad, lo que brinda mayor potencia, refrigeración líquida y bandejas más anchas para dar cabida a nodos aceleradores grandes. La solución a escala de rack AMD Helios aprovecha ORW para integrar GPU, CPU, DPU y otros componentes en un sistema de IA unificado, mantenible y fácil de implementar.
Una solución a escala de rack AMD Helios completa ofrece hasta 1,4 exaFLOPS de procesamiento en FP8, 2,9 exaFLOPS de procesamiento en FP4 y 31 TB de memoria HBM4, lo que permite el entrenamiento de modelos de IA con billones de parámetros y la inferencia de IA a gran escala.
Cada GPU AMD Instinct MI455X utiliza la arquitectura AMD CDNA™ de última generación, con 432 GB de memoria HBM4 y hasta 23,3 TB/s de ancho de banda: ideal para la inferencia y el entrenamiento de modelos de IA de clase de frontera. Cada GPU ofrece hasta 40 PFLOPS de FP4 y 2,9 EF de FP4 por solución a escala de rack AMD Helios.
La solución a escala de rack de AMD Helios es la primera solución de rack ORW de doble ancho diseñada para operaciones en el mundo real, que combina bandejas modulares y facilidad de servicio con un rendimiento sostenido en centros de datos con restricciones de energía. Reduce la fragmentación, ya que reemplaza los diseños exclusivos y de un solo uso por estándares abiertos, como OCP, UALink y UEC, lo que permite crear clústeres de IA eficientes y de alto rendimiento a escala.
Es un diseño de referencia, no un producto a la venta. La solución a escala de rack de AMD Helios es un modelo para que los socios OEM y ODM construyan sus propios sistemas de marca basados en estándares ORW abiertos.
La plataforma cuenta con tecnología AMD ROCm™, un conjunto de software de IA y HPC de código abierto con compatibilidad de fábrica para PyTorch, TensorFlow, JAX, ONNX Runtime, vLLM y Triton. Se escala desde una única GPU a superclústeres de varios racks y evita el bloqueo del proveedor.
El diseño de referencia de la solución a escala de rack de AMD Helios se está compartiendo con los socios en este momento, y se esperan implementaciones a gran escala en el segundo semestre del 2026.
GPU AMD Instinct MI455X
Las GPU AMD Instinct™ MI455X potencian la solución a escala de rack de AMD Helios y proporcionan la capacidad de liderazgo por dispositivo que se acumula a través de bandejas repetibles de 4 GPU en 72 GPU AMD Helios para lograr resultados predecibles y reemplazables de clase exaFLOP.
Las GPU AMD Instinct™ MI455X proporcionan:
- Hasta 40 PFLOPS de rendimiento máximo en 4 bits
- Hasta 20 PFLOPS de rendimiento máximo en 8 bits
- 432 GB de HBM4
- Ancho de banda de memoria de 23,3 TB/s
Estas capacidades se agregan a través de bandejas repetibles de 4 GPU en la solución a escala de rack 72 GPU AMD Helios.
La memoria se ha convertido en una de las consideraciones más importantes para la infraestructura de IA a medida que los modelos continúan aumentando en tamaño y complejidad. Cada GPU AMD Instinct MI455X ofrece 432 GB de memoria HBM4, mientras que un rack Helios completo ofrece 31 TB de memoria HBM4. En combinación con un alto ancho de banda de memoria, esto permite a los clientes admitir modelos más grandes, reducir la complejidad de la infraestructura y escalar de manera eficiente las cargas de trabajo de entrenamiento e inferencia con un uso intensivo de memoria.
GPU AMD Instinct MI430X
La GPU AMD Instinct™ MI430X es una nueva GPU diseñada específicamente para la IA soberana, la informática científica y la computación de alto rendimiento (HPC). La GPU AMD Instinct MI430X está diseñada para admitir cargas de trabajo de IA y HPC convergentes combinando la memoria HBM4 líder en la industria, el procesamiento de FP64 de alto rendimiento y la plataforma de software abierta AMD ROCm™. Al ofrecer un rendimiento de FP64 basado en hardware con un máximo de 288 TFLOPS, AMD Instinct MI430X se diseñó para ayudar a gobiernos, instituciones de investigación y laboratorios nacionales a abordar las simulaciones y aplicaciones de IA más exigentes del mundo.
La informática científica y la IA soberana requieren cada vez más de una infraestructura capaz de respaldar tanto la HPC tradicional como la IA moderna. AMD Instinct MI430X permite a las organizaciones consolidar estas cargas de trabajo en una sola plataforma, al tiempo que mejora la eficiencia, simplifica la infraestructura y mantiene la apertura y la flexibilidad necesarias para las implementaciones a nivel nacional.
Para las gigafábricas de IA y los centros de computación de alto rendimiento, AMD Instinct MI430X está diseñada para ofrecer la fidelidad numérica y el rendimiento de procesamiento necesarios para las cargas de trabajo más exigentes. A medida que los modelos de IA de próxima generación dependen cada vez más de datos de entrenamiento generados a partir de simulaciones de alta fidelidad, AMD Instinct MI430X ayuda a investigadores e instituciones a crear sistemas de IA sobre datos científicos precisos, lo que permite una mayor confianza en los descubrimientos impulsados por IA en campos como la ciencia del clima, la investigación de materiales, la ingeniería nuclear y la dinámica de fluidos.
Las GPU AMD Instinct™ MI430X ofrecen una precisión y un rendimiento sin concesiones en flujos de trabajo convergentes de HPC e IA, con 288 TFLOPS de FP64 basado en hardware para la informática científica, junto con compatibilidad con tipos de datos e infraestructura de software para la IA moderna. Gracias a los 432 GB de HBM4 y los 2,3 TB/s de ancho de banda de memoria líderes en la industria, AMD Instinct MI430X está diseñada para grandes simulaciones y modelos con uso intensivo de memoria, lo que reduce la cantidad de servidores, disminuye la complejidad de la infraestructura y mejora la eficiencia al escalar conjuntos de datos masivos.
Se espera que el próximo sistema Discovery del DOE/ORNL de EE. UU. y dos sistemas europeos, los sistemas Alice Recoque y Herder, se implementen con GPU AMD Instinct MI430X.
Con la tecnología del software AMD ROCm™, AMD Instinct MI430X proporciona una base abierta equipada con modelos de programación, compiladores, bibliotecas, entornos de ejecución y herramientas de implementación tanto para HPC como para IA. Este compromiso con los estándares abiertos respalda la interoperabilidad y la portabilidad a largo plazo en todo el software, el sistema y las opciones de redes, lo que ayuda a los operadores soberanos a innovar sin bloqueo.
Se estima que el AMD Instinct MI430X tiene un rendimiento máximo de FLOPS en FP64 basado en hardware 8,7 veces superior al de NVIDIA Vera Rubin.
NOTAS FINALES: AMD Instinct MI400-001A: según las proyecciones de ingeniería de los laboratorios de rendimiento de AMD al mes de julio del 2026, para estimar la precisión teórica máxima de la GPU AMD Instinct™ MI430X con el tipo de datos FP64 (vectorial) en comparación con la GPU AMD Instinct MI300X y la GPU Nvidia Rubin. Los resultados están sujetos a cambios cuando los productos se lancen al mercado.
Se prevé que las GPU AMD Instinct MI430X estén disponibles en el 2027. Se ofrecerán más detalles próximamente.
Recursos
Mantente informado
Regístrate para recibir las últimas novedades sobre centros de datos y contenido de servidores
Notas al pie
- Basado en cálculos realizados por los laboratorios de rendimiento de AMD al mes de junio del 2026 para determinar el rendimiento de precisión teórica máxima de una solución a escala de rack AMD Helios utilizando tipos de datos de matriz de máximo rendimiento FP16, BF16, INT8, y los tipos de datos MXFP6, MXFP8, FP8 y MXFP4 de máximo rendimiento del Open Compute Project, en comparación con NVIDIA Vera Rubin NVL72 con el tipo de datos NVFP4 Dense y los tipos de datos FP8/FP6. Los fabricantes de sistemas pueden variar las configuraciones, lo que arroja resultados diferentes. MI400-005
- Según los cálculos realizados por los laboratorios de rendimiento de AMD en junio del 2026, para determinar el rendimiento de precisión teórica máxima de una GPU AMD Instinct™ MI455X utilizando los tipos de datos de matriz FP16, BF16 e INT8 de máximo rendimiento y los tipos de datos MXFP6, MXFP8, FP8 y MXFP4 de máximo rendimiento del Open Compute Project, en comparación con las especificaciones preliminares publicadas de la GPU NVIDIA Vera Rubin con el tipo de datos NVFP4 Dense. Los fabricantes de sistemas pueden variar las configuraciones, lo que arroja resultados diferentes. MI400-003
- Cálculos de los laboratorios de rendimiento de AMD al mes de junio del 2026, con base en la capacidad de memoria y el ancho de banda de memoria publicados para las GPU AMD Instinct™ MI455X y MI430X frente a las especificaciones publicadas de capacidad de memoria y ancho de banda de memoria de la GPU NVIDIA Vera Rubin. Los fabricantes de sistemas pueden variar las configuraciones, lo que arroja resultados diferentes. MI400-004
- Basado en los cálculos de los laboratorios de rendimiento de AMD (junio del 2026) con una GPU AMD Instinct™ MI455X, rendimiento de precisión teórico máximo (matriz/vector FP32, FP16, BF16, MXFP6, MXFP8, FP8 y MXFP4), en comparación con las especificaciones publicadas para las GPU AMD Instinct™ MI355X, MI350X, MI325X, MI300X, MI250X y MI100. Los resultados pueden variar según la configuración del sistema y el tipo de datos. MI400-006
- Basado en cálculos realizados por los laboratorios de rendimiento de AMD al mes de junio del 2026 para determinar el rendimiento de precisión teórica máxima de una solución a escala de rack AMD Helios utilizando tipos de datos de matriz de máximo rendimiento FP16, BF16, INT8, y los tipos de datos MXFP6, MXFP8, FP8 y MXFP4 de máximo rendimiento del Open Compute Project, en comparación con NVIDIA Vera Rubin NVL72 con el tipo de datos NVFP4 Dense y los tipos de datos FP8/FP6. Los fabricantes de sistemas pueden variar las configuraciones, lo que arroja resultados diferentes. MI400-005
- Según los cálculos realizados por los laboratorios de rendimiento de AMD en junio del 2026, para determinar el rendimiento de precisión teórica máxima de una GPU AMD Instinct™ MI455X utilizando los tipos de datos de matriz FP16, BF16 e INT8 de máximo rendimiento y los tipos de datos MXFP6, MXFP8, FP8 y MXFP4 de máximo rendimiento del Open Compute Project, en comparación con las especificaciones preliminares publicadas de la GPU NVIDIA Vera Rubin con el tipo de datos NVFP4 Dense. Los fabricantes de sistemas pueden variar las configuraciones, lo que arroja resultados diferentes. MI400-003
- Cálculos de los laboratorios de rendimiento de AMD al mes de junio del 2026, con base en la capacidad de memoria y el ancho de banda de memoria publicados para las GPU AMD Instinct™ MI455X y MI430X frente a las especificaciones publicadas de capacidad de memoria y ancho de banda de memoria de la GPU NVIDIA Vera Rubin. Los fabricantes de sistemas pueden variar las configuraciones, lo que arroja resultados diferentes. MI400-004
- Basado en los cálculos de los laboratorios de rendimiento de AMD (junio del 2026) con una GPU AMD Instinct™ MI455X, rendimiento de precisión teórico máximo (matriz/vector FP32, FP16, BF16, MXFP6, MXFP8, FP8 y MXFP4), en comparación con las especificaciones publicadas para las GPU AMD Instinct™ MI355X, MI350X, MI325X, MI300X, MI250X y MI100. Los resultados pueden variar según la configuración del sistema y el tipo de datos. MI400-006