GPU AMD Instinct™ Série MI400

Leadership en matière d'IA de pointe, d'IA souveraine et de calculs hautes performances

Les GPU AMD Instinct™ Série MI400 offrent une base ouverte, reposant sur le software AMD ROCm™, qui s'adapte aussi bien aux déploiements hyperscale qu'aux environnements de calculs hautes performances, souverains et de recherche. Conçus sur la base de normes ouvertes et de technologies de virtualisation et de partitionnement pour une allocation efficace des ressources, les GPU AMD Instinct Série MI400 permettent une cohérence des modèles, des outils et des opérations à grande échelle.

Cette gamme comprend la solution rackscale AMD Helios™, équipée de 72 GPU AMD Instinct MI455X pour l'IA de pointe, ainsi que le GPU AMD Instinct MI430X pour l'IA souveraine et les calculs hautes performances. Elle permet ainsi aux clients de choisir la plateforme la mieux adaptée à leurs besoins, sans compromettre la cohérence, la flexibilité ou l'évolutivité.

short top curved fade divider
AMD Instinct™ MI430X, MI440X, MI455X die

Qu'est-ce qui se cache sous le capot ?

Les GPU AMD Instinct reposent sur l'architecture AMD CDNA™, qui intègre aux GPU AMD Instinct des technologies avancées de chiplet, de mémoire HBM et de cache, ainsi que la technologie AMD Infinity Fabric™. L'architecture AMD CDNA propose des technologies de cœurs matriciels et vectoriels permettant de prendre en charge un large éventail de types de données, allant du format OCP MXFP 8/6/4 extrêmement efficace (incluant INT8 et la prise en charge de la parcimonie FP16/BF16 pour l'IA) au format FP64 le plus exigeant pour les calculs hautes performances.

short bottom curved fade divider

Avantages

Conception de rack

Solution d'infrastructure d'IA entièrement intégrée pour une évolutivité optimale

La solution rackscale AMD Helios est une infrastructure d'IA entièrement intégrée, combinant les derniers GPU AMD Instinct™, les CPU pour serveur AMD EPYC™ et la mise en réseau AMD Pensando™, conçue selon des normes ouvertes du secteur pour prendre en charge l'inférence à grande échelle, ainsi que l'entraînement et l'affinage des modèles de pointe.

Les meilleures performances du marché

Performances de GPU et de rack de pointe

La solution rackscale AMD Helios offre une puissance de calcul d'IA exceptionnelle au niveau du rack : des performances de l'ordre de l'exaFLOP conçues pour l'inférence, l'entraînement et le réglage fin à très grande échelle. À l'échelle d'un rack, AMD Helios offre jusqu'à 2,9 exaFLOPS de pic de performance OCP MXFP4, 1,4 exaFLOPS de pic de performance OCP MXFP8, 31 To de mémoire HBM4 et 1,67 Pbit/s de bande passante mémoire.

Avancées en matière de GPU

Le packaging avancé des GPU permet la mise à l'échelle de l'IA de nouvelle génération

Le GPU AMD Instinct™ MI455X introduit des innovations clés pour passer à l'IA de nouvelle génération. L'architecture chiplet optimise indépendamment les fonctions de calcul, de mémoire, de cache et d'E/S dans un souci d'amélioration des performances, de la consommation énergétique et du processus de fabrication. Les dies de calcul liées hybrides empilées en 3D du GPU AMD Instinct MI455X utilisent des interconnexions haute densité pour offrir une densité de calcul plus élevée et des performances accrues.

Grâce aux 432 Go (12 piles) de mémoire HBM4 de nouvelle génération intégrée, avec une bande passante de 23,3 Tbit/s, les modèles plus volumineux, les caches KV et les activations peuvent rester en mémoire locale.

Le tout est relié par notre interconnexion AMD Infinity Fabric™ à large bande passante, qui assure des communications à faible temps de latence sur un boîtier CoWoS-L avancé, afin de permettre l'évolutivité de l'IA de nouvelle génération.

Software et écosystème

La liberté des software ouverts, pour plus d'évolutivité

Le software AMD ROCm™ équipe la solution rackscale AMD Helios basée sur les plateformes AMD Instinct MI455X. Il transforme ainsi les innovations GPU au niveau du noyau en résultats fiables en production pour l'inférence, l'entraînement et le réglage fin. Le software ROCm permet une exécution distribuée prévisible grâce à des primitives de communication (RCCL), des optimisations du cache KV et un chevauchement calcul/communication optimisé à l'échelle de l'exaFLOP.

Éprouvé à l'échelle des exaFLOPs et prêt à l'emploi pour les opérateurs, le software AMD ROCm permet aux clients d'accélérer le déploiement, d'évoluer en toute confiance du rack aux systèmes de classe exascale et d'assurer la portabilité entre les différentes configurations de plateformes et de la solution rackscale AMD Helios équipées de GPU AMD Instinct™ MI455X et MI430X.

short top curved fade divider
AMD Helios Rackscale

L'infrastructure d'IA rackscale la plus performante1

Performances de pointe des racks pour l'infrastructure d'IA hyperscale

La solution rackscale AMD Helios est une infrastructure d'IA entièrement intégrée, combinant les derniers GPU AMD Instinct™, les CPU pour serveur AMD EPYC™ et la mise en réseau AMD Pensando™, conçue selon des normes ouvertes du secteur pour prendre en charge l'inférence à grande échelle, ainsi que l'entraînement et l'affinage des modèles de pointe.

Performances de pointe pour les modèles d'IA les plus performants

Jusqu'à
2,9 exaFLOPS
2,9 exaFLOPS de calcul d'IA OCP MXFP4
Jusqu'à
260 To/s
Bande passante scale-up par GPU
Jusqu'à
31 To
31 To de mémoire HBM4 avec jusqu'à 1,7 Pbit/s de pic de bande passante mémoire théorique
short bottom curved fade divider
short top curved fade divider

Découvrez les GPU AMD Instinct™ Série MI400

GPU AMD Instinct™ MI455X

Basé sur l'architecture AMD CDNA™ de 5e génération, le GPU AMD Instinct™ MI455X est spécialement conçu pour la solution rackscale AMD Helios. Il offre des performances de premier plan pour l'IA de pointe, prenant en charge les capacités modernes d'IA en matière d'inférence, d'entraînement et de réglage fin.

AMD Instinct™ MI455X die
Jusqu'à
256 WGP
256 processeurs de groupe de travail (WGP) avec exécution Wave32
Jusqu'à
3,6 To/s
Bande passante scale-up par GPU
Jusqu'à
432 Go
432 Go de mémoire HBM4 intégrée avec un pic de bande passante mémoire théorique de 23,3 Tbit/s

Comparaison des spécifications du GPU AMD Instinct MI455X

Jusqu'à 26 % de performances d'IA en plus par rapport aux GPU concurrents2

Performances d'IA

(Pic de PFLOPS)

FP4
40
35
FP4/OCP MXFP4
Tenseur FP4
FP8 | FP6
20
18
MI455X 432 Go
Tenseur FP8/FP6
FP16 | BF16
5
4
Matrice FP16/BF16
Matrice FP16/BF16

AMD Instinct MI455X

NVIDIA Vera Rubin

Mémoire

Capacité de mémoire
432 Go
288 Go
MI455X 432 Go
Vera Rubin 288 Go
Bande passante mémoire
23,3 Tbit/s
22 Tbit/s
MI455X 432 Go
Vera Rubin 288 Go

AMD Instinct MI455X

NVIDIA Vera Rubin

short bottom curved fade divider

GPU AMD Instinct™ MI430X

Booster l'IA pour la science et les calculs hautes performances

Le GPU AMD Instinct™ MI430X est conçu pour les calculs hautes performances scientifiques et l'IA souveraine. Il combine la précision FP64 pour la simulation et la modélisation avec des capacités d'IA modernes pour l'inférence, l'entraînement et le réglage fin.

AMD Instinct™ MI430X GPU
short top curved fade divider

Basé sur un écosystème software ouvert

Software AMD ROCm™

Le software AMD ROCm™ inclut un large éventail de modèles de programmation, d'outils, de compilateurs, de bibliothèques et d'exécutions pour les GPU AMD Instinct dédiés aux charges de travail d'IA et de HPC.

AMD Enterprise AI Suite

AMD Enterprise AI Reference Stack

En associant les principaux frameworks d'IA open source et les modèles d'IA générative à une plateforme Kubernetes adaptée aux entreprises, ces dernières peuvent passer du calcul bare metal à une IA de production en quelques minutes, réduisant ainsi au minimum le délai entre l'expérimentation de l'IA et la mise en production à grande échelle sur les plateformes de calcul AMD.

short bottom curved fade divider

Études de cas

Options de déploiement AMD Instinct

Foire aux questions

Solution rackscale AMD Helios

Première conception de référence d'IA rackscale proposée par AMD, la solution rackscale AMD Helios est entièrement basée sur la nouvelle norme Open Rack Wide (ORW) de Meta et soumise à l'Open Compute Project (OCP). Elle combine 72 GPU AMD Instinct MI455X, des CPU AMD EPYC™ et des DPU AMD Pensando™, ainsi que d'autres composants de pointe, au sein d'un rack ORW ouvert à double largeur, conçu pour les centres de données à grande échelle dédiés à l'IA d'aujourd'hui.

Lors de l'OCP Global Summit, Meta a présenté un nouveau rack ouvert dédié à l'IA, adoptant le format ORW. AMD s'aligne sur cette conception ouverte grâce à la solution rackscale AMD Helios et présente ainsi le premier rack complet développé selon les normes ORW. Cela démontre l'engagement d'AMD en faveur de l'ouverture, des puces aux systèmes, en passant par les racks et les clusters à grande échelle.

Les racks OCP précédents étaient à largeur simple et destinés aux serveurs à usage général. L'ORW introduit un rack à double largeur optimisé pour les systèmes d'IA à haute densité, offrant une puissance accrue, un refroidissement par liquide et des plateaux plus larges pour accueillir de grands nœuds d'accélérateurs. La solution rackscale AMD Helios s'appuie sur l'ORW pour intégrer des GPU, des CPU, des DPU et d'autres composants au sein d'un système d'IA unifié, facile à entretenir et à déployer.

Une solution rackscale AMD Helios complète offre jusqu'à 1,4 exaFLOPS de puissance de calcul FP8, 2,9 exaFLOPS de puissance de calcul FP4 et 31 To de mémoire HBM4, permettant ainsi l'entraînement d'IA à un trillion de paramètres et l'inférence d'IA à grande échelle.

Chaque GPU AMD Instinct MI455X utilise l'architecture AMD CDNA™ de nouvelle génération, avec 432 Go de mémoire HBM4 et une bande passante pouvant atteindre 23,3 Tbit/s, ce qui est idéal pour l'inférence et l'entraînement de modèles d'IA de pointe. Chaque GPU offre jusqu'à 40 PFLOPS en FP4 et 2,9 EF en FP4 par solution rackscale AMD Helios.

La solution rackscale AMD Helios est la première solution de rack ORW à double largeur conçue pour des opérations en conditions réelles, alliant des plateaux modulaires et une facilité d'entretien à des performances soutenues dans les centres de données soumis à des contraintes d'alimentation. Elle réduit la fragmentation en remplaçant les conceptions propriétaires et ponctuelles par des normes ouvertes, notamment OCP, UALink et UEC, ce qui permet de déployer à grande échelle des clusters d'IA efficaces et hautes performances.

Il s'agit d'une conception de référence et non d'un produit disponible à la vente. La solution rackscale AMD Helios est un modèle permettant aux partenaires OEM et ODM de concevoir leurs propres systèmes, sous leur marque, basés sur les normes ORW ouvertes.

Cette plateforme est basée sur AMD ROCm™, pile software open source dédiée à l'IA et aux calculs hautes performances. Elle offre une prise en charge dès le premier jour de PyTorch, TensorFlow, JAX, ONNX Runtime, vLLM et Triton. Elle s'adapte à toutes les échelles, du GPU unique aux superclusters multi-racks, et évite la dépendance vis-à-vis d'un seul fournisseur.

La conception rackscale de référence AMD Helios est en cours de partage avec les partenaires et les déploiements en volume sont attendus au 2e semestre 2026.

GPU AMD Instinct MI455X

Les GPU AMD Instinct™ MI455X qui équipent la solution rackscale AMD Helios offrent des performances de pointe par appareil qui s'agrègent grâce à des tiroirs modulaires à 4 GPU pour former le système AMD Helios à 72 GPU, permettant ainsi d'obtenir des résultats fiables et exploitables de l'ordre de l'exaFLOP.

Les GPU AMD Instinct™ MI455X offrent :

  • Jusqu'à 40 PFLOPS en pic de performance en 4 bits
  • Jusqu'à 20 PFLOPS en pic de performance en 8 bits
  • 432 Go de mémoire HBM4
  • 23,3 Tbit/s de bande passante mémoire

Ces capacités s'agrègent via des tiroirs modulaires standardisés de 4 GPU pour former la solution rackscale AMD Helios à 72 GPU.

La mémoire est 'une des considérations les plus importantes pour l'infrastructure d'IA, car les modèles ne cessent d'augmenter en taille et en complexité. Chaque GPU AMD Instinct MI455X offre 432 Go de mémoire HBM4, tandis qu'un rack Helios complet en fournit 31 To. Combinée à une bande passante mémoire élevée, cette capacité permet aux clients de prendre en charge des modèles plus volumineux, de réduire la complexité de l'infrastructure et de faire évoluer efficacement les charges de travail d'inférence et d'entraînement grandes consommatrices de mémoire.

GPU AMD Instinct MI430X

Le GPU AMD Instinct™ MI430X est un nouveau GPU spécialement conçu pour l'IA souveraine, le calcul scientifique et les calculs hautes performances. Le GPU AMD Instinct MI430X est conçu pour prendre en charge les charges de travail convergentes d'IA et de calculs hautes performances en combinant une mémoire HBM4 de pointe, des capacités de calcul FP64 hautes performances et la plateforme software ouverte AMD ROCm™. Offrant un pic de performance FP64 de 288 TFLOPS basé sur hardware, l'AMD Instinct MI430X est conçu pour permettre aux gouvernements, aux instituts de recherche et aux laboratoires nationaux d'exécuter les simulations et les applications d'IA les plus exigeantes au monde.

Les calculs scientifiques et l'IA souveraine nécessitent de plus en plus d'infrastructures capables de prendre en charge à la fois le calcul intensif traditionnel et l'IA moderne. L'AMD Instinct MI430X permet de regrouper ces charges de travail sur une seule et même plateforme, tout en améliorant l'efficacité, en simplifiant l'infrastructure et en préservant l'ouverture et la flexibilité requises pour les déploiements à l'échelle nationale.

Pour les gigafactories d'IA et les centres de calcul haute performance, AMD Instinct MI430X est conçu pour offrir la fidélité numérique et le débit nécessaires pour les charges de travail les plus exigeantes. Alors que les modèles d'IA de nouvelle génération s'appuient de plus en plus sur les données d'entraînement générées à partir de simulations haute fidélité, AMD Instinct MI430X aide les chercheurs et les institutions à construire des systèmes d'IA à partir de données scientifiques précises, pour renforcer la confiance dans les découvertes basées sur l'IA dans des domaines tels que la science du climat, la recherche des matériaux, l'ingénierie nucléaire et la dynamique des fluides.

Les GPU AMD Instinct™ MI430X offrent une précision et un débit sans compromis dans les flux de travail convergents de calculs hautes performances et d'IA, grâce à une puissance de calcul FP64 de 288 TFLOPS intégrée au hardware pour le calcul scientifique, ainsi qu'à la prise en charge des types de données et des fonctionnalités software modernes de l'IA. Doté de 432 Go de mémoire HBM4, une référence dans le secteur, et d'une bande passante mémoire de 2,3 Tbit/s, AMD Instinct MI430X est conçu pour les simulations de grande envergure et les modèles à consommation intensive de mémoire. Il permet ainsi de réduire le nombre de serveurs, de simplifier l'infrastructure et d'améliorer l'efficacité lors du traitement d'ensembles de données massifs.

Oui, le prochain système Discovery du DOE/ORNL américain ainsi que deux systèmes européens, les systèmes Alice Recoque et Herder, devraient être déployés avec des GPU AMD Instinct MI430X.

Basé sur le software AMD ROCm™, AMD Instinct MI430X offre une base ouverte comprenant des modèles de programmation, des compilateurs, des bibliothèques, des environnements d'exécution et des outils de déploiement tant pour les calculs hautes performances que pour l'IA. Cet engagement en faveur des normes ouvertes favorise l'interopérabilité et la portabilité à long terme entre les différents choix de software, de systèmes et de réseaux. Il permet ainsi aux opérateurs souverains d'innover sans se retrouver prisonniers d'un écosystème fermé.

Selon les estimations, AMD Instinct MI430X offre un pic de performance en FLOP FP64 basé sur le hardware 8,7 fois supérieur à celui du Nvidia Vera Rubin.

NOTES DE FIN : AMD Instinct MI400-001A - D'après les projections techniques d'AMD Performance Labs datant de juillet 2026, visant à estimer le pic de précision théorique du GPU AMD Instinct™ MI430X utilisant le type de données FP64 (vecteur), par rapport au GPU AMD Instinct MI300X et au GPU Nvidia Rubin. Les résultats peuvent changer lorsque les produits sont mis sur le marché.

Les GPU AMD Instinct MI430X devraient être disponibles sur le marché en 2027. De plus amples informations seront fournies à l'avenir.

Ressources

Blogs

Lisez les derniers articles de blog sur les accélérateurs AMD Instinct.

Tenez-vous au courant

Abonnez-vous pour recevoir les actualités et contenus les plus récents sur les centres de données et les serveurs.

Notes de bas de page
  1. Sur la base des calculs effectués par AMD Performance Labs en juin 2026 afin de déterminer le pic de performance théorique en précision d'une solution rackscale AMD Helios à l'aide des types de données Matrice FP16, BF16 et INT8 à leur niveau optimal, ainsi que du type de données MXFP6 de l'Open Compute Project à son niveau optimal, MXFP8, FP8 et MXFP4 de l'Open Compute Project, par rapport à la carte NVIDIA Vera Rubin NVL72 utilisant le type de données NVFP4 Dense avec les types de données FP8/FP6. Les résultats peuvent varier en fonction des configurations créées par les fabricants de systèmes. MI400-005
  2. Sur la base de calculs effectués par AMD Performance Labs en juin 2026, afin de déterminer le pic de performance théorique en précision d'un GPU AMD Instinct™ MI455X à l'aide des types de données Matrice FP16, BF16 et INT8 à leur niveau optimal et des types de données MXFP6, MXFP8, FP8 et MXFP4 à leur niveau optimal de l'Open Compute Project, par rapport aux spécifications préliminaires publiées du GPU NVIDIA Vera Rubin avec le type de données NVFP4 Dense. Les résultats peuvent varier en fonction des configurations créées par les fabricants de systèmes. MI400-003
  3. Calculs effectués par AMD Performance Labs en juin 2026, sur la base de la capacité de mémoire et de la bande passante mémoire publiées des GPU AMD Instinct™ MI455X et MI430X, par rapport aux spécifications de capacité de mémoire et de bande passante mémoire publiées d'un GPU NVIDIA Vera Rubin. Les résultats peuvent varier en fonction des configurations créées par les fabricants de systèmes. MI400-004
  4. Sur la base des calculs effectués par AMD Performance Labs (juin 2026) à l'aide d'un GPU AMD Instinct™ MI455X, pic de performance théorique en précision (FP32, FP16, BF16, MXFP6, MXFP8, FP8, MXFP4 matrice/vecteur), par rapport aux spécifications publiées pour les GPU AMD Instinct™ MI355X, MI350X, MI325X, MI300X, MI250X et MI100.1 Les résultats peuvent varier en fonction de la configuration du système et des types de données. MI400-006