概要
AMD CDNA™ アーキテクチャは、AMD Instinct™ GPU および APU の基盤となる、専用演算アーキテクチャです。このアーキテクチャは、AMD チップレット テクノロジと高スループットの Infinity アーキテクチャ ファブリックである広帯域幅メモリ (HBM) を統合する高度なパッケージを備えており、AI および HPC データ形式の包括的なセットをサポートする高度なマトリックス コア テクノロジを提供します。このテクノロジはデータ移動のオーバーヘッドを削減し、電力効率を向上させるように設計されたものです。
世代間比較表:
| CDNA | CDNA 2 | CDNA 3 | CDNA 4 | CDNA 5 | |
| プロセス テクノロジ | 7 nm FinFET | 6 nm FinFET | 5 nm + 6 nm FinFET | 3 nm + 6 nm FinFET | 2 nm + 3 nm FinFET |
| トランジスタ | 256 億 | 最大 580 億 | 最大 1,460 億 | 最大 1,850 億 | 最大 3,200 億 |
| CU | マトリックス コア | 120 | 440 | 最大 220 | 880 | 最大 304 | 1216 | 256 | 1024 | 256 (WGP)** |
| メモリ タイプ | 32GB HBM2 | 最大 128 GB HBM2E | 最大 256 GB HBM3 | HBM3E | 288GB HBM3E | 432GB HBM4 |
| メモリ帯域幅 (ピーク) | 1.2 TB/秒 | 最大 3.2 TB/秒 | 最大 6 TB/秒 | 8 TB/秒 | 23.3 TB/s |
| AMD Infinity Cache™ | N/A | N/A | 256 MB | 256 MB | N/A |
| GPU コヒーレンシ | N/A | キャッシュ | キャッシュおよび HBM | キャッシュおよび HBM | キャッシュおよび HBM |
| サポートするデータ型 | INT4、INT8、BF16、FP16、FP32、FP64 | INT4、INT8、BF16、FP16、FP32、FP64 | Matrix: INT8、FP8、BF16、FP16、TF32、FP32、FP64 Vector: FP16、FP32、FP64 Sparsity: INT8、FP8、BF16、FP16 |
Matrix: MXFP4、MXFP6、INT8、MXFP8、OCP FP8、BF16、FP16、TF32*、FP32、FP64 Vector: FP16、FP32、FP64 Sparsity: OCP-FP8、INT8、FP16、BF16 |
OCP: MXFP4、MXFP6、MXFP8、FP8 Matrix: INT8、BF16、FP16、FP32、FP64 Vector: FP16、FP32、FP64 Sparsity: INT8、FP16、BF16 |
| 製品 | AMD Instinct™ MI100 シリーズ | AMD Instinct™ MI200 シリーズ | AMD Instinct™ MI300 シリーズ | AMD Instinct™ MI350 シリーズ | AMD Instinct™ MI400 シリーズ |
* TF32 はソフトウェア エミュレーションを通じてサポートされます。
** AMD CDNA™ 5 アーキテクチャは、高度な WGP (Work Group Processor) を使用します。
AMD CDNA™ 5 アーキテクチャの概要
AMD CDNA™ 5 は、AMD Instinct™ MI400 シリーズ GPU の基盤となる、専用演算アーキテクチャです。データ移動のオーバーヘッドを削減し、電力効率を高めるように設計されたチップレット テクノロジによる、高度なパッケージングを特徴としています。
AMD Instinct™ MI455X GPU は、新しい 72 GPU の AMD Helios™ ラックスケール ソリューション専用に設計されており、AMD CDNA 5 アーキテクチャをベースにした初の製品として、フロンティア AI 導入における最新の AI スケーリング向けの拡張機能を備えています。ソブリン AI および HPC 向け AMD Instinct MI430X GPU は、2027 年にリリース予定であり、異なる AMD CDNA 5 機能が有効になっている場合があります。
AMD Instinct™ MI455X GPU
高度なパッケージング
AMD CDNA 5 は、演算、メモリ、キャッシュ、I/O 機能を専用ダイ全体に分割して、性能と消費電力を個別に最適化する高度なチップセット アーキテクチャを提供します。
3D ハイブリッド ボンディング演算ダイは、演算密度と効率を向上させるために積層され、高密度ダイ間のインターコネクトを介して接続されます。AMD CDNA 5 は、432 GB の次世代 HBM4 メモリを 12 層に統合し、帯域幅は 23.3 TB/s、さらに AMD Infinity Fabric™ インターコネクトを使用して、CoWoS-L アドバンスト パッケージの演算、メモリ、I/O ダイ間の広帯域幅で低レイテンシのオンパッケージ通信を提供し、最新の AI スケーリングに必要なメモリと帯域幅の拡張性を実現します。
強化されたコンピューティング
AMD CDNA™ 5 は、AMD Instinct MI400 シリーズ GPU へのクロックあたりのスループットが向上した新しい WGP (Work Group Processor) アーキテクチャを提供します。この新しいアーキテクチャにより、Wave32 実行が可能になり、同期オーバーヘッドが減少して SIMD 使用率が向上します。また、新しい tanh 命令を使用した高度な AI 演算エンジンが実現し、超越関数演算スループットが向上します。
高度な低精度 AI データ型 MXFP8、MXFP6、MXFP4 は、16/32 のブロックスケールと、前世代の AMD Instinct GPU と比較して最大 4 倍のスループットのフラクショナル スケーリングを備えています。1
メモリ システムのアップグレード
AMD Instinct MI400 シリーズ GPU は、メモリ機能の水準を引き上げます。業界をリードする 432 GB の HBM4 を GPU あたり 23.3 TB/s の帯域幅で提供し、改善されたキャッシュとメモリ階層で、成長するモデル、コンテキスト ウィンドウ、および kV キャッシュに対応します。
AMD Helios ラックスケール ソリューションに搭載された AMD Instinct MI455X GPU は、72 基の GPU を搭載した 31 TB の HBM4 共有ポッド メモリ システム、全対全通信、大規模 AI モデル ワークロード向け UALoE ファブリックを使用したシングル ホップを提供します。
統合ファブリックと I/O
AMD Infinity アーキテクチャは、AMD Infinity Fabric™ テクノロジと共に、AMD GPU チップセット テクノロジ、積層 HBM4 メモリ、L2 キャッシュ、および I/O ダイ間の一貫性のある高スループットのオンパッケージ通信を、単一デバイスでもマルチデバイス プラットフォーム間でも実現します。
72 基の GPU を搭載する AMD Helios ラックスケール ソリューション向けに設計された各 AMD Instinct MI455X GPU EAM には、2 つの拡張 I/O ダイと 2 枚の PCIe® 6 互換 NIC または 3 枚の AMD AI-NIC が含まれます。各 GPU EAM にはさらに、AMD Helios ラックスケール ソリューションの高帯域幅スケールアップ用に 36 の (双方向) UUALoE リンク (x2) も含まれています。
電力効率の向上
AMD CDNA 5 アーキテクチャは、メモリ トラフィックとアイドル サイクルを減らして、提供されるパフォーマンスを向上させることにより、GPU 効率を向上させます。重要なイノベーションとして、レジスタ ステージングなしで転送する直接非同期グローバル LDS 用 Tensor Data Mover (TDM)、1 回のメモリ フェッチで複数の WGP に対応して冗長メモリ トラフィックを排除する L2 マルチキャスト機能、同期の効率向上のためのスプリットネームド バリア、Matrix 演算におけるマルチ WGP 連携のための WGP クラスタリングなどがあります。
AMD CDNA™ 4
AMD CDNA™ 4 は、AMD Instinct™ MI350 シリーズ GPU の基盤となる、専用演算アーキテクチャです。データ移動のオーバーヘッドを削減し、電力効率を高めるように設計されたチップレット テクノロジによる、高度なパッケージングを特徴としています。
AMD Instinct MI350 シリーズ GPU
AMD CDNA 3
AMD CDNA 3 アーキテクチャは、AMD Instinct™ MI300 シリーズ GPU の基盤となる、専用演算アーキテクチャです。データ移動のオーバーヘッドを削減し、電力効率を高めるように設計されたチップレット テクノロジによる、高度なパッケージングを特徴としています。
AMD Instinct MI300A APU
AMD Instinct MI325X GPU
AMD CDNA 2
AMD CDNA 2 アーキテクチャは、最も負荷のかかる科学演算ワークロードや機械学習アプリケーションでも、高速化できるように設計されています。AMD Instinct MI200 シリーズ GPU の基盤となっています。
AMD CDNA
AMD CDNA アーキテクチャは、GPU ベースの演算専用アーキテクチャで、エクサスケール級の演算の時代を切り開くために設計されました。AMD Instinct MI100 シリーズ GPU の基盤となっています。
AMD Instinct アクセラレータ
AMD Instinct GPU が生成 AI、トレーニング、HPC の新しい標準をどのように確立しているかについて説明します。
AMD ROCm™ ソフトウェア
AMD CDNA アーキテクチャは、オープン ソフトウェア スタックである AMD ROCm™ ソフトウェアによってサポートされています。この AMD ROCm には、AMD Instinct GPU をターゲットとする、AI および HPC ソリューション開発のためのプログラミング モデル、ツール、コンパイラ、ライブラリ、ランタイムの幅広いセットが含まれています。
脚注
* 上記の一部の機能は、すべての AMD Instinct™ MI400 シリーズ GPU で使用できるとは限りません。
1.AMD パフォーマンス ラボの計算 (2026 年 6 月) に基づき、AMD Instinct™ MI455X GPU を使用したピーク時における理論上の精度性能 (FP32、FP16、BF16、MXFP6、MXFP8、FP8、MXFP4 Matrix/Vector) を、AMD Instinct™ MI355X、MI350X、MI325X、MI300X、MI250X、MI100 GPU の公開仕様と比較しました。システム構成およびデータ型によって、異なる結果が生じる場合があります。MI400-006
* 上記の一部の機能は、すべての AMD Instinct™ MI400 シリーズ GPU で使用できるとは限りません。
1.AMD パフォーマンス ラボの計算 (2026 年 6 月) に基づき、AMD Instinct™ MI455X GPU を使用したピーク時における理論上の精度性能 (FP32、FP16、BF16、MXFP6、MXFP8、FP8、MXFP4 Matrix/Vector) を、AMD Instinct™ MI355X、MI350X、MI325X、MI300X、MI250X、MI100 GPU の公開仕様と比較しました。システム構成およびデータ型によって、異なる結果が生じる場合があります。MI400-006