AMD Instinct™ MI400 シリーズ GPU

業界をリードするフロンティア AI、ソブリン AI、HPC

AMD Instinct™ MI400 シリーズ GPU は、オープンな AMD ROCm™ ソフトウェアベースの基盤を提供し、ハイパースケール展開から HPC、ソブリン、研究向けの環境まで拡張できます。AMD Instinct MI400 シリーズ GPU は、オープン スタンダードと仮想化、パーティショニングを基盤としており、大規模なモデル、ツール、および運用の一貫性を維持します。

このポートフォリオは、フロンティア AI 向けの 72 基の AMD Instinct MI455X GPU を搭載した AMD Helios™ ラックスケール ソリューションからソブリン AI および HPC 向けの AMD Instinct MI430X GPU まで網羅しており、一貫性、柔軟性、拡張性を犠牲にすることなく、ニーズに合ったプラットフォームを選択できます。

short top curved fade divider
AMD Instinct™ MI430X, MI440X, MI455X die

内部のテクノロジ

AMD Instinct GPU の基礎となる AMD CDNA™ アーキテクチャは、AMD Instinct GPU に高度なチップセット、HBM メモリとキャッシュ、AMD Infinity Fabric™ テクノロジを提供します。AMD CDNA アーキテクチャは、高効率の OCP MXFP 8/6/4 (INT8 および AI 向け FP16/BF16 スパース性対応を含む) から HPC 向けの最も要求の厳しい FP64 まで、幅広いデータ型機能をサポートするためのマトリックスおよびベクトル コア テクノロジを提供します。

short bottom curved fade divider

利点

ラック設計

拡張性を実現する完全統合型 AI インフラストラクチャ ソリューション

AMD Helios ラックスケール ソリューション設計は、最新の AMD Instinct™ GPU、AMD EPYC™ サーバー向け CPU、AMD Pensando™ ネットワーキングを組み合わせた完全統合型 AI インフラストラクチャです。オープンな業界標準を使用して設計されており、大規模な推論、フロンティア モデルのトレーニング、ファインチューニングが可能です。

業界をリードするパフォーマンス

業界をリードする GPU およびラック パフォーマンス

AMD Helios ラックスケール ソリューションは、AI ファクトリーのラックレベルの出力において、ハイパースケール推論、トレーニング、および大規模なファインチューニングのために設計された exaFLOP クラスの圧倒的なパフォーマンスを発揮します。ラックスケールで、AMD Helios は最大 2.9 exaFLOPS のピーク時 OCP MXFP4 演算性能、1.4 exaFLOPS のピーク時 OCP MXFP8 演算性能、31 TB の HBM4 メモリ、1.67 PB/s のメモリ帯域幅を実現します。

GPU の進歩

次世代 AI スケーリングを可能にする高度な GPU パッケージング

AMD Instinct MI455X™ GPU は、次世代 AI スケーリングを実現するための重要なイノベーションをもたらします。チップレット アーキテクチャは、パフォーマンス、消費電力、製造の強化のために、コンピューティング、メモリ、キャッシュ、および I/O 機能を個別に最適化します。AMD Instinct MI455X GPU 積層 3D ハイブリッド ボンディング演算ダイは、高密度インターコネクトを使用して高い演算密度とパフォーマンスの向上を実現します。

432 GB (12 層) の次世代 HBM4 メモリと 23.3 TB/s の帯域幅の組み合わせにより、大規模モデル、kV キャッシュ、およびアクティベーションをローカル メモリに保持できます。

これらすべてが高帯域幅の AMD Infinity Fabric™ インターコネクトと連携して、先進の CoWoS-L パッケージで低レイテンシ通信が実現し、次世代の AI スケーリングが可能になります。

ソフトウェアとエコシステム

オープン ソフトウェアの自由度と拡張性に優れた設計

AMD ROCm™ ソフトウェアにより、AMD Instinct MI455X プラットフォームを搭載した AMD Helios ラックスケール ソリューションが実現します。これにより、カーネルレベルの GPU イノベーションが、推論、トレーニング、ファインチューニングに対応できる信頼性の高い本番環境の成果へと変換されます。ROCm ソフトウェアは、通信プリミティブ (RCCL)、kV キャッシュ最適化、および exaFLOP クラスのスケールに合わせて調整された計算/通信オーバーラップにより、予測可能な分散実行を実現します。

エクサスケールで実証済みであり、そのまま運用に組み込める AMD ROCm ソフトウェアは、迅速に導入し、ラックからエクサスケールクラスのシステムへと安心して拡張できます。また、AMD Instinct MI455X および MI430X GPU とプラットフォームを展開する AMD Helios ラックスケール ソリューション全体で移植性を維持できます。

short top curved fade divider
AMD Helios Rackscale

最もパワフルなラックスケール AI インフラストラクチャ1

ハイパースケール AI 向けの業界をリードするラック パフォーマンス

AMD Helios ラックスケール ソリューション設計は、最新の AMD Instinct™ GPU、AMD EPYC™ サーバー向け CPU、AMD Pensando™ ネットワーキングを組み合わせた完全統合型 AI インフラストラクチャです。オープンな業界標準を使用して設計されており、大規模な推論、フロンティア モデルのトレーニング、ファインチューニングが可能です。

業界をリードするフロンティア AI 向けパフォーマンス

最大
2.9 exaFLOPS
2.9 exaFLOPS OCP MXFP4 AI 演算性能
最大
260 TB/s
GPU あたりのスケールアップ帯域幅
最大
31 TB
最大 1.7 PB/s のピーク理論メモリ帯域幅を備えた 31 TB HBM4 メモリ
short bottom curved fade divider
short top curved fade divider

AMD Instinct™ MI400 シリーズ GPU のご紹介

AMD Instinct™ MI455X GPU

第 5 世代 AMD CDNA™ アーキテクチャを基盤とする AMD Instinct™ MI455X GPU は、AMD Helios ラックスケール ソリューション専用に設計されています。フロンティア AI 向けに業界をリードする AI パフォーマンスを提供し、推論、トレーニング、ファインチューニングに対応する最先端の AI 機能をサポートします。

AMD Instinct™ MI455X die
最大
256 WGP
256 の WGP、Wave32 の実行が可能
最大
3.6 TB/s
GPU あたりのスケールアップ帯域幅
最大
432 GB
432 GB の統合 HBM4 メモリを搭載し、最大 23.3 TB/s の理論上のメモリ帯域幅を実現

AMD Instinct MI455X GPU の仕様比較

競合 GPU と比較して最大 26% 上回る AI パフォーマンス2

AI パフォーマンス

(ピーク時 PFLOPS)

FP4
40
35
FP4/OCP MXFP4
FP4 Tensor
FP8 | FP6
20
18
MI455X 432 GB
FP8/FP6 Tensor
FP16 | BF16
5
4
FP16/BF16 Matrix
FP16/BF16 Matrix

AMD Instinct MI455X

NVIDIA Vera Rubin

メモリ

メモリ容量
432 GB
288 GB
MI455X 432 GB
Vera Rubin 288 GB
メモリ帯域幅
23.3 TB/s
22.0 TB/s
MI455X 432 GB
Vera Rubin 288 GB

AMD Instinct MI455X

NVIDIA Vera Rubin

short bottom curved fade divider

AMD Instinct™ MI430X GPU

科学と HPC のために AI を大幅に強化

AMD Instinct™ MI430X GPU は、科学研究用の HPC およびソブリン AI のために設計されており、シミュレーションとモデリングのための FP64 精度と、推論、トレーニング、およびファインチューニングのための最新の AI 機能を兼ね備えています。

AMD Instinct™ MI430X GPU
short top curved fade divider

オープン ソフトウェア エコシステム上に構築

AMD ROCm™ ソフトウェア

AMD ROCm™ ソフトウェアには、AMD Instinct GPU をターゲットとする、AI モデルおよび HPC ワークロード向けのプログラミング モデル、ツール、コンパイラ、ライブラリ、ランタイムの幅広いセットが含まれています。

AMD Enterprise AI Suite

AMD Enterprise AI Reference Stack

主要なオープンソース AI フレームワークと生成 AI モデルをエンタープライズ対応の Kubernetes プラットフォームに接続することで、企業はベアメタル コンピューティングから本番運用レベルの AI に数分で移行でき、AI の試験運用から AMD 演算プラットフォームでの大規模な本番稼働に至るまでの時間を最短にできます。

short bottom curved fade divider

ケース スタディ

AMD Instinct の導入オプション

よくある質問 (FAQ)

AMD Helios のラックスケール ソリューション

AMD Helios ラックスケール ソリューションは、AMD 初のラックスケール AI リファレンス デザインであり、Open Compute Project (OCP) に提出された Meta の新しい Open Rack Wide (ORW) 標準を完全に順守して構築されています。72 基の AMD Instinct MI455X GPU、AMD EPYC™ CPU、および AMD Pensando™ DPU を、今日の AI スケール データセンター向けに設計されたオープンなダブル幅 ORW ラック内のほかの主要コンポーネントと組み合わせたものです。

OCP Global Summit において、Meta が ORW フォーム ファクターを特徴とする新しい AI 向け Open Rack 規格を発表しました。AMD は、ORW 規格に基づいて構築された初のフル ラックとなる AMD Helios ラックスケール ソリューションを通じて、このオープン設計に沿った取り組みを実施しています。これは、AMD のシリコンからシステム、ラック、大規模クラスターに至るまでのオープン性へのコミットメントを示しています。

以前の OCP ラックはシングル幅であり、汎用サーバーに焦点を当てていました。ORW は高密度 AI システムに最適化されたダブル幅ラックを採用し、大規模なアクセラレータ ノードに対応するための高電力供給、液体冷却、幅広トレイを提供します。AMD Helios ラックスケール ソリューションは、ORW を活用して GPU、CPU、DPU、およびその他のコンポーネントを統合し、保守が可能で展開が容易な統合 AI システムを構築します。

AMD Helios ラックスケールの完全なソリューションは、最大 1.4 exaFLOPS の FP8 演算性能、2.9 exaFLOPS の FP4 演算性能、31 TB の HBM4 メモリを提供します。これにより、数兆パラメーターの AI トレーニングと大規模な AI 推論が可能です。

各 AMD Instinct MI455X GPU は、次世代 AMD CDNA™ アーキテクチャを採用し、432 GB の HBM4 メモリと最大 23.3 TB/s の帯域幅を備えており、フロンティアクラス AI モデルの推論とトレーニングに最適です。GPU 1 基で、AMD Helios ラックスケール ソリューションあたり最大 40 PFLOPS の FP4 演算性能および 2.9 exaFLOPS の FP4 演算性能を実現します。

AMD Helios ラックスケール ソリューションは、実際の運用のために構築された初のダブル幅 ORW ラック ソリューションです。モジュール式トレイと容易な保守性を兼ね備えており、電力に制約のあるデータセンターで持続的なパフォーマンスを発揮します。独自の設計を OCP、UALink、UEC などのオープン スタンダードに置き換えることで断片化を軽減し、効率的で高性能な AI クラスターを大規模に実現します。

これはリファレンス デザインであり、販売用の製品ではありません。AMD Helios ラックスケール ソリューションは、ORW オープン スタンダードに基づいて独自のブランド システムを構築する OEM および ODM パートナー向けのブループリントです。

このプラットフォームは AMD ROCm™ を搭載しています。これは、PyTorch、TensorFlow、JAX、ONNX Runtime、vLLM、Triton を初期導入段階からサポートするオープンソースの AI および HPC ソフトウェア スタックです。1 基の GPU からマルチラックのスーパークラスターにまで拡張可能であり、ベンダー ロックインを回避できます。

AMD Helios ラックスケール ソリューション リファレンス デザインは現在、パートナーと共有されており、2026 年下半期には量産展開される予定です。

AMD Instinct MI455X GPU

AMD Instinct™ MI455X GPU は、AMD Helios ラックスケール ソリューションに搭載され、デバイス単位の能力として業界トップクラスを誇ります。標準化された 4 GPU トレイを介して 72 基 GPU の AMD Helios に集約し、予測可能かつ保守可能な exaFLOP クラスの結果を実現します。

AMD Instinct™ MI455X GPU の実力:

  • ピーク時の 4 ビット性能は最大 40 PFLOPS
  • ピーク時の 8 ビット性能は最大 20 PFLOPS
  • 432GB HBM4
  • 23.3 TB/s のメモリ帯域幅

これらの機能は、標準化された 4 GPU トレイを介して 72 基 GPU の AMD Helios ラックスケール ソリューションに集約されます。

モデルの規模と複雑さが増大し続ける中で、AI インフラストラクチャにとってメモリは最も重要な考慮事項の 1 つとなっています。AMD Instinct MI455X GPU は 1 基につき 432 GB の HBM4 メモリを搭載し、Helios ラックは 1 台フルに使用すると 31 TB の HBM4 メモリを搭載できます。これにより、大規模なモデルをサポートし、インフラストラクチャの複雑さを軽減し、メモリを多用する推論とトレーニングのワークロードを効率的に拡張できます。

AMD Instinct MI430X GPU

AMD Instinct™ MI430X GPU は、AI、科学計算、およびハイパフォーマンス コンピューティング (HPC) 向けに設計された新しい GPU です。AMD Instinct MI430X GPU は、業界をリードする HBM4 メモリ、高性能 FP64 コンピューティング、およびオープン AMD ROCm™ ソフトウェア プラットフォームを組み合わせて、統合型 AI および HPC ワークロードをサポートするように設計されています。AMD Instinct MI430X は、288 TFLOPS のハードウェアベース FP64 ピーク性能を発揮し、世界で最も要求の厳しいシミュレーションや AI アプリケーションに取り組む政府、研究機関、国立研究所に貢献します。

科学計算とソブリン AI は、従来の HPC と現代の AI の両方をサポートできるインフラストラクチャをますます必要としています。AMD Instinct MI430X を使用することで、組織は効率性を向上させ、インフラストラクチャを簡素化し、全国規模の導入に必要なオープン性と柔軟性を維持しながら、それらのワークロードを単一のプラットフォームに統合できます。

AI ギガファクトリーやハイパフォーマンス コンピューティング センター向けに、AMD Instinct MI430X は最も要求の厳しいワークロードに必要な数値忠実性とスループットを実現するように設計されています。次世代 AI モデルが高忠実度シミュレーションから生成されたトレーニング データに依存するようになるにつれて、AMD Instinct MI430X は、研究者や機関が正確な科学データに基づいて AI システムを構築できるように支援します。これにより、気候科学、材料研究、原子力工学、流体力学などの分野で AI 主導の発見をより確実に行えるようになります。

AMD Instinct™ MI430X GPU は、HPC と AI の集約ワークフロー全体で妥協のない精度とスループットを提供します。科学計算向けに 288 TFLOPS のハードウェアベース FP64 性能を誇り、最新の AI データ型とソフトウェア機能をサポートします。AMD Instinct MI430X は、業界をリードする 432 GB の HBM4 および 2.3 TB/s のメモリ帯域幅を備え、大規模なシミュレーションやメモリ負荷の高いモデル向けに構築されています。これにより、サーバー数の削減、インフラストラクチャの複雑さの軽減、大規模なデータセットの拡張時の効率向上に貢献します。

はい。次の US DOE/ORNL Discovery システム、およびヨーロッパの Alice Recoque システムと Herder システムには、AMD Instinct MI430X GPU が導入される予定です。

AMD ROCm™ ソフトウェアを搭載した AMD Instinct MI430X は、HPC と AI の両方に対応するプログラミング モデル、コンパイラ、ライブラリ、ランタイム、およびデプロイメント ツールを備えたオープンな基盤を提供します。このオープン スタンダードへの取り組みは、ソフトウェア、システム、ネットワークの選択肢を超えた相互運用性と長期的な移植性をサポートし、ソブリン事業者がロックインに縛られることなくイノベーションを達成できるよう支援します。

AMD Instinct MI430X は、Nvidia Vera Rubin と比較してピーク時のハードウェアベース FP64 性能 FLOP が 8.7 倍になると推定されています。

脚注: AMD Instinct MI400-001A - AMD パフォーマンス ラボが 2026 年 7 月に実施したエンジニアリング予測に基づいて、FP64 (Vetor) データ型を使用した AMD Instinct™ MI430X GPU、AMD Instinct MI300X GPU、Nvidia Rubin GPU のピーク時における理論上の演算精度を推定し、比較しました。市場に発売される製品では、結果が異なる可能性があります。

AMD Instinct MI430X GPU は 2027 年に提供が開始される予定です。詳細は今後発表される予定です。

リソース

ブログ

AMD Instinct アクセラレータに関する最新のブログをお読みください。

最新情報を入手

サインアップして、最新のデータセンター ニュースとサーバー コンテンツを受信します。

脚注
  1. 2026 年 6 月に AMD パフォーマンス ラボが実施した計算に基づき、AMD Helios ラックスケール ソリューションのピーク時における理論上の精度性能を判定。ピーク Matrix FP16、BF16、INT8 データ型およびピーク Open Compute Project MXFP6、MXFP8、FP8、MXFP4 データ型を使用し、比較対象は、NVFP4 Dense データ型および FP8/FP6 データ型を使用する NVIDIA Vera Rubin NVL72 ラックです。システム メーカーの構成によって、異なる結果が生じる場合があります。MI400-005
  2. 2026 年 6 月に AMD パフォーマンス ラボが実施した計算に基づき、AMD Instinct™ MI455X GPU のピーク時における理論上の精度性能を判定。ピーク Matrix FP16、BF16、INT8 データ型およびピーク Open Compute Project MXFP6、MXFP8、FP8、MXFP4 データ型を使用し、NVFP4 Dense データ型を使用する NVIDIA Vera Rubin GPU の公開されている Preliminary 仕様と比較しました。システム メーカーの構成によって、異なる結果が生じる場合があります。MI400-003
  3. 2026 年 6 月に AMD パフォーマンス ラボが実施した計算。AMD Instinct™ MI455X および MI430X GPU の公表されているメモリ容量とメモリ帯域幅に基づき、NVIDIA Vera Rubin GPU の公表されているメモリ容量およびメモリ帯域幅の仕様と比較しました。 システム メーカーの構成によって、異なる結果が生じる場合があります。MI400-004
  4. AMD パフォーマンス ラボの計算 (2026 年 6 月) に基づき、AMD Instinct™ MI455X GPU を使用したピーク時における理論上の精度性能 (FP32、FP16、BF16、MXFP6、MXFP8、FP8、MXFP4 Matrix/Vector) を、AMD Instinct™ MI355X、MI350X、MI325X、MI300X、MI250X、MI100 GPU の公開仕様と比較しました。システム構成およびデータ型によって、異なる結果が生じる場合があります。MI400-006