-
Arquitetura da GPU
-
CDNA4
-
Lithography
-
TSMC 3nm | 6nm FinFET
-
Processadores de streaming
-
8,192
-
Núcleos de matriz
-
512
-
Unidades de computação
-
128
-
Pico do clock do mecanismo
-
2200 MHz
-
Desempenho de matriz
máximo para microdimensionamento de precisão de quatro bits (MXFP4)
-
4.6 PFLOPs
-
Desempenho de matriz
máximo para microdimensionamento de precisão de seis bits (MXFP6)
-
4.6 PFLOPs
-
Desempenho de matriz
máximo para microdimensionamento de precisão de oito bits (MXFP8)
-
2.3 PFLOPs
-
Desempenho de matriz máximo (E5M2, E4M3)
para projetos de computação de oito bits (OCP FP8)
-
2.3 PFLOPs
-
Desempenho de matriz máximo
para projetos de computação de oito bits (OCP FP8) com esparsidade estruturada
-
4.6 PFLOPs
-
Desempenho de matriz de precisão de meio pico (FP16)
-
1.15 PFLOPs
-
Desempenho de matriz de precisão de meio pico (FP16) com esparsidade estruturada
-
2.3 PFLOPs
-
Desempenho da precisão de meio pico (FP16)
-
72 TFLOPs
-
Desempenho da matriz da precisão de pico único (FP32)
-
72 TFLOPs
-
Desempenho da precisão de pico único (FP32)
-
72 TFLOPs
-
Desempenho da matriz da precisão de pico duplo (FP64)
-
36 TFLOPs
-
Desempenho da precisão de pico duplo (FP64)
-
36 TFLOPs
-
Desempenho de matriz de pico INT8
-
2.3 POPs
-
Desempenho de matriz de pico INT8 com esparsidade estruturada
-
4.6 POPs
-
Peak bfloat16 (BF16) Matrix Performance
-
1.15 PFLOPs
-
Peak bfloat16 (BF16) Matrix Performance with Structured Sparsity
-
2.3 PFLOPs
-
Contagem de transistor
-
73 Billion
-
Suporte a SO
-
Linux x86 64-Bit