GPUs AMD Instinct™ Série MI400
Liderança em IA de fronteira, IA soberana e HPC
As GPUs AMD Instinct™ Série MI400 oferecem uma base aberta baseada em software AMD ROCm™, com escalabilidade desde implantações de hiperescala até ambientes de HPC, IA soberana e pesquisa. Baseadas em padrões abertos, além de virtualização e particionamento para alocação de recursos, as GPUs AMD Instinct Série MI400 mantêm modelos, ferramentas e operações consistentes em escala.
O portfólio abrange a solução em escala de rack AMD Helios™ equipada com 72 GPUs AMD Instinct MI455X para IA de fronteira e a GPU AMD Instinct MI430X para IA soberana e HPC, permitindo que os clientes escolham a plataforma ideal para suas necessidades sem sacrificar a consistência, a flexibilidade ou a escalabilidade.
Equipamento interno
As GPUs AMD Instinct são baseadas na arquitetura AMD CDNA™, que oferece tecnologias avançadas de chiplet, HBM e cache, além de tecnologias AMD Infinity Fabric™ para as GPUs AMD Instinct. A arquitetura AMD CDNA oferece tecnologias de núcleos matriciais e vetoriais para dar suporte a uma ampla variedade de recursos de tipo de dados, desde os altamente eficientes OCP MXFP 8/6/4 (incluindo suporte a esparsidade INT8 e FP16/BF16 para IA) até o mais exigente FP64 para HPC.
Benefícios
- Design de racks
- Desempenho líder
- Avanços da GPU
- Software e Ecossistema
Design de racks
Solução de infraestrutura de IA totalmente integrada para escala
O design da solução em escala de rack AMD Helios é uma infraestrutura de IA totalmente integrada, que combina as mais recentes GPUs AMD Instinct™, CPUs de servidor AMD EPYC™ e a rede AMD Pensando™, e é projetada com base em padrões abertos do setor, para viabilizar inferência em larga escala, treinamento de modelos de fronteira e ajuste fino.
Desempenho líder
Liderança em desempenho de GPU e rack
A solução em escala de rack AMD Helios oferece uma enorme capacidade de produção de IA em nível de rack — desempenho da classe exaFLOP projetado para inferência, treinamento e ajuste fino em hiperescala e em grande escala. Em escala de rack, o AMD Helios oferece até 2,9 exaFLOPS de pico em OCP MXFP4, 1,4 exaFLOPS de pico em OCP MXFP8, 31 TB de memória HBM4 e 1,67 PB/s de largura de banda de memória.
Avanços da GPU
O empacotamento avançado de GPU permite o dimensionamento da IA de última geração
A GPU AMD Instinct™ MI455X traz inovações importantes para permitir o dimensionamento da IA de última geração. A arquitetura chiplet otimiza de forma independente as funções de computação, memória, cache e E/S para melhorias em desempenho, consumo de energia e fabricação. Os dies de computação da GPU AMD Instinct MI455X, empilhados em 3D com ligação híbrida, usam interconexões de alta densidade para proporcionar maior densidade de computação e desempenho aprimorado.
Os 432 GB integrados (12 pilhas) de memória HBM4 de última geração, com uma largura de banda de 23,3 TB/s, permitem que modelos maiores, caches KV e ativações permaneçam na memória local.
Tudo isso interligado, nossa interconexão AMD Infinity Fabric™ de alta largura de banda possibilita comunicações de baixa latência em um pacote CoWoS-L avançado, o que permite a última geração de dimensionamento da IA.
Software e Ecossistema
Liberdade de software de código aberto, projetada para escalar
O software AMD ROCm™ viabiliza a solução em escala de rack AMD Helios com plataformas AMD Instinct MI455X, convertendo inovações de GPU em nível de kernel em resultados de produção confiáveis para inferência, treinamento e ajuste fino. O software ROCm permite execução distribuída previsível com primitivas de comunicação (RCCL), otimizações de cache KV e sobreposição de computação/comunicação ajustada para escala de classe exaFLOP.
Comprovado em exascale e pronto para operadores, o software AMD ROCm ajuda os clientes a realizar implantações mais rapidamente, dimensionar de forma confiável desde um racks até sistemas de classe exascale e manter a portabilidade entre implantações de plataformas e da solução em escala de rack AMD Helios com GPUs AMD Instinct MI455X e MI430X.
A mais poderosa infraestrutura de IA em escala de rack1
Desempenho líder de rack para IA em hiperescala
O design da solução em escala de rack AMD Helios é uma infraestrutura de IA totalmente integrada, que combina as mais recentes GPUs AMD Instinct™, CPUs de servidor AMD EPYC™ e a rede AMD Pensando™, e é projetada com base em padrões abertos do setor, para viabilizar inferência em larga escala, treinamento de modelos de fronteira e ajuste fino.
Desempenho líder para IA de fronteira
Conheça as GPUs AMD Instinct™ Série MI400
GPU AMD Instinct™ MI455X
Construída com base na arquitetura AMD CDNA™ de 5ª geração, a GPU AMD Instinct™ MI455X foi projetada especificamente para a solução em escala de rack AMD Helios, oferecendo desempenho de IA líder para IA de ponta, com suporte a recursos modernos de IA para inferência, treinamento e ajuste fino.
Comparação das especificações da GPU AMD Instinct MI455X
Até 26% mais desempenho de IA em comparação com GPUs concorrentes2
- Desempenho de IA
- Memória
Desempenho de IA
(PFLOPS máximos)
FP4
FP8 | FP6
FP16 | BF16
AMD Instinct MI455X
NVIDIA Vera Rubin
Memória
Capacidade de memória
Largura de banda de memória
AMD Instinct MI455X
NVIDIA Vera Rubin
GPU AMD Instinct™ MI430X
Turbinando a IA para ciência e HPC
A GPU AMD Instinct™ MI430X foi projetada para HPC científico e IA soberana, combinando precisão FP64 para simulação e modelagem com recursos modernos de IA para inferência, treinamento e ajuste fino.
Criada em um ecossistema de software aberto
Estudos de caso
Opções de implantação da AMD Instinct
Perguntas frequentes
- Solução em escala de rack AMD Helios
- GPUs AMD Instinct MI455X
- GPUs AMD Instinct MI430X
Solução em escala de rack AMD Helios
A solução em escala de rack AMD Helios é o primeiro projeto de referência de IA em escala de rack da AMD, construído inteiramente com base no novo padrão Open Rack Wide (ORW) da Meta, submetido ao Open Compute Project (OCP). Ela combina 72 GPUs AMD Instinct MI455X, CPUs AMD EPYC™ e DPUs AMD Pensando™, juntamente com outros componentes líderes em um rack ORW aberto e de largura dupla, projetado para os atuais data centers de escala de IA.
No OCP Global Summit, a Meta apresentou um novo Open Rack para IA com o fator de forma ORW. A AMD está se alinhando com esse projeto aberto por meio da solução em escala de rack AMD Helios, apresentando o primeiro rack completo construído com base nos padrões ORW. Isso demonstra o compromisso da AMD com a abertura: do chip ao sistema, do rack aos clusters de larga escala.
Os racks OCP anteriores tinham largura simples e eram voltados para servidores de uso geral. O ORW apresenta um rack de largura dupla otimizado para sistemas de IA de alta densidade, oferecendo maior potência, resfriamento líquido e bandejas mais largas para acomodar grandes nós de acelerador. A solução em escala de rack AMD Helios utiliza ORW para integrar GPUs, CPUs, DPUs e outros componentes em um sistema de IA unificado, de fácil manutenção e implantação.
Uma solução completa em escala de rack AMD Helios oferece até 1,4 exaFLOPS de computação em FP8, 2,9 exaFLOPS de computação em FP4 e 31 TB de memória HBM4, permitindo o treinamento de IA com trilhões de parâmetros e a inferência de IA em larga escala.
As GPUs AMD Instinct MI455X, que usam a arquitetura AMD CDNA de última geração, contam com 432 GB de memória HBM4 e uma largura de banda de até 23,3 TB/s, o que as torna ideais para a inferência e o treinamento de modelos de IA de classe de fronteira. Cada GPU oferece até 40 PFLOPS FP4 e 2,9 EF FP4 por solução em escala de rack AMD Helios.
A solução em escala de rack AMD Helios é a primeira solução de rack ORW de largura dupla projetada para operações reais, combinando bandejas modulares e facilidade de manutenção com desempenho sustentado em data centers com restrições de energia. Ela reduz a fragmentação substituindo projetos exclusivos e únicos por padrões abertos, incluindo OCP, UALink e UEC, habilitando clusters de IA eficientes e de alto desempenho em escala.
É um projeto de referência, não um produto para venda. A solução em escala de rack AMD Helios é um modelo para parceiros OEM e ODM desenvolverem seus próprios sistemas com suas marcas, com base nos padrões ORW abertos.
A plataforma é equipada com AMD ROCm™, uma pilha de software de IA e HPC de código aberto com suporte imediato (Dia 0) para PyTorch, TensorFlow, JAX, ONNX Runtime, vLLM e Triton. Ela escala de uma única GPU para superclusters multi-rack e evita a dependência de fornecedores.
O projeto de referência da solução em escala de rack AMD Helios está sendo compartilhado com os parceiros neste momento, com implantações em volume previstas para o 2º semestre de 2026.
GPUs AMD Instinct MI455X
As GPUs AMD Instinct™ MI455X impulsionam a solução em escala de rack AMD Helios e oferecem recursos líderes por dispositivo, que são agregados por meio de bandejas repetíveis de 4 GPUs no AMD Helios de 72 GPUs, proporcionando resultados previsíveis e de classe exaFLOP, com facilidade de manutenção.
As GPUs AMD Instinct™ MI455X fornecem:
- Até 40 PFLOPs de desempenho máximo em 4 bits
- Até 20 PFLOPs de desempenho máximo em 8 bits
- HBM4 de 432 GB
- Largura de banda de memória de 23,3 TB/s
Esses recursos são agregados por meio de bandejas repetíveis de 4 GPUs na solução em escala de rack AMD Helios de 72 GPUs.
A memória tornou-se uma das considerações mais importantes para a infraestrutura de IA, pois os modelos continuam aumentando em tamanho e complexidade. Cada GPU AMD Instinct MI455X fornece 432 GB de memória HBM4, enquanto um rack Helios completo oferece 31 TB de memória HBM4. Combinado com uma alta largura de banda de memória, isso permite que os clientes ofereçam suporte a modelos maiores, reduzam a complexidade da infraestrutura e dimensionem com eficiência cargas de trabalho de inferência e treinamento com uso intensivo de memória.
GPUs AMD Instinct MI430X
A GPU AMD Instinct™ MI430X é uma nova GPU desenvolvida especificamente para IA soberana, computação científica e computação de alto desempenho (HPC). A GPU AMD Instinct MI430X foi projetada para suportar cargas de trabalho convergentes de IA e HPC combinando memória HBM4 líder do setor, computação FP64 de alto desempenho e a plataforma aberta de software AMD ROCm™. Ao oferecer 288 TFLOPS de desempenho máximo de FP64 baseado em hardware, a AMD Instinct MI430X foi criada para ajudar governos, instituições de pesquisa e laboratórios nacionais a lidar com as simulações mais exigentes do mundo e aplicações de IA.
A computação científica e a IA soberana exigem cada vez mais uma infraestrutura capaz de suportar a HPC tradicional e a IA moderna. A AMD Instinct MI430X permite que as organizações consolidem essas cargas de trabalho em uma única plataforma, ao mesmo tempo em que melhoram a eficiência, simplificam a infraestrutura e mantêm a abertura e a flexibilidade necessárias para implantações em escala nacional.
Para gigafábricas de IA e centros de computação de alto desempenho, a AMD Instinct MI430X foi projetada para oferecer a fidelidade numérica e a produtividade necessárias para as cargas de trabalho mais exigentes. À medida que os modelos de IA de última geração dependem cada vez mais dos dados de treinamento gerados a partir de simulações de alta fidelidade, a AMD Instinct MI430X ajuda pesquisadores e instituições a criar sistemas de IA com base em dados científicos precisos, permitindo maior confiança na descoberta orientada por IA em áreas como ciência do clima, pesquisa de materiais, engenharia nuclear e dinâmica de fluidos.
As GPUs AMD Instinct™ MI430X oferecem precisão e produtividade incomparáveis em fluxos de trabalho de HPC e IA convergentes, com 288 TFLOPS de FP64 baseados em hardware para computação científica, além de suporte para tipos de dados de IA modernos e recursos de software. Com largura de banda de memória líder do setor de 432 GB de HBM4 e 2,3 TB/s, a AMD Instinct MI430X foi desenvolvida para grandes simulações e modelos com uso intenso de memória, reduzindo a contagem de servidores, diminuindo a complexidade da infraestrutura e aumentando a eficiência ao dimensionar grandes conjuntos de dados.
Sim, espera-se que o próximo sistema Discovery DOE/ORNL dos EUA e dois sistemas europeus, Alice Recoque e Herder, sejam implantados com GPUs AMD Instinct MI430X.
Impulsionada pelo software AMD ROCm™, a AMD Instinct MI430X oferece uma base aberta com modelos de programação, compiladores, bibliotecas, tempos de execução e ferramentas de implantação para HPC e IA. Esse compromisso com padrões abertos apoia a interoperabilidade e a portabilidade de longo prazo entre opções de software, sistemas e redes, ajudando os operadores soberanos a inovar sem se tornarem dependentes.
Estima-se que a AMD Instinct MI430X ofereça desempenho máximo de FLOPs FP64 baseado em hardware 8,7 vezes superior ao da NVIDIA Vera Rubin.
NOTA FINAL: AMD Instinct MI400-001A – com base em projeções de engenharia dos laboratórios de desempenho AMD em julho de 2026, para estimar a precisão teórica máxima da GPU AMD Instinct™ MI430X usando o tipo de dados FP64 (vetorial) em comparação com a GPU AMD Instinct MI300X e a GPU Nvidia Rubin. Resultados sujeitos a alteração quando os produtos forem lançados no mercado.
Espera-se que as GPUs AMD Instinct MI430X estejam disponíveis em 2027. Mais detalhes serão fornecidos no futuro.
Recursos
Fique por dentro
Inscreva-se para receber as últimas notícias sobre data centers e conteúdo sobre servidores.
Notas de rodapé
- Com base em cálculos realizados pelos laboratórios de desempenho AMD em junho de 2026 para determinar o desempenho de precisão teórico máximo da solução em escala de rack AMD Helios utilizando os tipos de dados de pico Matrix FP16, BF16 e INT8 e os tipos de dados de pico Open Compute Project MXFP6, MXFP8, FP8 e MXFP4, em comparação com a NVIDIA Vera Rubin NVL72 com tipo de dados NVFP4 Dense e tipos de dados FP8/FP6. Os fabricantes de sistemas podem variar as configurações, gerando resultados diferentes. MI400-005
- Com base em cálculos realizados pelos laboratórios de desempenho AMD em junho de 2026 para determinar o desempenho de precisão teórico máximo de uma GPU AMD Instinct™ MI455X utilizando os tipos de dados de pico da matriz FP16, BF16, INT8, e os tipos de dados Open Compute Project MXFP6, MXFP8, FP8 e MXFP4, em comparação com as especificações preliminares publicadas da GPU NVIDIA Vera Rubin com tipos de dados NVFP4 Dense. Os fabricantes de sistemas podem variar as configurações, gerando resultados diferentes. MI400-003
- Cálculos realizados pelos laboratórios de desempenho AMD em junho de 2026, com base na capacidade de memória publicada e na largura de banda de memória das GPUs AMD Instinct™ MI455X e MI430X em comparação com as especificações publicadas de capacidade de memória e largura de banda de memória de uma GPU NVIDIA Vera Rubin. Os fabricantes de sistemas podem variar as configurações, gerando resultados diferentes. MI400-004
- Com base em cálculos dos laboratórios de desempenho AMD (junho de 2026) usando uma GPU AMD Instinct™ MI455X, desempenho de precisão teórico máximo (Matriz/Vetor FP32, FP16, BF16, MXFP6, MXFP8, FP8, MXFP4), em comparação com as especificações publicadas para GPUs AMD Instinct™ MI355X, MI350X, MI325X, MI300X, MI250X e MI100. Os resultados podem variar de acordo com a configuração do sistema e tipos de dados. MI400-006
- Com base em cálculos realizados pelos laboratórios de desempenho AMD em junho de 2026 para determinar o desempenho de precisão teórico máximo da solução em escala de rack AMD Helios utilizando os tipos de dados de pico Matrix FP16, BF16 e INT8 e os tipos de dados de pico Open Compute Project MXFP6, MXFP8, FP8 e MXFP4, em comparação com a NVIDIA Vera Rubin NVL72 com tipo de dados NVFP4 Dense e tipos de dados FP8/FP6. Os fabricantes de sistemas podem variar as configurações, gerando resultados diferentes. MI400-005
- Com base em cálculos realizados pelos laboratórios de desempenho AMD em junho de 2026 para determinar o desempenho de precisão teórico máximo de uma GPU AMD Instinct™ MI455X utilizando os tipos de dados de pico da matriz FP16, BF16, INT8, e os tipos de dados Open Compute Project MXFP6, MXFP8, FP8 e MXFP4, em comparação com as especificações preliminares publicadas da GPU NVIDIA Vera Rubin com tipos de dados NVFP4 Dense. Os fabricantes de sistemas podem variar as configurações, gerando resultados diferentes. MI400-003
- Cálculos realizados pelos laboratórios de desempenho AMD em junho de 2026, com base na capacidade de memória publicada e na largura de banda de memória das GPUs AMD Instinct™ MI455X e MI430X em comparação com as especificações publicadas de capacidade de memória e largura de banda de memória de uma GPU NVIDIA Vera Rubin. Os fabricantes de sistemas podem variar as configurações, gerando resultados diferentes. MI400-004
- Com base em cálculos dos laboratórios de desempenho AMD (junho de 2026) usando uma GPU AMD Instinct™ MI455X, desempenho de precisão teórico máximo (Matriz/Vetor FP32, FP16, BF16, MXFP6, MXFP8, FP8, MXFP4), em comparação com as especificações publicadas para GPUs AMD Instinct™ MI355X, MI350X, MI325X, MI300X, MI250X e MI100. Os resultados podem variar de acordo com a configuração do sistema e tipos de dados. MI400-006