Reinventando a rede para cargas de trabalho de IA
Entre no futuro dos data centers especificamente projetados para cargas de trabalho de IA com as soluções de rede aberta AMD Pensando™, um conjunto inovador de produtos de alto desempenho, programáveis e abertos que aprimoram e elevam a rede de ponta a ponta.
DPUs AMD Pensando™ impulsionam a rede de front-end
Acelere a movimentação de dados e serviços de infraestrutura em velocidade de linha, liberando recursos de CPU para cargas de trabalho de IA.
Rede escalável para cargas de trabalho de IA em evolução
Os modelos modernos de IA superaram a GPU única. A rede de expansão vertical conecta várias GPUs dentro de um sistema ou rack para formar um único domínio de computação, oferecendo a largura de banda ultra-alta e a baixa latência exigidas por cargas de trabalho de grande escala, como a IA agêntica.
Expansão horizontal e entre sistemas com NICs para IA
Quando as cargas de trabalho de IA abrangem servidores, racks e data centers, a conectividade contínua entre GPUs se torna essencial. A tecnologia AMD AI NIC™ impulsiona a sincronização de alta velocidade exigida pela IA em larga escala.
AMD Helios: desempenho líder de rack para IA em hiperescala1
O design da solução em escala de rack AMD Helios é uma infraestrutura de IA totalmente integrada, que combina as mais recentes GPUs AMD Instinct™, CPUs de servidor AMD EPYC™ e a rede AMD Pensando™, e é projetada com base em padrões abertos do setor, para viabilizar inferência em larga escala, treinamento de modelos de ponta e ajuste fino.
NIC para IA AMD Pensando™ Vulcano 800
Conclua trabalhos de IA até 13% mais rápido2 com a única NIC para IA do mercado compatível com até 2,4 Tbps de largura de banda de expansão por GPU.
Desenvolvendo redes escaláveis para cargas de trabalho de IA
Saiba como a rede de expansão melhora a utilização de GPUs, acelera os trabalhos de IA e reduz o custo de dimensionar a infraestrutura de IA.
Adaptadores e CPUs
O mundo faz negócios com os adaptadores de rede de baixa latência AMD Solarflare™
Chip, software e adaptadores projetados especificamente para mercados de capital
9 em cada 10 bolsas de valores globais usam as soluções Solarflare para suas negociações3
Processadores AMD x86 Embedded
Os processadores AMD x86 Embedded oferecem computação de alta produtividade, E/S robusta e escalabilidade para aplicações como firewalls, roteadores e dispositivos de rede, proporcionando desempenho, eficiência e confiabilidade de longo prazo na borda ou no data center.
Recursos
Estamos projetando a rede com padrões abertos para desempenho em qualquer escala
Notas de rodapé
- Cálculos realizados pelos laboratórios de desempenho AMD em junho de 2025, com base nas especificações projetadas de capacidade/largura de banda de memória e de largura de banda de expansão vertical/expansão do rack de IA "Helios" com AMD Instinct™ MI455X com 72 GPUs em comparação com o rack "Oberon" com NVIDIA "Vera Rubin" com 72 GPUs anunciado publicamente. Os fabricantes de servidores podem variar as configurações, gerando resultados diferentes. MI350-045A
Cálculos dos laboratórios de desempenho AMD em setembro de 2025, com base nos tipos de dados FP8/FP4 e nas especificações projetadas do rack de IA AMD Instinct™ MI455X com 72 GPUs "Helios" versus especificações anunciadas publicamente do rack de IA NVIDIA "Vera Rubin" com 72 GPUs "Oberon". Os resultados reais baseados na produção de silício podem variar. Os fabricantes de servidores podem variar as configurações, gerando resultados diferentes. MI350-046B
- Com base na modelagem de chip da engenharia da AMD e em uma simulação de avaliação de desempenho sintética da AMD, utilizando a avaliação de desempenho MOE_4p5T hi_sparsity_ea9 para projetar a aceleração do tempo até a solução em dias, utilizando o tipo de dados de treinamento FP8 em um sistema LLM simulado, modelado com 8000 GPUs AMD Instinct MI455X e (3) NICs AMD Pensando Vulcano em comparação com (2).
Os resultados refletem a análise de computação pura de treinamento (apenas camadas de decodificação). Configuração avaliada com um tamanho de lote global de 4096 e comprimento de sequência de 4K, utilizando ativação SwiGLU. Os resultados excluem a avaliação e a sobrecarga de ponto de verificação. Assume-se FlashAttention v3 com sobreposição matmul–softmax. Os custos de comunicação AllReduce e All2All são totalmente contabilizados e não são ocultados por meio da sobreposição em blocos entre computação e comunicação. A sincronização de gradientes e a pré-busca de pesos FSDP são avaliadas sob diferentes níveis de sobreposição para avaliar a sensibilidade de expansão. Os resultados pressupõem comportamento ideal e não totalmente otimizado no mundo real, e podem variar quando os produtos reais forem lançados no mercado. MI400-018
- https://focus.world-exchanges.org/issue/june-2025/market-statistics, dados internos de vendas da AMD
- Cálculos realizados pelos laboratórios de desempenho AMD em junho de 2025, com base nas especificações projetadas de capacidade/largura de banda de memória e de largura de banda de expansão vertical/expansão do rack de IA "Helios" com AMD Instinct™ MI455X com 72 GPUs em comparação com o rack "Oberon" com NVIDIA "Vera Rubin" com 72 GPUs anunciado publicamente. Os fabricantes de servidores podem variar as configurações, gerando resultados diferentes. MI350-045A
Cálculos dos laboratórios de desempenho AMD em setembro de 2025, com base nos tipos de dados FP8/FP4 e nas especificações projetadas do rack de IA AMD Instinct™ MI455X com 72 GPUs "Helios" versus especificações anunciadas publicamente do rack de IA NVIDIA "Vera Rubin" com 72 GPUs "Oberon". Os resultados reais baseados na produção de silício podem variar. Os fabricantes de servidores podem variar as configurações, gerando resultados diferentes. MI350-046B - Com base na modelagem de chip da engenharia da AMD e em uma simulação de avaliação de desempenho sintética da AMD, utilizando a avaliação de desempenho MOE_4p5T hi_sparsity_ea9 para projetar a aceleração do tempo até a solução em dias, utilizando o tipo de dados de treinamento FP8 em um sistema LLM simulado, modelado com 8000 GPUs AMD Instinct MI455X e (3) NICs AMD Pensando Vulcano em comparação com (2).
Os resultados refletem a análise de computação pura de treinamento (apenas camadas de decodificação). Configuração avaliada com um tamanho de lote global de 4096 e comprimento de sequência de 4K, utilizando ativação SwiGLU. Os resultados excluem a avaliação e a sobrecarga de ponto de verificação. Assume-se FlashAttention v3 com sobreposição matmul–softmax. Os custos de comunicação AllReduce e All2All são totalmente contabilizados e não são ocultados por meio da sobreposição em blocos entre computação e comunicação. A sincronização de gradientes e a pré-busca de pesos FSDP são avaliadas sob diferentes níveis de sobreposição para avaliar a sensibilidade de expansão. Os resultados pressupõem comportamento ideal e não totalmente otimizado no mundo real, e podem variar quando os produtos reais forem lançados no mercado. MI400-018 - https://focus.world-exchanges.org/issue/june-2025/market-statistics, dados internos de vendas da AMD