SDK do ROCm Core

Tudo de que você precisa para desenvolver aplicações aceleradas por GPUs no hardware AMD. O SDK do ROCm Core inclui as bibliotecas essenciais, tempos de execução, compiladores e ferramentas que formam a base da pilha de software ROCm.

Diagram of the ROCm Core SDK showing math, communication, media, storage, runtime, profiling, debugging, and monitoring libraries, including Composable Kernel, MIOpen, rocWMMA, hipBLAS, rocBLAS, RCCL, rocDecode, hipFile, HIP, LLVM, ROCm Compute Profiler, ROCgdb, AMD SMI, and RDC.

Novidades do ROCm 7.14

O TheRock está pronto para produção, o que permite um desenvolvimento mais rápido e modular do ROCm.

Amplo suporte de hardware de IA em GPUs AMD Instinct™, Radeon™ e Ryzen™ AI

Suporte otimizado para as principais estruturas de IA de código aberto e mecanismos de inferência

Implantação de IA pronta para empresas, com orquestração nativa da nuvem e ferramentas para desenvolvedores

Desempenho aprimorado para IA distribuída, criação de perfis e implantação dimensionável

AMD ROCm Lockup White

Evolução do ROCm ao longo dos anos

As principais empresas e institutos de pesquisa têm usado o ROCm há quase uma década. Explore os vários marcos que fazem parte da história do ROCm.

Componentes do SDK do ROCm Core

Explore o principal componente que desenvolve o SDK do ROCm Core

AMD ROCm Lockup White

Bibliotecas de IA, matemática e comunicações aceleradas por GPU para HPC. As bibliotecas roc* nativas otimizam o desempenho em GPUs AMD, enquanto os wrappers hip* simplificam a portabilidade de CUDA. Dimensione cargas de trabalho de IA e HPC distribuídas com várias GPUs de alto desempenho e bibliotecas de comunicação de vários nós.

Crie e execute aplicações de GPU de forma eficiente com cadeias de ferramentas e tempos de execução do compilador AMD. Meça o desempenho, analise o uso da GPU e identifique gargalos com ferramentas de criação de perfil e depuração para otimizar aplicações de IA, HPC e computação acelerada.

Monitore e gerencie hardware de GPU, incluindo temperatura, energia, memória e alocação de recursos, com ferramentas de tempo de execução, driver e sistema operacional.

Monitore e gerencie o estado do hardware da GPU, incluindo temperatura, energia e alocação de recursos.

AI Inference

Inferência de IA de produção com ROCm

Implante os principais modelos abertos em GPUs AMD usando uma pilha de inferência de código totalmente aberto. Comece a trabalhar com contêineres pré-criados e suporte a estrutura de upstream.

Inferência aberta e pronta para uso

De ajustes detalhados a serviços de produção, sem alterar os fluxos de trabalho

O AMD ROCm oferece uma pilha de inferência completa de código aberto com suporte a estrutura de upstream (incluindo PyTorch) e contêineres validados para vLLM e SGLang, para que as equipes possam passar de ajustes delicados e avaliações de desempenho para serviços de produção em GPUs AMD Instinct™ com um fluxo de trabalho consistente.

Inferência eficiente, otimizada por padrão

Alta produtividade sem sobrecarga de ajuste por modelo

O ROCm combina pacotes de modelos quantificados com execução nativa de baixa precisão e kernels de hot-path de transformadores otimizados, reduzindo o esforço de ajuste e maximizando a produtividade e a eficiência para oferecer atendimento em ambiente real.

Inferência distribuída para servidores modernos

Criado para cargas de trabalho de pré-preenchimento, decodificação e expansão horizontal

O ROCm aceita inferência distribuída com desagregação de pré-preenchimento/decodificação e comunicação otimizada de vários nós e várias GPUs, ajudando a manter a capacidade de resposta e a utilização conforme a inferência é expandida.

Pronto para produção no Kubernetes com IA

Execute a inferência de forma confiável em escala de frota

O ROCm se integra ao Kubernetes por meio do AMD GPU Operator, da telemetria integrada e de uma arquitetura de driver modular, com suporte para distribuição automatizada, observabilidade e gerenciamento previsível de ciclo de vida em ambientes seguros e isolados.

Treinamento de IA

Treinamento de IA de ponta a ponta em grande escala em GPUs AMD

Treine e ajuste os modelos de IA em GPUs AMD com uma plataforma de software aberta e completa. Aproveite estruturas otimizadas, aceleração eficiente de GPU e dimensionamento uniforme de uma única GPU para clusters de vários nós.

Desempenho otimizado de treinamento de IA

Acelere o treinamento do modelo com computação e otimizações

O ROCm aproveita os recursos de processamento paralelo das GPUs AMD para reduzir o tempo de treinamento e melhorar o desempenho geral das cargas de trabalho de IA. Com bibliotecas otimizadas, gerenciamento eficiente de recursos e suporte para estruturas de IA modernas, os desenvolvedores podem treinar modelos maiores mais rapidamente e, ao mesmo tempo, maximizar a utilização da GPU.

Ajuste eficiente para IA especializada

Adapte modelos de base para tarefas específicas de domínio com o ROCm

O ROCm impulsiona o ajuste fino de grandes modelos de linguagem e outros modelos de base em GPUs AMD com bibliotecas otimizadas, compatibilidade ampla com frameworks e gerenciamento eficiente de recursos. Ajuste os modelos com mais rapidez e, ao mesmo tempo, faça a integração perfeita com estruturas, modelos e ferramentas de código aberto.

Treinamento distribuído dimensionável

Execute o treinamento de vários nós de forma confiável em clusters de GPU AMD

O Primus ajuda as equipes a dimensionar o treinamento em clusters de GPU AMD com execução distribuída, programação com reconhecimento de topologia e operação tolerante a falhas. Isso dá suporte a treinamento mais consistente à medida que as cargas de trabalho e os clusters crescem.

Operações de treinamento prontas para empresas

Telemetria, validação e recuperação mais rápida para tarefas de longa duração

O Primus fornece telemetria, painéis e avaliações de desempenho de integridade de nós, dando às equipes visibilidade do desempenho do treinamento e da integridade do cluster. Isso ajuda as organizações a operar grandes cargas de trabalho de treinamento com maior confiabilidade e solução de problemas mais rápida.

ROCm para HPC e supercomputação

Crie e escale aplicações de HPC com ROCm

O ROCm possibilita a computação de alto desempenho em GPUs AMD, de bibliotecas otimizadas aos principais supercomputadores

Acelerando a inovação em HPC

Avanços tecnológicos em ciência, engenharia e pesquisa

O AMD ROCm™ possibilita a HPC (High-Performance Computing, Computação de alto desempenho) e as cargas de trabalho de supercomputação em energia, dinâmica molecular, física, química computacional, ciência climática, e outros domínios de pesquisa, fornecendo uma plataforma de software aberto para ajudar a enfrentar alguns dos desafios computacionais mais complexos do mundo.

Programação flexível de HPC

Desenvolva com as ferramentas ideiais para sua aplicação

O ROCm suporta vários modelos de programação de HPC, incluindo OpenMP®, HIP, OpenCL™ e Python™, dando aos desenvolvedores a flexibilidade para criar, otimizar e dimensionar aplicações usando as linguagens e estruturas que melhor se adaptam às suas cargas de trabalho.

Bibliotecas otimizadas de HPC

Acelere aplicações com bibliotecas otimizadas

O ROCm inclui um conjunto abrangente de bibliotecas de matemática e comunicação projetadas para simplificar o desenvolvimento de HPC e, ao mesmo tempo, melhorar o desempenho, a escalabilidade e a eficiência das aplicações em todas as plataformas de computação AMD.

Comprovado em supercomputação

Escala que impulsiona os principais supercomputadores do mundo

A AMD equipa 177 dos supercomputadores da Top500, incluindo o Frontier, o LUMI e o futuro sistema El Capitan. O ROCm fornece a base de software para executar algumas das maiores e mais exigentes aplicações de HPC do mundo em exascale e além.

Estudos de caso de parceiros

Parcerias e sucesso comprovado

Confira como as empresas e os principais institutos de pesquisa fizeram parceria com a AMD.

Blogs em destaque

Apresentando o ROCprofiler

Explore o novo SDK ROCprofiler e saiba como sua infraestrutura de criação de perfil unificada agiliza a otimização do desempenho para aplicações de IA e HPC em GPUs AMD.

Ferramentas de criação de perfis da AMD

Saiba como as ferramentas de criação de perfis da AMD fornecem insights detalhados sobre o desempenho para ajudar os desenvolvedores a fazer avaliações de desempenho, definir perfis e otimizar aplicações heterogêneas executadas em CPUs e GPUs.

Hardware compatível

Recursos para desenvolvedores

ROCm Developer screen shot

Hub de desenvolvedores do ROCm

Comece a desenvolver aplicações acelerados por GPUs AMD. Visite o Hub de desenvolvedores do ROCm para obter acesso aos mais recentes guias de usuário, contêineres, vídeos de treinamento, Webinars e muito mais.

Boletim informativo do ROCm

Receba as últimas novidades sobre o ROCm.

Notas de rodapé

©2024 Advanced Micro Devices, Inc. Todos os direitos reservados. AMD, o logotipo de seta AMD, AMD ROCm, AMD Instintic, EPYC, Radeon Instinct e suas combinações são marcas registradas da Advanced Micro Devices, Inc. PyTorch é uma marca comercial ou marca registrada da PyTorch. Outros nomes de produtos usados nesta publicação são apenas para fins de identificação e podem ser marcas comerciais de suas respectivas empresas.

  1. Para obter uma lista completa das peças Radeon compatíveis com o ROCm, acesse https://rocm.docs.amd.com/en/latest/reference/gpu-arch-specs.html