SDK do ROCm Core
Tudo de que você precisa para desenvolver aplicações aceleradas por GPUs no hardware AMD. O SDK do ROCm Core inclui as bibliotecas essenciais, tempos de execução, compiladores e ferramentas que formam a base da pilha de software ROCm.
Novidades do ROCm 7.14
O TheRock está pronto para produção, o que permite um desenvolvimento mais rápido e modular do ROCm.
Amplo suporte de hardware de IA em GPUs AMD Instinct™, Radeon™ e Ryzen™ AI
Suporte otimizado para as principais estruturas de IA de código aberto e mecanismos de inferência
Implantação de IA pronta para empresas, com orquestração nativa da nuvem e ferramentas para desenvolvedores
Desempenho aprimorado para IA distribuída, criação de perfis e implantação dimensionável
Evolução do ROCm ao longo dos anos
As principais empresas e institutos de pesquisa têm usado o ROCm há quase uma década. Explore os vários marcos que fazem parte da história do ROCm.
Componentes do SDK do ROCm Core
Explore o principal componente que desenvolve o SDK do ROCm Core
Bibliotecas de IA, matemática e comunicações aceleradas por GPU para HPC. As bibliotecas roc* nativas otimizam o desempenho em GPUs AMD, enquanto os wrappers hip* simplificam a portabilidade de CUDA. Dimensione cargas de trabalho de IA e HPC distribuídas com várias GPUs de alto desempenho e bibliotecas de comunicação de vários nós.
Crie e execute aplicações de GPU de forma eficiente com cadeias de ferramentas e tempos de execução do compilador AMD. Meça o desempenho, analise o uso da GPU e identifique gargalos com ferramentas de criação de perfil e depuração para otimizar aplicações de IA, HPC e computação acelerada.
Monitore e gerencie hardware de GPU, incluindo temperatura, energia, memória e alocação de recursos, com ferramentas de tempo de execução, driver e sistema operacional.
Monitore e gerencie o estado do hardware da GPU, incluindo temperatura, energia e alocação de recursos.
AI Inference
Inferência de IA de produção com ROCm
Implante os principais modelos abertos em GPUs AMD usando uma pilha de inferência de código totalmente aberto. Comece a trabalhar com contêineres pré-criados e suporte a estrutura de upstream.
Inferência aberta e pronta para uso
De ajustes detalhados a serviços de produção, sem alterar os fluxos de trabalho
O AMD ROCm oferece uma pilha de inferência completa de código aberto com suporte a estrutura de upstream (incluindo PyTorch) e contêineres validados para vLLM e SGLang, para que as equipes possam passar de ajustes delicados e avaliações de desempenho para serviços de produção em GPUs AMD Instinct™ com um fluxo de trabalho consistente.
Inferência eficiente, otimizada por padrão
Alta produtividade sem sobrecarga de ajuste por modelo
O ROCm combina pacotes de modelos quantificados com execução nativa de baixa precisão e kernels de hot-path de transformadores otimizados, reduzindo o esforço de ajuste e maximizando a produtividade e a eficiência para oferecer atendimento em ambiente real.
Inferência distribuída para servidores modernos
Criado para cargas de trabalho de pré-preenchimento, decodificação e expansão horizontal
O ROCm aceita inferência distribuída com desagregação de pré-preenchimento/decodificação e comunicação otimizada de vários nós e várias GPUs, ajudando a manter a capacidade de resposta e a utilização conforme a inferência é expandida.
Pronto para produção no Kubernetes com IA
Execute a inferência de forma confiável em escala de frota
O ROCm se integra ao Kubernetes por meio do AMD GPU Operator, da telemetria integrada e de uma arquitetura de driver modular, com suporte para distribuição automatizada, observabilidade e gerenciamento previsível de ciclo de vida em ambientes seguros e isolados.
Treinamento de IA
Treinamento de IA de ponta a ponta em grande escala em GPUs AMD
Treine e ajuste os modelos de IA em GPUs AMD com uma plataforma de software aberta e completa. Aproveite estruturas otimizadas, aceleração eficiente de GPU e dimensionamento uniforme de uma única GPU para clusters de vários nós.
Desempenho otimizado de treinamento de IA
Acelere o treinamento do modelo com computação e otimizações
O ROCm aproveita os recursos de processamento paralelo das GPUs AMD para reduzir o tempo de treinamento e melhorar o desempenho geral das cargas de trabalho de IA. Com bibliotecas otimizadas, gerenciamento eficiente de recursos e suporte para estruturas de IA modernas, os desenvolvedores podem treinar modelos maiores mais rapidamente e, ao mesmo tempo, maximizar a utilização da GPU.
Ajuste eficiente para IA especializada
Adapte modelos de base para tarefas específicas de domínio com o ROCm
O ROCm impulsiona o ajuste fino de grandes modelos de linguagem e outros modelos de base em GPUs AMD com bibliotecas otimizadas, compatibilidade ampla com frameworks e gerenciamento eficiente de recursos. Ajuste os modelos com mais rapidez e, ao mesmo tempo, faça a integração perfeita com estruturas, modelos e ferramentas de código aberto.
Treinamento distribuído dimensionável
Execute o treinamento de vários nós de forma confiável em clusters de GPU AMD
O Primus ajuda as equipes a dimensionar o treinamento em clusters de GPU AMD com execução distribuída, programação com reconhecimento de topologia e operação tolerante a falhas. Isso dá suporte a treinamento mais consistente à medida que as cargas de trabalho e os clusters crescem.
Operações de treinamento prontas para empresas
Telemetria, validação e recuperação mais rápida para tarefas de longa duração
O Primus fornece telemetria, painéis e avaliações de desempenho de integridade de nós, dando às equipes visibilidade do desempenho do treinamento e da integridade do cluster. Isso ajuda as organizações a operar grandes cargas de trabalho de treinamento com maior confiabilidade e solução de problemas mais rápida.
ROCm para HPC e supercomputação
Crie e escale aplicações de HPC com ROCm
O ROCm possibilita a computação de alto desempenho em GPUs AMD, de bibliotecas otimizadas aos principais supercomputadores
Acelerando a inovação em HPC
Avanços tecnológicos em ciência, engenharia e pesquisa
O AMD ROCm™ possibilita a HPC (High-Performance Computing, Computação de alto desempenho) e as cargas de trabalho de supercomputação em energia, dinâmica molecular, física, química computacional, ciência climática, e outros domínios de pesquisa, fornecendo uma plataforma de software aberto para ajudar a enfrentar alguns dos desafios computacionais mais complexos do mundo.
Programação flexível de HPC
Desenvolva com as ferramentas ideiais para sua aplicação
O ROCm suporta vários modelos de programação de HPC, incluindo OpenMP®, HIP, OpenCL™ e Python™, dando aos desenvolvedores a flexibilidade para criar, otimizar e dimensionar aplicações usando as linguagens e estruturas que melhor se adaptam às suas cargas de trabalho.
Bibliotecas otimizadas de HPC
Acelere aplicações com bibliotecas otimizadas
O ROCm inclui um conjunto abrangente de bibliotecas de matemática e comunicação projetadas para simplificar o desenvolvimento de HPC e, ao mesmo tempo, melhorar o desempenho, a escalabilidade e a eficiência das aplicações em todas as plataformas de computação AMD.
Comprovado em supercomputação
Escala que impulsiona os principais supercomputadores do mundo
A AMD equipa 177 dos supercomputadores da Top500, incluindo o Frontier, o LUMI e o futuro sistema El Capitan. O ROCm fornece a base de software para executar algumas das maiores e mais exigentes aplicações de HPC do mundo em exascale e além.
Estudos de caso de parceiros
Parcerias e sucesso comprovado
Confira como as empresas e os principais institutos de pesquisa fizeram parceria com a AMD.
Blogs em destaque
Hardware compatível
Recursos para desenvolvedores
Boletim informativo do ROCm
Receba as últimas novidades sobre o ROCm.
Notas de rodapé
©2024 Advanced Micro Devices, Inc. Todos os direitos reservados. AMD, o logotipo de seta AMD, AMD ROCm, AMD Instintic, EPYC, Radeon Instinct e suas combinações são marcas registradas da Advanced Micro Devices, Inc. PyTorch é uma marca comercial ou marca registrada da PyTorch. Outros nomes de produtos usados nesta publicação são apenas para fins de identificação e podem ser marcas comerciais de suas respectivas empresas.
- Para obter uma lista completa das peças Radeon compatíveis com o ROCm, acesse https://rocm.docs.amd.com/en/latest/reference/gpu-arch-specs.html
©2024 Advanced Micro Devices, Inc. Todos os direitos reservados. AMD, o logotipo de seta AMD, AMD ROCm, AMD Instintic, EPYC, Radeon Instinct e suas combinações são marcas registradas da Advanced Micro Devices, Inc. PyTorch é uma marca comercial ou marca registrada da PyTorch. Outros nomes de produtos usados nesta publicação são apenas para fins de identificação e podem ser marcas comerciais de suas respectivas empresas.
- Para obter uma lista completa das peças Radeon compatíveis com o ROCm, acesse https://rocm.docs.amd.com/en/latest/reference/gpu-arch-specs.html