Tags:
Microsoft expande infraestrutura de IA e HPC do Azure com a AMD
Por Scott Guthrie, vice-presidente executivo, Cloud + AI
As cargas de trabalho de IA estão escalando mais rapidamente do que qualquer abordagem única de infraestrutura consegue suportar, com mais modelos, novas cargas impulsionadas por agentes e uma demanda crescente por computação, o que aumenta a necessidade de maior especialização em todo o conjunto de tecnologias. Para atender a essa necessidade, a Microsoft continua a evoluir a infraestrutura do Azure, incluindo a expansão de sua frota de IA com as soluções mais avançadas da AMD para IA e computação de alto desempenho (HPC).
Nossa abordagem para infraestrutura de IA foi projetada para dar suporte à variedade de formas como os sistemas de IA são criados e executados. Trabalhamos em estreita colaboração com inovadores de indústria, como a AMD, bem como com nossos próprios sistemas e componentes desenvolvidos com especificidades, para oferecer aos clientes uma plataforma abrangente, aberta e heterogênea, capaz de alcançar os melhores resultados de desempenho, custo e eficiência energética.
Com base em nossa estreita colaboração com a AMD, a Microsoft está trazendo para o Azure a mais recente plataforma de IA Helios da AMD e os processadores de datacenter EPYC de próxima geração. Essas tecnologias vão impulsionar três ofertas futuras do Azure: VMs HDv2 para processamento de dados, VMs HXv2 para automação de design eletrônico (EDA) e VMs ND MI455X v7 para cargas de trabalho de inferência de IA.
Infraestrutura expandida para inferência, sistemas de dados de IA e design de chips
Desenvolvido para sistemas de dados de IA — Azure HDv2
A infraestrutura de CPU é essencial para o desempenho e a eficiência dos sistemas modernos de IA. Aceleradores de IA dependem de computação de CPU de alta densidade e eficiência energética para processar dados, coordenar cargas de trabalho e manter pipelines em funcionamento em escala. Sem isso, os trabalhos de treinamento não têm dados suficientes para aprender, e os agentes não têm capacidade suficiente para realizar tarefas em nome dos clientes. As máquinas virtuais Azure HDv2 são uma de nossas ofertas mais recentes, projetadas desde o início para eliminar esses gargalos e viabilizar a adoção massiva de cargas de trabalho agênticas.
Codesenvolvidas com a AMD, as VMs HDv2 expandem o portfólio do Azure de soluções criadas especificamente para as cargas de trabalho de CPU mais exigentes de clientes de IA, incluindo preparação de dados, busca, aprendizado por reforço e coordenação de agentes em escala. Com quase 500 núcleos físicos de CPU AMD EPYC de 6ª geração, 4 terabytes de RAM, 32 terabytes de armazenamento local NVMe e rede Azure Boost de 400 Gb, as VMs HDv2 foram criadas para atender às necessidades dos nossos clientes de IA mais exigentes.
Otimizado para design de silício e computação técnica — Azure HXv2
A era da IA criou uma enorme necessidade e oportunidade para empresas que desenvolvem os produtos de silício que impulsionam essa infraestrutura. Por esse motivo, as máquinas virtuais Azure HX, lançadas em parceria com a AMD em 2023 e com a tecnologia exclusiva 3D V-cache, tiveram adoção significativa entre empresas de design de silício que trabalham para levar ao mercado chips de IA mais capazes e eficientes. Hoje, estamos anunciando o próximo passo em nossa jornada otimizada para as cargas de trabalho desses clientes: HXv2.
As máquinas virtuais HXv2 se baseiam nos pontos fortes da HX e os ampliam. Elas mantêm a diferenciação que o Azure oferece para cargas de trabalho de simulação RTL ao empregar novamente a tecnologia 3D V-cache, ao mesmo tempo em que oferecem melhorias significativas no desempenho de thread único e na memória. As VMs HXv2 contarão com 176 núcleos de CPU AMD EPYC de 6ª geração, com frequência de clock superior a 5 GHz, 50% mais cache endereçável por núcleo e tamanhos de VM com quase 2 ou 4 terabytes de RAM, ajudando os clientes a otimizar suas cargas de trabalho de acordo com as necessidades de memória.
O Azure HXv2 também foi projetado para dar suporte a uma gama mais ampla de cargas de trabalho de computação técnica, incluindo simulação científica, análise de engenharia e outras aplicações de memória distribuída. O desempenho significativamente maior por VM e por núcleo, além da inclusão de InfiniBand de 800 Gb, viabiliza simulações baseadas em MPI em larga escala e torna a HXv2 uma opção ideal para uma ampla variedade de clientes de HPC.
A AMD, uma das principais clientes da série HX, destaca esse impacto diretamente:
“As equipes de engenharia estão ampliando os limites da simulação, do design de chips e da computação científica. Na AMD, vivenciamos essas demandas em primeira mão enquanto projetamos as futuras CPUs AMD EPYC e GPUs AMD Instinct. O Azure HX é uma plataforma importante para escalar cargas de trabalho complexas de Automação de Projeto Eletrônico (Electronic Design Automation – EDA), e estamos entusiasmados com o Azure HXv2, que foi projetado para entregar desempenho e escalabilidade ainda maiores. Esperamos continuar nossa colaboração com a Microsoft enquanto ajudamos a avançar a infraestrutura para as cargas de trabalho de engenharia e científicas mais exigentes do mundo”.
— Mark Papermaster, vice-presidente executivo e CTO da AMD
A HXv2 também aproveita a colaboração de longa data da Microsoft com a Synopsys para otimizar soluções de EDA com IA no Azure:
“À medida que a computação de IA continua a ampliar os limites do design de semicondutores, nossa colaboração com a Microsoft na série Azure HX demonstra uma visão compartilhada para permitir que os clientes entreguem sistemas de IA de próxima geração com precisão e escala em ciclos de design acelerados. Esses sistemas permitiram que os clientes da Synopsys aproveitassem a computação baseada em nuvem de forma confiável e eficiente, estendendo as cargas de trabalho de EDA para além das restrições da infraestrutura tradicional, para que possam cumprir cronogramas de desenvolvimento ambiciosos, maximizando a qualidade do design e entregando ganhos de desempenho expressivos”.
— Shankar Krishnamoorthy, diretor de desenvolvimento de produtos da Synopsys
Inferência de IA em escala de produção — ND MI455X v7
A ND MI455X v7 foi projetada para as cargas de trabalho de raciocínio, busca e agentes por trás dos serviços modernos de IA. Impulsionada pela solução AMD Helios em escala de rack, ela expande as opções de infraestrutura do Azure para inferência em larga escala e foi projetada para entregar forte desempenho e eficiência para cargas de trabalho de IA exigentes.
Juntas, essas novas capacidades expandem os recursos do Azure, ao mesmo tempo em que oferecem aos clientes mais flexibilidade para escolher a computação certa para cada fluxo de trabalho de IA específico: da inferência aos sistemas de dados e ao design de chips. A escolha do cliente é um princípio central de design incorporado diretamente ao Microsoft Azure, e estamos entusiasmados em trazer as inovações mais avançadas da AMD em escala de produção.
Para saber mais sobre os recursos de computação de alto desempenho e infraestrutura de IA do Azure, acesse Azure.com.
Scott Guthrie é responsável por um conjunto de soluções e serviços de computação em nuvem em hiperescala, incluindo o Azure, a plataforma de computação em nuvem da Microsoft, soluções de IA generativa, plataformas de dados e informação e cibersegurança. Essas plataformas e serviços ajudam organizações em todo o mundo a resolver desafios urgentes e a se transformar para o futuro.
The post Microsoft expande infraestrutura de IA e HPC do Azure com a AMD appeared first on Source LATAM.






