Microsoft anunció la ampliación de la infraestructura de Azure para la inteligencia artificial y la computación de alto rendimiento mediante la integración de la plataforma AMD Helios más reciente para inteligencia artificial y de los procesadores EPYC de próxima generación diseñados para centros de datos. Estas tecnologías impulsarán tres próximas ofertas de Azure: HDv2 para el procesamiento de datos, HXv2 para la automatización del diseño electrónico y ND MI455X v7 para cargas de trabajo de inferencia de inteligencia artificial.
La medida llega en un momento en que las cargas de trabajo de inteligencia artificial se expanden a un ritmo que ninguna infraestructura individual puede satisfacer, con un aumento del número de modelos, la aparición de nuevas cargas basadas en agentes y una mayor demanda de capacidad informática. Microsoft afirma que Azure avanza hacia una plataforma abierta y diversificada en sus componentes, que combina tecnologías de socios como AMD con chips y sistemas desarrollados internamente por Microsoft, con el objetivo de ofrecer a los clientes más opciones para equilibrar el rendimiento, el coste y la eficiencia energética.
HDv2 para el procesamiento de datos de sistemas de inteligencia artificial
Las máquinas virtuales Azure HDv2 están diseñadas para abordar los cuellos de botella asociados con la infraestructura basada en unidades centrales de procesamiento en los sistemas de inteligencia artificial. Los aceleradores necesitan una capacidad informática densa y eficiente desde el punto de vista energético para procesar datos, coordinar cargas de trabajo y mantener la continuidad de las canalizaciones de procesamiento, mientras que las tareas de entrenamiento y los agentes necesitan capacidad suficiente para alimentar los modelos y ejecutar tareas.
HDv2 se desarrolló en colaboración con AMD para atender cargas como la preparación de datos, la búsqueda, el aprendizaje por refuerzo y la coordinación de agentes a gran escala. Las máquinas virtuales incluyen aproximadamente 500 núcleos físicos de procesadores AMD EPYC de sexta generación, 4 terabytes de memoria de acceso aleatorio y 32 terabytes de almacenamiento local NVMe, además de conectividad de red Azure Boost a 400 gigabits.
HXv2 para el diseño de chips y la computación técnica
HXv2 se basa en la serie HX que Azure lanzó en colaboración con AMD en 2023, la cual utiliza la tecnología 3D V-Cache de AMD y ha sido adoptada por empresas de diseño de chips. HXv2 continúa ofreciendo compatibilidad con cargas de simulación RTL, con mejoras en el rendimiento de un solo hilo y en la memoria.
HXv2 incluye hasta 176 núcleos de procesadores AMD EPYC de sexta generación con una frecuencia superior a 5 gigahercios, además de un aumento del 50 % en la memoria caché direccionable por núcleo. También hay tamaños de máquinas virtuales con cerca de 2 o 4 terabytes de memoria, para ayudar a los clientes a adaptar los recursos de memoria a los requisitos de sus cargas de trabajo.
HXv2 no se limita al diseño de chips; también está dirigida a la simulación científica, el análisis de ingeniería y las aplicaciones de memoria distribuida. La máquina virtual ofrece conectividad InfiniBand a 800 gigabits, lo que permite simulaciones a gran escala basadas en MPI y refuerza su idoneidad para una variedad de cargas de computación de alto rendimiento.
Mark Papermaster, vicepresidente ejecutivo y director de tecnología de AMD, afirmó que los equipos de ingeniería afrontan requisitos cada vez mayores en simulación, diseño de chips y computación científica, y añadió que Azure HXv2 está diseñada para ofrecer un mayor rendimiento y escalabilidad. Shankar Krishnamurthy, director general de desarrollo de productos de Synopsys, también señaló que la colaboración con Microsoft en torno a la serie Azure HX ayuda a los clientes de la empresa a ampliar las cargas de automatización del diseño electrónico mediante la computación en la nube.
ND MI455X v7 para la inferencia de inteligencia artificial
La máquina virtual ND MI455X v7 está diseñada para cargas de inferencia, búsqueda y tareas basadas en agentes que sustentan los servicios modernos de inteligencia artificial. Se basa en la solución AMD Helios, diseñada para infraestructuras en rack, con el objetivo de ampliar las opciones de Azure para la inferencia a gran escala y ofrecer un rendimiento y una eficiencia adecuados para las cargas más exigentes.
Según Microsoft, las tres ofertas proporcionan a los clientes mayor flexibilidad para elegir los recursos informáticos en función del flujo de trabajo requerido, desde la inferencia, pasando por los sistemas de datos de inteligencia artificial, hasta el diseño de chips. El anuncio no especificó la fecha de disponibilidad de estas ofertas ni los detalles de precios.