Cloud

Las empresas pueden alquilar HPC centrados en IA en la nube

Dos anuncios de Google y Azure ilustran el creciente papel de los aceleradores en las ofertas de la nube, ya sean GPU, TPU u otros procesadores especializados. Aceleradores que permiten a estos operadores ofrecer un verdadero HPC bajo demanda en la nube.

Tanto en el corazón de las ofertas de IaaS como en el corazón de las plataformas PaaS, los aceleradores se multiplican en las nubes para responder a las necesidades sectoriales (como los gráficos por ordenador, por ejemplo), a las nuevas necesidades «a distancia» (con ofertas de DaaS cada vez más eficaces, pero también para dar respuesta a las crecientes necesidades de Cloud Gaming), a las necesidades más oscuras y dudosas (para minar bitcoins), pero también y sobre todo para responder a la diversidad de necesidades de la IA. La Inteligencia Artificial se está extendiendo ahora a todos los sectores y a todos los ámbitos. Como resultado, está modificando profundamente las necesidades informáticas de la infraestructura hasta las capas de software más altas. Empezando, por supuesto, por las infraestructuras y las ofertas de los hiperescaladores de la nube.

Esta semana, dos nuevos anuncios ilustran este movimiento subyacente. Google lanza estas «Cloud TPU VMs» y Azure anuncia la disponibilidad general de las instancias GPU NVidia A100.

Con su Máquinas virtuales de TPU en la nubeLanzada en versión preliminar, la nube estadounidense introduce una nueva opción de infraestructura en su oferta de IaaS: instancias equipadas con procesadores TPU (Tensor Processing Unit) desarrollados internamente en Google. Están destinadas a proyectos de IA avanzada, pero también a ciertos procesamientos cuánticos. Google ya había propuesto aprovisionar instancias de TPU (a través de sus Cloud TPU Pods), pero la solución era costosa y lenta, ya que el procesamiento de TPU no se ejecutaba en los mismos servidores físicos que el resto del procesamiento.
Con las nuevas máquinas virtuales Cloud TPU, todo se ejecuta en un único servidor físico para lograr un rendimiento mucho mayor. Los usuarios pueden elegir entre TPU v2 (hasta 180 teraflops) o TPU v3 (hasta 420 teraflops). Cabe señalar que las TPU v4 anunciadas en Google I/O y que ya utiliza Google para sus propias necesidades aún no están disponibles a través de estas instancias de máquinas virtuales Cloud TPU.
cloud TPU podcloud TPU podAdemás de las necesidades específicas de los desarrolladores, Google también pretende con estas nuevas VM proporcionar una forma sencilla y práctica de desarrollar, probar y depurar los algoritmos destinados a sus costosos «Cloud TPU Pods», siendo las Cloud TPU VM infinitamente más accesibles.
Recordemos que un “TPU Cloud Pod” es un grupo de servidores alimentados por TPU que las empresas pueden alquilar para ejecutar sus modelos de aprendizaje más complejos.
Google ofrece dos tipos de Pods: Cloud TPU Pods v2 (11,5 Petaflops y 4 TB de memoria HBM) y Cloud TPU Pods v3 (100 Petaflops y 32 TB de memoria HBM).

Por su parte, Azure ha puesto a disposición del público general una oferta en preview desde hace muchos meses: instancias Azure ND A100 v4instancias potenciadas por las nuevas GPU A100 Tensor Core de NVidia (entre 1,7 y 3,2 veces más potentes que las instancias NVidia V100 ofrecidas anteriormente).
Azure HPCAzure HPCEstas instancias se pueden agrupar en clústeres para formar lo que Microsoft llama “la supercomputadora de nube pública más rápida”.
Las instancias ND A100 v4 están diseñadas para permitir que las empresas escalen hacia arriba o hacia abajo a voluntad y sin disminuir la velocidad.
En otras palabras, las empresas pueden asignar HPCs con aceleradores NVidia A100 a demanda. Estas supercomputadoras a demanda fueron «destelladas» a 16,59 petaflops durante la fase beta en la prueba Linpack HPL. Usando el benchmark HPL-AI, estas supercomputadoras en la nube (compuestas por 164 máquinas virtuales ND A100 v4 ensambladas en un pool) muestran 142,8 petaflops.
Sin embargo, estos resultados se lograron utilizando sólo una fracción de los recursos disponibles en el clúster de Azure.
Estas infraestructuras se han desplegado en las regiones de EE. UU. Este, EE. UU. Oeste 2, EE. UU. Centro Sur y Europa Occidental. Por tanto, Europa no ha quedado olvidada. Así, con los resultados obtenidos en la prueba HPL, una «máquina de nube» equipada con 164 instancias VM ND A100 v4 entra en el TOP 10 de los HPC europeos.

En resumen, cualquier empresa puede ahora alquilar un HPC para una determinada necesidad de IA gracias a las nubes de Google o Microsoft. ¡También es una forma de medir la brecha entre los hiperescaladores estadounidenses y los operadores de la nube europeos en un momento en el que tanto se habla de soberanía digital!

[

Related posts
Cloud

¡Cloud First se vuelve más selectivo!

¿Qué hubiera pasado si “Cloud First” hubiera llegado a su fin? Si bien casi una cuarta parte…
Read more
Cloud

Azure Logic Apps Automation quiere alinear a los agentes de IA

Con Azure Logic Apps Automation, Microsoft quiere convertir la automatización empresarial en un…
Read more
Cloud

Tsuga confía en BYOC para reinventar la observabilidad

En un momento en el que los volúmenes de registros, métricas y rastreos se están disparando, la…
Read more

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *