Google ha lanzado sus máquinas virtuales (VM) A4X impulsadas por Nvidia GB200 NVL72.
Las máquinas virtuales están diseñadas específicamente para entrenar y atender cargas de trabajo de IA a gran escala, en particular aquellas que involucran modelos de razonamiento, LLM con ventanas de contexto largas y escenarios que necesitan concurrencia masiva.
Google Cloud afirma ser el primer y único proveedor de nube que ofrece máquinas virtuales impulsadas por B200 y GB200.
El Nvidia GB200 NVL72 es un sistema compuesto por 72 GPU Nvidia Blackwell y 36 CPU Nvidia Grace basadas en Arm, conectadas a través de Nvidia NVLink de quinta generación.
Cada GB200 NVL72 ofrece más de un exaflop de rendimiento de entrenamiento, y la VM A4X ofrece un aumento de 4 veces en el rendimiento de entrenamiento LLM, en comparación con las VM A3 que funcionan con Nvidia H100.
Las máquinas virtuales A4X permiten la implementación de modelos en decenas de miles de GPU Blackwell y actualmente están disponibles en versión preliminar.
En una publicación del blog de Google escrita por George Elissaios, vicepresidente de infraestructura y computación de IA, y Roy Kim, director de GPU en la nube, señalan que las máquinas virtuales A4X son parte de la arquitectura de supercomputación AI Hypercomputer de Google, y los usuarios pueden "implementar y administrar grandes grupos de máquinas virtuales A4X con computación, almacenamiento y redes como una sola unidad", lo que facilita la gestión de la complejidad en cargas de trabajo distribuidas.
La máquina virtual también incluye el adaptador de red Titanium ML, que se basa en tarjetas de interfaz de red (NIC) Nvidia ConnectX-7. Ofrece 28,8 TBps de tráfico de GPU a GPU sin bloqueos, mientras que cada NVL72 se conecta mediante la red Jupiter de Google.
"Los desarrolladores e investigadores necesitan acceso a la última tecnología para entrenar e implementar modelos de IA para aplicaciones e industrias específicas", afirmó Alexis Bjorlin, vicepresidente de Nvidia DGX Cloud, Nvidia.
"Nuestra colaboración con Google ofrece a los clientes un rendimiento y una escalabilidad mejorados, lo que les permite abordar las cargas de trabajo más exigentes de inteligencia artificial generativa, LLM y computación científica mientras se benefician de la facilidad de uso y el alcance global de Google Cloud".
La publicación del blog también señala que las máquinas virtuales se enfrían mediante "la infraestructura de enfriamiento líquido de tercera generación de Google", aunque no incluye detalles sobre la metodología de enfriamiento más allá de que está "basada en aprendizajes adquiridos a lo largo de años de experiencia operativa".
Google ofreció por primera vez una vista previa de sus racks NVL GB200 en octubre de 2024. A principios de este mes, Google puso a disposición las GPU Nvidia Blackwell en vista previa a través de sus máquinas virtuales A4.
En enero de 2025, Lambda Labs implementó dos racks GB200 NVL72: uno en el centro de datos de EdgeCloudLink en Mountain View, California, y el otro en una instalación de Pegatron. CoreWeave también incorporó instancias GB200 NVL72 a su plataforma en la nube.
En octubre de 2024, Microsoft publicó que era la primera nube que ejecutaba un sistema Blackwell con servidores de inteligencia artificial con tecnología GB200, aunque, según se informó, no se trataba de una configuración NVL72 GB200.
En mayo de 2024, varias empresas anunciaron su intención de implementar las GPU GB200, incluidas Oracle, Amazon, Microsoft, Google y varios proveedores de nube más pequeños.
Comments