El sistema GB200 NVL72 de Nvidia ahora está disponible a través de Oracle Cloud Infrastructure (OCI).
Según se revela en una publicación del blog de Nvidia, Oracle ha implementado miles de GPU Nvidia Blackwell en sus centros de datos y ahora ofrece acceso a ellas a través de su plataforma en la nube.
El sistema Nvidia GB200 NVL72 está compuesto por 72 GPU Nvidia Blackwell y 36 CPU Nvidia Grace basadas en ARM, conectadas mediante Nvidia NVLink de quinta generación. Cada GB200 NVL72 ofrece más de un exaflop de rendimiento de entrenamiento.
En última instancia, Oracle pretende construir un clúster de más de 100.000 GPU Blackwell que formarán uno de sus "Superclusters OCI".
Noticias anteriores sugieren que podrían ser hasta 131.072 GPU Nvidia Blackwell , y su lanzamiento estaba previsto para la primera mitad de 2025. Eso le daría al sistema 2,4 zettaflops de rendimiento máximo, dijo Oracle, aunque se refería al formato FP4, en lugar de FP64 o incluso FP8.
La empresa también cuenta con un superclúster OCI con 65.536 GPU Nvidia H200 que ofrece hasta 260 exaflops de rendimiento máximo en FP8, que entró en funcionamiento en noviembre de 2024. El superclúster OCI H100 puede escalar a 16.384 GPU.
Según la publicación del blog, las GPU Blackwell están disponibles a través de las nubes públicas, gubernamentales y soberanas de Oracle, así como en los centros de datos de propiedad del cliente a través de sus ofertas OCI Dedicated Region y Alloy.
Otros proveedores de nube que han puesto a disposición el sistema NVL72 GB200 son Google y CoreWeave . Lambda también ha implementado al menos dos racks NVL72. Microsoft ofrece las GPU GB200, aunque no se implementan como una máquina NVL72.
Amazon Web Services está trabajando en el "Proyecto Ceiba", un clúster de IA que ofrecerá 20 736 GPU B200 y 10 368 CPU Grace. Ceiba se construirá utilizando la nueva plataforma GB200 NVL72 con refrigeración líquida y NVLink de quinta generación.
Comments