En febrero de 2024, Yandex (la empresa a menudo considerada como la versión rusa de Google) anunció que vendería sus activos rusos a un consorcio de inversores por 5.200 millones de dólares.
La noticia llegó casi dos años después de la invasión ilegal rusa de Ucrania, un conflicto que se ha convertido en el más grande y más letal en Europa desde la Segunda Guerra Mundial.
A los pocos meses de estallar la guerra, Yandex ya había vendido su negocio de medios al gigante de redes sociales controlado por el Estado ruso VK (el director de la división fue sancionado en los meses posteriores a la invasión) y, según se informa, estaba buscando una forma de salir de Rusia.
Antes de la venta, el holding de Yandex ya llevaba más de una década radicado en los Países Bajos, y es en Ámsterdam donde el Grupo Nebius, recientemente rebautizado, tiene ahora su sede. La capital holandesa alberga a unos 500 empleados de Nebius, aunque tras la salida de la empresa de Rusia, sus empleados —en particular los rusos que tuvieron que abandonar el país— se asentaron en todo el mundo.
La nueva empresa mantuvo el control del centro de datos finlandés de Yandex y su unidad Nebius AI (la inspiración para su nuevo nombre), así como la firma de datos Toloka AI, el proveedor de tecnología educativa TripleTen y el desarrollador de conducción autónoma Avride.
Como era de esperar, dado su nuevo nombre, Nebius también anunció la creación de una de las empresas de infraestructura de inteligencia artificial (IA) más grandes del mercado con sede en Europa, y que ofrecerá una plataforma en la nube centrada en IA, diseñada para cargas de trabajo intensivas de IA. Su infraestructura integral estará diseñada para impulsar el crecimiento de la industria global de la IA, incluyendo clústeres de GPU a gran escala, plataformas en la nube, y herramientas y servicios para desarrolladores.
En un frío fin de semana a principios de octubre de 2024, DCD fue invitado a Finlandia para visitar el centro de datos de Nebius en Mäntsälä.
Después de un largo tiempo sin poder decir mucho por razones obvias, la compañía finalmente estuvo lista para emerger en su nueva forma y mostrar Nebius al mundo, como lo demostró la serie de anuncios que enmarcaron el viaje.
A principios de octubre, Nebius había anunciado planes para implementar un clúster Nvidia H200 en París como parte del objetivo declarado de la compañía de invertir más de mil millones de dólares en infraestructura de IA en Europa para mediados de 2025.
La semana posterior a la visita, Nebius anunció públicamente que triplicaría la capacidad de su centro de datos finlandés, instalando más de 60.000 GPU en el emplazamiento para ampliar su capacidad a 75 MW. La inversión de 1.000 millones de dólares incluye lo que la compañía invertirá en su plan de expansión finlandesa.
Posteriormente, Nebius anunció la implementación de un clúster de GPU Nvidia H200 en un centro de datos propiedad de Patmos en Kansas City, Misuri, reanudó sus operaciones en el Nasdaq y reveló detalles de una recaudación de capital de 700 millones de dólares. La compañía también planea invertir hasta 1.500 millones de dólares en gastos de capital este año, una parte significativa destinada a GPU e infraestructura de centros de datos.
Llevando la eficiencia al sur de Finlandia
Ubicado en el sur de Finlandia, a 60 km de Helsinki, el viaje al centro de datos de Mäntsälä comienza y termina con un recorrido de una hora a través de la hermosa campiña escandinava.
Este viaje marca la primera vez que Nebius abre sus puertas desde la venta y el cambio de marca. Tras los controles de seguridad habituales en cualquier visita a un centro de datos, DCD es conducido al interior para el recorrido, dirigido por el jefe de infraestructura de Nebius, Andrey Korolenko, un antiguo empleado de Yandex que ocupaba el mismo puesto antes de la separación.
En las palabras de presentación de la empresa, la directora de marketing, Anastasia Zemskova, dice que Nebius busca cerrar la brecha entre los profesionales de IA y las ofertas actuales proporcionadas por los proveedores especializados en nube de IA, que cree que son inadecuadas.
“Nuestro enfoque para construir la nube siempre se ha basado en lo que vemos en el mercado, en el consumo real, en el mundo real de los científicos de datos y matemáticos que actualmente están trabajando arduamente, no solo para entrenar sus modelos, sino también para construir la infraestructura que los sustente eficazmente”, afirma Zemskova. “Nos centramos en el usuario”.
“Lo que vemos en el mercado es que los proveedores de la nube no son capaces de satisfacer las necesidades de los ingenieros de aprendizaje automático, y es muy común que a los usuarios se les ofrezcan GPU sin nube sobre ellas”.
También agrega que la nube "ha estado evolucionando todo el tiempo", por lo que el objetivo de la empresa es brindar una "experiencia similar a un hyperscaler combinada con GPU, para que los usuarios de nuestra nube centrada en IA puedan utilizar lo mejor de la nube, pero tenerla hecha a medida para la IA".
Actualmente, además de las decenas de miles de GPU que alberga, la instalación de 25 MW también alberga la supercomputadora ISEG, un sistema de 46,54 petaflops equipado con CPU Intel Xeon y GPU Nvidia H100. En la edición de noviembre de 2024 de la lista Top500 de las supercomputadoras más potentes del mundo, ISEG ocupó el puesto 29.
En su capacidad actual, el centro de datos de Mäntsälä solo utiliza tecnología de enfriamiento por aire para enfriar sus servidores, uno de los beneficios de construir sus instalaciones en un país donde el aire frío está disponible libremente durante todo el año.
La instalación también exporta calor a través de una red de calefacción urbana local, proporcionando calefacción a unos 2.500 hogares de la zona. Como resultado, según Nebius, el centro de datos se encuentra entre los más eficientes energéticamente del mundo y, actualmente, tiene una PUE de 1,12.
El centro de datos utiliza dos niveles de filtrado para la calidad del aire, y el sistema de admisión de aire tiene una capacidad de 7 a 8 millones de metros cúbicos de aire por hora. El aire exterior se purifica mediante filtros antes de ser conducido a los servidores, a través del pasillo frío, y luego de vuelta a Mäntsälä.
Sin embargo, esto cambiará a medida que la compañía implemente GPU más potentes. Al fin y al cabo, incluso el gélido aire finlandés tiene sus límites ante chips de 1 kW. A partir de diciembre de 2024, Nebius afirmó que se instalará un "sistema de refrigeración líquida diseñado por Nvidia" en Finlandia y en las nuevas instalaciones de colocation de la compañía en Kansas City, para alojar las GPU Nvidia Blackwell.
Otro cambio que experimentará el centro de datos tras su expansión es la eliminación de los generadores diésel. Originalmente instalados para garantizar la disponibilidad en el primer edificio del centro de datos, Korolenko afirma que el segundo, tercer y cuarto edificio no utilizarán generadores diésel, debido tanto a una mejora en el diseño como a la fiabilidad de la red eléctrica finlandesa.
El centro de datos tampoco tiene baterías UPS: "las baterías son un gran dolor de cabeza, para ser honesto", en su lugar dependen de un volante para generar energía cinética que alimentará el alternador si la instalación experimenta una caída de energía.
¿Quieres construir un rack?
Además de mejorar las ofertas actuales de nube de IA, Nebius también busca abordar el desequilibrio de GPU que existe entre Europa y los EE. UU., y señala que debido a que Estados Unidos es tan "hambriento de computación", existe una escasez de hardware en el continente.
“Desde el primer día, nos hemos centrado en construir clústeres enormes para estas grandes cargas de trabajo distribuidas”, afirmó Zemskova. “Pero también vemos la insuficiencia de que quienes necesitan mucho menos no puedan encontrar esas GPU en el mercado. Por eso cubrimos las necesidades de infraestructura de cualquier escala, desde una sola GPU hasta estos clústeres a gran escala”.
Nebius diseña sus propios racks para albergar la sorprendente cantidad de GPU que la empresa ha podido conseguir, incluidas las GPU Nvidia H100, H200 y Blackwell, que, a finales de enero, deberían estar en posesión de la empresa "en cuestión de semanas".
Los racks de Mäntsälä, además de los que pronto se desplegarán en París y Kansas City, han sido diseñados por el propio equipo de I+D de la empresa y, según Nebius, están optimizados para refrigeración gratuita y funcionan dentro de un rango de temperatura de entrada de 15-40 °C (59-104 °F).
La empresa también afirma que los servidores diseñados por Nebius son un 28 por ciento más eficientes en comparación con los de un "centro de datos promedio" y, en combinación con la "excelente eficiencia en el uso de energía" de la instalación, le permite ofrecer "precios competitivos para los recursos de la GPU".
En un documento informativo proporcionado a DCD antes de la visita, Nebius dijo que su hardware “consume aproximadamente entre un 30 y un 50 por ciento menos de energía para los cálculos que los servidores con arquitectura estándar y, al mismo tiempo, ofrece el doble de rendimiento”.
Si bien Nebius no detalló cómo definía el "centro de datos promedio", en un evento en Londres organizado por la compañía en febrero de 2025, Gleb Evstropov, jefe de servicios de computación y red, explicó que la cifra se obtuvo calculando la diferencia entre la energía consumida por un servidor HGX estándar de 19" y un servidor Nebius HGX en diferentes temperaturas de entrada.
Sin embargo, continuó señalando que, si bien la cifra del 28 por ciento se relacionaba con los servidores implementados en los centros de datos de Nebius, era más cercana al 22 por ciento para los servidores implementados en instalaciones de colocation.
A mitad de nuestra visita al centro de datos de Mäntsälä, acababa de llegar un nuevo lote de racks del fabricante en Taiwán y nos detuvimos a observar cómo los desembalaban.
Volviéndose hacia un rack que ya había sido desempaquetado, Korolenko le preguntó al grupo si nos gustaría ver algunos H100, antes de sacar uno de los estantes para revelar hardware de Nvidia con un valor de $600,000.
"Hay un par de Lamborghinis en este estante", dice, con cierta naturalidad.
Nebius es un proveedor de servicios en la nube preferido en la red de socios de Nvidia y, como resultado, aproximadamente 450 de los 1000 ingenieros que la empresa tenía empleados hasta octubre de 2024 trabajan exclusivamente con Nvidia.
Además, la reciente recaudación de fondos de 700 millones de dólares de Nebius incluyó la participación de Nvidia.
En declaraciones a DCD varios meses después del viaje, Korolenko afirma que Nebius sigue implementando principalmente chips H100, pero que pronto recibirá más de 22.000 GPU Blackwell. El pedido consta de B200, GB200, B300 y GB300, que se espera lleguen en ese orden. Nebius comenzará implementando sus chips Blackwell en EE. UU., y pronto se realizarán las implementaciones en Europa.
“Implementar Blackwell llevará más tiempo que implementar la generación actual, por la razón puramente técnica de que las primeras implementaciones suelen ser más largas, ya que es necesario probar todo y arreglarlo todo”, dice Korolenko.
Cuando se le preguntó si estaba preocupado por los problemas de sobrecalentamiento informados anteriormente que habían afectado las primeras implementaciones de Blackwell, Korolenko dice que no es una preocupación para la empresa ya que Nebius ha estado trabajando en sus racks Blackwell desde principios de noviembre y no ha encontrado ningún problema en condiciones de laboratorio.
Sin embargo, agrega que, si bien es normal rediseñar los racks para la mayoría de las nuevas generaciones de chips, Blackwell es notablemente diferente: "tienes diferente potencia, diferente administración y un diseño diferente.
Veremos cómo va el despliegue masivo, pero creo que nos estamos dejando un margen de error, así que creo que será positivo. Será una curva de aprendizaje desde el principio, pero hasta ahora, todo parece ir bien.
El futuro es Nebius
Si bien Nebius se encuentra actualmente haciendo girar muchos platos con forma de GPU en varias regiones, al hablar en enero, Korolenko confía en que los diversos planes de la compañía están según lo previsto.
Sobre su decisión de lanzarse en el mercado estadounidense, donde Nebius alquila espacio en una antigua imprenta convertida en centro de datos en Kansas City, Missouri, dice que tener presencia en Estados Unidos es importante ya que "la mayoría de los clientes y la mayor parte del dinero proviene de Estados Unidos".
Inicialmente, la compañía planea implementar un clúster de GPU Nvidia H200 de 5 MW en el centro de datos propiedad de Patmos, que puede expandirse hasta un máximo de 40 MW, o alrededor de 35 000 GPU, a plena capacidad.
Si bien Korolenko reconoce que Kansas City no es el primer lugar que se viene a la mente al pensar en la ubicación de un centro de datos, afirma que se eligió el sitio por su precio y disponibilidad de energía. Desde entonces, la compañía ha anunciado un sitio de 300 MW en Nueva Jersey.
Sin embargo, este nuevo enfoque en EE. UU. no significa que las ambiciones de Nebius de cubrir el déficit de GPU en Europa se hayan pospuesto, aunque Korolenko señala que no solo escasea el hardware en Europa, sino que también es más difícil encontrar equipos y trabajadores de construcción en el continente en comparación con otras regiones. En marzo, la compañía anunció un pequeño despliegue en el centro de datos de Verne en Islandia.
“[EE. UU.] tampoco está tan preocupado por la energía verde, por ejemplo; ni de lejos, para ser sincero”, afirma. “Además, son mucho más pragmáticos y se centran en las fechas de entrega, mientras que Europa es un poco más relajada”.
A pesar de los desafíos, dado el tiempo que la empresa pasó lidiando con la incertidumbre de su futuro, Nebius parece feliz de encontrarse en una posición en la que puede hablar sobre estas cosas abiertamente.
Korolenko afirma que ha sido un período extremadamente intenso para la empresa, pero argumenta que los proyectos presentados demuestran que podemos lograr lo que Nebius se propuso. Y añade: «Estamos prácticamente en la forma que deberíamos estar como empresa».
Comments