El negocio minorista de Amazon ya no está limitado por la falta de acceso a las GPU.
Tal y como ha informado Business Insider (BI), y citando un "tesoro de documentos de Amazon" obtenido por la publicación, Amazon luchó con una falta de capacidad computacional durante 2024 a pesar de que su unidad de computación en la nube Amazon Web Services (AWS) era un importante comprador de GPU.
Este problema ya lo ha solucionado la empresa mediante su iniciativa "Proyecto Greenland".
Se desconoce el número exacto de GPU operadas por AWS. En noviembre de 2024, LessWrong estimó que Amazon contaba con entre 250.000 y 400.000 GPU equivalentes a Nvidia H100, cifra que se espera aumente a 1,3-1,6 millones para finales de 2025. LessWrong también estimó que Amazon compraría aproximadamente 360.000 GPU Nvidia GB200 en 2025.
Además de las GPU adquiridas a empresas como Nvidia y AMD, AWS también desarrolla sus propios chips de inteligencia artificial Trainium. Se desconoce la cantidad de chips Trainium que posee la compañía, pero en diciembre de 2024 anunció que estaba desarrollando un clúster de Trainium2 UltraServers para Anthropic que contendría cientos de miles de chips Trainium.
A pesar de que su departamento de nube dispone de un stock enorme de computación de IA, la división minorista todavía tenía dificultades para acceder a las GPU necesarias.
Insider ha informado que a principios de 2024, algunos empleados de la unidad minorista de Amazon pasaron meses sin conseguir GPU, lo que impidió el lanzamiento de proyectos en toda la división, incluidas las operaciones de comercio electrónico y logística.
Como resultado, Amazon lanzó el "Proyecto Greenland" para ayudarlo a gestionar y asignar mejor el suministro de GPU en julio de 2024.
En uno de los documentos vistos por BI, el Proyecto Greenland se describe como una "plataforma de orquestación de GPU centralizada para compartir la capacidad de GPU entre equipos y maximizar su utilización".
La plataforma rastrea el uso de la GPU por iniciativa, comparte servidores inactivos y permite a la empresa "recuperar" chips para proyectos más urgentes.
"Las GPU son demasiado valiosas para ser entregadas por orden de llegada", declaraba una de las directrices de Amazon. "En cambio, la distribución debería determinarse en función del retorno de la inversión (ROI), junto con consideraciones de sentido común, y contemplar el crecimiento a largo plazo del flujo de caja libre de la empresa".
Amazon prioriza y clasifica la asignación de GPU según diversos factores, como la integridad de los datos proporcionados y el beneficio económico por GPU, según BI. Los proyectos de IA deben estar aprobados para su desarrollo y listos para su ejecución, y deben proporcionarse plazos para los beneficios esperados.
Si Amazon considera que otras iniciativas tienen mayor valor, retirará las GPU de los proyectos, incluso si ya cuentan con aprobación. A partir de 2025, todas las solicitudes de capacidad de GPU de Amazon deben pasar obligatoriamente por Greenland.
La unidad minorista tuvo un déficit de más de 1000 instancias P5 durante el segundo semestre de 2024. Cada instancia P5 consta de ocho GPU Nvidia H100. Un documento de diciembre sugería que se esperaba una ligera mejora a principios de este año.
Además, se esperaba que el chip de inteligencia artificial Trainium de AWS respaldara la demanda a fines de 2025, pero "no antes".
A pesar de esto, un portavoz de Amazon le ha dicho a BI que esas estimaciones están desactualizadas y que ya no hay escasez de GPU.
"Amazon cuenta con una amplia capacidad de GPU para seguir innovando para nuestro negocio minorista y otros clientes de la compañía", declaró el portavoz a BI. "AWS reconoció desde el principio que las innovaciones en IA generativa están impulsando la rápida adopción de servicios de computación en la nube para todos nuestros clientes, incluido Amazon, y evaluamos rápidamente sus crecientes necesidades de GPU y tomamos medidas para ofrecerles la capacidad necesaria para impulsar la innovación".
La unidad minorista de Amazon, según documentos internos, tiene en marcha más de 160 iniciativas impulsadas por IA. La compañía estimó en 2024 que las inversiones en IA habían contribuido indirectamente a 2.500 millones de dólares en proyectos operativos y a un ahorro de 670 millones de dólares en costes variables.
La unidad minorista de la empresa espera gastar alrededor de $5.7 mil millones en AWS este año, frente a los $4.5 mil millones de 2024.
Durante la presentación de resultados del cuarto trimestre de 2024 de Amazon en febrero de 2025, el director ejecutivo y presidente de la compañía, Andy Jassy, señaló que la compañía había experimentado algunas limitaciones de capacidad, que "vienen en forma de chips de nuestros socios externos, limitaciones de energía y cadenas de suministro como las placas base".
"Predigo que esas restricciones realmente empezarán a relajarse en la segunda mitad de 2025. Y, como dije, creo que podemos crecer más rápido, aunque hoy estamos creciendo a un ritmo bastante bueno", añadió.
Comments