Microsoft Azure presenta el primer clúster de supercomputación NVIDIA GB300 NVL72 del mundo para OpenAI

Microsoft Azure anunció hoy la nueva serie NDv6 GB300 VM, que ofrece el primer clúster de supercomputación a escala de producción de sistemas NVIDIA GB300 NVL72, diseñado específicamente para las cargas de trabajo de inferencia de IA más exigentes de OpenAI.

Este clúster a escala de supercomputadora cuenta con más de 4600 GPU NVIDIA Blackwell Ultra conectadas a través de la plataforma de red NVIDIA Quantum-X800 InfiniBand. El enfoque de sistemas único de Microsoft ha aplicado ingeniería radical a la memoria y las redes para proporcionar la escala informática masiva necesaria para lograr un alto rendimiento de inferencia y entrenamiento para modelos de razonamiento y sistemas de IA basados ​​en agentes.

El logro de hoy es el resultado de años de profunda asociación entre NVIDIA y Microsoft para construir una infraestructura de IA diseñada específicamente para las cargas de trabajo de IA más exigentes del mundo y para ofrecer infraestructura para la próxima frontera de la IA. Marca otro momento de liderazgo, asegurando que la inteligencia artificial de vanguardia impulse la innovación en los Estados Unidos.

«La entrega del primer clúster de producción NVIDIA GB300 NVL72 a gran escala de la industria para la IA de vanguardia es un logro que va más allá del potente silicio: refleja el compromiso compartido de Microsoft Azure y NVIDIA de optimizar todas las partes del moderno centro de datos de IA», dijo Nidhi Chappell, vicepresidente corporativo de Microsoft Azure AI Infrastructure.

«Nuestra colaboración ayuda a garantizar que clientes como OpenAI puedan implementar infraestructuras de próxima generación con una escala y velocidad sin precedentes».

Dentro del motor: NVIDIA GB300 NVL72

En el corazón de la nueva serie de máquinas virtuales NDv6 GB300 de Azure se encuentra el sistema NVIDIA GB300 NVL72 refrigerado por líquido y a escala de rack. Cada bastidor es una potencia que integra 72 GPU NVIDIA Blackwell Ultra y 36 CPU NVIDIA Grace en una única unidad cohesiva para acelerar el entrenamiento y la inferencia para modelos masivos de IA.

El sistema proporciona la increíble cantidad de 37 terabytes de memoria rápida y 1,44 exaflops de rendimiento de Tensor Core FP4 por VM, creando un enorme espacio de memoria unificada esencial para modelos de razonamiento, sistemas de IA basados ​​en agentes e IA generativa multimodal compleja.

NVIDIA Blackwell Ultra funciona con la plataforma NVIDIA AI de pila completa, que incluye bibliotecas de comunicaciones colectivas que aprovechan nuevos formatos como NVFP4 para un rendimiento de entrenamiento innovador, así como tecnologías de compilación como NVIDIA Dynamo para un rendimiento máximo de inferencia en el razonamiento de IA.

La plataforma NVIDIA Blackwell Ultra destaca tanto en entrenamiento como en inferencia. En las pruebas comparativas recientes de MLPerf Inference v5.1, los sistemas NVIDIA GB300 NVL72 obtuvieron un rendimiento récord utilizando NVFP4. Los resultados incluyeron un rendimiento de GPU hasta 5 veces mayor en el modelo de razonamiento DeepSeek-R1 de 671 mil millones de parámetros en comparación con la arquitectura NVIDIA Hopper, junto con un rendimiento líder en todos los puntos de referencia recientemente introducidos, como el modelo Llama 3.1 405B.

La estructura de una supercomputadora: NVLink Switch y NVIDIA Quantum-X800 InfiniBand

Para conectar más de 4600 GPU Blackwell Ultra en una única supercomputadora cohesiva, el clúster de Microsoft Azure se basa en una arquitectura de red NVIDIA de dos niveles diseñada para un rendimiento escalable dentro del bastidor y un rendimiento escalable en todo el clúster.

Dentro de cada bastidor GB300 NVL72, el tejido NVIDIA NVLink Switch de quinta generación proporciona 130 TB/s de ancho de banda directo total en 72 GPU Blackwell Ultra. Esto convierte todo el bastidor en un único acelerador unificado con un conjunto de memoria compartida, un diseño fundamental para modelos grandes que consumen mucha memoria.

Para escalar más allá del rack, el clúster utiliza la plataforma NVIDIA Quantum-X800 InfiniBand, diseñada específicamente para IA a escala de billones de parámetros. Equipado con NVIDIA ConnectX-8 SuperNIC y el conmutador Quantum-X800, NVIDIA Quantum-X800 proporciona 800 Gb/s de ancho de banda por GPU, lo que garantiza una comunicación perfecta entre las 4608 GPU.

El clúster de Microsoft Azure también utiliza el enrutamiento adaptativo avanzado, el control de congestión basado en telemetría y las capacidades de aislamiento de rendimiento de NVIDIA Quantum-X800, así como el protocolo de reducción y agregación jerárquica escalable de NVIDIA (SHARP) v4, que acelera las operaciones para aumentar significativamente la eficiencia del entrenamiento y la inferencia a escala.

Impulsando el futuro de la inteligencia artificial

Ofrecer el primer clúster NVIDIA GB300 NVL72 de producción del mundo a esta escala requirió reinventar cada capa del centro de datos de Microsoft, desde refrigeración líquida personalizada y distribución de energía hasta una pila de software rediseñada para orquestación y almacenamiento.

Este último hito marca un gran paso adelante en la construcción de la infraestructura que desbloqueará el futuro de la inteligencia artificial. A medida que Azure alcance su objetivo de implementar cientos de miles de GPU NVIDIA Blackwell Ultra, surgirán aún más innovaciones de clientes como OpenAI.

Obtenga más información sobre este anuncio en Blog de Microsoft Azure.

Andy Yaipen

Acerca de Andy Yaipen

Andy Yaipen es un matemático emprendedor, ingeniero industrial que intenta ayudar en temas académicos y profesionales en empresas tecnológicas en latinoamerica y en el mundo.

Ver todas las entradas de Andy Yaipen →