Nvidia desveló esta semana los resultados de su sistema GB-trescientos NVL-setenta y dos, un clúster que combina setenta y dos GPU Blackwell y treinta y seis CPU Grace en un solo rack líquido-refrigerado.
El fabricante presume de un salto de cuarenta y cinco por ciento en rendimiento de inferencia frente al GB-doscientos, batiendo su propia marca en los últimos MLPerf con modelos como DeepSeek R-uno y Llama tres punto uno.
La mejora llega gracias a nuevos tensor cores que duplican la aceleración de capas de atención, un formato de pesos NVFP-cuatro que reduce memoria y una malla NVLink de ciento treinta terabytes por segundo que permite fragmentar modelos de billones de parámetros sin cuellos de botella.
Con estas cifras, Blackwell Ultra apunta a dominar los centros de datos de IA de próxima generación o “fábricas de IA”, término que Jensen Huang repitió en la presentación.
Las primeras unidades se embarcan este mismo mes y gigantes cloud como AWS y Oracle han reservado capacidad.
Analistas calculan que el conjunto podría superar los cuarenta petaflops de FP-cuatro, casi triplicando lo visto en Hopper, y abrir la puerta a servicios de IA en tiempo real con latencias sub-cincuenta milisegundos.(T)
Fuente: evafm.net – tomshardware.com



