Bitget App
Trading Inteligente
Comprar criptoMercadosTradingFuturosEarnCentroMás
Mientras Rubin es muy esperado, Nvidia sigue optimizando Blackwell y la eficiencia energética del GB200 se cuadruplicó en tres meses.

Mientras Rubin es muy esperado, Nvidia sigue optimizando Blackwell y la eficiencia energética del GB200 se cuadruplicó en tres meses.

华尔街见闻华尔街见闻2026/07/22 08:27
Mostrar el original
Por:华尔街见闻

Nvidia está extendiendo la vida útil de la plataforma Blackwell mediante optimización continua de la pila de software, mientras prepara el despliegue a gran escala de la próxima arquitectura Rubin.

En el contexto de la rápida implementación de la nueva plataforma Rubin, Nvidia reveló que en tan solo tres meses, multiplicó por cuatro el rendimiento computacional por megavatio (TPS/MW) del GB200 NVL72 al ejecutar el modelo DeepSeek R1 0528. Este logro es el resultado de 38 optimizaciones importantes completadas en cuatro meses, respaldadas por más de 250 mil pruebas de configuración simulada y un total de 1,4 millones de horas de GPU de validación.

Asimismo, la plataforma GB300 "Blackwell Ultra" sigue batiendo récords en benchmarks de entrenamiento de IA. Con 256 tarjetas, el GB300 NVL72 logró un récord histórico de 1648 TFLOPs por GPU en la tarea de preentrenamiento del modelo DeepSeek-V3 671B, lo que representa un aumento de aproximadamente tres veces respecto a los 606 TFLOPs del GB200; además, este indicador ha aumentado 1,5 veces en los últimos seis meses.

Gran salto en eficiencia energética del GB200, optimización aplicable al 90% de los modelos

Nvidia indicó que las optimizaciones realizadas sobre la plataforma GB200 NVL72 permitieron cuadruplicar el rendimiento computacional por megavatio en tres meses al ejecutar DeepSeek R1 0528 (configuración 1K entrada/1K salida).

Mientras Rubin es muy esperado, Nvidia sigue optimizando Blackwell y la eficiencia energética del GB200 se cuadruplicó en tres meses. image 0

Este incremento fue posible gracias a 38 iteraciones de optimización completadas en cuatro meses, evaluadas mediante más de 250 mil pruebas simuladas y 1,4 millones de horas de GPU de pruebas reales. Nvidia destacó que más del 90% de las mejoras pueden reutilizarse en distintos modelos de su portafolio de productos de IA, y no están hechas a medida para una tarea específica.

Esto significa que los clientes de centros de datos actuales pueden obtener importantes beneficios en eficiencia energética solo actualizando el software, sin necesidad de cambiar hardware—lo cual tiene gran valor económico directo para empresas y proveedores de nube a gran escala, sensibles al costo computacional.

GB300 marca nuevos récords de entrenamiento, mejora de 1,5 veces en seis meses

En el entrenamiento de IA, el GB300 NVL72 también muestra una performance contundente. Con 256 tarjetas y utilizando Megatron Core para preentrenar el modelo DeepSeek-V3 671B, el GB300 NVL72 alcanzó 1648 TFLOPs por GPU, triplicando el rendimiento del GB200 y estableciendo el mayor récord global en esta tarea.

Mientras Rubin es muy esperado, Nvidia sigue optimizando Blackwell y la eficiencia energética del GB200 se cuadruplicó en tres meses. image 1

Lo notable es que este resultado no representa un límite fijo de hardware. Bajo el marco Megatron Core, el rendimiento del GB300 NVL72 creció de 1088 TFLOPs/GPU en noviembre de 2025 a 1648 TFLOPs/GPU en junio de 2026, mejorando 1,5 veces en seis meses.

Mientras Rubin es muy esperado, Nvidia sigue optimizando Blackwell y la eficiencia energética del GB200 se cuadruplicó en tres meses. image 2

En la optimización colaborativa de frameworks AI líderes, la alianza de Nvidia con las comunidades PyTorch y JAX produjo importantes mejoras. En TorchTitan (stack de entrenamiento nativo de PyTorch), el GB300 NVL72 multiplicó por seis el rendimiento de entrenamiento para DeepSeek-V3 671B comparado con la configuración base sin optimizar, pasando de 199 TFLOPs/GPU a 1197 TFLOPs/GPU. En JAX, el salto fue aún mayor: en julio de 2026, el rendimiento alcanzó 4082 Tokens/s por GPU, equivalentes a 1025 TFLOPs/GPU, multiplicando por diez la cifra de enero de 2026 (418 Tokens/s).

Mientras Rubin es muy esperado, Nvidia sigue optimizando Blackwell y la eficiencia energética del GB200 se cuadruplicó en tres meses. image 3

Eficiencia de escalabilidad cercana al límite teórico, la red de 800 Gb/s es clave

La eficiencia de escalabilidad en entornos de entrenamiento masivo es uno de los factores centrales para la utilidad de la infraestructura AI. Nvidia reveló que, entre 256 y 1024 tarjetas, el GB300 NVL72 mantiene eficiencia de escalabilidad casi al límite teórico en los tres principales frameworks: Megatron Core alcanza 98,5%, TorchTitan y JAX llegan al 97%.

Nvidia atribuye este desempeño a los chips de red Scale-Out de 800 Gb/s integrados en los racks NVL72. La interconexión de alta velocidad es crucial para reducir los costos de comunicación en entrenamientos distribuidos, y constituye la base fundamental para la alta eficiencia mencionada en todos los frameworks.

Mientras Rubin es muy esperado, Nvidia sigue optimizando Blackwell y la eficiencia energética del GB200 se cuadruplicó en tres meses. image 4

Despliegue acelerado de la plataforma Rubin, las optimizaciones de Blackwell continúan

Mientras se anuncian estos avances, la próxima generación Vera Rubin de Nvidia ya está siendo desplegada globalmente. Según informes, Vera Rubin NVL72 mejora el rendimiento de tokens en casi diez veces respecto a Blackwell: mientras el GB200 NVL72 procesa unos 80.000 Tokens/s, el Vera Rubin NVL72 alcanza 800.000 Tokens/s bajo el mismo consumo de 150MW.

No obstante, la plataforma Blackwell ya está instalada en numerosos centros de datos alrededor del mundo. Nvidia sigue la misma estrategia que con la generación Hopper—impulsando el nuevo hardware, pero optimizando continuamente el software para maximizar el potencial de los equipos ya desplegados. Esto no solo extiende el ciclo de retorno de inversión para los clientes actuales, sino también refuerza la fidelidad de la plataforma de Nvidia en el ecosistema de infraestructura AI. En términos de mercado, con avances paralelos en Blackwell y Rubin, Nvidia está construyendo un canal de defensa software difícil de superar por la competencia en el corto plazo.

0
0

Descargo de responsabilidad: El contenido de este artículo refleja únicamente la opinión del autor y no representa en modo alguno a la plataforma. Este artículo no se pretende servir de referencia para tomar decisiones de inversión.

PoolX: Haz staking y gana nuevos tokens.
APR de hasta 12%. Gana más airdrop bloqueando más.
¡Bloquea ahora!

También te puede gustar

La caída del "dios de las acciones de IA": tras oler a "sangre", los "buitres" de Wall Street inician la caza

Cuando un gerente de un fondo de cobertura recibió una llamada en un taxi para una "venta urgente de acciones de Anthropic", el juego de caza de Wall Street ya había comenzado. El fondo Situational Awareness, del "profeta de la IA" Aschenbrenner, provocó una pérdida de aproximadamente 35.000 millones de dólares en 72 horas, en medio de rondas de margin call, embates de los vendedores en corto y negociaciones nocturnas de emergencia, convirtiéndose en la mayor pérdida en la historia de los fondos a nivel mundial.

华尔街见闻2026/08/19 02:11

Una encuesta de Bank of America revela que el frenesí de "no aterrizaje" está llevando las posiciones al límite, mientras el "dinero inteligente" de Wall Street se inclina hacia el "flujo de caja compuesto + desajuste de valoración".

La encuesta de agosto del Bank of America muestra que los inversores institucionales esperan que la economía estadounidense experimente un "no aterrizaje" en los próximos 12 meses.

智通财经2026/08/19 02:06
Una encuesta de Bank of America revela que el frenesí de "no aterrizaje" está llevando las posiciones al límite, mientras el "dinero inteligente" de Wall Street se inclina hacia el "flujo de caja compuesto + desajuste de valoración".

La venta masiva de acciones de chips se extiende por Asia: el mercado japonés cae más del 2%, el mercado surcoreano cae un 6% y se suspende temporalmente la venta programada durante 5 minutos.

Durante la noche, la caída del sector de semiconductores en el mercado accionario estadounidense continuó extendiéndose hacia los mercados asiáticos. El índice MSCI Asia Pacífico cayó más del 1%, el índice TOPIX de Japón amplió su baja al 2,4% y el índice Nikkei 225 también retrocedió más del 2%. El KOSPI de Corea del Sur cayó más del 6%, lo que llevó a la Bolsa de Corea a activar el mecanismo SIDECAR, suspendiendo las ventas programadas para frenar la presión vendedora.

华尔街见闻2026/08/19 01:11