El panorama general
Durante años Nvidia dominó el mercado de GPUs para entrenar modelos de IA. Ahora, con Vera Rubin, la compañía ofrece una plataforma que incluye su propio CPU (Vera), GPUs (Rubin) y redes diseñadas a medida (NVLink y Spectrum-X). El objetivo es vender sistemas completos en lugar de chips sueltos.
Vera Rubin ya está en fase de producción y se despliega en más de 350 sitios en 30 países. Los primeros clientes incluyen a CoreWeave, Google Cloud, Microsoft Azure y Oracle Cloud Infrastructure. OpenAI ya tiene un rack funcionando.
El dato clave
Los números que diferencian a Vera Rubin de generaciones anteriores:
- Rendimiento energético: 10x más throughput por megavatio que Grace Blackwell NVL72 según una prueba de CoreWeave con el modelo DeepSeek-R1.
- Velocidad de ensamblaje: el compute tray del NVL72 se monta en 1 minuto, frente a los 90 minutos del modelo anterior (una mejora de 90x).
- Clientes confirmados: CoreWeave, Microsoft, SpaceXAI, Tesla y OpenAI.
Lo que no se dice
La presentación evitó abordar las controversias que rodean a la infraestructura física de IA. Un día después del evento, activistas en Países Bajos lanzaron globos con químicos sobre un centro de datos que da servicio a Microsoft, en protesta por el consumo de energía y agua. Nvidia también enfrenta el desafío de la aceptación social en comunidades donde instala sus equipos.
Además, Jensen Huang, CEO de Nvidia, no asistió al taller; estaba en Japón cerrando acuerdos para robótica con IA, lo que sugiere que la compañía prioriza múltiples frentes de expansión.
Qué sigue
Nvidia venderá el CPU Vera como producto independiente. Ha informado a clientes chinos que podría estar listo a partir de agosto. De concretarse, esto abriría una competencia directa con AMD e Intel en el mercado de CPUs para centros de datos.
La compañía también busca que sus racks sean más "plug-and-play" que los anteriores, reduciendo la intervención humana en la instalación. Esto apunta a una escalabilidad más rápida para los operadores de centros de datos.