NVIDIA presenta plataforma Rubin con seis chips para agentic AI y reducción de costes de inferencia
Hecho Qué ha ocurrido
NVIDIA ha anunciado en CES 2026 la plataforma Rubin, compuesta por seis chips nuevos (Vera CPU, Rubin GPU, NVLink 6 Switch, ConnectX-9 SuperNIC, BlueField-4 DPU y Spectrum-6 Ethernet Switch) diseñados para acelerar entrenamientos e inferencias. El DGX SuperPOD basado en Rubin ofrecerá hasta 10x reducción en el coste de generación de tokens respecto a la generación anterior, con modelos de 576 GPUs Rubin en la configuración Vera Rubin NVL72 entregando 28,8 exaflops de rendimiento FP4. Los sistemas estarán disponibles en la segunda mitad de 2026.
Resumen generado mediante IA a partir de NVIDIA Blog (original en inglés). Naturaleza de la información: hecho documentado.
Análisis Por qué importa
La reducción dramática del coste de inferencia es crítica conforme los modelos de IA crecen en tamaño, contexto y profundidad de razonamiento. Las empresas que despliegan agentes IA y modelos de mezcla de expertos verán oportunidades de escala económica significativas.
- Quién se ve afectado
- Proveedores de computación en la nube, centros de datos empresariales, laboratorios de investigación de IA y organizaciones que entrenan o despliegan modelos de gran escala con razonamiento extendido.
- Qué puede cambiar
- La arquitectura de interconexión de sexta generación (260TB/s por rack) permite operar un rack completo como motor de IA coherente sin particionamiento de modelos, eliminando un cuello de botella tradicional. El codesign extremo de la plataforma sitúa a Rubin como nuevo estándar de referencia para fábricas de IA a escala de gigavatio.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Adopción de primeros clientes (hiperscalers, startups de frontera, centros de investigación) en H2 2026. Impacto en precios de competidores (AMD, Intel) y disponibilidad de alternativas en Ethernet vs InfiniBand. Viabilidad económica real de sistemas de 28.8 exaflops en entornos empresariales.
Recomendación Qué debería hacer una empresa
Evaluar la compatibilidad de pilas de IA existentes con los programadores optimizados de Rubin durante Q2-Q3 2026. Organizaciones con cargas de agentic AI o MoE deben solicitar acceso a programas beta para validar ROI antes de compromisos de inversión mayores.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Enviar esta noticia por correo
Fuente original: NVIDIA Blog (fuente primaria). La referencia es siempre el artículo original.
Ver fuente original ↗Rubin GPUNVLink 6Vera CPUagentesMoE NVIDIA CES 2026chipsDGX SuperPODinfraestructura IANVIDIA Rubin
Forma parte de la historia Nvidia despliega la plataforma Rubin y acelera la infraestructura de IA (5 noticias, estado: cerrada).
Tu opinión
0 comentarios
Relacionadas
NVIDIA lanza Vera CPU especializada en IA agentiva y se posiciona como mayor proveedor de CPUs por ingresos
NVIDIA ha presentado Vera, una CPU basada en arquitectura ARM personalizada (Olympus) diseñada específicamente para cargas de trabajo de IA agentiva e…
Por qué importaNVIDIA diversifica fuera de GPUs hacia un mercado de infraestructura crítica de IA valorado en 200.000 millones de dólares, consolidando su posición…
Nvidia presenta arquitectura Vera Rubin en CES 2026 con triple velocidad que Blackwell
Jensen Huang, consejero delegado de Nvidia, presentó en el CES 2026 la arquitectura Vera Rubin en estado de producción, tras ser anunciada en 2024. Vera Rubin…
Por qué importaVera Rubin representa el siguiente hito en la carrera de infraestructura de IA tras Blackwell, definiendo el estándar técnico para cargas de trabajo…
Nvidia presenta Vera Rubin en CES 2026 con producción masiva de chips de IA
Jensen Huang, CEO de Nvidia, anunció en el CES de Las Vegas que la nueva generación de chips de la compañía, denominada Vera Rubin, ya está en producción…
Por qué importaEl anuncio marca un punto de inflexión en la carrera por la inferencia de IA a escala, donde la velocidad de entrenamiento y respuesta define…
NVIDIA presenta plataforma Rubin con tokens 10 veces más baratos y modelos abiertos
NVIDIA anunció en CES 2026 la plataforma Rubin, su primera plataforma IA de seis chips en producción completa, que reduce el coste de generación de tokens a…
Por qué importaLa reducción de costes en inferencia de IA es crítica para la viabilidad económica de aplicaciones a escala empresarial. El enfoque de Rubin como…
