NVIDIA presenta AI Factories: infraestructura de producción de inteligencia en tiempo real
Hecho Qué ha ocurrido
NVIDIA ha presentado el concepto de 'AI Factories' como una nueva clase de infraestructura diseñada para producir inteligencia continua y en tiempo real, donde la unidad de producción es el token. Según NVIDIA, el GPU Blackwell Ultra logra 50 veces más tokens por megavatio que la generación anterior, con un costo 35 veces menor por token. La plataforma Vera Rubin promete una eficiencia 35 veces superior en rendimiento por vatio, optimizando el stack completo (modelos, computación, networking, memoria, almacenamiento, energía y refrigeración).
Resumen generado mediante IA a partir de NVIDIA Blog (original en inglés). Naturaleza de la información: declaración de parte interesada.
Análisis Por qué importa
Define cómo evolucionará la economía de la infraestructura de IA hacia la medición de coste y rendimiento por token en lugar de por GPU. Para empresas que implementan agentes de IA autónomos en producción, el costo por token se convierte en el factor crítico de rentabilidad y escala.
- Quién se ve afectado
- Proveedores de infraestructura cloud, centros de datos empresariales, empresas que despliegan agentes de IA autónomos, y operadores de modelos de lenguaje a gran escala.
- Qué puede cambiar
- La evaluación de inversiones en infraestructura de IA pasará de pensar en GPU individuales a sistemas completos orquestados. Los requisitos de latencia, memoria y orquestación de software cobrarán tanta importancia como el cálculo puro, cambiando el diseño arquitectónico de centros de datos.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Adopción real de estas métricas (tokens/megavatio, costo por token) en evaluaciones de competidores; disponibilidad y precio de sistemas Blackwell Ultra y Vera Rubin; confirmación de los números de eficiencia en benchmarks independientes; velocidad de despliegue en centros de datos empresariales.
Recomendación Qué debería hacer una empresa
Empresas con cargas significativas de inferencia de IA deben evaluar en los próximos 6 meses cómo migrar a arquitecturas orientadas a AI Factories, comenzando con pilotos en unidades de negocio específicas, y negociar con proveedores (Dell, HPE, Lenovo) sobre disponibilidad de estas plataformas optimizadas.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Enviar esta noticia por correo
Fuente original: NVIDIA Blog (fuente primaria). La referencia es siempre el artículo original.
Ver fuente original ↗Blackwell Ultra GPULLMagentesinferenciaVera Rubin NVIDIACiscoDellHPELenovo agentes autónomosAI Factorieseficiencia tokensinfraestructura IANVIDIA Blackwell
Forma parte de la historia NVIDIA presenta AI Factories con GPU Blackwell Ultra y optimización de costo por token (2 noticias, estado: cerrada).
Tu opinión
0 comentarios
Relacionadas
Barcelona Supercomputing Center impulsa AI Factories para acercar IA a pymes europeas
Albert Cañigueral, responsable de AI Factory en el Barcelona Supercomputing Center (BSC), ha concedido una entrevista en el AMETIC AI Summit 2026. En ella…
Por qué importaLas AI Factories representan una estrategia europea alternativa centrada en democratizar el acceso a infraestructura de supercomputación, problema…
NVIDIA amplía IA para medios: detección de vídeo sintético y herramientas de producción en vivo
En la conferencia IBC 2026 en Ámsterdam, NVIDIA anunció una expansión de NVIDIA AI for Media, con SDKs y microservicios NIM para detección de vídeo sintético…
Por qué importaEstas herramientas permiten a broadcasters y plataformas de streaming automatizar verificación de autenticidad, localización y producción en vivo…
Google DeepMind recrea con IA un recuerdo no fotografiado en el documental 'Love, Rendered'
Google DeepMind colaboró con Primordial Soup, la productora de Darren Aronofsky, y la directora Liz Garbus para crear el documental 'Love, Rendered', que usa…
Por qué importaIlustra un uso creativo y emocional de modelos generativos de imagen y vídeo más allá de aplicaciones empresariales, mostrando capacidades de…
IBM lanza Granite Time Series PatchTST-FM-r2, modelo de pronóstico con licencia comercial abierta
IBM ha publicado PatchTST-FM-r2, un modelo de series temporales de 385M de parámetros con licencia dual Apache 2.0 y OpenMDW 1.0. Según el benchmark GIFT-Eval…
Por qué importaOfrece a empresas un modelo de forecasting de alto rendimiento sin restricciones de licencia, evitando entrenar modelos específicos por dataset y…