Ir al contenido
IA para hoy
Inversión y mercado Lanzamiento

NVIDIA comienza a entregar Vera, su primer CPU diseñado para IA agentic

Imagen: NVIDIA Blog

Hecho Qué ha ocurrido

NVIDIA ha comenzado a entregar sistemas con su CPU Vera, diseñada específicamente para cargas de trabajo de IA agentic. El vicepresidente de NVIDIA Ian Buck ha entregado personalmente sistemas Vera a AWS, Oracle Cloud Infrastructure, Anthropic, OpenAI y SpaceX AI. Vera integra 88 núcleos Olympus personalizados, 1,2 TB/s de ancho de banda de memoria y ofrece hasta 1,8x más rendimiento por núcleo en cargas agentic. AWS y NVIDIA anunciaron simultáneamente una expansión de su colaboración que incluye 2 millones de GPUs adicionales y planes para infraestructura basada en Vera en AWS.

Resumen generado mediante IA a partir de NVIDIA Blog (original en inglés). Naturaleza de la información: hecho documentado.

Análisis Por qué importa

La IA agentic genera una nueva demanda de CPU que rompe el modelo tradicional de diseño centrado en densidad de núcleos: orquestación, llamadas a herramientas, recuperación en contexto largo y compilación de código son tareas CPU intensivas que las arquitecturas clásicas no priorizan. Vera es el primer paso de NVIDIA hacia hardware codesigned específicamente para este paradigma, con implicaciones inmediatas en eficiencia, latencia y escala de cualquier infraestructura agentic.

Quién se ve afectado
Proveedores de cloud (AWS, Oracle, Azure), laboratorios de IA (OpenAI, Anthropic, SpaceX AI), empresas que desarrollan o despliegan agentes de IA, y clientes enterprise que demandan infraestructura agentic en producción.
Qué puede cambiar
La disponibilidad de CPU optimizadas para agentes agentic podría reducir significativamente el coste total de propiedad de sistemas agentic al eliminar cuellos de botella CPU. Las decisiones de arquitectura en sistemas multi-agente (orquestación, scheduling, integración herramientas) podrán optimizarse con hardware específico, no como compromiso sobre GPU.

Análisis generado a partir de la información disponible; no procede de la fuente.

Predicción Qué observar a continuación

Velocidad de adopción de Vera en clientes enterprise más allá de laboratorios de investigación; comparativas de rendimiento real frente a CPU x86/ARM tradicionales en cargas agentic; disponibilidad y precio en mercado de segunda mano o rental; respuesta de AMD e Intel con ofertas competitivas; integración efectiva en plataformas cloud públicas (AWS, Azure, GCP).

Recomendación Qué debería hacer una empresa

Las organizaciones con cargas intensivas de IA agentic en producción deberían evaluar en los próximos 6-12 meses la migración a infraestructura Vera si operan en AWS u Oracle Cloud, pidiendo POC específicos a sus proveedores cloud.

Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.

Fuente original: NVIDIA Blog (fuente primaria). La referencia es siempre el artículo original.

Ver fuente original ↗

CPUagentic AINVLinkreinforcement learningsimulación cloudhardwareIA agenticinfraestructuraNVIDIA Vera

Relacionadas

Herramientas y productos 3 fuentes

NVIDIA anuncia Vera Rubin y Groq 3 LPX en producción para sistemas agentic

NVIDIA ha anunciado que su plataforma Vera Rubin NVL72 con el acelerador Groq 3 LPX está en producción completa. Según un benchmark de Artificial Analysis con…

Por qué importaLa producción en volumen de Vera Rubin y Groq 3 LPX señala que NVIDIA está estableciendo un nuevo estándar de infraestructura optimizada para agentes…

Impacto alto Fiabilidad confirmado por varias fuentes NVIDIA Blog
Herramientas y productos 3 fuentes

NVIDIA Vera Rubin NVL72 alcanza 30x mayor eficiencia energética en cargas de trabajo agentic

NVIDIA anunció que sus sistemas Vera Rubin NVL72 alcanzan hasta 30x mayor rendimiento por megavatio que GB300 NVL72 en cargas de trabajo de IA agentic, según…

Por qué importaPara empresas que despliegan IA agentic en producción, la eficiencia energética se traduce directamente en rentabilidad: menos megavatios consumidos…

Impacto alto Fiabilidad confirmado por varias fuentes NVIDIA Blog

ChatGPT recupera cuota de tráfico web hasta el 55,5%, según Similarweb

Según datos de Similarweb, ChatGPT ha subido su cuota de tráfico web entre chatbots de IA del 52,7% al 55,5% en tres meses. Gemini bajó del 27,8% al 25,6%…

Por qué importaEl reparto de tráfico entre chatbots indica el grado de competencia real en el mercado de asistentes de IA, aunque la exclusión de móvil y escritorio…

Impacto bajo Fiabilidad declaración interesada The Decoder