Tecnología
GPU
Relacionadas
LLM ×2inferencia ×2Google ×2AMD ×2Mirendil ×1arquitectura de sistemas ×1optimización de inferencia ×1decodificación ×1OpenAI ×1orquestación de datos ×1
Historias
Nvidia avanza en orquestación de datos como ventaja más allá de GPUs
Discrepancia entre capacidad declarada e instalada de chips de IA en Microsoft
Asignador de GPUs por restricciones vs FIFO: 33 puntos ganados
Kog promete acelerar inferencia en GPUs estándar con optimización de software
Mirendil y Google Cloud acuerdan inversión de 100M para IA automejorable
Noticias
Nvidia expande su ventaja más allá de las GPU con sistemas de orquestación de datos
Nvidia ha presentado su nueva arquitectura Vera Rubin, que integra junto a la GPU Rubin componentes especializados como la CPU Vera, aceleradores de inferencia…
Por qué importaA medida que los centros de datos escalan a escala de gigavatios, la orquestación eficiente de datos y memoria se convierte en un reto crítico…
Investigación cuestiona capacidad real de chips de IA de Microsoft frente a sus afirmaciones públicas
The Guardian publicó el 17 de agosto un reportaje basado en documentos internos de Microsoft que señala discrepancias entre el número de chips de IA…
Por qué importaLa investigación impacta directamente en la confianza sobre la capacidad real de entrega de servicios de IA de Microsoft (Azure, Copilot, OpenAI) y…
Asignador de GPUs consciente de restricciones mejora utilización en 33 puntos porcentuales
Dharma AI presentó un asignador de GPUs basado en restricciones y lo comparó con un planificador FIFO en siete escenarios de prueba. En hardware idéntico…
Por qué importaPara empresas con clusters de GPUs compartidos, la ineficiencia de los planificadores simples significa capacidad infrautilizada y cuellos de botella…
Kog optimiza inferencia en GPUs estándar con software para acelerar flujos IA
La startup francesa Kog desarrolla un motor de inferencia (KIE) basado en optimización de software para acelerar el procesamiento en GPUs convencionales de…
Por qué importaLa velocidad de inferencia es un cuello de botella crítico en costes y experiencia de usuario para empresas que usan IA en flujos de trabajo…
Mirendil anuncia acuerdo con Google Cloud por más de 100 millones de dólares
Mirendil, un laboratorio de IA nacido con capital de Anthropic, ha firmado un acuerdo multianual con Google Cloud valorado en más de 100 millones de dólares…
Por qué importaEl acuerdo refleja dos dinámicas críticas en la industria: la competencia feroz entre gigantes de nube por asegurar startups de IA frontera mediante…




