OpenAI desplegará aceleradores Cerebras por 10.000 millones hasta 2028 para inferencia
Hecho Qué ha ocurrido
OpenAI ha anunciado un acuerdo con Cerebras para desplegar 750 megavatiios de aceleradores wafer-scale (WSE-3) de la empresa a través de 2028, con un valor superior a 10.000 millones de dólares. El acuerdo incluye que Cerebras construya y gestione datacenters para OpenAI. Los chips de Cerebras ofrecen 21 petabytes por segundo de ancho de banda de memoria SRAM frente a los 22 terabytes por segundo de las GPUs Nvidia Rubin, permitiendo inferencia significativamente más rápida: 3.098 tokens por segundo en modelos como gpt-oss 120B versus 885 tok/s en soluciones competidoras con GPUs.
Resumen generado mediante IA a partir de The Register AI (original en inglés). Naturaleza de la información: hecho documentado.
Análisis Por qué importa
Esta infraestructura es crítica para la viabilidad económica de OpenAI en la era de agentes de IA y modelos de razonamiento extendido, donde la latencia de inferencia es un factor directo de adopción empresarial y valor percibido. El acuerdo posiciona a Cerebras como alternativa viable a Nvidia en inferencia, alterando el mapa de proveedores de chips para IA a escala global.
- Quién se ve afectado
- Empresas de tecnología que compiten en servicios de IA generativa, proveedores de infraestructura de compute, operadores de datacenters, y potencialmente todas las organizaciones que dependen de ChatGPT y servicios OpenAI.
- Qué puede cambiar
- La latencia de inferencia de ChatGPT podría reducirse significativamente, mejorando la experiencia del usuario en casos de uso interactivos y agentes complejos. La arquitectura SRAM-heavy de Cerebras ofrece un cambio en el trade-off entre tamaño de modelo y velocidad, aunque con limitaciones de escala que requieren paralelización.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Adopción real de los aceleradores Cerebras en producción durante 2026-2027; impacto medible en latencia y costos de OpenAI; si otros proveedores de servicios IA replican esta estrategia; evolución de la arquitectura de chips Cerebras (soporte a modelos más grandes, tipos de dato modernos); posible desagregación de la inferencia entre múltiples proveedores de chips.
Recomendación Qué debería hacer una empresa
Las empresas que compiten con OpenAI en servicios IA o que dependen de su infraestructura deberían evaluar el impacto de esta decisión en costos y rendimiento durante los próximos 6-12 meses, y considerar diversificación de proveedores de compute si la latencia es factor competitivo clave.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Enviar esta noticia por correo
Fuente original: The Register AI. La referencia es siempre el artículo original.
Ver fuente original ↗inferenciaSRAMwafer-scale acceleratorsmodelos de razonamientoagentes IA OpenAICerebrasNvidiaTogether AIAMD CerebraschipsinferenciainfraestructuraOpenAI
Forma parte de la historia Infraestructura como barrera principal en adopción empresarial de IA (3 noticias, estado: cerrada).
Tu opinión
0 comentarios
Relacionadas
Más del 50% de proyectos de IA en empresas se retrasan por problemas de infraestructura
Un informe encargado por DDN en asociación con Google Cloud y Cognizant reveló que más de la mitad de los proyectos de IA en empresas estadounidenses se han…
Por qué importaEste hallazgo ilustra una brecha crítica entre la adopción acelerada de IA y la capacidad operativa real de las empresas para implementarla…
Demanda de inversores contra Oracle por endeudamiento masivo en infraestructura de IA
Tenedores de bonos de Oracle han interpuesto una demanda colectiva alegando que la empresa ocultó información sobre necesidad de deuda adicional en su oferta…
Por qué importaIlustra el estrés financiero que genera la carrera por infraestructura de IA entre gigantes tecnológicos y expone riesgos de endeudamiento…
Kepler Computing propone nueva arquitectura de memoria HBM sin litografía EUV
Kepler Computing, startup de San José con 468 millones de dólares recaudados y hasta 245 millones comprometidos por el Departamento de Comercio de EE UU…
Por qué importaSi la tecnología escala, podría reducir cuellos de botella y costes en el suministro de memoria HBM, un componente crítico y caro para el hardware de…
Datos de Ramp muestran freno en el gasto en IA por empleado durante agosto
Según datos de Ramp sobre 70.000 empresas, el 56% de sus clientes pagó por productos de IA en agosto, un crecimiento de solo 0,4% respecto al mes anterior. El…
Por qué importaLa desaceleración en el gasto empresarial, junto con la caída de precios de tokens, pone en duda si los laboratorios de IA podrán recuperar sus…

