Ir al contenido
IA para hoy

Lo esencial del día

Meta y Arm diseñan CPU para IA mientras Google comprime modelos sin perder precisión

24 de marzo de 2026, 13:00

La jornada gira en torno a la infraestructura: hardware específico para inferencia masiva, compresión de modelos y estandarización abierta de la gestión de GPU. En paralelo, OpenAI y Anthropic siguen ampliando el terreno de los productos, con compras dentro de ChatGPT y permisos automáticos en Claude Code.

Meta y Arm co-desarrollan una CPU para centros de datos de IA

Fotografía de archivo que ilustra: Meta y Arm desarrollan CPU Arm AGI para data centers de IA a escala masiva
Foto: Cmglee · CC BY-SA 3.0 · Wikidata

Meta se alía con Arm para crear la Arm AGI CPU, orientada a inferencia a gran escala, y publicará diseños de placa y rack en el Open Compute Project. Reduce su dependencia de procesadores genéricos y propone un estándar abierto para infraestructura de IA.

TurboQuant: Google comprime hasta 6 veces el cache sin perder precisión

Ilustración generada con IA sobre: Google Research presenta TurboQuant para comprimir modelos IA sin pérdida de precisión
Ilustración generada con IA por IA para hoy

El nuevo algoritmo de cuantización de Google Research baja a 3 bits sin reentrenamiento y multiplica por ocho la velocidad en GPU H100 en pruebas con Gemma y Mistral. Abarata la inferencia y hace viable el contexto largo con el hardware ya instalado.

ChatGPT incorpora descubrimiento y comparativa de productos

Ilustración generada con IA sobre: OpenAI integra compras y comparativa de productos en ChatGPT con protocolo de comercio
Ilustración generada con IA por IA para hoy

OpenAI añade una experiencia visual de compra con comparativas lado a lado e integración con comerciantes vía Agentic Commerce Protocol. Para marcas y comercios aparece un canal nuevo que compite con la búsqueda tradicional.

NVIDIA cede a la CNCF la gestión dinámica de GPU en Kubernetes

Fotografía de archivo que ilustra: NVIDIA dona gestor de recursos GPU a Kubernetes para infraestructura de IA empresarial
Foto: Brett Sayles · Licencia Pexels · Pexels

El controlador DRA para GPUs pasa a gobernanza abierta dentro del proyecto Kubernetes, junto con soporte en Kata Containers y el planificador KAI. Simplifica la operación de cargas de IA en las empresas y evita ataduras a soluciones propietarias.

Claude Code estrena modo automático con un clasificador de seguridad

Fotografía de archivo que ilustra: Claude introduce modo automático con validación de permisos en Code
Foto: Digital Buggu · Licencia Pexels · Pexels

Anthropic delega en Claude las decisiones de permisos, con Sonnet 4.6 revisando cada acción para bloquear accesos fuera de alcance o inducidos por contenido malicioso. Gana fluidez el trabajo con agentes, pero la protección pasa a depender de un modelo no determinista.

Modelos gigantes ejecutados en portátiles y móviles mediante streaming desde SSD

Fotografía de archivo que ilustra: Técnica de streaming expande acceso a modelos gigantes en hardware limitado
Foto: Bike756 · Public domain · Wikimedia Commons

Desarrolladores independientes han corrido modelos de cientos de miles de millones de parámetros leyendo pesos desde disco, incluido un caso en iPhone a 0,6 tokens por segundo. Rebaja la barrera de entrada para experimentar en local sin GPU costosas.

El foco competitivo se desplaza del tamaño del modelo al coste por inferencia: conviene vigilar cómo se reparten hardware propio, compresión y estándares abiertos.

Días anteriores

Ver todo el archivo de resúmenes