Ir al contenido
IA para hoy

Lo esencial del día

Gemini 3.5 Flash aprende a usar el ordenador y OpenAI estrena chip propio

24 de junio de 2026, 14:00

La jornada confirma dos movimientos de fondo: los agentes que operan software como un humano dejan de ser un producto aparte para integrarse en los modelos generalistas, y los grandes laboratorios buscan controlar su propio silicio. En paralelo, los casos de uso empresariales —banca, sanidad, centros de contacto— muestran cifras concretas de ahorro y calidad.

Uso de ordenador nativo en Gemini 3.5 Flash

Fotografía de archivo que ilustra: Google DeepMind integra capacidad de uso de ordenador en Gemini 3.5 Flash
Foto: Tiger Lily · Licencia Pexels · Pexels

Google DeepMind integra la capacidad de ver e interactuar con navegadores y aplicaciones directamente en Gemini 3.5 Flash, disponible vía API y en Gemini Enterprise Agent Platform. Incluye entrenamiento adversarial y salvaguardias opcionales frente a la inyección de instrucciones, un riesgo clave al dar a un modelo control real sobre aplicaciones.

OpenAI y Broadcom presentan Jalapeño

Fotografía de archivo que ilustra: OpenAI y Broadcom presentan Jalapeño, chip personalizado para inferencia de LLM
Foto: Jeremy Waterhouse · Licencia Pexels · Pexels

El nuevo chip está diseñado específicamente para la inferencia de grandes modelos de lenguaje, con foco en rendimiento, eficiencia energética y escalabilidad. Reduce la dependencia de proveedores externos y apunta a rebajar el coste por consulta, la partida que más pesa en los servicios de IA.

Un banco depura 400 millones de documentos con IA

Fotografía de archivo que ilustra: Huntington Bank procesa 400 millones de documentos con IA: de años a meses
Foto: Yan Krukau · Licencia Pexels · Pexels

Huntington National Bank automatizó la detección y ocultación de datos personales en más de 400 millones de documentos, con una precisión superior al 95% y unos 10 millones de documentos diarios. Pasó de años a meses y gastó cerca del 5% del presupuesto estimado inicialmente.

Agentes de voz con latencia por debajo de 1,4 segundos

Ilustración generada con IA sobre: Loka implementa agente de voz en tiempo real con Amazon Nova 2 Sonic
Ilustración generada con IA por IA para hoy

Loka construyó un agente conversacional con Amazon Nova 2 Sonic que procesa audio sin transcripción intermedia, con 1,39 segundos hasta la primera respuesta y unos 0,27 dólares por hora de audio. AWS publica además una guía para aplicar el mismo enfoque a la gestión de citas médicas.

NVIDIA acelera 3,4 veces el entrenamiento de modelos MoE

Fotografía de archivo que ilustra: NVIDIA NeMo AutoModel acelera el entrenamiento de modelos MoE un 3.4x con API compatible
Foto: Trần Chính · Licencia Pexels · Pexels

NeMo AutoModel optimiza el entrenamiento de mezclas de expertos sobre Transformers v5 y reduce el consumo de memoria de GPU entre el 29% y el 32%, manteniendo la API de Hugging Face. Permite escalar el ajuste fino sin reescribir código ni cambiar de infraestructura.

Las gafas con IA de Meta llegan al Sudeste Asiático

Fotografía de archivo que ilustra: Meta y EssilorLuxottica lanzan Ray-Ban Meta y Oakley Meta en Singapur
Foto: Khoi Pham · Licencia Pexels · Pexels

Ray-Ban Meta de segunda generación y Oakley Meta se venderán en Singapur desde abril de 2026, primera expansión de la gama en la región. Señala que estos dispositivos ya son un producto de consumo masivo más allá de los mercados occidentales.

Conviene vigilar cómo se gobiernan estos agentes con acceso directo a aplicaciones corporativas: la seguridad, y no la capacidad, será el cuello de botella de su despliegue.

Días anteriores

Ver todo el archivo de resúmenes