Ir al contenido
IA para hoy

Lo esencial del día

La seguridad domina la agenda: razonamientos filtrados y hackeo asistido por IA

11 de agosto de 2026, 14:00

El día ha estado marcado por la seguridad: una vulnerabilidad que permitía extraer el razonamiento oculto de los modelos frontera y un caso que muestra cómo con menos de 20 consultas se descubre un fallo crítico en software empresarial. En paralelo, OpenAI lleva sus modelos de ciberseguridad a Amazon Bedrock y empieza a probar publicidad en ChatGPT, mientras Google y NVIDIA avanzan en medicina multimodal e infraestructura para agentes.

Extraen el razonamiento cifrado de modelos de OpenAI, Anthropic y Google

Fotografía de archivo que ilustra: Investigadores extraen razonamientos ocultos de modelos propietarios mediante trazas cifradas
Foto: cottonbro studio · Licencia Pexels · Pexels

Investigadores lograron descifrar las cadenas de pensamiento ocultas replicando trazas en modelos más débiles de la misma familia, que compartían clave de cifrado. Los proveedores confirmaron y corrigieron el fallo, pero queda expuesto un vector avanzado de inyección de instrucciones dentro de las propias trazas.

Modelos públicos hallan un fallo crítico en Zoom en menos de 20 consultas

Fotografía de archivo que ilustra: Investigadores descubren que modelos IA públicos hallaron vulnerabilidad crítica en Zoom en menos de 20…
Foto: Egor Komarov · Licencia Pexels · Pexels

La vulnerabilidad, en el protocolo de anotaciones durante compartición de pantalla, permitía tomar control del dispositivo de otro participante sin su conocimiento. Zoom ya despliega correcciones; el caso ilustra cómo la IA acelera el descubrimiento de fallos y amplía la superficie de riesgo empresarial.

OpenAI lleva sus modelos Daybreak de ciberseguridad a Amazon Bedrock

Fotografía de archivo que ilustra: OpenAI lanza Daybreak Red y Daybreak Blue en Amazon Bedrock para ciberseguridad
Foto: panumas nikhomkhai · Licencia Pexels · Pexels

Daybreak Red y Daybreak Blue, basados en GPT-5.6 Cyber y Sol, se ejecutan sin acceso de operadores y ya han servido para hallar dos vulnerabilidades desconocidas en el motor V8 de Chrome. Es la vía de OpenAI para llegar a la empresa a través de un distribuidor establecido.

AMIE, de Google, realiza consultas clínicas por vídeo en tiempo real

Fotografía de archivo que ilustra: Google AMIE demuestra consultas clínicas por vídeo en tiempo real con capacidades de experto
Foto: MART PRODUCTION · Licencia Pexels · Pexels

El sistema, construido sobre Gemini y Project Astra, interpretó señales visuales y auditivas, guió exámenes virtuales y razonó diagnósticos en directo, con buena valoración de médicos evaluadores. Apunta a la telemedicina asistida como aplicación cercana.

NVIDIA presenta Nemotron 3.5 Lightning y NeMo Switchyard

Fotografía de archivo que ilustra: NVIDIA lanza Nemotron 3.5 Lightning y NeMo Switchyard para agentes autónomos más eficientes
Foto: panumas nikhomkhai · Licencia Pexels · Pexels

El modelo de 30.000 millones de parámetros con mezcla de expertos completa tareas de agentes un 30% más rápido, y la nueva biblioteca enruta cada petición al modelo adecuado sin reescribir aplicaciones. Ambos apuntan a reducir el coste operativo de los agentes en producción.

OpenAI prueba publicidad en ChatGPT

Fotografía de archivo que ilustra: OpenAI comienza a probar publicidad en ChatGPT para mantener acceso gratuito
Foto: Mateusz Dach · Licencia Pexels · Pexels

Los anuncios irán etiquetados, con controles de privacidad y sin influir en las respuestas, según la compañía. Supone un giro en su modelo de ingresos para sostener el acceso gratuito masivo.

Conviene vigilar cómo evolucionan las defensas de las APIs de razonamiento y qué controles de gobernanza adoptan las empresas antes de escalar agentes en producción.

Días anteriores

Ver todo el archivo de resúmenes