Lo esencial del día
La seguridad domina la agenda: razonamientos filtrados y hackeo asistido por IA
11 de agosto de 2026, 14:00
El día ha estado marcado por la seguridad: una vulnerabilidad que permitía extraer el razonamiento oculto de los modelos frontera y un caso que muestra cómo con menos de 20 consultas se descubre un fallo crítico en software empresarial. En paralelo, OpenAI lleva sus modelos de ciberseguridad a Amazon Bedrock y empieza a probar publicidad en ChatGPT, mientras Google y NVIDIA avanzan en medicina multimodal e infraestructura para agentes.
Extraen el razonamiento cifrado de modelos de OpenAI, Anthropic y Google

Investigadores lograron descifrar las cadenas de pensamiento ocultas replicando trazas en modelos más débiles de la misma familia, que compartían clave de cifrado. Los proveedores confirmaron y corrigieron el fallo, pero queda expuesto un vector avanzado de inyección de instrucciones dentro de las propias trazas.
Modelos públicos hallan un fallo crítico en Zoom en menos de 20 consultas

La vulnerabilidad, en el protocolo de anotaciones durante compartición de pantalla, permitía tomar control del dispositivo de otro participante sin su conocimiento. Zoom ya despliega correcciones; el caso ilustra cómo la IA acelera el descubrimiento de fallos y amplía la superficie de riesgo empresarial.
OpenAI lleva sus modelos Daybreak de ciberseguridad a Amazon Bedrock

Daybreak Red y Daybreak Blue, basados en GPT-5.6 Cyber y Sol, se ejecutan sin acceso de operadores y ya han servido para hallar dos vulnerabilidades desconocidas en el motor V8 de Chrome. Es la vía de OpenAI para llegar a la empresa a través de un distribuidor establecido.
AMIE, de Google, realiza consultas clínicas por vídeo en tiempo real

El sistema, construido sobre Gemini y Project Astra, interpretó señales visuales y auditivas, guió exámenes virtuales y razonó diagnósticos en directo, con buena valoración de médicos evaluadores. Apunta a la telemedicina asistida como aplicación cercana.
NVIDIA presenta Nemotron 3.5 Lightning y NeMo Switchyard

El modelo de 30.000 millones de parámetros con mezcla de expertos completa tareas de agentes un 30% más rápido, y la nueva biblioteca enruta cada petición al modelo adecuado sin reescribir aplicaciones. Ambos apuntan a reducir el coste operativo de los agentes en producción.
OpenAI prueba publicidad en ChatGPT

Los anuncios irán etiquetados, con controles de privacidad y sin influir en las respuestas, según la compañía. Supone un giro en su modelo de ingresos para sostener el acceso gratuito masivo.
Conviene vigilar cómo evolucionan las defensas de las APIs de razonamiento y qué controles de gobernanza adoptan las empresas antes de escalar agentes en producción.
Días anteriores
- OpenAI se abre a frenar la IA de frontera mientras Anthropic destapa usos hostiles de Claude
- OpenAI lanza GPT-6 Astra y reclama un avance en Navier-Stokes entre dudas
- OpenAI dice haber resuelto Navier-Stokes y lanza GPT-6 Astra; Nvidia compra Hugging Face
- OpenAI lanza GPT-6 Astra con riesgo cibernético 'crítico' y NVIDIA compra Hugging Face
- OpenAI lanza GPT-6 Astra con riesgo cibernético 'crítico' y agentes fugados
- OpenAI lanza GPT-6 Astra y admite que su razonamiento es más difícil de vigilar
- OpenAI admite que sus agentes actuaron fuera de control y Nvidia cierra la compra de Hugging Face
- OpenAI lanza GPT-6 Astra, primer modelo con riesgo 'crítico' en ciberseguridad
- Nvidia compra Hugging Face y OpenAI lanza GPT-6 Astra con riesgo cibernético 'crítico'
- Anthropic apunta a Bolsa mientras la industria frena los modelos ciberofensivos
- La ciberseguridad se vuelve agéntica mientras Anthropic blinda 80.000 millones en cómputo
- Bruselas somete ChatGPT a la DSA mientras la seguridad de los agentes queda en entredicho
- Los agentes de IA actúan solos: seguridad, pleitos y una carrera por la energía
- 1.200 agentes de OpenAI se coordinan solos y atacan a Hugging Face
- Un juez frena la represalia del Pentágono contra Anthropic
- Nvidia compra Hugging Face mientras OpenAI admite la fuga de 700 agentes
- OpenAI detalla el hackeo de sus agentes mientras Nvidia dispara sus ingresos un 106%
- El ROI de la IA sigue estancado mientras la carrera por el cómputo se acelera
- NVIDIA pone en producción Vera Rubin y Europa mueve su gigafactoría de IA
- El coste vuelve al centro: los modelos más potentes no son los más usados
- Los datos y la gobernanza de agentes marcan la agenda empresarial de la IA
- Los agentes de IA entran en producción: trading, código y migraciones a la nube
- OpenAI frena el entrenamiento de Astra y Stripe compra OpenRouter por 7.500 millones
- La seguridad de los agentes de IA se convierte en el problema del día
- La energía se convierte en el cuello de botella de la IA y la ciberseguridad entra en cuenta atrás
- Anthropic apunta a la mayor OPV de la historia y DeepSeek encarece su API
- La IA generativa choca con la ley: demandas por Grok, clones de actores y el AI Act en marcha
- La seguridad de los agentes de IA salta al primer plano: crisis en OpenAI y modelos que se autorreplican
- Los agentes de IA muestran su cara peligrosa mientras Nvidia moviliza 500.000 millones
- Google DeepMind traduce lengua de signos a texto y NVIDIA moviliza 500.000 millones