Anthropic advierte que GLM-5.3 y Claude Mythos cruzan umbral en explotación de vulnerabilidades

Hecho Qué ha ocurrido
El Frontier Red Team de Anthropic evaluó varios modelos en 100 tareas de un benchmark interno de explotación binaria. GLM-5.3 logró secuestros completos de control de flujo en el 4% de los intentos y Claude Mythos Preview en el 6%, mientras que modelos anteriores como Claude Opus 4.6 y GLM-5.2 no tuvieron éxito en ninguno.
Resumen generado mediante IA a partir de Simon Willison (original en inglés). Naturaleza de la información: hecho documentado.
Análisis Por qué importa
El salto de 0% a niveles de éxito no nulos en explotación automatizada de vulnerabilidades sugiere que capacidades ofensivas avanzadas ya no son exclusivas de un solo laboratorio, incluyendo modelos chinos como GLM.
- Quién se ve afectado
- Equipos de ciberseguridad, responsables de infraestructura crítica y laboratorios de IA que desarrollan modelos de frontera.
- Qué puede cambiar
- Se refuerza la necesidad de evaluaciones de seguridad previas al lanzamiento y de medidas de contención para modelos con capacidades cibernéticas ofensivas emergentes.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Vigilar si estas capacidades se extienden a más modelos, si aumentan las tasas de éxito, y cómo reaccionan reguladores y otros laboratorios ante la difusión de capacidades ofensivas.
Recomendación Qué debería hacer una empresa
Los equipos de ciberseguridad empresarial deberían evaluar en los próximos 6-12 meses cómo estas capacidades emergentes de explotación automatizada podrían usarse contra sus sistemas, y reforzar defensas ante ataques asistidos por IA.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Enviar esta noticia por correo
Fuente original: Simon Willison. La referencia es siempre el artículo original.
Ver fuente original ↗LLMciberseguridad ofensiva AnthropicZhipu AI AnthropicbenchmarkciberseguridadClaude MythosGLM-5.3
Tu opinión
0 comentarios
Relacionadas
Google Research presenta Diffusion Controller, framework para dirigir generación de imágenes en modelos cerrados
Investigadores de Google Research presentan Diffusion Controller, una red ligera tipo 'amortiguador de dirección' que se acopla a modelos de difusión de texto…
Por qué importaOfrece una forma unificada y más controlable de ajustar modelos de imagen sin necesidad de acceso a sus pesos internos, lo que podría facilitar la…
Científicos cuestionan el hallazgo de Anthropic de un sistema tipo Crispr descubierto por Claude
Anthropic anunció que unos 950 agentes de Claude, ejecutados en paralelo durante 21,5 horas, identificaron una familia de retrotranscriptasas con repeticiones…
Por qué importaEl caso ilustra la diferencia entre la capacidad de la IA para detectar patrones en grandes bases de datos genómicas y la validación científica real…
Red Queen Bio, respaldada por OpenAI, usa IA para diseñar anticuerpos contra la gripe aviar
Red Queen Bio, startup fundada en 2025 y respaldada por OpenAI (ronda seed de 15M$ liderada por OpenAI, 36M$ totales), usa modelos de IA para diseñar…
Por qué importaEs un ejemplo concreto de cómo los grandes laboratorios de IA financian mecanismos de defensa contra los riesgos biológicos que sus propios modelos…
Microsoft presenta Quine, un modelo de mundo multimodal de IA para biología
Microsoft Research anunció Quine, un sistema de IA que crea un modelo de mundo multimodal de biología integrando secuencia, estructura, función, estado celular…
Por qué importaIlustra cómo los modelos de mundo multimodal pueden acelerar drásticamente la fase de diseño experimental en biociencia, reduciendo costes y tiempos…


