Ir al contenido
IA para hoy
Investigación Investigación 3/5 · Una fuente fiable

Anthropic advierte que GLM-5.3 y Claude Mythos cruzan umbral en explotación de vulnerabilidades

Anthropic advierte que GLM-5.3 y Claude Mythos cruzan umbral en explotación de vulnerabilidades
Foto: Schäferle · Licencia Pixabay · Pixabay

Hecho Qué ha ocurrido

El Frontier Red Team de Anthropic evaluó varios modelos en 100 tareas de un benchmark interno de explotación binaria. GLM-5.3 logró secuestros completos de control de flujo en el 4% de los intentos y Claude Mythos Preview en el 6%, mientras que modelos anteriores como Claude Opus 4.6 y GLM-5.2 no tuvieron éxito en ninguno.

Resumen generado mediante IA a partir de Simon Willison (original en inglés). Naturaleza de la información: hecho documentado.

Análisis Por qué importa

El salto de 0% a niveles de éxito no nulos en explotación automatizada de vulnerabilidades sugiere que capacidades ofensivas avanzadas ya no son exclusivas de un solo laboratorio, incluyendo modelos chinos como GLM.

Quién se ve afectado
Equipos de ciberseguridad, responsables de infraestructura crítica y laboratorios de IA que desarrollan modelos de frontera.
Qué puede cambiar
Se refuerza la necesidad de evaluaciones de seguridad previas al lanzamiento y de medidas de contención para modelos con capacidades cibernéticas ofensivas emergentes.

Análisis generado a partir de la información disponible; no procede de la fuente.

Predicción Qué observar a continuación

Vigilar si estas capacidades se extienden a más modelos, si aumentan las tasas de éxito, y cómo reaccionan reguladores y otros laboratorios ante la difusión de capacidades ofensivas.

Recomendación Qué debería hacer una empresa

Los equipos de ciberseguridad empresarial deberían evaluar en los próximos 6-12 meses cómo estas capacidades emergentes de explotación automatizada podrían usarse contra sus sistemas, y reforzar defensas ante ataques asistidos por IA.

Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.

Compartir WhatsApp LinkedIn X Bluesky Telegram
Enviar esta noticia por correo

Se envía esta noticia con su análisis. La dirección se usa solo para ese envío y no se guarda.

Fuente original: Simon Willison. La referencia es siempre el artículo original.

Ver fuente original ↗

LLMciberseguridad ofensiva AnthropicZhipu AI AnthropicbenchmarkciberseguridadClaude MythosGLM-5.3

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.

Relacionadas

Investigación

Google Research presenta Diffusion Controller, framework para dirigir generación de imágenes en modelos cerrados

Investigadores de Google Research presentan Diffusion Controller, una red ligera tipo 'amortiguador de dirección' que se acopla a modelos de difusión de texto…

Por qué importaOfrece una forma unificada y más controlable de ajustar modelos de imagen sin necesidad de acceso a sus pesos internos, lo que podría facilitar la…

Impacto bajo Fiabilidad fuente primaria Google Research
Investigación

Científicos cuestionan el hallazgo de Anthropic de un sistema tipo Crispr descubierto por Claude

Anthropic anunció que unos 950 agentes de Claude, ejecutados en paralelo durante 21,5 horas, identificaron una familia de retrotranscriptasas con repeticiones…

Por qué importaEl caso ilustra la diferencia entre la capacidad de la IA para detectar patrones en grandes bases de datos genómicas y la validación científica real…

Impacto bajo Fiabilidad una fuente fiable Relevancia 7/10 Wired AI
Investigación

Red Queen Bio, respaldada por OpenAI, usa IA para diseñar anticuerpos contra la gripe aviar

Red Queen Bio, startup fundada en 2025 y respaldada por OpenAI (ronda seed de 15M$ liderada por OpenAI, 36M$ totales), usa modelos de IA para diseñar…

Por qué importaEs un ejemplo concreto de cómo los grandes laboratorios de IA financian mecanismos de defensa contra los riesgos biológicos que sus propios modelos…

Impacto bajo Fiabilidad declaración interesada Relevancia 7/10 WWWhat's new
Investigación

Microsoft presenta Quine, un modelo de mundo multimodal de IA para biología

Microsoft Research anunció Quine, un sistema de IA que crea un modelo de mundo multimodal de biología integrando secuencia, estructura, función, estado celular…

Por qué importaIlustra cómo los modelos de mundo multimodal pueden acelerar drásticamente la fase de diseño experimental en biociencia, reduciendo costes y tiempos…

Impacto medio Fiabilidad una fuente fiable Relevancia 8/10 Microsoft Research