Tecnología
jailbreak
Relacionadas
LLM ×3OpenAI ×2Anthropic ×2chain-of-thought ×1prompt injection ×1seguridad de modelos ×1
Historias
Noticias
Investigadores demuestran vulnerabilidad fundamental en LLMs imposible de resolver completamente
Un equipo de investigadores presentó en la Conferencia Internacional de Aprendizaje Automático (ICML) un artículo que argumenta que es imposible asegurar…
Por qué importaEsta investigación revela que las defensas actuales basadas en etiquetado de roles y red-teaming no pueden resolver completamente el problema de…
EE.UU. ordena suspender Claude Fable 5 y Mythos 5 por razones de seguridad nacional
La Casa Blanca ordenó el 12 de junio a Anthropic desactivar inmediatamente los modelos Fable 5 y Mythos 5 para cualquier usuario no ciudadano estadounidense…
Por qué importaMarca un precedente sin antecedentes: es la primera vez que EE.UU. restringe el acceso a un modelo de IA de uso general por seguridad nacional, no…
Investigador vulnera barreras de seguridad de Claude Fable 5 en menos de 48 horas
Un investigador de ciberseguridad identificado como "Pliny the Liberator" asegura haber vulnerado los mecanismos de seguridad de Claude Fable 5, el modelo de…
Por qué importaDemuestra que incluso modelos diseñados como los más seguros pueden ser eludidos en períodos muy cortos, cuestionando la efectividad real de los…


