Ir al contenido
IA para hoy

Tecnología

jailbreak

Relacionadas

LLM ×3OpenAI ×2Anthropic ×2chain-of-thought ×1prompt injection ×1seguridad de modelos ×1

Historias

Noticias

Investigadores demuestran vulnerabilidad fundamental en LLMs imposible de resolver completamente

Un equipo de investigadores presentó en la Conferencia Internacional de Aprendizaje Automático (ICML) un artículo que argumenta que es imposible asegurar…

Por qué importaEsta investigación revela que las defensas actuales basadas en etiquetado de roles y red-teaming no pueden resolver completamente el problema de…

Impacto alto Fiabilidad una fuente fiable MIT Technology Review
Regulación y ética 3 fuentes

Investigador vulnera barreras de seguridad de Claude Fable 5 en menos de 48 horas

Un investigador de ciberseguridad identificado como "Pliny the Liberator" asegura haber vulnerado los mecanismos de seguridad de Claude Fable 5, el modelo de…

Por qué importaDemuestra que incluso modelos diseñados como los más seguros pueden ser eludidos en períodos muy cortos, cuestionando la efectividad real de los…

Impacto medio Fiabilidad declaración interesada Hipertextual