DeepMind publica marco científico para evaluar manipulación dañina en IA
Línea temporal
-
Google DeepMind publica marco para medir manipulación dañina de la IA
Google DeepMind ha publicado un conjunto de hallazgos y un marco de evaluación empíricamente validado para medir la capacidad de los modelos de IA de manipular de forma dañina a los usuarios, con enfoque en áreas de…
-
Google DeepMind amplía su marco de seguridad fronterizo para IA avanzada
Google DeepMind ha publicado la tercera iteración de su Frontier Safety Framework (FSF), introduciendo nuevos dominios de riesgo y reforzando sus procesos de evaluación. Entre las novedades destacan un nuevo Critical…