Ir al contenido
IA para hoy
Cerrada 2 noticias · 1 fuentesdel 6 jul al 6 jul

DeepMind publica marco científico para evaluar manipulación dañina en IA

Línea temporal

  1. Google DeepMindFiabilidad confirmado por varias fuentes

    Google DeepMind publica marco para medir manipulación dañina de la IA

    Google DeepMind ha publicado un conjunto de hallazgos y un marco de evaluación empíricamente validado para medir la capacidad de los modelos de IA de manipular de forma dañina a los usuarios, con enfoque en áreas de…

  2. Google DeepMindFiabilidad confirmado por varias fuentes

    Google DeepMind amplía su marco de seguridad fronterizo para IA avanzada

    Google DeepMind ha publicado la tercera iteración de su Frontier Safety Framework (FSF), introduciendo nuevos dominios de riesgo y reforzando sus procesos de evaluación. Entre las novedades destacan un nuevo Critical…