DeepMind presenta entornos para medir seguridad en agentes de IA
Línea temporal
-
DeepMind presenta entornos de prueba para medir comportamiento seguro en agentes de IA
Google DeepMind ha publicado un artículo presentando nueve entornos de aprendizaje por refuerzo (gridworlds) diseñados específicamente para medir comportamientos seguros en agentes de IA. Los entornos abordan tres…