DeepMind publica UNREAL para acelerar aprendizaje por refuerzo
Línea temporal
-
DeepMind presenta UNREAL, algoritmo de aprendizaje por refuerzo 10x más rápido
Google DeepMind ha publicado un paper sobre UNREAL (UNsupervised REinforcement and Auxiliary Learning), un método que mejora significativamente la velocidad y el rendimiento del aprendizaje por refuerzo mediante tareas…