DeepMind publica arquitectura escalable de agentes IWALA para RL multi-tarea
Línea temporal
-
Google DeepMind presenta arquitectura escalable de agentes para entrenamiento distribuido
Google DeepMind ha publicado una nueva arquitectura de agentes llamada Importance Weighted Actor-Learner Architecture (IWALA) diseñada para entrenar un único agente en múltiples tareas simultáneamente. La arquitectura…