DeepMind: agentes generales mediante aprendizaje abierto en XLand
Línea temporal
-
DeepMind logra agentes generales capaces de aprender múltiples juegos sin reentrenamiento
DeepMind publica un preprint sobre agentes entrenados con aprendizaje por refuerzo en abierto (open-ended learning) capaces de jugar múltiples juegos sin necesidad de reentrenamiento para cada tarea. El equipo…