DeepMind logra agentes generales capaces de aprender múltiples juegos sin reentrenamiento
DeepMind publica un preprint sobre agentes entrenados con aprendizaje por refuerzo en abierto (open-ended learning) capaces de jugar múltiples juegos sin…
Por qué importaEste avance aborda una limitación fundamental del aprendizaje por refuerzo: la incapacidad de generalizar entre tareas diferentes sin…
Impacto alto
Fiabilidad fuente primaria
Google DeepMind