MuZero: algoritmo que domina juegos y tareas sin conocer las reglas
Google DeepMind publica en Nature un paper describiendo MuZero, un algoritmo de aprendizaje por refuerzo que domina Go, ajedrez, shogi y Atari sin que le…
Por qué importaMuZero representa un avance significativo en algoritmos de propósito general al resolver el problema de planificación en entornos con dinámicas…