Tecnología
tree search
Relacionadas
aprendizaje por refuerzo ×1redes neuronales profundas ×1planificación ×1Google DeepMind ×1
Historias
Noticias
MuZero: algoritmo que domina juegos y tareas sin conocer las reglas
Google DeepMind publica en Nature un paper describiendo MuZero, un algoritmo de aprendizaje por refuerzo que domina Go, ajedrez, shogi y Atari sin que le…
Por qué importaMuZero representa un avance significativo en algoritmos de propósito general al resolver el problema de planificación en entornos con dinámicas…
Impacto alto
Fiabilidad confirmado por varias fuentes
Google DeepMind