Tecnología
recurrent DQN
Relacionadas
aprendizaje por refuerzo ×1Google DeepMind ×1demostraciones ×1
Historias
Noticias
DeepMind presenta R2D3, agente de aprendizaje por refuerzo con demostraciones para tareas complejas
DeepMind ha publicado R2D3 (Recurrent Replay Distributed DQN from Demonstrations), un agente de aprendizaje por refuerzo diseñado para resolver tareas con…
Por qué importaR2D3 aborda un problema fundamental del aprendizaje por refuerzo: la exploración ineficiente en entornos complejos. La capacidad de aprovechar…
Impacto medio
Fiabilidad fuente primaria
Google DeepMind