Tecnología
meta-learning
Relacionadas
robótica ×1aprendizaje por refuerzo ×1Google DeepMind ×1aprendizaje por refuerzo profundo ×1
Historias
Noticias
Agent57: primer agente de refuerzo profundo que supera nivel humano en todos los juegos Atari
DeepMind ha desarrollado Agent57, el primer agente de aprendizaje por refuerzo profundo que obtiene puntuaciones superiores al nivel humano en los 57 juegos de…
Por qué importaRepresenta un hito significativo en la generalización de agentes de RL: demuestra que es posible entrenar un único sistema capaz de adaptarse a…
Impacto alto
Fiabilidad fuente primaria
Google DeepMind
Google DeepMind publica SAC-X, método para que agentes RL aprendan tareas de control desde cero
Google DeepMind ha publicado un paper presentando SAC-X (Scheduled Auxiliary Control), un método de aprendizaje por refuerzo que permite a agentes robóticos…
Por qué importaSAC-X aborda un desafío crítico en robótica: aprender comportamientos complejos con mínimo conocimiento previo y máxima eficiencia de datos. Esto…
Impacto medio
Fiabilidad fuente primaria
Google DeepMind