Ir al contenido
IA para hoy

Resultados para «aprendizaje por refuerzo»

9 noticias

¿Prefieres una respuesta redactada? Pregunta a IA para hoy.

Google DeepMind lanza Acme, framework para aprendizaje por refuerzo distribuido

Google DeepMind ha publicado Acme, un framework de código abierto diseñado para construir algoritmos de aprendizaje por refuerzo (RL) legibles y eficientes…

Por qué importaAcme reduce la brecha entre investigación académica y aplicación industrial en RL al facilitar la reproducibilidad y escalabilidad de algoritmos. Su…

Impacto medio Fiabilidad fuente primaria Google DeepMind

Google DeepMind controla plasma de fusión con aprendizaje por refuerzo profundo

Google DeepMind colaboró con el Swiss Plasma Center de EPFL para desarrollar un sistema de aprendizaje por refuerzo profundo capaz de controlar autónomamente…

Por qué importaEste logro demuestra que el aprendizaje automático puede acelerar significativamente la investigación en fusión nuclear, uno de los mayores desafíos…

Impacto alto Fiabilidad fuente primaria Google DeepMind
Investigación 2 fuentes

AlphaStar alcanza nivel Grandmaster en StarCraft II sin restricciones mediante aprendizaje multiagente

DeepMind ha logrado que AlphaStar, un sistema de IA, alcance el nivel Grandmaster (el máximo) en StarCraft II jugando el juego completo sin restricciones ni…

Por qué importaEste logro demuestra que las técnicas de aprendizaje por refuerzo y competencia multiagente ('League') pueden escalar a dominios extremadamente…

Impacto alto Fiabilidad confirmado por varias fuentes Google DeepMind
Investigación 2 fuentes

DeepMind conecta aprendizaje por refuerzo con dopamina cerebral en Nature

DeepMind publica en Nature un trabajo que vincula el algoritmo de aprendizaje por diferencia temporal (TD, temporal difference learning) con el funcionamiento…

Por qué importaEste hallazgo consolida el puente entre neurociencia e IA al demostrar que algoritmos de aprendizaje por refuerzo más sofisticados (distribucionales)…

Impacto medio Fiabilidad confirmado por varias fuentes Google DeepMind

AlphaGo Zero aprende Go desde cero en tres días, superando versiones anteriores

Google DeepMind ha publicado en Nature el desarrollo de AlphaGo Zero, una versión mejorada de AlphaGo que aprende a jugar Go sin entrenamiento previo en…

Por qué importaAlphaGo Zero demuestra que los algoritmos de IA pueden alcanzar y superar capacidades superhúmanas partiendo de cero, sin depender de datos o…

Impacto muy alto Fiabilidad fuente primaria Google DeepMind