Ir al contenido
IA para hoy

aprendizaje por refuerzo

Noticias etiquetadas con «aprendizaje por refuerzo»

11 noticias

Google DeepMind lanza Acme, framework para aprendizaje por refuerzo distribuido

Google DeepMind ha publicado Acme, un framework de código abierto diseñado para construir algoritmos de aprendizaje por refuerzo (RL) legibles y eficientes…

Por qué importaAcme reduce la brecha entre investigación académica y aplicación industrial en RL al facilitar la reproducibilidad y escalabilidad de algoritmos. Su…

Impacto medio Fiabilidad fuente primaria Google DeepMind

DeepMind: agentes IA aprenden conductas económicas como producción, comercio y fijación de precios

DeepMind publica un paper que demuestra que agentes de aprendizaje por refuerzo profundo pueden aprender comportamientos microeconómicos como producción…

Por qué importaRepresenta un avance en inteligencia multiagente hacia simular comportamientos económicos reales sin codificar conocimiento de dominio. Demuestra que…

Impacto bajo Fiabilidad fuente primaria Google DeepMind

DeepMind publica evaluación completa de AlphaZero en Science

Google DeepMind ha publicado en la revista Science la evaluación completa de AlphaZero, el sistema que en 2017 aprendió a dominar ajedrez, shogi y Go desde…

Por qué importaAlphaZero demuestra que un único algoritmo general puede dominar múltiples dominios complejos sin reglas codificadas manualmente, solo con los…

Impacto medio Fiabilidad fuente primaria Google DeepMind
Investigación 2 fuentes

AlphaStar derrota al campeón profesional de StarCraft II sin restricciones

Google DeepMind ha presentado AlphaStar, un sistema de IA que ha derrotado 5-0 al jugador profesional Grzegorz "MaNa" Komincz de Team Liquid en StarCraft II…

Por qué importaAlphaStar demuestra un avance significativo en capacidades de IA para problemas complejos que requieren equilibrio entre decisiones a largo y corto…

Impacto alto Fiabilidad confirmado por varias fuentes Google DeepMind
Investigación 2 fuentes

AlphaStar alcanza nivel Grandmaster en StarCraft II sin restricciones mediante aprendizaje multiagente

DeepMind ha logrado que AlphaStar, un sistema de IA, alcance el nivel Grandmaster (el máximo) en StarCraft II jugando el juego completo sin restricciones ni…

Por qué importaEste logro demuestra que las técnicas de aprendizaje por refuerzo y competencia multiagente ('League') pueden escalar a dominios extremadamente…

Impacto alto Fiabilidad confirmado por varias fuentes Google DeepMind
Investigación 3 fuentes

DeepMind conecta aprendizaje por refuerzo con dopamina cerebral en Nature

DeepMind publica en Nature un trabajo que vincula el algoritmo de aprendizaje por diferencia temporal (TD, temporal difference learning) con el funcionamiento…

Por qué importaEste hallazgo consolida el puente entre neurociencia e IA al demostrar que algoritmos de aprendizaje por refuerzo más sofisticados (distribucionales)…

Impacto medio Fiabilidad confirmado por varias fuentes Google DeepMind

DeepMind presenta agentes IA que imaginan y planifican acciones futuras

Google DeepMind ha publicado dos papers sobre arquitecturas de agentes basadas en 'imaginación': redes neuronales que internamente simulan consecuencias de…

Por qué importaEsta investigación avanza en el razonamiento deliberativo de agentes IA, permitiéndoles funcionar con modelos imperfectos y adaptar estrategias de…

Impacto medio Fiabilidad fuente primaria Google DeepMind

AlphaGo Zero aprende Go desde cero en tres días, superando versiones anteriores

Google DeepMind ha publicado en Nature el desarrollo de AlphaGo Zero, una versión mejorada de AlphaGo que aprende a jugar Go sin entrenamiento previo en…

Por qué importaAlphaGo Zero demuestra que los algoritmos de IA pueden alcanzar y superar capacidades superhúmanas partiendo de cero, sin depender de datos o…

Impacto muy alto Fiabilidad fuente primaria Google DeepMind
Investigación 2 fuentes

DeepMind y Blizzard abren StarCraft II como entorno de investigación en IA

DeepMind y Blizzard Entertainment anunciaron en BlizzCon 2016 su colaboración para poner a disposición de investigadores de IA en todo el mundo el juego…

Por qué importaStarCraft II representa un desafío científico significativo para la investigación en aprendizaje por refuerzo por su complejidad: información…

Impacto medio Fiabilidad confirmado por varias fuentes Google DeepMind