Google DeepMind usa RL para diseño de políticas democráticas
Línea temporal
-
Google DeepMind demuestra RL para diseño de políticas económicas alineadas con valores humanos
Google DeepMind publicó en Nature Human Behaviour un estudio en el que entrena un agente de aprendizaje por refuerzo profundo para diseñar políticas de redistribución de recursos que maximicen la votación mayoritaria de…