Ir al contenido
IA para hoy

Resultados para «retroalimentación humana»

3 noticias

Filtrar

¿Prefieres una respuesta redactada? Pregunta a IA para hoy.

Investigación 2 fuentes

DeepMind presenta ReQueST para entrenar agentes de RL desde retroalimentación humana sin estados inseguros

Google DeepMind ha publicado un método llamado ReQueST (Reward Query Synthesis via Trajectory Optimisation) que permite entrenar agentes de aprendizaje por…

Por qué importaEl problema de exploración segura es crítico para desplegar RL en aplicaciones reales (robótica, vehículos autónomos, sistemas de control) donde…

Impacto alto Fiabilidad confirmado por varias fuentes Google DeepMind
Investigación 2 fuentes

DeepMind y OpenAI publican técnica para entrenar IA desde retroalimentación humana sin expertos

DeepMind y OpenAI han publicado investigación sobre un método que permite a usuarios sin experiencia técnica enseñar sistemas de aprendizaje por refuerzo a…

Por qué importaLa capacidad de alinear sistemas de IA complejos sin especificar objetivos de forma explícita reduce el riesgo de comportamientos indeseados o…

Impacto medio Fiabilidad confirmado por varias fuentes Google DeepMind