Ir al contenido
IA para hoy

Tecnología

reward predictor

Relacionadas

aprendizaje por refuerzo ×1Google DeepMind ×1OpenAI ×1agentes autónomos ×1

Historias

Noticias

Investigación 2 fuentes

DeepMind y OpenAI publican técnica para entrenar IA desde retroalimentación humana sin expertos

DeepMind y OpenAI han publicado investigación sobre un método que permite a usuarios sin experiencia técnica enseñar sistemas de aprendizaje por refuerzo a…

Por qué importaLa capacidad de alinear sistemas de IA complejos sin especificar objetivos de forma explícita reduce el riesgo de comportamientos indeseados o…

Impacto medio Fiabilidad confirmado por varias fuentes Google DeepMind