Sparrow: entrenamiento de agentes de diálogo seguros con feedback humano
Línea temporal
-
DeepMind: limitaciones en la detoxificación automática de modelos de lenguaje
Google DeepMind publica un paper que analiza métodos para reducir la generación de lenguaje tóxico en modelos de lenguaje y sus efectos secundarios. El estudio muestra que una combinación de filtrado de datos de…
-
Google DeepMind presenta Sparrow, un agente de diálogo más seguro y verificable
Google DeepMind ha publicado un paper introduciendo Sparrow, un agente de diálogo entrenado con refuerzo basado en feedback humano para reducir respuestas inseguras e imprecisas. El agente integra búsqueda en internet…