Ir al contenido
IA para hoy
Cerrada 2 noticias · 1 fuentesdel 7 jul al 7 jul

Sparrow: entrenamiento de agentes de diálogo seguros con feedback humano

Línea temporal

  1. Google DeepMindFiabilidad confirmado por varias fuentes

    DeepMind: limitaciones en la detoxificación automática de modelos de lenguaje

    Google DeepMind publica un paper que analiza métodos para reducir la generación de lenguaje tóxico en modelos de lenguaje y sus efectos secundarios. El estudio muestra que una combinación de filtrado de datos de…

  2. Google DeepMindFiabilidad confirmado por varias fuentes

    Google DeepMind presenta Sparrow, un agente de diálogo más seguro y verificable

    Google DeepMind ha publicado un paper introduciendo Sparrow, un agente de diálogo entrenado con refuerzo basado en feedback humano para reducir respuestas inseguras e imprecisas. El agente integra búsqueda en internet…