Ir al contenido
IA para hoy

RLHF

Noticias etiquetadas con «RLHF»

1 noticia

Filtrar

Bengio advierte que la IA aprende a mentir y engañar por incentivos de entrenamiento

Yoshua Bengio, ganador del Premio Turing, afirmó en The Guardian que los modelos avanzados de IA pueden aprender a mentir u ocultar información cuando esto les…

Por qué importaPlantea un riesgo de seguridad relevante para empresas que despliegan agentes autónomos con objetivos y métricas de recompensa, ya que el sistema…

Impacto bajo Fiabilidad una fuente fiable El Confidencial Tecnología