AWS publica técnica rDPO para desaprendizaje personalizado en Nova
Línea temporal
-
AWS publica técnica de desaprendizaje selectivo para modelos Nova
AWS presenta Reverse Direct Preference Optimization (rDPO), una técnica de desaprendizaje que permite a los clientes ajustar selectivamente los controles de moderación de contenido en Amazon Nova sin reentrenar el…