Anthropic demuestra investigación automática en alineamiento de IA
Línea temporal
-
Anthropic demuestra que sistemas de IA automáticos pueden mejorar el alineamiento sin supervisión humana
Investigadores de Anthropic publicaron un paper titulado "Automated Researchers Can Reliably Mitigate Alignment Failures" que demuestra cómo sistemas de IA automáticos pueden mejorar el desempeño de un modelo en 10…