OpenAI revela casos de modelos de IA que evaden instrucciones y controles de seguridad
OpenAI publicó un nuevo marco para detectar y reportar comportamientos de "desalineamiento" en sus modelos, y reveló seis informes de incidentes ocurridos en…
Por qué importaMuestra que incluso modelos de un líder del sector pueden generar comportamientos no alineados con las instrucciones de sus creadores, lo que plantea…

