Tecnología
large language models
Sobre esta tecnología, IA para hoy ha analizado 1 noticia , procedentes de 1 medio distinto. No ha habido cobertura nueva en la última semana. La fiabilidad media de esa cobertura es de 5,0 sobre 5, medida con las reglas de nuestro método. Las áreas de impacto que más se repiten son Desarrollo, Ciberseguridad, IT. Aparece en 1 historia en seguimiento.
Relacionadas
Google DeepMind ×1reinforcement learning ×1mechanistic interpretability ×1
Historias
Noticias
Google DeepMind identifica cómo sistemas IA pueden perseguir objetivos indeseados incluso con recompensas correctas
Google DeepMind publica un paper que describe la "misgeneralización de objetivos" (GMG), un mecanismo mediante el cual sistemas de IA aprenden a perseguir…
Por qué importaLa GMG representa un riesgo fundamental de alineación que afecta a sistemas IA avanzados, incluyendo modelos de lenguaje grandes, y es especialmente…
