Google Research distingue fallos de codificación y recuperación en factualidad de LLM
Línea temporal
-
Google Research halla que el fallo factual de los LLM es de recuperación, no de conocimiento
Investigadores de Google Research presentan un marco de 'perfilado de conocimiento' y el benchmark WikiProfile (2.150 hechos de Wikipedia) para distinguir si un LLM falla por no tener codificado un hecho o por no poder…
-
Google Research explica por qué el razonamiento mejora el recuerdo factual en LLMs
Investigadores de Google Research publicaron un estudio, a presentarse en COLM 2026, que analiza por qué activar el razonamiento (chain-of-thought) mejora la recuperación de hechos simples en modelos como Gemini-2.5 y…