FACTS Grounding: benchmark de Google DeepMind para evaluar factualidad en LLMs
Línea temporal
-
Google DeepMind lanza FACTS Benchmark Suite para evaluar factualidad en LLMs
Google DeepMind y Kaggle han presentado el FACTS Benchmark Suite, un conjunto sistemático de evaluación de la factualidad en modelos de lenguaje grandes. El suite incluye cuatro benchmarks—Grounding v2, Parametric…
-
Google DeepMind lanza FACTS Grounding, benchmark para evaluar precisión factual en LLMs
Google DeepMind e Google Research presentaron FACTS Grounding, un benchmark integral para medir la capacidad de los grandes modelos de lenguaje de fundamentar sus respuestas en documentos fuente y evitar alucinaciones…