Ir al contenido
IA para hoy

Tecnología

compute-optimal training

Relacionadas

LLM ×1transformers ×1Google DeepMind ×1

Historias

Noticias

Modelos y avances 2 fuentes

DeepMind: modelos más pequeños con más datos superan a gigantes en eficiencia

DeepMind publicó un análisis empírico sobre el entrenamiento óptimo de modelos de lenguaje, concluyendo que los LLM actuales son demasiado grandes para su…

Por qué importaEste hallazgo desafía la estrategia dominante de maximizar parámetros y establece que la proporción óptima es 4x menos parámetros con 4x más datos…

Impacto alto Fiabilidad confirmado por varias fuentes Google DeepMind