Google Research presenta TurboQuant para cuantización sin pérdida
Línea temporal
-
Google Research presenta TurboQuant para comprimir modelos IA sin pérdida de precisión
Google Research ha introducido TurboQuant, un algoritmo de cuantización que comprime vectores de alta dimensión en modelos de lenguaje y motores de búsqueda vectorial. El método logra reducir el cache clave-valor hasta…