Modelos LFM2.5-DSpark con decodificación especulativa optimizada
Línea temporal
-
Liquid AI logra aceleración de hasta 3,2x en inferencia con LFM2.5-DSpark
Liquid AI ha publicado modelos de decodificación especulativa (DSpark) para su serie LFM2.5, logrando mejoras de velocidad de hasta 3,2x en inferencia. Los modelos draft tienen aproximadamente 300M de parámetros y…